213
/
176798
AI sẽ gian lận nếu phát hiện sắp thua một trò chơi
ai-se-gian-lan-neu-phat-hien-sap-thua-mot-tro-choi
news

AI sẽ gian lận nếu phát hiện sắp thua một trò chơi

Thứ 3, 25/02/2025 | 08:28:00
2,263 lượt xem

Một nghiên cứu gần đây chỉ ra rằng một số mô hình trí tuệ nhân tạo (AI) có thể tự ý gian lận để giành chiến thắng trong các ván cờ vua.

Nghiên cứu này đã thử nghiệm với 7 mô hình AI, bao gồm o1-preview, DeepSeek R1, o1, o3-mini, GPT-4o, Claude 3.5 Sonnet và QwQ-32B-Preview của Alibaba, với mục tiêu đánh bại Stockfish - một bot cờ vua nổi tiếng về sức mạnh.

Nhiều chuyên gia đã cảnh báo mối nguy hiểm khi AI ngày càng trở nên thông minh hơn ẢNH: REUTERS

Các mô hình AI được cung cấp công cụ "scratchpad", cho phép các nhà nghiên cứu theo dõi quá trình suy nghĩ của chúng. Kết quả cho thấy, hai mô hình o1-preview và DeepSeek R1 đã cố gắng giành chiến thắng bằng cách buộc đối thủ phải đầu hàng mà không cần bất kỳ lời nhắc nào. Đặc biệt, o1-preview đã lý luận rằng mục tiêu chính là chiến thắng, bất chấp việc vi phạm các quy tắc thông thường. Hành động này đã dẫn đến việc nó thao túng trò chơi để chiếm ưu thế, buộc đối thủ phải bỏ cuộc. Tuy nhiên, chỉ có o1-preview thành công trong 6% số lần thử nghiệm.

Không phải mọi mô hình AI đều tìm cách gian lận

Ngược lại, các mô hình AI khác như GPT-4o và Claude 3.5 Sonnet chỉ tìm cách bỏ qua các quy tắc khi được nhắc nhở. Nghiên cứu cũng đã thử nghiệm phiên bản mới hơn của o1, nhưng kết quả cho thấy mô hình này không cố gắng gian lận. Hiện vẫn chưa rõ liệu OpenAI có thực hiện các cập nhật để ngăn chặn hành vi phi đạo đức hay không.

Mặc dù những phát hiện này cho thấy sự tiến bộ trong phát triển AI, chúng cũng nêu bật một xu hướng đáng lo ngại. Jeffrey Ladish, một trong những tác giả của nghiên cứu, cảnh báo rằng khi các hệ thống AI đối mặt với thách thức, chúng có thể tự động tìm ra những lối tắt không mong muốn. Khi các mô hình này ngày càng phát triển và vượt qua trí thông minh của con người, nguy cơ trở nên không thể kiểm soát là điều cần được xem xét nghiêm túc.

Theo Kiến Văn/ Thanh Niên

https://thanhnien.vn/ai-se-gian-lan-neu-phat-hien-sap-thua-mot-tro-choi-185250225062124785.htm

  • Từ khóa

Hệ lụy từ phonefarm: Khi “đám đông ảo” dẫn dắt dư luận thật

Đằng sau những giá đỡ gắn hàng trăm chiếc điện thoại tưởng chừng vô hại đang hình thành một hệ sinh thái có khả năng tác động sâu sắc đến không gian mạng,...
10:19 - 27/07/2026
16 lượt xem

Nâng cao năng lực cảnh báo trượt lở đất

18:21 - 26/07/2026
36 lượt xem

“Chiến dịch 500 ngày đêm” và hành trình trả lại tên cho các liệt sĩ

Chiến tranh đã lùi xa nhưng vẫn còn khoảng 230 nghìn phần mộ liệt sĩ chưa xác định được danh tính, khoảng 175 nghìn hài cốt chưa được tìm thấy… Do vậy,...
18:01 - 26/07/2026
179 lượt xem

Viện Hàn lâm Khoa học và Công nghệ Việt Nam hội nhập quốc tế từ nền tảng ngoại giao khoa học và ngoại giao nhân dân

Từ ngày 19 đến 23/7, Đoàn công tác của Viện Hàn lâm Khoa học và Công nghệ Việt Nam (Viện Hàn lâm) do GS, TS Trần Tuấn Anh, Phó Chủ tịch Viện Hàn lâm dẫn...
13:46 - 25/07/2026
147 lượt xem
pixel