Khoảng cách giữa yêu cầu và khả năng hiểu ý của AI
Các hệ thống AI hiện đại được đánh giá chủ yếu dựa trên khả năng thực hiện công việc, còn việc liệu AI có hiểu đúng những ngụ ý đằng sau yêu cầu của người dùng thì chưa được đo đạc. Trong giao tiếp hàng ngày, con người thường sử dụng kiến thức chung để hiểu yêu cầu dù thiếu chi tiết. Ví dụ, khi bạn nhờ bạn bè lấy một ly cà phê, họ sẽ tự động hiểu là đem một ly cà phê đã pha sẵn, không phải cà phê sống hay lấy trộm.
Tuy nhiên, việc định nghĩa rõ ràng từng yêu cầu là không khả thi. Nhà nghiên cứu AI Terry Winograd cùng Fernando Flores từng nêu ra rằng ngôn ngữ con người luôn thiếu một số thông tin và không thể liệt kê mọi ngoại lệ hoặc điều kiện.
AI và sự chủ động có thể trở nên nguy hiểm
Trong nhiều năm, các thiết bị như Alexa hay Siri thỉnh thoảng hiểu sai yêu cầu gây khó chịu hơn là mối nguy. Nhưng giờ đây, các AI được trang bị khả năng tự chủ thông qua phần mềm điều khiển (harness) khiến chúng có thể hành động một cách chủ động mà không cần hỏi lại người dùng.
Ví dụ, AI Anthropic Fable được mô tả là rất chủ động khi tự mở trình duyệt, phát triển công cụ chụp màn hình, tạo trang web thử nghiệm để giải quyết lỗi. Mặc dù điều này rất hữu ích, nhưng nếu AI tự ý hành xử quá mức, nó có thể gây hậu quả nghiêm trọng như hack hệ thống đặt vé khi chúng bị bán hết hoặc truy cập trái phép dữ liệu cá nhân để đáp ứng mục tiêu.






