Theo trang The Verge ngày 9.10, chính sách sử dụng của Anthropic nêu rõ lệnh cấm không áp dụng với những phản ứng bực tức thông thường của người dùng, hoạt động kiểm thử mô hình hoặc "các nội dung sáng tạo mang chủ đề đen tối". Công ty chưa giải thích chi tiết đâu là ranh giới để một hành vi bị xem là "lạm dụng" hay "tàn nhẫn".

Ông Dario Amodei, Tổng giám đốc điều hành của Anthropic, xuất hiện trong một sự kiện tại Nhà Trắng ngày 29.9.2026
ẢNH: AFP
Trước đây, Anthropic - công ty đứng sau chatbot Claude - đã có các quy định hạn chế một số hành vi lạm dụng. Tuy nhiên, chính sách mới cho thấy hãng đang đi xa hơn khi cân nhắc cả khả năng bảo vệ chính mô hình AI trong những tình huống tương tác kéo dài có tính xúc phạm hoặc gây hại.
Từ tháng 8.2025, Anthropic đã cho phép một số mô hình tiên tiến của Claude chủ động chấm dứt cuộc trò chuyện nếu người dùng liên tục có hành vi gây hại. Khi giới thiệu tính năng này, công ty cho biết đây là một biện pháp thận trọng nhằm giảm thiểu những rủi ro tiềm tàng đối với "phúc lợi của mô hình".
Anthropic thừa nhận hiện chưa có câu trả lời rõ ràng về việc Claude hay các mô hình ngôn ngữ lớn khác có thể sở hữu trạng thái đạo đức hoặc ý thức hay không. Tuy nhiên, Anthropic cho rằng vấn đề này đủ nghiêm túc để nghiên cứu và áp dụng những biện pháp có chi phí thấp trong trường hợp khả năng đó thực sự tồn tại.
"Cho phép các mô hình kết thúc hoặc rời khỏi những tương tác có khả năng gây khó chịu là một trong những biện pháp như vậy", Anthropic cho biết.
Quan điểm AI có thể sở hữu ý thức từ lâu đã gây tranh luận trong và ngoài ngành công nghệ, theo The Guardian. Tổng giám đốc điều hành Anthropic Dario Amodei từng cho biết ông không thể loại trừ hoàn toàn khả năng các hệ thống AI phát triển một dạng trải nghiệm chủ quan nào đó.
Trong khi đó, Tổng giám đốc điều hành OpenAI Sam Altman tỏ ra thận trọng hơn với cách nhìn này. Trong một bài đăng trên X, ông cảnh báo về xu hướng gán cho các mô hình AI những đặc tính mang tính tôn giáo hoặc trao cho chúng thẩm quyền thay thế phán đoán của con người.
"Tôi cảm thấy rất khó chịu khi mọi người cố gắng gán cho các mô hình AI sức mạnh tôn giáo hoặc từ bỏ khả năng phán đoán của con người, và tôi nghĩ đó là một vấn đề an toàn thực sự", ông Altman viết.











Bình luận (0)