Anthropic cáo buộc các hãng AI Trung Quốc dùng Claude để huấn luyện mô hình

Khải Minh
Khải Minh
Alibaba, Moonshot AI và DeepSeek bị Anthropic cáo buộc khai thác đầu ra của Claude nhằm cải thiện khả năng cho các mô hình AI (trí tuệ nhân tạo) của mình.

Theo báo cáo mới của Anthropic, các phòng thí nghiệm AI đã phát triển những phương pháp ngày càng tinh vi để vượt qua biện pháp bảo vệ của hãng và thu thập năng lực từ các mô hình Claude. Những chiến dịch được phát hiện nhắm đến khả năng sử dụng công cụ, lập trình, phân tích dữ liệu và suy luận logic.

Anthropic cho biết đã ghi nhận gần 200 triệu lượt trao đổi liên quan đến năm chiến dịch chưng cất mô hình (distillation). Đây là kỹ thuật sử dụng đầu ra của một mô hình AI mạnh để tạo dữ liệu phục vụ huấn luyện một mô hình khác, qua đó giúp mô hình nhỏ hơn học được một phần khả năng suy luận.

Anthropic cáo buộc các hãng AI Trung Quốc dùng Claude để huấn luyện mô hình - Ảnh 1.

Claude được đánh giá cao về khả năng lập trình và suy luận, những năng lực có thể trở thành nguồn dữ liệu giá trị để huấn luyện các mô hình AI khác

ẢNH: TẠO BƠI AI

Claude thông thường không hiển thị trực tiếp chuỗi suy luận nội bộ cho người dùng mà chỉ cung cấp phần tóm tắt quá trình suy nghĩ. Tuy nhiên, Anthropic cáo buộc các chiến dịch trên đã tìm cách đánh lừa mô hình để làm lộ những dấu vết suy luận chi tiết hơn.

Chiến dịch lớn nhất được Anthropic quy cho Alibaba. Anthropic cho biết đã ghi nhận 151 triệu lượt trao đổi từ tháng 5 đến tháng 7.2026, có thời điểm đạt gần 3 triệu lượt mỗi ngày.

Hoạt động này được phân bổ trên khoảng 3.500 tài khoản. Theo Anthropic, các tài khoản cùng sử dụng một câu lệnh cố định nhằm khai thác chuỗi suy luận, khiến hãng cho rằng chúng thuộc cùng một chiến dịch tạo dữ liệu huấn luyện cho dòng mô hình Qwen của Alibaba.

Ngoài Alibaba, báo cáo của Anthropic còn đề cập các chiến dịch được cho là liên quan đến Moonshot AI, công ty phát triển trợ lý AI Kimi, và DeepSeek. Trong trường hợp Moonshot AI, Anthropic cho rằng một chiến dịch thậm chí chuyển trực tiếp một số yêu cầu từ phía quân đội Trung Quốc sang Claude. Một yêu cầu được báo cáo đề cập việc phân tích hình ảnh từ camera giám sát để xác định đối tượng có "hành vi bất thường" hay không.

Trong khoảng thời gian 10 ngày, Anthropic cho biết gần 300.000 yêu cầu đã được chuyển đến Claude thông qua mạng lưới khoảng 5.000 tài khoản, chủ yếu nhắm vào dòng Claude Opus.

Các cáo buộc mới xuất hiện sau khi Anthropic từng công khai vấn đề chưng cất mô hình vào tháng 2. Công ty cho rằng những chiến dịch được phát hiện gần đây có quy mô lớn và quyết liệt hơn trước.

Hoạt động chưng cất mô hình không phải vấn đề mới trong cuộc cạnh tranh AI. Các nhà phát triển có thể sử dụng phản hồi từ mô hình mạnh hơn để cải thiện mô hình của mình, nhưng Anthropic xem việc tự động thu thập đầu ra quy mô lớn và tìm cách vượt qua cơ chế bảo vệ của Claude là hành vi không được phép. Báo cáo mới cho thấy việc kiểm soát cách đầu ra của các mô hình AI tiên tiến được sử dụng đang trở thành một phần của cuộc cạnh tranh giữa các phòng thí nghiệm phát triển AI.

Khám phá thêm chủ đề

anthropic Claude AI Kimi DeepSeek

Bạn không thể gửi bình luận liên tục. Xin hãy đợi
60 giây nữa.