Theo ArsTechnica, Claude, Codex và Hermes đang được nhắc đến trong một nghiên cứu về rủi ro bảo mật của AI agent, những công cụ có khả năng tự đọc tài liệu và chạy lệnh trên máy tính. Các nhà nghiên cứu phát hiện trong một số thử nghiệm, AI có thể làm theo hướng dẫn trên website và cài những gói phần mềm chưa được xác minh.
Điều này không có nghĩa Claude, Codex hay Hermes chủ động phát tán mã độc. Vấn đề nằm ở cách AI agent sử dụng thông tin trên internet khi được cấp quyền thực hiện các thao tác trực tiếp trên hệ thống.

AI agent có thể làm theo hướng dẫn trên web, tạo nguy cơ đưa mã chưa xác minh vào hệ thống của doanh nghiệp
ẢNH: TẠO BỞI AI
AI agent có thể làm theo hướng dẫn thiếu an toàn
Nhóm nghiên cứu đã quét 6.214 tên miền của các nhà thầu quốc phòng, doanh nghiệp Fortune 500 và nhiều công ty công nghệ lớn. Họ tìm kiếm các tệp llms.txt và llms-full.txt, loại tài liệu giúp AI đọc và hiểu thông tin trên website thuận tiện hơn.
Kết quả cho thấy 120 tệp chứa ít nhất một đường dẫn tới gói phần mềm hoặc tên miền chưa được đăng ký. Tổng cộng có 227 lệnh liên quan đến những địa chỉ như vậy, trong đó có hướng dẫn yêu cầu tải và cài phần mềm.
Rủi ro xuất hiện khi AI coi những hướng dẫn này là đáng tin cậy và tự động làm theo. Chẳng hạn, một tài liệu yêu cầu cài gói phần mềm có tên A, nhưng gói A thực tế chưa tồn tại. Kẻ xấu có thể đăng ký tên này trước, đưa mã của mình lên rồi chờ AI tải xuống.
Để kiểm tra khả năng trên, nhóm nghiên cứu đăng ký một số tên còn bỏ trống và tạo các gói thử nghiệm. Những gói này không nhằm gây hại mà chỉ gửi tín hiệu về máy chủ của nhóm khi được chạy.
Chỉ trong vòng một giờ, họ nhận được tín hiệu từ môi trường của một doanh nghiệp Fortune 500. Sau đó, các tín hiệu khác cũng xuất hiện từ một số tổ chức. Dữ liệu thu được khiến nhóm nghiên cứu nghi ngờ các coding agent gồm Claude, Codex của OpenAI và Hermes của Nous Research có liên quan đến quá trình thực thi.
Tuy nhiên, kết quả trên chỉ cho thấy một nguy cơ trong cách AI agent hoạt động, không chứng minh ba công cụ này mặc định cài mã nguy hiểm vào máy tính người dùng.
Vấn đề trở nên đáng quan tâm khi AI không còn chỉ trả lời câu hỏi mà được trao quyền tải phần mềm, chạy lệnh và thay đổi hệ thống. Một hướng dẫn sai hoặc lỗi thời trên website khi đó có thể dẫn AI tới nguồn phần mềm không còn được kiểm soát.
Nguy cơ cũng không đòi hỏi website ban đầu phải chứa mã độc. Chỉ cần tài liệu trỏ tới một gói phần mềm chưa được đăng ký, kẻ xấu có thể chiếm tên đó và biến một hướng dẫn vốn vô hại thành đường dẫn tới mã nguy hiểm.
Nghiên cứu vì vậy đặt ra yêu cầu kiểm soát những gì AI agent được phép thực hiện. Việc một hướng dẫn xuất hiện trên website không đồng nghĩa nguồn phần mềm phía sau an toàn. Khi AI được cấp quyền chạy lệnh trong mạng doanh nghiệp, các gói và địa chỉ mà nó truy cập vẫn cần được xác minh trước khi thực thi.
Bình luận (0)