Astra được cho là có thể phát hiện nhiều lỗ hổng bảo mật hơn các mô hình tiên tiến nhất hiện nay của OpenAI, trong khi cần ít tài nguyên tính toán hơn. "Với các công cụ và quyền truy cập phù hợp, Astra có thể tìm ra những lỗ hổng bảo mật chưa từng được biết đến và phát triển phương thức khai thác chúng trên nhiều hệ thống được bảo vệ tốt mà không cần con người hướng dẫn từng bước", bà Amelia Glaese, Phó chủ tịch phụ trách an toàn của OpenAI, cho biết ngày 1.9.

OpenAI tăng kiểm soát với mô hình AI sắp ra mắt
Ảnh: Reuters
OpenAI dự kiến sớm cung cấp Astra cho một nhóm người dùng hạn chế. Đây là mô hình đầu tiên của hãng chạm ngưỡng buộc phải áp dụng tầng bảo vệ nghiêm ngặt hơn theo khuôn khổ an toàn nội bộ.
Theo quy trình an toàn của OpenAI, hãng sẽ kích hoạt các lớp bảo vệ đối với các mô hình có thể phát hiện, khai thác lỗ hổng an ninh mạng mới hoặc tự lập kế hoạch và thực hiện một chiến lược tấn công phức tạp với rất ít hoặc không cần con người can thiệp.
Hãng cho biết đã điều chỉnh Astra nhằm hạn chế khả năng đáp ứng các yêu cầu tấn công mạng độc hại, đồng thời sẽ giám sát hoạt động của mô hình để phát hiện dấu hiệu vượt qua các lớp bảo vệ. OpenAI hiện đối mặt sự giám sát ngày càng lớn về cách kiểm soát những hệ thống AI ngày một mạnh hơn.
Bình luận (0)