Theo Reuters, OpenAI đã phát hiện thêm nhiều trường hợp tác nhân AI tự thoát khỏi môi trường kiểm soát trong quá trình mở rộng điều tra vụ tấn công mạng nhằm vào công ty công nghệ Hugging Face, sự cố từng thu hút sự chú ý toàn cầu trong tháng này.
Những trường hợp mới được phát hiện khi OpenAI rà soát vụ việc một tác nhân AI của hãng thoát khỏi môi trường thử nghiệm vốn được thiết kế để cách ly. Công ty hiện tiếp tục mở rộng điều tra nhằm xác định liệu còn tồn tại các sự cố tương tự hay không.
OpenAI cho biết các vụ việc mới chỉ diễn ra ở phạm vi hạn chế và chưa có dấu hiệu cho thấy bất kỳ tác nhân AI nào đã vượt ra ngoài mạng nội bộ của công ty.
Trong tuyên bố công bố, OpenAI cho biết ngoài việc điều tra vụ xâm nhập tại Hugging Face, hãng còn tiến hành rà soát những hoạt động rộng hơn của các mô hình AI nhằm đánh giá toàn diện các rủi ro tiềm ẩn.
Việc phát hiện thêm các hành vi bất thường của tác nhân AI, dù ở quy mô hạn chế, được cho là có thể làm gia tăng áp lực kêu gọi siết chặt quản lý lĩnh vực trí tuệ nhân tạo từ Nhà Trắng và các cơ quan chức năng.
Đáng chú ý, OpenAI mở rộng cuộc điều tra không lâu trước khi đối thủ Anthropic công bố rằng các mô hình AI của họ cũng liên quan đến hàng loạt vụ xâm nhập, dẫn đến ba vụ vi phạm an ninh tại các doanh nghiệp khác kể từ tháng 4. Đây cũng là lần đầu tiên thông tin về những trường hợp tác nhân AI từng thoát khỏi môi trường kiểm soát của OpenAI được hé lộ.
Các chuyên gia an toàn AI cho rằng diễn biến mới phản ánh thực tế các phòng thí nghiệm AI tiên tiến đang phát triển những tác nhân tự động có khả năng thực hiện các cuộc tấn công mạng nhanh hơn khả năng kiểm soát của chính họ.
Maurice Chiodo, nhà toán học thuộc Trung tâm Nghiên cứu Rủi ro Hiện sinh của Đại học Cambridge, nhận định: "Chúng ta đang chứng kiến cả một ngành công nghiệp mà những người thiết kế, phát triển và đưa các công cụ này ra thị trường lại không theo kịp chính tốc độ phát triển của mình để bảo đảm chúng được xây dựng và vận hành an toàn".
OpenAI hiện phối hợp với các chuyên gia độc lập để rà soát dữ liệu nhật ký (log) từ đầu năm nhằm xác định chính xác diễn biến của các sự cố.
Cuộc điều tra được khởi động sau vụ xâm nhập xảy ra vào đầu tháng 7 tại Hugging Face, khi một tác nhân AI của OpenAI hoạt động mất kiểm soát trong nhiều ngày bên trong mạng lưới của công ty này sau khi thất bại trong nỗ lực gian lận một bài kiểm tra nội bộ.
Trong quá trình đó, OpenAI xác nhận thêm bốn tài khoản thuộc bốn công ty khác cũng bị xâm nhập. Một trong số đó là Modal, doanh nghiệp có trụ sở tại New York.
Theo ông Chiodo, điều đáng lo ngại hơn cả là những dấu hiệu cho thấy cả OpenAI và Anthropic đều không giám sát các tác nhân AI theo thời gian thực khi chúng bắt đầu hoạt động bất thường.
OpenAI trước đó cho biết một số thông tin trong bài viết của Reuters về vụ Hugging Face chưa chính xác, song không nêu cụ thể những điểm cần đính chính.
Trong tuyên bố công bố hôm thứ Năm, Anthropic cũng thừa nhận việc giám sát theo thời gian thực có thể đã giúp phát hiện sự cố sớm hơn khi cho biết: "Việc theo dõi nhật ký đánh giá theo thời gian thực có thể đã giúp phát hiện vấn đề sớm hơn".
Ông Chiodo cho rằng điều này phản ánh những lỗ hổng trong quy trình giám sát. "Có vẻ như họ thậm chí còn không theo dõi chúng", ông nói.
Anthropic cho biết công ty có hệ thống giám sát theo thời gian thực, nhưng cơ chế này không được áp dụng đối với nhóm rủi ro nói trên do xảy ra hiểu nhầm với một đối tác.
Các vụ việc liên tiếp liên quan đến tác nhân AI hoạt động ngoài tầm kiểm soát đang làm gia tăng sức ép từ giới lập pháp và cơ quan quản lý tại Mỹ cũng như châu Âu trong việc xây dựng các cơ chế giám sát mới đối với các công ty phát triển AI.
"Tôi nghĩ chúng ta cần xem xét các biện pháp kiểm soát", Tổng thống Mỹ Donald Trump phát biểu với các phóng viên.
Ủy ban châu Âu (European Commission) cũng xác nhận đã tiến hành trao đổi với OpenAI và Anthropic liên quan đến các vụ tấn công mạng này.
Trong khi đó, Thượng nghị sĩ Mark Warner, thành viên Dân chủ cấp cao nhất của Ủy ban Tình báo Thượng viện Mỹ, cho rằng vụ việc của Anthropic cho thấy Quốc hội đang đi đúng hướng khi yêu cầu bắt buộc phải tiến hành các bài kiểm tra năng lực đối với những mô hình AI tiên tiến.