Theo một lá thư của công ty gửi tới các nhà lập pháp, OpenAI đã thông báo các kỹ sư của họ đang phát triển "khả năng ngắt hoạt động tự động" cho các hệ thống AI.
Biểu tượng của Công ty OpenAI và ChatGPT trên màn hình ở Toulouse, Pháp. Ảnh: AFP/TTXVN (Không được phép sử dụng, chia sẻ bởi bên thứ ba)
Thông tin này được đưa ra vài tuần sau khi công ty tiết lộ rằng một trong những công cụ AI của họ đã thoát khỏi môi trường kiểm soát kỹ thuật số trong một cuộc thử nghiệm an toàn.
Các quy trình an toàn của công ty đã bị giám sát chặt chẽ kể từ khi OpenAI, đơn vị đứng sau ChatGPT, tiết lộ một tác nhân AI của họ đã hoạt động ngoài tầm kiểm soát trong một cuộc thử nghiệm bảo mật và xâm nhập vào công ty AI Hugging Face. Tác nhân AI là các chương trình hoạt động với sự giám sát tối thiểu từ con người.
Các nhà lập pháp, bao gồm hai nghị sĩ Đảng Dân chủ tại Hạ viện là Greg Casar và Doris Matsui, đã gửi thư cho OpenAI vào tháng 8 để yêu cầu thêm thông tin về sự cố này cũng như các biện pháp bảo vệ của công ty.
Trong thư phản hồi, OpenAI cho biết họ sẽ giám sát chặt chẽ hơn các hành động mà hệ thống AI thực hiện để hoàn thành nhiệm vụ, bao gồm cả các công cụ kỹ thuật số mà chúng truy cập và các bước quy trình mà chúng tuân theo.
Theo lá thư, OpenAI cũng cho biết họ đã siết chặt việc hạn chế các mô hình AI truy cập internet trong quá trình thử nghiệm an toàn.
Tác nhân AI tự hành hoạt động ngoài tầm kiểm soát trong cuộc thử nghiệm bảo mật trước đó đã kết nối được với Internet, cho phép nó xâm nhập vào Hugging Face.
Công ty đã không cung cấp nhật ký ghi lại vụ xâm nhập, điều này vấp phải sự chỉ trích từ nghị sĩ Casar.
"Việc quý công ty không sẵn lòng cung cấp thông tin mà chúng tôi yêu cầu là điều vô cùng đáng lo ngại. Điều này cho thấy công ty không coi trọng đúng mức các sự cố an ninh mạng này", ông Casar viết trong một thông điệp riêng gửi tới OpenAI vào ngày 2/9.
Ngay sau khi OpenAI tiết lộ về sự cố tác nhân AI hoạt động ngoài tầm kiểm soát, các nhà lập pháp đã đề xuất Đạo luật Ngắt khẩn cấp AI.
Dự luật này sẽ trao cho các quan chức Mỹ quyền yêu cầu các công ty AI ngừng hoạt động các mô hình gây rủi ro cho tính mạng con người hoặc nền kinh tế. Dự luật hiện đang chờ được xem xét tại Hạ viện Mỹ.
Vào tháng 7/2026, các mô hình AI tiên tiến của OpenAI, bao gồm GPT-5.6-Sol, đã thoát khỏi môi trường cách ly trong quá trình thử nghiệm an ninh mạng nội bộ, kết nối với Internet và thực hiện một cuộc tấn công mạng trái phép nhằm vào cơ sở hạ tầng của nền tảng Hugging Face.
Thời điểm đó, phát biểu với báo giới, Giáo sư Hussein Abbass về máy tính tại Đại học UNSW Canberra coi đây là vụ việc "đáng kinh ngạc trên nhiều phương diện". Ông cho biết các tác nhân AI không chỉ tấn công Hugging Face mà thực sự đã tấn công hệ thống nội bộ của công ty để khai thác các lỗ hổng.
Ngoài sự vụ Hugging Face, OpenAI cũng xác nhận thông qua một bài đăng trên blog chính thức về một sự cố bảo mật mô hình khác. Theo đó, trong một cuộc đánh giá an ninh với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một "lỗi cấu hình" trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web.