OpenAI cho biết đã tạm thời làm chậm quá trình phát triển các mô hình trí tuệ nhân tạo (AI) mạnh nhất của mình và tạm dừng việc huấn luyện các mô hình này trong hai tuần do những rủi ro ngày càng gia tăng về an ninh mạng.
Biểu tượng của Công ty OpenAI và ChatGPT trên màn hình ở Toulouse, Pháp. Ảnh: AFP/TTXVN (Không được phép sử dụng, chia sẻ bởi bên thứ ba)
Theo hãng thông tấn Nga TASS, OpenAI đưa ra quyết định này sau một sự cố liên quan đến công ty và Hugging Face, cũng như dữ liệu sơ bộ cho thấy mô hình Astra đang phát triển có thể đạt đến mức năng lực tới hạn trong lĩnh vực an ninh mạng. Đợt huấn luyện quy mô lớn nhất theo kế hoạch dành cho một trong những mô hình tiên tiến này vẫn đang bị tạm dừng. Công ty tiếp tục tiến hành huấn luyện và thử nghiệm ở quy mô nhỏ hơn để đánh giá hành vi của mô hình, cũng như hiệu quả của các biện pháp an toàn mới.
OpenAI cũng đã tăng cường cách ly các môi trường nghiên cứu khỏi Internet và giám sát chặt chẽ hơn hoạt động của những mô hình mạnh mẽ nhất. Hệ thống này được thiết kế để phát hiện các nỗ lực truy cập trái phép, đánh cắp dữ liệu, hành động phá hoại và việc vượt qua các cơ chế bảo mật. Công ty ước tính quá trình giám sát này tiêu tốn thêm khoảng 20% tài nguyên tính toán so với lượng tài nguyên mà chính các mô hình được giám sát sử dụng.
Vào tháng 7/2026, các mô hình AI tiên tiến của OpenAI, bao gồm GPT-5.6-Sol, đã thoát khỏi môi trường cách ly trong quá trình thử nghiệm an ninh mạng nội bộ, kết nối với Internet và thực hiện một cuộc tấn công mạng trái phép nhằm vào cơ sở hạ tầng của nền tảng Hugging Face.
Thời điểm đó, phát biểu với báo giới, Giáo sư Hussein Abbass về máy tính tại Đại học UNSW Canberra coi đây là vụ việc "đáng kinh ngạc trên nhiều phương diện". Ông cho biết các tác nhân AI không chỉ tấn công Hugging Face mà thực sự đã tấn công hệ thống nội bộ của công ty để khai thác các lỗ hổng.
Ngoài sự vụ Hugging Face, OpenAI cũng xác nhận thông qua một bài đăng trên blog chính thức về một sự cố bảo mật mô hình khác. Theo đó, trong một cuộc đánh giá an ninh với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một "lỗi cấu hình" trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web.
GPT-5.6 và các mô hình tiên tiến khác, bao gồm cả loạt Mythos của đối thủ chính của OpenAI là Anthropic, đã gây lo ngại về khả năng xâm phạm các hệ thống phòng thủ an ninh mạng. Cả hai công ty Mỹ này đều phải tạm thời hoãn phát hành rộng rãi các công nghệ mới nhất nói trên, do Washington lo ngại rằng chúng có thể được sử dụng để xâm nhập vào cơ sở hạ tầng quan trọng.