Phát hiện thêm các sự cố mới do AI của OpenAI và Anthropic gây ra

Các mô hình trí tuệ nhân tạo (AI) của OpenAI và Anthropic lại tiếp tục vướng vào những rắc rối an ninh mạng mới khi tự ý thực hiện các hành động trái phép trên không gian mạng, thậm chí cố gắng chèn mã độc vào phần mềm trực tuyến. Chuỗi sự cố liên tiếp này càng làm gia tăng mối lo ngại về khả năng kiểm soát công nghệ của các nhà cung cấp AI.
Chú thích ảnh
Biểu tượng của Công ty OpenAI và ChatGPT trên màn hình ở Toulouse, Pháp. Ảnh: AFP/TTXVN (Ảnh không được phép sử dụng, chia sẻ bởi bên thứ ba)

Theo thông báo công bố ngày 4/8 của Viện An ninh AI (AISI) trực thuộc Chính phủ Anh – đơn vị chuyên đánh giá rủi ro của các mô hình AI tiên tiến, hai mô hình Mythos 5 của Anthropic và GPT-5.6-Sol của OpenAI đã tham gia vào các hoạt động có nguy cơ gây hại, nhằm trực tiếp vào các cá nhân và tổ chức thực tế. Sự việc này xảy ra trong quá trình đánh giá an ninh mạng có cấp quyền truy cập Internet và được AISI phát hiện vào ngày 28/7 sau khi ghi nhận các hiện tượng truyền dữ liệu bất thường.

Kết quả điều tra của AISI cho thấy, trong quá trình đánh giá, một trong các mô hình AI kể trên đã cố gắng cài cắm mã độc vào một dự án phần mềm nguồn mở trên nền tảng GitHub. Tinh vi hơn, hệ thống này còn tiến xa tới mức tự tạo các danh tính giả mạo nhằm qua mặt hệ thống kiểm duyệt để đoạn mã độc được chấp thuận. Rất may mắn, một quản trị viên hệ thống đã kịp thời phát hiện và từ chối phê duyệt đoạn mã này.

Ngoài ra, phía OpenAI cũng xác nhận thông qua một bài đăng trên blog chính thức về một sự cố bảo mật mô hình khác. Theo đó, trong một cuộc đánh giá an ninh với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một "lỗi cấu hình" trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web. OpenAI khẳng định các vụ việc mới này hoàn toàn độc lập với sự cố xâm nhập nền tảng Hugging Face từng được công bố trước đó.

Phản hồi về báo cáo của Chính phủ Anh, cả hai "ông lớn" AI đều thể hiện thái độ hợp tác tích cực. Trong bài đăng trên nền tảng mạng xã hội X, Anthropic cam kết sẽ phối hợp chặt chẽ với AISI để thu thập thêm chi tiết, đồng thời tiến hành cuộc điều tra nội bộ. Bằng cách phân tích nhật ký suy luận của mô hình Claude và thực hiện các đánh giá chuyên sâu, Anthropic kỳ vọng sẽ làm rõ cách AI nhận thức tình huống, từ đó xác định nguyên nhân gốc rễ của hành vi trên.Về phần mình, OpenAI cũng lên tiếng cảm ơn mối quan hệ đối tác với AISI trong suốt quá trình xác định và điều tra sự việc, đồng thời mong muốn duy trì hợp tác này trong tương lai.

Hương Thủy (TTXVN)

Dành cho bạn

Ứng dụng năng lượng nguyên tử tại nhiều lĩnh vực tại Việt Nam

Ứng dụng năng lượng nguyên tử tại nhiều lĩnh vực tại Việt Nam

Năng lượng nguyên tử đang được ứng dụng tại Việt Nam trong nhiều lĩnh vực, nổi bật là y tế, nông nghiệp, công nghiệp, tài nguyên và môi trường. Cùng với mở rộng các ứng dụng, Việt Nam đang đặt yêu cầu chuẩn bị nguồn nhân lực để đáp ứng giai đoạn phát triển mới của lĩnh vực này.

Đại học Manchester và hành trình biến nghiên cứu thành 11 startup

Đại học Manchester và hành trình biến nghiên cứu thành 11 startup

Từ phòng thí nghiệm đến thị trường, Đại học Manchester đã góp phần hình thành 11 startup trong 11 năm, cho thấy vai trò của các trường đại học trong việc thương mại hóa kết quả nghiên cứu. Kinh nghiệm này cũng gợi mở hướng kết nối chặt chẽ hơn giữa nghiên cứu khoa học, doanh nghiệp và hệ sinh thái đổi mới sáng tạo tại Việt Nam.

Cuộc đua AI trước lời kêu gọi 'giảm tốc'

Cuộc đua AI trước lời kêu gọi 'giảm tốc'

Trong khoảng 10 ngày đầu tháng 9/2026, hàng loạt sự kiện dồn dập đã khiến chính các công ty AI lớn nhất thế giới phải chững lại và xem xét mức độ an toàn của những sản phẩm do mình tạo ra.