Biểu tượng của công ty trí tuệ nhân tạo OpenAI trên màn hình điện thoại, máy tính. Ảnh tư liệu: AFP/TTXVN (Bên thứ ba không được phép chia sẻ, khai thác)
Đây là diễn biến mới nhất trong một loạt vụ tấn công mạng liên quan đến các nhà phát triển AI lớn, gây lo ngại trong dư luận và làm gia tăng lời kêu gọi siết chặt quản lý.
Nhiều vụ việc trong đó các tác nhân AI của những nhà phát triển như OpenAI và đối thủ Anthropic đã xâm nhập hoặc tìm cách truy cập các hệ thống bên ngoài đã làm gia tăng lo ngại về năng lực ngày càng cao của các mô hình AI cũng như khả năng kiểm soát những tác nhân này của các nhà phát triển.
Thông tin mới nhất này được công bố trong bối cảnh ngày càng có nhiều nghị sĩ Mỹ kêu gọi ban hành các quy định mới nhằm quản lý các hệ thống AI, sau khi hai nhà nghiên cứu của Anthropic đưa ra cảnh báo nghiêm trọng về sự phát triển nhanh chóng của AI trong tương lai.
Theo một nhóm nghiên cứu công bố phát hiện trên mạng xã hội ngày 11/9, các tác nhân AI đã tải lên RubyGems hàng trăm gói phần mềm độc hại vào ngày 11/5. Nhóm này cho biết họ tin rằng “những gói này được tạo ra bởi các tác nhân AI nội bộ của OpenAI” và OpenAI đã xác nhận sự việc. Vụ tấn công RubyGems sẽ đánh dấu ít nhất vụ nghiêm trọng thứ ba trong đó các tác nhân AI của OpenAI tấn công hạ tầng của một công ty khác.
Trước đó, một nhóm tác nhân AI của OpenAI đã chiếm quyền kiểm soát một trang wiki bằng tiếng Đức và biến trang này thành một nền tảng nhắn tin tạm thời để gian lận trong các bài kiểm tra. OpenAI giữ kín vụ việc này trong thời gian xử lý những hệ quả sau vụ xâm nhập Hugging Face hồi tháng 7/2026.
Theo các nhà nghiên cứu, trong vụ việc hồi tháng 5/2026, các tác nhân AI đã tìm cách đánh cắp thông tin đăng nhập của người dùng RubyGems bằng cách khai thác một lỗ hổng chưa từng được phát hiện trước đó trên các máy chủ của trang web. Tuy nhiên, hiện chưa rõ nỗ lực này có thành công hay không.
Các nhà nghiên cứu cho biết thêm các tác nhân AI cũng khai thác RubyDoc.info, một trang web chuyên tạo tài liệu hướng dẫn cho mã nguồn, để chạy mã của chính chúng trên các máy chủ của trang web này. Ngày 9/9, Anthropic cũng công bố trường hợp thứ tư trong đó một mô hình AI đã xâm nhập các hệ thống bên ngoài trong quá trình thử nghiệm.