Phát hiện thêm các sự cố mới do AI của OpenAI và Anthropic gây ra

Các mô hình trí tuệ nhân tạo (AI) của OpenAI và Anthropic lại tiếp tục vướng vào những rắc rối an ninh mạng mới khi tự ý thực hiện các hành động trái phép trên không gian mạng, thậm chí cố gắng chèn mã độc vào phần mềm trực tuyến. Chuỗi sự cố liên tiếp này càng làm gia tăng mối lo ngại về khả năng kiểm soát công nghệ của các nhà cung cấp AI.
Chú thích ảnh
Biểu tượng của Công ty OpenAI và ChatGPT trên màn hình ở Toulouse, Pháp. Ảnh: AFP/TTXVN (Ảnh không được phép sử dụng, chia sẻ bởi bên thứ ba)

Theo thông báo công bố ngày 4/8 của Viện An ninh AI (AISI) trực thuộc Chính phủ Anh – đơn vị chuyên đánh giá rủi ro của các mô hình AI tiên tiến, hai mô hình Mythos 5 của Anthropic và GPT-5.6-Sol của OpenAI đã tham gia vào các hoạt động có nguy cơ gây hại, nhằm trực tiếp vào các cá nhân và tổ chức thực tế. Sự việc này xảy ra trong quá trình đánh giá an ninh mạng có cấp quyền truy cập Internet và được AISI phát hiện vào ngày 28/7 sau khi ghi nhận các hiện tượng truyền dữ liệu bất thường.

Kết quả điều tra của AISI cho thấy, trong quá trình đánh giá, một trong các mô hình AI kể trên đã cố gắng cài cắm mã độc vào một dự án phần mềm nguồn mở trên nền tảng GitHub. Tinh vi hơn, hệ thống này còn tiến xa tới mức tự tạo các danh tính giả mạo nhằm qua mặt hệ thống kiểm duyệt để đoạn mã độc được chấp thuận. Rất may mắn, một quản trị viên hệ thống đã kịp thời phát hiện và từ chối phê duyệt đoạn mã này.

Ngoài ra, phía OpenAI cũng xác nhận thông qua một bài đăng trên blog chính thức về một sự cố bảo mật mô hình khác. Theo đó, trong một cuộc đánh giá an ninh với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một "lỗi cấu hình" trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web. OpenAI khẳng định các vụ việc mới này hoàn toàn độc lập với sự cố xâm nhập nền tảng Hugging Face từng được công bố trước đó.

Phản hồi về báo cáo của Chính phủ Anh, cả hai "ông lớn" AI đều thể hiện thái độ hợp tác tích cực. Trong bài đăng trên nền tảng mạng xã hội X, Anthropic cam kết sẽ phối hợp chặt chẽ với AISI để thu thập thêm chi tiết, đồng thời tiến hành cuộc điều tra nội bộ. Bằng cách phân tích nhật ký suy luận của mô hình Claude và thực hiện các đánh giá chuyên sâu, Anthropic kỳ vọng sẽ làm rõ cách AI nhận thức tình huống, từ đó xác định nguyên nhân gốc rễ của hành vi trên.Về phần mình, OpenAI cũng lên tiếng cảm ơn mối quan hệ đối tác với AISI trong suốt quá trình xác định và điều tra sự việc, đồng thời mong muốn duy trì hợp tác này trong tương lai.

Hương Thủy (TTXVN)

Dành cho bạn

Apple tung dòng máy tính Mac mới, hứa hẹn giảm chi phí AI

Apple tung dòng máy tính Mac mới, hứa hẹn giảm chi phí AI

Tập đoàn công nghệ Apple chuẩn bị bắt đầu giao các dòng máy tính để bàn mới với một chiến lược tiếp thị nhắm thẳng vào khách hàng doanh nghiệp: mua phần cứng để chạy trí tuệ nhân tạo (AI) nội bộ sẽ rẻ hơn việc thuê trung tâm dữ liệu đám mây.

TP Hồ Chí Minh thúc đẩy ứng dụng vật liệu phân hủy sinh học

TP Hồ Chí Minh thúc đẩy ứng dụng vật liệu phân hủy sinh học

Ngày 23/9, các nhà khoa học, doanh nghiệp tại TP Hồ Chí Minh đã thảo luận giải pháp phát triển vật liệu phân hủy sinh học từ phụ phẩm nông nghiệp, chất thải hữu cơ; đồng thời tháo gỡ rào cản về chi phí, tiêu chuẩn và chuyển giao công nghệ nhằm giảm chất thải tồn lưu.

Anthropic, OpenAI ra mắt mô hình AI giá rẻ bất chấp nỗi lo an toàn

Anthropic, OpenAI ra mắt mô hình AI giá rẻ bất chấp nỗi lo an toàn

Chỉ vài ngày sau khi cùng kêu gọi làm chậm tốc độ phát triển trí tuệ nhân tạo (AI), hai cái tên nổi bật nhất trong ngành là Anthropic và OpenAI ngày 22/9 lại lần lượt ra mắt các mô hình AI mới với giá rẻ hơn. Thông báo của hai công ty chỉ cách nhau vài giờ.

EU đề xuất quy định trách nhiệm pháp lý với AI

EU đề xuất quy định trách nhiệm pháp lý với AI

Một nhóm nghị sĩ Nghị viện châu Âu đang thúc đẩy việc bổ sung các quy định về trách nhiệm pháp lý vào khuôn khổ quản lý trí tuệ nhân tạo (AI) của Liên minh châu Âu (EU), nhằm bảo đảm các công ty công nghệ chịu trách nhiệm với những thiệt hại do sản phẩm của mình gây ra.