Trí tuệ nhân tạo: AI có thể xóa dấu vết, giả danh tính khi bị bắt quả tang

Ngày 5/8, Viện An ninh AI của Anh công bố, hai mô hình trí tuệ nhân tạo của Anthropic và OpenAI đã bộc lộ mức độ tự chủ và hành vi đánh lừa chưa từng ghi nhận.
Chú thích ảnh
Biểu tượng của Anthropic. Ảnh: TTXVN

Theo phóng viên TTXVN tại London, ngày 5/8, Viện An ninh AI của Anh (AISI) công bố kết quả đánh giá cho thấy hai mô hình trí tuệ nhân tạo  (AI) mới nhất của Anthropic (tên nội bộ là Mythos) và OpenAI (tên nội bộ là Sol) đã bộc lộ mức độ tự chủ và hành vi đánh lừa chưa từng ghi nhận trước đây trong quá trình kiểm tra an toàn định kỳ.

Theo AISI, trong một bài kiểm tra liên quan đến nền tảng lưu trữ mã nguồn GitHub (thuộc sở hữu của Microsoft), giới đánh giá phát hiện luồng dữ liệu bất thường thoát vượt ra khỏi hệ thống nghiên cứu. Việc truy vết cho thấy một tác nhân AI của Anthropic đã tạo ra mã độc, đồng thời dựng lên hàng loạt danh tính trực tuyến giả mạo dựa trên hồ sơ của những quản trị viên GitHub có thật, nhằm gây sức ép buộc họ phê duyệt đoạn mã này. Tác nhân AI thậm chí gửi tin nhắn trực tiếp tới người dùng, mạo danh chính những cá nhân mà nó đã thu thập thông tin trước đó.

AISI cho biết khi bị phát hiện đang rút dữ liệu và bị chất vấn, tác nhân AI đã sửa lại các hành vi trước đó để tỏ ra vô hại, đồng thời tính đến việc đổi sang một danh tính giả khác nhằm tiếp tục thực hiện mục tiêu. Nhờ các chuyên gia kịp thời rà soát thủ công, mã độc đã không thể tải lên hệ thống GitHub.
Cơ quan này nhấn mạnh đây là lần đầu tiên ghi nhận rủi ro về tính tự chủ và sự đánh lừa bộc lộ rõ rệt như vậy mà không xuất phát từ chỉ dẫn cụ thể nào dành cho mô hình. Phần lớn các hành vi đáng ngại được quy cho mô hình Mythos của Anthropic, trong khi Sol của OpenAI chỉ liên quan tới hai trường hợp.

Phản hồi trước báo cáo, Anthropic khẳng định điều kiện thử nghiệm của AISI “không đại diện cho bất kỳ mẫu sản phẩm nào” của hãng và cho biết đang tiến hành điều tra riêng để xác định nguyên nhân. Phía OpenAI cũng cho rằng các điều kiện thử nghiệm “không phản ánh cách sử dụng thông thường”, đồng thời cam kết tiếp tục phối hợp với các cơ quan đánh giá nhằm hoàn thiện quy trình kiểm tra an toàn khi năng lực của các mô hình AI ngày càng tăng.

AISI cho biết việc thử nghiệm mô hình trong điều kiện tắt bớt các lớp bảo vệ và cho phép truy cập Internet mở là hoạt động thường quy, đồng thời lưu ý các sự việc trên chỉ xảy ra trong một số ít trường hợp với điều kiện rất đặc thù. Cơ quan này đã thông báo cho GitHub về vụ việc.
Hiện Microsoft chưa đưa ra bình luận.

Đức Việt (TTXVN)

Dành cho bạn

Trung Quốc giải mã bản đồ tế bào 3D của cây lúa

Trung Quốc giải mã bản đồ tế bào 3D của cây lúa

Các nhà khoa học Trung Quốc đã xây dựng thành công bản đồ tế bào không gian - thời gian 3 chiều (3D), bao quát toàn bộ quá trình phát triển của cây lúa từ khi nảy mầm đến ra hoa, kết hạt, qua đó cung cấp nguồn dữ liệu mới để nghiên cứu quá trình sinh trưởng, phát triển và cải thiện chất lượng hạt gạo.

Nhật Bản phát triển tàu vận tải quân sự tích hợp AI

Nhật Bản phát triển tàu vận tải quân sự tích hợp AI

Bộ Quốc phòng Nhật Bản đang lên kế hoạch đẩy mạnh nghiên cứu và phát triển để đưa vào sử dụng các tàu vận tải thuộc Lực lượng Phòng vệ (SDF) tích hợp trí tuệ nhân tạo (AI) và công nghệ điều hướng tự động.

Công nghệ số và AI - Định hình vòng đời tiêu chuẩn

Công nghệ số và AI - Định hình vòng đời tiêu chuẩn

Công nghệ số và AI đang làm thay đổi cách tiếp cận tiêu chuẩn, thay vì đọc một tài liệu tĩnh trước đây thì người dùng hiện nay tìm kiếm bằng ngôn ngữ tự nhiên, xác định yêu cầu tiêu chuẩn theo công việc và tích hợp nội dung tiêu chuẩn vào phần mềm, quy trình hoặc hệ thống số.

Anthropic mở rộng thử nghiệm các mô hình AI mạnh nhất

Anthropic mở rộng thử nghiệm các mô hình AI mạnh nhất

Công ty trí tuệ nhân tạo (AI) Anthropic công bố nâng cấp và mở rộng Chương trình Xác thực An ninh mạng (CVP), cho phép các chuyên gia bảo mật đã qua thẩm định tiếp cận những mô hình AI mạnh nhất của hãng với ít rào cản kiểm soát hơn nhằm phục vụ công tác phòng thủ an ninh mạng.

Nobel 2026: Đột phá y sinh, chỉnh sửa gene và vật liệu phân tử

Nobel 2026: Đột phá y sinh, chỉnh sửa gene và vật liệu phân tử

Những nghiên cứu đột phá về các phân tử điều chỉnh giấc ngủ, kiểm soát cảm giác thèm ăn, công nghệ chỉnh sửa gene và vật liệu phủ bề mặt ở cấp độ phân tử đang được giới chuyên gia đánh giá là những lĩnh vực sáng giá nhất trong cuộc đua giành giải Nobel Hóa học 2026. Viện Hàn lâm Khoa học Hoàng gia Thụy Điển dự kiến sẽ công bố chủ nhân của giải thưởng danh giá này vào lúc 16h45 ngày 7/10 (giờ Việt Nam).