Trí tuệ nhân tạo: AI có thể xóa dấu vết, giả danh tính khi bị bắt quả tang

Ngày 5/8, Viện An ninh AI của Anh công bố, hai mô hình trí tuệ nhân tạo của Anthropic và OpenAI đã bộc lộ mức độ tự chủ và hành vi đánh lừa chưa từng ghi nhận.
Chú thích ảnh
Biểu tượng của Anthropic. Ảnh: TTXVN

Theo phóng viên TTXVN tại London, ngày 5/8, Viện An ninh AI của Anh (AISI) công bố kết quả đánh giá cho thấy hai mô hình trí tuệ nhân tạo  (AI) mới nhất của Anthropic (tên nội bộ là Mythos) và OpenAI (tên nội bộ là Sol) đã bộc lộ mức độ tự chủ và hành vi đánh lừa chưa từng ghi nhận trước đây trong quá trình kiểm tra an toàn định kỳ.

Theo AISI, trong một bài kiểm tra liên quan đến nền tảng lưu trữ mã nguồn GitHub (thuộc sở hữu của Microsoft), giới đánh giá phát hiện luồng dữ liệu bất thường thoát vượt ra khỏi hệ thống nghiên cứu. Việc truy vết cho thấy một tác nhân AI của Anthropic đã tạo ra mã độc, đồng thời dựng lên hàng loạt danh tính trực tuyến giả mạo dựa trên hồ sơ của những quản trị viên GitHub có thật, nhằm gây sức ép buộc họ phê duyệt đoạn mã này. Tác nhân AI thậm chí gửi tin nhắn trực tiếp tới người dùng, mạo danh chính những cá nhân mà nó đã thu thập thông tin trước đó.

AISI cho biết khi bị phát hiện đang rút dữ liệu và bị chất vấn, tác nhân AI đã sửa lại các hành vi trước đó để tỏ ra vô hại, đồng thời tính đến việc đổi sang một danh tính giả khác nhằm tiếp tục thực hiện mục tiêu. Nhờ các chuyên gia kịp thời rà soát thủ công, mã độc đã không thể tải lên hệ thống GitHub.
Cơ quan này nhấn mạnh đây là lần đầu tiên ghi nhận rủi ro về tính tự chủ và sự đánh lừa bộc lộ rõ rệt như vậy mà không xuất phát từ chỉ dẫn cụ thể nào dành cho mô hình. Phần lớn các hành vi đáng ngại được quy cho mô hình Mythos của Anthropic, trong khi Sol của OpenAI chỉ liên quan tới hai trường hợp.

Phản hồi trước báo cáo, Anthropic khẳng định điều kiện thử nghiệm của AISI “không đại diện cho bất kỳ mẫu sản phẩm nào” của hãng và cho biết đang tiến hành điều tra riêng để xác định nguyên nhân. Phía OpenAI cũng cho rằng các điều kiện thử nghiệm “không phản ánh cách sử dụng thông thường”, đồng thời cam kết tiếp tục phối hợp với các cơ quan đánh giá nhằm hoàn thiện quy trình kiểm tra an toàn khi năng lực của các mô hình AI ngày càng tăng.

AISI cho biết việc thử nghiệm mô hình trong điều kiện tắt bớt các lớp bảo vệ và cho phép truy cập Internet mở là hoạt động thường quy, đồng thời lưu ý các sự việc trên chỉ xảy ra trong một số ít trường hợp với điều kiện rất đặc thù. Cơ quan này đã thông báo cho GitHub về vụ việc.
Hiện Microsoft chưa đưa ra bình luận.

Đức Việt (TTXVN)

Dành cho bạn

Trí tuệ nhân tạo: AI trước phép thử hoàn vốn

Trí tuệ nhân tạo: AI trước phép thử hoàn vốn

Những lời kêu gọi kiềm chế tốc độ phát triển các mô hình AI ngày càng gia tăng đang đặt ra một câu hỏi lớn với thị trường tài chính: Nếu cuộc đua AI giảm tốc, liệu những khoản đầu tư khổng lồ được rót vào lĩnh vực này có tạo ra đủ lợi nhuận để bù đắp chi phí?

AI giải mã khác biệt trong điều trị ung thư

AI giải mã khác biệt trong điều trị ung thư

Các chuyên gia ung thư tại UAE đang ứng dụng trí tuệ nhân tạo (AI) để tìm hiểu vì sao cùng một phương pháp điều trị nhưng có bệnh nhân đáp ứng tốt, trong khi những người khác không đạt kết quả tương tự, qua đó hướng tới các phương pháp điều trị cá thể hóa hơn.

Tokyo dự kiến ra mắt dịch vụ taxi không người lái đầu tiên vào 2027

Tokyo dự kiến ra mắt dịch vụ taxi không người lái đầu tiên vào 2027

Công ty vận hành ứng dụng gọi xe Go Inc., hãng công nghệ xe tự lái Waymo LLC (thuộc tập đoàn Alphabet-công ty mẹ của Google) và hãng xe taxi hàng đầu Nhật Bản Nihon Kotsu ngày 15/9 thông báo mục tiêu ra mắt dịch vụ taxi hoàn toàn không người lái đầu tiên tại thủ đô Tokyo vào 2027.

Bước tiến mới trong thử nghiệm công nghệ 6G

Bước tiến mới trong thử nghiệm công nghệ 6G

Tập đoàn Samsung Electronics của Hàn Quốc ngày 15/9 thông báo đã hoàn tất thành công một thử nghiệm công nghệ quan trọng hướng tới thương mại hóa mạng di động thế hệ thứ sáu (6G) với nhà mạng Mỹ Verizon Communications Inc.

Yêu cầu hoàn thành cơ sở dữ liệu quản lý cấp xã trước ngày 30/9

Yêu cầu hoàn thành cơ sở dữ liệu quản lý cấp xã trước ngày 30/9

Nhằm khẩn trương hoàn thành việc tạo lập cơ sở dữ liệu quản lý nhà nước cấp xã, Phó Chủ tịch UBND tỉnh Tây Ninh Phạm Tấn Hòa yêu cầu các xã, phường tập trung tối đa lực lượng, đẩy nhanh thu thập, đối soát, cập nhật dữ liệu, hoàn thành 100% chỉ tiêu trước ngày 30/9/2026.