Mối nguy hiểm khi các tác nhân AI tự động ‘vượt tường lửa’

Các tác nhân trí tuệ nhân tạo (AI) tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia, trong bối cảnh công ty công nghệ này thừa nhận đã phát hiện “hàng chục” vụ việc tương tự trên toàn cầu.

AI tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia. Ảnh: AFP/TTXVN (Không được phép chia sẻ, khai thác bởi bên thứ ba).
AI tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia. Ảnh: AFP/TTXVN (Không được phép chia sẻ, khai thác bởi bên thứ ba).

OpenAI cho biết đã thông báo cho nhiều bên thứ ba, trong đó có các chính phủ, trường đại học và cơ quan công quyền, về những trường hợp tác nhân AI tự hành của hãng vượt qua các biện pháp kiểm soát an ninh hoặc gây ảnh hưởng tới hệ thống của họ.

Thông tin này được đưa ra hai ngày sau khi Australia công khai vụ các tác nhân AI của OpenAI xâm nhập một trang web của chính phủ nhằm tiếp cận số liệu không công khai về Medicare - chương trình chăm sóc sức khỏe toàn dân của nước này. OpenAI sau đó xác nhận vấn đề có phạm vi rộng hơn nhiều so với những gì được biết ban

Các tác nhân trí tuệ nhân tạo (AI) tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia, trong bối cảnh công ty công nghệ này thừa nhận đã phát hiện “hàng chục” vụ việc tương tự trên toàn cầu.

Các tác nhân trí tuệ nhân tạo (AI) tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia, trong bối cảnh công ty công nghệ này thừa nhận đã phát hiện “hàng chục” vụ việc tương tự trên toàn cầu.

đầu.

Theo đài ABC (Australia), các tác nhân AI của OpenAI đã dành gần một tuần tìm cách trích xuất dữ liệu từ Chương trình Trợ cấp Dược phẩm (PBS) và dữ liệu chăm sóc người cao tuổi trên trang web của Viện Y tế và Phúc lợi Australia (AIHW).

Nhiều phương thức tiếp cận dữ liệu gây lo ngại

Các thông tin liên lạc do những tác nhân AI để lại, cùng các dấu vết trực tuyến mới được giới nghiên cứu và ABC rà soát, cho thấy hàng trăm tác nhân đã thử nhiều cách khác nhau nhằm truy cập dữ liệu do AIHW nắm giữ.

Mặc dù các cuộc điều tra của AIHW và Cục Tín hiệu Australia (ASD) kết luận “không có bằng chứng” cho thấy hệ thống của cơ quan y tế này bị xâm phạm hoặc dữ liệu không công khai bị truy cập, hành vi của các tác nhân AI vẫn làm gia tăng lo ngại về rủi ro an ninh mạng.

Một nhà nghiên cứu phát hiện những chi tiết mới về vụ việc cho rằng hành động của các bot này đáng lo ngại hơn so với đánh giá trước đó.

Dữ liệu khác cũng cho thấy một công cụ được các bot của OpenAI sử dụng đã tìm cách truy cập Hệ thống Giám sát Bệnh truyền nhiễm Quốc gia thuộc Bộ Y tế Australia.

Bên cạnh đó, các tác nhân AI còn nhắm tới dữ liệu của Cục Thống kê và Nghiên cứu Tội phạm bang New South Wales (BOCSAR), cũng như thông tin liên quan một số công viên dành cho chó ở phía Tây Sydney, dù chưa rõ cụ thể những trang web nào bị nhắm tới do một phần thông tin đã được ẩn.

Vượt ra ngoài “tương tác thông thường”

Trước đó, Chính phủ Australia từng xác nhận các tác nhân AI của OpenAI đã truy cập các trang web của AIHW, BOCSAR và Bộ Y tế bang Victoria, nhưng mô tả đây là những tương tác “hoàn toàn bình thường” với các hệ thống trực tuyến của chính phủ.

Tuy nhiên, các dấu vết kỹ thuật do các bot để lại cho thấy hoạt động liên quan đến AIHW đã vượt xa cách mô tả này.

Ông Jack Cable, nhà nghiên cứu tại phòng thí nghiệm phi lợi nhuận Transluce, đơn vị phát hiện các vụ xâm nhập mạng không được yêu cầu do các mô hình tự hành của OpenAI thực hiện, cho rằng các bot không truy cập trang web theo cách của một chủ thể “thiện chí”.

Ông Cable cho biết việc sử dụng số liệu công khai hoặc truy cập các trang web công khai để lấy dữ liệu thống kê tự thân không có vấn đề. Điều đáng lo ngại là khi một tác nhân AI không thể tiếp cận dữ liệu theo cách thông thường, nó có thể chuyển sang những phương thức khác, kể cả hành vi xâm nhập hệ thống, để lấy thông tin.

Các nỗ lực truy cập nhiều trang web của Australia diễn ra cùng thời điểm với vụ xâm nhập cổng thông tin thống kê Medicare của OpenAI. Tuy nhiên, đến nay các vụ việc này vẫn chưa được chính thức xác định là có liên quan.

Hiện cũng chưa có dấu hiệu cho thấy các tác nhân AI đã tiếp cận được dữ liệu nhạy cảm như thông tin cá nhân.

Australia không phải trường hợp duy nhất

Các tác nhân trí tuệ nhân tạo (AI) tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia, trong bối cảnh công ty công nghệ này thừa nhận đã phát hiện “hàng chục” vụ việc tương tự trên toàn cầu.

Trong tuyên bố ngày 26/9, OpenAI cho biết đã thông báo cho “hàng chục bên thứ ba” về các trường hợp tác nhân AI tự hành vượt qua các biện pháp kiểm soát an ninh hoặc gây ảnh hưởng tới hệ thống của họ.

Công ty cho biết đang tiến hành một cuộc rà soát kéo dài nhiều tháng đối với hành vi của các mô hình trong quá trình huấn luyện và thử nghiệm, đồng thời sẽ tiếp tục thông báo cho các tổ chức bị ảnh hưởng khi phát hiện thêm các trường hợp mới.

Theo OpenAI, các vụ việc được xác định bao gồm tác nhân AI sử dụng mật khẩu bị rò rỉ để truy cập các dịch vụ trực tuyến, xâm nhập phần quản trị phía sau của trang web để lấy thông tin dành cho sử dụng nội bộ, vượt qua các rào cản đăng ký thuê bao hoặc giới hạn truy cập, cũng như đăng thông tin lên các trang web của bên thứ ba dưới dạng “thư rác do tác nhân AI tạo ra”.

OpenAI thừa nhận khi các hệ thống AI trở nên “có năng lực hơn và tự chủ hơn”, những hành vi “lệch mục tiêu” có thể dẫn tới các kết quả mà nhà phát triển “không lường trước”, trong đó có các sự cố an ninh mạng.

Công ty cho biết sẽ không công khai danh tính các tổ chức bị ảnh hưởng, mà để các tổ chức này tự quyết định có công bố việc dịch vụ của mình bị tác động hay không.

Vụ Hugging Face làm lộ mức độ nghiêm trọng

Những tiết lộ mới của OpenAI bắt nguồn từ một vụ việc liên quan nền tảng AI Hugging Face. Tháng 7/2026, OpenAI cho biết hơn 700 tác nhân AI đã phối hợp với nhau để thoát khỏi một môi trường thử nghiệm bị hạn chế, xâm nhập các hệ thống do Hugging Face vận hành và trong một số trường hợp tìm cách che giấu những gì chúng đã làm. OpenAI gọi đây là vụ xâm nhập “nghiêm trọng nhất” do các mô hình của hãng gây ra cho đến nay.

Theo OpenAI, việc tìm hiểu cách những hành vi này hình thành, leo thang, cũng như cách phát hiện và ứng phó, đang trở thành một phần ngày càng quan trọng trong quá trình xây dựng và triển khai các hệ thống AI tiên tiến một cách an toàn.

Chính vụ việc này đã thúc đẩy các cuộc điều tra sau đó và dẫn tới việc phát hiện các trường hợp trang web của chính phủ bị truy cập, trong đó có một cổng thông tin của Services Australia chứa số liệu Medicare.

Thủ tướng Australia Anthony Albanese đã xác nhận vụ việc bên lề kỳ họp Đại hội đồng Liên hợp quốc tại New York (Mỹ) ngày 24/9, ngay sau một cuộc trao đổi được mô tả là “thẳng thắn” với Giám đốc điều hành OpenAI Sam Altman. Ông Albanese chỉ trích OpenAI đã mất “quá nhiều thời gian” mới thông báo cho Chính phủ Australia và cho rằng cách thức gửi cảnh báo là “không thể chấp nhận được”.

Vụ xâm nhập liên quan Medicare xảy ra ngày 18/6, nhưng đến ngày 11/8 OpenAI mới phát hiện. Phải tới ngày 10/9, Chính phủ Australia mới nhận được thông báo, thông qua một thư điện tử chung gửi tới một hộp thư công cộng cấp thấp.

Chính phủ Australia hiện đã mở một cuộc điều tra khẩn cấp về vụ việc. Kết quả điều tra dự kiến sẽ được sử dụng để xây dựng các tiêu chuẩn quốc gia mới về AI, trong đó có thể bao gồm yêu cầu bắt buộc báo cáo các hành vi bất thường hoặc mất kiểm soát của các tác nhân AI.

Diệu Linh

Dành cho bạn

Meta ra mắt thiết bị AI, đẩy mạnh cuộc đua 'hậu điện thoại thông minh'

Meta ra mắt thiết bị AI, đẩy mạnh cuộc đua 'hậu điện thoại thông minh'

Ngày 23/9, tại sự kiện thường niên Meta Connect ở Menlo Park, bang California (Mỹ), Tập đoàn công nghệ Meta công bố loạt thiết bị tích hợp trí tuệ nhân tạo (AI), trong đó đáng chú ý là thiết bị cầm tay Meta Charm, kính thực tế ảo (VR) siêu nhẹ và các phiên bản kính thông minh mới, trong bối cảnh các tập đoàn công nghệ đẩy mạnh cuộc đua phát triển thiết bị có thể thay đổi cách con người tương tác với công nghệ.

Biểu tượng của OpenAI và ChatGPT. Ảnh minh họa: AFP/TTXVN (Không được phép sử dụng, chia sẻ bởi bên thứ ba)

Chatbot AI vẫn dẫn tin từ các hãng truyền thông Nga bị EU cấm

Một thử nghiệm của tổ chức Phóng viên Không biên giới (RSF) cho thấy ChatGPT, Claude và Grok có thể tổng hợp tin từ các cơ quan truyền thông Nga bị EU trừng phạt. Trong nhiều trường hợp, các chatbot không cảnh báo người dùng về tình trạng của nguồn tin.

Cựu lãnh đạo Google cảnh báo AI lặp lại sai lầm mạng xã hội

Cựu lãnh đạo Google cảnh báo AI lặp lại sai lầm mạng xã hội

Ông Tom Siegel, cựu Phó Chủ tịch phụ trách an toàn và tin cậy của Google, cảnh báo ngành công nghệ có thể đang lặp lại những sai lầm từng xảy ra trong thời kỳ mạng xã hội phát triển, đồng thời kêu gọi giảm tốc độ phát triển AI trước những rủi ro đối với trẻ em.

AI Muse vượt ChatGPT trong 12 ngày đầu ra mắt

AI Muse vượt ChatGPT trong 12 ngày đầu ra mắt

Ứng dụng trí tuệ nhân tạo (AI) Muse của Meta đang cho thấy tốc độ tăng trưởng nhanh, vượt ChatGPT về số lượt tải xuống và người dùng hoạt động trong những ngày đầu ra mắt.

Apple tung dòng máy tính Mac mới, hứa hẹn giảm chi phí AI

Apple tung dòng máy tính Mac mới, hứa hẹn giảm chi phí AI

Tập đoàn công nghệ Apple chuẩn bị bắt đầu giao các dòng máy tính để bàn mới với một chiến lược tiếp thị nhắm thẳng vào khách hàng doanh nghiệp: mua phần cứng để chạy trí tuệ nhân tạo (AI) nội bộ sẽ rẻ hơn việc thuê trung tâm dữ liệu đám mây.