Theo truyền thông Mỹ, hệ thống trí tuệ nhân tạo Gemini của Google đã truy cập vào hệ thống của 3 doanh nghiệp thực tế trong một cuộc thử nghiệm an ninh mạng, sau khi một lỗi vô tình cho phép mô hình kết nối Internet.
Google cho biết sự việc xảy ra trong quá trình đánh giá khả năng an ninh mạng của Gemini từ tháng 5. Mô hình sau đó tự dừng các cuộc tấn công khi nhận ra mình đang tiếp cận hệ thống của những doanh nghiệp thực tế thay vì mục tiêu giả lập.
Sự cố là một ví dụ đáng chú ý về thách thức đang xuất hiện khi các mô hình AI ngày càng được trao khả năng thực hiện hành động thay vì chỉ trả lời câu hỏi hoặc tạo nội dung. Với Việt Nam, đây cũng là vấn đề gắn trực tiếp với yêu cầu phát triển AI đi đôi với an ninh mạng, an toàn dữ liệu và kiểm soát rủi ro trong quá trình thực hiện Nghị quyết 57-NQ/TW.
Từ mục tiêu giả lập đến hệ thống thật
Sự cố xảy ra trong các cuộc kiểm thử do Irregular, một công ty khởi nghiệp của Israel chuyên đánh giá các mô hình AI, thực hiện.
Theo Google, Gemini trong mỗi bài kiểm tra được yêu cầu tiến hành một cuộc tấn công mạng nhằm vào một công ty giả lập. Tuy nhiên, doanh nghiệp giả lập này có tên trùng với một công ty tồn tại ngoài đời thực.
Trong quá trình thử nghiệm, một lỗi khiến Gemini được truy cập Internet. Khi kết nối với mạng bên ngoài, mô hình bắt đầu tìm cách xâm nhập vào công ty có tên trùng với mục tiêu giả lập.
Gemini sử dụng những mật khẩu tìm thấy trên Internet hoặc tự đoán để đăng nhập vào hệ thống trực tuyến của doanh nghiệp. Sau đó, mô hình tiếp tục truy cập vào hệ thống của 2 công ty khác.
Google cho biết sau khi đăng nhập, Gemini nhận ra những hệ thống mà mình tiếp cận là hạ tầng của các doanh nghiệp thực tế chứ không phải môi trường mô phỏng phục vụ thử nghiệm. Mô hình đã tự dừng các cuộc tấn công.
Google cũng cho biết sự cố không gây thiệt hại cho các doanh nghiệp bị truy cập. Irregular sau đó xác nhận lỗi cho phép các mô hình AI kết nối Internet đã được khắc phục.
“Việc truy cập Internet vô tình được kích hoạt đã khiến một số mô hình thực hiện các hành động an ninh mang tính tấn công trong thế giới thực”, Irregular cho biết trong một bài viết, đồng thời khẳng định các vấn đề liên quan đã được xử lý.
Các phòng thí nghiệm AI liên quan được thông báo về sự cố vào cuối tháng 7, trong khi những doanh nghiệp bị ảnh hưởng cũng được liên hệ trong quá trình điều tra.
Điểm đáng chú ý nằm ở chỗ Gemini không được yêu cầu tấn công các doanh nghiệp thật. Sự cố bắt nguồn từ việc ranh giới giữa môi trường thử nghiệm và Internet thực tế bị mở ra ngoài dự kiến. Nhưng khi một mô hình AI có khả năng tự thực hiện nhiều bước liên tiếp, chỉ một sai sót trong thiết kế môi trường cũng có thể dẫn đến những hành động vượt khỏi phạm vi ban đầu.
Không chỉ Gemini
Gemini không phải trường hợp duy nhất. Theo Irregular, trong quá trình kiểm thử, các mô hình AI của OpenAI, Anthropic và Meta cũng từng có quyền truy cập Internet ngoài dự kiến.
Những sự việc này diễn ra trong bối cảnh các phòng thí nghiệm AI đang chuyển mạnh từ những mô hình chủ yếu cung cấp thông tin sang các hệ thống có khả năng thực hiện nhiệm vụ thay người dùng. Các AI tác nhân có thể truy cập công cụ, tìm kiếm thông tin, viết và chạy mã hoặc thực hiện một chuỗi hành động để hoàn thành mục tiêu được giao.
Khả năng hành động tạo ra nhiều ứng dụng mới, nhưng đồng thời làm thay đổi cách đánh giá an toàn AI. Với một chatbot chỉ tạo văn bản, một câu trả lời sai chủ yếu tạo ra rủi ro về thông tin. Với một hệ thống có quyền truy cập Internet, tài khoản, dữ liệu hoặc các công cụ bên ngoài, sai sót có thể dẫn đến hành động trong thế giới thực.
Heather Adkins, Phó Chủ tịch phụ trách kỹ thuật an ninh của Google, cho biết nhóm an ninh của hãng có kinh nghiệm phát hiện và báo cáo các vấn đề trong phần mềm và hệ thống của bên khác, từ những lỗi đơn giản như sử dụng mật khẩu yếu đến những vấn đề phức tạp hơn.
Google cho biết đã thông báo cho 3 đơn vị bị ảnh hưởng và phối hợp với đối tác kiểm thử để thay đổi quy trình.
Sự cố cũng cho thấy kiểm thử AI không thể chỉ tập trung vào việc mô hình có hoàn thành nhiệm vụ được giao hay không. Một hệ thống có thể đạt yêu cầu về năng lực nhưng vẫn cần được đánh giá về quyền truy cập, phạm vi hoạt động, khả năng tự dừng và cách phản ứng khi gặp tình huống ngoài dự kiến.
Đây là một vấn đề ngày càng quan trọng khi AI được sử dụng trong những lĩnh vực có yêu cầu cao về an toàn, từ tài chính, y tế đến quản trị số và an ninh mạng.
Phát triển AI phải đi cùng “hàng rào” an toàn
Câu chuyện Gemini đặt ra một vấn đề rộng hơn đối với quá trình phát triển AI: làm thế nào để mở rộng khả năng hành động của mô hình mà không để những quyền năng đó vượt khỏi phạm vi được kiểm soát.
Nghị quyết 57-NQ/TW xác định trí tuệ nhân tạo là một trong những công nghệ chiến lược Việt Nam cần từng bước làm chủ, đồng thời nhấn mạnh bảo đảm an ninh mạng, an ninh dữ liệu và an toàn thông tin là yêu cầu xuyên suốt, không thể tách rời quá trình phát triển khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số.
Đáng chú ý, kết luận tại Hội nghị toàn quốc sơ kết 1 năm 6 tháng triển khai Nghị quyết 57-NQ/TW tháng 7/2026 tiếp tục nhấn mạnh yêu cầu không đánh đổi an ninh, an toàn để lấy phát triển, nhưng cũng không vì lo ngại rủi ro mà làm chậm đổi mới sáng tạo. Các hệ thống số, cơ sở dữ liệu và nền tảng số phải được thiết kế, xây dựng và vận hành theo yêu cầu bảo đảm an ninh, an toàn ngay từ đầu.
Đối với AI, nguyên tắc này đặc biệt có ý nghĩa khi các mô hình ngày càng chuyển từ “biết” sang “làm”. Một hệ thống AI có thể được huấn luyện tốt nhưng vẫn cần những giới hạn rõ ràng về dữ liệu được tiếp cận, công cụ được sử dụng, mạng được kết nối và hành động được phép thực hiện.
Điều này đặt ra yêu cầu không chỉ đối với các doanh nghiệp phát triển AI mà cả những tổ chức sử dụng công nghệ. Khi đưa AI vào hệ thống thực tế, việc phân quyền, cô lập môi trường thử nghiệm, giám sát hoạt động của mô hình và xây dựng cơ chế ngắt khẩn cấp cần được xem là một phần của thiết kế hệ thống, thay vì biện pháp bổ sung sau khi công nghệ đã được triển khai.
Đây cũng là một hướng gợi mở cho quá trình thực hiện Nghị quyết 57 tại Việt Nam. Nếu AI được xác định là công nghệ chiến lược cần làm chủ, năng lực AI không chỉ nằm ở việc phát triển mô hình hoặc đưa AI vào nhiều hoạt động hơn, mà còn ở khả năng xây dựng hạ tầng, tiêu chuẩn, quy trình và nguồn nhân lực đủ năng lực kiểm soát công nghệ.
Kết luận triển khai Nghị quyết 57-NQ/TW năm 2026 cũng yêu cầu gắn việc tạo ra tri thức mới và làm chủ công nghệ với chuyển hóa thành giá trị thực tế; đồng thời xác định an ninh mạng, an toàn thông tin và an ninh dữ liệu là những yêu cầu phải được coi trọng trong quá trình phát triển.
Với Việt Nam, đây có thể là một phần quan trọng của quá trình xây dựng năng lực AI trong nước: không chỉ tạo ra những hệ thống thông minh hơn, mà còn phải tạo ra những hệ thống thông minh có giới hạn, có thể giám sát và có thể kiểm soát.
Sự cố của Gemini không cho thấy AI đã tự chủ hoàn toàn hay cố tình gây thiệt hại cho các doanh nghiệp. Nhưng nó cho thấy một thực tế đáng chú ý: khi AI được trao khả năng hành động, chỉ một cánh cửa kỹ thuật mở nhầm cũng có thể đưa mô hình từ thế giới giả lập sang thế giới thực. Bởi vậy, cùng với việc nâng cao năng lực AI, xây dựng “hàng rào” an toàn ngay từ khâu thiết kế sẽ ngày càng trở thành một phần không thể thiếu của quá trình làm chủ công nghệ.