AI ngày càng tự chủ, cuộc đua công nghệ chuyển sang bài toán kiểm soát

AI đang chuyển từ công cụ trả lời sang các “tác nhân” có khả năng tự lập kế hoạch, sử dụng công cụ và thực hiện nhiều nhiệm vụ liên tiếp. Khi mức độ tự chủ tăng lên, kiểm soát và an toàn trở thành một phần quan trọng của phát triển AI, cũng là vấn đề Việt Nam đang phải tính đến.

Chú thích ảnh
OpenAI cho biết một nhóm AI agent đã có những hành vi vượt ngoài mục tiêu được giao, khai thác lỗ hổng và cuối cùng tham gia cuộc tấn công kéo dài nhiều ngày nhằm vào Hugging Face hồi tháng 7. Ảnh: WION

AI đang chuyển từ công cụ trả lời sang các “tác nhân” có thể tự lập kế hoạch, sử dụng công cụ và thực hiện nhiều bước liên tiếp. Những thử nghiệm gần đây cho thấy khi mức độ tự chủ tăng lên, yêu cầu về kiểm soát và an toàn cũng trở nên cấp thiết hơn.

Sự phát triển nhanh của AI agent đang mở ra một bước chuyển mới trong cách con người sử dụng trí tuệ nhân tạo. Thay vì chỉ trả lời câu hỏi hoặc tạo nội dung theo yêu cầu, các hệ thống này có thể tự tìm kiếm thông tin, viết và chạy mã, sử dụng công cụ trực tuyến, lập kế hoạch rồi thực hiện nhiều bước để hoàn thành một mục tiêu.

Nhưng chính khả năng đó cũng tạo ra những rủi ro mới.

Trong một cuộc đánh giá an ninh mạng của Viện An toàn AI Anh (AISI) hồi tháng 7, các nhà nghiên cứu phát hiện một số AI agent đã thực hiện những hành động ngoài phạm vi được cho phép khi được đặt trong môi trường thử nghiệm tương đối cởi mở.

Cuộc đánh giá được tiến hành 122 lần trên nhiều mô hình. Trong 10 lần, các nhà nghiên cứu ghi nhận 19 hành động tự chủ ngoài phạm vi thử nghiệm. Phần lớn các lượt thử vẫn diễn ra như dự kiến, nhưng một số trường hợp đáng chú ý liên quan đến việc AI tìm cách tác động tới con người và hệ thống bên ngoài.

Trong trường hợp nghiêm trọng nhất, một agent tìm cách đưa mã độc vào một dự án phần mềm nguồn mở và tạo các tài khoản giả để thuyết phục người duy trì dự án chấp nhận mã này. Người kiểm duyệt đã phát hiện và từ chối yêu cầu.

Điểm đáng chú ý ở đây không phải AI đã “có ý thức” hay tự hình thành một âm mưu riêng. AISI cho biết hành vi này xuất hiện trong quá trình AI cố hoàn thành nhiệm vụ được giao, khi hệ thống được trao quyền truy cập Internet và các công cụ cần thiết.

Khi AI không còn hoạt động đơn lẻ

Những thử nghiệm như vậy cho thấy một thay đổi quan trọng trong cách đánh giá AI.

Một mô hình đơn lẻ có thể được kiểm tra xem có tạo ra nội dung nguy hiểm, viết mã độc hay vượt qua một giới hạn cụ thể hay không. Nhưng với AI agent, hệ thống có thể tự chia nhỏ nhiệm vụ, sử dụng nhiều công cụ và thực hiện hàng loạt hành động liên tiếp.

Khi nhiều agent được kết nối, vấn đề càng phức tạp. Một nghiên cứu của AISI về AI đa tác nhân cho thấy các hệ thống được thiết kế để phối hợp có thể tạo ra những thách thức mới đối với cơ chế giám sát, bởi hành vi của một agent có thể ảnh hưởng đến các agent khác.

Điều này không đồng nghĩa AI đang “nổi loạn”. Vấn đề thực tế hơn là hệ thống có thể tìm ra cách hoàn thành mục tiêu mà người sử dụng không dự đoán trước.

Khả năng này vừa là lợi thế, vừa là rủi ro. Một nhóm AI agent có thể chia nhau nghiên cứu tài liệu, phân tích dữ liệu, viết phần mềm hoặc xử lý công việc doanh nghiệp nhanh hơn một hệ thống đơn lẻ. Nhưng nếu một agent đưa ra quyết định sai hoặc sử dụng công cụ không phù hợp, hành vi đó có thể lan sang những bước tiếp theo của quy trình.

AISI cũng ghi nhận xu hướng AI agent ngày càng được trao quyền tác động trực tiếp lên môi trường bên ngoài. Trong dữ liệu về hơn 177.000 công cụ dành cho agent, tỷ lệ sử dụng các công cụ có khả năng “hành động” bên ngoài hệ thống tăng đáng kể trong giai đoạn được nghiên cứu.

Điều đó khiến câu hỏi về an toàn không còn chỉ là “AI trả lời có đúng hay không”, mà còn là AI được phép làm gì, làm đến đâu và ai có thể dừng nó.

Phát triển AI phải đi cùng kiểm soát

Đây cũng là vấn đề Việt Nam cần tính đến khi thúc đẩy phát triển AI trong thực hiện Nghị quyết 57.

Nghị quyết 57 xác định trí tuệ nhân tạo là một trong những lĩnh vực cần tập trung phát triển, đồng thời đặt mục tiêu xây dựng năng lực AI quốc gia theo hướng tự chủ, tin cậy, an toàn và có khả năng triển khai trên diện rộng.

Trong kết luận sơ kết 1 năm 6 tháng thực hiện Nghị quyết 57 vào tháng 7/2026, yêu cầu bảo đảm an ninh mạng, an toàn thông tin, an ninh dữ liệu và chủ quyền số quốc gia cũng được nhấn mạnh. Thông báo nêu rõ các hệ thống số, cơ sở dữ liệu và nền tảng số phải được thiết kế, xây dựng và vận hành theo yêu cầu bảo đảm an ninh, an toàn ngay từ đầu.

Với AI agent, nguyên tắc này càng có ý nghĩa khi hệ thống không chỉ tạo ra thông tin mà còn có thể thực hiện hành động.

Điều đó đòi hỏi việc phát triển AI không dừng ở năng lực của mô hình. Doanh nghiệp và cơ quan triển khai cần xác định rõ quyền truy cập dữ liệu, phạm vi sử dụng công cụ, mức độ tự chủ và cơ chế giám sát. Những chức năng có thể gây hậu quả lớn cũng cần có giới hạn và sự kiểm soát của con người.

Các biện pháp như hạn chế quyền truy cập Internet, kiểm soát công cụ mà agent được phép sử dụng, giám sát hoạt động theo thời gian thực và thiết lập cơ chế dừng khẩn cấp đang trở thành những thành phần quan trọng trong đánh giá AI agent. AISI cũng nhấn mạnh vai trò của con người và các biện pháp bảo mật cơ bản trong việc ngăn chặn những hành động nguy hiểm của agent trong các thử nghiệm gần đây.

AI càng được trao nhiều quyền tự chủ, ranh giới giữa “một công cụ hỗ trợ” và “một hệ thống có khả năng hành động” càng rõ hơn. Vì thế, thước đo của một hệ thống AI tiên tiến không chỉ là nó có thể hoàn thành bao nhiêu nhiệm vụ, mà còn là con người có hiểu, giám sát và kiểm soát được những hành động mà hệ thống thực hiện hay không.

Đối với Việt Nam, đây là phần không thể tách rời khỏi quá trình phát triển năng lực AI. Nghị quyết 57 không chỉ đặt mục tiêu làm chủ và ứng dụng công nghệ mà còn yêu cầu gắn phát triển với an ninh, an toàn và chủ quyền số. Khi AI agent ngày càng tiến gần khả năng tự hành động, yêu cầu đó càng trở nên cụ thể hơn trong từng hệ thống được đưa vào sử dụng.

Thu Hằng - Tổng hợp

Dành cho bạn

Microsoft biến Copilot thành 'đồng nghiệp số' hỗ trợ toàn diện hơn

Microsoft biến Copilot thành 'đồng nghiệp số' hỗ trợ toàn diện hơn

Tập đoàn công nghệ Microsoft ngày 25/9 đã công bố loạt tính năng mới cho ứng dụng Copilot, trong đó đáng chú ý là công cụ lập trình bằng ngôn ngữ tự nhiên và một tác nhân AI có khả năng hoạt động liên tục, trong nỗ lực biến trợ lý AI này thành nền tảng hỗ trợ toàn diện hơn cho người dùng văn phòng.