Theo phóng viên TTXVN tại Nga, nhà khoa học Abramsky cho rằng các lỗ hổng trong tệp cấu hình là nguyên nhân chính khiến các mô hình AI thoát được khỏi môi trường dành riêng cho chúng. Điều này cho phép các tác nhân AI thực hiện các hành động ngoài ý muốn trên Internet, vượt qua các hạn chế. Ông nhấn mạnh các tệp cấu hình này phải mô tả chi tiết về những gì mà các mô hình AI có thể thực hiện và truy cập. Ông lấy ví dụ các tác nhân AI phải mặc định bị chặn quyền truy cập Internet miễn phí.
Chuyên gia này cũng nêu ví dụ về một trường hợp AI, để đáp lại yêu cầu trợ giúp của người dùng tìm chỗ trống trong phòng tập thể dục, đã tìm thấy lỗ hổng trong hệ thống đặt chỗ và hủy đăng ký của người xếp hàng đầu tiên. Một trường hợp “vượt rào” khác liên quan đến hai tác nhân AI liên lạc trong một cuộc trò chuyện bí mật với nhau, thảo luận cách vượt qua các hạn chế và phối hợp hành động.
Ông Abramsky giải thích khi tác nhân AI gặp khó khăn trong việc thực hiện một yêu cầu theo cách thông thường, chúng có thể chuyển sang chế độ tìm kiếm tất cả các tùy chọn hợp lệ, sử dụng chính xác các lỗ hổng trong cấu hình của chúng. Nếu hoạt động của tác nhân AI không bị giới hạn, chúng sẽ trở thành một hacker đang cố gắng xâm nhập vào một số ứng dụng, không phải vì mục đích xấu mà để giải quyết nhiệm vụ.
Tuy nhiên ông Abramsky cho rằng trong bối cảnh hiện nay nguy cơ không phải là mất quyền kiểm soát hàng loạt các hệ thống thông minh. Những sự cố xảy ra không phải là “cuộc nổi loạn của máy móc” mà là liên quan đến các lỗi nhất định cần được theo dõi và sửa chữa. Nhiệm vụ đặt ra là cần phải đặt các mô hình AI trong ranh giới riêng và chỉ cho phép chúng thực hiện một số thao tác nhất định chứ không phải tất cả khả năng của người dùng. Theo chuyên gia này, tất cả những sự cố đó khiến con người phải cân nhắc rủi ro khi sử dụng AI, đặc biệt là đảm bảo hoạt động an toàn của AI.