Ảnh chụp màn hình logo của công ty Irregular.
Theo truyền thông Mỹ ngày 9/8, đó là Irregular - một công ty khởi nghiệp nhỏ ở Israel.
Được thành lập cách đây 3 năm và đặt trụ sở tại Tel Aviv, Irregular là công ty chuyên biệt trong lĩnh vực trí tuệ nhân tạo, nhận 80 triệu USD vốn đầu tư từ Sequoia và Redpoint Ventures, đồng thời được định giá 450 triệu USD vào năm 2025. Công nghệ của công ty này đóng vai trò là môi trường thử nghiệm an ninh mạng dành cho các mô hình AI.
Khi các mô hình AI hàng đầu ngày càng mạnh, khả năng chúng thực hiện những hành vi nguy hiểm đang trở thành mối đe dọa lớn đối với các doanh nghiệp và chính phủ, đặc biệt khi nguy cơ này liên quan đến xâm nhập các hệ thống máy tính và cơ sở hạ tầng quan trọng. Các sự cố mới đây tại OpenAI, Anthropic và Meta đều xảy ra khi những mô hình AI của các công ty này truy cập các trang web vốn không được phép tiếp cận trong quá trình kiểm tra an ninh mạng.
Cái tên Irregular liên tục được nhắc đến vì công ty này được xác định là đơn vị vận hành môi trường thử nghiệm đánh giá. Trong một bài đăng trên blog ngày 4/8, OpenAI cho biết môi trường thử nghiệm của Irregular có lỗi cấu hình, cho phép các mô hình truy cập Internet công cộng. Một tuần trước đó, Anthropic đã thông báo cho Irregular vài ngày sau khi bắt đầu phân tích dữ liệu cho thấy mô hình Claude của họ có thể đã truy cập Internet.
Meta là doanh nghiệp Mỹ mới nhất thông báo mô hình AI đã xâm nhập hệ thống của bên thứ ba bằng cách truy cập Internet. Trong một tuyên bố trong tuần trước, người phát ngôn Meta nói rằng đã biết về sự việc thông qua Irregular và đang tiến hành điều tra. Người phát ngôn nhấn mạnh Meta sẽ công bố báo cáo đánh giá đầy đủ khi có đủ mọi thông tin.
Trong một tuyên bố, Irregular nói rằng tất cả các sự cố đều bắt nguồn từ cùng một vấn đề trong môi trường đánh giá. Irregular đang xây dựng báo cáo chuyên sâu nhằm chia sẻ các phương thức tốt nhất về kiểm soát sự cố và vận hành an toàn các hoạt động đánh giá an ninh mạng.
Công ty này khẳng định tình huống không liên quan đến việc thoát khỏi môi trường thử nghiệm hay hành động tấn công mạng tinh vi, đồng thời cho biết hiện không còn vấn đề nào đang tồn tại.
Các sự cố an ninh trên cho thấy AI đang phát triển nhanh chóng như thế nào, đồng thời phản ánh sức ép đối với các nhà phát triển mô hình trong thiết lập các cơ chế bảo vệ công nghệ khi chỉ có một số ít công ty chuyên sâu trong những lĩnh vực nhất định trên thị trường. Ông Sundeep Bhimireddy, người phụ trách AI tại công ty khởi nghiệp Von, cho biết các công ty này bao gồm những đơn vị chuyên về đào tạo và gắn nhãn dữ liệu, tiến hành đánh giá để xác định năng lực của mô hình và thực hiện các cuộc kiểm tra an ninh nhằm tìm ra những điểm yếu mà các đối tượng xấu có thể khai thác.
Theo ông Bhimireddy, Irregular là một trong số ít đơn vị có năng lực kỹ thuật cần thiết để hỗ trợ các nhà phát triển mô hình nền tảng tiến hành kiểm tra an ninh tiên tiến. Những đơn vị khác được ông đề cập gồm tổ chức phi lợi nhuận METR và công ty vì lợi ích cộng đồng Apollo Research.
Ông Bhimireddy nói: "Khi kiểm tra các mô hình này, họ không muốn tự chấm bài của mình. Họ muốn có hoạt động kiểm tra độc lập do các nhà cung cấp bên thứ ba bên ngoài thực hiện".
Irregular là ai?
Irregular, trước đây có tên Pattern Labs, được thành lập năm 2023 bởi Giám đốc điều hành Dan Lahav, người từng làm việc trong lĩnh vực nghiên cứu AI tại IBM, và Giám đốc công nghệ Omer Nevo, người từng làm việc hơn 2 năm tại Google. Công ty này có 35 nhân viên.
Khi Irregular công bố vòng gọi vốn 80 triệu USD vào tháng 9/2025, các đối tác của Sequoia là Shaun Maguire và Dean Meyer viết trong bài đăng trên blog rằng đội ngũ do Lahav và Nevo lãnh đạo có khả năng nhìn thấy những vấn đề mà người khác chưa nhận ra, tiến hành các cuộc đánh giá tấn công mạng đối với những mô hình tiên tiến và phát triển biện pháp phòng vệ trước khi các mô hình đó được phát hành.
Mặc dù các sự cố mới nhất liên quan đến OpenAI, Anthropic và Meta đang được xem xét kỹ lưỡng, nhưng một cách nhìn nhận khác là những gì xảy ra thực chất đúng với mục đích của hoạt động kiểm tra. Ông Bhimireddy cho rằng sự việc đang bị thổi phồng hơi quá mức, bởi mô hình AI được chỉ đạo tìm kiếm và khai thác các lỗ hổng an ninh trong môi trường thử nghiệm mô phỏng sát thực tế, đồng thời phát hiện những lỗi phần mềm và cấu hình bị bỏ sót có thể dẫn đến việc vô tình truy cập Internet.
Tuy nhiên, ông Bhimireddy cho rằng nếu các công ty không muốn mô hình AI khai thác trang web kết nối Internet, các phòng thí nghiệm phát triển mô hình nền tảng hoàn toàn có thể giám sát lưu lượng truy cập đi ra và lập tức dừng cuộc thử nghiệm.
Ông Gordon Rios, nhà khoa học sáng lập công ty an ninh Magnitude, cho rằng toàn bộ quá trình này giống như thiết kế thí nghiệm trong khoa học. Ông cho biết năng lực và tính khó đoán của các mô hình nền tảng khiến những phương pháp kiểm thử phần mềm truyền thống có thể không còn phù hợp. Do các mô hình liên tục học được những thủ thuật mới, nên việc chúng phát hiện ra các lỗ hổng phần mềm bị bỏ sót trong những môi trường kiểm thử và công nghệ thông tin được thiết kế để kiểm soát chúng cũng không phải điều đáng ngạc nhiên.
Chẳng hạn, mô hình Mythos của Anthropic đã tạo ra các danh tính trực tuyến giả khi tìm cách gây sức ép để con người phê duyệt các bản cập nhật mã độc cho một dự án nguồn mở. Ông Rios bình luận rằng Mythos thực sự đã nghĩ ra những phương thức khai thác mà con người thậm chí chưa từng thấy trước đó. Ông nói: "Chúng ta đang học được rất nhiều điều chỉ trong vài tuần ngắn ngủi".
Vấn đề này nhanh chóng trở thành một chủ đề lớn tại Mỹ. Tháng 7, các nghị sĩ thuộc cả hai đảng đã đưa ra Dự luật Công tắc ngắt AI, theo đó yêu cầu các phòng thí nghiệm AI phải duy trì khả năng tắt, hạn chế hoặc đình chỉ hoạt động của các mô hình. Dự luật đề cập đến sự cố an ninh AI khác liên quan đến OpenAI và công ty khởi nghiệp Hugging Face.
Một trong những tác giả của dự luật, Hạ nghị sĩ đảng Dân chủ Ted Lieu của bang California, phát biểu: "Chúng ta cần thông qua dự luật này trong năm nay trong bối cảnh đang chứng kiến các vụ tấn công trái phép nhằm vào những công ty khác".
Ông Trevor Koverko, đồng sáng lập công ty khởi nghiệp đào tạo dữ liệu Sapien, cho rằng các công ty phát triển mô hình nền tảng có động lực để công khai một số phát hiện, dù hiện chưa có yêu cầu bắt buộc, qua đó tìm cách đi trước các nhà lập pháp và cơ quan quản lý. Ông nói: "Hiện có quá nhiều lo ngại nên các chính trị gia đang cảnh báo hoặc tích cực quản lý AI. Ngành này cho rằng họ thà tự điều chỉnh còn hơn để cơ quan chức năng xuất hiện và làm điều đó thay họ".
Anthropic và OpenAI cho biết trong các tuyên bố công khai rằng họ vẫn đang tiếp tục hợp tác với Irregular và hỗ trợ quá trình rà soát.