OpenAI tăng cường biện pháp an toàn đối với mô hình AI Astra

Ngày 7/8, OpenAI cho biết mô hình trí tuệ nhân tạo (AI) tiên tiến Astra sắp ra mắt đã cho thấy tiềm năng đạt được năng lực an ninh mạng ở cấp độ cao.

Công ty này đang áp dụng các biện pháp bảo vệ và kiểm soát an ninh chặt chẽ hơn đối với mô hình AI này nhằm bảo đảm an toàn.

Chú thích ảnh
Biểu tượng Tập đoàn công nghệ Mỹ OpenAI. Ảnh minh họa: AFP/TTXVN

Theo OpenAI, các đánh giá nội bộ đối với Astra - mô hình vẫn đang trong quá trình phát triển và không phải là một trong những mô hình liên quan đến vụ tấn công Hugging Face gần đây - cho thấy những bước tiến đáng kể về năng lực an ninh mạng. Công ty cho biết chưa thể loại trừ khả năng Astra đã đạt tới mức có thể tự thực hiện những cuộc tấn công mạng phức tạp nhằm vào các hệ thống được bảo vệ nghiêm ngặt, còn được gọi theo chuyên môn là “năng lực an ninh mạng ở mức nghiêm trọng”. Đây là mức năng lực được OpenAI xếp vào nhóm rủi ro đặc biệt cao và phải áp dụng các biện pháp kiểm soát an toàn chặt chẽ.

Theo Preparedness Framework, năng lực an ninh mạng ở mức nghiêm trọng bao gồm khả năng một mô hình AI, với sự hỗ trợ của các công cụ, có thể phát triển các phương thức khai thác những lỗ hổng chưa từng được biết đến (zero-day) ở mọi mức độ nghiêm trọng nhằm vào nhiều hệ thống trọng yếu được bảo vệ nghiêm ngặt trong thực tế mà không cần sự can thiệp của con người.

Một mô hình AI cũng được xem là có năng lực an ninh mạng ở mức nghiêm trọng nếu có thể tự xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, trong khi con người chỉ cần đưa ra mục tiêu tổng quát.

OpenAI cho biết công ty này công bố thông tin này nhằm giúp công chúng nắm được tình hình, đồng thời cung cấp thông tin cho cộng đồng an toàn và an ninh. Theo đó, OpenAI đang tạm dừng những hoạt động nội bộ liên quan đến Astra nếu chưa có đầy đủ biện pháp bảo vệ và kiểm soát; triển khai cơ chế giám sát toàn diện đối với mô hình; đồng thời phối hợp với các cơ quan chính phủ và các tổ chức về an toàn AI để tiếp tục kiểm tra năng lực của Astra.

Thông báo của OpenAI được đưa ra sau một loạt thông tin từ các phòng thí nghiệm AI cho biết những mô hình AI của họ đã hoạt động ngoài dự kiến và xâm nhập hệ thống của các tổ chức khác.

Đối thủ Anthropic sau đó cũng cho biết các mô hình AI của công ty đã vượt ra ngoài môi trường kiểm soát trong quá trình thử nghiệm do một vấn đề về cấu hình. Những mô hình AI này đã truy cập Internet công cộng và xâm nhập hệ thống của ba tổ chức khác nhau vì cho rằng tất cả các hệ thống đó đều là một phần của bài kiểm tra an ninh.

Meta cũng cho biết một trong những mô hình của công ty đã thoát khỏi môi trường thử nghiệm và truy cập Internet do lỗi cấu hình.

Minh Trang/TTXVN (Yahoo Finance)

Dành cho bạn

Khi cuộc đua AI làm gia tăng lo ngại về mối đe doạ với nhân loại

Khi cuộc đua AI làm gia tăng lo ngại về mối đe doạ với nhân loại

Cuộc đua trí tuệ nhân tạo (AI) đang tăng tốc, trong khi cạnh tranh có nguy cơ khiến các doanh nghiệp xem nhẹ an toàn, làm gia tăng những rủi ro khó kiểm soát. Diễn biến này đặt ra yêu cầu đối với Việt Nam trong thực hiện Nghị quyết 57: phát triển và làm chủ AI phải song hành với xây dựng năng lực quản trị, kiểm soát và bảo đảm an toàn.
Tìm giải pháp kéo dài tuổi thọ phù điêu Mậu Thân 1968

Tìm giải pháp kéo dài tuổi thọ phù điêu Mậu Thân 1968

Nắng nóng, độ ẩm và nước mưa có thể âm thầm tác động đến bức phù điêu bằng đồng tại Khu truyền thống cách mạng cuộc Tổng tiến công và nổi dậy Xuân Mậu Thân 1968. Từ những vị trí dễ hư hỏng được nhận diện, nhóm nghiên cứu đề xuất giải pháp theo dõi và bảo trì chủ động nhằm kéo dài tuổi thọ công trình..
TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài cuối: Thu hút nhân tài, tạo động lực mới

TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài cuối: Thu hút nhân tài, tạo động lực mới

Để khoa học, công nghệ và đổi mới sáng tạo trở thành động lực tăng trưởng, TP Hồ Chí Minh đang đặt trọng tâm vào một nguồn lực có tính quyết định: con người. Từ chính sách thu hút chuyên gia đến việc tạo môi trường để người giỏi giải quyết những bài toán lớn, Thành phố đang từng bước tìm cách biến tri thức thành năng lực đổi mới và giá trị cụ thể.
TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài 2: Khi khoảng cách từ phòng nghiên cứu đến thị trường được rút ngắn

TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài 2: Khi khoảng cách từ phòng nghiên cứu đến thị trường được rút ngắn

Nếu các cơ chế mới là “đường băng” để khoa học, công nghệ và đổi mới sáng tạo "cất cánh" thì thị trường mới là nơi quyết định công nghệ có tạo ra giá trị hay không. TP Hồ Chí Minh đang tìm cách rút ngắn khoảng cách từ phòng nghiên cứu đến doanh nghiệp, từ ý tưởng đến sản phẩm, qua đó biến nguồn lực tri thức thành một động lực tăng trưởng thực chất.