Trí tuệ nhân tạo: OpenAI 'hãm phanh' chương trình AI tiên tiến

Ngày 18/8, OpenAI, “cha đẻ” ChatGPT, cho biết đang tạm thời hãm lại tiến độ phát triển mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ, sau vụ tấn công mạng do chính một trong các công cụ AI của hãng này thực hiện.
Chú thích ảnh
Biểu tượng của OpenAI và ChatGPT. Ảnh: AFP/TTXVN

Trong một bài đăng, OpenAI cho biết đang hoãn thực hiện đợt huấn luyện AI quy mô lớn nhất từng được lên kế hoạch, trong khi chờ xác minh xem liệu mô hình thu được có hoạt động đúng như mong đợi hay không. Các đợt huấn luyện là những quy trình bắt buộc để nạp dữ liệu nhằm tăng năng lực suy luận và phản hồi của các mô hình AI. Theo đó, OpenAI tạm dừng huấn luyện các mô hình mới nhất trong 2 tuần trước khi tiếp tục lại với các biện pháp kiểm soát chặt chẽ hơn. Các nguồn tin cho biết phần lớn công việc kiểm soát liên quan đến Astra - mô hình lớn tiếp theo của công ty, sau một báo cáo hồi đầu tháng 8 cho thấy mô hình này có nguy cơ vượt qua ngưỡng cảnh báo của OpenAI về tấn công mạng.

Ngày 18/8, OpenAI cũng cho biết họ đang phát triển một hệ thống mới để giám sát quá trình suy luận nội bộ của các mô hình và cảnh báo cho con người trong vòng 30 phút nếu phát hiện hành vi đáng ngờ. Tuy nhiên, việc giám sát này sẽ đòi hỏi thêm 20% năng lực tính toán. Ngoài ra, phương pháp này cũng có hạn chế vì mô hình AI có thể học cách che giấu ý định trong quá trình suy luận, nếu biết mình bị giám sát. 

Là nhân tố chủ chốt trong quá trình xây dựng cơ sở hạ tầng và công cụ AI trên toàn cầu, quyết định của OpenAI có thể ảnh hưởng đến tiến độ phát triển AI của thế giới. Quyết định trên được đưa ra sau khi hồi giữa tháng 7, một tác nhân AI (AI agent) dựa trên hai mô hình của OpenAI đã tự ý thoát khỏi môi trường thử nghiệm để xâm nhập vào internet và tấn công Hugging Face – một nền tảng nơi các nhà phát triển trên toàn thế giới chia sẻ các mô hình AI của họ. OpenAI cam kết sẽ công bố báo cáo kỹ thuật chi tiết về sự cố liên quan đến Hugging Face song vẫn chưa thực hiện. Đáng chú ý, không chỉ OpenAI, hồi cuối tháng 7, đối thủ cạnh tranh của hãng này là Anthropic cũng tiết lộ rằng 3 mô hình đang trong giai đoạn thử nghiệm của công ty đã thực hiện các vụ xâm nhập trái phép vào hệ thống máy tính của 3 tổ chức khác nhau.

Những sự cố này đã khiến 1.000 nhân viên trong ngành công nghệ ký tên một bản kiến nghị kêu gọi Chính phủ Mỹ ủng hộ giảm tốc việc phát triển các hệ thống AI tiên tiến nhất. Hồi đầu năm nay, Chính phủ Mỹ từng viện dẫn các lo ngại về an ninh quốc gia để ngăn việc phát hành những mô hình AI mạnh do Anthropic và OpenAI phát triển.

Đài Trang (TTXVN)

Dành cho bạn

Sáng kiến Khoa học 2026: Vinh danh 15 giải thưởng vì cộng đồng

Sáng kiến Khoa học 2026: Vinh danh 15 giải thưởng vì cộng đồng

Ngày 4/10, Cuộc thi Sáng kiến Khoa học 2026 vinh danh 15 sáng kiến, giải pháp xuất sắc nhất. Sản phẩm “C-HySI – Nền tảng quang học siêu phổ chi phí thấp, tích hợp điện toán biên và học máy” xuất sắc giành giải Nhất trị giá 100 triệu đồng.

Du lịch vũ trụ: Gần 20 tỷ đồng cho một chuyến đi 6 ngày

Du lịch vũ trụ: Gần 20 tỷ đồng cho một chuyến đi 6 ngày

Nền tảng đặt dịch vụ du lịch Trung Quốc Trip.com vừa niêm yết một gói du lịch không gian dưới quỹ đạo với giá 5,1 triệu nhân dân tệ (khoảng 19,7 tỷ đồng), mở ra một lựa chọn trải nghiệm dành cho nhóm khách hàng có khả năng chi trả rất cao.

Google thử nghiệm chip AI trong không gian

Google thử nghiệm chip AI trong không gian

Ngày 2/10, công ty Google thuộc Tập đoàn Alphabet đã phóng vệ tinh mẫu thử nghiệm lên quỹ đạo nhằm đánh giá khả năng hoạt động của chip TPU trong môi trường khắc nghiệt của không gian.

Tesla công bố số xe giao quý III/2026 vượt xa dự báo

Tesla công bố số xe giao quý III/2026 vượt xa dự báo

Hãng Tesla ngày 2/10 công bố đã bàn giao 486.532 xe trong quý III/2026, vượt đáng kể dự báo của giới phân tích, trong khi sản lượng đạt 464.391 xe. Cổ phiếu của Tesla tăng khoảng 2% trong phiên giao dịch cùng ngày sau khi số liệu trên được công bố.