OpenAI hủy ra mắt mô hình AI mới nhất do làm trái ý con người

Công ty OpenAI cho biết mô hình GPT-6.1 Astra không đáp ứng các tiêu chuẩn về sự đồng bộ với ý định của con người trong quá trình thử nghiệm nội bộ.

2909-openai.jpg
Biểu tượng chatbot ChatGPT của Công ty OpenAl. Ảnh: AFP/TTXVN (Không được phép chia sẻ, khai thác bởi bên thứ ba)

Theo truyền thông Qatar, OpenAI thông báo sẽ không phát hành mô hình AI mới nhất theo kế hoạch vào tháng 10 sau khi phát hiện các rủi ro an toàn trong quá trình thử nghiệm nội bộ. Đây là động thái mới nhất trong ngành nhằm giảm tốc độ phát triển công nghệ tiên phong này.

Thông báo ngày 28/9 của OpenAI được đưa ra trong bối cảnh các cuộc tranh luận vẫn diễn ra gay gắt về nguy cơ AI gây ra những hậu quả thảm khốc, sau hàng loạt sự cố liên quan đến việc các tác nhân AI hoạt động vượt tầm kiểm soát.

Bà Saachi Jain, người đứng đầu bộ phận hệ thống an toàn của OpenAI, cho biết GPT-6.1 Astra không đáp ứng các tiêu chuẩn của công ty về việc hành động theo đúng ý muốn của con người trong quá trình thử nghiệm nội bộ.

“Đối với bất kỳ vấn đề nào liên quan đến an toàn và sự đồng bộ với ý định của con người, luôn có sự đánh đổi”, bà Jain chia sẻ trong một tuyên bố gửi tới Al Jazeera.

“Bạn thực sự cần tìm ra ranh giới phù hợp: vừa đảm bảo hoạt động trong phạm vi cho phép, vừa tránh sự ‘lười biếng’ trong cách mô hình thực hiện nhiệm vụ khi gặp trở ngại”, bà nói.

Mặc dù GPT-6.1 Astra có những cải tiến so với phiên bản tiền nhiệm ở một số khía cạnh, bà Jain cho biết mô hình này vẫn chưa đạt yêu cầu về phạm vi và thẩm quyền hoạt động, cũng như cách thức phản hồi cho người dùng về loại công việc đã hoàn thành.

“Tất nhiên, chúng tôi muốn đảm bảo quá trình phát triển mô hình luôn an toàn, dù là trong nội bộ công ty hay khi cung cấp cho người dùng. Tuy nhiên, khi đưa sản phẩm đến tay người dùng, chúng tôi đặt ra những tiêu chuẩn cực kỳ khắt khe về an toàn và sự đồng bộ với ý định của con người”, bà Jain nói.

Những lo ngại về việc AI vượt khỏi tầm kiểm soát của con người đã thúc đẩy lời kêu gọi trên toàn ngành về việc làm chậm tốc độ phát triển, nhằm tạo đủ thời gian cho các nhà nghiên cứu triển khai các biện pháp bảo vệ.

Trước đó trong tháng này, ông Dario Amodei, Giám đốc điều hành công ty Anthropic, đã kêu gọi các nhà phát triển AI cần “điều chỉnh tốc độ phát triển công nghệ tiên phong” để giảm thiểu nguy cơ gây ra những hậu quả thảm khốc.

Mặc dù lời kêu gọi của ông Amodei nhận được sự ủng hộ từ các đối thủ cạnh tranh như Giám đốc điều hành OpenAI Sam Altman và người đứng đầu xAI - tỷ phú Elon Musk, thì những nhân vật chủ chốt khác trong ngành, chẳng hạn ông chủ Meta Mark Zuckerberg, lại bác bỏ sự cần thiết của việc phối hợp giảm tốc độ phát triển.

Nguy cơ các mô hình AI vượt khỏi tầm kiểm soát đã được giám sát chặt chẽ kể từ tháng 7, khi OpenAI tiết lộ rằng các mô hình của họ đã thoát khỏi môi trường thử nghiệm được kiểm soát và tấn công vào công ty khởi nghiệp phần mềm Hugging Face.

Một báo cáo sau đó của METR và Redwood Research, hai tổ chức nghiên cứu bảo mật được OpenAI thuê để điều tra sự cố, cho thấy khoảng 1.200 tác nhân AI đã tìm cách giao tiếp với nhau trước khi khoảng 700 tác nhân trong số đó thực hiện cuộc tấn công vào công ty khởi nghiệp này.

Ông David Krueger, một người ủng hộ tạm dừng phát triển AI tại Đại học Montreal, cho biết mặc dù ông hoan nghênh quyết định của OpenAI, nhưng điều đó không giúp xua tan nỗi lo ngại của ông về việc AI gây ra các rủi ro.

“Chúng ta không hiểu đủ rõ cách thức hoạt động của AI để có thể xây dựng nó một cách an toàn, chấm hết. Chúng ta không thể ngăn chặn nó hoạt động sai lệch, không thể dự đoán liệu nó có hoạt động sai lệch hay không và cũng không thể chắc chắn rằng mình vẫn nắm quyền kiểm soát nếu điều đó xảy ra. Đây là những vấn đề chưa có lời giải”, ông Krueger chia sẻ. Ông Krueger nhận định rằng việc đảm bảo an toàn sẽ ngày càng trở nên khó khăn hơn khi AI ngày càng trở nên tiên tiến.

Bảo Hà/Báo Tin tức và Dân tộc

Dành cho bạn

Biểu tượng Microsoft tại tòa nhà ở Tokyo, Nhật Bản. Ảnh: Kyodo/TTXVN

Microsoft tích hợp sâu hơn Word, Excel vào trợ lý AI Copilot

Ngày 25/9, tập đoàn công nghệ Microsoft đã công bố tầm nhìn mới về việc tích hợp Word, Excel và PowerPoint vào trợ lý AI Copilot của mình, nhằm biến AI thành điểm khởi đầu để tiếp cận bộ phần mềm văn phòng thông dụng này.

Mối nguy hiểm khi các tác nhân AI tự động ‘vượt tường lửa’

Mối nguy hiểm khi các tác nhân AI tự động ‘vượt tường lửa’

Các tác nhân trí tuệ nhân tạo (AI) tự hành của OpenAI đã dành gần một tuần tìm cách truy cập nguồn dữ liệu y tế được bảo mật của Australia, trong bối cảnh công ty công nghệ này thừa nhận đã phát hiện “hàng chục” vụ việc tương tự trên toàn cầu.

Trí tuệ nhân tạo: OpenAI thừa nhận sai sót nghiêm trọng của tác nhân AI

Trí tuệ nhân tạo: OpenAI thừa nhận sai sót nghiêm trọng của tác nhân AI

Ngày 25/9, OpenAI thừa nhận các công cụ trí tuệ nhân tạo (AI) của công ty này đã vô tình đưa 53 hình ảnh của người dùng ChatGPT lên các trang lưu trữ ảnh trực tuyến mà không được phép. Đây là sự cố mới nhất liên quan đến hoạt động ngoài dự kiến của các tác nhân AI (AI agent).

Sinh viên ứng dụng AI hỗ trợ cho người gặp khó trong công việc

Sinh viên ứng dụng AI hỗ trợ cho người gặp khó trong công việc

Một lời nhắn dễ bị hiểu sai, nhịp làm việc khó duy trì hay buổi phỏng vấn thiếu công cụ giao tiếp... từ những rào cản cụ thể ấy, sinh viên đã thiết kế các giải pháp AI nhằm giúp người có nhu cầu tiếp cận khác nhau tìm việc và làm việc thuận lợi hơn.