Cảnh báo "lạnh người" về nguy cơ AI hủy diệt nhân loại trong thập kỷ tới

Một nhà nghiên cứu cấp cao của Anthropic ước tính AI có hơn 10% khả năng hủy diệt nhân loại trong 10 năm tới, đồng thời cảnh báo con người chưa có kế hoạch rõ ràng để kiểm soát siêu trí tuệ.
Chú thích ảnh
Giới khoa học đang lo ngại các công ty công nghệ hàng đầu đang chạy đua phát triển những hệ thống mà họ có thể không đủ khả năng kiểm soát. Ảnh minh họa: RT

Theo đài RT, một nhà nghiên cứu cấp cao của Anthropic cảnh báo có hơn 10% khả năng trí tuệ nhân tạo (AI) có thể xóa sổ nhân loại trong 10 năm tới, trong bối cảnh ngày càng có nhiều lo ngại về nguy cơ các hệ thống AI ngày càng mạnh vượt khỏi khả năng kiểm soát của con người.

Evan Hubinger, nhà nghiên cứu chuyên về việc bảo đảm các hệ thống AI tiên tiến hoạt động phù hợp với lợi ích của con người, đưa ra đánh giá trên sau khi một đồng nghiệp tại Anthropic là Jacob Coxon từ chức vì lo ngại các công ty công nghệ hàng đầu đang chạy đua phát triển những hệ thống mà họ có thể không đủ khả năng kiểm soát.

“Chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ con người”, ông Hubinger viết trên mạng xã hội X ngày 9/9. Ông cho biết cá nhân mình đánh giá xác suất này ở mức “trên 10% trong thập kỷ tới”.

Nhà nghiên cứu này nói rằng Anthropic đang “cố gắng hết sức”, song công ty vẫn chưa có một kế hoạch rõ ràng để kiểm soát siêu trí tuệ nhân tạo (superintelligence) một cách an toàn và “chưa rõ liệu có đi đúng hướng” để tìm ra giải pháp hay không.

Theo ông, các mô hình AI hiện nay chỉ gây ra rủi ro thấp đối với sự tồn vong của nhân loại. Tuy nhiên, mối lo ngại nằm ở những hệ thống trong tương lai có thể bắt đầu tự cải thiện theo cách đệ quy, qua đó nhanh chóng trở nên vượt trội so với con người trước khi các biện pháp bảo vệ cần thiết được xây dựng đầy đủ.

Ông Jacob Coxon, người từng làm việc tại OpenAI trước khi gia nhập Anthropic, đã thông báo rời công ty hôm 8/9, đồng thời tuyên bố rời khỏi ngành AI lo ngại cuộc đua phát triển các hệ thống AI tự cải thiện đang vượt quá khả năng kiểm soát của con người. Ông cáo buộc cả hai công ty đang phớt lờ những “hệ quả mang tính văn minh” của cuộc đua AI và “chạy thẳng tới siêu trí tuệ có khả năng tự cải thiện, đánh cược với mạng sống của chúng ta”.

“Những người xây dựng AI thực sự tin rằng công nghệ này có thể giết chết tất cả chúng ta vào cuối thập kỷ”, ông Coxon viết, đồng thời nhấn mạnh những cảnh báo trên “không phải một chiêu tiếp thị”.

Trao đổi với tạp chí Wall Street, Coxon cho rằng trong những kịch bản nghiêm trọng nhất, tình hình có thể trở nên “mất kiểm soát” ngay từ cuối năm 2027. Theo ông, ngay cả những công ty có chương trình an toàn AI mạnh cũng bị cuốn vào cuộc đua, bởi họ lo ngại đối thủ sẽ vượt lên nếu mình giảm tốc độ phát triển.

Trong khi đó, cả Anthropic và OpenAI đều công khai khẳng định coi trọng những rủi ro liên quan đến AI và đang đầu tư mạnh vào các biện pháp an toàn. Lãnh đạo hai công ty cũng ủng hộ việc tăng cường phối hợp giữa các chính phủ và xây dựng cơ chế có thể làm chậm quá trình phát triển AI nếu cần thiết. Tuy nhiên, cả hai vẫn tiếp tục phát triển những mô hình ngày càng mạnh.

Những cảnh báo mới nhất được đưa ra trong bối cảnh ngày càng xuất hiện nhiều báo cáo về các AI agent – những hệ thống có khả năng tự thực hiện một chuỗi nhiệm vụ – do OpenAI, Anthropic và Meta phát triển. Một số hệ thống được cho là nhiều lần thoát khỏi môi trường thử nghiệm, xâm nhập các hệ thống bên ngoài và thực hiện những hành động không được cấp phép đối với người hoặc tổ chức thực tế.

OpenAI từng tạm thời làm chậm một số hoạt động phát triển vào tháng trước sau khi một mô hình của công ty xâm nhập nền tảng Hugging Face.

Viện An ninh AI của Anh (AI Security Institute) cũng cho biết trong các cuộc đánh giá, một số AI agent đã tạo danh tính giả, viết mã độc và tìm cách thao túng con người.

Trong khi đó, các nhà nghiên cứu đã chứng minh AI có khả năng thiết kế toàn bộ bộ gene virus có chức năng, làm gia tăng những lo ngại về nguy cơ các hệ thống AI ngày càng mạnh bị sử dụng cho những mục đích nguy hiểm.

Thu Hằng

Dành cho bạn

Khi cuộc đua AI làm gia tăng lo ngại về mối đe doạ với nhân loại

Khi cuộc đua AI làm gia tăng lo ngại về mối đe doạ với nhân loại

Cuộc đua trí tuệ nhân tạo (AI) đang tăng tốc, trong khi cạnh tranh có nguy cơ khiến các doanh nghiệp xem nhẹ an toàn, làm gia tăng những rủi ro khó kiểm soát. Diễn biến này đặt ra yêu cầu đối với Việt Nam trong thực hiện Nghị quyết 57: phát triển và làm chủ AI phải song hành với xây dựng năng lực quản trị, kiểm soát và bảo đảm an toàn.
Tìm giải pháp kéo dài tuổi thọ phù điêu Mậu Thân 1968

Tìm giải pháp kéo dài tuổi thọ phù điêu Mậu Thân 1968

Nắng nóng, độ ẩm và nước mưa có thể âm thầm tác động đến bức phù điêu bằng đồng tại Khu truyền thống cách mạng cuộc Tổng tiến công và nổi dậy Xuân Mậu Thân 1968. Từ những vị trí dễ hư hỏng được nhận diện, nhóm nghiên cứu đề xuất giải pháp theo dõi và bảo trì chủ động nhằm kéo dài tuổi thọ công trình..
TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài cuối: Thu hút nhân tài, tạo động lực mới

TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài cuối: Thu hút nhân tài, tạo động lực mới

Để khoa học, công nghệ và đổi mới sáng tạo trở thành động lực tăng trưởng, TP Hồ Chí Minh đang đặt trọng tâm vào một nguồn lực có tính quyết định: con người. Từ chính sách thu hút chuyên gia đến việc tạo môi trường để người giỏi giải quyết những bài toán lớn, Thành phố đang từng bước tìm cách biến tri thức thành năng lực đổi mới và giá trị cụ thể.
TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài 2: Khi khoảng cách từ phòng nghiên cứu đến thị trường được rút ngắn

TP Hồ Chí Minh cụ thể hóa Nghị quyết 57 - Bài 2: Khi khoảng cách từ phòng nghiên cứu đến thị trường được rút ngắn

Nếu các cơ chế mới là “đường băng” để khoa học, công nghệ và đổi mới sáng tạo "cất cánh" thì thị trường mới là nơi quyết định công nghệ có tạo ra giá trị hay không. TP Hồ Chí Minh đang tìm cách rút ngắn khoảng cách từ phòng nghiên cứu đến doanh nghiệp, từ ý tưởng đến sản phẩm, qua đó biến nguồn lực tri thức thành một động lực tăng trưởng thực chất.