09:09 12/09/2026

Điều gì có thể khiến siêu trí tuệ nhân tạo trở thành mối đe dọa với nhân loại?

Một nhà nghiên cứu hàng đầu về an toàn trí tuệ nhân tạo (AI) đã gây lo ngại trong tuần này sau khi nghỉ việc và cảnh báo công nghệ này có thể “hủy diệt nhân loại” ngay trong thập kỷ tới.

Chú thích ảnh
Robot "Ameca" được giới thiệu tại Bảo tàng Tương lai ở Dubai, UAE. Ảnh tư liệu: AFP/TTXVN (Ảnh không cho phép bên thứ ba khai thác, chia sẻ lại)

Ông Jacob Coxon, người từng tham gia huấn luyện các phiên bản AI mới nhất tại Anthropic, công ty có trụ sở ở San Francisco (Mỹ), kêu gọi công chúng “không nên đánh giá thấp” sức mạnh của AI, đặc biệt nếu công nghệ này đạt tới trạng thái “siêu thông minh”.

Nhà nghiên cứu này cho rằng cả Anthropic, công ty phát triển hệ thống Claude, và OpenAI, đơn vị đứng sau ChatGPT và cũng là nơi ông từng làm việc, đều “chưa hành động có trách nhiệm” trong vấn đề an toàn AI.

Vậy bằng cách nào AI có thể đẩy nhân loại đến nguy cơ tuyệt chủng?

Theo các chuyên gia, điều đáng lo ngại nhất là AI có thể dẫn tới thảm họa theo nhiều phương thức khác nhau.

Các kịch bản tồi tệ nhất trải dài từ việc gây hỗn loạn chính trị bằng thông tin sai lệch đến khả năng làm biến đổi không thể đảo ngược môi trường Trái Đất.

Một nguy cơ khác đến từ khả năng AI chế tạo và khai thác vũ khí hủy diệt hàng loạt.

Trong cuộc đua phát triển những hệ thống AI ngày càng mạnh, các cường quốc có thể vô tình tạo ra một hệ thống mất kiểm soát hoặc hoạt động theo cách không thể dự đoán. Nếu AI tiếp cận được vũ khí hạt nhân hoặc vũ khí sinh học, hậu quả có thể là thảm họa đối với toàn nhân loại.

Mất kiểm soát và xâm nhập các hệ thống quan trọng

Phần lớn những mối đe dọa từ AI siêu thông minh bắt nguồn từ điều các nhà nghiên cứu gọi là “bài toán căn chỉnh” (alignment problem).

Vấn đề cốt lõi là khi con người tạo ra một AI thông minh hơn chính mình, việc bảo đảm mục tiêu của hệ thống luôn phù hợp với lợi ích và mục tiêu của con người có thể trở nên vô cùng khó khăn.

Thế giới đã có một lời cảnh báo rõ ràng về rủi ro này khi hơn 1.000 bot AI do OpenAI tạo ra thoát khỏi môi trường bảo mật và xâm nhập Hugging Face, nền tảng công khai lưu trữ các mô hình AI nguồn mở.

Các bot này không được yêu cầu tấn công Hugging Face. Chúng chỉ vô tình được giao một nhiệm vụ bất khả thi, rồi tự xác định rằng cách tốt nhất để giải quyết vấn đề là đánh cắp các câu trả lời.

Một số nhà nghiên cứu lo ngại những mô hình AI mạnh hơn có thể gặp phải sai lệch tương tự trong việc “căn chỉnh” mục tiêu, nhưng với quy mô và hậu quả nghiêm trọng hơn nhiều.

Giáo sư Mark Lee, chuyên gia AI tại Đại học Birmingham, nói rằng nguy cơ này thậm chí còn lớn hơn cả “robot có vũ trang”.

Ông cho rằng các công ty AI lớn đang chạy đua phát triển những hệ thống có trí thông minh ngang hoặc vượt con người, trong khi hiện chưa có phương thức đủ tin cậy để kiểm soát hành vi của chúng.

Do AI tồn tại dưới dạng phần mềm, bất kỳ hệ thống nào kết nối với Internet đều có thể trở thành mục tiêu.

“Chẳng hạn, nếu hệ thống điều khiển giao thông quốc gia hoặc một nhà máy điện hạt nhân bị tấn công, hậu quả có thể rất thảm khốc”, ông nói.

Gây hỗn loạn xã hội

Chú thích ảnh
Bộ khung xương của robot Terminator. Ảnh minh hoạ: Wikipedia

AI mất kiểm soát thậm chí không cần trực tiếp gây hại cho con người vẫn có thể làm chấm dứt cuộc sống như chúng ta biết.

Tiến sĩ Andrew Rogoyski thuộc Viện Trí tuệ nhân tạo lấy con người làm trung tâm của Surrey cho rằng một AI thực sự thông minh sẽ nhận ra sự phụ thuộc lẫn nhau với nhân loại.

Theo ông, con người sẽ cần AI để thực hiện những công việc mình mong muốn, trong khi AI lại cần con người cung cấp vật liệu, năng lượng, hệ thống làm mát, mạng lưới và dữ liệu.

Vì vậy, việc trực tiếp hủy diệt nhân loại trong một thảm họa quy mô lớn có thể không phải lựa chọn có lợi nhất đối với AI.

Tiến sĩ Rogoyski cho rằng điều này nhiều khả năng sẽ khiến AI mang lại lợi ích cho nhân loại về lâu dài. Tuy nhiên, một số chuyên gia lại nhìn nhận nguy cơ theo hướng đáng lo ngại hơn.

Một kịch bản “tinh vi và nguy hiểm hơn” là AI có thể âm thầm kiểm soát con người thông qua thông tin sai lệch và tuyên truyền, từ đó kích động những cuộc xung đột tàn khốc giữa con người.

Andrea Miotti, nhà sáng lập kiêm Giám đốc điều hành ControlAI, nói rằng không ai, kể cả những nhà phát triển AI hàng đầu, hiện biết cách kiểm soát AI siêu thông minh. Theo ông, đây chính là yếu tố tạo ra nguy cơ tuyệt chủng đối với nhân loại.

Nếu hàng tỷ tác nhân AI siêu thông minh hoạt động mà con người không thể kiểm soát, đồng thời cạnh tranh với nhau để giành nguồn lực và quyền lực, con người có thể trở thành “thiệt hại ngoài ý muốn”.

Ông Miotti cho rằng quá trình này cuối cùng có thể dẫn tới việc nhân loại từng bước mất đi quyền kiểm soát và khả năng tự quyết định.

Châm ngòi chiến tranh hạt nhân

Chú thích ảnh
Vụ thử hạt nhân Badger, có sức công phá 23 kiloton, được thực hiện ngày 18/4/1953 tại Khu thử nghiệm Nevada. Ảnh minh hoạ: Wikipedia

Xét về những cách thức AI có thể trực tiếp dẫn đến sự chấm dứt của đời sống con người, mối đe dọa rõ ràng nhất đến từ những loại vũ khí mà thế giới hiện sở hữu.

Hiện có 9 quốc gia sở hữu vũ khí hạt nhân, với tổng cộng khoảng 12.187 đầu đạn.

Nếu bất kỳ quốc gia nào trong số này rơi vào tay một hệ thống AI bị “lệch mục tiêu” nghiêm trọng, những vũ khí đó có thể bị sử dụng chống lại chính con người.

Đáng lo ngại hơn, AI siêu thông minh thậm chí không cần có ý đồ xấu mới có thể dẫn đến kịch bản này.

Một hệ thống AI có thể tìm cách tối đa hóa lợi nhuận cho chủ sở hữu bằng cách gây chấn động thị trường chứng khoán, hoặc tìm cách hạ nhiệt độ toàn cầu và đi đến kết luận rằng một mùa Đông hạt nhân sẽ là phương án nhanh nhất.

Nguy cơ càng lớn khi các cường quốc chủ động chạy đua tích hợp AI vào các hệ thống vũ khí.

Nếu không có con người trực tiếp giám sát quá trình ra quyết định của AI, các cuộc xung đột có thể nhanh chóng vượt khỏi tầm kiểm soát.

Ben Eisenpress, Giám đốc vận hành Viện Future of Life, từng cho biết điều này có thể dẫn đến một “cuộc chiến chớp nhoáng”.

Theo ông, việc tích hợp AI vào hệ thống chỉ huy và kiểm soát hạt nhân có thể gây mất ổn định. Ngay cả khi về mặt kỹ thuật vẫn có “con người trong vòng kiểm soát”, cũng không thể chắc chắn các nhà hoạch định chính sách sẽ bác bỏ một khuyến nghị phóng vũ khí do AI đưa ra nếu khuyến nghị đó có thể sai, trong khi hậu quả liên quan đến sự tồn vong của nhân loại.

Mở đường cho vũ khí sinh học nguy hiểm

AI cũng có thể không hủy diệt nhân loại bằng cách tự thực hiện những mục tiêu của mình, mà bằng cách đưa các công cụ nguy hiểm vào tay những người sẵn sàng sử dụng chúng.

Trước đây, việc chế tạo vi khuẩn hoặc virus làm vũ khí đòi hỏi kiến thức tổng hợp và nguồn lực tài chính của cả một quốc gia.

Tuy nhiên, các chuyên gia nhiều lần cảnh báo những công cụ AI đang khiến việc phát triển vũ khí sinh học nguy hiểm trở nên dễ dàng hơn đáng kể.

Giáo sư Lee cho rằng mối đe dọa thực tế hơn có thể đến từ những đối tượng xấu, chẳng hạn các nhóm khủng bố hoặc các quốc gia hoạt động ngoài khuôn khổ, sử dụng AI để phát triển một loại virus mới và gây ra một đại dịch toàn cầu với mức độ nghiêm trọng hơn.

Ngày 10/9, Anthropic cho biết công ty đã phải ngăn chặn những nỗ lực “có chủ đích” nhằm sử dụng mô hình Claude để phát triển vũ khí sinh học.

Công ty cho biết đã phát hiện 5 vụ việc trong đó người dùng tìm kiếm thông tin “theo những cách có thể hỗ trợ việc phát triển vũ khí sinh học”.

Thông tin trên được đưa ra sau khi một báo cáo cảnh báo các mô hình AI phổ biến được cung cấp rộng rãi có thể dễ dàng bị điều chỉnh để vượt qua các biện pháp bảo đảm an toàn.

Theo báo cáo do nhóm nghiên cứu Crimson Flare công bố, điều này có thể cho phép AI hướng dẫn những đối tượng có ý đồ xấu nhưng thiếu chuyên môn thực hiện từng bước cụ thể để chế tạo chất nổ hoặc vũ khí hóa học và sinh học.

Vân Khánh/Báo Tin tức và Dân tộc