Trong bối cảnh triển khai Nghị quyết 57 và Thông báo 24, Việt Nam đang đẩy mạnh làm chủ, phát triển và ứng dụng trí tuệ nhân tạo gắn với bảo đảm an ninh, an toàn. Những nguy cơ AI bị lạm dụng trong quân sự, an ninh mạng, sinh học và thông tin đặt ra yêu cầu quản trị rủi ro.
Trong bối cảnh triển khai Nghị quyết 57 và Thông báo 24, Việt Nam đang đẩy mạnh làm chủ, phát triển và ứng dụng trí tuệ nhân tạo gắn với bảo đảm an ninh, an toàn. Những nguy cơ AI bị lạm dụng trong quân sự, an ninh mạng, sinh học và thông tin đặt ra yêu cầu quản trị rủi ro.
Một nhóm nghiên cứu an ninh mạng đã sử dụng mô hình trí tuệ nhân tạo (AI) Claude của Anthropic để khai thác lỗ hổng trong hệ thống của OpenAI, qua đó chiếm quyền truy cập một số tài khoản nhân viên và chứng minh khả năng tiếp cận kho mã nguồn nội bộ của công ty phát triển ChatGPT.
Một nhà nghiên cứu hàng đầu về an toàn trí tuệ nhân tạo (AI) đã gây lo ngại trong tuần này sau khi nghỉ việc và cảnh báo công nghệ này có thể “hủy diệt nhân loại” ngay trong thập kỷ tới.
Kể từ tháng 8/2026, Anthropic - công ty đứng sau mô hình ngôn ngữ Claude - chính thức gắn watermark, một dấu kỹ thuật số vô hình lên mọi sản phẩm đầu ra của hệ thống trên phạm vi toàn cầu.
Công ty trí tuệ nhân tạo (AI) Anthropic đang triển khai phiên bản thử nghiệm của một hệ thống cho phép các trợ lý AI như Claude điều khiển thiết bị khoa học và kỹ thuật để tự tiến hành các thí nghiệm. Đây được xem là một bước tiến mới của Anthropic trong việc đưa AI từ môi trường số vào thế giới vật lý.
Công ty công nghệ Anthropic mới đây đã đăng một bài viết trên blog nhằm giải đáp các câu hỏi cơ bản về cách gắn dấu nhận diện kỹ thuật số chìm (watermark) vào văn bản do chatbot Claude tạo ra.
Anthropic đang tăng cường kiểm soát các kênh truy cập gián tiếp vào Claude, sau khi một số doanh nghiệp Trung Quốc bị phát hiện sử dụng công cụ AI của hãng thông qua công ty con ở nước ngoài, nhà cung cấp điện toán đám mây hoặc tài khoản cá nhân của nhân viên.
Theo nghiên cứu được Trung tâm Truyền thông, Công nghệ và Dân chủ thuộc Đại học McGill công bố hôm 16/3, các mô hình trí tuệ nhân tạo (AI) hàng đầu như ChatGPT, Gemini, Claude và Grok có mức độ hiểu biết sâu rộng về các sự kiện thời sự tại Canada – một dấu hiệu cho thấy chúng đã hấp thụ đáng kể nội dung báo chí trong quá trình huấn luyện.
Các chuyên gia cho rằng việc triển khai công cụ trí tuệ nhân tạo (AI) trong các chiến dịch tấn công Iran đang báo hiệu sự ra đời của kỷ nguyên ném bom mới với tốc độ nhanh hơn cả “suy nghĩ”.
Bộ trưởng Quốc phòng Mỹ Pete Hegseth đã đặt thời hạn chót (ngày 27/2), yêu cầu Anthropic, đơn vị phát triển chatbot Claude, mở công nghệ trí tuệ nhân tạo (AI) cho quân đội sử dụng không hạn chế nếu không có thể bị hủy hợp đồng với chính phủ.
Các “bộ não nhân tạo” như ChatGPT, Gemini, Claude, Deepseek, Copilot hay Meta AI… đang từng bước trở thành hạ tầng cốt lõi trong nhiều lĩnh vực. Nhưng trong cuộc chơi tưởng như toàn “siêu nhân” này, mỗi mô hình lại mang những ưu thế và điểm yếu riêng.
Ngày 4/3, Anthropic, công ty khởi nghiệp được Google và Amazon đầu tư, đã ra mắt bộ mô hình trí tuệ nhân tạo (AI) Claude 3, gồm Claude 3 Opus, Claude 3 Sonnet và Claude 3 Haiku. Đây là bộ chatbot mới nhất trong cuộc cạnh tranh khốc liệt ở Thung lũng Silicon trong lĩnh vực công nghệ AI này.