Cuộc đua AI chuyển sang giá và hiệu quả

Các hãng AI đang đẩy mạnh giảm chi phí sử dụng mô hình khi doanh nghiệp ngày càng chú trọng hiệu quả đầu tư và tìm kiếm những lựa chọn phù hợp hơn với ngân sách. Xu hướng này cũng mở ra một vấn đề Việt Nam cần lưu ý khi thúc đẩy ứng dụng AI: không chỉ năng lực mô hình mà chi phí, hiệu quả sử dụng và khả năng tiếp cận công nghệ cũng ngày càng quan trọng.

Chú thích ảnh
Biểu tượng của OpenAI. Ảnh: TTXVN

Theo báo chí Anh ngày 14/8, cuộc cạnh tranh về giá trên thị trường AI đang gia tăng trong bối cảnh chi phí sử dụng công nghệ này ngày càng lớn, buộc một số doanh nghiệp phải hạn chế nhu cầu hoặc tìm kiếm những lựa chọn tiết kiệm hơn.

Xu hướng này tạo thêm cơ hội cho các nhà phát triển Trung Quốc như Moonshot và DeepSeek mở rộng thị phần, thu hút người dùng từ Thung lũng Silicon đến châu Âu.

OpenAI gần đây thông báo giảm 80% giá mô hình GPT-5.6 Luna, sản phẩm nhanh và có chi phí thấp nhất của hãng. Giá đầu vào giảm từ 1 USD xuống 0,2 USD cho mỗi triệu token, trong khi giá đầu ra giảm từ 6 USD xuống 1,2 USD.

Anthropic cũng ra mắt Claude Opus 5 với mức giá 5 USD cho một triệu token đầu vào và 25 USD cho một triệu token đầu ra, bằng một nửa mức giá của Fable 5, mô hình mạnh nhất của hãng. Anthropic đồng thời hủy kế hoạch tăng giá Sonnet 5, dự kiến có hiệu lực từ tháng 9.

Theo chỉ số giá token của Silicon Data, những động thái trên góp phần kéo mức giá khách hàng phải trả cho các mô hình AI hàng đầu của Mỹ giảm gần 25% kể từ giữa tháng 7.

Token là đơn vị dữ liệu được các mô hình ngôn ngữ xử lý và thường được sử dụng để tính chi phí. Khách hàng trả tiền cho token đầu vào, tức dữ liệu đưa vào mô hình, và token đầu ra, tức nội dung được hệ thống tạo ra.

Từ cuộc đua năng lực đến cuộc đua chi phí

Việc giảm giá cho thấy chiến lược cạnh tranh của các hãng AI đang có thêm một trọng tâm mới. Nếu trước đây các nhà phát triển mô hình đóng chủ yếu cạnh tranh về năng lực xử lý, sự xuất hiện của những mô hình mở có chi phí thấp hơn đang khiến hiệu quả sử dụng và giá thành trở thành yếu tố được quan tâm nhiều hơn.

Sức ép này gia tăng khi OpenAI và Anthropic chuyển một bộ phận khách hàng doanh nghiệp từ gói thuê bao cố định sang hình thức thanh toán theo mức sử dụng. Theo cơ chế này, doanh nghiệp trả tiền dựa trên lượng tài nguyên tính toán thực tế mà họ tiêu thụ.

Chi phí tăng khiến một số công ty áp giới hạn sử dụng AI hoặc thử nghiệm các lựa chọn rẻ hơn. DoorDash và Airbnb cho biết đã bắt đầu sử dụng các mô hình do Trung Quốc phát triển nhằm kiểm soát chi phí AI.

Trong khi đó, các phòng thí nghiệm Trung Quốc liên tục đưa ra sản phẩm mới và thu hẹp khoảng cách về hiệu năng với những mô hình hàng đầu của Mỹ. Điều này tạo thêm lựa chọn cho doanh nghiệp, đồng thời thúc đẩy cạnh tranh về giá trên thị trường AI.

Tuy nhiên, giá token niêm yết không phản ánh đầy đủ chi phí thực tế của một mô hình. Một hệ thống có năng lực cao hơn có thể hoàn thành một nhiệm vụ bằng ít token hoặc ít lần thử hơn. Do đó, mô hình có giá token cao hơn vẫn có thể tạo ra tổng chi phí thấp hơn.

Chi phí cũng phụ thuộc vào chế độ xử lý mà người dùng lựa chọn, bởi yếu tố này quyết định lượng tài nguyên tính toán được sử dụng để xử lý yêu cầu.

Theo Artificial Analysis, đơn vị đánh giá các mô hình AI trong những lĩnh vực như toán học, khoa học, lập trình và suy luận, Anthropic Opus 5 ở chế độ trung bình có hiệu năng và chi phí cho mỗi nhiệm vụ tương đương Moonshot Kimi K3 ở mức tối đa.

GPT-5.6 Luna của OpenAI ở mức tối đa cũng có hiệu năng gần tương đương DeepSeek V4 Flash, nhưng chi phí cho mỗi nhiệm vụ vẫn cao gần gấp đôi.

Hiệu quả sử dụng ngày càng quan trọng

Ông Mantas Lukauskas, lãnh đạo công nghệ AI tại nhà cung cấp dịch vụ lưu trữ website Hostinger, nhận định giá của những mô hình mạnh nhất hiện vẫn đi ngang hoặc tiếp tục tăng. Theo ông, những thay đổi gần đây là phép thử đối với khả năng duy trì mức giá ở phân khúc cao cấp của OpenAI và Anthropic.

Diễn biến trên cho thấy thị trường AI đang bước vào giai đoạn mà năng lực công nghệ và chi phí ngày càng gắn chặt với nhau. Doanh nghiệp không chỉ cần một mô hình mạnh mà còn phải cân nhắc mô hình nào phù hợp với từng nhiệm vụ, mức độ sử dụng và ngân sách.

Đối với Việt Nam, khi AI được thúc đẩy trong doanh nghiệp, cơ quan nhà nước và các lĩnh vực kinh tế theo định hướng phát triển khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số, vấn đề chi phí sử dụng cũng có ý nghĩa thực tế. Khả năng tiếp cận những mô hình phù hợp, tối ưu tài nguyên tính toán và lựa chọn công nghệ theo từng nhu cầu sẽ ảnh hưởng đến hiệu quả ứng dụng AI.

Cuộc cạnh tranh trên thị trường vì thế không chỉ diễn ra giữa những mô hình có năng lực cao hơn, mà còn giữa những mô hình có thể cung cấp hiệu quả tính toán tốt hơn với chi phí hợp lý. Khi các nhà đầu tư tiếp tục yêu cầu ngành AI chứng minh khả năng tạo lợi nhuận từ những khoản đầu tư lớn vào hạ tầng và phát triển công nghệ, áp lực tối ưu chi phí nhiều khả năng sẽ trở thành một phần ngày càng rõ của cuộc đua AI.

Hải Trần/Báo Tin tức và Dân tộc

Dành cho bạn

Meta tăng tốc cuộc đua AI giữa lo ngại về quyền riêng tư

Meta tăng tốc cuộc đua AI giữa lo ngại về quyền riêng tư

Meta, Tập đoàn công nghệ sở hữu các nền tảng Facebook, Instagram và WhatsApp, ngày 23/9 khai mạc hội nghị thường niên Connect tại trụ sở ở Menlo Park, bang California, tập trung giới thiệu những bước phát triển mới về trí tuệ nhân tạo (AI), kính thông minh và công nghệ thực tế ảo, trong bối cảnh công ty phải đối mặt với những lo ngại ngày càng lớn về quyền riêng tư và an toàn người dùng.

Biểu tượng của OpenAI và ChatGPT. Ảnh minh họa: AFP/TTXVN (Không được phép sử dụng, chia sẻ bởi bên thứ ba)

Chatbot AI vẫn dẫn tin từ các hãng truyền thông Nga bị EU cấm

Một thử nghiệm của tổ chức Phóng viên Không biên giới (RSF) cho thấy ChatGPT, Claude và Grok có thể tổng hợp tin từ các cơ quan truyền thông Nga bị EU trừng phạt. Trong nhiều trường hợp, các chatbot không cảnh báo người dùng về tình trạng của nguồn tin.

Cựu lãnh đạo Google cảnh báo AI lặp lại sai lầm mạng xã hội

Cựu lãnh đạo Google cảnh báo AI lặp lại sai lầm mạng xã hội

Ông Tom Siegel, cựu Phó Chủ tịch phụ trách an toàn và tin cậy của Google, cảnh báo ngành công nghệ có thể đang lặp lại những sai lầm từng xảy ra trong thời kỳ mạng xã hội phát triển, đồng thời kêu gọi giảm tốc độ phát triển AI trước những rủi ro đối với trẻ em.