Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Chi phí mỗi tác vụ giảm khoảng 1/3: GPT-5.6 so với Claude Fable 5

Tài liệu so sánh chi phí đặt cạnh máy tính cầm tay / TokenPost.ai

Cuộc đua giá giữa các mô hình AI mới nhất của OpenAI và Anthropic đang chuyển từ so sánh đơn giá mỗi token sang so sánh tổng chi phí cho mỗi tác vụ. Trong khi các mô hình AI Trung Quốc vẫn nổi bật với bảng giá công khai thấp hơn, một số phép so sánh trên tác vụ lập trình và tác vụ dạng agent cho thấy các mô hình hàng đầu của Mỹ có thể hoàn thành công việc với ít token và thời gian hơn, từ đó kéo tổng chi phí xuống thấp hơn.

Trong thông báo công bố GPT-5.6 ngày 9 tháng 7, OpenAI cho biết GPT-5.6 Sol sử dụng chưa đến một nửa số token đầu ra và mất chưa đến một nửa thời gian so với Claude Fable 5 trên Artificial Analysis Coding Agent Index, đồng thời chi phí thấp hơn khoảng 1/3. Phép so sánh này không dựa trên đơn giá API đơn thuần mà dựa trên chi phí thực tế để hoàn thành một tác vụ cụ thể.

Artificial Analysis cho biết bảng xếp hạng coding agent của họ đo chi phí theo mức phí API trả theo dung lượng trung bình cho mỗi tác vụ. Điều này có nghĩa là ngay cả khi đơn giá 1 triệu token cao hơn, nếu số lần thử lại và lượng token đầu ra giảm, chi phí thực tế cho công việc vẫn có thể thay đổi.

Anthropic công bố giá của Claude Fable 5 và Claude Mythos 5 lần lượt là 10 USD (khoảng 14.150 KRW) cho mỗi 1 triệu token đầu vào và 50 USD (khoảng 70.750 KRW) cho mỗi 1 triệu token đầu ra. Về phía OpenAI, hãng đã giảm giá GPT-5.6 Luna 80% và giá GPT-5.6 Terra 20% vào ngày 30 tháng 7.

Reuters nhận định việc OpenAI giảm giá là phản ứng trước áp lực chi phí AI của khách hàng doanh nghiệp cũng như sự cạnh tranh từ các mô hình giá rẻ của Trung Quốc. Đây cũng là lý do khiến doanh nghiệp ngày càng khó đánh giá mô hình AI nào tốt hơn chỉ dựa vào bảng giá.

Các mô hình Trung Quốc vẫn giữ lợi thế về đơn giá công khai. DeepSeek niêm yết giá deepseek-chat ở mức 0,27 USD (khoảng 382 KRW) cho mỗi 1 triệu token đầu vào và 1,10 USD (khoảng 1.557 KRW) cho mỗi 1 triệu token đầu ra.

Z.AI công bố giá GLM-5.1 ở mức 1,4 USD (khoảng 1.981 KRW) cho mỗi 1 triệu token đầu vào và 4,4 USD (khoảng 6.226 KRW) cho mỗi 1 triệu token đầu ra. Kimi K2.6 của Moonshot có giá 0,95 USD (khoảng 1.344 KRW) cho đầu vào và 4,00 USD (khoảng 5.660 KRW) cho đầu ra, tính trên mỗi 1 triệu token.

Tuy nhiên, hiệu năng, tốc độ và đặc thù công việc của từng mô hình khác nhau, nên chỉ liệt kê bảng giá có thể khiến phép so sánh bị lệch. Trong phép so sánh giữa Kimi K3 và GPT-5.6 Terra của Artificial Analysis, Kimi K3 đạt chỉ số trí tuệ 60, cao hơn đối thủ. Nhưng GPT-5.6 Terra (chế độ high) có giá 1,74 USD (khoảng 2.462 KRW) cho mỗi 1 triệu token, thấp hơn mức 2,31 USD (khoảng 3.269 KRW) của Kimi K3, đồng thời được đánh giá có tốc độ nhanh hơn.

Dữ liệu sử dụng thực tế cũng phản ánh cả hai xu hướng trên. Trong báo cáo chỉ số vận hành AI Gateway tháng 7 năm 2026, Vercel cho biết tính đến tháng 6, Anthropic chiếm 61% tổng chi tiêu nhưng chỉ chiếm 32% tỷ trọng token.

Ngược lại, các mô hình mã nguồn mở xử lý 29% lượng token nhưng tỷ trọng chi tiêu chưa đến 4%. Cùng báo cáo này, DeepSeek chiếm 22,6% lượng token qua gateway.

Khoảng cách này cũng kéo theo bài toán cấu trúc chi phí cho doanh nghiệp Hàn Quốc và các dự án Web3. Với công việc gọi lặp lại nhiều như chatbot, hỗ trợ lập trình, kiểm tra bảo mật hay phân tích dữ liệu, đơn giá token vẫn quan trọng. Nhưng với các tác vụ coding agent phức tạp hay tự động hóa kéo dài, tỷ lệ thành công, số lần thử lại và lượng token đầu ra mới là yếu tố quyết định tổng chi phí.

Xu hướng doanh nghiệp Mỹ cân nhắc sử dụng mô hình Trung Quốc mà TokenPost từng đưa tin cũng gắn liền với áp lực chi phí tương tự. Thử nghiệm cắt giảm chi phí mỗi tác vụ của AI dạng agent mà TokenPost từng phản ánh cũng cho thấy cấu trúc vận hành và lượng token sử dụng, chứ không phải bản thân giá mô hình, mới là yếu tố có thể thay đổi chi phí.

Cuộc đua này còn kéo theo tranh cãi về an ninh công nghệ. Reuters đưa tin một quan chức cấp cao của chính phủ Mỹ đặt nghi vấn rằng quá trình phát triển Kimi K3 của Moonshot AI có sử dụng kỹ thuật chưng cất từ Claude Fable của Anthropic, trong khi phía Trung Quốc bác bỏ cáo buộc này.

Điểm mấu chốt của phép so sánh lần này không phải là mô hình Mỹ luôn rẻ hơn mô hình Trung Quốc. Trên bảng giá công khai, các mô hình Trung Quốc vẫn duy trì đơn giá thấp, trong khi ở một số phép so sánh theo tác vụ cụ thể, hiệu quả của các mô hình thuộc OpenAI và Anthropic lại nổi bật hơn.

Chi phí thực tế của doanh nghiệp phụ thuộc vào giá mô hình, tỷ lệ hoàn thành tác vụ, lượng token sử dụng và cách định tuyến yêu cầu. Cuộc đua chi phí AI dự kiến sẽ tiếp tục được nhìn nhận qua cả đơn giá mỗi 1 triệu token lẫn chi phí hoàn thành công việc thực tế.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1