OpenAI, Anthropic và xAI liên tiếp hạ giá API của các mô hình trí tuệ nhân tạo (AI) hiệu năng cao, mở rộng tiêu chí cạnh tranh từ năng lực mô hình sang hiệu quả chi phí. Ba công ty đồng thời nhấn mạnh các biện pháp đánh giá an toàn và bảo vệ, nhưng chưa có bằng chứng xác nhận mối liên hệ nhân quả trực tiếp giữa việc giảm giá và những thay đổi này.
OpenAI công bố GPT-6 Sol và Luna vào ngày 22. Sol có giá 2 USD (khoảng 2.708 won) cho 1 triệu token đầu vào và 10 USD (khoảng 13.540 won) cho 1 triệu token đầu ra. Luna có giá 0,10 USD (khoảng 135 won) cho token đầu vào và 0,50 USD (khoảng 677 won) cho token đầu ra. Giá của cả hai mô hình thấp hơn 50% so với mức giá khuyến mại của GPT-5.6 Pro.
OpenAI cho biết chi phí được giảm nhờ cải thiện bộ nhớ đệm và hạ tầng suy luận. Bộ nhớ đệm là phương thức tái sử dụng dữ liệu đầu vào đã được xử lý để giảm lượng tính toán bổ sung.
Anthropic ra mắt Claude Opus 5.5 trong cùng ngày. Giá token đầu vào là 4 USD (khoảng 5.416 won) cho mỗi 1 triệu token, còn token đầu ra là 20 USD (khoảng 27.080 won), thấp hơn mức 5 USD (khoảng 6.770 won) và 25 USD (khoảng 33.850 won) của Opus 5.
Anthropic giải thích rằng chi phí vận hành Opus 5.5 trong môi trường sử dụng thông thường đã giảm khoảng 40%. Giá token đầu vào được lưu trong bộ nhớ đệm cũng giảm còn 0,20 USD (khoảng 271 won) cho mỗi 1 triệu token, so với 0,50 USD (khoảng 677 won) trước đây.
xAI công bố Grok 4.7 vào ngày 21. Giá API bắt đầu từ 2 USD (khoảng 2.708 won) cho 1 triệu token đầu vào và 6 USD (khoảng 8.124 won) cho 1 triệu token đầu ra. Token đầu vào được lưu trong bộ nhớ đệm có giá 0,50 USD (khoảng 677 won).
Tài liệu của xAI ghi rõ mức phí riêng được áp dụng cho ngữ cảnh dài hơn 200.000 token. Vì vậy, khó có thể so sánh đơn giản chi phí sử dụng thực tế của ba mô hình chỉ dựa trên đơn giá token bề mặt.
Đợt giảm giá lần này gần với cuộc cạnh tranh về 'chi phí suy luận' hơn là một đợt giảm giá đơn thuần. Trong các dịch vụ AI dành cho doanh nghiệp, tổng chi phí triển khai phụ thuộc không chỉ vào chất lượng câu trả lời mà còn vào việc cùng một tác vụ được xử lý bằng bao nhiêu token và phép tính.
Chi phí thực tế có thể thay đổi tùy vào số lần gọi, tỷ lệ bộ nhớ đệm được sử dụng, tốc độ xử lý, việc dùng ngữ cảnh dài và phí sử dụng công cụ, bên cạnh đơn giá token. Đặc biệt, các dịch vụ tác nhân AI và tự động hóa có tần suất gọi cao cần được xem xét cả cấu trúc gọi cùng với giá mô hình.
Giá giảm tạo điều kiện để nhà phát triển và doanh nghiệp gọi các mô hình hiệu năng cao thường xuyên hơn. Tuy nhiên, giá token thấp hơn không đồng nghĩa tổng chi tiêu AI hoặc khả năng sinh lời của doanh nghiệp sẽ lập tức cải thiện.
Tăng cường an toàn là yếu tố được cả ba công ty cùng nhấn mạnh. Anthropic cho biết Opus 5.5 đã trải qua quá trình xác minh trước khi ra mắt bởi các tổ chức đánh giá bên ngoài METR và Frontier Design. xAI giải thích rằng họ áp dụng đánh giá an toàn trong toàn bộ quá trình phát triển mô hình, đồng thời công bố thẻ mô hình và kết quả đánh giá.
OpenAI cho biết vào ngày 18 tháng 8, công ty đã tạm dừng khoảng hai tuần hoạt động huấn luyện tăng cường trong quá trình nghiên cứu các mô hình có năng lực mạng máy tính nguy hiểm cao, đồng thời tăng cường cô lập, giám sát và xác minh căn chỉnh trong môi trường nghiên cứu. Công ty cho biết chi phí giám sát có thể tương đương khoảng 20% lượng tính toán suy luận được giám sát.
Trường hợp trước đây OpenAI công bố việc tạm dừng huấn luyện tăng cường và tăng cường kiểm soát an ninh chưa được xác nhận là có liên hệ trực tiếp với chính sách giá lần này. Tuy vậy, diễn biến này cho thấy tốc độ phát triển mô hình và chi phí quản lý an toàn đang được thảo luận đồng thời.
Các số liệu về hiệu năng và an toàn do từng công ty đưa ra có thể sử dụng điều kiện đánh giá và đối tượng so sánh khác nhau. Anthropic đã công bố đánh giá bên ngoài, còn xAI công bố đánh giá an toàn riêng, nhưng chưa có tài liệu so sánh ba mô hình theo cùng một tiêu chuẩn.
Nhận định về việc các mô hình AI của Trung Quốc có lợi thế giá lên tới 9 lần so với các mô hình Mỹ đã được loại khỏi bài viết do chưa xác nhận được tiêu chuẩn so sánh giống nhau và tài liệu chính thức. Cũng chưa thể khẳng định việc giảm giá đã tạo điều kiện tài chính cho phát triển ưu tiên an toàn, do cơ cấu chi phí và thay đổi ngân sách nghiên cứu an toàn của các công ty chưa được công bố.
Thị trường API mô hình AI trong thời gian tới có thể đồng thời xem xét chính sách bộ nhớ đệm, phí ngữ cảnh dài, tốc độ xử lý và phương thức đánh giá an toàn, bên cạnh giá token. Bảng giá lần này cho thấy OpenAI, Anthropic và xAI đã bước vào cuộc cạnh tranh nhấn mạnh hiệu quả chi phí.
Bình luận 0