DeepSeek (DeepSeek) đã ghi nhận 299 triệu lượt yêu cầu văn bản hàng tuần trên OpenRouter, vượt qua Google (Google). Đây được xem là kết quả của việc các mô hình trọng số mở (open-weight) chi phí thấp gia tăng mức sử dụng, tập trung vào các tác vụ dạng tác nhân (agentic).
Theo dịch vụ giám sát dữ liệu AI Beating (Beating) đưa tin ngày 5, lượng yêu cầu văn bản của DeepSeek trong tuần này chiếm 27,1% tổng lượng của OpenRouter. Google đứng ở vị trí thứ hai với 277 triệu lượt, chiếm 25,0%, còn OpenAI (OpenAI) ghi nhận 185 triệu lượt, chiếm 16,8%. Bảng xếp hạng này không tính theo từng mô hình riêng lẻ mà là tổng số lượt yêu cầu API văn bản theo từng nhà cung cấp mô hình.
Lượng yêu cầu của DeepSeek bao gồm cả các lượt gọi đến những mô hình thuộc dòng V4 như DeepSeek V4 Flash và DeepSeek V4 Pro. OpenRouter giới thiệu V4 Flash là mô hình hỗn hợp chuyên gia (MoE) với tổng cộng 284 tỷ tham số, trong đó có 13 tỷ tham số hoạt động. Cửa sổ ngữ cảnh của mô hình này đạt 1 triệu token, và khả năng ứng dụng trong quy trình làm việc dạng tác nhân được nêu là đặc điểm nổi bật.
Dòng V4 chính là động lực giúp mở rộng mức sử dụng của DeepSeek. Trong phân tích công bố ngày 30 tháng 6, OpenRouter cho biết sau khi khảo sát hơn 450 nghìn tỷ token mẫu trong giai đoạn từ ngày 1 tháng 1 đến ngày 14 tháng 6 năm 2026, thị phần token của DeepSeek đã tăng từ 9% lên 18%. Theo một bài viết trước đây của TokenPost, vào cuối tháng 5, V4 Flash đã chiếm tới 70% lưu lượng token dạng tác nhân của DeepSeek.
Các tác vụ dạng tác nhân đòi hỏi mô hình phải được gọi qua nhiều bước để hoàn thành một công việc. OpenRouter giải thích rằng loại tác vụ này tiêu tốn lượng token nhiều hơn khoảng 15 lần trên mỗi yêu cầu so với việc con người sử dụng AI thông thường. Khi việc ứng dụng dạng tác nhân càng tăng, lượng yêu cầu và mức sử dụng token cũng có thể tăng theo.
Trong phân tích ngày 13 tháng 7, OpenRouter cho biết tại thời điểm đó, theo bảng xếp hạng trực tiếp tính theo thị phần token của nhà phát triển mô hình, DeepSeek đứng đầu với 16,7%. Cả V4 Flash và V4 Pro đều nằm trong top 10 mô hình có mức sử dụng cao nhất. Tuy nhiên, con số này được tính theo thị phần token, khác với tiêu chí đo lường của bảng xếp hạng lượng yêu cầu văn bản hàng tuần lần này.
Đánh giá của người dùng có sự trái chiều về chi phí và chất lượng định tuyến (routing). Một người dùng trên diễn đàn AI By Nick cho biết vào ngày 19 tháng 7 rằng họ đang sử dụng V4 Flash cho các tác vụ dạng tác nhân và lập trình, đồng thời đánh giá cao chi phí thấp và tốc độ nhanh. Ngược lại, trong cộng đồng DeepSeek trên Reddit, một số người dùng bày tỏ không hài lòng về chi phí sử dụng lâu dài, hiệu quả bộ nhớ đệm (cache) và sự khác biệt trong định tuyến giữa các nhà cung cấp.
Số liệu thống kê lần này cho thấy sự thay đổi trong mức sử dụng các mô hình AI trên nền tảng OpenRouter. Hiện chưa xác nhận mối liên hệ trực tiếp nào với các token AI cụ thể, dự án blockchain hay kết quả kinh doanh của các công ty bán dẫn.
Nguồn được sử dụng để xác minh: báo cáo phân tích V4 của OpenRouter, phân tích định tuyến DeepSeek của OpenRouter, trang mô hình V4 Flash trên OpenRouter.
Bình luận 0