Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

420 token/giây: DeepSeek V4.1 Flash lập tốc độ trong thử nghiệm nội bộ

Đồng hồ bấm giờ đặt cạnh laptop và bàn tay đang thao tác / TokenPost.ai (macro)

DeepSeek V4.1 Flash đã đạt tốc độ xuất token 420 token/giây trong một bài kiểm tra nội bộ. Mô hình này tạo ra hơn 71.000 token liên tục chỉ trong chưa đầy 3 phút.

BlockBeats là bên đầu tiên đưa tin về kết quả đo thực tế này vào ngày 8 (giờ địa phương). Theo bài viết, tốc độ xuất token qua API của DeepSeek V4 Flash 0731 - phiên bản được nêu ra để so sánh - đạt khoảng 128 token/giây theo số liệu đo của Artificial Analysis.

Chưa rõ hai con số này có được đo trong cùng điều kiện hay không, nên việc so sánh trực tiếp còn hạn chế. Kỷ lục 420 token/giây lần này cũng chỉ là kết quả của một lần đo trong thử nghiệm nội bộ, tốc độ thực tế có thể thay đổi tùy độ dài đầu vào, cách gửi yêu cầu và điều kiện máy chủ.

Token là đơn vị mà các mô hình AI dùng để xử lý câu chữ. Tốc độ xuất token thể hiện tốc độ mô hình tạo ra câu trả lời - chỉ số này càng cao thì thời gian phản hồi khi tạo mã lệnh hay văn bản dài càng được rút ngắn.

V4.1 Flash là phiên bản thử nghiệm được giới thiệu với cấu trúc mô hình mới và khả năng đa phương thức (multimodal), tức xử lý đồng thời văn bản và hình ảnh.

Ở phiên bản thử nghiệm, người dùng vẫn gọi qua địa chỉ API cũ nhưng đổi tên mô hình thành deepseek-v4.1-flash-expires-on-0910. Số yêu cầu đồng thời cho mỗi tài khoản bị giới hạn ở mức 20. Điều kiện thử nghiệm nội bộ mà DeepSeek từng công bố trước đó cũng giữ nguyên địa chỉ API cũ và giới hạn 20 yêu cầu đồng thời.

Chưa rõ con số “0910” trong tên mô hình có phải là ngày kết thúc thử nghiệm hay có liên quan đến thời điểm chuyển sang phiên bản chính thức hay không. Việc có ra mắt chính thức hay không, thời gian cung cấp và mức giá cuối cùng cũng chưa được công bố.

Giá của phiên bản thử nghiệm hiện được giữ nguyên như DeepSeek V4 Flash. Theo tài liệu chính thức của DeepSeek, giá của V4 Flash được tính dựa trên số token đầu vào và số token đầu ra. Vì vậy, riêng kỷ lục tốc độ lần này chưa đủ để kết luận rằng chi phí sử dụng API đã giảm.

DeepSeek V4 Flash chuyển sang bản beta công khai từ ngày 31 tháng 7. Tài liệu chính thức của DeepSeek khi đó cho biết V4 Flash 0731 vẫn giữ nguyên cấu trúc và quy mô so với phiên bản preview trước đó, nhưng đã được huấn luyện lại.

Do V4.1 Flash được giới thiệu với cấu trúc mới, khác biệt về hiệu năng so với phiên bản cũ chỉ có thể so sánh khi có benchmark chính thức được đo trong cùng điều kiện. Riêng tốc độ xuất token không đủ để đánh giá năng lực suy luận hay chất lượng kết quả của mô hình.

Để đánh giá khả năng áp dụng vào dịch vụ thực tế, cần xem xét đồng thời số yêu cầu xử lý cùng lúc, độ trễ phản hồi, khả năng xử lý ngữ cảnh dài, chất lượng đầu ra và chi phí. Hiện tại, số liệu cốt lõi được công bố mới chỉ là tốc độ xuất token đo được trong thử nghiệm nội bộ và các điều kiện gọi API còn giới hạn.

Một điểm cần theo dõi là khi phiên bản chính thức được công bố, liệu DeepSeek có so sánh trực tiếp với V4 Flash 0731 trong cùng điều kiện đầu vào, máy chủ và cách gửi yêu cầu hay không. Đánh giá về mô hình này có thể thay đổi tùy vào thời điểm DeepSeek công bố chính thức và thời điểm công bố benchmark theo từng điều kiện.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1