Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

0h ngày 27/8: Alibaba hé lộ Qwen3.8-Flash-Next, kiến trúc nền cho Qwen4

Laptop và đồng hồ để bàn vào lúc nửa đêm / TokenPost.ai

Alibaba (BABA) sẽ công bố Qwen3.8-Flash-Next (Qwen3.8-Flash-Next), mô hình ứng dụng kiến trúc thế hệ mới dùng để vận hành Qwen4 (Qwen4), vào lúc 0h ngày 27/8 theo giờ Hàn Quốc, trước khi phiên bản chính thức Qwen4 ra mắt.

Theo BlockBeat đưa tin ngày 26/8, trang ModelScope đã đăng tải giao diện giới thiệu trước cho Qwen3.8-Flash-Next. Thời điểm công bố được ấn định vào 23h ngày 26/8 theo giờ Trung Quốc, tương đương 0h ngày 27/8 theo giờ Hàn Quốc.

Mô hình này được giới thiệu là mô hình hỗn hợp chuyên gia (MoE) đa phương thức, dựa trên kiến trúc thế hệ mới sẽ vận hành Qwen4. Đây chưa phải bản chính thức của Qwen4, mà mang tính chất bản xem trước kỹ thuật, giúp giới lập trình viên và cộng đồng tiếp cận cấu trúc mới trước khi dòng Qwen4 chính thức ra mắt.

Đa phương thức là khái niệm chỉ cấu trúc mô hình có thể xử lý đồng thời nhiều dạng dữ liệu đầu vào như văn bản, hình ảnh, chứ không chỉ riêng văn bản. Trong khi đó, mô hình hỗn hợp chuyên gia không kích hoạt toàn bộ tham số trong mỗi lượt xử lý, mà chỉ chọn ra phần cần thiết cho từng tác vụ, qua đó giúp tối ưu chi phí xử lý và tốc độ phản hồi của các mô hình quy mô lớn.

Điều Alibaba ưu tiên công bố lần này là kiến trúc, chứ không phải tên sản phẩm. Giới quan sát nhận định đây là bước đi nhằm công bố kiến trúc mới trước khi Qwen4 chính thức trình làng, qua đó rút ngắn thời gian để môi trường phát triển và quy trình kiểm định cho dòng sản phẩm kế tiếp được chuẩn bị sớm hơn.

BlockBeat cho biết trước đó Alibaba từng áp dụng cấu trúc lai kết hợp Gated DeltaNet và cơ chế attention thông thường trong Qwen3-Next (Qwen3-Next), và dòng Qwen3.5 sau đó tiếp tục kế thừa thiết kế này. Lần công bố này cũng nằm trong xu hướng công bố kiến trúc mới trước, rồi mở rộng sang các dòng sản phẩm tiếp theo.

Tốc độ ra mắt mô hình của Alibaba cũng là điều được chú ý. BlockBeat cho biết Alibaba vừa công bố Qwen3.8-Max (Qwen3.8-Max) với quy mô 2.400 tỷ tham số hồi đầu tháng này, và chưa đầy một tháng sau đã tiếp tục hé lộ kiến trúc thế hệ kế tiếp.

[Trước đó, TokenPost từng đưa tin Alibaba đã công bố mã nguồn mở dòng mô hình Qwen3.8](https://www.tokenpost.kr/news/cryptocurrency/391304). Theo bài viết khi đó, Qwen3.8-27B được giới thiệu là mô hình dense đa phương thức gốc với quy mô 27 tỷ tham số.

Mô hình dense sử dụng toàn bộ tham số một cách nhất quán trong mỗi lượt xử lý, còn mô hình hỗn hợp chuyên gia chỉ kích hoạt chọn lọc một số mạng chuyên gia nhất định. Mô hình dense được đánh giá cao ở sự đơn giản khi triển khai, trong khi cấu trúc hỗn hợp chuyên gia lại có lợi thế về hiệu quả vận hành ở quy mô lớn.

Trong hệ sinh thái mô hình mã nguồn mở, giới lập trình viên không chỉ quan tâm đến chỉ số hiệu năng, mà còn xem xét giấy phép sử dụng, cách công bố trọng số, chi phí suy luận, khả năng xử lý ngữ cảnh dài và mức độ hỗ trợ đa phương thức. Giấy phép, trọng số và kết quả benchmark cụ thể của Qwen3.8-Flash-Next sẽ chỉ được xác nhận sau khi mô hình chính thức ra mắt vào ngày 27/8.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1