Alibaba (BABA) chưa phát hành phiên bản trọng số mở (open-weight) cho thế hệ Qwen3.8. Thứ công ty này giới thiệu trước tiên là Qwen3.8 Max Preview, một bản xem trước chỉ có thể gọi qua nền tảng của Alibaba, chứ không phải mô hình tải về dùng trực tiếp. Ở phân khúc mô hình trọng số mở quy mô 27B, cái tên được xác nhận chính thức hiện vẫn là Qwen3.6-27B.
Theo thông báo của Alibaba Group ngày 19 tháng 7, quanh thời điểm diễn ra Hội nghị Trí tuệ nhân tạo Thế giới (WAIC 2026), Qwen3.8 Max Preview đã được đưa lên gói Token Plan, Qoder và QoderWork. Công ty mô tả đây là mô hình đa phương thức (multimodal) quy mô 2.400 tỷ tham số, đồng thời cho biết sẽ sớm phát hành trọng số mở của Qwen3.8 Max.
Điểm mấu chốt của câu chuyện nằm ở phạm vi của từ "mở". Qwen3.8 Max Preview là bản xem trước dạng hosted, người dùng gọi mô hình thông qua nền tảng của Alibaba. Đây khác hẳn mô hình open-weight, nơi nhà phát triển có thể tải trọng số về, chỉnh sửa và triển khai trên hạ tầng riêng của mình.
Danh sách mô hình trên nền tảng API Qwen hiện không có mục nào tên Qwen3.8-27B. Thông tin chính thức được xác nhận chỉ gồm việc cung cấp Qwen3.8 Max Preview và lời hứa công bố trọng số mở của Qwen3.8 Max trong thời gian tới. Việc phát hành open-weight cho Qwen3.8-27B chưa được xác nhận.
Tài liệu Model Studio của Alibaba Cloud cho thấy Qwen3.6-27B được đăng tải từ ngày 23 tháng 4, là mô hình dense xử lý đồng thời thị giác và ngôn ngữ (vision-language) ở quy mô 27B. Alibaba mô tả mô hình này cải thiện so với Qwen3.5-27B ở các khả năng lập trình, STEM, suy luận, hiểu video, nhận dạng ký tự trong tài liệu (OCR) và tác vụ agent thị giác.
Vì vậy, nếu lấy mốc mô hình trọng số mở quy mô 27B làm chuẩn, cái tên được xác nhận ở thời điểm hiện tại vẫn là Qwen3.6-27B. Có thể thấy dòng Qwen3.8 đang đi theo trình tự: tung bản xem trước hosted quy mô cực lớn trước, còn việc phát hành trọng số mở được để lại như một bước riêng.
TokenPost từng đưa tin rằng mô hình trọng số mở quy mô 27B của Qwen, thuộc Alibaba, được xác nhận là Qwen3.6-27B. Khi đó, điểm gây tranh cãi cũng chính là sự vênh nhau giữa cách gọi Qwen3.8-27B xuất hiện ở một số bài viết và tên mô hình trong tài liệu chính thức.
Open-weight là cách công bố trọng số mô hình để nhà phát triển tự chạy và tinh chỉnh trên môi trường của mình. Ngược lại, hosted preview là hình thức nhà cung cấp dịch vụ kiểm soát toàn bộ môi trường vận hành mô hình, còn người dùng chỉ nhận kết quả qua API hoặc nền tảng. Dù cùng một dòng mô hình, cách phân phối khác nhau sẽ kéo theo khả năng tiếp cận và cơ cấu chi phí khác nhau cho nhà phát triển.
Alibaba giới thiệu Qwen3.8 Max Preview phục vụ chủ yếu cho viết code, phân tích dữ liệu, xử lý công việc văn phòng và hiểu hình ảnh. Trong thông cáo riêng, công ty cho biết kết quả thử nghiệm ban đầu của mô hình này ở mức ngay sau Fable 5. Đây là đánh giá từ phía công ty, còn benchmark độc lập, model card hay điều khoản cấp phép vẫn chưa được công bố.
Giới phát triển lại quan tâm nhiều hơn đến các mô hình cỡ vừa có thể chạy trên máy cá nhân, thay vì mô hình xem trước siêu lớn. Trên Hacker News và diễn đàn nhà phát triển của Nvidia, nhiều ý kiến bày tỏ mong chờ một phiên bản phái sinh quy mô 27B. Kỳ vọng chung là khi có mô hình chạy được trên hạ tầng cục bộ hoặc tự triển khai, việc thử nghiệm phát triển và triển khai nội bộ trong doanh nghiệp sẽ thuận lợi hơn.
Cũng có không ít phản ứng dè dặt. Trên V2EX và Linux.do, một số người dùng nhận xét chất lượng câu trả lời chưa đạt kỳ vọng và cho rằng mô hình còn thiếu huấn luyện hậu kỳ (post-training). Đánh giá hiệu năng của mô hình mới vẫn còn khoảng cách giữa công bố của công ty và trải nghiệm thực tế từ cộng đồng.
Vấn đề tương thích công cụ cũng bộc lộ ngay ở giai đoạn đầu. Trên mục issue của kho GitHub qwen-code, có báo cáo cho biết Qwen3.8 Max Preview không chấp nhận cấu hình enable_thinking=false, khiến một số tác vụ nội bộ trả về lỗi 400. Điều này cho thấy sau khi ra mắt, mô hình vẫn cần điều chỉnh để tương thích với các công cụ phát triển thực tế.
Chiến lược Qwen của Alibaba được nhìn nhận là kết hợp song song giữa phát hành open-weight và phân phối qua nền tảng đám mây. Trọng số mở giúp mở rộng khả năng tiếp cận cho nhà phát triển, nhưng ở giai đoạn vận hành thực tế, nhu cầu vẫn gắn với GPU, dịch vụ cloud và trung tâm dữ liệu. Cuộc tranh luận về nhu cầu tính toán xoay quanh các mô hình AI mở cũng tiếp diễn theo mạch tương tự.
Với nhà phát triển và doanh nghiệp trong khu vực, điều kiện phát hành quan trọng hơn tên gọi mô hình. Chỉ khi trọng số mở thực sự được công bố, người dùng mới có cơ sở xem xét giấy phép, model card, môi trường vận hành và phạm vi được phép sử dụng cho mục đích thương mại. Thời điểm và điều kiện phát hành trọng số mở của Qwen3.8 Max sẽ cần được xác nhận qua các thông báo tiếp theo của Alibaba.
Nguồn xác minh: alibabagroup.com, alibabacloud.com, github.com/QwenLM/qwen-code.
Bình luận 0