Zhipu AI(02513.HK) vừa ra mắt mô hình ngôn ngữ lớn mới GLM-5.3 với khả năng lập trình được cải thiện đáng kể. Công ty cho biết trong đánh giá nội bộ, năng lực viết mã của GLM-5.3 cao hơn 50% so với phiên bản tiền nhiệm GLM-5.2.
Theo tờ Yicai (Đệ Nhất Tài Chính) đưa tin, Zhipu AI đã chính thức công bố GLM-5.3. Mô hình mới vẫn sử dụng cùng nền tảng với GLM-5.2, nhưng nhờ mở rộng quy mô huấn luyện sau (post-training scaling), giới hạn năng lực trí tuệ của mô hình đã được nâng lên.
Zhipu AI cho biết GLM-5.3 đứng đầu nhóm mô hình mã nguồn mở trên các bài kiểm tra công khai như Terminal Bench 3.0 và Agents' Last Exam (CLI). Tuy nhiên, kết quả benchmark chỉ mang tính tham khảo để so sánh hiệu năng giữa các mô hình, còn trải nghiệm thực tế khi phát triển ứng dụng còn phụ thuộc vào cách sử dụng và cấu trúc kết nối công cụ.
Việc ra mắt GLM-5.3 diễn ra trong bối cảnh các công ty phát triển mô hình ngôn ngữ lớn của Trung Quốc liên tục cạnh tranh bằng năng lực lập trình và vận hành agent. Theo tài liệu công bố của Zhipu AI, GLM-5.2 là mô hình chủ lực mới nhất, được ra mắt ngày 16 tháng 6, nghĩa là chỉ khoảng hai tháng sau, phiên bản kế nhiệm đã xuất hiện. Trước đó, TokenPost từng đưa tin cụm từ GLM-5.3 từng xuất hiện thoáng qua trong kết quả tìm kiếm của Bing.
Huấn luyện sau (post-training) là giai đoạn bổ sung dữ liệu và quy trình đánh giá riêng cho mô hình đã hoàn tất huấn luyện trước đó, nhằm nâng cao khả năng thực hiện các tác vụ cụ thể. Việc Zhipu AI nhấn mạnh hiệu suất lập trình và kết quả đánh giá agent dựa trên CLI trong lần công bố này cũng phù hợp với định hướng phát triển đó.
Zhipu AI cho biết sẽ mở trọng số (weights) của GLM-5.3 sau hai tuần kể từ ngày công bố. Khi trọng số được công khai, các nhà phát triển và doanh nghiệp có thể tải mô hình về để kiểm tra trực tiếp hoặc thử nghiệm khả năng ứng dụng trong môi trường riêng của mình.
Bình luận 0