Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

10 nghìn tỷ token mỗi ngày: GLM được cho là vượt mô hình AI Mỹ ở một số chuẩn đo

Cảnh giải thích hiệu năng mô hình AI trong cuộc phỏng vấn / TokenPost.ai

Một số mô hình trí tuệ nhân tạo (AI) của Trung Quốc được cho là đã vượt các mô hình có hiệu năng cao nhất của Mỹ trong một số bài kiểm chuẩn, trong khi GLM được cho là xử lý khoảng 10 nghìn tỷ token mỗi ngày chỉ bằng chip bán dẫn sản xuất tại Trung Quốc. Tuy nhiên, điều kiện kiểm chuẩn và sản lượng xử lý vẫn cần được xác minh độc lập.

Aidan Gomez (Aidan Gomez), đồng sáng lập kiêm CEO Cohere, nói trong cuộc phỏng vấn với chương trình 'The Tech Download' của CNBC rằng không thể quy toàn bộ thành tựu của AI Trung Quốc là kết quả của việc đơn giản sao chép công nghệ Mỹ. Ông thừa nhận khả năng một phần kiến thức đã được trích xuất từ các mô hình Mỹ bằng kỹ thuật chưng cất, nhưng cho rằng không thể giải thích sự phát triển của các mô hình Trung Quốc mới nhất chỉ bằng chưng cất.

Chưng cất là kỹ thuật sử dụng đầu ra của mô hình hiệu năng cao để huấn luyện một mô hình tương đối nhỏ và rẻ hơn. Kỹ thuật này được sử dụng hợp pháp trong nghiên cứu AI, nhưng nếu được dùng để trích xuất quy mô lớn các chức năng của mô hình cạnh tranh, nó có thể dẫn đến tranh cãi về chiếm đoạt công nghệ và né tránh các hạn chế tiếp cận.

Cơ quan An ninh Quốc gia Mỹ (NSA), Cục Điều tra Liên bang Mỹ (FBI) và Cơ quan An ninh mạng và Cơ sở hạ tầng Mỹ (CISA) cho rằng các công ty AI có trụ sở tại Trung Quốc đang trích xuất chức năng và năng lực của các mô hình tiên phong Mỹ ở quy mô công nghiệp để huấn luyện mô hình riêng. Các cơ quan này nhận định phương thức trên có thể giúp thu hẹp khoảng cách công nghệ mà không cần đầu tư lớn vào năng lực tính toán, điện năng và chi phí nghiên cứu phát triển, đồng thời nhấn mạnh chưng cất bản thân là một kỹ thuật nghiên cứu hợp pháp và hữu ích.

Gomez cho biết mô hình GLM mới nhất của Trung Quốc đã vượt một số mô hình có hiệu năng cao nhất của Mỹ trong một số bài kiểm chuẩn. Tuy nhiên, các tài liệu công khai chưa xác nhận bài kiểm chuẩn được sử dụng, điều kiện so sánh và phiên bản mô hình.

Sản lượng xử lý của GLM mà ông đề cập đạt khoảng 10 nghìn tỷ token mỗi ngày chỉ bằng chip bán dẫn sản xuất tại Trung Quốc. Con số này được đưa ra trong phát biểu phỏng vấn của Gomez, nhưng chưa có tài liệu nào cho thấy nhà phát triển GLM hoặc một công ty dữ liệu độc lập chính thức xác nhận.

Phía Mỹ cũng đưa ra một trường hợp riêng. Anthropic cho biết trong thư gửi Thượng viện Mỹ rằng các nhà vận hành có liên hệ với Alibaba và viện nghiên cứu Qwen của Alibaba đã sử dụng khoảng 25.000 tài khoản giả để tạo hơn 28,8 triệu cuộc hội thoại với Claude.

Anthropic cho rằng hoạt động này nhằm trích xuất chức năng của mô hình, nhưng tuyên bố trên chưa được xác nhận cuối cùng một cách độc lập. Cách các tài khoản giả và số lượng lớn cuộc hội thoại được sử dụng thực tế trong quá trình huấn luyện mô hình vẫn cần được kiểm chứng riêng.

Chính phủ Trung Quốc bác bỏ cách diễn giải của Mỹ. Mao Ninh (Mao Ning), người phát ngôn Bộ Ngoại giao Trung Quốc, nói sự phát triển của AI Trung Quốc là kết quả của 'tự chủ và tự cường khoa học công nghệ' cùng hợp tác cởi mở, đồng thời kêu gọi Mỹ chấm dứt 'cáo buộc sai trái và vu khống' nhằm vào Trung Quốc.

Tranh luận lần này đã mở rộng từ hiệu năng mô hình sang khả năng tự chủ về chip bán dẫn và hạ tầng trung tâm dữ liệu. Các biện pháp kiểm soát xuất khẩu của Mỹ từ lâu tập trung hạn chế Trung Quốc tiếp cận chip AI hiệu năng cao và thiết bị liên quan.

Việc các công ty AI Trung Quốc tiếp cận chip bán dẫn hiệu năng cao và biện pháp kiểm soát xuất khẩu của Mỹ từng được đề cập trong một bài viết trước đây, xoay quanh khả năng 확보 tài nguyên tính toán của ngành AI Trung Quốc và hiệu quả của kiểm soát xuất khẩu. Phát biểu lần này tiếp tục dẫn đến thảo luận rằng cần kiểm tra đồng thời không chỉ hiệu năng mô hình mà cả cấu trúc cung ứng chip thực tế.

Nếu tuyên bố của Gomez được xác nhận, các công ty Trung Quốc có thể kết hợp mô hình tự phát triển với chip sản xuất trong nước để phần nào giảm tác động của kiểm soát xuất khẩu Mỹ. Tuy vậy, vẫn khó đánh giá sản lượng xử lý của GLM và tỷ lệ sử dụng chip Trung Quốc phản ánh quy mô vận hành thực tế đến mức nào.

Hiệu năng mô hình, phương thức huấn luyện và sản lượng xử lý suy luận là những chỉ số khác nhau. Việc vượt một số bài kiểm chuẩn không đủ để kết luận toàn bộ AI Trung Quốc đã vượt AI Mỹ, cũng như tuyên bố về sản lượng xử lý cao không đủ chứng minh khả năng tự chủ về chip bán dẫn.

Nghi vấn chưng cất do các cơ quan tình báo Mỹ nêu ra cũng chưa đủ để ngay lập tức quy toàn bộ thành tựu của AI Trung Quốc là sản phẩm sao chép. Cần xác minh riêng việc chưng cất có được sử dụng trong phát triển một số mô hình hay không và hiệu năng của các mô hình mới nhất bắt nguồn từ nghiên cứu phát triển độc lập đến mức nào.

Thời gian tới, hiệu năng thực tế của mô hình, phương thức huấn luyện và cấu trúc cung ứng chip sẽ cần được kiểm chứng thêm. Việc nhà phát triển hoặc công ty dữ liệu độc lập xác nhận sản lượng xử lý của GLM và tỷ lệ sử dụng chip sản xuất tại Trung Quốc cũng sẽ là những điểm được theo dõi.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1