Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

GPU và Cerebras chạy song song, General Compute nhắm vận hành quý I/2027

Bộ tăng tốc GPU và chip quy mô wafer / TokenPost.ai

General Compute đang thúc đẩy hạ tầng suy luận AI kết hợp GPU NVIDIA($NVDA) với chip chuyên dụng của Cerebras. Mô hình này phân bổ quá trình xử lý đầu vào và tạo câu trả lời cho các loại chip khác nhau nhằm hỗ trợ các tác vụ AI dạng tác tử.

Crypto Briefing đưa tin General Compute sẽ vận hành song song chip quy mô wafer của Cerebras với GPU hiện có. Công ty đặt mục tiêu đưa công suất tính toán dành cho khách hàng vào hoạt động trong quý I/2027, trong đó các tác vụ lập trình dạng tác tử được xem là lĩnh vực ứng dụng đầu tiên.

Trên trang web chính thức, General Compute giới thiệu mô hình trong đó GPU xử lý 'prefill', tức xử lý đồng thời toàn bộ prompt, còn các chip chuyên dụng như Cerebras và SambaNova đảm nhiệm 'decode', tức tạo token tuần tự. Công ty đang giới thiệu Cerebras CS-3 là sản phẩm 'Shipping now'.

Prefill là giai đoạn xử lý song song ngữ cảnh đầu vào dài, chịu ảnh hưởng lớn từ năng lực tính toán. Decode tạo từng token trong câu trả lời nên băng thông bộ nhớ và tốc độ truyền dữ liệu có vai trò quan trọng.

Trong sách trắng tháng 8, General Compute cho biết decode là nút thắt khó giải quyết chỉ bằng năng lực tính toán của GPU. Động cơ quy mô wafer của Cerebras được giới thiệu với cấu trúc đặt trọng số mô hình trong SRAM bên trong chip nhằm giảm truy cập bộ nhớ bên ngoài.

General Compute cho rằng phương thức này phù hợp với các tác vụ dạng tác tử, nơi tốc độ tạo token cho từng người dùng có ý nghĩa quan trọng. AI dạng tác tử có thể thực hiện nhiều vòng suy luận khi phản hồi yêu cầu của người dùng, khiến độ trễ tạo câu trả lời trở thành một yếu tố hiệu năng đáng chú ý.

Cerebras cũng từng công bố chiến lược suy luận phân tách bằng chip chuyên dụng. Trong tài liệu công bố tháng 6, Cerebras đề xuất phương án để chip AWS Trainium xử lý prefill và Cerebras CS-3 đảm nhiệm decode.

Trong cùng tài liệu, Cerebras cho biết đã ký hợp đồng triển khai công suất tính toán suy luận quy mô 750MW với OpenAI. Diễn biến này phù hợp với xu hướng phân bổ tài nguyên tính toán theo đặc điểm công việc, thay vì xử lý cả huấn luyện và suy luận trên cùng một hệ thống chip.

General Compute đang thúc đẩy mô hình kinh doanh triển khai nhiều loại chip chuyên dụng tại các trung tâm dữ liệu hiện có và cơ sở cho thuê chỗ đặt máy chủ, cho phép khách hàng sử dụng công suất tính toán thông qua một hợp đồng duy nhất. Trang web của công ty liệt kê Cerebras, SambaNova, Positron, d-Matrix và NVIDIA B300 trong danh mục sản phẩm.

Công ty cũng đang huy động vốn. General Compute đã huy động khoản nợ tối đa 400 triệu USD (khoảng 543,6 tỷ won) từ Upper90 vào tháng 7. TechCrunch đưa tin nguồn vốn khi đó được sử dụng để mở rộng dịch vụ đám mây suy luận dựa trên SambaNova SN50.

TechCrunch cũng mô tả đây là trường hợp sử dụng chip chuyên dụng cho suy luận làm tài sản thế chấp tài chính. Tuy nhiên, chưa có thông tin công khai cho thấy khoản vốn lần này được sử dụng trực tiếp để mua chip Cerebras.

General Compute cũng có điểm giao với ngành tiền mã hóa. Trong cuộc phỏng vấn với TechCrunch vào tháng 5, Finn Puklowski, CEO General Compute, cho biết các công ty khai thác Bitcoin(BTC) đang xem xét chuyển đổi các cơ sở hiện có thành trung tâm dữ liệu AI.

Chưa có thông tin xác nhận việc Cerebras được triển khai lần này có liên quan đến một công ty khai thác cụ thể hay doanh nghiệp tại Việt Nam. Mô hình kinh doanh được General Compute công bố là bố trí nhiều loại chip tại trung tâm dữ liệu và cơ sở cho thuê chỗ đặt máy chủ, nhưng công ty chưa đưa ra lịch triển khai cho từng khách hàng.

Một trường hợp hạ tầng suy luận AI sử dụng chip chuyên dụng là mô hình sử dụng suy luận quy mô wafer của Cerebras từng được giới thiệu trước đây. Khi đó, phương án phân chia Cerebras và GPU theo từng tác vụ cũng được đề cập.

Cerebras cũng nhấn mạnh bộ nhớ bên trong chip và độ trễ thấp khi giới thiệu CS-4 như một hệ thống tập trung vào suy luận. Tuy nhiên, hiệu năng sản phẩm và khả năng mở rộng kinh doanh chỉ có thể được đánh giá sau khi xem xét đồng thời độ ổn định nguồn cung thực tế, khả năng tương thích mô hình và chi phí vận hành.

General Compute đặt mục tiêu đưa công suất tính toán dành cho khách hàng vào hoạt động trong quý I/2027. Số lượng chip Cerebras thực tế được mua, giá trị hợp đồng và lịch triển khai theo từng khách hàng vẫn chưa được công bố.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1