Giới hạn tiếp theo của quá trình mở rộng AI đang được cho là nằm ở điện năng và hạ tầng trung tâm dữ liệu, thay vì năng lực tính toán. Cerebras Systems($CBRS) đang ứng phó với các hạn chế của hạ tầng AI bằng kiến trúc sử dụng toàn bộ wafer như một bộ xử lý và nền tảng đám mây riêng.
Andrew Feldman, CEO kiêm đồng sáng lập Cerebras Systems($CBRS), sẽ tham dự TechCrunch Disrupt 2026, diễn ra tại San Francisco, Mỹ từ ngày 13 đến 15 tháng 10. TechCrunch cho biết chủ đề của phiên thảo luận là 'AI có thể tiếp tục mở rộng hay không'.
Phiên thảo luận dự kiến tập trung vào nhu cầu tính toán, điện năng và các hạn chế của hạ tầng trung tâm dữ liệu, sản xuất. Phát biểu cụ thể của Feldman chưa được công bố trước sự kiện.
Thành lập năm 2015, Cerebras là công ty bán dẫn AI. Thay vì kết hợp chiplet và GPU theo cách thông thường, công ty phát triển kiến trúc 'wafer-scale', sử dụng toàn bộ wafer silicon như một bộ xử lý, đồng thời cung cấp cả hệ thống tại chỗ và nền tảng đám mây.
Cerebras cho biết trong báo cáo kết quả kinh doanh quý II/2026 rằng công suất trung tâm dữ liệu đang vận hành hoặc đã ký hợp đồng cung cấp đến cuối năm 2027 vượt 600MW. Con số này bao gồm cả công suất đang hoạt động và công suất sẽ được cung cấp sau khi ký hợp đồng, nên không đồng nghĩa toàn bộ điện năng hiện có thể sử dụng hoặc là công suất dành riêng cho Cerebras.
Cerebras cũng cho biết đã mở rộng năng lực sản xuất năm 2026 lên hơn 10 lần và bảo đảm nguồn cung wafer từ TSMC. Công ty nhấn mạnh kiến trúc wafer-scale không sử dụng bộ nhớ HBM, đóng gói CoWoS và quy trình sản xuất 3 nanomet.
Ra mắt vào tháng 8, CS-4 là hệ thống dạng rack được trang bị ba bộ xử lý WSE-3 Turbo. Cerebras cho rằng CS-4 được công bố trước đó có tốc độ suy luận nhanh hơn tối đa 30 lần so với hệ thống GPU truyền thống và thông lượng trên mỗi watt cao hơn tối đa 10 lần so với thế hệ trước CS-3.
So sánh hiệu năng này dựa trên Artificial Analysis và các bài kiểm tra nội bộ. Mức xử lý hơn 1.000 token mỗi giây trên các mô hình có trên 10 nghìn tỷ tham số là kết quả ngoại suy từ bài kiểm tra nội bộ tháng 8/2026, có thể thay đổi tùy tác vụ, mô hình và cấu hình hệ thống.
Cerebras cho rằng chỉ cải thiện bộ xử lý sẽ khó mở rộng hạ tầng AI. Trong tài liệu công bố CS-4, công ty cho biết cần thiết kế đồng thời năng lực tính toán, điện năng, làm mát và hoạt động nhập xuất. Nền tảng rack Nexus mới tích hợp các mô-đun điện năng, nhập xuất và tính toán, đồng thời giảm 50% số linh kiện so với thế hệ trước.
Cerebras đang phối hợp với AMD để triển khai kiến trúc phân tách quá trình suy luận. AMD Helios phụ trách xử lý prompt và thông lượng cao, trong khi công cụ wafer-scale của Cerebras giảm độ trễ ở giai đoạn tạo phản hồi. Giải pháp hợp tác dự kiến được cung cấp trên Cerebras Cloud vào nửa cuối năm 2026.
Hợp tác với AWS đặt mục tiêu tích hợp vào Amazon Bedrock trong quý I/2027. Qua đó, Cerebras đang mở rộng việc cung cấp ở cấp độ hệ thống, kết hợp hiệu năng bộ xử lý với cấu hình đám mây, trung tâm dữ liệu và mạng.
OpenAI cho biết vào tháng 1/2026 rằng họ sẽ hợp tác với Cerebras để bổ sung năng lực tính toán AI độ trễ cực thấp quy mô 750MW vào nền tảng của mình. Công suất này dự kiến được triển khai theo nhiều giai đoạn đến năm 2028.
Cerebras cũng cho biết sẽ đưa công suất trung tâm dữ liệu đầu tiên tại châu Âu vào vận hành vào cuối năm 2026 và nâng tổng công suất tại châu Âu lên 200MW vào cuối năm 2027. Pháp và Bắc Âu là các khu vực trọng điểm, trong đó một phần công suất sẽ được sử dụng cho các tác vụ của OpenAI.
Tốc độ tăng trưởng và khả năng sinh lời vẫn là những yếu tố cần được theo dõi đồng thời. Doanh thu GAAP từ dịch vụ đám mây và các dịch vụ khác của Cerebras trong quý II/2026 đạt 126 triệu USD (khoảng 170,6 tỷ won), tăng 281% so với cùng kỳ năm trước. Tổng doanh thu GAAP đạt 180,10 triệu USD (khoảng 244 tỷ won), tăng 74%. Tuy nhiên, biên lợi nhuận hoạt động GAAP ở mức -265%.
Nút thắt của hạ tầng AI đang mở rộng từ bản thân chip sang điện năng, làm mát, trung tâm dữ liệu và mạng. Tương tự bài viết trước đó về việc NVIDIA xác định nguồn cung năng lực tính toán là một hạn chế đối với nhu cầu AI, chiến lược của Cerebras cũng tập trung vào việc bảo đảm toàn bộ hệ thống thay vì chỉ nâng hiệu năng của từng chip bán dẫn.
Việc hiệu năng CS-4 và kế hoạch mở rộng trung tâm dữ liệu do Cerebras đưa ra có được triển khai trong môi trường khách hàng thực tế hay không sẽ cần được kiểm chứng qua các đợt giao hàng và báo cáo kết quả kinh doanh tiếp theo. Tại TechCrunch Disrupt 2026 diễn ra từ ngày 13 đến 15 tháng 10, các phát biểu của Feldman về khả năng mở rộng AI dự kiến sẽ được công bố.
Bình luận 0