AMD (AMD, mã $AMD) đã đưa hệ thống rack-scale Helios (Helios) dành cho trung tâm dữ liệu AI vào giai đoạn sản xuất. Công ty cho biết Helios tạo ra số token suy luận trên mỗi USD cao hơn tối đa 30% so với các sản phẩm cạnh tranh.
AMD công bố Helios tại sự kiện 'Advancing AI 2026' ngày 23 tháng 7 và cho biết các công ty AI lớn dự kiến triển khai hệ thống này ở quy mô gigawatt. Lisa Su (Lisa Su), Chủ tịch kiêm Giám đốc điều hành (CEO) AMD, cho biết AI đang mở rộng sang các mô hình nền tảng (frontier model), AI tác nhân (agent) và AI vật lý (physical AI).
Helios được thiết kế theo cấu trúc rack tích hợp 72 GPU AMD Instinct MI455X, 18 CPU EPYC (EPYC) Venice thế hệ thứ 6, hệ thống mạng Pensando (Pensando) và phần mềm ROCm. Thông số sản phẩm gồm hiệu năng 2,9 EF FP4, hiệu năng 1,4 EF FP8, bộ nhớ HBM4 dung lượng 31TB và băng thông bộ nhớ 23,3TB/s trên mỗi GPU.
Trọng tâm của thông báo lần này không nằm ở hiệu năng của từng chip mà ở tính kinh tế theo quy mô rack. Khi các dịch vụ AI chuyển sang mô hình AI tác nhân thực hiện nhiều bước suy luận và gọi công cụ, các nhà vận hành trung tâm dữ liệu đang tính toán chi phí sản xuất token dựa trên tổng chi phí điện năng, bộ nhớ, mạng và phần mềm. Đây là lý do AMD đưa chỉ số token trên mỗi USD lên hàng đầu.
Helios không phải là sản phẩm hoàn chỉnh do AMD trực tiếp bán ra, mà là thiết kế tham chiếu để các công ty OEM, ODM tự xây dựng hệ thống riêng. Việc triển khai hàng loạt các hệ thống dựa trên Helios dự kiến diễn ra vào nửa cuối năm 2026.
Trong chuỗi cung ứng, hệ sinh thái Đài Loan giữ vai trò trục chính. AMD từng công bố vào ngày 21 tháng 5 sẽ đầu tư hơn 10 tỷ USD (khoảng 13.800 tỷ won) vào hệ sinh thái Đài Loan. Các công ty như Sanmina, Wiwynn, Wistron và Inventec sẽ hỗ trợ quá trình chuyển đổi sang sản xuất hàng loạt các hệ thống dựa trên Helios.
Nvidia (Nvidia, mã $NVDA) đang cạnh tranh trên cùng thị trường này với sản phẩm Vera Rubin NVL72 (Vera Rubin NVL72). Nvidia cho biết Vera Rubin NVL72 giảm chi phí trên mỗi triệu token xuống còn 1/10 so với Blackwell (Blackwell) và tăng thông lượng token trên mỗi megawatt tối đa gấp 10 lần. Các con số mà cả hai công ty đưa ra đều là tuyên bố hiệu năng tự công bố, dựa trên cấu hình hệ thống và điều kiện cụ thể riêng.
Tuyên bố vượt trội 30% của AMD dựa trên phép tính của AMD Performance Lab thực hiện vào tháng 6 năm 2026. Công ty nêu rõ kết quả có thể thay đổi tùy theo cấu hình hệ thống của từng nhà sản xuất. Cần có các bài kiểm tra hiệu năng (benchmark) độc lập, so sánh Helios và Vera Rubin trong cùng điều kiện tại trung tâm dữ liệu thực tế, mới có thể đánh giá chính xác chênh lệch chi phí.
AMD cho biết vào ngày 4 tháng 8 rằng doanh thu quý 2 năm 2026 đạt 11,5 tỷ USD (khoảng 15.900 tỷ won), tăng 50% so với cùng kỳ năm trước. Doanh thu mảng trung tâm dữ liệu đạt 6,7 tỷ USD (khoảng 9.200 tỷ won), tăng 107%. CEO Lisa Su nêu ra nhu cầu EPYC tăng, số lượng triển khai Instinct tăng và sản lượng Helios mở rộng là động lực tăng trưởng cho nửa cuối năm.
Vấn đề lần này liên quan trực tiếp đến chuỗi cung ứng chất bán dẫn AI hơn là tiền mã hóa. Helios được trang bị bộ nhớ HBM4, và theo một bài viết trước đây của TokenPost về hợp tác bộ nhớ AI thế hệ mới giữa Samsung Electronics và AMD, GPU Instinct MI455X cùng nền tảng Helios cũng nằm trong phạm vi hợp tác này. Hiện chưa xác nhận mối liên hệ trực tiếp nào với hoạt động đào tiền mã hóa hay mạng lưới blockchain.
Bình luận 0