Không có thông báo nào

Supermicro bắt đầu xuất xưởng NVIDIA Vera Rubin NVL72, mỗi rack có 72 GPU và 36 CPU

Supermicro đã bắt đầu xuất xưởng các hệ thống NVIDIA Vera Rubin NVL72, đưa nền tảng AI thế hệ mới của NVIDIA từ giai đoạn trình diễn sang các hệ thống rack-scale sẵn sàng triển khai. Supermicro tích hợp NVL72 với nền tảng Data Center Building Block Solutions (DCBBS) cùng hệ thống tản nhiệt chất lỏng trực tiếp DLC-2, hướng tới việc rút ngắn thời gian đưa các cụm AI công suất lớn vào vận hành. Động thái này diễn ra ngay sau khi NVIDIA công bố những kết quả đầu tiên của Vera Rubin NVL72 trên MLPerf Inference v6.1. Trong các bài kiểm tra DeepSeek-R1 và Qwen3-VL, NVIDIA cho biết NVL72 đạt throughput cao hơn đáng kể so với thế hệ GB300 NVL72 trong những cấu hình được thử nghiệm.

Một rack chứa 72 GPU Rubin và 36 CPU Vera

Vera Rubin NVL72 không phải một máy chủ thông thường mà là một hệ thống được thiết kế để hoạt động như một cỗ máy tính toán AI thống nhất ở cấp độ rack. Mỗi rack gồm 72 GPU NVIDIA Rubin và 36 CPU NVIDIA Vera, được bố trí trong 18 khay máy tính 1U. Mỗi khay chứa bốn GPU Rubin và hai CPU Vera, kết nối thông qua chín khay chuyển mạch NVIDIA NVLink thế hệ thứ sáu. Tổng băng thông scale-up giữa các thành phần đạt 216 TB/s. Hệ thống cung cấp 20,7 TB HBM4 cùng tối đa 54 TB LPDDR5X, tạo ra một lượng bộ nhớ rất lớn cho các workload AI có mô hình và tập dữ liệu ngày càng tăng. Ở quy mô lớn hơn, Supermicro có thể ghép 16 rack thành một Scalable Unit gồm 1.152 GPU Rubin và 331 TB HBM4. Thiết kế này đi kèm hệ thống cấp điện, lưu trữ, networking và làm mát được cân bằng theo từng mức công suất từ 5 MW đến quy mô gigawatt. Điều này cho thấy Vera Rubin không được thiết kế đơn thuần để nâng cấp hiệu năng của từng GPU, mà hướng tới việc biến cả rack thành một đơn vị tính toán có khả năng mở rộng.

Làm mát bằng chất lỏng trở thành yêu cầu bắt buộc

Một trong những thay đổi lớn của các hệ thống AI rack-scale thế hệ mới là mật độ công suất và nhiệt lượng ngày càng cao. Với hàng chục GPU cùng hoạt động trong một rack, giải pháp tản nhiệt bằng không khí truyền thống khó đáp ứng yêu cầu. Supermicro vì vậy tích hợp Vera Rubin NVL72 với hệ thống DLC-2 direct liquid cooling. Công ty kiểm tra và xác nhận toàn bộ rack cùng hệ thống làm mát trước khi xuất xưởng, thay vì chỉ cung cấp các máy chủ riêng lẻ để khách hàng tự tích hợp. Hệ thống DCBBS của Supermicro bao gồm nhiều thành phần trong cùng một hệ sinh thái, từ cold plate, manifold, hose kit và rack power shelf cho tới cooling distribution unit (CDU), rear-door heat exchanger và hệ thống làm mát phía cơ sở. Các CDU đặt trong hàng có công suất 1,8 MW, hỗ trợ cấu hình dự phòng N+1. Cách tiếp cận này cho phép Supermicro cung cấp một giải pháp hoàn chỉnh từ phần cứng tính toán đến hạ tầng nhiệt và điện, thay vì chỉ bán rack GPU.

Vera Rubin đang chuyển sang giai đoạn triển khai thực tế

Việc Supermicro bắt đầu xuất xưởng NVL72 diễn ra trong bối cảnh NVIDIA đang đẩy mạnh Vera Rubin cho các workload AI quy mô lớn. Trong MLPerf Inference v6.1, NVIDIA cho biết Vera Rubin NVL72 đạt throughput cao hơn tối đa 3,7 lần GB300 NVL72 trên Qwen3-VL và tối đa 2,5 lần trên DeepSeek-R1 trong các bài kiểm tra được công bố. Đây là kết quả do NVIDIA trình bày và cần được hiểu trong phạm vi các cấu hình, phần mềm và phương pháp benchmark tương ứng. Với Supermicro, điểm quan trọng không chỉ nằm ở hiệu năng GPU mà còn ở khả năng đưa cả hệ thống vào vận hành nhanh hơn. DCBBS bao phủ từ khảo sát địa điểm, thiết kế, tích hợp, kiểm thử L11/L12, giao hàng cho tới triển khai tại chỗ và hỗ trợ vận hành. Điều này phản ánh một xu hướng ngày càng rõ trong hạ tầng AI: khi các hệ thống chuyển từ máy chủ GPU riêng lẻ sang rack chứa hàng chục GPU, nguồn điện, networking và đặc biệt là hệ thống làm mát trở thành một phần quan trọng ngang với GPU. Vera Rubin NVL72 vì thế không chỉ là thế hệ GPU mới của NVIDIA mà còn đại diện cho cách xây dựng AI factory ở quy mô rack và cụm rack. Việc Supermicro bắt đầu xuất xưởng các hệ thống hoàn chỉnh cho thấy nền tảng này đang tiến thêm một bước từ thiết kế tham chiếu sang triển khai thương mại thực tế.

Nguồn: techpowerup
Cộng đồng: