Vera Rubin đang chuyển sang giai đoạn triển khai thực tế
Việc Supermicro bắt đầu xuất xưởng NVL72 diễn ra trong bối cảnh NVIDIA đang đẩy mạnh Vera Rubin cho các workload AI quy mô lớn. Trong MLPerf Inference v6.1, NVIDIA cho biết Vera Rubin NVL72 đạt throughput cao hơn tối đa 3,7 lần GB300 NVL72 trên Qwen3-VL và tối đa 2,5 lần trên DeepSeek-R1 trong các bài kiểm tra được công bố. Đây là kết quả do NVIDIA trình bày và cần được hiểu trong phạm vi các cấu hình, phần mềm và phương pháp benchmark tương ứng.
Với Supermicro, điểm quan trọng không chỉ nằm ở hiệu năng GPU mà còn ở khả năng đưa cả hệ thống vào vận hành nhanh hơn. DCBBS bao phủ từ khảo sát địa điểm, thiết kế, tích hợp, kiểm thử L11/L12, giao hàng cho tới triển khai tại chỗ và hỗ trợ vận hành.
Điều này phản ánh một xu hướng ngày càng rõ trong hạ tầng AI: khi các hệ thống chuyển từ máy chủ GPU riêng lẻ sang rack chứa hàng chục GPU, nguồn điện, networking và đặc biệt là hệ thống làm mát trở thành một phần quan trọng ngang với GPU.
Vera Rubin NVL72 vì thế không chỉ là thế hệ GPU mới của NVIDIA mà còn đại diện cho cách xây dựng AI factory ở quy mô rack và cụm rack. Việc Supermicro bắt đầu xuất xưởng các hệ thống hoàn chỉnh cho thấy nền tảng này đang tiến thêm một bước từ thiết kế tham chiếu sang triển khai thương mại thực tế.