Supermicro hat begonnen, Nvidias Rack-Systeme vom Typ Vera Rubin NVL72 auszuliefern – die ersten Systeme, die Kunden erreichen, und damit der Schritt von der Referenzarchitektur in die Serienfertigung.
Jeder Rack vereint 72 Rubin-GPUs und 36 Vera-CPUs zu einer einzigen flüssigkeitsgekühlten Maschine. Achtzehn 1U-Recheneinschübe mit je vier GPUs und zwei CPUs sind über neun NVLink-Switch-Einschübe der sechsten Generation verbunden, die 216 TB/s Scale-up-Bandbreite liefern. Ein Rack trägt 20,7 TB HBM4 und bis zu 54 TB LPDDR5X.
Supermicro liefert den kompletten Stack der direkten Flüssigkühlung – von Cold Plates und Manifolds bis zu In-Row-CDU mit 1,8 MW Leistung und N+1-Redundanz, optional ergänzt durch Rear-Door-Wärmetauscher. Die DCBBS-Blueprints definieren ausgewogene Stücklisten von 5 MW bis Gigawatt-Maßstab; ein Blueprint auf Basis einer einzigen Vera-Rubin-NVL72-Scalable-Unit umfasst 16 Rechenracks mit 1.152 Rubin-GPUs und 331 TB HBM4. Ein Team übernehme Standortprüfung, Design, Integration, Tests, Lieferung und Support.
„Wir haben jahrelang genau für diesen Moment den Kühlungsstack, die Fertigungskapazität und die Deployment-Teams aufgebaut“, sagte CEO Charles Liang. Weil die Leistungsdichte Flüssigkühlung zwingend macht, werden Rack, Kühlkreislauf und Gebäudetechnik als Paket verkauft. Nvidia hatte angekündigt, die Produktionsauslieferung von Vera-Rubin-Systemen in der zweiten Jahreshälfte zu beginnen.




