Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

thenextwebthenextweb+1dell+1Nvidia bestätigte am Montag, dass die KI-Plattform der nächsten Generation, Vera Rubin, die volle Produktion erreicht hat. Die Systeme werden nun an Kunden wie OpenAI, CoreWeave , Google Cloud, Microsoft Azure , Meta und Dell ausgeliefert, wie aus einem Briefing am Hauptsitz des Unternehmens hervorgeht, über das zuerst Bloomberg berichtete.thenextweb
Ian Buck, Nvidias Vizepräsident für Accelerated Computing, erklärte, dass die Produktionsauslieferungen im Gange seien und OpenAI plane, Vera Rubin-Systeme im dritten Quartal in großem Maßstab einzusetzen. CoreWeave, einer der ersten Cloud-Anbieter, der die Hardware erhielt, berichtete, dass seine NVL72-Racks den zehnfachen Token-Durchsatz der vorherigen Grace Blackwell-Generation liefern.coreweave+1
Die Rubin-GPU im Herzen der Plattform verfügt über 336 Milliarden Transistoren, 288 GB HBM4-Speicher mit einer Bandbreite von 22 TB/s und 50 Sparse-Petaflops an NVFP4-Inferenzleistung, was der fünffachen Inferenzkapazität der vorherigen Blackwell-Architektur entspricht. Das Vera Rubin NVL72, ein Full-Rack-System, das 72 Rubin-GPUs mit 36 Vera-CPUs kombiniert, nutzt Flüssigkeitskühlung, um interne Verkabelung zu eliminieren, wodurch die Komponenten dichter gepackt werden können.tech-insider+3
Nvidia nutzte das Briefing auch, um seine eigene Vera-CPU mit dem Turin-Chip von AMD zu vergleichen, und beanspruchte eine nahezu doppelt so hohe Leistung bei Python-Workloads, ein Benchmark, der gewählt wurde, weil Python den Software-Stack für KI-Inferenz dominiert. Anthropic, Perplexity, SpaceX und Oracle gehören neben OpenAI und CoreWeave zu den frühen Empfängern.thenextweb
Die Lieferkette der Plattform umfasst mehr als 350 Fabriken in 30 Ländern, mit über 150 Ökosystempartnern allein in Taiwan. Dell war der erste Systemanbieter, der Vera Rubin NVL72 PowerRack-Einheiten an CoreWeave auslieferte, und hob dabei bis zu 10-mal niedrigere Kosten pro Token im Vergleich zu Blackwell für groß angelegte agentische KI-Inferenz hervor.investor.nvidia+3
Der Produktionsmeilenstein folgt auf monatelange Vorbereitungen. Jensen Huang erklärte bereits auf der Computex Anfang Juni, dass sich Vera Rubin in der vollen Produktion befinde, und Nvidia stellte die Sieben-Chip-Plattform offiziell auf der GTC 2026 im März vor. Das Briefing am Montag lieferte die ersten von Kunden gemeldeten Leistungsdaten, wenngleich eine unabhängige Überprüfung der Angaben noch aussteht.datacenterknowledge+2