Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

coreweave+1news.bmsnvidianews.nvidia+1Die rack-skalierbare KI-Plattform Vera Rubin NVL72 der NVIDIA Corporation bewegt sich zügig auf eine breite kommerzielle Verfügbarkeit zu. CoreWeave hat die ersten gemessenen Leistungsergebnisse veröffentlicht, und die Bristol Myers Squibb Company hat Pläne zur Nutzung der Architektur für die Arzneimittelforschung bekannt gegeben.
CoreWeave veröffentlichte am Sonntag Benchmark-Daten, die zeigen, dass die Vera Rubin NVL72 bei der Ausführung des DeepSeek R1-Modells den 10-fachen Tokendurchsatz pro Megawatt im Vergleich zur vorherigen NVIDIA GB200 NVL72-Generation erreichte, bei identischen Interaktivitätszielen. Der Test nutzte modernste Inferenzoptimierungen, darunter Experten-Parallelisierung, NVFP4-Präzision, Multi-Token-Vorhersage sowie disaggregiertes Prefill und Decoding. Bei voller Skalierung erzeugte ein Vera Rubin NVL72-Rack etwa 800.000 Token pro Sekunde bei gleicher Leistungsaufnahme, während ein Grace Blackwell-System laut Berichten von WCCFTech 80.000 erreichte.wccftech+1
Am selben Tag kündigte Bristol Myers Squibb an, ein zweites NVIDIA DGX SuperPOD auf Basis von acht DGX Vera Rubin NVL72-Systemen einzusetzen, das als die leistungsfähigste KI-Recheninfrastruktur der Life-Sciences-Branche beschrieben wird. Das Unternehmen erklärte, die Plattform werde Wissenschaftlern helfen, größere chemische Räume zu bewerten, komplexere molekulare Vorhersagen zu treffen und Forschungszeiten zu verkürzen. Laut dem NVIDIA-Blog könnte BMS das weltweit erste biopharmazeutische Unternehmen sein, das die Vera Rubin-Architektur betreibt.pulse2+2
CoreWeave schloss am 1. Juni die branchenweit erste Inbetriebnahme und Validierung der Vera Rubin NVL72 in seinem Werk in Livingston, New Jersey, unter Verwendung der PowerEdge XE9812-Serverplattform von Dell Technologies ab. Das Rack umfasst 72 Rubin-GPUs und 36 Vera-CPUs, die über ein 260 TB/s NVLink 6-Fabric verbunden sind.mlq+2
NVIDIA-CEO Jensen Huang bestätigte während seiner Keynote auf der CES 2026 im Januar, dass sich die Plattform in der Serienproduktion befindet. Das Unternehmen bekräftigte später auf der Computex, dass die Auslieferungen im Herbst 2026 beginnen würden. Cloud-Partner wie Google Cloud , Microsoft Azure und Oracle Cloud Infrastructure werden voraussichtlich in der zweiten Jahreshälfte Vera Rubin-Instanzen anbieten.hashrateindex+4
Die Plattform integriert sieben gemeinsam entwickelte Chips für Computing, Netzwerk, Speicher und Sicherheit und ist für agentische KI-Workloads konzipiert, bei denen Reasoning-Modelle pro Abfrage deutlich mehr Token generieren als herkömmliche Inferenzmodelle.coreweave+1