Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1Neue Benchmark-Daten der InferenceX-Plattform von SemiAnalysis zeigen, dass die GPU Instinct MI355X von Advanced Micro Devices, Inc. das 2,8 Billionen Parameter schwere Kimi K3-Modell von Moonshot AI zu niedrigeren Kosten pro Token ausführt als der B300 von Nvidia . Das gibt AMD nur wenige Tage vor der Vorlage der Zahlen für das zweite Quartal neue Munition im KI-Chip-Rennen im Rechenzentrumsmarkt.
Die InferenceX-Plattform, ein herstellerneutraler Open-Source-Benchmark, der die KI-Inferenzleistung über GPUs und Software-Stacks hinweg kontinuierlich misst, hat zum Start von Kimi K3 Vergleiche auf den neuesten Nvidia- und AMD-GPUs veröffentlicht. Berichten über die Ergebnisse zufolge betreibt der MI355X Kimi K3 zu weniger als der Hälfte der stündlichen Cloud-Mietkosten des B300. Dieser Unterschied ist vor allem auf den deutlich niedrigeren Preis des MI355X pro GPU-Stunde am Markt zurückzuführen. Cloud-Anbieter listen MI355X-Instanzen derzeit ab etwa 2,50 US-Dollar pro GPU-Stunde, verglichen mit rund 6,00 US-Dollar für den B300.news.ycombinator+4
Kimi K3, das am 16. Juli vom in Peking ansässigen Unternehmen Moonshot AI veröffentlicht wurde, ist ein Mixture-of-Experts-Modell mit insgesamt 2,8 Billionen Parametern und einem Kontextfenster von einer Million Token. Seine schiere Größe, die 288 GB HBM pro GPU erfordert, führt dazu, dass es bei FP4-Präzision nicht auf ältere B200-Knoten von Nvidia passt. Das beschränkt den Einsatz auf B300-, GB300 NVL72- oder MI355X-Systeme. Diese Hardware-Einschränkung führt effektiv zu einem direkten Vergleich zwischen den neuesten 288-GB-Beschleunigern von AMD und Nvidia.amd+3
Das Ergebnis bei Kimi K3 setzt ein Muster fort, das bereits in früheren InferenceX-Vergleichen von SemiAnalysis sichtbar war. Beim kleineren Kimi K2.6-Modell lieferte der B300 zwar 29 Prozent mehr Rohdurchsatz pro GPU, doch der MI355X war pro Token um 23 Prozent günstiger. Eine ähnliche Dynamik zeigte sich bei MiniMax M3, wo der MI355X trotz geringerem absoluten Durchsatz um 24 Prozent günstiger pro Token war. Eine unabhängige Bewertung von Signal65 im Juli ergab, dass der MI355X über mehrere Modelle hinweg 1,4- bis 2,1-mal mehr Token pro Dollar erzielte als der B200.signal65+2
Der Zeitpunkt ist bemerkenswert. AMD legt am 4. August seine Zahlen für das zweite Quartal 2026 vor. Der Konsens erwartet einen Umsatz von rund 11,2 Milliarden US-Dollar, was einem Wachstum von 46 Prozent gegenüber dem Vorjahr entspricht. Das Rechenzentrumssegment, das im ersten Quartal dank anhaltender Auslieferungen von Instinct-GPUs 5,8 Milliarden US-Dollar erreichte, steht für Anleger im Mittelpunkt. Wedbush hat kürzlich seine Umsatzschätzung für 2026 mit Verweis auf ein schneller als erwartet ausfallendes Wachstum im Rechenzentrumsbereich auf 49,2 Milliarden US-Dollar angehoben.seekingalpha+3
Ob sich Kostenvorteile bei Inferenz-Benchmarks in Marktanteilsgewinne übersetzen, bleibt die zentrale Frage. Nvidias B300 führt weiterhin beim Rohdurchsatz, und sein CUDA-Software-Ökosystem bleibt in den Unternehmen tief verankert. Doch während Open-Weight-Modelle wie Kimi K3 die Hardware-Anforderungen an ihre Grenzen treiben, bietet der Preisvorteil von AMD Hyperscalern und Cloud-Anbietern eine attraktive Alternative in ihren Wirtschaftlichkeitsberechnungen.