Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cerebras.ai+1cerebras.ai+1Business Insider+1AMD Advanced Micro Devices, Inc. und Cerebras Systems gaben am Dienstag eine technische Partnerschaft bekannt, um eine disaggregierte KI-Inferenzplattform zu entwickeln, die die Helios-Infrastruktur auf Rack-Ebene von AMD mit der Wafer-Scale-Engine-Technologie von Cerebras kombiniert. Basierend auf internen Berechnungen aus dem Juli 2026 soll das kombinierte System bis zu fünfmal mehr Tokens pro Sekunde und Watt liefern als eine reine Cerebras-WSE-Konfiguration.cerebras.ai+1
Das gemeinsame Angebot teilt verschiedene Teile einer Inferenz-Arbeitslast der Hardware zu, die für die jeweilige Phase am besten geeignet ist. AMD Helios übernimmt die rechenintensive Vorverarbeitung von Nutzeranfragen mit hohem Durchsatz, während die WSE-Technologie von Cerebras die Token-Generierung übernimmt, bei der ihre Vorteile hinsichtlich der Speicherbandbreite am stärksten zum Tragen kommen.Investing.com+1
Die Plattform soll in der zweiten Hälfte des Jahres 2026 über die Cerebras Cloud verfügbar werden.cerebras.ai+1
Die Ankündigung erfolgte während der Keynote von AMD-Chefin Lisa Su auf der Veranstaltung Advancing AI 2026 in San Francisco am 23. Juli. Wie Business Insider berichtete, spiegelt die Partnerschaft AMDs breitere Wette wider, dass die disaggregierte Inferenz, also das Aufteilen von KI-Arbeitslasten auf spezialisierte Hardware anstatt alles auf einem einzigen Chip auszuführen, die nächste Phase der KI-Infrastruktur darstellt.Business Insider+2
Dieser Ansatz hat branchenweit an Dynamik gewonnen. AWS und Cerebras hatten im März 2026 eine ähnliche Zusammenarbeit angekündigt, bei der Amazon-Trainium-Chips für die Vorverarbeitung mit Cerebras-Hardware für die Dekodierung auf Amazon Bedrock kombiniert wurden. Nvidia übernahm Groq, um eine vergleichbare Architektur zu verfolgen. UBS schrieb im Juni laut Business Insider, dass die Einschränkungen aktueller Systeme einen Wandel hin zur disaggregierten Inferenz vorantreiben.youtube+2
Die Einigung mit Cerebras erfolgte inmitten einer Reihe von Ankündigungen auf der Advancing AI 2026. AMD stellte sein vollständiges Helios-Rack-System vor, das 72 Instinct-MI455X-Beschleuniger mit 31 TB HBM4-Speicher bündelt und etwa drei KI-Exaflops pro Rack liefert. Su betonte, Helios liefere bis zu 30 Prozent mehr Inferenz-Tokens pro Dollar als Nvidias Vera-Rubin-NVL72-Rack.DCDNoticias+2
Zudem gab AMD am Tag zuvor eine milliardenschwere Infrastrukturpartnerschaft mit Anthropic bekannt, die zu bestehenden Beziehungen mit OpenAI, Meta , Microsoft und Oracle hinzukommt.Business Insider
Für Cerebras ist der AMD-Deal die Fortsetzung einer Reihe wichtiger Partnerschaften nach dem Börsengang zu Beginn dieses Jahres, bei dem 6.4 Milliarden US-Dollar in der nach Unternehmensangaben größten Halbleiter-Neuemission aller Zeiten eingesammelt wurden. Cerebras betreibt im Rahmen eines im Januar unterzeichneten Multimilliarden-Dollar-Vertrags bereits das GPT-5.4-Modell von OpenAI.The New York Times+2