Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

LinkedInFuTu News+1ReutersMeta Platforms setzt eine angepasste Version des Advanced Micro Devices, Inc. Instinct MI450-Beschleunigers ein, die laut dem Halbleiter-Forschungsunternehmen SemiAnalysis die Rechenleistung halbiert und die Speicherkapazität im Vergleich zum Standardmodell MI455X um etwa zwei Drittel reduziert. Die Entscheidung, die für Metas Empfehlungssysteme statt für generative KI optimiert wurde, hat eine ungewöhnliche öffentliche Rüge des Analysehauses ausgelöst, das warnt, dass die Konfiguration Metas KI-Forschungsteams gegenüber Konkurrenten benachteiligen wird.
SemiAnalysis enthüllte am 21. Juli, dass Metas angepasster Chip der MI400-Serie vier Rechenkerne anstelle der standardmäßigen acht verwendet und die zwölf 12-Hi HBM4-Stapel des MI455X — insgesamt 432 GB — durch sechs 8-Hi-Stapel ersetzt, die etwa 144 GB Speicher bieten. Das Infrastrukturteam von Meta rechtfertigte die Konfiguration damit, dass sie auf das Verhältnis von CPU zu GPU abgestimmt sei, das die Arbeitslasten der Empfehlungssysteme erfordern, um die Kosten pro Einheit Speicherbandbreite zu optimieren.FuTu News+1
Das Standardmodell MI455X, das auf dem 2nm-Prozess von TSMC mit Hybrid-Bonding-Verpackung basiert, stellt derzeit das Maximum an GPU-Verpackung und Speicherdichte dar. Die angepasste Variante opfert diesen Spielraum, um Arbeitslasten zu bedienen, die Meta in enormem Umfang ausführt, die sich jedoch stark von den Trainings- und Inferenzaufgaben großer Sprachmodelle unterscheiden, die heute für die KI-Industrie zentral sind.FuTu News
SemiAnalysis bezeichnete die Entscheidung als "katastrophal" und unternahm den seltenen Schritt, AMD öffentlich dazu aufzufordern, direkt mit TBD Lab — Metas Forschungsabteilung für Superintelligenz unter der Leitung von Alexandr Wang — zusammenzuarbeiten, anstatt mit der Infrastrukturorganisation von Meta. Das Unternehmen argumentierte, dass der abgespeckte Chip für die Ingenieure von TBD Lab wenig attraktiv sei, da diese "eindeutig" die Vera Rubin-Architektur von Nvidia bevorzugen würden.LinkedIn+1
Die Kritik fügt sich in ein breiteres Muster ein, das SemiAnalysis bei den Hardwareentscheidungen von Meta identifiziert hat. Das Unternehmen verwies auf den Ariel-Server von Meta — eine angepasste GB200-Konfiguration mit einem Eins-zu-eins-Verhältnis von CPU zu GPU, die 14 Prozent höhere Gesamtbetriebskosten als das Standard-NVL72-Design aufwies — als weiteres Beispiel dafür, dass die Prioritäten von Empfehlungssystemen die Bedürfnisse der Teams für generative KI überlagern. Meta ist inzwischen bei seinen GB300-Servern zur Standardkonfiguration zurückgekehrt, ein implizites Eingeständnis, dass der angepasste Ansatz gescheitert ist.FuTu News
Der angepasste Chip ist Teil einer umfassenderen Fünfjahresvereinbarung, die im Februar angekündigt wurde und im Rahmen derer AMD bis zu sechs Gigawatt an Instinct-GPUs an Meta liefern wird, ein Geschäft mit einem Volumen von bis zu 60 Milliarden Dollar. AMD stellte Meta eine leistungsbasierte Option auf 160 Millionen Aktien aus — potenziell 10 Prozent des Eigenkapitals des Chipherstellers —, wobei die Ausübung an Liefermeilensteine geknüpft ist. Das erste Gigawatt an MI450-basierter Hardware soll in der zweiten Hälfte des Jahres 2026 ausgeliefert werden.Jon Peddie Research+1
SemiAnalysis warnte, dass, wenn das abgespeckte Design Metas primärer AMD-Einsatz bleibt, dies das Volumen von AMD im Unternehmen untergraben und Mark Zuckerbergs Fähigkeit einschränken könnte, freie Kapazitäten an externe Kunden zu vermieten.LinkedIn