Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

quiverquant+1quiverquantquiverquant+1Cerebras Systems meddelade på torsdagen att de driver en ny "Ultrafast"-tjänstenivå i OpenAI API för GPT-5.6 Sol, som levererar upp till 750 utdata-tokens per sekund — upp till 14 gånger snabbare än standardbearbetning utan förlust av modellintelligens.quiverquant+1
Lanseringen, som bekräftades samtidigt av OpenAI och Cerebras, markerar en fördjupning av partnerskapet mellan de två företagen och representerar en ny gräns i avvägningen mellan modellkapacitet och inferenshastighet.
Ultrafast är till en början tillgängligt i begränsad förhandsversion för en utvald grupp OpenAI-kunder och kör GPT-5.6 Sol med hastigheter som Cerebras hävdar är 5 gånger snabbare än Claude Opus 4.8 i Fast-läge och 11 gånger snabbare än Claude Fable 5, baserat på utdatahastigheter rapporterade av Artificial Analysis.investing+1
"GPT-5.6 Sol på Ultrafast är bevis på att hastighet och intelligens inte längre utesluter varandra", sade Andrew Feldman, VD och medgrundare av Cerebras.quiverquant
Sachin Katti, vice VD för beräkningsstrategi och GPT-Infra på OpenAI, sade att företagen "utforskar vad som blir möjligt när kunder kan få intelligensen hos våra mest kapabla modeller med betydligt lägre latens", och tillade att OpenAI planerar att börja med en liten grupp kunder innan tjänsten utökas.openai+1
I Humanity's Last Exam, ett benchmark-test med 2 500 frågor som spänner över ämnen på avancerad nivå, svarade GPT-5.6 Sol Ultrafast på hela frågeuppsättningen på 11 timmar och 11 minuter — jämfört med mer än tre dagar för Claude Fable 5, och uppnådde jämförbar noggrannhet nästan sju gånger snabbare. I GDP-Val, ett benchmark för ekonomiskt värdefulla kunskapsarbetsuppgifter, levererade Ultrafast en 5,6 gånger snabbare hastighet från start till slut utan kvalitetsförsämring.cerebras+1
Hastighetsfördelen kommer från Cerebras Wafer-Scale Engine-arkitektur, som håller modellvikter på chippet med 44 GB SRAM på varje wafer-stort chip, vilket eliminerar flaskhalsen för minnesbandbredd som begränsar GPU-baserad inferens.cerebras
Tillkännagivandet kommer samtidigt som Cerebras-aktien föll kraftigt på torsdagen, trots att företaget höjde sina prognoser för AI-efterfrågan efter en stark tillväxt under andra kvartalet. Flera analytiker höjde sina riktkurser för aktien, där UBS behöll en köprekommendation och Morgan Stanley behöll en Overweight-värdering.marketscreener