Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

quiverquant+1quiverquantquiverquant+1Cerebras Systems kunngjorde torsdag at de driver et nytt "Ultrafast"-tjenestenivå i OpenAI API for GPT-5.6 Sol, som leverer opptil 750 utdata-tokens per sekund — opptil 14 ganger raskere enn standard prosessering uten tap av modellintelligens.quiverquant+1
Lanseringen, som ble bekreftet samtidig av OpenAI og Cerebras, markerer en styrking av partnerskapet mellom de to selskapene og representerer en ny grense i avveiningen mellom modellkapasitet og inferenshastighet.
Ultrafast er i utgangspunktet tilgjengelig i begrenset forhåndsvisning for en utvalgt gruppe OpenAI-kunder, og kjører GPT-5.6 Sol med hastigheter som Cerebras hevder er 5 ganger raskere enn Claude Opus 4.8 i Fast-modus og 11 ganger raskere enn Claude Fable 5, basert på utdatahastigheter rapportert av Artificial Analysis.investing+1
"GPT-5.6 Sol på Ultrafast er bevis på at hastighet og intelligens ikke lenger er gjensidig utelukkende," sa Andrew Feldman, administrerende direktør og medgründer av Cerebras.quiverquant
Sachin Katti, visepresident for beregningsstrategi og GPT-Infra hos OpenAI, sa at selskapene "utforsker hva som blir mulig når kunder kan få intelligensen til våre mest kapable modeller med betydelig lavere forsinkelse," og la til at OpenAI planlegger å starte med en liten gruppe kunder før de utvider tjenesten.openai+1
I Humanity's Last Exam, en benchmark med 2 500 spørsmål som spenner over fag på høyere nivå, svarte GPT-5.6 Sol Ultrafast på hele spørsmålssettet på 11 timer og 11 minutter — sammenlignet med mer enn tre dager for Claude Fable 5, og oppnådde sammenlignbar nøyaktighet nesten syv ganger raskere. I GDP-Val, en benchmark for økonomisk verdifulle kunnskapsarbeidsoppgaver, leverte Ultrafast en 5,6 ganger raskere hastighet fra start til slutt uten kvalitetsforringelse.cerebras+1
Hastighetsfordelen kommer fra Cerebras' Wafer-Scale Engine-arkitektur, som holder modellvekter på brikken med 44 GB SRAM på hver wafer-størrelse brikke, noe som eliminerer flaskehalsen for minnebåndbredde som begrenser GPU-basert inferens.cerebras
Kunngjøringen kommer samtidig som Cerebras-aksjene falt kraftig torsdag, til tross for at selskapet hevet prognosene for AI-etterspørsel etter sterk vekst i andre kvartal. Flere analytikere hevet kursmålene sine på aksjen, der UBS opprettholdt en kjøpsanbefaling og Morgan Stanley opprettholdt en Overweight-vurdering.marketscreener