Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

quiverquant+1quiverquantquiverquant+1Společnost Cerebras Systems ve čtvrtek oznámila, že pohání novou „ultrarychlou“ úroveň služeb v rámci OpenAI API pro model GPT-5.6 Sol. Ta poskytuje až 750 výstupních tokenů za sekundu, což je až 14krát rychleji než standardní zpracování, aniž by došlo ke ztrátě inteligence modelu.quiverquant+1
Spuštění, které současně potvrdily OpenAI i Cerebras, znamená prohloubení partnerství mezi oběma společnostmi a představuje novou hranici v kompromisu mezi schopnostmi modelu a rychlostí inference.
Režim Ultrafast, který je zpočátku dostupný v omezeném náhledu pro vybranou skupinu zákazníků OpenAI, provozuje GPT-5.6 Sol rychlostí, o které Cerebras tvrdí, že je 5krát vyšší než u Claude Opus 4.8 v režimu Fast a 11krát vyšší než u Claude Fable 5, na základě rychlostí výstupu hlášených společností Artificial Analysis.investing+1
„GPT-5.6 Sol v režimu Ultrafast je důkazem, že rychlost a inteligence se již vzájemně nevylučují,“ uvedl Andrew Feldman, generální ředitel a spoluzakladatel Cerebras.quiverquant
Sachin Katti, viceprezident pro výpočetní strategii a GPT-Infra v OpenAI, uvedl, že společnosti „zkoumají, co je možné, když zákazníci mohou získat inteligenci našich nejschopnějších modelů s výrazně nižší latencí,“ a dodal, že OpenAI plánuje začít s malou skupinou zákazníků a poté službu rozšiřovat.openai+1
V testu Humanity's Last Exam, což je benchmark s 2 500 otázkami pokrývajícími předměty na úrovni absolventů vysokých škol, odpověděl GPT-5.6 Sol Ultrafast na celou sadu otázek za 11 hodin a 11 minut – ve srovnání s více než třemi dny u Claude Fable 5, přičemž dosáhl srovnatelné přesnosti téměř sedmkrát rychleji. V benchmarku GDP-Val, který hodnotí ekonomicky hodnotné úkoly znalostní práce, poskytl Ultrafast 5,6krát vyšší rychlost end-to-end bez snížení kvality.cerebras+1
Výhoda v rychlosti pramení z architektury Wafer-Scale Engine společnosti Cerebras, která udržuje váhy modelu přímo na čipu díky 44 GB SRAM na každém čipu o velikosti waferu, čímž eliminuje úzké hrdlo propustnosti paměti, které omezuje inferenci založenou na GPU.cerebras
Oznámení přichází v době, kdy akcie Cerebras ve čtvrtek prudce klesly, přestože společnost po silném růstu ve druhém čtvrtletí zvýšila své prognózy poptávky po AI. Několik analytiků zvýšilo své cílové ceny akcií, přičemž UBS si udržela nákupní hodnocení a Morgan Stanley hodnocení Overweight.marketscreener