Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

x+1axios+1mlq+1OpenAI:s VD Sam Altman varnade användare på måndagen att företagets nyligen släppta GPT-5.6 Sol-modell kan möta tjänstestörningar då efterfrågan överväldigar dess inferenskapacitet, bara dagar efter att flaggskeppsmodellen blev allmänt tillgänglig för allmänheten.
"5.6 sol-tillväxten är galen," skrev Altman på X den 14 juli. "Inferensteamet har gjort ett heroiskt arbete för att kunna stödja efterfrågan. Vi kommer att flytta berg för att fortsätta skala, men det är möjligt att det uppstår lite hicka snart."mlq+1
GPT-5.6 Sol lanserades offentligt den 9 juli efter en ungefär två veckor lång statligt kontrollerad säkerhetsgranskning som begränsade den initiala åtkomsten till cirka 20 granskade partnerorganisationer. Modellen är den mest kapabla i GPT-5.6-familjen, som även inkluderar mellanklassmodellen Terra och den lätta Luna.axios+2
Altman berättade för CNBC att Sol är 54 % mer token-effektiv vid agentiska kodningsuppgifter, ett mått han ramade in utifrån företags kostnadsmedvetenhet. "Varje företag tänker nu på utgifter och det värde de får i utbyte mot AI," sa han. Modellen introducerar ett "max"-resonemangsläge för djup problemlösning och ett "ultra"-läge som delegerar deluppgifter till koordinerade underagenter.openai+2
OpenAI har redan vidtagit åtgärder för att hantera anstormningen. Företaget tog bort en femtimmars hastighetsbegränsning och återställde användningstak för Plus-, Pro-, Business- och Enterprise-prenumeranter. De kör även Sol på Cerebras-hårdvara med hastigheter på upp till 750 tokens per sekund för företagskunder som kräver realtidsinferens.mlq+1
Codex och ChatGPT Work, den nya produktivitetsagenten som lanserades tillsammans med GPT-5.6, har nått 8 miljoner aktiva användare, upp från 5 miljoner tidigare, enligt MLQ AI. Modellen är prissatt till 5 dollar per miljon input-tokens och 30 dollar per miljon output-tokens via API:et.openai+2
Den breda lanseringen följde vad Altman beskrev som en "samarbetsvillig dialog" med Trump-administrationen, som hade bett OpenAI att skjuta upp utrullningen på grund av nationella säkerhetsaspekter relaterade till modellens cybersäkerhetskapacitet. TechCrunch rapporterade i juni att OpenAI kallade restriktionen för ett "kortsiktigt steg" och sa att en sådan process "inte borde vara normen".reuters+2
Kapacitetsvarningen understryker en återkommande spänning vid utrullning av avancerad AI: att bygga modeller som är tillräckligt kraftfulla för att driva användning samtidigt som man upprätthåller infrastrukturen för att betjäna den. För utvecklare och företag som förlitar sig på OpenAI API signalerar Altmans inlägg möjligheten till försämrad prestanda eller tillfälliga tjänsteavbrott på kort sikt.