Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1stable-learncryptobriefingMysteriet som sysselsatt AI-utvecklare i nästan en vecka är löst. Z.ai, det kinesiska AI-företaget tidigare känt som Zhipu AI, bekräftade på onsdagen att den anonyma "Ox Alpha"-modellen som dök upp på OpenRouter och OpenCode är GLM-5.3-Flash, den första naturligt multimodala modellen i deras GLM-5-serie.africa.businessinsider+1
Modellen, som funnits tillgänglig gratis och utan källhänvisning sedan den 20 augusti, väckte stor uppmärksamhet från både utvecklare och teknikledare. Stripes vd Patrick Collison kallade den "mycket imponerande" på X. Före avslöjandet hade Ox Alpha samlat över 503 000 unika användare och bearbetat 44 biljoner tokens enbart på OpenCode.techcrunch+1
GLM-5.3-Flash använder en "mixture-of-experts"-arkitektur med totalt 320 miljarder parametrar, men aktiverar endast 18 miljarder per token, vilket drastiskt sänker beräkningskostnaderna jämfört med täta modeller med liknande kapacitet. Modellen stöder ett kontextfönster på en miljon tokens och accepterar text, bild och video som indata.cryptobriefing+1
I kodningstestet DeepSWE v1.1 fick GLM-5.3-Flash 63,4 poäng, upp från 46,2 för föregångaren GLM-5.2. Z.ai hävdar att den närmar sig Claude Opus 4.8 i deras interna kodningstest, med 29,0 poäng mot Opus 4.8s 29,5. API-priset ligger på 0,15 dollar per miljon indata-tokens och 0,50 dollar per miljon utdata-tokens – ungefär en tiondel av kostnaden för jämförbara proprietära alternativ.officechai+1
Vikterna finns tillgängliga under MIT-licens på Hugging Face och ModelScope, vilket tillåter obegränsad kommersiell användning.testingcatalog+1
Kanske den mest betydelsefulla aspekten av lanseringen är infrastrukturen bakom. Z.ai säger att GLM-5.3-Flash körs helt på inhemskt tillverkade AI-acceleratorer, med en anpassad SGLang-baserad serverstack som gav en trefaldig förbättring i prestanda. Företaget framställde detta som bevis på att kinesiska chip kan stödja inferens för avancerade modeller till konkurrenskraftiga kostnader, ett påstående som väger tungt mitt i pågående amerikanska exportrestriktioner mot Nvidias mest avancerade processorer.testingcatalog+1
Z.ai hade tidigare tränat sin GLM-5-basmodell på Huawei Ascend-chip, men GLM-5.3-Flash utökar den oberoendet till att även gälla inferenslagret i stor skala.siliconrepublic
Den anonyma lanseringen följde ett mönster Z.ai använt tidigare – de testade tidigare en modell under namnet "Pony Alpha" på OpenRouter. Den här gången skapade strategin betydligt mer uppmärksamhet, då utvecklare dissekerade tokenizer-fingeravtryck och API-felkoder för att identifiera tillverkaren före det officiella tillkännagivandet.kingy+2
Som TechCrunch noterade bidrar utgivningen till "det växande hotet från billiga, kapabla modeller från Kina som kan ta betydande marknadsandelar från dyra företag som OpenAI och Anthropic."techcrunch