Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1stable-learncryptobriefingMysteriet som har opptatt AI-utviklere i nesten en uke, er løst. Z.ai, det kinesiske AI-selskapet tidligere kjent som Zhipu AI, bekreftet onsdag at den anonyme "Ox Alpha"-modellen som dukket opp på OpenRouter og OpenCode, er GLM-5.3-Flash, den første naturlig multimodale modellen i deres GLM-5-serie.africa.businessinsider+1
Modellen, som har vært tilgjengelig gratis og uten kildeangivelse siden 20. august, vakte stor oppsikt blant både utviklere og teknologiledere. Stripe-sjef Patrick Collison kalte den "svært imponerende" på X. Før avsløringen hadde Ox Alpha samlet over 503 000 unike brukere og prosessert 44 billioner tokens bare på OpenCode.techcrunch+1
GLM-5.3-Flash bruker en "mixture-of-experts"-arkitektur med totalt 320 milliarder parametere, men aktiverer kun 18 milliarder per token, noe som reduserer beregningskostnadene drastisk sammenlignet med tette modeller med tilsvarende kapasitet. Modellen støtter et kontekstvindu på én million tokens og aksepterer tekst, bilde og video som inndata.cryptobriefing+1
I kodingstesten DeepSWE v1.1 oppnådde GLM-5.3-Flash en skåre på 63,4, opp fra 46,2 for forgjengeren GLM-5.2. Z.ai hevder at den nærmer seg Claude Opus 4.8 i deres interne kodingstest, med 29,0 poeng mot Opus 4.8s 29,5. API-prisen ligger på 0,15 dollar per million inndata-tokens og 0,50 dollar per million utdata-tokens – omtrent en tiendedel av prisen for tilsvarende proprietære alternativer.officechai+1
Vektene er tilgjengelige under MIT-lisens på Hugging Face og ModelScope, noe som tillater ubegrenset kommersiell bruk.testingcatalog+1
Kanskje det mest konsekvensrike aspektet ved lanseringen er infrastrukturen bak. Z.ai sier at GLM-5.3-Flash kjører utelukkende på egenproduserte AI-akseleratorer, med en tilpasset SGLang-basert serverstakk som ga en tredobling i ytelse. Selskapet fremstilte dette som bevis på at kinesiske brikker kan støtte inferens for avanserte modeller til konkurransedyktige priser, et poeng som veier tungt midt i pågående amerikanske eksportrestriksjoner på Nvidias mest avanserte prosessorer.testingcatalog+1
Z.ai hadde tidligere trent sin GLM-5-basemodell på Huawei Ascend-brikker, men GLM-5.3-Flash utvider denne uavhengigheten til også å gjelde inferenslaget i stor skala.siliconrepublic
Den anonyme lanseringen fulgte et mønster Z.ai har brukt før – de testet tidligere en modell under navnet "Pony Alpha" på OpenRouter. Denne gangen skapte strategien langt mer oppmerksomhet, da utviklere dissekerte tokenizer-fingeravtrykk og API-feilkoder for å identifisere produsenten før den offisielle kunngjøringen.kingy+2
Som TechCrunch bemerket, bidrar utgivelsen til "den voksende trusselen fra billige, kapable modeller fra Kina som kan ta betydelige markedsandeler fra dyre selskaper som OpenAI og Anthropic."techcrunch