Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

bloombergfinance.biggo+1finance.biggoKinesiska DeepSeek rullade i fredags ut ett publikt beta-programmeringsgränssnitt (API) för sin V4 Flash-modell och lyfte fram förbättrade agentförmågor som uppges överträffa det mer kraftfulla systemet V4-Pro-Preview. Draget markerar en övergång från modellens tidigare testfas till bredare tillgång för allmänheten, vilket trappar upp priskriget mellan kinesiska och amerikanska AI-laboratorier.bloomberg
DeepSeek V4 Flash, en mixture-of-experts-modell med 284 miljarder parametrar och 13 miljarder aktiva parametrar, tar 0,14 dollar per miljon indata-tokens och 0,28 dollar per miljon utdata-tokens. Den prissättningen gör den dramatiskt billigare än OpenAI:s NVIDIA Corporation GPU-drivna erbjudanden, även efter att OpenAI sänkte kostnaderna för sin GPT-5.6 Luna-modell med 80 procent den 30 juli, vilket sänkte Lunas indatapris till 0,20 dollar per miljon tokens.finance.biggo+3
Lanseringen av den publika betan kom med ett specifikt påstående om agentprestanda. "Asevärt förbättrade agentförmågor, med testresultat som långt överträffar V4-Pro-Preview," uppgav DeepSeek i ett inlägg på sin webbplats, enligt Bloomberg. Modellen gick först in i förhandsvisning den 24 april med MIT-licensierade öppna vikter och ett kontextfönster på en miljon tokens.api-docs.deepseek+2
Tidpunkten är anmärkningsvärd. Bara en dag före DeepSeeks meddelande omstrukturerade OpenAI sin egen prissättning för att konkurrera i lägre prissegment, genom att sänka Luna till 0,20 dollar för indata och 1,20 dollar för utdata medan flaggskeppsmodellen Sol lämnades oförändrad på 5,00 och 30,00 dollar. Men även efter dessa sänkningar underbyter DeepSeek V4 Flash Luna på både indata- och utdatapriser.xenospectrum
Data som citeras av CNBC visar att kinesiska modeller kan vara upp till nio gånger billigare per token än sina amerikanska motsvarigheter. Andelen tokens som förbrukas av amerikanska företag på kinesiska modeller har legat kvar över 30 procent varje vecka sedan februari. Ion Stoica, professor i datavetenskap vid UC Berkeley och medgrundare av Databricks, noterade att klyftan mellan kinesiska öppen källkod-modeller och spetsmodeller har minskat från sex till nio månader till bara två eller tre.finance.biggo
Den publika betan positionerar DeepSeek för att ta hand om företagskunders arbetsbelastningar som prioriterar kostnad framför varumärkeslojalitet, särskilt för storskaliga uppgifter inom klassificering, extrahering och kodning där V4 Flashs hastighetsfördel väger tyngst. Eftersom både OpenAI och Anthropic i hemlighet ansökte om börsnotering i juni, kommer trycket att skydda marginalerna och samtidigt matcha de kinesiska priserna bara att öka när båda bolagen närmar sig sina IPO-fönster.finance.biggo