Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunnhi-tech+1news.futunnSpolečnost DeepSeek vydala 10. září multimodální model V4.1 Flash využívající architekturu Mixture-of-Experts. Model disponuje celkem 552 miliardami parametrů, avšak během inference aktivuje pouze jejich malou část, což představuje posun v tom, jak velké jazykové modely vyvažují výkon s efektivitou. Podle údajů analytické platformy Gelonghui se model během tří dnů od svého spuštění dostal na šesté místo na světě v celkové spotřebě tokenů na platformě OpenRouter.news.futunn
Novinka nahrazuje předchozí verze V4 Flash a V4 Flash Vision, jejichž API požadavky jsou nyní automaticky přesměrovávány na V4.1 Flash. Od 14. září jsou na V4.1 Flash dočasně přesměrovávány i všechny požadavky na koncový bod V4 Pro a účtovány za jeho nižší sazbu, dokud nebude spuštěna verze V4.1 Pro.hi-tech+1
V4.1 Flash staví na architektuře Causal Encoder-Decoder s celkovým počtem 552 miliard parametrů. Architektura Mixture-of-Experts však při zpracování vstupu aktivuje pouhých 8 miliard parametrů a při generování výstupu 16 miliard. To představuje pokles oproti předchozímu modelu V4 Flash s 284 miliardami parametrů, který na jeden token aktivoval 13 miliard parametrů.hackernoon+2
Model podporuje kontextové okno o velikosti až jednoho milionu tokenů a využívá přeprojektovanou KV-cache, která ukládá přibližně 890 bajtů na token. To je zhruba čtvrtina paměťové náročnosti oproti V4 Flash. Pro organizace provozující velkoobjemové úlohy může být toto snížení paměťových nároků důležitější než samotné nárůsty v testech výkonu. Váhy modelu jsou veřejně dostupné na platformě Hugging Face pod licencí MIT.mindstudio+2
Globální spotřeba tokenů u AI modelů dosáhla v týdnu od 7. do 13. září 127 bilionů tokenů, což je o více než 10 procent více než v předchozím týdnu, vyplývá z dat OpenRouter zveřejněných platformou Gelonghui. Čínské AI modely se na tomto objemu podílely 61,17 bilionu tokenů a udržely si tak náskok před americkými modely již dvacátý týden v řadě.news.futunn
Model V4.1 Flash debutoval na šestém místě se 4,94 bilionu spotřebovaných tokenů během prvních tří dnů, zatímco model MiMo-V2.5 společnosti Xiaomi zaznamenal mezitýdenní nárůst o 230 procent a obsadil pátou příčku. Společnost Alibaba Cloud mezitím 13. září spustila vlastní hostovanou platformu DeepSeek-V4.1-Flash, nabízející přístup přes API a Token Plan integrovaný s nástroji jako Qoder a Codex.gurufocus+1
Při maximálním úsilí při uvažování dosáhl V4.1 Flash podle vlastního hodnocení společnosti DeepSeek skóre 74,2 v testu DeepSWE v1.1, 90,6 v Terminal-Bench 2.1 a 88,1 v CyberGym. Model rovněž prokázal silné multimodální výsledky, včetně 95,6 v testu DocVQA a 56,5 v MMMU-Pro.flowtivity+1
V několika znalostních a logických testech však V4.1 Flash zaostává za vlastním modelem V4 Pro společnosti DeepSeek a jeho skóre 45,2 v testu dlouhého kontextu LongBench-V2 nedosahuje hodnoty 51,5, kterou získal V4 Pro. Společnost DeepSeek dosud nezveřejnila požadavky na VRAM, srovnávací testy rychlosti inference ani doporučení pro velikost dávky, takže plánování lokálního nasazení do značné míry závisí na vlastním testování vývojářů.hackernoon