multimodal AI

Alibaba lanserar multimodal AI-modell med drastiskt lägre priser

Alibabas Qwen-team släppte på fredagen Qwen3.8-Omni-Flash, en nativ omnimodal AI-modell som accepterar text, bild, ljud och video genom en enda arkitektur med ett kontextfönster på 1 miljon tokens. Lanseringen fick Alibabas aktier noterade i Hongkong att stiga mer än 4…

DeepSeek släpper sin första synmodell för AI-agenter som öppen källkod

DeepSeek har släppt vikterna för sin första multimodala modell, V4-Flash-Vision-Exp, som öppen källkod och gör 305 miljarder parametrar tillgängliga på Hugging Face under MIT-licensen. Lanseringen, som skedde den 31 augusti, fullbordar en utrullning som inleddes den 21 augusti när modellen…

Google lyfter Gemini Omni efter att ha nått 1 miljard användare

Google Alphabet Inc. rider på en våg av framgång för sina AI-satsningar denna vecka. Företaget har publicerat ett expertrundabordssamtal om sin Gemini Omni-modell, firat en milstolpe på en miljard användare för sin Gemini-assistent och utökat plattformens ekosystem med nya anslutna…