multimodální AI

Alibaba uvádí multimodální AI model s výrazně nižší cenou

Tým Qwen společnosti Alibaba v pátek vydal Qwen3.8-Omni-Flash, nativní omnimodální AI model, který přijímá text, obrázky, zvuk a video prostřednictvím jediné architektury s kontextovým oknem o velikosti 1 milionu tokenů. Uvedení na trh poslalo akcie Alibaby kótované v Hongkongu v…

DeepSeek uvolňuje svůj první vizuální model pro AI agenty jako open-source

Společnost DeepSeek uvolnila váhy svého prvního multimodálního modelu V4-Flash-Vision-Exp jako open-source a zpřístupnila tak 305 miliard parametrů na platformě Hugging Face pod licencí MIT. Vydání, k němuž došlo 31. srpna, završuje postupný debut zahájený 21. srpna, kdy byl model spuštěn…

Google po dosažení miliardy uživatelů vyzdvihuje model Gemini Omni

Společnost Google Alphabet Inc. tento týden těží z vlny zájmu o své aktivity v oblasti umělé inteligence, když zveřejnila odborný kulatý stůl o svém modelu Gemini Omni, oslavila milník miliardy uživatelů svého asistenta Gemini a rozšířila ekosystém platformy o nové…