IA multimodale

Alibaba lance un modèle d’IA multimodal à prix cassés

L'équipe Qwen d'Alibaba a lancé vendredi Qwen3.8-Omni-Flash, un modèle d'IA omnimodal natif capable de traiter du texte, des images, de l'audio et de la vidéo via une architecture unique dotée d'une fenêtre de contexte d'un million de jetons. Cette annonce…

DeepSeek lance en open source son premier modèle de vision pour agents IA

DeepSeek a publié en open source les poids de son premier modèle multimodal, V4-Flash-Vision-Exp, rendant 305 milliards de paramètres disponibles sur Hugging Face sous licence MIT. Ce lancement, effectif le 31 août, vient parachever un déploiement débuté le 21 août…

Google met en avant son modèle Gemini Omni après avoir franchi le cap du milliard d’utilisateurs

Google Alphabet Inc. surfe sur une vague de succès pour ses efforts en matière d'IA cette semaine, en publiant une table ronde d'experts sur son modèle Gemini Omni, en célébrant le cap du milliard d'utilisateurs pour son assistant Gemini et…