Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

marktechpost+1neowin+1moomoo+1L'équipe Qwen d'Alibaba a lancé vendredi Qwen3.8-Omni-Flash, un modèle d'IA omnimodal natif capable de traiter du texte, des images, de l'audio et de la vidéo via une architecture unique dotée d'une fenêtre de contexte d'un million de jetons. Cette annonce a fait grimper les actions d'Alibaba à la Bourse de Hong Kong de plus de 4% lors des premiers échanges.moomoo
Le modèle, basé sur l'architecture Qwen3.8-Flash-Next publiée en open source en août, marque une transition de la compréhension multimédia passive vers ce qu'Alibaba appelle des capacités d'agent : la faculté de planifier des tâches, d'appeler des outils externes et d'exécuter des flux de travail basés sur des entrées audiovisuelles.marktechpost+2
Qwen3.8-Omni-Flash se distingue par ses coûts compétitifs. La tarification API pour l'entrée audio horaire a chuté de plus de 98% par rapport à son prédécesseur, Qwen3.5-Omni-Plus, tandis que les coûts d'entrée audiovisuelle ont diminué de plus de 93%. QwenCloud propose le modèle à 0,15 dollar par million de jetons en entrée et 0,47 dollar par million de jetons en sortie, une fraction des tarifs pratiqués par Gemini d'Alphabet Inc. pour des niveaux comparables.neowin+3
Sur 29 benchmarks internes, Alibaba a rapporté une amélioration moyenne des scores supérieure à 25% par rapport à Qwen3.5-Omni-Plus. Sur OmniVideoBench, la précision est passée de 63,4 à 67,8, tandis que la consommation de jetons a chuté de 45,7%, passant de 145 736 à 79 117 jetons. Aucun résultat de benchmark indépendant n'était disponible au moment du lancement.marktechpost+2
Le modèle est accessible sur QwenCloud, Alibaba Cloud Model Studio et l'interface de chat Qwen dans six régions : Pékin, Singapour, Hong Kong, Tokyo, Francfort et la Virginie. Il prend en charge le protocole API compatible avec OpenAI, l'appel de fonctions, la recherche web et les sorties structurées.alibabacloud+1
Il est à noter que Qwen3.8-Omni-Flash ne génère que du texte ; les développeurs ayant besoin de synthèse vocale sont orientés vers l'ancien modèle Qwen3.5-Omni. Aucun poids ouvert n'a été publié, rendant l'auto-hébergement impossible pour le moment. Parallèlement, Alibaba a publié en open source Qwen-MM-Plugins sous licence Apache 2.0, un kit d'outils permettant aux frameworks d'agents d'intégrer les capacités multimodales du modèle sous forme de compétences installables.marktechpost+2
Ce lancement intervient alors que les entreprises chinoises d'IA continuent de réduire l'écart avec leurs rivaux occidentaux malgré les restrictions américaines sur l'exportation de puces, Neowin notant que Huawei a accéléré la livraison de sa puce IA Ascend 960DT.neowin