Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

marktechpost+1neowin+1moomoo+1El equipo de Qwen de Alibaba lanzó el viernes Qwen3.8-Omni-Flash, un modelo de IA omnimodal nativo que acepta entradas de texto, imagen, audio y video a través de una arquitectura única con una ventana de contexto de 1 millón de tokens. El lanzamiento impulsó las acciones de Alibaba en Hong Kong más de un 4% durante las primeras operaciones.moomoo
El modelo, construido sobre la arquitectura Qwen3.8-Flash-Next lanzada con pesos abiertos en agosto, marca un cambio desde la comprensión multimedia pasiva hacia lo que Alibaba denomina capacidades de agente: la habilidad de planificar tareas, invocar herramientas externas y ejecutar flujos de trabajo basados en entradas audiovisuales.marktechpost+2
Qwen3.8-Omni-Flash reduce los costos frente a sus competidores. El precio de la API para la entrada de audio por hora ha caído más de un 98% en comparación con su predecesor, Qwen3.5-Omni-Plus, mientras que los costos de entrada audiovisual han disminuido más de un 93%. QwenCloud lista el modelo a 0,15 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida, una fracción de lo que cobra Gemini de Alphabet Inc. en niveles comparables.neowin+3
En 29 pruebas internas, Alibaba reportó una mejora promedio en la puntuación superior al 25% respecto a Qwen3.5-Omni-Plus. En OmniVideoBench, la precisión aumentó de 63,4 a 67,8, mientras que el consumo de tokens se redujo un 45,7%, pasando de 145.736 a 79.117 tokens. Los resultados de pruebas independientes no estaban disponibles en el momento del lanzamiento.marktechpost+2
El modelo está disponible en QwenCloud, Alibaba Cloud Model Studio y la interfaz de chat de Qwen en seis regiones: Pekín, Singapur, Hong Kong, Tokio, Fráncfort y Virginia. Es compatible con el protocolo API de OpenAI, llamadas a funciones, búsqueda web y salidas estructuradas.alibabacloud+1
Cabe destacar que Qwen3.8-Omni-Flash solo genera texto; los desarrolladores que necesiten síntesis de voz deben recurrir al modelo anterior Qwen3.5-Omni. No se publicaron pesos abiertos, por lo que el alojamiento propio no es posible por ahora. Junto con el modelo, Alibaba publicó bajo licencia Apache 2.0 los Qwen-MM-Plugins, un kit de herramientas que permite a los marcos de agentes incorporar las capacidades multimodales del modelo como habilidades instalables.marktechpost+2
El lanzamiento se produce mientras las empresas chinas de IA continúan cerrando la brecha con sus rivales occidentales a pesar de las restricciones estadounidenses a la exportación de chips, con Neowin señalando que Huawei ha acelerado la entrega de su chip de IA Ascend 960DT.neowin