IA multimodal

Alibaba lanza un modelo de IA multimodal con precios drásticamente más bajos

El equipo de Qwen de Alibaba lanzó el viernes Qwen3.8-Omni-Flash, un modelo de IA omnimodal nativo que acepta entradas de texto, imagen, audio y video a través de una arquitectura única con una ventana de contexto de 1 millón de…

DeepSeek libera su primer modelo de visión para agentes de IA

DeepSeek ha publicado en código abierto los pesos de su primer modelo multimodal, V4-Flash-Vision-Exp, poniendo a disposición 305.000 millones de parámetros en Hugging Face bajo la licencia MIT. El lanzamiento, publicado el 31 de agosto, marca la conclusión de un…

Google destaca su modelo Gemini Omni tras superar los 1.000 millones de usuarios

Google Alphabet Inc. vive una semana de impulso para sus iniciativas de IA, publicando una mesa redonda de expertos sobre su modelo Gemini Omni, celebrando el hito de mil millones de usuarios en su asistente Gemini y expandiendo el ecosistema…