Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreuters+1reuters+1Nvidia está construyendo una nueva familia de modelos de IA de código abierto llamada Nemotron 4, cuya versión más grande se espera que contenga al menos un billón de parámetros, según un informe publicado el martes por The Information que cita a varios empleados que trabajan en el proyecto.
El fabricante de chips no ha fijado una fecha de lanzamiento oficial y aún no ha completado el entrenamiento final, aunque los empleados creen que el modelo podría estar listo a finales de otoño, informó Reuters. Este esfuerzo posiciona a Nvidia como una de las pocas grandes empresas estadounidenses que lanzan modelos de frontera de código abierto en un momento en que los crecientes costos de la IA y la presión competitiva de las alternativas chinas de bajo costo están transformando el panorama de la industria.reuters
"Nvidia está invirtiendo en Nemotron porque creemos que cada empresa y cada país necesita modelos de frontera abiertos y accesibles para fortalecer la seguridad, acelerar la innovación y proporcionar una base en la que puedan confiar de una generación a la siguiente", afirmó Kari Briski, vicepresidenta de IA generativa, en un comunicado enviado por correo electrónico.firstpost+1
La medida se produce a medida que los modelos chinos más baratos han reducido la brecha de rendimiento con los sistemas líderes de Anthropic y OpenAI, y una serie de hackeos revelados recientemente que involucran agentes de IA autónomos ha aumentado el interés en modelos abiertos que carecen de restricciones para el uso en ciberseguridad. El mes pasado, Nvidia se unió a una coalición centrada en la seguridad de la IA y firmó una carta abierta junto con Microsoft y otras empresas defendiendo los modelos de pesos abiertos para evitar que la innovación se traslade al extranjero.reuters+2
La Coalición Nemotron, anunciada en GTC en marzo, incluye a Mistral AI, Black Forest Labs y LangChain como miembros fundadores que colaboran en modelos abiertos de frontera construidos sobre la infraestructura DGX Cloud de Nvidia.cryptobriefing
Junto con el desarrollo de Nemotron 4, Nvidia lanzó el martes dos nuevos productos. Nemotron 3.5 Lightning es un modelo de mezcla de expertos de 30 mil millones de parámetros con 3 mil millones de parámetros activos, diseñado para tareas de agentes siempre activas, incluyendo revisión de código, uso de herramientas, monitoreo de alertas de seguridad y consultas de facturación. La compañía afirma que ofrece una generación de tokens hasta 4 veces más rápida que modelos de tamaño similar, lo que se traduce en una finalización de tareas de agentes aproximadamente un 30% más rápida.seekingalpha+2
Nvidia también lanzó NeMo Switchyard, una biblioteca de enrutamiento de modelos de código abierto que dirige automáticamente las tareas de IA al modelo disponible más adecuado, permitiendo a las empresas ejecutar configuraciones de múltiples modelos sin reconstruir las aplicaciones.firstpost+1