NVIDIA presenta la familia Nemotron 3 de modelos abiertos
15 de diciembre de 2025
Resumen de noticias:
- La familia Nemotron 3 de modelos abiertos —en tamaños Nano, Super y Ultra— introduce la familia más eficiente de modelos abiertos con precisión líder para construir aplicaciones de IA agente.
- Nemotron 3 Nano ofrece un rendimiento 4 veces mayor que Nemotron 2 Nano y proporciona la mayor cantidad de tokens por segundo para sistemas multiagente a escala, gracias a una innovadora arquitectura híbrida de mezcla de expertos.
- Nemotron logra una precisión superior mediante técnicas avanzadas de aprendizaje por refuerzo con entrenamiento posterior concurrente en múltiples entornos a escala.
- NVIDIA es la primera en lanzar una colección de modelos abiertos de vanguardia, conjuntos de datos de entrenamiento y entornos y bibliotecas de aprendizaje por refuerzo para construir agentes de IA altamente precisos, eficientes y especializados.
Hoy, NVIDIA anunció la familia de modelos, datos y bibliotecas abiertos NVIDIA Nemotron™ 3, diseñada para impulsar el desarrollo transparente, eficiente y especializado de IA agente en diversas industrias.
Los modelos Nemotron 3 —con tamaños Nano, Super y Ultra— introducen una innovadora arquitectura híbrida de mezcla de expertos latentes (MoE) que ayuda a los desarrolladores a construir y desplegar sistemas multiagente confiables a escala.
A medida que las organizaciones pasan de chatbots de un solo modelo a sistemas colaborativos de IA multiagente, los desarrolladores enfrentan desafíos crecientes, como sobrecarga de comunicación, deriva de contexto y altos costos de inferencia. Además, los desarrolladores requieren transparencia para confiar en los modelos que automatizarán sus flujos de trabajo complejos. Nemotron 3 aborda directamente estos desafíos, ofreciendo el rendimiento y la apertura que los clientes necesitan para construir IA agente especializada.
“La innovación abierta es la base del progreso en IA”, dijo Jensen Huang, fundador y CEO de NVIDIA. “Con Nemotron, estamos transformando la IA avanzada en una plataforma abierta que brinda a los desarrolladores la transparencia y eficiencia necesarias para construir sistemas agente a escala”.
NVIDIA Nemotron respalda los esfuerzos más amplios de NVIDIA en IA soberana, con organizaciones desde Europa hasta Corea del Sur adoptando modelos abiertos, transparentes y eficientes que les permiten construir sistemas de IA alineados con sus propios datos, regulaciones y valores.
Adoptantes tempranos, incluidos Accenture, Cadence, CrowdStrike, Cursor, Deloitte, EY, Oracle Cloud Infrastructure, Palantir, Perplexity, ServiceNow, Siemens, Synopsys y Zoom, están integrando modelos de la familia Nemotron para impulsar flujos de trabajo de IA en manufactura, ciberseguridad, desarrollo de software, medios, comunicaciones y otras industrias.
“NVIDIA y ServiceNow han estado moldeando el futuro de la IA durante años, y lo mejor está por venir”, dijo Bill McDermott, presidente y CEO de ServiceNow. “Hoy damos un paso importante para empoderar a líderes en todas las industrias a acelerar su estrategia de IA agente. La automatización inteligente de flujos de trabajo de ServiceNow combinada con NVIDIA Nemotron 3 continuará definiendo el estándar con eficiencia, velocidad y precisión sin igual”.
A medida que los sistemas de IA multiagente se expanden, los desarrolladores dependen cada vez más de modelos propietarios para razonamiento de vanguardia, mientras usan modelos abiertos más eficientes y personalizables para reducir costos. Enrutar tareas entre modelos de vanguardia y Nemotron en un solo flujo de trabajo brinda a los agentes la mayor inteligencia mientras optimiza la tokenómica.
“Perplexity se basa en la idea de que la curiosidad humana se amplificará mediante IA precisa integrada en herramientas excepcionales, como asistentes de IA”, dijo Aravind Srinivas, CEO de Perplexity. “Con nuestro enrutador de agentes, podemos dirigir cargas de trabajo a los mejores modelos abiertos ajustados, como Nemotron 3 Ultra, o aprovechar modelos propietarios líderes cuando las tareas se benefician de sus capacidades únicas, asegurando que nuestros asistentes de IA operen con velocidad, eficiencia y escala excepcionales”.
Los modelos abiertos Nemotron 3 permiten a las startups construir e iterar más rápido en agentes de IA y acelerar la innovación desde el prototipo hasta el despliegue empresarial. Empresas de las carteras de General Catalyst, Mayfield y Sierra Ventures están explorando Nemotron 3 para construir compañeros de IA que apoyen la colaboración humano-IA.
“La pila de modelos abiertos de NVIDIA y el programa NVIDIA Inception brindan a las empresas en etapas tempranas los modelos, herramientas e infraestructura rentable para experimentar, diferenciarse y escalar rápidamente”, dijo Navin Chaddha, socio gerente de Mayfield. “Nemotron 3 da a los fundadores un punto de partida para construir aplicaciones de IA agente y compañeros de IA, y les ayuda a aprovechar la enorme base instalada de NVIDIA”.
Nemotron 3 reinventa la IA multiagente con eficiencia y precisión
La familia Nemotron 3 de modelos MoE incluye tres tamaños:
- Nemotron 3 Nano, un modelo pequeño de 30 mil millones de parámetros que activa hasta 3 mil millones de parámetros a la vez para tareas específicas y altamente eficientes.
- Nemotron 3 Super, un modelo de razonamiento de alta precisión con aproximadamente 100 mil millones de parámetros y hasta 10 mil millones activos por token, para aplicaciones multiagente.
- Nemotron 3 Ultra, un motor de razonamiento grande con aproximadamente 500 mil millones de parámetros y hasta 50 mil millones activos por token, para aplicaciones de IA complejas.
Disponible hoy, Nemotron 3 Nano es el modelo más eficiente en costos computacionales, optimizado para tareas como depuración de software, resumen de contenido, flujos de trabajo de asistentes de IA y recuperación de información a bajos costos de inferencia. El modelo utiliza una arquitectura híbrida MoE única para lograr ganancias en eficiencia y escalabilidad.
Este diseño logra hasta un 4x mayor rendimiento de tokens en comparación con Nemotron 2 Nano y reduce la generación de tokens de razonamiento hasta en un 60%, reduciendo significativamente los costos de inferencia. Con una ventana de contexto de 1 millón de tokens, Nemotron 3 Nano recuerda más, lo que lo hace más preciso y mejor capaz de conectar información en tareas largas y multietapas.
Artificial Analysis, una organización independiente que evalúa IA, clasificó el modelo como el más abierto y eficiente entre modelos del mismo tamaño, con precisión líder.
Nemotron 3 Super destaca en aplicaciones que requieren muchos agentes colaborativos para lograr tareas complejas con baja latencia. Nemotron 3 Ultra sirve como un motor de razonamiento avanzado para flujos de trabajo de IA que exigen investigación profunda y planificación estratégica.
Nemotron 3 Super y Ultra utilizan el formato de entrenamiento ultraeficiente de 4 bits NVFP4 de NVIDIA en la arquitectura NVIDIA Blackwell, reduciendo significativamente los requisitos de memoria y acelerando el entrenamiento. Esta eficiencia permite entrenar modelos más grandes en infraestructura existente sin comprometer la precisión en comparación con formatos de mayor precisión.
Con la familia de modelos Nemotron 3, los desarrolladores pueden elegir el modelo abierto adecuado para sus cargas de trabajo específicas, escalando desde decenas hasta cientos de agentes mientras se benefician de un razonamiento de horizonte largo más rápido y preciso para flujos de trabajo complejos.
Nuevas herramientas y datos abiertos para personalización de agentes de IA
NVIDIA también lanzó una colección de conjuntos de datos de entrenamiento y bibliotecas de aprendizaje por refuerzo de vanguardia disponibles para cualquier persona que construya agentes de IA especializados.
Tres billones de tokens de nuevos conjuntos de datos de preentrenamiento, postentrenamiento y aprendizaje por refuerzo de Nemotron proporcionan ejemplos ricos de razonamiento, codificación y flujos de trabajo multietapa necesarios para crear agentes altamente capaces y especializados por dominio. El Conjunto de datos de seguridad agente Nemotron proporciona telemetría del mundo real para ayudar a los equipos a evaluar y fortalecer la seguridad de sistemas de agentes complejos.
Para acelerar el desarrollo, NVIDIA lanzó las bibliotecas de código abierto NeMo Gym y NeMo RL, que proporcionan entornos de entrenamiento y base de postentrenamiento para modelos Nemotron, junto con NeMo Evaluator para validar la seguridad y rendimiento del modelo. Todas las herramientas y conjuntos de datos están ahora disponibles en GitHub y Hugging Face.
Nemotron 3 es compatible con LM Studio, llama.cpp, SGLang y vLLM. Además, Prime Intellect y Unsloth están integrando los entornos de entrenamiento listos para usar de NeMo Gym directamente en sus flujos de trabajo, brindando a los equipos acceso más rápido y fácil a entrenamiento de aprendizaje por refuerzo potente.
Comience con modelos abiertos de NVIDIA
Nemotron 3 Nano está disponible hoy en Hugging Face y a través de proveedores de servicios de inferencia, incluidos Baseten, DeepInfra, Fireworks, FriendliAI, OpenRouter y Together AI.
Nemotron se ofrece en plataformas empresariales de IA y datos, incluidas Couchbase, DataRobot, H2O.ai, JFrog, Lambda y UiPath. Para clientes en nubes públicas, Nemotron 3 Nano estará disponible en AWS a través de Amazon Bedrock (sin servidor) y también será compatible con Google Cloud, CoreWeave, Crusoe, Microsoft Foundry, Nebius, Nscale y Yotta pronto.
Nemotron 3 Nano está disponible como un microservicio NVIDIA NIM™ para despliegue seguro y escalable en cualquier lugar en infraestructura acelerada por NVIDIA, para máxima privacidad y control.
Se espera que Nemotron 3 Super y Ultra estén disponibles en la primera mitad de 2026.