NVIDIA NEMOTRON 3.5 LIGHTNING: el open 30B de NVIDIA para agentes
TL;DR
NVIDIA NEMOTRON 3.5 LIGHTNING: el open 30B de NVIDIA para agentes
¿Un modelo open de NVIDIA con 30B MoE que corre en una sola GPU y es 4x más rápido para agentes? Analizamos el Nemotron 3.5 Lightning.
Capítulos del vídeo
- 0:00 — Intro — la nueva era open de NVIDIA
- 0:36 — Arquitectura — híbrida Mamba-2 + MoE (30B/3B, 1M contexto)
- 1:13 — Capa de ejecución — el motor de los agentes always-on
- 1:56 — Velocidad — 4x output, PinchBench 86%
- 2:32 — Benchmarks — model card bajo la lupa
- 3:10 — Hardware — una sola GPU local
- 3:46 — Optimización — NVFP4 y decodificación especulativa
- 4:21 — NeMo Switchyard — enrutamiento inteligente
- 5:00 — Licencia OpenMDW-1.1 — ecosistema integrado
- 5:40 — Limitaciones — las fronteras del Lightning
- 6:17 — Veredicto y cómo empezar
El contexto
NVIDIA lanzó el 11 de agosto de 2026 el Nemotron 3.5 Lightning: un modelo abierto de 30 mil millones de parámetros con arquitectura MoE híbrida (Mamba-2 + MoE + atención) que activa solo 3B por token, soporta 1M de contexto y está pensado para la capa de ejecución de agentes siempre activos. Analizamos sus benchmarks (PinchBench 86%, MMLU Pro 81.94), su licencia permisiva OpenMDW-1.1, el enrutador NeMo Switchyard y si de verdad corre en una sola GPU local como la DGX Spark, la RTX 5090 o en Apple Silicon.
Análisis
El vídeo desgrana el tema con datos verificados, comparativas y conclusiones prácticas. Aquí tienes el contexto por escrito para profundizar.
Puntos clave
- Ver datos y cifras en el vídeo: https://www.youtube.com/watch?v=SO1ZPB1vqjY
- Investigación previa documentada en el pipeline de vídeo (research.md del proyecto)
- Fuentes primarias listadas a continuación
Fuentes
- NVIDIA Blog — Nemotron 3.5 Lightning y NeMo Switchyard
- Model card Hugging Face (NVFP4/BF16)
- Ollama Blog
- Thoughtworks — test independiente
Conclusión
Un análisis más en el canal. Suscríbete para no perderte los próximos.
Artículo generado automáticamente desde el vídeo publicado en nramosdev. Cada número citado proviene de la investigación verificada del pipeline.