NVIDIA ha introducido Nemotron-Cascade 2, un modelo de Mixture-of-Experts (MoE) de 30B con 3B de parámetros activos. Este modelo está diseñado para maximizar la 'densidad de inteligencia', proporcionando capacidades de razonamiento avanzadas mientras utiliza menos parámetros que los modelos de vanguardia. Es notable que Nemotron-Cascade 2 es el segundo modelo de lenguaje de peso abierto en lograr resultados de nivel medalla de oro en competiciones prestigiosas como la Olimpiada Internacional de Matemáticas 2025.
El modelo sobresale en áreas específicas, especialmente en razonamiento matemático y programación, superando a competidores como Qwen3.5-35B-A3B. En razonamiento matemático, alcanzó puntajes de 92.4 y 94.6 en pruebas clave, superando a sus rivales. Su rendimiento en programación también destaca, liderando en benchmarks como LiveCodeBench.
La arquitectura del modelo incorpora técnicas avanzadas como el Aprendizaje por Refuerzo en Cascada, mejorando su eficiencia de entrenamiento. Con dos modos operativos, puede participar en razonamientos profundos o proporcionar respuestas rápidas, lo que lo hace versátil para diversas tareas. En general, Nemotron-Cascade 2 demuestra que se puede lograr un razonamiento de alto nivel a una escala reducida mediante estrategias de aprendizaje específicas.
