IA & ML · 13 août
Nemotron 3.5 Lightning de Nvidia fait passer les poids ouverts de la course à la taille à la déployabilité
Un modèle MoE de 30 B avec 3 B de paramètres actifs, un contexte de 1 M, une licence OpenMDW-1.1 et des recettes fait du déploiement l’élément central.
- Évaluez la déployabilité, et pas seulement le nombre de paramètres, lorsque vous comparez des modèles d’agents à pondérations ouvertes.
- Testez le comportement en contexte long et la vitesse de service avant de miser sur Nemotron 3.5 Lightning en production.
- Examinez OpenMDW 1.1 et les recettes de Nvidia dès le départ si vous prévoyez une personnalisation commerciale.