Nemotron 3.5 Lightning
NVIDIA🇺🇸
nvidia/nemotron-3.5-lightningNemotron 3.5 Lightning is NVIDIA's open 30B mixture-of-experts model with 3B active parameters and a 1M-token context window, built for fast, accurate execution within long-running agent pipelines. It is designed as a low-latency, low-cost execution layer for always-on agentic systems.
Taux de coût
0.1x
Contexte
262K
Date de sortie
11 août 2026
Entrée
Text
Sortie
Text
Prise en charge
RaisonnementAppel d'outilsSorties structurées
Meilleur en
Les catégories où ce modèle se classe le mieux.
Aucune catégorie classée en tête trouvée.
Performances
Latence et débit médians mesurés sur les requêtes récentes.
Débit301 tok/s
Latence