Nemotron 3.5 Lightning
NVIDIA🇺🇸
nvidia/nemotron-3.5-lightningNemotron 3.5 Lightning is NVIDIA's open 30B mixture-of-experts model with 3B active parameters and a 1M-token context window, built for fast, accurate execution within long-running agent pipelines. It is designed as a low-latency, low-cost execution layer for always-on agentic systems.
Fascia di costo
0.1x
Contesto
262K
Rilasciato
11 ago 2026
Input
Text
Output
Text
Supporto
RagionamentoChiamata di strumentiOutput strutturati
In cosa eccelle
Le categorie in cui questo modello ottiene i risultati migliori.
Nessuna categoria con classifica elevata trovata.
Prestazioni
Latenza e velocità mediane misurate sulle richieste recenti.
Velocità301 tok/s
Latenza