// TOM'S HARDWARE ITALIA — MODA & SOCIETÀ
NVIDIA Nemotron 3.5 Lightning: 669 token al secondo
Circa 3 miliardi di parametri attivi per token, a fronte di 30 miliardi complessivi, e una finestra di contesto che arriva a 1.048.576 token: sono le coordinate principali di NVIDIA Nemotron 3.5 Lightning, modello linguistico open-weight pubblicato ufficialmente l'11 agosto 2026. Il sistema adotta una struttura Mixture-of-Experts pensata per contenere il costo dell'inferenza, mantenendo una capacità complessiva superiore alla quantità di parametri utilizzata durante ogni passaggio.
L'architettura è ibrida e combina Mamba-2, livelli Mixture-of-Experts, attenzione selettiva e Multi-Token Prediction. NVIDIA presenta questa configurazione come una base per carichi di lavoro agentici, nei quali velocità di generazione, gestione di contesti lunghi e uso efficiente delle risorse incidono direttamente sulla possibilità di eseguire più passaggi consecutivi.
Nemotron 3.5 Lightning supporta il ragionamento configurabile e il tool calling, due funzioni necessarie per costruire agenti capaci di interagire con servizi e strumenti esterni. Le lingue dichiarate sono sei: inglese, spagnolo, francese, tedesco, italiano e giapponese. Il supporto all'italiano è quindi presente fin dal rilascio, senza che NVIDIA abbia indicato varianti regionali separate.
Il modello è disponibile in due checkpoint con finalità differenti. La versione NVFP4 è ottimizzata per agenti autonomi, inferenza locale e hardware NVIDIA, inclusi DGX Spark, H100, H200, GB200 e GeForce RTX 5090; la modalità W4A16 estende la compatibilità anche all'architettura Ampere. Il checkpoint BF16 costituisce invece il riferimento per personalizzazione, post-training e ricerca. L'esecuzione è prevista tramite vLLM, TensorRT-LLM e SGLang.
Le prime misurazioni indipendenti di Artificial Analysis indicano circa 669 token al secondo e un risultato di 24 nell'Intelligence Index. Quest'ultimo valore colloca il modello sullo stesso livello di OpenAI gpt-oss-120b, pur lasciandolo dietro ad alcuni concorrenti più capaci. Nei benchmark pubblicati da NVIDIA per il checkpoint NVFP4, Nemotron 3.5 Lightning raggiunge 52,80 su SWE-bench Verified, 75,57 su GPQA Diamond e 72,88 su IFBench; i risultati del produttore e quelli indipendenti restano quindi attribuiti a serie di test distinte.
NVIDIA distribuisce Nemotron 3.5 Lightning con licenza OpenMDW 1.1 e lo dichiara utilizzabile commercialmente. Il pre-training ha impiegato oltre 20.000 miliardi di token, con cutoff dei dati fissato a settembre 2025; per il post-training il limite dichiarato è maggio 2026. Specifiche, requisiti hardware e istruzioni per il checkpoint di riferimento sono raccolti nella model card ufficiale BF16.
Aggiungi Tom's Hardware alle tue fonti preferite su Google