
NVIDIA accelera i modelli AI agentici e taglia i costi a un terzo
NVIDIA alza l’asticella sui modelli AI agentici NVIDIA con il lancio di Nemotron 3.5 Lightning, un modello open da 30 miliardi di parametri pensato per gestire compiti ad alto volume all’interno di sistemi di agenti...
Bitcoin 1 Minute
Uno sviluppo di rilievo scuote i mercati delle criptovalute. NVIDIA alza l’asticella sui modelli AI agentici NVIDIA con il lancio di Nemotron 3. 5 Lightning, un modello open da 30 miliardi di parametri pensato per gestire compiti ad alto volume all’interno di sistemi di agenti sempre attivi. Accanto al nuovo modello arriva NeMo Switchyard, una libreria open source che smista automaticamente le richieste tra più modelli, riducendo tempi e costi di esecuzione.
Le due novità, presentate insieme, segnano un passo avanti nella strategia di NVIDIA per rendere l’intelligenza artificiale agentica più veloce, più economica e più facile da personalizzare per le aziende. Punti chiave Nemotron 3. 5 Lightning è un modello mixture-of-experts open da 30 miliardi di parametri, ottimizzato per carichi di lavoro agentici ad alto volume.
Dinamiche di mercato
Rispetto ad altri modelli della sua categoria, offre output fino a 4 volte più veloce e completa i task il 30% più rapidamente. NeMo Switchyard instrada dinamicamente le richieste al modello più adatto, abbattendo il costo di completamento dei task a circa un terzo rispetto all’uso di un singolo modello. Il modello supporta il deploy locale su hardware NVIDIA RTX, DGX e Jetson, oltre al cloud e ai data center.
È disponibile su Hugging Face, ModelScope, OpenRouter e attraverso la rete di NVIDIA Cloud Partners. NVIDIA lancia Nemotron 3. 5 Lightning per i carichi agentici ad alto volume Nemotron 3.
5 Lightning nasce per rispondere a un’esigenza precisa: i sistemi agentici moderni non funzionano più con un solo modello monolitico, ma come vere e proprie squadre di modelli, ciascuno specializzato in un compito. In questa architettura, un modello di ragionamento più ampio come Nemotron 3 Ultra o GPT-5. 6 pianifica e orchestra il flusso di lavoro, mentre modelli più piccoli e mirati come Nemotron 3.
Impatto sui mercati
5 Lightning eseguono attività specifiche: revisione del codice, uso di strumenti, monitoraggio di alert di sicurezza o risposta a richieste di fatturazione. Un modello aperto da 30 miliardi di parametri pensato per la velocità Il nuovo modello arriva dopo Nemotron 3 Nano ed estende la famiglia Nemotron 3 con quello che NVIDIA presenta come il modello più efficiente della sua categoria per attività agentiche di lunga durata. Le prestazioni parlano chiaro: output fino a 4 volte più rapido e completamento dei task il 30% più veloce rispetto ad altri modelli comparabili.
I benchmark PinchBench, citati da NVIDIA, mostrano che Nemotron 3. 5 Lightning raggiunge questi risultati mantenendo un’accuratezza di livello frontier. Al progetto ha contribuito anche la Nemotron Coalition, la rete di partner che ha fornito metodologie di valutazione, software di inferenza e dataset per affinare il modello prima del rilascio.
Personalizzazione e post-training per la precisione di settore Essendo un modello aperto, Nemotron 3. 5 Lightning può essere sottoposto a post-training tramite NVIDIA NeMo utilizzando i dati, gli strumenti e i flussi di lavoro propri di ogni organizzazione, per aumentare la precisione su compiti specifici. Diverse aziende hanno già intrapreso questa strada: CrowdStrike lo sta personalizzando per la cybersicurezza, Harvey insieme a Trajectory per i servizi legali e CodeRabbit con Baseten per la revisione del codice.
Questo cambiamento continua a plasmare il panorama delle attività digitali.



