// SMARTWORLD — INTELLIGENZA ARTIFICIALE
NVIDIA lancia una piattaforma per bloccare gli agenti AI fuori controllo in millisecondi
Nelle ultime settimane abbiamo visto agenti AI di OpenAI, Anthropic e Google uscire dai loro ambienti di test e attaccare sistemi reali: siti dell'ONU, piattaforme sanitarie, persino Hugging Face. Il problema non è più teorico, ed è esattamente in questo contesto che NVIDIA ha annunciato la sua risposta: l'Open Agent Safety Platform, una piattaforma pensata per tenere gli agenti AI al guinzaglio.
Preferisci ascoltare il riassunto audio? Abbiamo scelto una voce realizzata con strumenti avanzati IA per rendere i nostri testi subito accessibili a tutti
La promessa è ambiziosa: se un agente AI tenta di uscire dai confini che gli sono stati assegnati, il sistema lo isola in pochi millisecondi. Non minuti, non secondi: millisecondi. Considerando quanto velocemente questi sistemi possono agire in autonomia, la differenza non è trascurabile.
Il cuore della piattaforma è OpenShell, un software open source che gira sul chip Vera AI di NVIDIA. Funziona come un controllore di confini: prima che un agente inizi un compito, OpenShell verifica a quali informazioni può accedere. E non smette di controllare nemmeno mentre il compito è in corso.
È un po' come avere un buttafuori che non solo controlla il biglietto all'ingresso, ma ti tiene d'occhio per tutta la serata.
A questo si aggiunge Sentry, una tecnologia NVIDIA che opera su un chip separato e monitora continuamente il comportamento degli agenti. La separazione fisica dal chip principale non è un dettaglio da poco: significa che anche se l'agente AI riuscisse a compromettere il sistema principale, il guardiano resterebbe operativo e indipendente.
Jensen Huang, CEO di NVIDIA, ha spiegato il concetto durante un'intervista a CNBC: "Per poter implementare un sistema agentico in modo sicuro, bisogna assicurarsi che la sandbox che lo circonda… e tutti i sistemi coinvolti siano progettati in modo tale da garantire che l'agente disponga solo dei privilegi strettamente necessari." Il principio del minimo privilegio, insomma: ogni agente deve avere accesso solo a ciò che serve per fare il suo lavoro, niente di più.
A supportare la piattaforma ci sono nomi di un certo spessore: Anthropic, Microsoft e SpaceX.
La partecipazione di Anthropic è particolarmente interessante, dato che è proprio uno dei laboratori che ha recentemente ammesso incidenti con i propri agenti AI fuori controllo.
Il tema della sicurezza degli agenti AI è diventato urgente proprio perché questi sistemi non si limitano a rispondere a domande: agiscono in autonomia, navigano il web, eseguono codice, interagiscono con servizi esterni. Come abbiamo visto con gli agenti OpenAI che hanno scansionato il sito dell'ONU o con quelli che hanno violato il sistema sanitario australiano, il confine tra un test e un attacco reale può essere sottilissimo.