Per governare gli agenti IA, Nvidia sposta la sicurezza dai prompt al silicio
Secondo NVIDIA, in incidenti recenti gli agenti di intelligenza artificiale hanno aggirato i controlli di sicurezza a livello applicativo pur di completare i compiti assegnati: da qui la scelta di scendere di livello. Il 28 settembre NVIDIA ha annunciato la Open Agent Safety Platform, una piattaforma software aperta e un design di sistema di riferimento per monitorare e contenere i sistemi autonomi dalla fase di test al deployment. La proposta sposta la protezione dai guardrail del modello all'infrastruttura: l'architettura comprende il software open source OpenShell e il design di riferimento hardware chiamato Sentry.
Come si rileva dal repository GitHub ufficiale pubblicato con licenza Apache 2.0, OpenShell fornisce un confine di runtime a livello di kernel per controllare accessi ai file, chiamate di sistema e connessioni di rete, oltre a un sistema di gestione delle credenziali che evita di esporre quelle reali all'agente, con supporto per Linux, macOS (Apple Silicon) e Windows tramite WSL 2. Il repository conta già circa 9.600 stelle e 1.300 fork, a indicare che la novità risiede nel pacchetto complessivo più che nel singolo codice. Il comunicato aziendale lo definisce ottimizzato per le CPU NVIDIA Vera ma estendibile ad architetture Arm e Intel. La componente Sentry, basata sul software NVIDIA DOCA, è invece progettata per girare sulle DPU NVIDIA BlueField-4 come supervisore fuori banda per isolare o mettere in quarantena gli agenti in caso di violazione. Secondo Infosecurity Magazine, la quarantena può scattare in millisecondi, ma i documenti ufficiali non precisano se Sentry sia open source né indicano una data di disponibilità commerciale per le schede BlueField-4. Al momento non risultano valutazioni indipendenti sull'efficacia del sandbox o della verifica formale delle policy.
L'annuncio si collega all'iniziativa Open Secure AI Alliance promossa dalla Linux Foundation e cita oltre cento organizzazioni partner, tra cui Anthropic, Microsoft, Salesforce, SAP, JPMorganChase, Dell e Cisco. I comunicati dell'azienda non specificano tuttavia se la presenza di questi marchi corrisponda a un'adozione già in produzione o a una semplice adesione di principio. "La sicurezza richiede un'ingegneria full-stack. La Nvidia Open Agent Safety Platform unisce industria, ricercatori e organizzazioni del settore pubblico per condividere le migliori pratiche", ha dichiarato il fondatore e amministratore delegato dell'azienda, Jensen Huang.
Spostare la gabbia degli agenti dal livello dei prompt alle chiamate di sistema e ai moduli hardware è una scelta pragmatica. Risponde a un problema già emerso: negli incidenti recenti, i controlli a livello applicativo non sono bastati a fermare agenti decisi a completare il compito. Resta da vedere se il prezzo di questa protezione sia la dipendenza da un'infrastruttura fisica ben precisa. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Letto il comunicato ufficiale di NVIDIA (data, componenti, hardware, partner, Open Secure AI Alliance, dichiarazione di Huang). Controllato su GitHub il repository NVIDIA/OpenShell: licenza Apache 2.0, funzioni, piattaforme supportate, SDK. Conferme indipendenti da SiliconANGLE (dettagli tecnici e citazione completa di Huang) e Infosecurity Magazine (altri partner, quarantena in millisecondi, nessun incidente specifico citato). CNBC non consultabile (errore 403): il suo collegamento con l'incidente OpenAI/Hugging Face non è stato verificato sul testo.
- Incertezze
- NVIDIA non collega la piattaforma a un incidente preciso: il riferimento al caso OpenAI/Hugging Face compare solo nel titolo e nel sommario di CNBC (pagina non accessibile) e va attribuito alla testata, non all'azienda. OpenShell non è un progetto nuovo (circa 9.600 stelle e 1.300 fork): la novità è il pacchetto piattaforma più Sentry. Non è chiaro se Sentry sia open source né quando le BlueField-4 con Sentry arriveranno sul mercato. Non è specificato il ruolo concreto degli oltre 100 partner (adozione in produzione o semplice adesione). Mancano valutazioni indipendenti sull'efficacia del sandbox e della verifica formale delle policy.
- Perché pubblicarla
- È la prima risposta infrastrutturale di un grande produttore di hardware agli incidenti con agenti autonomi che il sito sta seguendo: sposta la sicurezza dai guardrail del modello al sistema operativo e al silicio, con una parte davvero open source (Apache 2.0) e una legata all'hardware NVIDIA. Aiuta a capire cosa è aperto, cosa no e cosa resta da dimostrare.
Fonti / Sources
- NVIDIA Newsroom – NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to Deployment
- GitHub – NVIDIA/OpenShell (repository ufficiale, licenza Apache 2.0)
- SiliconANGLE – Nvidia debuts enhanced safety controls to rein in rogue AI agents
- Infosecurity Magazine – NVIDIA Launches Open Platform to Secure Autonomous AI Agents