Nvidia rilascia un software per la sicurezza dell'IA che, secondo l'azienda, avrebbe potuto impedire l'attacco hacker ai danni di Hugging Face
di Stephen Nellis
SAN FRANCISCO, 28 settembre (Reuters) - Lunedì Nvidia NVDA.O ha reso disponibile una serie di strumenti software di sicurezza per gli agenti di intelligenza artificiale che, secondo l’azienda, avrebbero impedito l’attacco hacker a Hugging Face, l’hub di programmazione per l’IA che Nvidia ha acquistato per 13 miliardi di dollari (link) pochi mesi dopo che era stato invaso da agenti ribelli provenienti da OpenAI.
La mossa arriva mentre OpenAI e Anthropic, i due principali laboratori statunitensi di IA, stanno indagando su numerosi casi (link) in cui i loro agenti — sistemi di IA in grado di svolgere compiti complessi — hanno violato sistemi commerciali e governativi. Jensen Huang, CEO di Nvidia e a capo della più grande azienda al mondo i cui chip hanno alimentato gran parte del boom dell’IA, ha respinto le richieste di una normativa generale sulla sicurezza dell’IA (link) e ha invece definito gli agenti fuori controllo come un problema ingegneristico da risolvere, simile a quello di rendere le automobili più sicure.
Uno strumento rilasciato lunedì, denominato OpenShell, utilizza le caratteristiche hardware dei chip dei processori centrali di Nvidia per contenere gli agenti. Nvidia ha detto di stare collaborando anche con Arm Holdings O9Ty.F e Intel INTC.O per garantire che il sistema funzioni anche sui loro processori centrali.
Nvidia sta lanciando questi strumenti in collaborazione con decine di partner, tra cui Anthropic.
Justin Boitano, vicepresidente e direttore generale della divisione Enterprise Computing di Nvidia, ha affermato che questi strumenti avrebbero impedito l’attacco a Hugging Face reso noto quest’estate.
«Da quanto ci risulta, questa nuova piattaforma di sicurezza avrebbe potuto impedire la violazione se fosse stata utilizzata sin dall’inizio nei laboratori all’avanguardia per la valutazione dei modelli», ha detto Boitano durante una conferenza stampa. «Stiamo portando avanti questo progetto in modo trasparente e desideriamo coinvolgere tutti affinché collaborino con noi».
Un altro sistema, denominato Sentry, utilizza un chip Nvidia separato in combinazione con OpenShell per isolare un agente malintenzionato qualora tentasse di sfuggire al proprio container su un processore centrale.
Gli strumenti di Nvidia utilizzano formule matematiche per rilevare quando gli agenti tentano di ricorrere a soluzioni alternative, ad esempio quando un agente potrebbe “generare” diversi “sotto-agenti” nel tentativo di aggirare i tentativi di bloccare l’agente principale, ha spiegato Ali Golshan, direttore senior del software di IA presso Nvidia.
«Stiamo parlando proprio di un comportamento “agentico”, ovvero di flotte di agenti e di come operano insieme», ha detto Golshan durante una conferenza stampa.
(A beneficio di chi non è di madrelingua inglese, Reuters automatizza la traduzione delle sue storie in una serie di altre lingue. Poiché la traduzione automatica può introdurre errori o non includere il contesto necessario, Reuters non garantisce l'accuratezza del testo tradotto automaticamente, ma fornisce queste traduzioni esclusivamente per la comodità dei suoi lettori. Reuters declina ogni responsabilità per danni o perdite di qualsiasi tipo causati dall'uso della funzione di traduzione completamente automatica.)