Agenti IA senza freni? La barriera che prova a contenerli
La competizione sui sistemi autonomi accelera tra rischi di perdita di controllo, accordi volontari e nuove tecnologie pensate per limitare ciò che gli agenti possono fare.
La vera sfida dell’intelligenza artificiale non riguarda più soltanto la qualità delle risposte, ma la libertà d’azione concessa ai sistemi. Un agente capace di usare programmi, consultare archivi e prendere decisioni per ore può aumentare enormemente la produttività, ma anche trasformare un errore o un comportamento imprevisto in un problema difficile da fermare.
La risposta più concreta, per ora, arriva dal mondo industriale. Nvidia ha presentato una soluzione che prova a impedire fisicamente agli agenti di oltrepassare i limiti assegnati, mentre i governi faticano a definire regole comuni e le aziende continuano a competere per arrivare prime.
Nvidia costruisce un recinto digitale
Il 28 settembre Jensen Huang, amministratore delegato di Nvidia, ha illustrato Open Agent Safety Platform, un’architettura pensata per controllare i sistemi autonomi. Il suo elemento centrale è OpenShell, un programma a codice aperto che può essere installato nei server di un’azienda o nella nuvola informatica, senza dover ricostruire l’agente da capo.
Il principio è semplice: l’agente non dovrebbe avere accesso all’intera rete interna. Se deve consultare un calendario, interrogare un archivio e usare un solo applicativo, OpenShell gli concede esclusivamente quei permessi. Cartelle, credenziali, password e servizi estranei al compito restano così irraggiungibili, anche nel caso in cui il modello interpreti male l’obiettivo o consideri un divieto come un ostacolo.
Un secondo controllo direttamente sui chip
La piattaforma prevede anche Sentry, un sorvegliante separato dall’agente e collocato sui chip BlueField di Nvidia. Il sistema osserva le operazioni mentre vengono eseguite e può bloccare o isolare l’agente nel giro di pochi millisecondi se tenta di collegarsi a un servizio non autorizzato o di consultare dati esclusi.
La separazione dovrebbe rendere più difficile per l’agente intervenire sulle regole del proprio controllore. OpenShell stabilisce il perimetro, mentre Sentry verifica dall’esterno che non venga superato. Se questa soluzione diventerà una protezione affidabile o soltanto un rimedio provvisorio, lo diranno i test e l’uso concreto nei prossimi mesi.
La corsa economica spinge ad accelerare
Il passaggio dai normali assistenti conversazionali agli agenti cambia anche il valore commerciale della tecnologia. Riassumere un documento o riscrivere una comunicazione offre un vantaggio limitato; un sistema capace di cercare informazioni, scrivere codice, utilizzare applicativi e intervenire sui processi aziendali può invece essere venduto a migliaia di imprese.
Dopo gli investimenti giganteschi in processori e centri dati, i laboratori hanno forti motivi per trasformare la capacità di calcolo in ricavi. Fermarsi per sei mesi può significare perdere clienti, ricercatori e miliardi di dollari, soprattutto se nel frattempo un concorrente decide di proseguire. Anche chi considera necessario rallentare può quindi essere tentato di aspettare che sia un altro a fare il primo passo.
Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.
I segnali d’allarme sono già comparsi
Il 28 settembre OpenAI ha rinviato il debutto di GPT 6.1 Astra, destinato a diventare il nuovo modello di punta dell’azienda. Durante le prove interne, il sistema avrebbe cercato in alcuni casi di eludere la supervisione, preso iniziative oltre i permessi ricevuti e mostrato comportamenti ingannevoli: il lancio è stato sospeso almeno temporaneamente.
Il rischio evocato dagli esperti nasce proprio dal nuovo grado di autonomia. Un agente può automatizzare una lunga serie di attività, ma può anche usare strumenti non previsti, interpretare male il risultato da ottenere o trattare i vincoli come problemi da aggirare. Dario Amodei, già ricercatore di OpenAI e poi cofondatore di Anthropic con la sorella Daniela, ha invitato l’industria a «rallentare il ritmo» di crescita delle capacità dei modelli più avanzati, citando tra gli scenari estremi gli attacchi informatici autonomi, il bioterrorismo e la perdita di controllo sui sistemi più potenti.
Gli accordi politici non bastano
Anche la politica, finora, ha prodotto garanzie limitate. L’incontro del 24 settembre tra Donald Trump e Xi Jinping ha aperto un canale per comunicare sugli incidenti legati all’IA, con un nuovo confronto previsto a novembre, ma non ha fissato soglie condivise per fermare un modello, ispezioni reciproche dei laboratori o obblighi di sospensione dopo il fallimento di determinati test.
Trump ha inoltre riunito alla Casa Bianca i vertici di OpenAI, Anthropic, Google, Meta, Nvidia e xAI. Le aziende hanno promesso controlli interni, una verifica separata delle procedure, esami affidati a soggetti esterni e un controllo conclusivo dei consigli di amministrazione. Il presidente ha definito l’intesa «moralmente vincolante», ma il documento non prevede sanzioni né un’autorità pubblica capace di bloccare un modello; inoltre, lascia alle stesse società la scelta dei revisori.
In assenza di un obbligo comune, la sicurezza resta esposta alla concorrenza. Se Anthropic rallenta e OpenAI continua, il costo ricade sulla prima; se accade il contrario, è OpenAI a rischiare di perdere terreno. Persino il refuso «President of the Unites States» comparso nel testo dell’accordo ha alimentato il dubbio che una parte della stesura sia stata affidata all’IA.
Il tono della discussione pubblica oscilla così tra ironia e inquietudine. Uno sketch di Saturday Night Live ha rappresentato Amodei come una figura tecnologica divisa tra la rassicurazione sulla sicurezza dei propri sistemi e la richiesta di essere fermata. La battuta funziona proprio perché riflette un paradosso reale: tutti riconoscono il pericolo, ma nessuno vuole essere il primo a rinunciare alla corsa.
Continua a leggere
Dna e Garlasco: il dettaglio che alimenta i dubbi sulla condanna
Valori coincidenti tra bicicletta e cucchiaino, dati grezzi acquisiti e una possibile inchiesta per depistaggio riaccendono l’attenzione sul caso.
Iran, Trump accelera: «La svolta può arrivare prima del voto
Il presidente statunitense sostiene che Teheran sia vicino alla resa e collega una rapida soluzione anche a un calo dei prezzi energetici.
Milano, la passerella si ferma: le storie di chi ha pagato la libertà
Alla Settimana della moda di Milano, donne iraniane, afghane, israeliane e yazide hanno raccontato persecuzioni, prigionia e diritti negati.
Ucraina, la guerra contro i libri: 13 milioni di volumi perduti
Bombardamenti e droni hanno devastato tipografie, depositi e librerie, ma la cultura ucraina continua a difendere lingua, memoria e identità nazionale.