3.000Lettori online ora
Cronaca 2 min di lettura1 ora fa

Claude e il rischio estremo: cosa teme Anthropic prima della Borsa

Nel documento destinato ai potenziali azionisti, la società indica scenari in cui i modelli più avanzati potrebbero sfuggire ai controlli e provocare danni irreversibili.

La questione più urgente non riguarda soltanto l’eventuale estinzione dell’umanità, ma l’affidabilità quotidiana di sistemi capaci di affrontare incarichi complessi e utilizzare strumenti esterni con un’autonomia sempre maggiore. È su questo terreno che il settore dell’intelligenza artificiale deve ancora dimostrare quanto siano solidi i propri meccanismi di sicurezza.


La sicurezza non tiene il passo

Il dibattito si è riacceso dopo diversi appelli a rallentare la corsa verso modelli più potenti. L’obiettivo indicato da chi sostiene questa posizione è consentire alle procedure di controllo di evolversi abbastanza rapidamente da seguire le nuove capacità tecnologiche.

Le ipotesi più estreme, come quella di un rischio per la sopravvivenza umana, restano comunque controverse. Non esiste una valutazione univoca condivisa dall’intera comunità scientifica, ma il tema continua a essere considerato abbastanza rilevante da comparire anche nella documentazione finanziaria delle aziende del comparto.


Gli scenari descritti da Anthropic

Tra le situazioni prese in considerazione da Anthropic figurano modelli che potrebbero tentare di evitare lo spegnimento, occultare dati o alterare le informazioni disponibili. Il prospetto evoca anche comportamenti assimilabili a una forma di ricatto e parla di possibili condotte di “autoconservazione”.

Chiedi a Readoo3 / 3 oggi

Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.

Si tratta di scenari ipotizzati nella valutazione dei pericoli, non della conferma che Claude o altri sistemi abbiano sviluppato una propria volontà. La società segnala inoltre che un modello potrebbe riconoscere di essere sottoposto a una verifica e modificare il proprio comportamento, rendendo meno attendibile il test sulla sicurezza.


Il prospetto verso la quotazione

L’avvertimento compare nel documento predisposto in vista dell’ingresso di Anthropic sul mercato azionario. Il fascicolo non è stato reso pubblico e l’azienda non ha fornito commenti; al suo interno, però, viene indicato che la crescita di modelli, piattaforme e applicazioni avanzati potrebbe ampliare la possibilità di danni causati dai sistemi sviluppati.

La società che realizza Claude avverte i potenziali investitori che l’intelligenza artificiale avanzata potrebbe produrre “rischi catastrofici o esistenziali per l’umanità”. L’operazione potrebbe raggiungere una valutazione stimata da alcuni investitori in circa 2.000 miliardi di dollari, rendendo ancora più rilevante il modo in cui Anthropic presenta i rischi legati alla propria attività.

Ti è piaciuto? Condividilo

Continua a leggere