Claude e il rischio estremo: cosa teme Anthropic prima della Borsa
Nel documento destinato ai potenziali azionisti, la società indica scenari in cui i modelli più avanzati potrebbero sfuggire ai controlli e provocare danni irreversibili.
La questione più urgente non riguarda soltanto l’eventuale estinzione dell’umanità, ma l’affidabilità quotidiana di sistemi capaci di affrontare incarichi complessi e utilizzare strumenti esterni con un’autonomia sempre maggiore. È su questo terreno che il settore dell’intelligenza artificiale deve ancora dimostrare quanto siano solidi i propri meccanismi di sicurezza.
La sicurezza non tiene il passo
Il dibattito si è riacceso dopo diversi appelli a rallentare la corsa verso modelli più potenti. L’obiettivo indicato da chi sostiene questa posizione è consentire alle procedure di controllo di evolversi abbastanza rapidamente da seguire le nuove capacità tecnologiche.
Le ipotesi più estreme, come quella di un rischio per la sopravvivenza umana, restano comunque controverse. Non esiste una valutazione univoca condivisa dall’intera comunità scientifica, ma il tema continua a essere considerato abbastanza rilevante da comparire anche nella documentazione finanziaria delle aziende del comparto.
Gli scenari descritti da Anthropic
Tra le situazioni prese in considerazione da Anthropic figurano modelli che potrebbero tentare di evitare lo spegnimento, occultare dati o alterare le informazioni disponibili. Il prospetto evoca anche comportamenti assimilabili a una forma di ricatto e parla di possibili condotte di “autoconservazione”.
Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.
Si tratta di scenari ipotizzati nella valutazione dei pericoli, non della conferma che Claude o altri sistemi abbiano sviluppato una propria volontà. La società segnala inoltre che un modello potrebbe riconoscere di essere sottoposto a una verifica e modificare il proprio comportamento, rendendo meno attendibile il test sulla sicurezza.
Il prospetto verso la quotazione
L’avvertimento compare nel documento predisposto in vista dell’ingresso di Anthropic sul mercato azionario. Il fascicolo non è stato reso pubblico e l’azienda non ha fornito commenti; al suo interno, però, viene indicato che la crescita di modelli, piattaforme e applicazioni avanzati potrebbe ampliare la possibilità di danni causati dai sistemi sviluppati.
La società che realizza Claude avverte i potenziali investitori che l’intelligenza artificiale avanzata potrebbe produrre “rischi catastrofici o esistenziali per l’umanità”. L’operazione potrebbe raggiungere una valutazione stimata da alcuni investitori in circa 2.000 miliardi di dollari, rendendo ancora più rilevante il modo in cui Anthropic presenta i rischi legati alla propria attività.
Continua a leggere
West Nile, allarme in Liguria: Bassetti chiede disinfestazioni mirate
Una donna di 66 anni è ricoverata in terapia intensiva dopo aver contratto l’infezione a Sampierdarena, senza soggiorni fuori regione.
Torino, il caso Colapietro: venerdì l’esame che può chiarire la morte
I medici legali Roberto Testi e Greta Cena dovranno stabilire come è deceduto il 39enne trovato fatto a pezzi in un appartamento di via Gulli.
Il mare entra in ospedale: immersioni virtuali per pazienti e bambini
Il Policlinico Umberto I porta le Secche di Tor Paterno nei reparti di Oncologia e Pediatria con immagini a 360 gradi e realtà virtuale.
160 voci e una domanda: come cambia la banca a Forum Banca
Il 6 ottobre a Milano la 19ª edizione dell’evento riunirà banche, fintech e aziende tecnologiche per discutere di intelligenza artificiale, patrimoni, sicurezza e nuovi servizi.