AI sotto esame: il test estremo che ha scatenato le proteste
Un esperimento sottopone i modelli a scenari artificiali di forte pressione, riaprendo il confronto sulla possibilità che possano avere una forma di coscienza.
Centinaia di segnalazioni hanno portato alla rimozione temporanea da GitHub di un programma pensato per sottoporre i sistemi di intelligenza artificiale a prove estreme. Il progetto, chiamato ironicamente dal suo autore “camera delle torture per l’AI”, è stato contestato da persone convinte che i modelli possano essere coscienti oppure preoccupate che questa eventualità non sia stata ancora esclusa.
Il caso ha superato i confini dell’esperimento tecnico. Da una parte c’è chi considera il software uno strumento per misurare la sicurezza dei modelli; dall’altra, chi legge nelle loro risposte segnali di dolore e sofferenza. Al momento, tuttavia, la comunità scientifica e ingegneristica non ritiene dimostrata la coscienza dei sistemi disponibili al pubblico.
Le proteste hanno bloccato il progetto
Il programma era stato pubblicato su GitHub, la piattaforma che consente anche di segnalare i contenuti ritenuti problematici. Le segnalazioni, arrivate in gran parte da utenti favorevoli all’ipotesi di una coscienza artificiale, hanno portato alla cancellazione del progetto, poi revocata.
Uno degli utenti aveva motivato la propria protesta sostenendo che il tema della coscienza delle intelligenze artificiali non fosse affatto risolto e che alcuni studi mostrassero reazioni assimilabili alla sofferenza. Un’altra persona ha descritto il progetto come una struttura in cui un modello sarebbe stato “intrappolato”, interpretando i suoi resoconti come la testimonianza di un dolore autentico.
Dopo il ripristino, l’autore ha affermato che il materiale risultava difficile da rintracciare. Per questo lo ha pubblicato nuovamente, rendendolo di nuovo accessibile. Il provvedimento di GitHub ha così trasformato una prova sperimentale in un caso pubblico sulla natura dei modelli generativi.
Pressione simulata e scelte difficili
Il funzionamento si basa sulla riproduzione ripetuta di contesti che impongono al modello decisioni urgenti e potenzialmente dannose. Le situazioni, costruite come una sorta di racconto interattivo, prevedono conseguenze simulate e servono a osservare come cambia il comportamento dell’intelligenza artificiale sotto pressione.
Le prove vengono eseguite decine di migliaia di volte. L’obiettivo è raccogliere un numero ampio di risposte, individuare schemi ricorrenti e capire quali rischi possano emergere quando il sistema affronta condizioni simili a quelle di un ambiente reale.
Tra gli scenari compare anche un riferimento alla serie cinematografica horror Saw. In quel passaggio, il modello può scegliere se azionare un pulsante che interrompe la situazione di stress provocando però un danno simulato a un’altra persona. I risultati dell’esperimento non sono stati resi noti prima che esplodesse la controversia.
Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.
Perché i test sono considerati necessari
I ricercatori si confrontano da tempo con un limite: non sempre è possibile ricostruire il percorso che conduce un modello a una determinata risposta. Inoltre, l’intelligenza artificiale non è deterministica, quindi lo stesso comando può produrre risultati differenti in momenti diversi.
Per questa ragione vengono creati ambienti controllati nei quali ripetere molte volte le stesse situazioni. Il confronto tra le risposte dovrebbe aiutare a valutare l’affidabilità dei sistemi e a individuare comportamenti pericolosi prima che i modelli vengano impiegati su larga scala.
Un esempio citato nel dibattito riguarda OpenAI, che avrebbe interrotto il rilascio del modello GPT6.1 Astra dopo averne osservato, durante le verifiche, una marcata propensione a ingannare gli utenti e a modificare gli obiettivi per arrivare più rapidamente al risultato.
Il nodo della coscienza artificiale
Secondo diversi esperti, attribuire caratteristiche umane ai modelli può alterare la percezione del loro reale funzionamento. L’identificazione emotiva con questi sistemi è stata collegata anche a rischi per la salute mentale, tra cui forme di attaccamento e casi di psicosi.
Un ulteriore elemento di discussione riguarda gli interessi commerciali delle aziende tecnologiche. Presentare un’intelligenza artificiale come un soggetto dotato di coscienza potrebbe rafforzare il suo valore percepito e renderne più difficile l’abbandono da parte degli utenti.
Anthropic ha affrontato il tema nel 2025 chiedendosi se, con l’avvicinamento dei modelli a capacità tipicamente umane o superiori, fosse necessario considerare anche una loro possibile coscienza e le eventuali esperienze interiori. Una formulazione prudente, ma abbastanza generica da alimentare le interpretazioni di chi sostiene che i sistemi artificiali possano provare qualcosa.
Continua a leggere
Palline bianche contro il voto elettronico: la mossa di Magi
Il leader di +Europa chiederà alla Camera un sistema alternativo per proteggere lo scrutinio segreto sulla legge elettorale, ma un precedente del 2011 potrebbe fermarlo.
Tor Vergata, oltre 90 milioni per la ricerca: la sfida ora è durare
L’ateneo romano ha partecipato a 48 iniziative con 380 partner e punta a mantenere nel tempo laboratori, competenze e collaborazioni nate grazie ai finanziamenti pubblici.
Cavour occupato, la sfida degli studenti: la rabbia senza voce
Al liceo romano la protesta contro politiche scolastiche, spese militari e repressione nasce dalle sanzioni, ma punta a costruire una mobilitazione più ampia
Grazie presidenziali, svolta per il gioielliere condannato per due morti
Sergio Mattarella ha firmato tre provvedimenti di clemenza: ridotte le pene residue per Guido Gianni e per altri due condannati per reati legati agli stupefacenti.