IA in corsa: OpenAI e Anthropic rilanciano proprio mentre parlano di freno
Nel giorno in cui il dibattito sul rallentamento dell’intelligenza artificiale torna al centro, le due aziende mostrano il contrario con modelli più autonomi, più rapidi e più controllati.
Altro che stop. Nel giro di poche ore, OpenAI e Anthropic hanno messo sul tavolo GPT-6 e Claude Opus 5.5, due sistemi che spingono ancora più in alto l’asticella della competizione sull’intelligenza artificiale.
Il freno resta solo a parole
Il punto più evidente non è solo la potenza, ma il tipo di salto: più autonomia, migliori risultati nei compiti complessi e una corsa che continua proprio mentre le due società discutono in pubblico della necessità di rallentare lo sviluppo.
Le richieste di Amodei e la risposta dei
Il 12 settembre Dario Amodei, alla guida di Anthropic, aveva invitato il settore a “rallentare la frontiera”. Al suo appello aveva dato sostegno anche Sam Altman, aprendo il confronto su controlli condivisi, verifiche indipendenti e nuove regole di governance.
Amodei aveva indicato un percorso in tre passaggi: accesso continuo ai laboratori per esperti esterni, standard comuni tra aziende dei Paesi democratici e, in futuro, intese internazionali capaci di mettere un argine alle aree più pericolose dello sviluppo.
Eppure i lanci arrivati nello stesso giorno raccontano l’altra faccia della medaglia. Prima Anthropic ha svelato Claude Opus 5.5, poi OpenAI ha annunciato GPT-6 Sol e GPT-6 Luna; la famiglia GPT-6 era già partita il 3 settembre con Astra, il modello di fascia più alta, ma questi sono i primi nuovi arrivi dopo l’appello di Amodei.
OpenAI abbassa i prezzi e amplia GPT-6
OpenAI sta usando GPT-6 Astra come riferimento per i problemi più difficili, ma ha portato parte di quelle capacità anche nei livelli inferiori della gamma. Sol è stato orientato a programmazione e ragionamento articolato, oltre che ai compiti in cui un agente deve usare strumenti e procedere per passaggi successivi; Luna, invece, punta su rapidità e costi più bassi per i carichi ripetitivi e molto voluminosi.
Entrambi condividono una finestra di contesto da 1,05 milioni di token e arrivano fino a 128.000 token in uscita. Nella nuova generazione compaiono anche funzioni come le chiamate asincrone agli strumenti e la modifica delle istruzioni mentre il modello è già al lavoro.
Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.
C’è poi il capitolo dei listini: Sol costa 2 dollari per milione di token in input e 10 dollari in output, mentre Luna scende a 10 e 50 centesimi. OpenAI parla di tariffe dimezzate rispetto alla precedente generazione 5.6 nelle offerte confrontabili.
Anthropic spinge sul codice ma alza i guardrail
Claude Opus 5.5, secondo Anthropic, arriva a livelli vicini a Fable 5.1 pur consumando meno risorse: sui carichi tipici costerebbe circa il 40% in meno di Opus 5 e produrrebbe risultati oltre il 30% più velocemente. Il guadagno più netto riguarda il lavoro autonomo sul software.
Nei test Terminal-Bench 4.0 il modello ha ottenuto il 66,4%, contro il 52,3% di Opus 5 e il 57,9% attribuito a GPT-6 Astra; su FrontierCode ha toccato il 54,4%, appena sopra il 53,3% di Astra. Anthropic avverte però che, a questi livelli, pochi punti di benchmark raccontano sempre meno del comportamento reale.
La società accompagna il potenziamento con limiti più severi. Il modello riceve protezioni pensate per i sistemi più sensibili quando le richieste toccano cybersecurity e biologia; in certi casi, se la domanda supera le soglie previste, il compito può essere passato automaticamente a Opus 4.8. Anche i controlli sui tentativi di uscire dal proprio ambiente di esecuzione risultano più stretti rispetto a Opus 5 e Mythos 5.1.
OpenAI, dal canto suo, ha pubblicato nello stesso giorno un quadro più ampio per consentire a valutatori indipendenti di seguire da vicino training, valutazione e deployment, con accesso anche alle affermazioni sulla sicurezza. Ma i due lanci, messi uno accanto all’altro, dicono la stessa cosa: il rallentamento evocato nei dibattiti resta molto più difficile da praticare che da invocare.
Continua a leggere
Naza, il lato oscuro degli algoritmi: come si scelgono i bersagli a Gaza
Il documentario di Yuval Abraham e Rachel Szor ricostruisce la catena che unisce intercettazioni, intelligenza artificiale, sorveglianza e valutazione delle vittime civili.
Moto G86 5G a 239 euro: il prezzo da guardare prima dell’acquisto
Il Motorola Moto G86 5G scende sotto quota 250 euro con una dotazione completa, pagamenti dilazionati e 24 mesi di garanzia.
Android, Apple Music cambia pelle: arriva un Liquid Glass ridotto
Apple Music sta modificando il proprio aspetto anche sui dispositivi Android.
Honor 700 Pro, la sorpresa è dietro: spunta lo schermo posteriore
Il prossimo modello potrebbe riprendere la soluzione vista sui recenti Xiaomi, trasformando il modulo fotografico in un elemento ancora più distintivo.