Dieci giorni dopo l’appello di Dario Amodei a rallentare la IA, Anthropic lancia Opus 5.5, più economico e veloce. Una breve prova per capire che più i modelli sono capaci ed efficienti e maggiore è la possibilità di ritenerli affidabili senza verifiche ulteriori. E lì nasce il vero problema, anche in presenza di modelli molto evoluti.
Più un modello di intelligenza artificiale diventa capace, più ci viene naturale fidarci di quello che ci dice. È quello che ho sperimentato mettendo alla prova Claude Opus 5.5, il nuovo modello di Anthropic: capace, ma da verificare sempre. Ed è proprio questa fiducia, spesso concessa senza alcuna verifica, il punto più delicato del momento che stiamo vivendo con la IA.
Anthropic ha lanciato ieri, 22 settembre 2026, il nuovo Claude Opus 5.5, presentandolo come un modello al livello di Fable 5.1 sulla maggior parte dei lavori e con un costo inferiore del 40% rispetto a Opus 5. Un lancio che arriva appena dieci giorni dopo che Dario Amodei, CEO di Anthropic, aveva chiesto all’intera industria di rallentare.
Amodei e l’appello a rallentare la frontiera
Sabato 12 settembre Amodei ha pubblicato sul suo sito un saggio dal titolo «We Must Pace the Frontier». La tesi è netta: bisogna rallentare il ritmo con cui migliorano le capacità dei modelli di IA, così che le pratiche di sicurezza possano restare un passo avanti. Lo stesso Amodei precisa, però, che i progressi continueranno comunque a sembrare rapidi.
Il piano di Amodei prevede tre passaggi: valutatori esterni inseriti nelle aziende, con un accesso paragonabile a quello dei dipendenti, che Anthropic si impegna ad applicare da subito; standard di sicurezza comuni e limiti alle capacità, concordati tra le aziende dei Paesi democratici; un coordinamento globale che coinvolga anche i regimi autoritari.
Secondo quanto riportato da Axios, Sam Altman, CEO di OpenAI, si è detto d’accordo, mentre Elon Musk ha commentato che Amodei ha ragione. Non sono mancate le critiche. Su TechPolicy.Press, Dave Karpf ha osservato che tutte le proposte finiscono per avvantaggiare Anthropic, e che un’autoregolamentazione senza l’intervento dei governi rischia di essere catturata dall’industria stessa.

Opus 5.5 e la distanza tra le parole e i lanci
Ed è qui che il lancio di Opus 5.5 assume un significato particolare, proprio in questo momento. La stessa Anthropic, nella pagina di presentazione, lo definisce la sua prima uscita da quando ha chiesto di rallentare lo sviluppo della IA, la “frontiera”.
Secondo MacRumors, il modello genera le risposte oltre il 30% più velocemente di Opus 5. Anthropic, dal canto suo, scrive inoltre che in biologia e sicurezza informatica è paragonabile a Claude Mythos 5.1, tanto da distribuirlo con protezioni simili a quelle di Fable 5.1. Prima del rilascio, precisa l’azienda, è stato testato da valutatori esterni, tra cui METR.
Va detto che, in teoria, il lancio non contraddice l’appello di rallentare la IA. Opus 5.5 non supera il livello di un modello già esistente, e Anthropic lo presenta come coerente con la propria linea.
In pratica, però, rende capacità di frontiera più economiche, più veloci e accessibili a molte più persone. Quindi, una cosa è rallentare il livello massimo che la IA può raggiungere, un’altra è rallentarne la diffusione.
Il tutto dentro una competizione che non concede pause, perché lo stesso giorno anche OpenAI ha lanciato i suoi nuovi modelli.
Nei raffronti pubblicati da Anthropic, Opus 5.5 sembra prevalere, ma si tratta di dati diffusi dall’azienda stessa, che ammette come a questi livelli i margini nei benchmark siano una guida meno affidabile delle differenze reali.
Potrebbe un’industria che corre a questo ritmo, con gli stessi protagonisti che dieci giorni prima invocavano prudenza, rallentare davvero?
La prova con Opus 5.5 e i risultati non aggiornati
Quando ci si trova di fronte a modelli così evoluti, si cerca di capire come possano essere utili per le nostre attività e per l’uso quotidiano. Opus 5.5 viene presentato come un modello con capacità agentiche, in grado di effettuare azioni in autonomia, su richiesta, per lasciare all’utente il tempo di dedicarsi ad attività di maggior valore. Almeno questa sarebbe l’intenzione.
Allora ho fatto una prima, ma banale, prova per capire se davvero siamo di fronte a qualcosa di evoluto. Dico subito di sì, ma con un livello di attenzione che deve essere maggiore, proporzionato alla capacità di questi modelli. Opus 5.5 ha il ragionamento sempre attivo, e non c’è bisogno di chiedergli di prestare maggiore attenzione per svolgere un’azione specifica. Allo stesso modo è capace di fare in autonomia un percorso di riflessione e di analisi su quanto già cercato.
La prova era andare alla ricerca di un prodotto specifico, con caratteristiche ben definite. Vederlo lavorare in autonomia fa sempre il suo effetto, ma i risultati non sono stati poi così precisi. Avendo una buona conoscenza del prodotto richiesto e delle sue varianti, mi aspettavo una ricerca più approfondita e aggiornata. I risultati erano tutti in linea con quanto richiesto, ma in buona sostanza vecchi e già superati da modelli più recenti.
L’errore di non cercare nel modo giusto
Quando gliel’ho fatto notare, Opus 5.5 ha spiegato che il suo addestramento arriva a giugno 2026 e che su un prodotto uscito poche settimane prima di quella data aveva visto pochissimo materiale. Ma il punto più grave è un altro.
Pur avendo a disposizione la ricerca web, che gli permette di trovare notizie anche di ieri, l’ha usata male: ricerche troppo generiche, classifiche online non aggiornate prese per buone, nessuna verifica sull’esistenza di modelli più recenti. L’informazione era lì, ma non è stata cercata nel modo giusto.
E non è finita qui.
Parlando proprio del modello più adatto, mi ha presentato un servizio in abbonamento come se bloccasse alcune funzionalità, quando in realtà offre solo contenuti aggiuntivi. Una piccola imprecisione che mi avrebbe portato a scartare il prodotto giusto.
In sostanza, se mi fossi totalmente affidato a Opus 5.5 senza avere una conoscenza minima del prodotto, oggi avrei scartato proprio quello più in linea con le mie esigenze. E mi sarei fidato solo perché «me lo ha detto la IA», quindi dev’essere corretto. Il risultato, per quanto innovativo nella modalità, non era soddisfacente.
Il paradosso della fiducia nei modelli più capaci
Allora ho pensato a tutte le volte che si fanno ricerche su temi svariati senza avere la minima conoscenza della materia, e si finisce per prendere per buona qualsiasi cosa arrivi dalla IA, a maggior ragione da un modello nuovo ed evoluto come Opus 5.5. Si finisce per credere a qualcosa che in realtà non corrisponde a determinate esigenze e, nella peggiore delle ipotesi, per prendere per buona una cosa che non trova riscontri.
Ergo, si finisce per diffondere informazioni errate o distorte come se fossero vere, in maniera del tutto inconsapevole. Si finisce per diffondere notizie false senza saperlo.
E ancora, si finisce per costruirsi una conoscenza errata delle cose solo per essersi affidati alla IA.
Rallentare la frontiera della IA, forse, servirebbe anche a questo: dare a chi usa questi strumenti il tempo di imparare a verificarli.
C’è un paradosso in tutto questo: più questi modelli diventano capaci, più le loro risposte suonano convincenti, e meno sentiamo il bisogno di verificarle. Ma è proprio lì che serve più attenzione, non meno.


Lascia un commento
Devi essere connesso per inviare un commento.