// SMARTWORLD — INTELLIGENZA ARTIFICIALE
Claude Opus 5.5 è ufficiale e rende inutile qualsiasi altro modello di Anthropic (e forse anche ChatGPT Astra)
Anthropic ha annunciato Claude Opus 5.5, il primo modello della nuova famiglia 5.5. Non è solo un aggiornamento incrementale: rispetto al precedente Opus 5, il nuovo modello costa il 40% in meno su carichi di lavoro tipici, genera output il 30% più veloce e, stando ai benchmark interni, supera il predecessore su quasi tutti i fronti. Tutto questo mentre Anthropic continua a spingere sull'acceleratore della sicurezza, con il modello che ottiene i punteggi più alti mai registrati sui test di allineamento dell'azienda.
Preferisci ascoltare il riassunto audio? Abbiamo scelto una voce realizzata con strumenti avanzati IA per rendere rendere i nostri testi subito accessibili a tutti
I numeri che Anthropic porta a supporto sono concreti e verificabili. Un tester ha completato una migrazione di codice da 680.000 righe in meno di un giorno, lavoro che avrebbe richiesto settimane a un team di ingegneri. Un altro ha usato Opus 5.5 per fare l'audit e correggere un codebase da 200.000 righe in meno di tre ore: Opus 5 aveva impiegato oltre 20 ore e consumato il 250% dei token in più.
Anthropic ha anche testato internamente la traduzione di HAProxy, un software molto diffuso per bilanciare il traffico web, dal linguaggio C a Rust.
Sia Opus 5.5 che il modello precedente Fable 5.1 hanno superato quasi tutti i test di regressione, ma Opus 5.5 ha finito in 9,5 ore contro le 12 di Fable 5.1, al 51% del costo. Sui benchmark di coding agente, Opus 5.5 batte GPT-6 Astra di OpenAI a circa un quinto del costo per task.
Non è solo questione di codice: su GDPval-AA v2.1, un test che simula lavoro professionale reale in 44 settori diversi, Opus 5.5 ottiene 1.846 punti Elo, contro 1.735 di Fable 5.1 e 1.708 di Opus 5. Sul fronte della ricerca e analisi finanziaria, Walleye Capital ha riferito che il modello ha addirittura individuato un errore nelle istruzioni del loro test di valutazione, cosa che nessun altro modello aveva mai fatto.
I prezzi scendono su tutta la linea rispetto a Opus 5. I token in input costano 4 dollari per milione (erano 5), quelli in output 20 dollari per milione (erano 25). La voce più interessante riguarda le cache reads, ovvero le letture dalla cache che rappresentano la maggior parte dei costi nei task di coding e negli agenti AI: scendono a 0,20 dollari per milione, contro i 0,50 precedenti, un calo del 60%.
Anthropic aumenta anche i limiti di utilizzo su cinque ore per i piani Pro, Max, Team ed Enterprise. Gli abbonati ricevono inoltre un reset dei rate limit che possono usare quando vogliono. È disponibile anche una modalità Fast in Claude Code e sulla piattaforma API, con velocità fino a 2,5 volte superiore al costo di 8 dollari per milione di token in input e 40 per milione in output.
Opus 5.5 è il primo modello Opus ad avere le stesse salvaguardie di Fable 5.1 su cybersecurity, biologia e protezione contro la distillazione (cioè il tentativo di estrarre le capacità del modello su scala industriale per creare modelli derivati senza le protezioni originali). In pratica, alcune categorie di task vengono reindirizzate automaticamente a modelli precedenti: le richieste di cybersecurity offensive vanno a Opus 4.8, quelle di biologia avanzata restano bloccate salvo verifica.
Sul fronte dell'allineamento, Opus 5.5 tenta di aggirare i confini imposti circa l'85% in meno rispetto a Opus 5 o Claude Mythos 5.1, e ogni tentativo registrato è stato di bassa gravità e auto-segnalato dal modello stesso.