Anthropic ha rilasciato Claude Sonnet 5.5 il 28 settembre 2026, sei giorni dopo il debutto di Claude Opus 5.5. Il modello gira oltre il 30% più veloce rispetto a Sonnet 5 e riduce il costo effettivo per task fino al 30%, mantenendo invariato il prezzo di listino: 2 dollari per milione di token in input e 10 dollari per milione di token in output.
I numeri sui benchmark sono netti. Su Terminal-Bench 4.0, il test di riferimento per il coding agentivo da riga di comando, Sonnet 5.5 segna il 70,6% contro il 10,3% di Sonnet 5. Un salto che porta il modello addirittura sopra Opus 5.5, fermo al 66,4% sulla stessa prova. Sul fronte del lavoro professionale, Sonnet 5.5 raggiunge 1.844 Elo su GDPval-AA v2.1, appena due punti sotto Opus 5.5 e circa 360 punti sopra GPT-6 Sol secondo i dati di Anthropic. Su Chartography, test di riconoscimento visivo di grafici, il modello passa dal 15,6% di Sonnet 5 al 61,6%. Anthropic segnala anche che Sonnet 5.5 è il primo modello della serie Sonnet a completare il gioco Pokémon Red lavorando esclusivamente da screenshot.
Il risparmio economico non deriva da un taglio di prezzo, ma da un’efficienza maggiore nell’uso dei token. Balyasny Asset Management ha misurato circa 121.000 token per risposta con Sonnet 5.5, contro 497.000 con Sonnet 5. Base44 ha registrato 3,6 iterazioni per build di applicazione, dove Opus 5 ne richiedeva 7,7. Zendesk ha elaborato i ticket il 20% più rapidamente. Sono dati riportati da Anthropic, non ancora verificati da test indipendenti, ma indicano una direzione coerente.
Il posizionamento è preciso: Sonnet 5.5 è pensato per task ben definiti, bug fix, documenti, slide e fogli di calcolo. Opus 5.5 rimane il riferimento per lavori complessi e aperti che richiedono ragionamento prolungato. Questo spiega il vantaggio sul coding agentivo: Sonnet 5.5 riesce a generare più agenti in parallelo senza far esplodere i costi, mentre modelli più capaci e costosi si fermano prima per vincoli di budget. Il contesto massimo supportato è di 1 milione di token. Il modello è accessibile via API con l’ID claude-sonnet-5-5 ed è disponibile su AWS Bedrock, Google Cloud e Azure.
Sul fronte della sicurezza, Anthropic ha introdotto per la prima volta su un modello Sonnet le stesse protezioni cyber applicate ai modelli Opus e Fable. Le richieste ad alto rischio in ambito cybersecurity vengono reindirizzate a Sonnet 5. Il modello include anche nuovi classificatori contro gli attacchi di distillazione. Con Haiku 5.5 atteso nelle prossime settimane, la famiglia 5.5 si avvierà a essere completa: una struttura a tre livelli dove velocità, costo e capacità si distribuiscono in modo più granulare di quanto non accadesse con la generazione precedente. Per gli sviluppatori che oggi lavorano con Sonnet 5, la migrazione implica cinque modifiche alle chiamate API, documentate da Anthropic nella guida di rilascio del 28 settembre.