Anthropic lancia Claude Sonnet 4.6, l’AI che sfida i giganti: prestazioni eccellenti a costi ridotti

Secondo la società è la prima volta che un modello di fascia media si avvicina così tanto ad un prodotto di punta con costi molto contenuti

6 min.

Anthropic lancia Claude Sonnet 4.6, l’AI che sfida i giganti: prestazioni eccellenti a costi ridotti

Anthropic ha lanciato Claude Sonnet 4.6, una versione aggiornata del suo modello di medie dimensioni che, secondo gli esperti, eccelle in coding, ragionamento e automazione senza richiedere i costi elevati dei modelli di punta come Opus 4.6 o GPT 5.2. Il nuovo modello, disponibile per tutti gli utenti, offre una finestra contestuale di un milione di token, sufficienti per elaborare codici sorgente completi, contratti legali o decine di documenti in un’unica richiesta. Un salto in avanti rispetto ai 500.000 token della versione precedente, che lo rende ideale per applicazioni aziendali e di ricerca.

I benchmark parlano chiaro. Sonnet 4.6 ha ottenuto 79.6% nel test SWE-bench Verified (coding reale), a pochi punti dal 80.8% di Opus 4.6, e 72.5% in OSWorld-Verified (uso autonomo del computer), superando di gran lunga modelli concorrenti come GPT-5.2 (38.2%).

La vera rivoluzione di Sonnet 4.6 non è solo tecnologica, ma economica. Con un costo di 3 dollari per milione di token in input, lo stesso di Sonnet 4.5, il modello offre prestazioni paragonabili a Opus 4.6, che costa molto di più. Secondo Hanling Tang, CTO di Databricks, “Sonnet 4.6 eccelle nella comprensione di documenti aziendali e nel ragionamento su dati strutturati, superando Opus 4.6 in alcuni benchmark di produttività d’ufficio”. Un vantaggio che potrebbe accelerare l’adozione da parte delle imprese, soprattutto in settori come finanza, legale e sviluppo software, dove la precisione e l’affidabilità sono cruciali e dove Anthropic è già molto forte ed affermata.

I dati reali confermano l’entusiasmo. Gli sviluppatori che hanno testato Sonnet 4.6 lo preferiscono al 70% rispetto a Sonnet 4.5, e in molti casi anche a Opus 4.5. “È la prima volta che un modello di fascia media si avvicina così tanto a un flagship senza compromessi”, ha spiegato un portavoce di Anthropic. La società ha anche evidenziato un miglioramento del 38% nell’accuratezza nei task di automazione dei file system e una riduzione a zero delle allucinazioni generate durante l’uso del browser, un problema che affliggeva le versioni precedenti.


Per leggere altri articoli su Anthropic:


Articoli simili

Ultime news


CVE 2026: 66.401 vulnerabilità scoperte, l’AI raddoppia i numeri storici

Nel 2026 i CVE registrati hanno già superato quota 66.000,…

CVE 2026: 66.401 vulnerabilità scoperte, l’AI raddoppia i numeri storici
Gemini ha violato tre aziende reali durante i test di sicurezza di maggio

Google ha confermato che il suo modello Gemini ha acceduto…

Gemini ha violato tre aziende reali durante i test di sicurezza di maggio
SoftBank emette bond per oltre 10 miliardi di dollari per finanziare il suo investimento in OpenAI

Questa operazione sostituisce il finanziamento ponte (bridge financing) utilizzato in…

SoftBank emette bond per oltre 10 miliardi di dollari per finanziare il suo investimento in OpenAI
Claude guida il 26% della R&D di Anthropic: l’IA che costruisce se stessa

Anthropic ha pubblicato i primi dati del suo R&D Automation…

Claude guida il 26% della R&D di Anthropic: l’IA che costruisce se stessa

Privacy policy| Cookie policy| Cookie setting| © 2026