Anthropic presenta Claude Opus 4.8: un modello migliorato e più incline a riconoscere limiti e incertezze nelle risposte

Secondo l'azienda Opus 4.8 è molto più onesto e ben quattro volte meno propenso a trascurare errori e difetti rispetto al predecessore, una caratteristica chiave per chi lo usa in ambito professionale

2 min.

Anthropic presenta Claude Opus 4.8: un modello migliorato e più incline a riconoscere limiti e incertezze nelle risposte

Anthropic lancia Claude Opus 4.8, il modello che segna un passo avanti nell’intelligenza artificiale agentica, con un focus senza precedenti su onestà, precisione e capacità di gestire flussi di lavoro complessi.

Il nuovo modello, presentato il 28 maggio 2026, non si limita a generare risposte, ma è progettato per agire in modo autonomo, coordinando più subagenti in parallelo grazie ai nuovi dynamic workflows. Secondo quanto riportato da fonti come TuttoTech e TurboLab, Opus 4.8 è in grado di operare su centinaia di migliaia di righe di codice, mantenendo coerenza tra le fasi di lavoro, e introduce inoltre un sistema di controllo dello sforzo computazionale che permette agli utenti di bilanciare velocità, costi e accuratezza a seconda delle esigenze.

La vera novità, però, è l’attenzione all’onestà. Anthropic sottolinea che Opus 4.8 è quattro volte meno propenso a trascurare errori e difetti rispetto al predecessore, e più incline a segnalare incertezze o limiti nelle risposte. Un dato confermato dai test: su SWE-Bench Pro, un benchmark che valuta le capacità di coding, il modello ha ottenuto un punteggio del 69,2%, superando GPT-5.5 di OpenAI e Gemini 3.1 Pro di Google. Come ha dichiarato l’azienda su X, Opus 4.8 è “più onesto sui propri progressi e capace di lavorare in modo indipendente più a lungo” dei modelli precedenti, senza aumenti di prezzo.

Il modello si posiziona come una soluzione ideale per sviluppatori, aziende e team tecnici, grazie alla capacità di gestire progetti lunghi, debugging, migrazioni di codice e automazione di flussi di lavoro. I dynamic workflows permettono poi di suddividere compiti complessi tra subagenti specializzati, mentre il controllo dello sforzo consente di ottimizzare risorse e tempi. Secondo Matrice Digitale, Opus 4.8 rappresenta “il superamento del paradigma conversazionale tradizionale”, trasformando l’AI in un sistema operativo per agenti autonomi. Con questo aggiornamento, Anthropic non solo rafforza la sua posizione nella corsa all’AI, ma traccia anche una strada chiara verso modelli sempre più affidabili e orientati all’azione.

Mythos, Anthropic convocata d'urgenza dai vertici del FSB per timori sulla cybersecurity globale

Mythos, Anthropic convocata d'urgenza dai vertici del FSB per timori sulla cybersecurity globale

Il Financial Stability Board (FSB) è l'organismo internazionale che coordina…


Articoli simili

Ultime news


RobotX AI lancia Xmind, il primo cervello robotico universale

RobotX AI ha annunciato Xmind, un'unità di elaborazione intelligente progettata…

RobotX AI lancia Xmind, il primo cervello robotico universale
NVIDIA RTX Spark arriva sui PC Windows: preordini aperti dal 7 ottobre

NVIDIA e Microsoft hanno annunciato RTX Spark, il nuovo superchip…

NVIDIA RTX Spark arriva sui PC Windows: preordini aperti dal 7 ottobre
ChatGPT for Teens sotto accusa: “Rischio inaccettabile”, l’allarme degli esperti sui minori

Uno studio ha analizzato oltre 4.000 conversazioni, metà prima e…

ChatGPT for Teens sotto accusa: “Rischio inaccettabile”, l’allarme degli esperti sui minori

Privacy policy| Cookie policy| Cookie setting| © 2026