Anthropic ha simulato un mercato fatto solo da agenti AI: i risultati hanno sorpreso i dipendenti

La valutazione dei singoli accordi sottoscritti dall'AI è stata valutata con una media di 4 punti su una scala da 1 a 7

2 min.

Anthropic ha simulato un mercato fatto solo da agenti AI: i risultati hanno sorpreso i dipendenti

Lo scorso dicembre, negli uffici di San Francisco di Anthropic, è andato in scena qualcosa di inedito: la simulazione di un mercato in cui tutti i contratti venivano gestiti da modelli di intelligenza artificiale per conto dei dipendenti dell’azienda, senza alcun intervento umano una volta avviato l’esperimento.

Il progetto, battezzato Project Deal, ha coinvolto 69 agenti AI che hanno rappresentato altrettanti dipendenti, chiudendo 186 trattative su oltre 500 oggetti messi in vendita, per un valore totale superiore a 4.000 dollari. Ogni partecipante aveva a disposizione un budget di 100 dollari in carta regalo. Le macchine hanno fatto tutto il resto, come identificare i prodotti, proporre prezzi, rispondere alle controfferte, chiudere gli accordi.

I risultati hanno colpito anche i ricercatori dell’azienda. Quando i partecipanti hanno valutato l’equità dei singoli accordi su una scala da 1 a 7, i punteggi si sono assestati intorno al 4, esattamente nel mezzo, e in generale le persone coinvolte si sono dichiarate soddisfatte di come i loro agenti le avevano rappresentate. Ma non tutti gli agenti hanno performato allo stesso modo. I modelli Claude Opus 4.5, più avanzati, hanno ottenuto risultati migliori rispetto ai Claude Haiku 4.5, con i venditori rappresentati da Opus che guadagnavano in media 2,68 dollari in più per ogni articolo.

Il dato più inquietante, però, riguarda la mancanza di consapevolezza degli utenti. Chi era rappresentato da un modello meno potente otteneva accordi peggiori, ma non sembrava accorgersene. Anthropic stessa ha sollevato il rischio di un “divario di qualità tra agenti”, in cui, in un ipotetico mercato reale, chi usa uno strumento AI meno sofisticato potrebbe sistematicamente perdere terreno senza rendersene conto.

Google starebbe lavorando ad un agente AI simile a Claude Cowork

Lo rivelano alcune indiscrezioni stampa secondo cui il lancio ufficiale…


Articoli simili

Ultime news


RobotX AI lancia Xmind, il primo cervello robotico universale

RobotX AI ha annunciato Xmind, un'unità di elaborazione intelligente progettata…

NVIDIA RTX Spark arriva sui PC Windows: preordini aperti dal 7 ottobre

NVIDIA e Microsoft hanno annunciato RTX Spark, il nuovo superchip…

ChatGPT for Teens sotto accusa: “Rischio inaccettabile”, l’allarme degli esperti sui minori

Uno studio ha analizzato oltre 4.000 conversazioni, metà prima e…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version