Lo scorso dicembre, negli uffici di San Francisco di Anthropic, è andato in scena qualcosa di inedito: la simulazione di un mercato in cui tutti i contratti venivano gestiti da modelli di intelligenza artificiale per conto dei dipendenti dell’azienda, senza alcun intervento umano una volta avviato l’esperimento.
Il progetto, battezzato Project Deal, ha coinvolto 69 agenti AI che hanno rappresentato altrettanti dipendenti, chiudendo 186 trattative su oltre 500 oggetti messi in vendita, per un valore totale superiore a 4.000 dollari. Ogni partecipante aveva a disposizione un budget di 100 dollari in carta regalo. Le macchine hanno fatto tutto il resto, come identificare i prodotti, proporre prezzi, rispondere alle controfferte, chiudere gli accordi.
I risultati hanno colpito anche i ricercatori dell’azienda. Quando i partecipanti hanno valutato l’equità dei singoli accordi su una scala da 1 a 7, i punteggi si sono assestati intorno al 4, esattamente nel mezzo, e in generale le persone coinvolte si sono dichiarate soddisfatte di come i loro agenti le avevano rappresentate. Ma non tutti gli agenti hanno performato allo stesso modo. I modelli Claude Opus 4.5, più avanzati, hanno ottenuto risultati migliori rispetto ai Claude Haiku 4.5, con i venditori rappresentati da Opus che guadagnavano in media 2,68 dollari in più per ogni articolo.
Il dato più inquietante, però, riguarda la mancanza di consapevolezza degli utenti. Chi era rappresentato da un modello meno potente otteneva accordi peggiori, ma non sembrava accorgersene. Anthropic stessa ha sollevato il rischio di un “divario di qualità tra agenti”, in cui, in un ipotetico mercato reale, chi usa uno strumento AI meno sofisticato potrebbe sistematicamente perdere terreno senza rendersene conto.

Google starebbe lavorando ad un agente AI simile a Claude Cowork
Lo rivelano alcune indiscrezioni stampa secondo cui il lancio ufficiale…













