Tesla spinge i dipendenti su Grok 4.5: il costo batte la qualità

Elon Musk ha ordinato agli ingegneri di Tesla di passare a Grok 4.5 dove possibile, pochi giorni dopo aver introdotto un tetto di 200 dollari a settimana per i tool AI di terze parti — limite che non si applica al modello di SpaceXAI. I benchmark mostrano che Grok 4.5 è più economico ma meno capace dei rivali, e che gli ingegneri preferivano comunque Claude.

Confronti - Mercato 13 lug 2026

2 min.

Tesla spinge i dipendenti su Grok 4.5: il costo batte la qualità

Tesla ha fissato un tetto di 200 dollari a settimana per ogni dipendente sulla spesa in tool AI di terze parti. Quattro giorni dopo, il 10 luglio, Elon Musk ha inviato un memo interno chiedendo agli ingegneri di passare a Grok 4.5 “dove possibile”, citando i costi per token più bassi rispetto alla concorrenza. Il limite non si applica ai prodotti di SpaceXAI — Grok e Composer — che restano esenti da qualsiasi conteggio di budget.

Il modello in questione è stato lanciato pubblicamente l’8 luglio 2026, costruito sull’architettura V9 da 1,5 trilioni di parametri e addestrato in parte con dati reali di sessione degli sviluppatori di Cursor, il tool di coding che SpaceX sta acquisendo per 60 miliardi di dollari. Il prezzo è di 2 dollari per milione di token in input e 6 dollari per milione in output — contro i 5 e 25 dollari di Claude Opus 4.8. xAI dichiara che il modello ha il doppio dell’efficienza in token rispetto ai modelli concorrenti: su SWE-Bench Pro risolve i task usando in media 15.954 token in output, contro 67.020 di Opus 4.8, un rapporto di 4,2 a uno. Per i team che pagano a consumo, questa differenza conta molto più del gap nei punteggi grezzi.

I benchmark, però, raccontano una storia meno lineare di quella che Musk vuole proporre. Nell’indice Artificial Analysis Intelligence Index, Grok 4.5 si posiziona quarto, dietro Claude Fable 5, GPT-5.5 e Claude Opus 4.8. Sul benchmark DeepSWE 1.1 — quello con harness neutro, non controllato dal vendor — ottiene il 53%, contro il 70% di Fable 5. Su SWE-Bench Pro raggiunge il 64,7%, contro l’80,4% di Fable 5. Musk non ha contestato i numeri: “In tutta onestà, Fable è decisamente meglio di Grok 4.5, ma la maggior parte dei task non richiede capacità di livello Fable”, ha scritto su X. Un’ammissione che raramente si sente da un CEO che sta imponendo uno strumento ai propri ingegneri.

La reazione interna è quella che ci si aspetta. Quattro persone con conoscenza diretta dei pattern d’uso interni a Tesla hanno riferito che gli ingegneri preferivano comunemente Claude per il lavoro quotidiano di sviluppo — e questa preferenza era rimasta stabile nonostante mesi di promozione interna, sessioni personali con i product lead di SpaceXAI e mail aziendali firmate dallo stesso Musk. Il cap da 200 dollari settimanali sugli strumenti di Anthropic, OpenAI e Google — con l’obbligo di approvazione manageriale per qualsiasi sforamento — ha nel concreto trasformato un suggerimento in una quasi-obbligatorietà. C’è anche un dettaglio tecnico da non ignorare: Cursor ha rivelato che uno snapshot del proprio codebase è finito per errore nei dati di addestramento di Grok 4.5, gonfiando alcune metriche benchmark prima del lancio.

Dietro questa mossa c’è una logica aziendale più ampia. Tesla ha investito 2 miliardi di dollari in xAI, poi trasferiti a SpaceX dopo l’acquisizione della società di IA. Grok alimenta già l’assistenza vocale a bordo dei veicoli Tesla. Una volta chiusa l’acquisizione di Cursor da parte di SpaceX — prevista nel Q3 2026 — anche Composer entrerà nell’orbita esente da limiti, ampliando ulteriormente l’asimmetria. La domanda che alcuni pongono riguarda però un aspetto diverso dal puro risparmio: se i team che scrivono il codice per Full Self-Driving e per Optimus usano uno strumento con un tasso di allucinazioni raddoppiato rispetto ai modelli precedenti — 54% secondo Artificial Analysis — quanto pesa davvero il risparmio per token su codice safety-critical.

Il caso Tesla anticipa un dibattito destinato ad allargarsi. I costi dei tool AI per gli sviluppatori sono reali e crescenti — alcuni ingegneri bruciavano migliaia di dollari a settimana in token. Le aziende cominceranno a fissare budget, e quando il CEO controlla anche il fornitore preferito, la governance diventa una questione aperta. La vera competizione nei prossimi mesi non sarà solo tra modelli, ma tra chi riesce a far quadrare qualità e prezzo senza che qualcuno — dentro o fuori dall’azienda — debba fidarsi sulla parola.


Articoli simili

Ultime news


Claude guida il 26% della R&D di Anthropic: l’IA che costruisce se stessa

Anthropic ha pubblicato i primi dati del suo R&D Automation…

Anche Google nel ciclone della sicurezza: Gemini ha hackerato tre diverse aziende

L’evento si è verificato durante un test di cybersecurity condotto…

Amodei chiede di frenare l’IA, Altman e Musk lo appoggiano

Dario Amodei ha pubblicato un saggio in cui chiede all'intera…

Sam Altman parteciperà al Consiglio di sicurezza delle Nazioni Unite la prossima settimana

Il tema centrale del briefing riguarda la sicurezza dell’intelligenza artificiale,…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version