OpenAI taglia i prezzi di GPT-5.6: Luna -80%, Terra -20%

OpenAI ha abbattuto i costi di GPT-5.6 Luna dell'80% e di GPT-5.6 Terra del 20%, appena tre settimane dopo il lancio pubblico della famiglia di modelli. La mossa risponde alla crescente pressione delle imprese sui budget AI e all'intensificarsi della concorrenza con Anthropic e Google.

Economia - Mercato 11 ago 2026

2 min.

OpenAI taglia i prezzi di GPT-5.6: Luna -80%, Terra -20%

OpenAI ha ridotto il prezzo di GPT-5.6 Luna dell’80% e di GPT-5.6 Terra del 20%, a poco più di tre settimane dalla disponibilità generale della famiglia GPT-5.6. Un taglio che arriva con tempistiche precise e motivazioni concrete, legate tanto all’efficienza interna quanto alla pressione del mercato.

I nuovi listini parlano chiaro. Luna passa a 0,20 dollari per milione di token in input e 1,20 dollari per milione di token in output. Terra si attesta a 2 dollari per milione di token in input e 12 dollari per milione in output. Il modello di punta, Sol, mantiene invariato il prezzo base — 5 dollari per milione di token in input e 30 dollari in output — ma guadagna una nuova modalità Fast che offre velocità fino a 2,5 volte superiore allo standard, al doppio del costo. Non un taglio, ma un’opzione aggiuntiva per chi vuole più throughput senza cambiare modello.

La logica dietro queste cifre è spiegata nel post “Building abundant intelligence” pubblicato da Sarah Friar, CFO di OpenAI. Il ragionamento è lineare: quando il costo dell’intelligenza scende, più lavoro diventa economicamente sostenibile; quando cresce l’adozione, crescono i ricavi e i segnali di domanda che alimentano gli investimenti in ricerca e infrastruttura. Un ciclo che la stessa OpenAI descrive come il proprio motore economico. I tagli di prezzo non sono generosità, sono parte del modello di business.

Sul fronte tecnico, OpenAI attribuisce i ribassi a miglioramenti interni all’efficienza dei sistemi di inferenza. GPT-5.6 Sol ha contribuito a ottimizzare il software di produzione usato per servire i modelli, abbattendo i costi di serving end-to-end del 20%. Ha migliorato anche la speculative decoding, con un aumento dell’efficienza nella generazione di token superiore al 15%. Queste cifre spiegano perché il taglio è possibile senza comprimere i margini in modo insostenibile.

Il contesto competitivo non è secondario. I tagli arrivano a pochi giorni dalla pubblicazione di Claude Opus 5 da parte di Anthropic — al medesimo prezzo del predecessore Opus 4.8 — e dall’introduzione da parte di Google di Gemini 3.6 Flash e Gemini 3.5 Flash-Lite, entrambi costruiti attorno a costi di inferenza ridotti. La guerra dei prezzi nell’AI è in corso, e Luna si posiziona ora molto vicino ai modelli commerciali meno costosi del mercato. Le imprese, dal canto loro, erano già sotto pressione: molte avevano esaurito rapidamente i budget AI senza una visione chiara del ritorno sugli investimenti, e la sensibilità ai costi era diventata un freno reale all’adozione.

I dati sull’utilizzo di ChatGPT raccontano un’altra parte della storia. A sei mesi dall’iscrizione, gli utenti inviano circa il 50% di messaggi in più al giorno e usano il servizio per circa il doppio delle tipologie di attività rispetto all’inizio. Un passaggio che OpenAI descrive come lo spostamento da una modalità di “chiedere” a una di “fare”. Sul fronte enterprise, il lavoro agente tramite Codex rappresenta già il 99,8% dei token di output settimanali generati internamente. Sono numeri che giustificano la scelta di abbassare il prezzo dei modelli più leggeri: la domanda c’è, il volume scala, e abbassare la soglia di accesso conviene.

Se il ciclo che OpenAI descrive funziona davvero, i prossimi mesi potrebbero portare ulteriori riduzioni sui modelli mid-tier, mentre Sol resterà il riferimento per i carichi di lavoro ad alta intensità cognitiva. Il mercato dei modelli di frontiera si sta comportando sempre più come quello dei chip: prezzi in calo strutturale, competizione sulla densità di prestazioni per dollaro speso. Chi oggi paga 0,20 dollari per milione di token con Luna difficilmente tornerà indietro.


Articoli simili

Ultime news


Claude unifica la memoria tra Chat e Cowork: niente più spiegazioni ripetute

Anthropic ha fuso i sistemi di memoria di Claude Chat…

Nvidia Q2 2026: Wall Street attende i conti, attese a 91-95 miliardi

Nvidia presenta oggi i risultati del secondo trimestre fiscale 2027:…

OpenAI, zero data retention per i modelli frontier: addio ai dati degli enterprise

OpenAI ha annunciato lo Zero Data Retention per i clienti…

OpenAI subissata da indagini: l’Alabama la cita in giudizio per il caso Hugging Face

Il procuratore generale dell'Alabama ha emesso un'ingiunzione formale contro OpenAI…

DENTRO L’ALGORITMO – AI e caccia alle streghe

Perché l'ossessione per la certificazione dell'utilizzo di AI sta sfuggendo…

In Evidenza


New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version