GPT-5.5 Instant è il nuovo modello predefinito di ChatGPT, disponibile dal 5 maggio 2026 per tutti gli utenti. Nelle valutazioni interne, il modello produce il 52,5% in meno di affermazioni inventate rispetto a GPT-5.3 Instant sui prompt ad alto rischio che riguardano medicina, legge e finanza. Ha anche ridotto del 37,3% le affermazioni imprecise nelle conversazioni che gli utenti avevano segnalato per errori di fatto. Non sono numeri di poco conto: chiunque abbia mai ricevuto da ChatGPT una risposta medica sbagliata o un riferimento normativo inesistente capisce bene perché questo dato conti.
GPT-5.5 Instant sostituisce GPT-5.3 Instant per tutti gli utenti, ma gli abbonati paganti potranno continuare a usare la versione precedente per altri tre mesi. Il nuovo modello usa il 30,2% di parole in meno e il 29,2% di righe in meno rispetto al predecessore. L’obiettivo dichiarato è eliminare le risposte gonfiate, le formattazioni eccessive e – dettaglio che ha fatto notizia – le emoji superflue che rendevano le risposte disordinate. Chi usa ChatGPT ogni giorno lo sa: il modello aveva preso la brutta abitudine di disseminare cuoricini e stelle ovunque, anche in contesti del tutto inappropriati. GPT-5.5 Instant è complessivamente più capace nelle attività quotidiane, con miglioramenti nell’analisi di foto e immagini caricate, nelle risposte a domande STEM e nella decisione su quando usare la ricerca web per fornire una risposta più utile.
Sul fronte delle prestazioni misurabili, i progressi sono visibili su più fronti. Sul benchmark CharXiv per il ragionamento su grafici scientifici, GPT-5.5 Instant ottiene l’81,6%, contro il 75,0% di GPT-5.3 Instant. Su MMMU-Pro, un benchmark di ragionamento multimodale sviluppato da ricercatori accademici, raggiunge il 76,0% contro il 69,2% del modello precedente. Nella valutazione HealthBench, pensata per testare le risposte dei modelli alle domande mediche, GPT-5.5 Instant ha ottenuto 51,4 punti su 100. Su HealthBench Professional, la versione per uso clinico, il punteggio è salito da 32,9 a 38,4 punti. Numeri assoluti ancora lontani dalla perfezione, ma la direzione è quella giusta.
L’altra novità di rilievo riguarda la memoria e la personalizzazione. Il modello è ora più efficace nell’usare il contesto delle conversazioni passate, dei file caricati e di Gmail, se connesso, così le risposte risultano più pertinenti per l’utente specifico. Il sistema decide autonomamente quando una risposta può migliorare con una personalizzazione aggiuntiva ed è più rapido nel cercare le conversazioni precedenti per trovare il contesto giusto. OpenAI sta anche introducendo le “fonti di memoria” per tutti i modelli ChatGPT, che danno visibilità sul contesto usato per personalizzare le risposte – come ricordi salvati o chat precedenti – con controlli per eliminare o correggere le informazioni obsolete. Chi non vuole un assistente con memoria persistente può comunque optare per le chat temporanee. La questione dei dati personali resta aperta: collegare il chatbot a servizi di terze parti significa mettere a rischio più informazioni personali o di lavoro.
La System Card pubblicata da OpenAI introduce un elemento nuovo sul piano della sicurezza. Questo è il primo modello Instant classificato ad alta capacità nelle categorie Cybersecurity e Preparedness Biologica e Chimica, con le salvaguardie corrispondenti attivate. Con GPT-5.5, OpenAI sta distribuendo classificatori più severi per il rischio informatico, che alcuni utenti potrebbero trovare inizialmente restrittivi, mentre vengono progressivamente calibrati nel tempo. Significa che un modello veloce e di uso quotidiano ha ora le stesse tutele finora riservate ai modelli più potenti. La scelta ha un senso: l’aggiornamento riguarda il modello ad altissimo volume di utilizzo, quello usato da centinaia di milioni di persone per risposte rapide, scrittura, analisi, supporto alla programmazione e comprensione delle immagini. Quando uno strumento è così diffuso, anche i rischi di abuso scalano di conseguenza. Il passo successivo di OpenAI sarà probabilmente quello di calibrare questi filtri senza penalizzare gli usi legittimi, una sfida che, a giudicare dalla velocità dei rilasci degli ultimi mesi, la società intende affrontare in tempo reale.
