OpenAI presenta il suo primo chip acceleratore AI sviluppato in collaborazione con Broadcom

Si chiama Jalapeño ed è progettato per la fase di inferenza e per far girare i modelli in modo rapido ed efficiente quando rispondono alle domande degli utenti su ChatGPT

3 min.

OpenAI presenta il suo primo chip acceleratore AI sviluppato in collaborazione con Broadcom

OpenAI e Broadcom hanno svelato Jalapeño, il primo Intelligence Processor progettato da OpenAI. Un acceleratore costruito attorno alla visione dell’azienda per il futuro dell’inferenza sui grandi modelli linguistici. Non si tratta di un chip generico adattato da architetture precedenti, ma di un processore pensato dal primo all’ultimo transistor per fare una sola cosa: far girare i modelli in modo rapido ed efficiente quando rispondono alle domande degli utenti su ChatGPT.

Non serve ad addestrare i modelli, ma a farli funzionare in quella fase, detta inferenza, che ogni giorno si ripete miliardi di volte ogni volta che qualcuno interroga un sistema AI. Il chip è un ASIC, ovvero un circuito integrato progettato per uno scopo specifico essendo meno flessibile delle GPU di Nvidia, ma anche meno costoso e ottimizzabile per compiti precisi. Il suo sviluppo, dalla progettazione iniziale alla produzione, ha richiesto soli nove mesi, un ciclo che Broadcom definisce tra i più rapidi mai raggiunti per un chip ad alte prestazioni di questa complessità, reso possibile anche dall’uso dei modelli AI di OpenAI stessa per accelerare alcune fasi progettuali.

Sul piano tecnico, i primi campioni di Jalapeño stanno già eseguendo carichi di lavoro reali nei laboratori dell’azienda, incluso il modello GPT-5.3-Codex-Spark, alla frequenza e ai consumi target di produzione. I test preliminari indicano prestazioni per watt significativamente superiori agli standard attuali, anche se un rapporto tecnico indipendente arriverà nei prossimi mesi. Hock Tan, CEO di Broadcom, ha dichiarato in un’intervista a Reuters che le prestazioni di Jalapeño sono comparabili a quelle dei chip Blackwell di Nvidia e delle unità di elaborazione Tensor di Google. Richard Ho, responsabile del programma hardware di OpenAI, ha spiegato che il chip è stato ottimizzato attorno ai kernel, al movimento dei dati in memoria, al networking e ai pattern di esecuzione che contano di più per i modelli AI di frontiera. Il dispiegamento su scala è previsto entro la fine del 2026, con un’espansione pluriennale fino al 2029 in collaborazione con Microsoft.

La vera portata dell’annuncio va però letta su un piano strategico più ampio. Dal lancio di ChatGPT nel 2022, OpenAI è stata uno dei maggiori acquirenti di GPU Nvidia, ma ora, con una IPO attesa che potrebbe valutare l’azienda oltre mille miliardi di dollari, la pressione a dimostrare un percorso verso la redditività è altissima e Jalapeño potrebbe essere la risposta a questo nodo cruciale. Se l’azienda riesce ad abbassare i costi dell’inferenza, può recuperare parte delle perdite accumulate nei cicli di addestramento. OpenAI non è la prima a muoversi in questa direzione, Google ha le TPU, Amazon ha Trainium, Meta lavora da tempo su acceleratori custom, ma è arrivata a un momento in cui controllare il silicio significa controllare le prestazioni, i costi e i tempi di sviluppo. Come ha sintetizzato Greg Brockman, presidente di OpenAI: “Progettando più elementi dello stack da soli, possiamo erogare più intelligenza con maggiore efficienza e continuare a spingere l’AI avanzata verso un accesso più ampio.

Nel primo trimestre del 2026 OpenAI ha bruciato 3,7 miliardi di dollari

A pesare sulle casse dell'azienda sono soprattutto i costi computazionali…


Articoli simili

Ultime news


DeepMind, un ricercatore si dimette: “Non potevo restare in buona coscienza”

Alex Turner, ricercatore di AI safety a Google DeepMind, ha…

DeepMind, un ricercatore si dimette: “Non potevo restare in buona coscienza”
Kimi K3 e WAICO: il 16 luglio 2026 è una data cinese

Il 16 luglio 2026 la Cina ha lanciato Kimi K3,…

Kimi K3 e WAICO: il 16 luglio 2026 è una data cinese
New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

New York contro i data center (e altre notizie generative) | Weekly AI
Google DeepMind lancia un programma di bioresilienza con l’IA

Google DeepMind e Isomorphic Labs hanno pubblicato un piano congiunto…

Google DeepMind lancia un programma di bioresilienza con l’IA
Claude Code e il ROI dell’AI: Cherny sfida il mito del token burn

Boris Cherny, il creatore di Claude Code, ha pubblicato un…

Claude Code e il ROI dell’AI: Cherny sfida il mito del token burn

In Evidenza


Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo
Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News
AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

AI, bolla o non bolla? Il parere degli esperti non è unanime
Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

Privacy policy| Cookie policy| Cookie setting| © 2026