AWS e NVIDIA: 2 milioni di GPU in più per l’AI del futuro

AWS e NVIDIA hanno annunciato il dispiegamento di 2 milioni di GPU aggiuntive entro il 2028, triplicando gli impegni presi solo pochi mesi fa. L'accordo va oltre i chip: include CPU Vera, nuova memoria ad alta larghezza di banda e infrastrutture AI per il governo americano.

2 min.

AWS e NVIDIA: 2 milioni di GPU in più per l’AI del futuro

AWS e NVIDIA hanno annunciato il 26 agosto 2026 il dispiegamento di 2 milioni di GPU aggiuntive sull’infrastruttura globale di Amazon Web Services entro il 2028. La domanda ha già bruciato le aspettative: al GTC 2026 di NVIDIA, AWS si era impegnata ad aggiungere oltre un milione di GPU a partire da quest’anno. Non è bastato. I due gruppi hanno quindi più che raddoppiato l’ordine, estendendo la visibilità sulle forniture fino al 2027 e al 2028.

Le GPU in arrivo appartengono alle famiglie Blackwell Ultra, Rubin e Rubin Ultra, le architetture di punta di NVIDIA per i carichi di lavoro AI più pesanti. Ma l’accordo non si esaurisce nel conteggio dei chip. AWS integrerà anche le CPU Vera di NVIDIA, progettate per i workload di AI agente che richiedono potenza di calcolo generale accanto all’accelerazione GPU. La CFO di NVIDIA, Colette Kress, ha precisato che le Vera arriveranno in due configurazioni: alcune integrate con i chip Rubin, altre come unità standalone. Lo stesso CEO Jensen Huang aveva descritto le Vera come l’apertura di un mercato potenzialmente da 200 miliardi di dollari per l’azienda.

Sul fronte della memoria e del networking, AWS estenderà l’uso di NVIDIA NVLink Fusion alla nuova tecnologia di memoria ad alta larghezza di banda proprietaria di NVIDIA, chiamata NVHBM. Il risultato è un’architettura ibrida: GPU NVIDIA per chi richiede la piattaforma NVIDIA, chip Trainium per l’accelerazione ottimizzata AWS, Graviton per le sezioni CPU-intensive, Nitro per l’isolamento dell’infrastruttura, NVLink Fusion per la connettività interna e EFA per il networking su scala. La scelta di puntare su 2 milioni di GPU NVIDIA in più non segnala quindi un arretramento sui chip proprietari di Amazon: i due approcci coesistono nello stesso stack.

Parte del piano riguarda direttamente il governo americano. Le due aziende costruiranno AI factory dedicate al settore pubblico, con 100.000 GPU su infrastruttura AWS sicura per carichi di lavoro federali e di sicurezza nazionale. La piattaforma NVIDIA verrà integrata con il sistema AWS Nitro e con l’Elastic Fabric Adapter per garantire affidabilità e sicurezza. L’espansione tocca anche la robotica: la partnership si estende ai robot nei magazzini di Amazon e alle offerte enterprise, includendo il supporto alla piattaforma fisica AI di NVIDIA con Jetson e Omniverse.

La velocità con cui la domanda ha superato ogni previsione dice qualcosa di concreto sullo stato del mercato. Hyperscaler, laboratori AI e governi stanno aumentando i budget per training, inferenza e AI agente in modo più rapido di quanto i fornitori riuscissero ad anticipare anche solo sei mesi fa. Per NVIDIA, avere AWS come ancora di visibilità pluriennale sulle forniture riduce l’incertezza allocativa in un settore dove la competizione per i chip è serrata. Per AWS, bloccare 2 milioni di GPU di generazioni successive significa garantirsi capacità in un momento in cui chi resta indietro nelle infrastrutture rischia di perdere clienti verso Microsoft Azure e Google Cloud. Il fatto che Vera arrivi anche su Oracle e SpaceXAI, secondo le stesse parole di Kress, suggerisce che NVIDIA stia costruendo attorno alla sua CPU una base di adozione ampia quanto quella delle sue GPU.


Articoli simili

Ultime news


Google lancia Gemini 3.5 Transcribe: addio a “ehm” e pause

Google ha presentato Gemini 3.5 Transcribe, il suo nuovo modello…

AWS e NVIDIA: 2 milioni di GPU in più per l’AI agentiva e fisica

AWS e NVIDIA hanno annunciato il dispiegamento di altri 2…

La startup che ha creato un’AI addestrata a “pensare come l’universo”

Accelerated Understanding ha elaborato un modello che ragiona per equazioni…

Perplexity porta il suo agente AI sul DGX Spark: tutto gira in locale

Perplexity ha lanciato Portable Computer, una versione del suo agente…

Nvidia acquisisce Hugging Face per 12,9 miliardi di dollari

Nvidia ha raggiunto un accordo per acquistare Hugging Face, la…

In Evidenza


New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version