Due milioni di chip in più, uno schema familiare
Il 26 agosto 2026, AWS e NVIDIA hanno annunciato un'ampia espansione della loro collaborazione. AWS distribuirà 2 milioni di GPU NVIDIA aggiuntive - Blackwell Ultra, Rubin e Rubin Ultra - sull'intera infrastruttura globale entro il 2027-2028. La mossa amplia un impegno delineato per la prima volta alla conferenza GTC 2026 di NVIDIA, dove AWS aveva annunciato piani per aggiungere più di 1 milione di GPU a partire dal 2026. La domanda ha da allora superato quelle aspettative iniziali, spingendo verso la cifra più alta. Ad AWS arriva anche l'infrastruttura basata sulla CPU NVIDIA Vera, pensata appositamente per i carichi di lavoro di IA agentica che richiedono calcolo CPU ad alte prestazioni accanto agli acceleratori stessi.
Il CEO di AWS, Matt Garman, ha detto che i clienti vogliono la libertà di scegliere gli strumenti migliori per i propri carichi di lavoro di IA, qualunque sia la combinazione che ne risulta. Il CEO di NVIDIA, Jensen Huang, ha detto che le due aziende scalano insieme il computing NVIDIA nel cloud da 16 anni, descrivendo l'espansione come una continuazione di quella storia piuttosto che una nuova direzione. La partnership in sé va oltre il semplice conteggio dei chip: comprende AI factory, CPU, networking, modelli aperti, elaborazione dei dati e robotica, posizionando il rapporto come qualcosa che riguarda l'intera infrastruttura, non una singola linea di prodotto.
L'unica regione nominata con una cifra
All'interno dello stesso annuncio, AWS e NVIDIA hanno nominato una riserva specifica e cifrata: 100.000 GPU dedicate a data center sicuri costruiti per il governo statunitense. Quelle strutture sono progettate per gestire carichi di lavoro classificati al livello Impact Level 6 (IL6) e superiore, il livello che il Dipartimento della Difesa statunitense usa per le sue informazioni non classificate e classificate più sensibili. La cifra compare esplicitamente nell'annuncio, legata a un segmento di clientela nominato e a uno standard di sicurezza nominato, non dissolta in un totale regionale più ampio.
Quel livello di precisione conta come segnale. Quando un'azienda nomina un segmento di clientela con una cifra esatta di GPU all'interno di un annuncio sulla capacità, sta facendo un impegno pubblico con un numero collegato, uno a cui un cliente potrà chiederle conto in seguito. Le restanti 1,9 milioni di GPU sono descritte solo come destinate a "AWS Global Infrastructure", senza che nessun'altra regione o mercato riceva una riga nominata e cifrata comparabile. L'Europa non viene mai citata in tutto l'annuncio, né come regione, né come mercato, né come allocazione pianificata.
Cosa doveva dimostrare il Brandeburgo
AWS gestisce un'iniziativa separata, la AWS European Sovereign Cloud, costruita apposta per soddisfare i requisiti UE di residenza dei dati e indipendenza operativa. La sua prima regione è entrata in funzione nel Brandeburgo, in Germania, nel gennaio 2026, offrendo ai clienti UE un ambiente cloud pensato per mantenere dati, operazioni e decisioni di accesso all'interno dell'UE. AWS ha dichiarato che sono previste altre regioni nei Paesi Bassi, in Belgio e in Portogallo, per estendere lo stesso modello di sovranità a più parti del blocco nei prossimi anni.
La proposta del cloud sovrano ha sempre riguardato l'indipendenza legale e operativa: dove risiedono fisicamente i dati, chi può accedervi e sotto quale giurisdizione, non l'abbondanza garantita di calcolo. Questo annuncio ricorda che si tratta di due promesse separate: una regione sovrana garantisce la giurisdizione, non la capacità di GPU, e la capacità stessa continua a essere assegnata a livello globale in base alla domanda e al margine, non in base a quali regioni hanno assunto per prime impegni di sovranità. Un'azienda può essere pienamente conforme ai requisiti di sovranità UE nel Brandeburgo e non ricevere comunque nulla di una specifica espansione hardware annunciata nella stessa settimana.
Leggere un annuncio sulla capacità da acquirente
Il metodo di lettura è semplice una volta nominato direttamente. Una riserva nominata e cifrata, come l'impegno di 100.000 GPU per il governo statunitense, segnala dove un'azienda sta dando priorità alla capacità in questo momento, perché nominare una cifra in pubblico crea un'aspettativa che l'azienda dovrà poi rispettare. Tutto ciò che rientra in una categoria più ampia come "infrastruttura globale" viene distribuito a discrezione del fornitore, e finisce dove la domanda e il margine lo giustificano per primi. Quel luogo può essere o non essere la regione su cui un determinato cliente conta al momento di firmare un impegno pluriennale.
Per gli acquirenti aziendali e del settore pubblico UE con impegni GPU AWS in essere o piani di espansione, l'indicazione pratica è non leggere un titolo su "espansione dell'infrastruttura globale" come una promessa di capacità nella regione UE. Chiedere per iscritto ai team di account AWS impegni di capacità specifici per regione e tempi di consegna, invece di dedurre la disponibilità da un totale globale che nomina altre regioni con una cifra ma lascia l'Europa senza nome. Una cifra legata alla propria regione e al proprio carico di lavoro, scritta in un contratto, vale per un acquirente più di un totale globale dal suono favorevole, ed è esattamente il tipo di dettaglio che qualsiasi autorità nazionale di protezione dei dati si aspetterebbe comunque di trovare documentato.
La stretta sull'offerta dietro l'annuncio
Nella stessa settimana di questo accordo, la dirigenza finanziaria di NVIDIA ha dichiarato che i costi della memoria stanno salendo più velocemente di quanto l'azienda si aspettasse, una tendenza che ora prevede si estenda fino all'anno fiscale 2028. I componenti alla base delle GPU Blackwell Ultra e della classe Rubin stanno diventando più costosi da produrre proprio mentre gli impegni per costruirne di più continuano a moltiplicarsi in tutto il settore. NVIDIA ha reso nota la pressione sui costi della memoria separatamente dall'annuncio AWS, ma i due fatti cadono nella stessa settimana e descrivono la stessa catena di fornitura.
Quando un input limitato come la memoria incontra una lista crescente di acquirenti che chiedono impegni pubblici di capacità, l'allocazione non ricadrà in modo uniforme su tutte le regioni che la vogliono. Gli acquirenti disposti ad accettare qualunque regione assegnata da AWS sono meglio posizionati per ricevere capacità più rapidamente rispetto agli acquirenti che richiedono, per motivi legali o operativi, una specifica regione UE garantita contrattualmente. È esattamente la scelta che questo annuncio lascia agli acquirenti UE, un compromesso tra velocità e giurisdizione, senza mai dirlo direttamente nel testo dell'annuncio stesso.
Da leggere ora: Rete, acqua e manodopera sotto un unico cluster Amazon | Il chip anti-Nvidia di AWS adotta la memoria di Nvidia



