Nvidia e Amazon annunciano un'espansione della capacità: AWS distribuirà altri 2 milioni di GPU nel 2027-2028

📅 2026-08-27

Riassunto:

Il 26 agosto, ora locale a Seattle e Santa Clara, California, Amazon Cloud Technology (AWS) e NVIDIA hanno rilasciato contemporaneamente una dichiarazione di espansione della cooperazione strategica: AWS prevede di implementare altri 2 milioni di processori grafici NVIDIA sulla sua infrastruttura globale dal 2027 al 2028, con modelli di chip tra cui Blackwell Ultra, Rubin e Rubin Ultra. Le parti non hanno annunciato l'importo del contratto. Lo stesso giorno, Nvidia ha dichiarato in una conferenza stampa che Amazon utilizzerà il suo intero stack tecnologico di intelligenza artificiale fisica per i robot di magazzino.

Circa cinque mesi fa, AWS ha annunciato alla conferenza NVIDIA GTC del 2026 che avrebbe aggiunto più di 1 milione di GPU NVIDIA a partire dal 2026. Le due società hanno affermato questa volta che la domanda per quel livello è stata superata. Secondo il calibro ufficiale, il nuovo impegno è quello di aggiungere ulteriori 2 milioni di unità al piano originale, portando la scala di dispiegamento totale a oltre 3 milioni di unità. L'importo del contratto, il prezzo unitario e il ritmo di consegna annuale non sono ancora stati resi noti.


AWS installerà altri 2 milioni di GPU dal 2027 al 2028

Il comunicato stampa congiunto afferma che i 2 milioni di GPU aggiuntivi verranno distribuiti sull'infrastruttura globale di AWS, coprendo la cosiddetta "fabbrica di intelligenza artificiale" e le istanze cloud rivolte ai clienti. Gli usi sono elencati in diverse categorie: intelligenza artificiale intelligente, calcolo scientifico, automazione aziendale e intelligenza artificiale fisica. Kress, direttore finanziario di Nvidia, ha aggiunto alla conferenza sugli utili che un numero non specificato di processori centrali Vera sarà fornito ad AWS, alcuni integrati con Rubin e altri consegnati separatamente.

Entrambe le parti hanno scritto simultaneamente l'interconnessione ad alta velocità NVLink Fusion di NVIDIA e la memoria personalizzata a larghezza di banda elevata (NVHBM) nel rack Trainium di prossima generazione. Il sito web ufficiale di Amazon afferma che la prossima generazione di Trainium è stata annunciata al re:Invent nel 2025 per supportare NVLink Fusion; questa volta, la memoria personalizzata di NVIDIA è collegata alla stessa architettura rack, in modo che le GPU Trainium e NVIDIA possano essere espanse nello stesso cabinet. Wccftech ha citato i materiali di NVIDIA di quel giorno affermando che NVHBM ha una larghezza di banda maggiore di circa il 30% e un'efficienza energetica maggiore di circa il 15% rispetto a HBM4E. Questi indicatori provengono dal calibro del fornitore e le due parti non hanno fornito campioni di controllo effettivamente misurati.

AWS espanderà inoltre la capacità di Blackwell e fornirà GPU RTX PRO 4500 Blackwell Server Edition sulle istanze Amazon EC2 G7. Secondo il comunicato stampa, rispetto alla generazione precedente G6, G7 ha una prestazione massima di inferenza dell'intelligenza artificiale di circa 4,6 volte e una prestazione grafica di circa 2,1 volte. AWS è il primo grande fornitore di servizi cloud a fornire questa istanza della scheda acceleratrice.

Il fondatore e CEO di NVIDIA, Jensen Huang, ha dichiarato nella dichiarazione: "NVIDIA e AWS hanno costruito uno dei motori di crescita nell'era dell'intelligenza artificiale e la domanda è superiore a ogni previsione. Negli ultimi 16 anni, abbiamo lavorato insieme per portare il computing NVIDIA nel cloud. Ora la cooperazione si è estesa all'intero stack: GPU, CPU, rete, modelli e software open source." Il CEO di AWS Garman ha affermato che i clienti devono essere in grado di scegliere gli strumenti e confermare che tutti i livelli possono essere collegati, quindi AWS ha apportato ottimizzazioni approfondite con NVIDIA in termini di rete, sicurezza e distribuzione.

Le due società non hanno spiegato quanti modelli per ciascun modello costituivano i 2 milioni di unità, quali data center verranno installati per primi e come verranno abbinati alimentazione e raffreddamento. TechCrunch stima, in base alla fascia di prezzo di una singola carta, che l'intero affare possa raggiungere decine di miliardi di dollari, ma l'articolo originale afferma anche: I termini finanziari non sono stati annunciati da entrambe le parti.


I robot di magazzino sono collegati all'intero stack di intelligenza artificiale fisica di NVIDIA

Kress ha dichiarato durante la chiamata che Amazon utilizzerà l'intero stack tecnologico di intelligenza artificiale fisica di Nvidia per alimentare i robot di magazzino. Il comunicato stampa suddivide lo stack tecnologico in diverse parti: piattaforma di edge computing Jetson, simulazione Omniverse e libreria di gemelli digitali e piattaforma di sviluppo robot open source Isaac. Il sito web ufficiale di Amazon afferma inoltre che il dipartimento di robotica di Amazon utilizzerà gli strumenti di cui sopra per la simulazione, i dati sintetici, l'ottimizzazione del percorso, la sicurezza funzionale e la verifica "dalla simulazione reale", e i calcoli verranno eseguiti su istanze Amazon EC2 accelerate da GPU. TechCrunch elenca anche la piattaforma modello mondiale Cosmos.

La dichiarazione non riportava il numero di robot connessi, l'elenco dei magazzini online o il programma di trasformazione. La cooperazione dal lato del magazzino e i 2 milioni di GPU dal lato del cloud sono termini paralleli e non sono scritti nello stesso ordine di acquisto.

Il livello software è scritto insieme. Il modello open source Nemotron di Nvidia continua ad essere disponibile su Amazon Bedrock e SageMaker. La libreria cuDF viene utilizzata su Amazon EMR per l'elaborazione dei dati accelerata da GPU. Il comunicato stampa afferma che la velocità di elaborazione è fino a circa 3,7 volte e il rapporto costo-prestazioni è superiore di circa il 30% rispetto a quello di una configurazione CPU pura. Amazon OpenSearch utilizza la GPU per l'indicizzazione vettoriale e si dice che la velocità di indicizzazione sia fino a circa 9 volte e il costo è di circa un quarto. I multipli sopra indicati provengono tutti dal calibro di prova del produttore. Il livello di sicurezza collega la piattaforma NVIDIA al sistema AWS Nitro e all'Elastic Fabric Adapter (EFA).

100.000 GPU per il governo degli Stati Uniti sono elencate separatamente

Le due parti intendono costruire una "fabbrica di intelligenza artificiale" per il governo degli Stati Uniti, fornendo 100.000 GPU sull'infrastruttura sicura AWS per eseguire carichi di lavoro di sicurezza federale e nazionale con un livello di riservatezza di livello di impatto 6 (IL6) e superiore. I 100.000 pezzi sono il numero indicato separatamente nel rendiconto. Non è specificato se sia compreso nei suddetti 2 milioni di pezzi, né è annunciato l'anno di consegna e il luogo di costruzione.

Amazon ha inoltre sottolineato che i chip sviluppati internamente sono ancora in vendita. Secondo quanto riportato dai media, il business dei chip sviluppati internamente da Amazon ha un fatturato annuo di circa 25 miliardi di dollari e ha un impegno di circa 225 miliardi di dollari dal suo laboratorio di intelligenza artificiale; Trainium è posizionato come opzione che può essere utilizzata insieme alle schede acceleratrici Nvidia. Questa espansione inserisce GPU Nvidia, CPU Vera e Trainium nella stessa narrativa di rack e i clienti possono mescolarli e il rapporto specifico viene scelto dal cliente. I due partiti non hanno annunciato il momento del lancio del governo in tessuto misto.

Nvidia ha annunciato lo stesso giorno che i suoi ricavi per il secondo trimestre dell'anno fiscale 2027 sono stati pari a 96,2 miliardi di dollari, con ricavi dei data center pari a 89 miliardi di dollari, con un aumento su base annua del 117%; la previsione dei ricavi del terzo trimestre era di 108 miliardi di dollari, più o meno il 2%. Huang Renxun ha affermato in un'intervista correlata al rapporto finanziario che l'intelligenza artificiale è entrata nella fase di "produzione di lavoro utile e creazione di token redditizi" e che maggiore potenza di calcolo significa più token. La dichiarazione di espansione è stata rilasciata lo stesso giorno del rapporto finanziario, ma il testo della cooperazione in sé non ha convertito i 2 milioni di GPU in un contributo alle entrate di Nvidia.

Tag correlati

Articoli correlati

Commenti

0/500
验证码
Nessun commento