NotizieAzioniNVIDIA e AWS ampliano la collaborazione su infrastrutture AI e fabbriche AI di livello governativo

NVIDIA e AWS ampliano la collaborazione su infrastrutture AI e fabbriche AI di livello governativo

Autore: Metaverse Post·

Punti chiave

  • AWS dispiegherà due milioni di GPU NVIDIA aggiuntive, tra cui gli acceleratori Blackwell Ultra, Rubin e Rubin Ultra, sulla propria infrastruttura globale nel corso del 2027 e del 2028, in aggiunta ai piani già annunciati di aggiungere oltre un milione di GPU a partire dal 2026.
  • AWS e NVIDIA prevedono di costruire fabbriche AI dedicate che forniranno centomila GPU su infrastrutture sicure certificate per carichi di lavoro federali di Impact Level 6 e superiore.
  • AWS introdurrà istanze basate sulla CPU NVIDIA Vera per i carichi di lavoro di AI agentica, insieme a NVLink Fusion e a una memoria ad alta larghezza di banda personalizzata sviluppata con Annapurna Labs per migliorare velocità ed efficienza energetica.
  • L'accelerazione GPU con NVIDIA cuDF garantirà un'elaborazione dei dati fino a 3,7 volte più veloce su Amazon EMR, mentre Amazon OpenSearch Service otterrà una costruzione di indici vettoriali fino a nove volte più veloce a circa un quarto del costo.
  • Amazon Robotics integrerà la piattaforma Jetson, le librerie Omniverse e il framework Isaac di NVIDIA per far avanzare l'automazione dei magazzini attraverso simulazione, generazione di dati sintetici e ottimizzazione dei percorsi.
NVIDIA e AWS ampliano la collaborazione su infrastrutture AI e fabbriche AI di livello governativo

NVIDIA e Amazon Web Services hanno annunciato una significativa espansione della loro collaborazione strategica sedicenne, con un notevole potenziamento della capacità delle infrastrutture AI e un'integrazione più profonda lungo l'intero stack tecnologico per far avanzare l'AI agentica e l'AI fisica.

La partnership ora abbraccia hardware per GPU e CPU, networking avanzato, modelli aperti e piattaforme di robotica, mentre entrambe le aziende rispondono a una domanda aziendale e governativa che ha superato le proiezioni esistenti. L'annuncio riflette un più ampio cambiamento del settore, che passa dai progetti pilota al dispiego su scala di produzione nella scoperta scientifica, nell'automazione aziendale e nella robotica, dove la disponibilità di calcolo, il networking e l'integrazione software sono sempre più trattati come un unico sistema.

Il fulcro dell'espansione è il dispiego di due milioni di GPU NVIDIA aggiuntive sull'infrastruttura globale di AWS nel corso del 2027 e del 2028. Questa capacità includerà gli acceleratori NVIDIA Blackwell Ultra, Rubin e Rubin Ultra, in aggiunta ai piani già annunciati di aggiungere oltre un milione di GPU a partire dal 2026. AWS introdurrà inoltre istanze basate sulla CPU NVIDIA Vera, progettata appositamente per i carichi di lavoro di AI agentica, e implementerà NVIDIA NVLink Fusion insieme a una tecnologia di memoria ad alta larghezza di banda personalizzata sviluppata con Annapurna Labs per migliorare velocità ed efficienza energetica sia nelle architetture GPU sia in quelle Trainium.

Per l'addestramento AI su larga scala, le due aziende collaborano sul networking NVIDIA Spectrum per ottimizzare le prestazioni tra i cluster di GPU. Sul fronte governativo, AWS e NVIDIA prevedono di costruire fabbriche AI dedicate che forniranno centomila GPU su infrastrutture sicure certificate per carichi di lavoro federali di Impact Level 6 e superiore. Tutte le nuove istanze continueranno a utilizzare AWS Nitro System ed Elastic Fabric Adapter, mantenendo gli standard di sicurezza e affidabilità man mano che la flotta si amplia.

Software, elaborazione dati e AI fisica

Oltre all'espansione hardware, la collaborazione pone l'accento sull'ottimizzazione del livello software e sui casi d'uso emergenti. I modelli aperti NVIDIA Nemotron rimarranno disponibili come servizi completamente gestiti su Amazon Bedrock e come risorse implementabili su Amazon SageMaker, ampliando la scelta di modelli per gli sviluppatori. Le capacità di elaborazione dei dati saranno potenziate tramite l'accelerazione GPU su Amazon EMR con NVIDIA cuDF, che promette un'elaborazione fino a 3,7 volte più veloce e un rapporto prezzo-prestazioni migliore del 30 percento rispetto alle configurazioni CPU.

Separatamente, Amazon OpenSearch Service utilizzerà l'indicizzazione vettoriale accelerata su GPU per offrire una costruzione degli indici fino a nove volte più veloce a circa un quarto del costo, affrontando i colli di bottiglia nella generazione aumentata dal recupero e nelle pipeline di ricerca semantica che dipendono da un recupero rapido su grandi dataset. AWS diventerà inoltre il primo grande provider cloud a offrire istanze EC2 G7 accelerate da GPU NVIDIA RTX PRO 4500 Blackwell Server Edition, che offrono prestazioni di inferenza AI 4,6 volte superiori e prestazioni grafiche 2,1 volte superiori rispetto alle istanze G6 della generazione precedente.

Nel settore della robotica, Amazon Robotics integrerà le tecnologie full-stack di AI fisica di NVIDIA, tra cui la piattaforma Jetson, le librerie Omniverse e il framework di sviluppo Isaac, per far avanzare l'automazione dei magazzini attraverso simulazione, generazione di dati sintetici, ottimizzazione dei percorsi e validazione real-to-sim.