AktualnościAkcjeNVIDIA i AWS rozszerzają współpracę w zakresie infrastruktury AI i fabryk AI klasy rządowej

NVIDIA i AWS rozszerzają współpracę w zakresie infrastruktury AI i fabryk AI klasy rządowej

Autor: Metaverse Post·

Najważniejsze informacje

  • AWS wdroży dwa miliony dodatkowych procesorów graficznych NVIDIA, w tym akceleratory Blackwell Ultra, Rubin i Rubin Ultra, w swojej globalnej infrastrukturze w latach 2027 i 2028, kontynuując wcześniejsze plany dodania ponad miliona procesorów GPU począwszy od 2026 roku.
  • AWS i NVIDIA planują budowę dedykowanych fabryk AI zapewniających sto tysięcy procesorów GPU na bezpiecznej infrastrukturze certyfikowanej dla obciążeń federalnych na poziomie Impact Level 6 i wyższym.
  • AWS wprowadzi instancje oparte na procesorze NVIDIA Vera CPU dla obciążeń AI agentowego, a także NVLink Fusion i niestandardową pamięć o dużej przepustowości opracowaną z Annapurna Labs w celu poprawy szybkości i energooszczędności.
  • Akceleracja GPU z wykorzystaniem NVIDIA cuDF zapewni nawet 3,7-krotnie szybsze przetwarzanie danych na Amazon EMR, a usługa Amazon OpenSearch Service osiągnie nawet dziewięciokrotnie szybszą budowę indeksów wektorowych przy około jednej czwartej kosztu.
  • Amazon Robotics zintegruje platformę Jetson, biblioteki Omniverse i środowisko Isaac firmy NVIDIA, aby rozwijać automatyzację magazynów dzięki symulacji, generowaniu danych syntetycznych i optymalizacji tras.
NVIDIA i AWS rozszerzają współpracę w zakresie infrastruktury AI i fabryk AI klasy rządowej

NVIDIA i Amazon Web Services ogłosiły znaczącą rozbudowę swojej szesnastoletniej współpracy strategicznej, istotnie zwiększając moce infrastruktury AI i pogłębiając integrację w całym stosie technologicznym w celu rozwoju AI agentowego i fizycznego.

Partnerstwo obejmuje obecnie sprzęt GPU i CPU, zaawansowane rozwiązania sieciowe, otwarte modele oraz platformy robotyczne, a obie firmy odpowiadają na popyt ze strony przedsiębiorstw i administracji rządowej, który przekroczył dotychczasowe prognozy. Ogłoszenie odzwierciedla szerszą zmianę zachodzącą w branży — od projektów pilotażowych ku wdrożeniom na skalę produkcyjną w obszarach odkryć naukowych, automatyzacji przedsiębiorstw i robotyki, gdzie dostępność mocy obliczeniowych, sieci i integracja oprogramowania są coraz częściej traktowane jako jeden system.

Centrum tej rozbudowy stanowi wdrożenie dwóch milionów dodatkowych procesorów graficznych NVIDIA w globalnej infrastrukturze AWS w latach 2027 i 2028. Te moce obejmą akceleratory NVIDIA Blackwell Ultra, Rubin i Rubin Ultra, stanowiąc kontynuację wcześniejszych planów dodania ponad miliona procesorów GPU począwszy od 2026 roku. AWS wprowadzi także instancje oparte na procesorze NVIDIA Vera CPU, zaprojektowanym specjalnie z myślą o obciążeniach AI agentowego, oraz wdroży rozwiązanie NVIDIA NVLink Fusion wraz z niestandardową pamięcią o dużej przepustowości opracowaną wspólnie z Annapurna Labs w celu poprawy szybkości i energooszczędności zarówno w architekturach GPU, jak i Trainium.

W obszarze trenowania modeli AI na dużą skalę firmy współpracują nad sieciami NVIDIA Spectrum w celu optymalizacji wydajności w klastrach GPU. Jeśli chodzi o sektor rządowy, AWS i NVIDIA planują budowę dedykowanych fabryk AI zapewniających sto tysięcy procesorów GPU na bezpiecznej infrastrukturze certyfikowanej dla obciążeń federalnych na poziomie Impact Level 6 i wyższym. Wszystkie nowe instancje będą nadal korzystać z systemu AWS Nitro System i Elastic Fabric Adapter, co pozwoli utrzymać standardy bezpieczeństwa i niezawodności w miarę skalowania floty.

Oprogramowanie, przetwarzanie danych i fizyczne AI

Oprócz rozbudowy sprzętowej współpraca kładzie nacisk na optymalizację warstwy oprogramowania i nowe przypadki użycia. Otwarte modele NVIDIA Nemotron pozostaną dostępne jako w pełni zarządzane usługi na platformie Amazon Bedrock oraz jako zasoby do samodzielnego wdrażania na Amazon SageMaker, co poszerza wybór modeli dla deweloperów. Możliwości przetwarzania danych zostaną wzmocnione dzięki akceleracji GPU na Amazon EMR z wykorzystaniem NVIDIA cuDF, co ma zapewnić nawet 3,7-krotnie szybsze przetwarzanie oraz o 30 procent lepszy stosunek ceny do wydajności w porównaniu z konfiguracjami CPU.

Odrębnie usługa Amazon OpenSearch Service wykorzysta akcelerowane GPU indeksowanie wektorowe, aby zapewnić nawet dziewięciokrotnie szybszą budowę indeksów przy około jednej czwartej kosztu, usuwając wąskie gardła w potokach generowania wzbogaconego o wyszukiwanie (RAG) oraz wyszukiwania semantycznego, które wymagają szybkiego wyszukiwania w dużych zbiorach danych. AWS stanie się także pierwszym dużym dostawcą usług chmurowych oferującym instancje EC2 G7 przyspieszane przez procesory NVIDIA RTX PRO 4500 Blackwell Server Edition, które zapewniają 4,6-krotnie wyższą wydajność wnioskowania AI i 2,1-krotnie wyższą wydajność graficzną w porównaniu z instancjami poprzedniej generacji G6.

W sektorze robotyki Amazon Robotics zintegruje pełnostackowe technologie fizycznego AI firmy NVIDIA, w tym platformę Jetson, biblioteki Omniverse i środowisko deweloperskie Isaac, aby rozwijać automatyzację magazynów dzięki symulacji, generowaniu danych syntetycznych, optymalizacji tras i walidacji real-to-sim.