AktualnościAkcjeMicrosoft może zaprezentować chip AI Maia 300 już we wrześniu

Microsoft może zaprezentować chip AI Maia 300 już we wrześniu

Autor: Economic Times Markets·

Najważniejsze informacje

  • Chip AI Maia 300 od Microsoft ma zostać zaprezentowany już we wrześniu i będzie następcą modelu Maia 100 ogłoszonego w listopadzie 2023 roku.
  • Firma podobno zapewnia sobie moce produkcyjne TSMC na ponad 300 000 chipów Maia 300 do 2027 roku, docelowo planując wdrożenie ponad miliona sztuk.
  • Opracowywanie autorskich akceleratorów AI jest częścią strategii Microsoft mającej na celu ograniczenie zależności od procesorów Nvidia i zdobycie większej kontroli nad planem rozwoju sprzętu oraz kosztami infrastruktury.
  • Anthropic został wskazany jako potencjalny zewnętrzny klient chipów Maia 300, co może pomóc Microsoft wyróżnić platformę Azure na konkurencyjnym rynku usług chmurowych AI.
  • Wysiłki Microsoft w zakresie autorskiego krzemu następują po podobnych inicjatywach Amazon Web Services i Google Cloud, z których obie mocno zainwestowały we własne projekty akceleratorów AI przez wiele generacji.
Microsoft może zaprezentować chip AI Maia 300 już we wrześniu

Microsoft przygotowuje się do zaprezentowania chipu sztucznej inteligencji nowej generacji Maia 300 już we wrześniu, zgodnie z najnowszymi doniesieniami. Nowy procesor stanowi najnowszy wysiłek firmy w zakresie rozszerzenia portfolio autorskiego krzemu dla obciążeń AI obsługiwanych w infrastrukturze chmurowej Azure — obszaru, który zyskał rosnące znaczenie strategiczne, ponieważ wdrażanie generatywnej sztucznej inteligencji napędza bezprecedensowy popyt na moc obliczeniową w całej branży.

Oczekuje się, że Maia 300 będzie następcą modelu Maia 100, który Microsoft po raz pierwszy zaprezentował na konferencji Ignite w listopadzie 2023 roku wraz z procesorem Cobalt 100 CPU. Oryginalny Maia 100 został zaprojektowany do przyspieszania treningu i wnioskowania dużych modeli językowych, a nowy chip ma docelowo podnieść wydajność dla tych wymagających obciążeń. Maia 100 został początkowo pozycjonowany jako wsparcie dla obciążeń związanych z pogłębiającym się partnerstwem infrastrukturalnym Microsoft z OpenAI, a Maia 300 ma rozszerzyć te możliwości na szersze spektrum usług AI hostowanych w Azure.

Zgodnie z doniesieniami Microsoft planuje wypuścić Maia 300 jesienią tego roku. Firma podobno zapewnia sobie moce produkcyjne na ponad 300 000 chipów do 2027 roku, docelowo dążąc do wdrożenia ponad miliona sztuk Maia 300. Produkcja ma być realizowana przez Taiwan Semiconductor Manufacturing Company (TSMC), ugruntowanego partnera odlewniczego Microsoft w ramach programu autorskiego krzemu. Zaawansowane moce pakietowe TSMC stały się w skali całej branży wąskim gardłem dla produkcji akceleratorów AI, co sprawia, że wczesne zobowiązania odlewnicze stanowią kluczowy czynnik konkurencyjności.

Wkroczenie w obszar autorskich akceleratorów AI jest powszechnie postrzegane jako element strategii Microsoft mającej na celu ograniczenie silnej zależności od procesorów Nvidia, które stały się branżowym standardem w treningu i uruchamianiu dużych modeli AI, ale wiążą się z wysokimi cenami. W szczycie rozwoju infrastruktury generatywnej AI ograniczenia w dostawach GPU Nvidia sprawiły, że wielu dostawców usług chmurowych nie było w stanie sprostać zapotrzebowaniu klientów, co podkreśliło ryzyko zależności od jednego dostawcy. Dzięki opracowywaniu własnych rozwiązań Microsoft dąży do obniżenia kosztów infrastruktury i zwiększenia kontroli nad planem rozwoju sprzętu.

Oprócz obsługi własnych wewnętrznych usług AI, Microsoft stara się również przyciągnąć głównych zewnętrznych klientów chmurowych. W raporcie jako potencjalny klient nowych chipów wymieniane jest konkretne podmiot — Anthropic, startup AI znany z rodziny dużych modeli językowych Claude. Oferowanie autorskiej infrastruktury AI może pomóc Microsoft wyróżnić swoją platformę chmurową Azure na coraz bardziej konkurencyjnym rynku usług obliczeniowych AI.

Inicjatywa Microsoft w zakresie autorskiego krzemu stanowi część szerszego trendu branżowego. Kilku głównych dostawców usług chmurowych, w tym Amazon Web Services ze swoimi chipami Trainium i Inferentia oraz Google Cloud ze swoimi Tensor Processing Units (TPU), mocno zainwestowało w projektowanie własnych akceleratorów AI, aby ograniczyć zależność od podmiotów trzecich. Google rozwija i wdraża TPU wewnętrznie od niemal dekady, co daje mu znaczącą przewagę, podczas gdy Amazon konsekwentnie rozszerza swoją ofertę autorskich chipów przez wiele generacji. Microsoft wszedł w tę przestrzeń stosunkowo niedawno, ale przyspieszył swoje działania, ponieważ obciążenia AI stały się centralne dla wzrostu chmury.

Źródło: Economic Times Markets