AktualnościAkcjeAnthropic i Accenture pogłębiają współpracę w zakresie AI z miliardowym zobowiązaniem na rzecz bezpieczeństwa

Anthropic i Accenture pogłębiają współpracę w zakresie AI z miliardowym zobowiązaniem na rzecz bezpieczeństwa

Autor: CryptoBriefing·

Najważniejsze informacje

  • Anthropic i Accenture każde zamierzają zainwestować co najmniej 1 miliard dolarów w bezpieczeństwo AI w ciągu najbliższych pięciu lat w ramach nowego programu wbudowanych ocen.
  • Program poprowadzi Faculty, wyspecjalizowana spółka AI należąca do Accenture, a ewaluatorzy otrzymają dostęp porównywalny z dostępem pracowników Anthropic — będą obserwować trening, prowadzić red teaming modeli i testować zabezpieczenia.
  • Inicjatywa nawiązuje do eseju CEO Anthropic, Dario Amodeiego, "We Must Pace the Frontier", w którym apelował o działanie niezależnych ewaluatorów wewnątrz laboratoriów AI pracujących nad modelami granicznymi.
  • Faculty wnosi wcześniejsze doświadczenie z modelami granicznymi, w tym oceny bioasekuracji modeli Claude 4 firmy Anthropic oraz red teaming modelu o1 firmy OpenAI.
  • Porozumienie nie jest wyłączną współpracą — Anthropic prowadzi rozmowy z organizacją non-profit METR i planuje ogłosić dodatkowych partnerów w najbliższych tygodniach.
Anthropic i Accenture pogłębiają współpracę w zakresie AI z miliardowym zobowiązaniem na rzecz bezpieczeństwa

Anthropic i Accenture rozszerzają współpracę w zakresie bezpieczeństwa sztucznej inteligencji poprzez nowy program wbudowanych ocen modeli granicznych, w który każda z firm zamierza zainwestować co najmniej 1 miliard dolarów w ciągu najbliższych pięciu lat. Celem przedsięwzięcia jest luka, której branża dotąd nie zlikwidowała: niezależna weryfikowalność zobowiązań dotyczących bezpieczeństwa składanych przez laboratoria pracujące nad modelami granicznymi.

Program poprowadzi Faculty, wyspecjalizowana spółka AI należąca do Accenture, którą firma zadeklarowała zamiar przejęcia wcześniej w tym roku w ramach szerszej rozbudowy swoich zdolności w obszarze AI. Ewaluatorzy Faculty będą pracować ramię w ramię z zespołami Anthropic, oceniając modele i prowadząc wobec nich red teaming, przeprowadzając oceny wyrównania oraz testując zabezpieczenia modeli.

W odróżnieniu od konwencjonalnych zewnętrznych ewaluatorów zakłada się, że zespoły wbudowane otrzymają dostęp porównywalny z dostępem pracowników Anthropic. Pozwoli im to obserwować modele podczas treningu, analizować decyzje dotyczące rozwoju i wdrożeń oraz oceniać, czy firma dotrzymuje swoich zobowiązań w zakresie bezpieczeństwa. To właśnie głębokość dostępu wyróżnia ten model — przenosi ewaluację do wnętrza procesu rozwoju, zamiast pozostawiać ją na granicy laboratorium.

Inicjatywa jest realizacją zobowiązania podjętego przez CEO Anthropic, Dario Amodeiego, w jego niedawnym eseju "We Must Pace the Frontier", w którym apelował o działanie niezależnych ewaluatorów wewnątrz laboratoriów AI pracujących nad modelami granicznymi jako części szerszych starań o weryfikowalność zobowiązań dotyczących bezpieczeństwa. Nowy program przekształca tę propozycję w działające porozumienie, z nazwanym partnerem i określonym zobowiązaniem finansowym.

Faculty wcześniej współpracowała z największymi deweloperami AI przy testach bezpieczeństwa,.in. przyczyniając się do ocen bioasekuracji modeli Claude 4 firmy Anthropic oraz prowadząc red teaming modelu o1 firmy OpenAI. Ten dorobek oznacza, że zespół przychodzi z praktycznym doświadczeniem w testowaniu modeli granicznych z więcej niż jednego laboratorium.

Anthropic zaznaczyło, że ramy pozostają eksperymentalne, ponieważ nie ustanowiono jeszcze branżowych standardów określających, do czego ewaluatorzy wbudowani powinni mieć dostęp ani jak powinny być raportowane ich ustalenia. Przy braku uzgodnionych norm to własne praktyki programu w zakresie dostępu i ujawnień będą definiować jego zasady. Nierozwiązana pozostaje również kwestia finansowania. Anthropic wcześniej argumentowało, że niezależne oceny powinny być ostatecznie finansowane ze wspólnych lub rządowych mechanizmów, jednak w przypadku partnerstwa z Accenture firma będzie bezpośrednio finansować prace ewaluacyjne, co oznacza, że model opiera się na razie na bezpośrednim finansowaniu korporacyjnym, a nie na wspólnej infrastrukturze, za którą Anthropic się opowiada.

Porozumienie nie jest wyłączną współpracą. Anthropic poinformowało, że prowadzi również rozmowy z non-profitową organizacją ewaluacyjną METR i planuje w najbliższych tygodniach ogłosić dodatkowych partnerów, podczas gdy Accenture pozostanie wolny do współpracy z innymi deweloperami AI. Taka struktura wskazuje na wieloosobowy zespół ewaluatorów wbudowanych w Anthropic, a nie na uzależnienie od jednej relacji.

Anthropic podkreśliło, że wbudowani ewaluatorzy nie przenoszą odpowiedzialności za bezpieczeństwo modeli na organizacje zewnętrzne. Program ma natomiast ułatwić niezależną weryfikację własnych zobowiązań firmy w zakresie bezpieczeństwa. Najbliższe tygodnie powinny wyjaśnić przynajmniej dwie kwestie: którzy dodatkowi ewaluatorzy dołączą do programu oraz jak ukształtują się jego eksperymentalne zasady dostępu i raportowania.