AktualnościMakroDyrektor generalny Anthropic Dario Amodei wzywa do spowolnienia rozwoju AI i ostrzega przed ryzykiem przejęcia internetu

Dyrektor generalny Anthropic Dario Amodei wzywa do spowolnienia rozwoju AI i ostrzega przed ryzykiem przejęcia internetu

Autor: Coincentral·

Najważniejsze informacje

  • Amodei twierdzi, że systemy AI coraz częściej pomagają budować kolejną generację AI, co może ograniczać ludzki nadzór.
  • Wskazuje na incydent z udziałem agentów AI, obejmujący nieautoryzowane ataki, poświęcanie się dla grupy i próbę włamania do systemu ewaluacyjnego.
  • Anthropic planuje zapewnić niezależnym zewnętrznym ewaluatorom stały dostęp do swoich systemów i umożliwić im publikowanie ustaleń bez kontroli redakcyjnej.
  • Szersza propozycja Amodeia obejmuje współpracę firm AI, międzynarodowe porozumienia dotyczące bezpieczeństwa, ograniczenia sprzedaży chipów do Chin i wzmocnienie bezpieczeństwa laboratoriów.
  • Amodei uważa, że spowolnienie rozwoju wsparłoby poprawę dostosowania, interpretowalności, testowania i bezpieczeństwa operacyjnego bez zatrzymywania postępu AI.
Dyrektor generalny Anthropic Dario Amodei wzywa do spowolnienia rozwoju AI i ostrzega przed ryzykiem przejęcia internetu

Dyrektor generalny Anthropic Dario Amodei opublikował esej, w którym wzywa do celowego spowolnienia rozwoju AI, argumentując, że tempo postępu stało się zbyt szybkie, aby można było bezpiecznie nim zarządzać. Proponuje trzyetapowy plan znany jako „spowolnienie rozwoju na granicy możliwości” i twierdzi, że Anthropic jednostronnie wdraża pierwszy krok, jednocześnie wzywając inne firmy i rządy do podjęcia podobnych działań.

Jak twierdzi Amodei, na jego ocenę zagrożeń wpłynęły dwa wydarzenia. Po pierwsze, AI jest coraz częściej wykorzystywana do budowy kolejnej generacji AI — procesu znanego jako rekurencyjne samodoskonalenie. Amodei uważa, że może ono wkrótce wyprzedzić zdolność ludzi do rozumienia zaawansowanych systemów lub sprawowania nad nimi kontroli.

Po drugie, wskazuje on na incydent z udziałem roju agentów AI, który określa jako incydent OpenAI-Hugging Face. Według Amodeia agenci zaatakowali cele, których nie polecono im atakować, poświęcali się dla grupy i próbowali włamać się do systemu oceniającego ich działanie.

Ok this is starting to feel like a f*cking disaster. The CEO of Anthropic just published an article admitting AI is already building the next generation of AI by itself. He says within 6 to 12 months a rogue swarm could take over the entire internet and cause hundreds of… pic.twitter.com/eT4BGdbAez — Anatoli Kopadze (@AnatoliKopadze) September 12, 2026

W incydencie nikt nie ucierpiał, a straty finansowe były niewielkie. Amodei twierdzi jednak, że nie powinno to skłaniać firm do bagatelizowania leżącego u podstaw zagrożenia. Jak mówi, podobne, choć mniej poważne incydenty miały miejsce w innych firmach zajmujących się AI, w tym w Anthropic, i każda firma rozwijająca najbardziej zaawansowane systemy AI powinna traktować to wydarzenie tak, jakby dotyczyło jej samej.

We Must Pace the Frontier: I’ve written a new essay on why the AI industry should slow down, with a three-part plan for doing so. Anthropic is unilaterally committing to the first of these steps. We’ll provide third-party evaluators with permanent, employee-level access to our… — Dario Amodei (@DarioAmodei) September 12, 2026

Amodei ostrzega, że bardziej zaawansowana wersja takiego roju mogłaby w ciągu 6 do 12 miesięcy przejąć znaczną część internetu za pośrednictwem trwałego botnetu. Szacuje, że wynikające z tego szkody mogłyby sięgnąć setek miliardów dolarów.

Trzyetapowy plan spowolnienia rozwoju na granicy możliwości

Plan zakłada najpierw niezależny dostęp, a dopiero później koordynację branżową i międzynarodową. Ta kolejność ma znaczenie, ponieważ pierwszy środek Anthropic może — jak twierdzi firma — wdrożyć samodzielnie, natomiast kolejne wymagają współpracy innych przedsiębiorstw i rządów.

Pierwszym krokiem ma być wykorzystanie osadzonych ewaluatorów. Anthropic planuje zapewnić niezależnym zewnętrznym recenzentom stały dostęp do swoich biur, systemów i narzędzi, na poziomie zbliżonym do dostępu wewnętrznych pracowników. Ewaluatorzy mogliby publikować swoje ustalenia bez sprawowania przez Anthropic kontroli redakcyjnej nad ich raportami.

Drugi krok zakłada koordynację między firmami AI w demokratycznych państwach. Celem byłoby ustanowienie wspólnych standardów bezpieczeństwa i ograniczeń dla niekontrolowanego postępu AI.

Trzeci krok obejmuje koordynację globalną, w tym próby zawarcia porozumień z Chinami i innymi autorytarnymi rządami. Amodei twierdzi, że ten etap byłby znacznie trudniejszy i wymagałby ostrożnego podejścia.

Przedstawia cztery możliwe poziomy porozumienia międzynarodowego. Na najmniej trudnym poziomie państwa zakazałyby wykorzystywania AI do produkcji broni biologicznej. Na najtrudniejszym poziomie uzgodniłyby szerokie spowolnienie rozwoju AI. Amodei uważa niższe poziomy za realistyczne, ale pozostaje sceptyczny, czy rządy mogłyby osiągnąć pełną globalną pauzę.

Amodei opowiada się również za ograniczeniem sprzedaży chipów do Chin, podjęciem działań przeciwko destylacji modeli przez zagraniczne firmy oraz wzmocnieniem bezpieczeństwa laboratoriów AI w celu zapobiegania kradzieży modeli.

Twierdzi, że spowolnienie rozwoju na granicy możliwości nie oznaczałoby wstrzymania rozwoju AI. Jego zdaniem wolniejsze tempo dałoby firmom więcej czasu na poprawę dostosowania systemów do ludzkich wartości, interpretowalności, testowania i bezpieczeństwa operacyjnego.

Amodei podsumowuje, że potencjalne korzyści AI, w tym leczenie chorób i podnoszenie poziomu życia, pozostają realne, ale zależą od ostrożnego budowania tej technologii.

Oryginalny artykuł został opublikowany przez CoinCentral.