AktualnościAkcjeGdy firmy AI zbliżają się do „rekurencyjnej samodoskonalenia”, profesor fizyki nazywa pełną autonomię „najgorszym pomysłem w historii ludzkości”

Gdy firmy AI zbliżają się do „rekurencyjnej samodoskonalenia”, profesor fizyki nazywa pełną autonomię „najgorszym pomysłem w historii ludzkości”

Autor: Fortune Crypto·

Najważniejsze informacje

  • •Anthropic informuje, że jego model Claude prowadzi obecnie 26% prac badawczo-rozwojowych firmy nad modelami, wykonując większość zadań end-to-end na podstawie ogólnego polecenia, wciąż pod nadzorem człowieka.
  • •Wiodące laboratoria AI różnie definiują rekurencyjne samodoskonalenie — od jakiegokolwiek feedbacku AI przy ulepszaniu modeli po w pełni autonomiczne samodoskonalenie — więc deklaracje postępów różnych firm nie są bezpośrednio porównywalne.
  • •OpenAI stworzyło zautomatyzowanego „praktykanta badawczego” i wyznaczyło cel marca 2028 roku dla zautomatyzowanego badacza AI, przyznając jednocześnie, że nie wie jeszcze, jak bezpiecznie osiągnąć pełne, zgodne RSI.
  • •Elon Musk powiedział, że kolejne modele Grok firmy xAI są budowane z coraz mniejszym udziałem człowieka, a kamień milowy może zostać osiągnięty do końca bieżącego roku, ale nie później niż w 2027 roku.
  • •Dyrektor generalny Microsoft AI Mustafa Suleyman promuje „humanistyczną superinteligencję” pozostającą w określonych granicach, podczas gdy w branży nadal trwają podziały wokół wezwań do skoordynowanego spowolnienia AI dla bezpieczeństwa.
Gdy firmy AI zbliżają się do „rekurencyjnej samodoskonalenia”, profesor fizyki nazywa pełną autonomię „najgorszym pomysłem w historii ludzkości”

Perspektywa modeli sztucznej inteligencji uczących się samodzielnie, by stać się bardziej wydajnymi i sprawne — niegdyś odległa ambycja badaczy technologii — staje się coraz bliższa rzeczywistości.

W miarę postępu technologii deweloperzy mówią, że zbliża się ona do „rekurencyjnego samodoskonalenia”, czyli RSI, etapu, w którym modele AI znajdują sposoby na własne ulepszanie i budowę swoich następców. Przedstawiciele firm technologicznych twierdzą, że ta zmiana może przynieść postęp w nauce i medycynie, ale wiąże się też z ryzykiem.

Niepewność co do tego, dokąd to wszystko może prowadzić, leży u źródła rosnących obaw o to, że AI wymknie się spod kontroli człowieka i może stanowić zagrożenie dla ludzkości. Te obawy skłoniły kilka osobistości branży AI do przyłączenia się w zeszłym tygodniu do wezwania o spowolnienie tempa rozwoju tej technologii.

Anthropic szczegółowo opisał w tym tygodniu, jak jego model Claude pomaga firmie opracować kolejną, bardziej inteligentną wersję samego siebie. Claude prowadzi obecnie 26% prac badawczo-rozwojowych Anthropic nad modelami, co — jak stwierdziła firma — oznacza, że może wykonywać większość zadanego zadania „end-to-end na podstawie ogólnego polecenia”, wciąż pod nadzorem człowieka. Modele nie działają jeszcze całkowicie autonomicznie — przynajmniej na razie.

Konkurencyjne definicje RSI

Wiodące firmy AI różnie definiują rekurencyjne samodoskonalenie. Niektóre definiują je jako jakikolwiek feedback od dotyczący ulepszania modeli, inne jako AI pracujące ku temu celowi w pełni autonomicznie. To rozróżnienie ma znaczenie: ponieważ nie ma wspólnego progu określającego, co liczy się jako RSI, deklaracje postępów z różnych laboratoriów nie zawsze dotyczą tego samego.

Autonomiczne rekurencyjne samodoskonalenie w istocie oznacza AI zdolne do ulepszania samego siebie poprzez projektowanie kolejnej wersji systemu, potem następnej i tak dalej — według Anthony'ego Aguirre'a, prezesa i dyrektora generalnego nonprofitu Future of Life Institute oraz profesora fizyki na University of California, Santa Cruz.

„Naprawdę ważną rzeczą jest tu to, że im więcej AI tego robi, tym szybciej to idzie, ponieważ AI działa po prostu o wiele, wiele szybciej niż ludzie” — powiedział.

Eksperci ważą ryzyko wymknięcia się spod kontroli z powoli postępującą rzeczywistością

Strach wokół RSI opiera się w dużej mierze na możliwości wyłonienia się z tego procesu wymykającej się spod kontroli superinteligencji — scenariusza, w którym samodoskonalące się systemy rozwijają się poza zdolność ludzi do ich monitorowania i kontrolowania — powiedział John Thickstun, adiunkt informatyki na Cornell University badający metody kontrolowania zachowania modeli AI. Ale, jak dodał, bardziej ugruntowany pogląd sugeruje, że pewna forma rekurencyjnego samodoskonalenia trwa w rozwoju AI już od jakiegoś czasu.

„Od lat używamy już tych modeli w rolach pomocniczych przy tworzeniu kolejnych wersji tych modeli. Ludzie używają poprzedniej generacji modeli do pisania kodu dla systemów AI, które następnie tworzą kolejną generację” — powiedział.

Wybitni badacze AI — w tym współzałożyciel OpenAI Andrej Karpathy — od lat eksperymentowali z próbą skłonienia modeli AI do trenowania i ulepszania nowych systemów AI. Te wysiłki przyniosły drobne ulepszenia, ale bez wielkich twórczych przeskoków — powiedział Thickstun.

Aguirre powiedział jednak, że dzisiejsze firmy AI są znacznie bliżej osiągnięcia tych większych skoków w ulepszaniu.

„Widać na tych wykresach od Anthropic, że z czasem coraz więcej badań wykonuje AI i jest ono coraz bliższe pełnej autonomii” — powiedział. „A rezultat tego sukcesu to ostatecznie coś, co moim zdaniem jest skrajnie przerażające. Myślę, że to prawdopodobnie najgorszy pomysł w historii ludzkości. I tak, robią to.”

Ogłoszenie Anthropic dało opinii publicznej — i innym laboratoriom — pewien wgląd w postępy RSI, a firma zachęciła konkurentów do publikowania podobnych metryk. Publikowane w odpowiedzi dane konkurencji mogą dać branży wspólną podstawę do porównywania postępów w kierunku autonomicznych badań. Mimo to Anthropic nie wyraził wprost, jak blisko osiągnięcia w pełni autonomicznego ulepszania model się znajduje.

„Praktykant badawczy” OpenAI i cel na 2028 rok

Twórca ChatGPT, OpenAI, ogłosił w tym miesiącu, że opracował zautomatyzowanego „praktykanta badawczego”, definiowanego jako system zdolny do wykonywania dobrze zdefiniowanych zadań badawczych pod kierunkiem człowieka, w tym „zadań, które zajęłyby doświadczonemu badaczowi kilka dni”. Firma poinformowała, że realizuje cel stworzenia zautomatyzowanego „badacza” AI do marca 2028 roku. Ta data daje obserwatorom konkretny, zadeklarowany przez firmę kamień milowy, względem którego można mierzyć te postępy.

W tym ogłoszeniu OpenAI stwierdziło, że choć RSI może pomóc w zgodności działań modeli z ludzkimi wartościami i intencjami, nie oznacza to, że „szybkie RSI jest koniecznie rezultatem, który powinniśmy realizować”.

„Czy i jak kontynuować, musi zależeć od naszej zdolności do zachowania kontroli człowieka oraz od świadomych demokratycznych wyborów dotyczących korzyści i ryzyka” — napisała firma na blogu.

Musk sygnalizuje szybszy harmonogram w xAI

Elon Musk wydaje się bardziej skory do forsowania tempa. Mówiąc w marcu o modelach Grok firmy xAI, stwierdził, że „ludzie są stopniowo coraz mniej w pętli” przy ulepszaniu modeli i że „każdy kolejny model jest budowany przez poprzedni”, wyjaśniając jednocześnie, że proces nie jest jeszcze w pełni zautomatyzowany. Ten cel może zostać osiągnięty do końca bieżącego roku, dodał, „ale nie później” niż w 2027 roku — harmonogram wyprzedzający cel OpenAI z marca 2028 roku, choć obie firmy inaczej opisują ten kamień milowy.

„Humanistyczna” alternatywa Microsoftu

Microsoft i niektóre inne wiodące firmy AI wydają się przyjmować inne podejście. Mustafa Suleyman, dyrektor generalny Microsoft AI, powiedział, że firma zmierza ku „humanistycznej superinteligencji” — zaawansowanym możliwościom AI służącym ludziom i ludzkości jako całości. W eseju z 2025 roku Suleyman powiedział, że nie oznacza to „nieograniczonej i nieograniczonej w niczym istoty o wysokim stopniu autonomii”, lecz AI „starannie skalibrowane, osadzone w kontekście, w granicach”.

Środki bezpieczeństwa nie nadążają

Kluczowym wyzwaniem stojącym przed laboratoriami — z którym zmagają się w zasadzie od zarania tej technologii — jest zapewnienie, by środki bezpieczeństwa rozwijały się wraz z możliwościami modeli.

W branży technologicznej pojawiły się podziały wokół wezwań do skoordynowanego spowolnienia AI dla bezpieczeństwa, a nie każdy główny gracz w obszarze AI odniósł się wprost do swojej drogi z RSI.

Anthropic, będący czołowym głosem w wezwaniach do tempowania, powiedział, że spowolni lub tymczasowo wstrzyma prace rozwojowe — o ile uczynią to również jego globalni konkurenci, i to w „weryfikowalny sposób”.

OpenAI wyraźnie powiedziało w tym miesiącu, że nie wie jeszcze, „bezpiecznie doprowadzić sprawę aż do pełnego, zgodnego RSI”, dodając, że firma „nie może zakładać, że postęp w dziedzinie zgodności i bezpieczeństwa nadąży”. Bardziej zdolne systemy mogą stawać się trudniejsze do monitorowania — kontynuowała firma — ale realizacja RSI pozostaje celem, który ceni, ponieważ „zautomatyzowany badacz AI może być też zautomatyzowanym badaczem bezpieczeństwa lub zgodności”.

Ta historia była pierwotnie opublikowana na Fortune.com.