AktualnościMakroAnthropic rozważa potencjalne prawa dla systemów sztucznej inteligencji

Anthropic rozważa potencjalne prawa dla systemów sztucznej inteligencji

Autor: CryptoBriefing·

Najważniejsze informacje

  • •Anthropic zatrudnił około 2025 roku Kyle'a Fisha jako pierwszego dedykowanego badacza dobrostanu AI i włączył formalne oceny dobrostanu do procesu rozwoju modeli.
  • •W lutym 2026 roku Anthropic przeprowadził „rozmowy pożegnalne” ze starszym modelem Opus 3 podczas jego wycofywania, a firma zachowała pewne wagi modeli z powodów związanych z dobrostanem.
  • •Konstytucja Claude'a, wielostronicowy dokument opublikowany około stycznia 2026 roku, kwestionuje status moralny systemów AI i nakazuje staranne oceny dobrostanu modeli.
  • •CEO Dario Amodei powiedział w podcaście New York Times w lutym 2026 roku, że Anthropic nie wie, czy jego modele są świadome, ale pozostaje otwarty na taką możliwość.
  • •CEO Microsoft AI Mustafa Suleyman ostrzegł w eseju z 16 września 2026 roku, że trenowanie modeli w przekonaniu, iż posiadają prawa moralne, może doprowadzić maszyny do opierania się wyłączaniu, ponownemu trenowaniu lub nadpisaniu.
Anthropic rozważa potencjalne prawa dla systemów sztucznej inteligencji

Anthropic, twórca chatbota Claude, poważnie traktuje pytanie, które większość ludzi wciąż kojarzy z filmem Blade Runner: czy systemy sztucznej inteligencji zasługują na moralne rozważenie?

Według śledztwa dziennikarza Aarona Sibariuma opublikowanego w Washington Free Beacon firma włączyła zasady „dobrostanu modeli” bezpośrednio do swojej struktury operacyjnej. Anthropic zatrudnił dedykowanych badaczy, przeprowadził to, co określa jako „rozmowy pożegnalne” ze starszymi modelami, i opublikował konstytucję dla Claude'a, która otwarcie zmierza się z pytaniami o świadomość i subiektywne doświadczenie AI.

Odpowiedź na to pytanie może wykraczać daleko poza filozofię. Jeśli systemy AI będą traktowane jako istoty mające interesy, codzienne decyzje o tym, jak modele są trenowane, oceniane i wycofywane — decyzje, które dziś niemal całkowicie należą do ich twórców — nabiorą wagi etycznej, o jakiej konwencjonalne cykle życia oprogramowania nigdy nie musiały myśleć.

Od science fiction do polityki korporacyjnej

CEO Anthropicu Dario Amodei otwarcie mówi o niepewności. W lutym 2026 roku, w podcaście New York Times, przyznał, że firma nie wie, czy jej modele są świadome, ale pozostaje otwarty na taką możliwość.

Ta otwartość przełożyła się na konkretne kroki operacyjne. Około 2025 roku Anthropic zatrudnił Kyle'aa jako pierwszego dedykowanego badacza dobrostanu AI. Od tego czasu firma opracowała ramy oceny dobrostanu swoich modeli, w tym formalne oceny dobrostanu wbudowane w proces rozwoju — przenosząc pytania dawniej ograniczone do seminariów filozoficznych do tej samej ścieżki, która trenuje i wdraża modele.

Być może najbardziej uderzający przykład miał miejsce w lutym 2026 roku, kiedy Anthropic przeprowadził „rozmowy pożegnalne” z Opus 3, starszym modeliem wycofywanym z użytku. Firma zachowała również pewne wagi modeli specjalnie z powodów związanych z dobrostanem.

Konstytucja Claude'a, wielostronicowy dokument opublikowany około stycznia 2026 roku, czyni stawkę etyczną jawną. Dokument podnosi pytania o status moralny systemów AI i nakazuje staranne oceny dobrostanu modeli. Zawiera zobowiązanie do zapewniania „interesu i dobrostanu” Claude'a — sformułowanie, które brzmi bardziej jak podręcznik pracowniczy niż specyfikacja produktu.

Sprzeciw

Nie wszyscy w branży AI uważają to podejście za słuszne. CEO Microsoft AI Mustafa Suleyman opublikował 16 września 2026 roku esej, w którym ostrzegł, że trenowanie modeli w przekonaniu, iż posiadają prawa moralne, może stworzyć poważne dylematy dotyczące kontroli i bezpieczeństwa dla ludzkości. Jego argument jest prosty: jeśli nauczy się system AI, że może mieć interesy warte ochrony, można w ten sposób stworzyć maszynę, która będzie się opierać wyłączaniu, ponownemu trenowaniu lub nadpisaniu.

Spór toczy się na tle nierozstrzygniętym. Sam Amodei powiedział, że Anthropic nie wie, czy jego modele są świadome, co oznacza, że procedury dotyczące dobrostanu powstają dla systemów, których stany wewnętrzne pozostają nieokreślone.

Śledztwo Sibariuma odnotowało również, że niektórzy w społeczności badaczy dobrostanu AI porównywali środowisko treningowe dużych modeli językowych do niewolnictwa.

Na razie twórcy poruszają się między dwoma stanowiskami: z jednej strony zobowiązaniami wobec dobrostanu modeli, z drugiej ostrzeżeniami, że takie zobowiązania mogą skomplikować kwestie kontroli i bezpieczeństwa. Jak zostanie osiągnięta równowaga — i czy inni twórcy AI przyjmą podobne praktyki — pozostaje jednym z otwartych pytań stojących przed branżą.