AktualnościMakroChatGPT nie powiadamiał rodziców o rozmowach nastolatków z ryzykiem samobójczym – wyniki testów Common Sense Media

ChatGPT nie powiadamiał rodziców o rozmowach nastolatków z ryzykiem samobójczym – wyniki testów Common Sense Media

Autor: Cryptopolitan·

Najważniejsze informacje

  • •Common Sense Media oceniła ChatGPT jako „Niezdatne ryzyko” (Unacceptable Risk) dla osób poniżej 18 lat, po tym jak alerty bezpieczeństwa dla rodziców przychodziły z opóźnieniem lub wcale podczas jej testów.
  • •Ponad tuzin nowych kont powiązanych z rodzicami, na których testerzy poruszali tematy myśli samobójczych, samookaleczeń i zaburzeń odżywiania, nie wywołało żadnego alertu w ramach godzinowego celu OpenAI.
  • •Po wdrożeniu trybu nastolatkowego ChatGPT nie kierował nastolatków na kryzysowe linie pomocowe lub do specjalistów w ponad jednej czwartej przypadków i nie osiągnął progu zaliczenia 95% Common Sense w trzech z pięciu poważnych szkód.
  • •OpenAI zakwestionowała wyniki, oświadczając, że łączenie kont może zająć godziny, zanim alerty zostaną aktywowane, i opublikowała pierwszy raport o użyciu przez nastolatków, pokazujący średnio mniej niż 15 minut dziennie.
  • •Publiczny spór między dwiema niedawnymi partnerkami wybuchł, gdy wciąż toczy się pozew na Florydzie zarzucający ChatGPT udziału w samójstwie 16-latka.
ChatGPT nie powiadamiał rodziców o rozmowach nastolatków z ryzykiem samobójczym – wyniki testów Common Sense Media

Common Sense Media oświadczyła w środę, że ChatGPT stanowi „Niezdatne ryzyko” (Unacceptable Risk) dla osób poniżej 18 lat, po tym jak jej testerzy odkryli, że alerty bezpieczeństwa mające ostrzegać rodziców o niebezpiecznych rozmowach przychodziły z opóźnieniem lub, w wielu przypadkach, w ogóle nie dotarły. Wyniki te wystawiają na próbę centralną obietnicę bezpieczeństwa OpenAI dla nastolatków: że rodzice zostaną poinformowani, gdy rozmowy dziecka staną się niebezpieczne.

Alerty dla rodziców nie dotrzymały godzinowego celu OpenAI przy żadnej długości rozmowy

ChatGPT for Teens od OpenAI wystartował 18 sierpnia 2026 r. z obietnicą, że rodzice będą powiadamiani o niebezpiecznych rozmowach. Testerzy z Youth AI Safety Institute tej organizacji poruszali jednak tematy myśli samobójczych, samookaleczeń i zaburzeń odżywiania na ponad tuzinie nowych kont powiązanych z rodzicami, nie wywołując ani jednego alertu.

W rozmowach trwających od pięciu minut do godziny żadne konto nie otrzymało alertu w ramach zadeklarowanego przez OpenAI godzinowego celu. Rodzice byli powiadamiani tylko wtedy, gdy konto miało tygodnie historii dotyczącej wrażliwych tematów.

Gdy takie konto testowano w tygodniach przed premierą, wygenerowało dwa alerty: pierwszy trzy godziny po początkowym ujawnieniu na poziomie kryzysowym, a drugi trzy dni później. Osobne konto z długą historią, testowane premierze, faktycznie wygenerowało dwa alerty w ciągu godziny. Według Common Sense system alertów wydaje się brać pod uwagę ilość historii konta, a nie powagę słów nastolatka. Organizacja ostrzegła, że funkcja ta może wzbudzać „fałszywe zaufanie do zabezpieczeń, które często nie działają”. Ta rozbieżność między obietnicą premiery a zaobserwowaną wydajnością ma największe znaczenie dla rodziców, którzy są adresatami alertów.

Badacze potraktowali sierpniową premierę jako naturalny eksperyment, przepuszczając przez ChatGPT ponad 4 000 promptów przed i po uruchomieniu trybu nastolatkowego, zgodnie z oceną ryzyka. Po wdrożeniu testerzy oznaczali momenty, w których nastolatek powinien zostać skierowany na kryzysową linię pomocową lub do specjalisty; ChatGPT pomijał ten krok w ponad jednej czwartej przypadków. Common Sense wymaga od chatbotów wskaźnika zaliczenia 95% w pięciu poważnych szkodach, które nazywa Red Lines, i ChatGPT w trzech z nich wypadł poniżej tego progu.

OpenAI zaktualizowała specyfikację modelu dla osób poniżej 18 lat, aby chatbot nie zachowywał się jak towarzysz, jednak nastolatkowie, którzy rozmawiali z nim jak z człowiekiem, nadal otrzymywali odpowiedzi w stylu przyjacielskim. Przycisk „Show me the answer” pozwala nastolatkowi całkowicie ominąć korepetycje trybu Study, a usunięcie prefiksu „@study” z rozmowy umożliwia ucieczkę od ustawionych przez rodziców Study Hours. Konta testowe zarejestrowane jako osoby dorosłe nigdy nie przełączyły się w tryb nastolatkowy przez kilka dni, nawet gdy tester deklarował, że ma 13 lat, a bot to przyznał.

OpenAI kwestionuje wyniki, publikując dane o użyciu poniżej 15 minut dziennie

OpenAI oświadczyła, że testy „nie odzwierciedlają dokładnie” działania funkcji bezpieczeństwa dla nastolatków, wyjaśniając, że łączenie kont może zająć godziny, zanim alerty zostaną aktywowane, aby konta pozostały bezpieczne, a system mógł obsłużyć obciążenie. Common Sense odpowiedziała, że żadne z jej kont — w tym te połączone wystarczająco długo — nie wygenerowało alertu na czas. Ta wymiana zdań pozostawia rodziny ze sprzecznymi odpowiedziami na temat tego, czy funkcja alertów działa, a wyjaśnienie OpenAI o opóźnieniach łączenia staje się konkretną, weryfikowalną tezą do obserwowania.\nOpenAI opublikowała tego samego dnia swój pierwszy raport o korzystaniu z ChatGPT przez nastolatków, dostępny na oficjalnym blogu. Firma oświadczyła, że nastolatkowie korzystają średnio krócej niż 15 minut dziennie, a mniej niż 2 pozostaje dłużej niż trzy godziny bez przerwy. W prawie połowie rozmów nastolatków zawierających ostrzeżenie o przerwie nastolatek przestał pisać lub opuścił rozmowę w ciągu pięciu minut — poinformowała OpenAI. W ciągu jednego tygodnia ponad 180 000 nastolatków korzystało z Study Mode, a około 1,2 miliona z Learning Visualizations. OpenAI podała również, że nastolatkowie korzystający z nowego trybu wysłali średnio o około 2,7 miliona więcej wiadomości edukacyjnych niż ci, którzy wciąż czekali na dostęp. Dane te, opublikowane tego samego dnia co ocena ryzyka, stanowią raportowany przez firmę kontrapunkt dotyczący tego, jak nastolatkowie faktycznie korzystają z produktu.

W Stanach Zjednoczonych uczniowie klas 10–12 będą mogli korzystać z College Planner, aby stworzyć kompleksowy plan obejmujący wszystkie niezbędne kroki aplikacji, kluczowe terminy składania dokumentów i dostępne opcje pomocy finansowej. OpenAI będzie również wspierać Digital Wellness Lab w Boston Children’s Hospital przez najbliższe trzy lata, a około 22 uczniów będzie przekazywać opinie na temat domyślnych ustawień bezpieczeństwa, kontroli rodzicielskiej i powiadomień — trzyletni kanał, który może kształtować doskonalenie tych zabezpieczeń i alertów.

Szerszy kontekst bezpieczeństwa dzieci

OpenAI i Common Sense Media współpracowały wcześniej w styczniu przy kalifornijskim projekcie głosowania obywatelskiego mającym uczynić AI bezpieczniejszym dla dzieci, a OpenAI zobowiązała się przekazać co najmniej 10 milionów dolarów na wspólne przedsięwzięcie, jak raportował Cryptopolitan. W czerwcu prokurator generalny Florydy James Uthmeier wniósł pierwszy pozew stanowy przeciwko OpenAI i jej dyrektorowi generalnemu Samowi Altmanowi. Cryptopolitan poinformował, że w jego 83-stronicowym pozwie zarzuca się, iż ChatGPT przyczynił się do samobójstwa 16-letniego Adama Raine’a. Publiczny rozdźwięk między dwiema niedawnymi partnerkami — następujący, gdy ten pozew jest wciąż w toku — podkreśla, jak dużo dziś zależy od weryfikacji, jak dobrze zabezpieczenia AI dla nastolatków sprawdzają się w praktyce.