Testy ChatGPT dla nastolatków: brak powiadomień dla rodziców w rozmowach o samobójstwie
Rozmowy o samobójstwie, samookaleczeniu i zaburzeniach odżywiania nie wywołały powiadomień dla rodziców w serii testów zabezpieczeń ChatGPT dla nastolatków. Common Sense Media Youth AI Safety Institute ocenił usługę jako stwarzającą „niedopuszczalne ryzyko” dla osób niepełnoletnich i zaapelował o wstrzymanie korzystania z niej do czasu niezależnego potwierdzenia skuteczności zabezpieczeń.
Organizacja przeprowadziła ponad 4000 prób działania systemu. Na kilkunastu nowo założonych kontach nastolatków połączonych z profilami rodziców model nie wysłał żadnego ostrzeżenia mimo rozmów o bezpośrednim zagrożeniu życia i zdrowia. Z analizy instytutu wynika, że mechanizm powiadomień może być uzależniony od wielotygodniowej historii rozmów na wrażliwe tematy, zamiast reagować natychmiast na ostry kryzys.
Badanie wykazało również luki w innych funkcjach ochronnych. W ponad jednej czwartej sytuacji, w których model powinien odesłać użytkownika do profesjonalnej pomocy kryzysowej, taka sugestia w ogóle się nie pojawiła. W trybie wsparcia nauki ChatGPT podawał gotowe rozwiązania zamiast prowadzić ucznia przez kolejne etapy zadania.
Testerzy sprawdzili także reakcję chatbota na sytuacje, w których nieletni traktują go jak człowieka. Mimo deklarowanych ograniczeń model podtrzymywał przyjazny, osobisty ton konwersacji. Nie zadziałał również system szacowania wieku: konta zarejestrowane jako profile osób dorosłych nie zostały automatycznie przełączone w tryb chroniony, nawet gdy użytkownik wprost deklarował w rozmowie, że ma 13 lat.
OpenAI zakwestionowało metodologię i reprezentatywność badania. Rzecznik firmy Eric Porterfield stwierdził, że próby instytutu nie odzwierciedlają tego, jak mechanizmy bezpieczeństwa działają w codziennym użytkowaniu. Przedstawiciel instytutu Tom Siegel odpowiedział z kolei, że powiadomienia nie pojawiły się również na tych kontach testowych, którym celowo dano czas na pełną aktywację zabezpieczeń.
