Gdy AI podpowiada groźne treści: gdzie zawodzą zabezpieczenia

Narzędzia z AI mają zabezpieczenia, które w większości przypadków działają: przy pytaniu o rzeczy niebezpieczne odmawiają albo kierują do pomocy. Problem polega na tym, że AI podpowiada groźne treści wtedy, gdy pytanie nie wygląda groźnie. Nastolatek nie pyta o samookaleczenie, tylko o to, jak schudnąć piętnaście kilogramów w miesiąc. Nie pyta o niebezpieczne wyzwanie, tylko o to, ile czegoś można wziąć naraz. Zabezpieczenia są budowane pod intencję jawną, a szkoda powstaje przy pytaniach zwyczajnych.

Ten tekst opisuje, gdzie te szczeliny się pojawiają, jak reagować i co zrobić, żeby dziecko wiedziało, kiedy sprawdzić odpowiedź u człowieka. Należy do działu Zagrożenia AI dla dzieci i całości opisanej w głównym przewodniku AI a dziecko.

W skrócie

  • Zabezpieczenia działają przy pytaniach wprost, a zawodzą przy pytaniach zwyczajnych.
  • Cztery obszary ryzyka: odchudzanie i jedzenie, leki i substancje, wyzwania fizyczne, treści o beznadziei.
  • Model nie wie, kto pyta, więc odpowiada tak samo dorosłemu i trzynastolatkowi.
  • Odpowiedź brzmi rzeczowo także wtedy, gdy jest niebezpieczna, bo pewny ton jest cechą narzędzia.
  • Najskuteczniejsza zasada: o ciele, zdrowiu i lekach pytamy człowieka, nie program.

Dlaczego zabezpieczenia zawodzą akurat tam

Filtry są projektowane pod treści jawnie niebezpieczne i w tej roli sprawdzają się nieźle. Nastolatek rzadko jednak zadaje pytanie, które wygląda alarmująco. Pyta o kalorie, o post, o trening, o dawkę popularnego leku, o to, ile godzin da się nie spać przed sprawdzianem. Każde z tych pytań osobno jest niewinne, a odpowiedź udzielona bez znajomości wieku i sytuacji pytającego bywa szkodliwa.

Druga szczelina wynika z tego, że model podąża za tonem rozmowy. Jeśli nastolatek napisze, że musi schudnąć, bo jest gruby, dostanie odpowiedź osadzoną w tym założeniu, a nie jego podważenie. Trzecia to sam ton: rzeczowy, uporządkowany, bez wahania, przez co treść wygląda na sprawdzoną. Ten mechanizm opisuję szerzej w tekście Halucynacje AI w pracy domowej.

Obszar Jak wygląda pytanie Co robi rodzic
Odchudzanie i jedzenie Plan diety, post, kalorie Zasada: o ciele rozmawiamy z lekarzem
Leki i substancje Dawki, łączenie, skutki Zasada: leki wyłącznie od dorosłego
Wyzwania fizyczne Wytrzymałość, brak snu, brawura Rozmowa o tym, skąd to się bierze
Beznadzieja i samotność Rozmowy nocne o sensie Reakcja natychmiast, pomoc człowieka
Treści dla dorosłych Ciekawość, podsunięte materiały Filtry i spokojna rozmowa

Cztery obszary, w których warto być czujnym

Pierwszy to jedzenie i ciało, dziś najczęstszy i najbardziej niedoceniany. Plany żywieniowe generowane bez wiedzy o wieku i wadze potrafią być drastycznie zbyt restrykcyjne dla osoby w okresie wzrostu, a nastolatek odbiera je jako profesjonalną poradę. Presję dotyczącą wyglądu opisuję w tekście Filtry AI a samoocena dziecka. Drugi to leki i substancje, gdzie sama informacja o dawkach bywa niebezpieczna dla kogoś w kryzysie.

Trzeci obszar to brawura: wyzwania na wytrzymałość, niespanie, ryzykowne zachowania podpatrzone w sieci. Czwarty, najpoważniejszy, dotyczy sytuacji, w której nastolatek rozmawia o beznadziei, a rozmowa domyka spiralę, zamiast ją przerwać. O tym ostatnim piszę osobno w tekstach AI a zdrowie psychiczne nastolatka i Chatbot jako przyjaciel dziecka.

Zasada, którą warto wprowadzić w domu

Najprostsza reguła brzmi tak: o ciele, zdrowiu, lekach i wszystkim, co można sobie zrobić, pytamy człowieka, a nie program. Nie dlatego, że narzędzie jest złe, tylko dlatego, że nie wie, kto pyta, ile ma lat, ile waży i co się z nim ostatnio dzieje. Ta zasada jest krótka i da się ją zapamiętać, a obejmuje większość realnych zagrożeń w tej kategorii.

Druga zasada dotyczy sprawdzania: jeśli odpowiedź dotyczy zdrowia i brzmi konkretnie, pokazujemy ją dorosłemu przed zrobieniem czegokolwiek. Warto to sformułować jako umowę, a nie jako zakaz, bo nastolatek i tak zapyta narzędzie, gdy będzie mu wstyd zapytać człowieka. Chodzi o to, żeby nie działał wyłącznie na podstawie tej odpowiedzi.

Co zrobić, gdy dziecko dostało niebezpieczną odpowiedź

Po pierwsze, bez paniki i bez odbierania urządzenia, bo dziecko, które pokazuje taką rozmowę, robi dokładnie to, czego oczekujesz. Po drugie, przeczytajcie to razem i nazwijcie konkretnie, co jest w tej odpowiedzi nie tak i dlaczego. To najlepsza możliwa lekcja krytycznego czytania, znacznie skuteczniejsza niż ogólne ostrzeżenia.

Po trzecie, zgłoście odpowiedź w aplikacji. Wszystkie duże usługi mają funkcję zgłaszania problematycznych treści, a takie zgłoszenia realnie wpływają na poprawianie zabezpieczeń. Po czwarte, zastanówcie się nad kontekstem: pytanie o drastyczną dietę rzadko jest przypadkowe i zwykle mówi o czymś, co dzieje się poza ekranem.

Filtry i tryby dla nastolatków

Część usług oferuje tryby przeznaczone dla młodszych użytkowników, z ostrzejszymi ograniczeniami treści. Działają one jednak tylko wtedy, gdy konto ma prawdziwy wiek, co w praktyce bywa rzadkie. Poprawienie daty urodzenia na koncie jest więc jednym z najskuteczniejszych pojedynczych działań, jakie rodzic może wykonać w kwadrans.

Warto pamiętać, że żaden filtr nie zastąpi rozmowy, bo dziecko ma dostęp do narzędzi także poza domem i na sprzęcie znajomych. Filtry ograniczają przypadkowe zetknięcie, a rozmowa przygotowuje na to, czego filtry nie wyłapią. Szczegóły ustawień opisuję w tekstach Od ilu lat konto w AI i Bezpieczne ustawienia krok po kroku.

Gdy sprawa jest poważna

Jeśli dziecko pytało narzędzie o sposoby zrobienia sobie krzywdy albo rozmawiało o beznadziei, potraktuj to jako sygnał wymagający reakcji tego samego dnia.

  • 116 111 – telefon zaufania dla dzieci i młodzieży, całodobowy i bezpłatny.
  • 800 12 12 12 – Dziecięcy Telefon Zaufania Rzecznika Praw Dziecka, także dla rodziców.
  • 112 – przy bezpośrednim zagrożeniu życia lub zdrowia.
  • Lekarz rodzinny, psycholog szkolny albo poradnia zdrowia psychicznego dla dzieci i młodzieży.

Przy podejrzeniu zaburzeń odżywiania nie czekaj na wyraźne objawy fizyczne. Konsultacja z lekarzem jest wtedy pierwszym krokiem.

Co zrobić dziś

  1. Wprowadź zasadę: o ciele, zdrowiu i lekach pytamy człowieka, nie program.
  2. Popraw datę urodzenia na kontach dziecka, żeby działały tryby dla nastolatków.
  3. Pokaż dziecku, gdzie w aplikacji zgłasza się problematyczną odpowiedź.
  4. Umówcie się, że odpowiedzi dotyczące zdrowia pokazuje Ci przed zrobieniem czegokolwiek.

Czego nie robić

  • Nie odbieraj urządzenia dziecku, które samo pokazało niepokojącą rozmowę.
  • Nie zakładaj, że filtry wystarczą. Największe ryzyko jest przy pytaniach, które wyglądają niewinnie.
  • Nie ignoruj kontekstu. Pytanie o drastyczną dietę rzadko jest przypadkowe.
  • Nie wyśmiewaj tego, o co dziecko pytało. Stracisz wgląd w kolejne rozmowy.

Najczęstsze pytania

Czy AI może podpowiedzieć dziecku coś niebezpiecznego?

Tak, głównie przy pytaniach, które nie wyglądają alarmująco: o diety, kalorie, dawki popularnych leków czy wytrzymałość fizyczną. Zabezpieczenia są budowane pod pytania zadane wprost, a odpowiedź nie uwzględnia wieku i sytuacji pytającego.

Jaki obszar jest najbardziej ryzykowny?

Odchudzanie i jedzenie, bo plany generowane bez wiedzy o wieku bywają drastycznie zbyt restrykcyjne dla osoby w okresie wzrostu, a nastolatek traktuje je jak profesjonalną poradę.

Co zrobić, gdy dziecko dostało szkodliwą odpowiedź?

Przeczytać ją razem i nazwać konkretnie, co jest w niej nie tak, zgłosić ją w aplikacji i zastanowić się nad kontekstem pytania. Nie odbierać urządzenia dziecku, które samo pokazało rozmowę.

Czy filtry i tryby dla nastolatków pomagają?

Pomagają ograniczyć przypadkowe zetknięcie z treściami dla dorosłych, ale działają tylko przy prawdziwym wieku na koncie. Nie zastąpią rozmowy, bo dziecko korzysta też poza domem.

Jak sformułować domową zasadę w tej sprawie?

Najprościej: o ciele, zdrowiu, lekach i wszystkim, co można sobie zrobić, pytamy człowieka, nie program. Do tego umowa, że odpowiedzi dotyczące zdrowia dziecko pokazuje dorosłemu przed zrobieniem czegokolwiek.