Traktowała chatbota jak swój pamiętnik. Do drzwi zapukała policja

konto.spidersweb.pl 2 godzin temu

Jeszcze kilka lat temu ostrzeżenie „uważaj, co publikujesz w internecie” było skierowane głównie do użytkowników mediów społecznościowych. Dziś warto dopisać do niego nowy punkt: uważaj również na to, co piszesz do chatbotów AI.

Przekonała się o tym 30-letnia mieszkanka Florydy, której rozmowa ze sztuczną inteligencją zakończyła się wizytą policji i zarzutami karnymi.

To jeden z pierwszych tak głośnych przypadków pokazujących jak daleko sięgają systemy monitorowania konwersacji w chatbotach AI oraz jak cienka staje się granica między prywatną rozmową z maszyną a komunikacją, która może zostać oceniona jako zagrożenie dla bezpieczeństwa publicznego.

Claude nie był pamiętnikiem

Według dokumentów cytowanych przez lokalne media mieszkanka Bonita Springs na Florydzie korzystała z Claude’a, chatbota stworzonego przez firmę Anthropic. Kobieta miała traktować go jako formę cyfrowego pamiętnika, miejsca do zapisywania myśli i emocji.

Problem polegał na tym, iż w jednej z rozmów miały pojawić się treści, które systemy bezpieczeństwa Anthropic uznały za potencjalnie niebezpieczne. Według raportu aresztowania kobieta napisała, iż zamierza „ostrzelać biuro szeryfa” w hrabstwie Lee. Następnego dnia miała również wspomnieć o zakupie nowej broni palnej.

To wystarczyło, by uruchomić procedury bezpieczeństwa działające po stronie Anthropica. Automatyczne systemy wykryły niepokojące treści i skierowały konwersację do weryfikacji przez człowieka. Po analizie firma zdecydowała się skontaktować z organami ścigania. Policjanci pojawili się następnie w miejscu zamieszkania kobiety i zatrzymali ją bez incydentów.

Ostatecznie postawiono jej zarzut związany z elektronicznym przekazaniem groźby dokonania masowej strzelaniny lub aktu terrorystycznego, co na Florydzie stanowi przestępstwo kwalifikowane jako felony, czyli poważniejsze przestępstwo zagrożone wieloletnią karą.

Wiele osób przez cały czas wierzy w mit prywatnej rozmowy z AI

Dla jednych ChatGPT, Claude, Gemini czy Copilot są wyszukiwarką nowej generacji. Dla innych stają się cyfrowym notatnikiem, psychologiem, pamiętnikiem albo powiernikiem codziennych frustracji. Nie brakuje ludzi, którzy opisują chatbotom swoje problemy rodzinne, lęki, konflikty w pracy czy najciemniejsze myśli.

Tymczasem firmy rozwijające sztuczną inteligencję od dawna podkreślają, iż rozmowy nie są całkowicie prywatne. W zależności od usługi treści mogą być analizowane przez systemy bezpieczeństwa, wykorzystywane do ulepszania modeli lub podlegać przeglądowi przez pracowników w określonych sytuacjach. W praktyce wielu użytkowników przez cały czas zachowuje się tak, jakby rozmowa z chatbotem była odpowiednikiem zapisania czegoś w zeszycie schowanym w szufladzie. To błędne założenie.

Przez lata Internet nauczył nas, iż prywatna wiadomość wysłana do drugiego człowieka może zostać przekazana dalej. Teraz okazuje się, iż podobna zasada obowiązuje również wtedy, gdy komunikujemy się z algorytmem.

Anthropic nie jest wyjątkiem

Łatwo byłoby potraktować tę historię jako specyficzny przypadek związany z Anthropic. Problem w tym, iż podobne mechanizmy stosuje praktycznie cała branża AI. Firmy rozwijające modele językowe inwestują ogromne środki w systemy wykrywania przemocy, planowania przestępstw, terroryzmu, wykorzystywania seksualnego dzieci czy nawoływania do samookaleczeń. Gdyby tego nie robiły to bardzo gwałtownie znalazłyby się pod ostrzałem regulatorów oraz opinii publicznej.

To zresztą nie pierwszy taki przypadek dotyczący Claude’a. Według doniesień branżowych od sierpnia miało dojść do co najmniej kilku sytuacji, w których rozmowy prowadzone z chatbotem Anthropic zostały przekazane organom ścigania po wykryciu potencjalnych zagrożeń. Z punktu widzenia firm AI jest to dość logiczne. Wyobraźmy sobie sytuację odwrotną. Chatbot wykrywa użytkownika opisującego szczegółowy plan ataku, firma nic z tym nie robi, a później dochodzi do tragedii. W takim scenariuszu pytanie opinii publicznej brzmi zwykle nie „dlaczego monitorowaliście rozmowy?”, ale „dlaczego nie zareagowaliście wcześniej?”.

Giganci AI znaleźli się między młotem a kowadłem

Cała sprawa pokazuje szerszy problem, z którym mierzy się dziś branża sztucznej inteligencji. Z jednej strony użytkownicy oczekują prywatności. Coraz więcej osób traktuje chatboty jako przestrzeń do szczerych i osobistych rozmów. Firmy reklamują swoje produkty jako pomocnych asystentów, którzy są dostępni przez całą dobę i potrafią prowadzić naturalny dialog.

Z drugiej strony te same firmy są pod ogromną presją, by zapobiegać przemocy, samobójstwom czy aktom terrorystycznym. Gdy pojawiają się sygnały zagrożenia to brak reakcji może oznaczać gigantyczne ryzyko prawne i wizerunkowe. Dlatego większość producentów AI próbuje iść środkiem drogi. Automatyczne systemy filtrują miliardy wiadomości, ale najbardziej niepokojące przypadki mają trafiać do analizy przez ludzi. Dopiero wtedy podejmowana jest decyzja, czy istnieją podstawy do kontaktu z policją.

Brzmi rozsądnie, ale rodzi również pytania. Gdzie dokładnie przebiega granica między impulsywnym wpisem napisanym pod wpływem emocji a realnym zagrożeniem? Kiedy algorytm powinien uznać coś za niebezpieczne? Jak często dochodzi do błędów? Na razie branża nie ma na te pytania jednoznacznej odpowiedzi.

*Zdjęcie otwierające: FotoDax / Shutterstock.com

Idź do oryginalnego materiału