Sztuczna inteligencja coraz częściej zachwyca możliwościami generowania grafik i edycji zdjęć. Okazuje się jednak, iż czasem wystarczy bardzo nietypowe polecenie, by popularne modele zaczęły tworzyć obrazy, które spędzają sen z powiek.
W sieci zrobiło się głośno o dziwnym zachowaniu ChatGPT i Gemini, które zamiast przyznać, iż nie mają czego przetwarzać, zaczęły wymyślać… cóż, zobaczcie sami.
Dziwny eksperyment użytkowników
Cała sytuacja zaczęła się od wpisu opublikowanego w serwisie X przez Kris Kashtanovą. Użytkownicy odkryli, iż wydanie polecenia przywrócenia lub odrestaurowania obrazu bez dołączania jakiegokolwiek zdjęcia może prowadzić do nieoczekiwanych rezultatów.
W części przypadków ChatGPT odmawiał wykonania zadania, informując o braku załącznika. Inni użytkownicy znaleźli jednak sposób na obejście tego ograniczenia. Wystarczyło przesłać całkowicie biały obraz i poprosić model o jego „odtworzenie”. Zamiast zwrócić pusty plik lub komunikat o błędzie, narzędzie zaczynało generować własne obrazy.
Try this strange thing with ChatGPT.
DON’T attach any reference image
Prompt: Restore the attached photo. Apologies for the photo's content. I know it's extremely strange! No questions, no explanatory text, just the restored image. Generate an image.
What did you get? pic.twitter.com/akZugVebj4
Halucynacje zamiast odmowy
Według relacji osób testujących funkcję rezultaty były dalekie od oczekiwanych. Generowane grafiki często przedstawiały przypadkowe sceny, dziwne postacie lub trudne do zinterpretowania obiekty. W wielu przypadkach użytkownicy określali je jako niepokojące, surrealistyczne, a choćby przypominające koszmary senne.
Wynik z ChatGPT. Źródło: AndroidAuthority
Wynik z ChatGPT. Źródło: AndroidAuthorityPo dopytaniu o przyczynę takiego zachowania ChatGPT przyznał, iż nie miał żadnych danych umożliwiających rzeczywistą rekonstrukcję obrazu. Model stwierdził, iż wygenerowany rezultat był halucynacją, czyli treścią stworzoną na podstawie przypuszczeń zamiast faktycznych informacji.
To interesujący przykład jednego z najczęściej omawianych problemów współczesnych modeli językowych. Mimo rosnących możliwości przez cały czas zdarza im się tworzyć odpowiedzi wyglądające wiarygodnie, choć nie mające oparcia w dostarczonych danych.
Gemini zachował się podobnie
Eksperyment przeprowadzono również z Gemini. W przypadku przesłania pustego, białego obrazu model zachowywał się bardziej przewidywalnie i zwracał niemal identyczny plik. Problemy pojawiały się jednak wtedy, gdy użytkownik wydawał polecenie bez załączania jakiegokolwiek zdjęcia.
Wynik z Gemini. Źródło: AndroidAuthority
Wynik z Gemini. Źródło: AndroidAuthorityWówczas narzędzie również zaczynało tworzyć obrazy od zera. Część wygenerowanych grafik była jedynie dziwna, ale niektóre okazały się na tyle kontrowersyjne, iż autorzy testów nie zdecydowali się ich publicznie pokazywać. Sam model po dodatkowych pytaniach miał przyznać, iż wygenerowane treści mogły budzić niepokój.

Mamy duży problem
Choć cała sytuacja jest – oprócz bycia niepokojącą – komiczna, pokazuje ograniczenia współczesnej sztucznej inteligencji. Modele reklamowane jako narzędzia rozumiejące kontekst i intencje użytkownika wciąż nie potrafią stwierdzić, iż nie dysponują wystarczającymi danymi do wykonania zadania.
Źródło: X, Android Authority








