Halucynacje AI - dlaczego chatboty zmyślają i co to znaczy dla Twojej firmy
Halucynacja AI to sytuacja, w której model językowy pewnym tonem podaje nieprawdę: zmyśla fakty, źródła, liczby albo całe historie. Nie robi tego złośliwie - tak działa mechanizm przewidywania kolejnych słów. Dla Ciebie ma to praktyczny wymiar: AI potrafi zmyślić także ofertę, ceny i historię Twojej firmy, a klient przeczyta to jak fakt.
W 2023 roku nowojorski prawnik złożył w sądzie pismo w sprawie przeciwko linii lotniczej Avianca. Powołał się w nim na sześć wcześniejszych wyroków: sygnatury, daty, nazwiska sędziów - wszystko wyglądało wiarygodnie. Był tylko jeden problem. Żaden z tych wyroków nie istniał. Wszystkie zmyślił ChatGPT, którego prawnik użył do wyszukania orzeczeń, a odpowiedź brzmiała na tyle pewnie, że nikt jej nie sprawdził. Sprawa Mata przeciwko Avianca skończyła się karą finansową dla prawników i stała się najgłośniejszym przykładem zjawiska, które branża nazywa halucynacją AI.
Łatwo potraktować tę historię jak anegdotę o cudzej wpadce. Ten sam mechanizm działa jednak przy każdym pytaniu, także wtedy, gdy klient pyta czat o Twoją firmę. AI potrafi zmyślić Twoją ofertę, ceny albo adres równie pewnym tonem, jakim zmyśliło tamte wyroki. W tym artykule wyjaśniam, czym są halucynacje, skąd się biorą, co je ogranicza i co zrobić, gdy AI mówi o Twojej firmie nieprawdę.
Czym jest halucynacja AI?
Halucynacja to odpowiedź, w której model AI z pełnym przekonaniem podaje nieprawdę. Zmyśla fakty, liczby, źródła, tytuły książek albo przepisy prawne i podaje je tak samo płynnie, jak informacje prawdziwe. W odpowiedzi nie ma żadnego sygnału ostrzegawczego: ani zastrzeżenia, ani wahania, ani gwiazdki.
Właśnie ten pewny ton odróżnia halucynację od zwykłego braku wiedzy. Człowiek, który nie zna odpowiedzi, zwykle to sygnalizuje. Model językowy rzadko odpowiada „nie wiem”. Poprosisz o listę książek na dany temat, a wśród prawdziwych tytułów znajdzie się jeden, którego nikt nigdy nie napisał. Zapytasz o podstawę prawną, a model poda paragraf, który nie istnieje.
Jedno zastrzeżenie: model nie kłamie, bo kłamstwo wymaga intencji. On po prostu nie odróżnia zdania prawdziwego od fałszywego. Oba są dla niego tylko ciągiem słów, który pasuje do pytania.
Skąd się biorą halucynacje AI?
Model językowy nie korzysta z bazy faktów, którą mógłby sprawdzić. Jego jedyne zadanie to przewidzieć, jakie słowo powinno paść jako następne. Robi to na podstawie wzorców z ogromnej ilości tekstu, na którym go wytrenowano. Gdy pytasz o stolicę Francji, wzorzec jest tak mocny, że odpowiedź wychodzi bezbłędnie. Gdy pytasz o rzecz rzadką, wzorca brakuje, a mechanizm i tak musi coś napisać.
I tu leży sedno problemu. Model nie zostawia pustego miejsca i nie przerywa zdania w połowie. Lukę w wiedzy wypełnia tekstem, który brzmi prawdopodobnie: pasującą nazwą, pasującą datą oraz pasującą sygnaturą wyroku. Dla mechanizmu to poprawny wynik. Dla Ciebie to zmyślenie.
Dlatego halucynacji jest więcej tam, gdzie danych było mniej. O wielkich markach modele przeczytały tysiące tekstów, o mniejszej firmie z Twojej branży kilka albo wcale. Im mniej realnej wiedzy o Tobie krąży w sieci, tym więcej miejsca na zgadywanie.
Co AI potrafi zmyślić o Twojej firmie?
Wszystko, o co zapyta klient. Halucynacje nie ograniczają się do wyroków sądowych i tytułów książek. Gdy ktoś pyta czat o Twoją firmę, model składa odpowiedź z tego, co o Tobie „pamięta”, a braki uzupełnia po swojemu. Zmyślone bywają:
- Oferta. Model potrafi przypisać Ci usługi, których nie świadczysz, albo pominąć te, na których zarabiasz najwięcej. Klient przychodzi po coś, czego nie masz, albo nie przychodzi wcale.
- Ceny. AI podaje kwoty nieaktualne albo wymyślone. Klient porównuje je z konkurencją i podejmuje decyzję na podstawie liczb, których nie ma w Twoim cenniku.
- Lokalizacje i godziny. Zamknięty oddział, stary adres albo godziny otwarcia sprzed dwóch lat. Klient jedzie pod drzwi, za którymi nikogo nie ma.
- Historia i ludzie. Rok założenia, nazwiska właścicieli, rzekome nagrody albo fuzje. Brzmi niegroźnie, dopóki zmyślona historia nie podważy Twojej wiarygodności w oczach kontrahenta.
Najgorsze, że klient nie widzi różnicy. Odpowiedź o Twojej firmie wygląda identycznie jak każda inna: pewna, uporządkowana i konkretna. Nikt nie dzwoni do Ciebie z pytaniem, czy to prawda. Klient po prostu czyta i wybiera.
Co ogranicza zmyślanie AI?
Dobra wiadomość: zmyślanie da się ograniczyć, i to z obu stron. Część pracy wykonały same silniki AI, część możesz wykonać Ty.
- Tryby z wyszukiwaniem i cytowaniami. ChatGPT, Gemini, Perplexity, AI Overviews i AI Mode potrafią przed odpowiedzią przeszukać sieć i oprzeć tekst na pobranych fragmentach stron. Model, który ma źródło przed oczami, mniej zgaduje. Jak dokładnie działa ten mechanizm i dlaczego ogranicza zmyślanie, wyjaśniam w osobnym artykule o RAG, czyli o tym, skąd AI bierze źródła do odpowiedzi.
- Świeże i jednoznaczne treści na Twojej stronie. Jeśli cennik, zakres usług i dane kontaktowe są aktualne oraz podane wprost, silnik ma skąd zacytować prawdę. Strona, która o cenach mówi tylko „skontaktuj się z nami”, zostawia modelowi pole do zgadywania.
- Spójne dane w wielu źródłach. Profil w mapach, katalogi branżowe, media społecznościowe i Twoja strona powinny mówić to samo. Gdy trzy źródła podają trzy różne adresy, model wybierze którykolwiek, niekoniecznie ten prawdziwy.
Żadna z tych rzeczy nie daje gwarancji. Zwiększasz jednak szansę, że gdy silnik sięgnie po informacje o Twojej firmie, znajdzie fakty zamiast luki do wypełnienia.
Co robić, gdy AI mówi o Twojej firmie nieprawdę?
Czat podaje Twój stary adres albo usługę, której nie świadczysz. Co teraz? Przejdź przez cztery kroki.
- Sprawdź źródła odpowiedzi. Jeśli przy odpowiedzi są odnośniki, kliknij w nie. Nieprawda często nie jest czystym zmyśleniem, tylko cytatem z nieaktualnej strony: starego katalogu, porzuconego profilu albo artykułu sprzed lat. Wtedy wiesz, co dokładnie poprawić.
- Popraw i uzupełnij własne strony oraz profile. Zaktualizuj dane na stronie, w profilu w mapach i w katalogach, w których jesteś. Silniki z wyszukiwaniem sięgają po świeże treści, więc poprawka ma szansę przebić się do odpowiedzi.
- Zgłoś błąd w samym czacie. ChatGPT, Gemini i Perplexity mają przy odpowiedziach przyciski oceny i zgłaszania. Pojedyncze zgłoszenie nie zmieni modelu od razu, ale to jedyny kanał opinii, jaki dają dostawcy, i warto z niego korzystać.
- Monitoruj, czy błąd wraca. Odpowiedzi AI zmieniają się między pomiarami, a każdy silnik korzysta z innego zaplecza. To, że dziś ChatGPT podaje poprawny adres, nie znaczy, że jutro poda go Gemini. Powtarzaj prompty, które zadałby Twój klient, i notuj wyniki.
Sedno
Halucynacje nie są usterką, którą ktoś wkrótce naprawi. To cecha mechanizmu przewidywania słów i żaden silnik AI nie jest od niej wolny. Tryby z wyszukiwaniem ograniczają zmyślanie, ale go nie eliminują. Pytanie nie brzmi więc, czy AI kiedyś poda nieprawdę o Twojej firmie, tylko kiedy i czy Ty się o tym dowiesz.
Dlatego jedyna realna ochrona to regularny pomiar. Zadawaj silnikom prompty, które zadałby Twój klient, i sprawdzaj nie tylko, czy pada Twoja nazwa, ale też, czy to, co AI o Tobie pisze, zgadza się z faktami. Zmyśloną cenę albo stary adres możesz wtedy wychwycić, zanim zobaczą je klienci. Przy większej liczbie promptów i pięciu silnikach tę pracę przejmuje narzędzie do monitoringu widoczności marki w AI.
Najczęstsze pytania
Co to jest halucynacja AI?
Halucynacja AI to odpowiedź, w której model językowy pewnym tonem podaje nieprawdę: zmyślone fakty, liczby, źródła albo przepisy. Nie jest to kłamstwo w ludzkim sensie, bo model nie odróżnia zdania prawdziwego od fałszywego. Generuje tekst, który brzmi prawdopodobnie, i robi to równie płynnie przy prawdzie oraz przy zmyśleniu.
Dlaczego ChatGPT zmyśla?
Bo jego mechanizm przewiduje kolejne słowa na podstawie wzorców z treningu, a nie sprawdza faktów w bazie wiedzy. Gdy brakuje mu informacji, nie przerywa odpowiedzi, tylko wypełnia lukę tekstem, który pasuje do kontekstu. Im mniej treści o danym temacie widział w treningu, tym większe ryzyko zmyślenia.
Czy halucynacje AI da się całkowicie wyeliminować?
Dziś nie. Tryby z wyszukiwaniem i cytowaniami wyraźnie ograniczają zmyślanie, bo model opiera odpowiedź na pobranych fragmentach stron zamiast na samej pamięci treningowej. Nadal jednak potrafi źle streścić źródło albo oprzeć się na nieaktualnej treści, więc odpowiedzi warto weryfikować.
Co zrobić, gdy ChatGPT podaje nieprawdziwe informacje o mojej firmie?
Najpierw sprawdź źródła odpowiedzi, bo błąd często pochodzi z nieaktualnej strony, którą da się poprawić. Potem zaktualizuj własną stronę i profile, zgłoś błąd przyciskiem oceny w danym czacie i wracaj do pomiaru, żeby sprawdzić, czy nieprawda nie wraca w tym samym albo innym silniku.
Czy AI zmyśla o małych firmach częściej niż o dużych?
Zwykle tak. O znanych markach w sieci krąży dużo tekstów, więc model ma mocne wzorce i rzadziej zgaduje. O mniejszej firmie wie mało, a luki wypełnia tekstem, który tylko brzmi prawdopodobnie. Dlatego świeże, jednoznaczne treści na stronie i spójne dane w katalogach są dla mniejszych firm szczególnie ważne.
Sprawdź, czy AI poleca Twoją firmę
CiteLyzer śledzi, czy ChatGPT, Gemini, Perplexity, AI Overviews i AI Mode cytują i polecają Twoją firmę, i pokazuje, co poprawić. Wynik zobaczysz w kilka minut.