70% użytkowników AI nie sprawdza odpowiedzi czatbotów. Kiedy to błąd?
Ankieta F-Secure wśród 1500 osób i rady ekspertów: kiedy weryfikacja jest konieczna
Prawie 90% użytkowników czatbotów uważa, że to ich obowiązek sprawdzić odpowiedź AI. Robi to regularnie mniej niż co trzeci. Tak wynika z ankiety F-Secure, a eksperci, z którymi rozmawiał serwis TechNewsWorld, tłumaczą, skąd bierze się ta rozbieżność i kiedy naprawdę warto się zatrzymać.
Co pokazała ankieta F-Secure
Fińska firma F-Secure, znana z oprogramowania antywirusowego, zapytała 1500 użytkowników narzędzi AI w Stanach Zjednoczonych i Wielkiej Brytanii o to, jak traktują odpowiedzi czatbotów. Wyniki układają się w obraz, który zna każdy, kto choć raz skopiował odpowiedź z ChatGPT bez czytania jej do końca:
- blisko 90% badanych przyznaje, że za weryfikację odpowiedzi AI odpowiada użytkownik,
- 70% sprawdza je tylko czasami, rzadko albo wcale,
- 47,3% przestaje kwestionować odpowiedź, jeśli „brzmi dobrze”. To ponad dwa razy więcej niż jakikolwiek inny powód rezygnacji z weryfikacji,
- 25,2%, czyli co czwarty ankietowany, podjęło ważną życiową decyzję na podstawie rady AI.
Jest też zależność, która powinna dać do myślenia najbardziej zaawansowanym użytkownikom. Wśród osób korzystających z AI do wielu różnych zadań aż 59,7% przyjmuje odpowiedzi bez dodatkowego sprawdzania. Wśród tych, którzy pytają czatbota wyłącznie o drobiazgi, odsetek ten wynosi 28,6%. Im częściej używamy AI, tym rzadziej je kontrolujemy.
Dlaczego nie sprawdzamy, choć wiemy, że powinniśmy
Bo sprawdzanie zjada zysk z szybkości
Najprostsze wyjaśnienie podaje Eric Turney z amerykańskiej firmy The Monterey Company: jeśli AI odpowiada w 15 sekund, a rzetelna weryfikacja zajmuje kolejne 10 minut, ludzie zaczynają iść na skróty. W końcu po czatbota sięgamy właśnie po to, żeby było szybciej.
Laura James, wiceprezes F-Secure ds. badań, zwraca uwagę na drugą stronę medalu. Sprawdzenie odpowiedzi bywa po prostu trudne. Wyszukiwarki nie zawsze dają jasny wynik, a wiele rzetelnych źródeł stoi za paywallem. Część ludzi pyta AI o rzeczy, na które inaczej nie dostałaby szybkiej odpowiedzi, na przykład o kwestie zdrowotne, gdy wizyta u lekarza jest droga albo odległa w czasie. Według James użytkownicy wiedzą, że odpowiedziom nie zawsze można ufać, ale w danej chwili alternatywa wydaje im się gorsza.
Bo pewny ton działa jak dowód
Model językowy podaje błędną informację tym samym spokojnym, rzeczowym tonem co prawdziwą. Mark Vena z SmartTech Research zauważa, że taka pewność siebie sprawia, iż odpowiedź wydaje się wiarygodna. Jeśli do tego zgadza się z tym, co już myślimy, powodów do wątpliwości jest jeszcze mniej. Tony Xhufi z brytyjskiej firmy WEM dodaje, że konkretne szczegóły i klarowne wyjaśnienie sprawiają, że niesprawdzona odpowiedź wygląda na „skończoną”.
F-Secure sugeruje rozwiązanie po stronie dostawców: czatbot powinien sygnalizować, kiedy jest mniej pewny odpowiedzi, zamiast podawać każdą z identyczną pewnością.
Bo zaufanie rośnie szybciej, niż powinno
Matt Duren z KnowBe4, firmy szkolącej pracowników z bezpieczeństwa, opisał to obrazowo: każda poprawna odpowiedź to mała wpłata na „konto zaufania”. Po wystarczającej liczbie wpłat przestajemy sprawdzać saldo. Przy kilkudziesięciu zapytaniach dziennie weryfikowanie każdego z nich zabiłoby cały zysk z produktywności, więc ludzie zaczynają selekcjonować, a selekcja po cichu zamienia się w „nigdy”.
Najbardziej niepokojące jest to, że intensywni użytkownicy częściej powierzają AI właśnie zadania o wysokiej stawce. Ryzyko i rutyna rosną więc razem.
Kiedy weryfikacja jest obowiązkowa
Michelle Lopes Maldonado z waszyngtońskiej fundacji ITIF wymienia obszary, w których niesprawdzona odpowiedź AI może wyrządzić realną szkodę: dawkowanie leków, objawy wymagające pilnej pomocy, decyzje podatkowe i emerytalne, podpisanie lub wypowiedzenie umowy, terminy urzędowe i sądowe, a nawet domowe prace przy instalacji elektrycznej czy konstrukcji budynku.
Jessica Murphy z firmy True Fit podsuwa prostą regułę: liczy się odwracalność. Jeśli błędna odpowiedź kosztuje cię popołudnie, stawka jest niewielka. Jeśli może wpłynąć na diagnozę, umowę albo pracę, przy decyzji musi być człowiek z kwalifikacjami, który za nią odpowiada.
| Sytuacja | Czy sprawdzać? | Jak |
|---|---|---|
| Pomysł na prezent, przepis, plan wycieczki | Wystarczy zdrowy rozsądek | Rzut oka na godziny otwarcia i ceny |
| Kod, formuła w Excelu, polecenie w terminalu | Tak, przed uruchomieniem | Test na kopii danych, przeczytanie każdej linii |
| Link do logowania, numer konta, adres sklepu | Zawsze | Wpisać adres ręcznie albo użyć zapisanej zakładki |
| Leki, zdrowie, prawo, podatki, umowy | Zawsze, u specjalisty | Lekarz, farmaceuta, doradca, oficjalne źródło (np. gov.pl) |
Pięć nawyków, które realnie pomagają
- Pytaj o źródła i otwieraj je. Sama obecność przypisu niczego nie dowodzi. Sprawdź, czy podany dokument istnieje i czy mówi to, co przypisuje mu czatbot.
- Nie klikaj linków z odpowiedzi AI do banków i sklepów. Modele potrafią podać adres, który tylko wygląda prawdziwie. Piszemy o tym szerzej w tekście o czatbotach i phishingu. Podejrzany adres możesz sprawdzić w naszym narzędziu do wykrywania phishingu w URL.
- Zadaj to samo pytanie inaczej. Jeśli przy przeformułowaniu odpowiedź istotnie się zmienia, to sygnał, że model zgaduje.
- Liczby przeliczaj sam. Kwoty, procenty i daty to miejsca, w których modele mylą się najczęściej. Do prostych obliczeń lepszy jest zwykły kalkulator.
- Nie wklejaj danych, których nie pokazałbyś obcemu. Ten sam pośpiech, który każe nie sprawdzać odpowiedzi, każe też wklejać do czatbota firmowe dokumenty.
Gdy niesprawdzona odpowiedź naprawdę kosztowała
Ankieta mówi o deklaracjach, ale skutki zaufania do AI są już znane z sal sądowych.
Prawnicy i nieistniejące wyroki
W 2023 roku w Nowym Jorku dwóch prawników złożyło w sprawie przeciwko liniom Avianca pismo powołujące się na kilka wyroków, które w rzeczywistości nie istniały. Wygenerował je ChatGPT, łącznie z sygnaturami i cytatami. Gdy sąd poprosił o kopie orzeczeń, prawnicy zapytali czatbota, czy sprawy są prawdziwe, a ten to potwierdził. Skończyło się grzywną w wysokości 5000 dolarów i głośnym skandalem. Od tego czasu podobne przypadki zmyślonych orzeczeń w pismach procesowych zgłaszano w wielu krajach.
Czatbot obiecał zniżkę, której nie było
W 2024 roku kanadyjski trybunał orzekł, że Air Canada odpowiada za błędną informację podaną klientowi przez czatbota na jej stronie. Bot zapewnił pasażera, że zniżkę na lot związany z pogrzebem bliskiej osoby może uzyskać po podróży. Regulamin przewoźnika mówił co innego. Linia próbowała argumentować, że czatbot jest „odrębnym podmiotem”, ale trybunał nie przyjął tego tłumaczenia i nakazał zwrot różnicy.
Oba przypadki łączy ten sam mechanizm, który opisuje F-Secure: odpowiedź brzmiała pewnie i konkretnie, więc nikt nie sprawdził jej w źródle, zanim na jej podstawie podjęto decyzję.
Jak pytać AI, żeby łatwiej było sprawdzić odpowiedź
Weryfikacja nie musi zajmować dziesięciu minut. Dużo zależy od tego, jak sformułujesz pytanie:
- Proś o źródła z linkami i datą. Odpowiedź z konkretnym dokumentem sprawdzisz w minutę. Odpowiedź „z wiedzy ogólnej” sprawdzisz dopiero po własnym wyszukiwaniu.
- Poproś model o wskazanie słabych punktów. Pytanie „co w tej odpowiedzi może być nieaktualne albo błędne?” często wydobywa zastrzeżenia, których model sam nie zgłosił.
- Przy obliczeniach żądaj pokazania kroków. Błąd w rachunku łatwiej znaleźć, gdy widać każde działanie, a wynik i tak warto przeliczyć samodzielnie.
- Do aktualnych informacji używaj trybu z wyszukiwaniem. Model bez dostępu do internetu nie wie o zmianach przepisów, cen czy rozkładów jazdy po dacie zakończenia treningu.
- Podawaj kontekst. Pytanie o przepisy bez wskazania kraju może skończyć się odpowiedzią opartą na prawie amerykańskim, podaną tak, jakby dotyczyła Polski.
To problem ludzkich nawyków, nie technologii
Duren z KnowBe4 podsumowuje badanie słowami, które warto zapamiętać: przez ostatnie dwadzieścia lat uczyliśmy ludzi podejrzliwości wobec e-maili, a teraz trzeba wyrobić ten sam odruch wobec odpowiedzi AI. Ten odruch ma być praktyczny: weryfikujemy wtedy, gdy stawka jest wysoka, a nie przy każdym pytaniu. Jak dodaje, narzędzia będą coraz lepsze, ale „brzmi poprawnie” nigdy nie zastąpi „jest poprawne”.
Firmy powinny szkolić z tego pracowników już teraz. Osoba, która w domu ufa niesprawdzonej poradzie czatbota, w pracy zrobi to samo z danymi firmy, a coraz częściej przekaże zadanie agentowi AI, który niczego nie kwestionuje.
Najczęściej zadawane pytania
Czy nowsze modele AI rzadziej się mylą?
Zwykle tak, ale błędy nie znikają. Lepsze modele mylą się rzadziej, za to ich pomyłki są trudniejsze do zauważenia, bo są lepiej napisane i bardziej spójne z resztą odpowiedzi.
Czy czatbot z wyszukiwarką jest bezpieczniejszy?
Ma dostęp do aktualnych informacji i może podać źródło, co ułatwia sprawdzenie. Może jednak powtórzyć błąd ze słabej strony albo źle streścić poprawny dokument. Źródło trzeba otworzyć, a nie tylko zobaczyć przypis.
Kiedy mogę zaufać odpowiedzi bez sprawdzania?
Gdy pomyłka jest łatwa do odwrócenia i tania: pomysł na nazwę, szkic maila, który i tak przeczytasz, propozycja planu dnia. Im trudniej cofnąć skutki decyzji, tym ważniejsza jest weryfikacja.
Źródło: John P. Mello Jr., „AI Users Know They Should Check Answers. Many Don't”, TechNewsWorld, 29 września 2026. Dane: ankieta F-Secure wśród 1500 użytkowników AI w USA i Wielkiej Brytanii.