Kako se nositi s AI-jevim halucinacijama?
Većina korisnika AI alata zna da AI u svojim odgovorima može pogriješiti, ponekad i vrlo uvjerljivo. Zato njegove odgovore treba promatrati kao pomoć, a ne kao pouzdan i nepogrješiv izvor. Pokušali smo shvatiti zašto dolazi do takvih pogrešaka i kako ih prepoznati na vrijeme
Vjerujem da nema mlađe osobe koja se nije barem jednom obratila umjetnoj inteligenciji s pitanjem na koje ne zna odgovor ili je tražila neki savjet. Isto tako vjerujem da nema osobe koja nije dobila barem djelomično krivi odgovor. I taj krivi odgovor bude tako uvjerljiv s hrpom dodatnih informacija da bi svakoga mogao uvjeriti. I onda kada ga razotkrijete i kažete mu da nema pojma onda se tako pristojno ispričava, i čujete takve isprike koje možda niste nikad ni od koga čuli u vašem životu. Eh to je AI, šarmantan i jako pogrešiv.
Što sve AI može izmisliti?
- Izmišljanje činjenica ("halucinacije"): AI može navesti nepostojeće knjige, znanstvene radove, citate ili događaje, pri čemu odgovor zvuči potpuno uvjerljivo.
- Zastarjele informacije: Ako se ne koristi pretraživanje interneta, odgovor se temelji na znanju koje možda nije ažurno.
- Pogrešno razumijevanje pitanja: Ako je pitanje nejasno ili ima više mogućih značenja, AI može odgovoriti na ono što je "pretpostavio", a ne na ono što je korisnik mislio.
- Netočno zaključivanje: I kada su pojedinačne činjenice točne, zaključak može biti pogrešan.
- Pristranost u podacima: Budući da uči iz velikih količina ljudskog teksta, može odražavati pogreške ili pristranosti prisutne u tim izvorima.
Koliko često griješi?
Ne postoji neki postotak koji vrijedi za sve situacije. To ovisi o vrsti zadatka:
Za opća objašnjenja često je vrlo pouzdan. Za matematiku ili programiranje može biti vrlo dobar, ali ipak može napraviti logičku pogrešku. Za medicinske, pravne ili financijske savjete pogreške mogu imati ozbiljne posljedice, pa je važno provjeriti informacije u pouzdanim izvorima. Za najnovije vijesti ili događaje potrebno je koristiti pretraživanje interneta, jer se informacije brzo mijenjaju pa AI to ne može tako brzo pratiti.
Kako prepoznati da je odgovor možda netočan?
Treba svakako obrati pozornost ako AI:
1. Iznosi vrlo precizne podatke bez mogućnosti provjere,
2. Navodi izvore koje ne možete pronaći,
3. Daje odgovor s velikom sigurnošću na pitanje koje je neizvjesno ili kontroverzno,
4. Sam sebi proturječi u različitim dijelovima odgovora.
Kako koristiti AI na najbolji način?
Za jako važne odluke nemojte odmah povjerovati odgovoru ma koliko žurili. Pitajte AI da objasni svoje zaključivanje ili navede izvore. Provjerite ključne tvrdnje u neovisnim i pouzdanim izvorima. Ako je riječ o zdravlju, pravu, porezima ili sigurnosti, treba svakako potvrditi informacije kod stručnjaka ili službenih institucija.
Zanimljivo je da AI često ne zna kada ne zna. Umjesto da odgovori "nisam siguran", može dati odgovor koji zvuči uvjerljivo, ali nije točan. Zbog toga je važno kritički procjenjivati odgovore, osobito kada su u pitanju činjenice koje imaju praktične posljedice. Drugim riječima, AI je izvrstan alat za učenje, objašnjavanje, sažimanje i pomoć u razmišljanju, ali nije zamjena za provjerene izvore kada je potrebna visoka razina točnosti.
Evo jedan moj primjer borbe s AI haluciniranjem
Nije mi se dalo tražiti broj podrške Hrvatske pošte, jer sam već bila na rubu zbog nedolaska jednog paketa koji je inače bio poslan brzom poštom koja se zove "HP 24 sata". Ne da je prošlo 24 sata nego barem tjedan dana. I što je najgore na praćenju pošiljke je evidentiran neki "nebulozni" pokušaj uručenja u 17:20 kojeg naravno nije bilo jer su na kući nadzorne kamere i vidi se i kad mačka prođe. Pa sam eto htjela nazvati poštu i probati saznati o čemu je riječ. I tako već spremna na dugo čekanje da se uopće netko javi meni AI predloži da kontaktiram HP-ovu Whatsapp podršku koja je po njemu genijalna i navodno se brzo do nje dođe.

Izvor: vlastiti
Ja oduševljena da konačno pošta ima i neku konkretniju podršku, osim čekanja na telefonu i po sat vremena, odmah upišem broj u mobitel i pokušavam ga naći na Whatsappu. Mada me je prije nego sam poslala poruku zanimalo kako Hrvatskoj pošti izgleda Whatsapp profilna fotkica i kako ju je pošta dizajnirala.
Odem na profil kad ono: vidim nekog stranca u žutoj majici kako drži šalicu kave u ruci. Pomislim, i dalje naivno, hm vidi ima žutu majicu kao što je boja HP logoa. Ali ipak mene gricka neki crvić i ne da mi da povjerujem kako bi pošta takvu fotku stavila na svoj profil, bez obzira na žutu majicu. Odem sama proguglati internetom i nigdje ne vidim informaciju da Pošta ima Whatsapp kanal za korisnike.
Vratim se na razgovor s AI-je i pitam ga "jesi li ti siguran da je ovo broj HP chatbota xxxx?" I nakon toga je nastupila hrpa poruka isprike, onako lijepo kako se rijetko tko zna ispričati. AI je priznao da je halucinirao. Broj koji mi je dao je u stvari broj nekih prevaranata koji kradu profile i predstavljaju se kao HP podrška.

Izvor: vlastiti
Eto pravog primjera kako vas AI može unazaditi ako mu vjerujete. I zato mu nikako ne smijete slijepo vjerovati, pogotovo ako netko traži obične informacije poput broja telefona neke ustanove, za što treba koristiti pretraživače, a ne chatbot..
Jeste li doživjeli da vam AI odgovori s: "nisam siguran"?
Zapravo, AI može napisati "nisam siguran" i moderni modeli to rade mnogo češće nego prije. Međutim, postoje tehnički razlozi zašto se to ne događa uvijek.
Najvažnije je razumjeti da AI nije baza podataka koja "zna" ili "ne zna" činjenice na isti način kao čovjek. On procjenjuje koji je sljedeći odgovor najvjerojatniji s obzirom na pitanje i ono što je naučio iz velikog broja primjera.
Ne posjeduje svijest o vlastitom znanju. Čovjek može pomisliti: "Nisam siguran, ovo sam davno učio." AI nema takvu vrstu introspekcije. On procjenjuje vjerojatnost odgovora, a ne svoje "sjećanje".
Uvjerljiv stil ne znači visoku sigurnost. Model je treniran da daje tečne i korisne odgovore. To znači da isti stil može koristiti i kada je odgovor vrlo pouzdan i kada je zapravo nesiguran.
Neka pitanja izgledaju jednostavnije nego što jesu. Ako pitaš nešto vrlo specifično, primjerice ime osobe u malom povijesnom događaju ili detalj iz nekog dokumenta, model može "popuniti praznine" umjesto da zaključi da nema dovoljno informacija.
Zato bi se budući AI modeli trebali ponašati opreznije. Ako procijene da nema dovoljno podataka ili da postoji više mogućih odgovora, trebali bi reći nešto poput:
"Nisam siguran."
"Ne mogu to potvrditi."
"Postoji više mogućih odgovora."
"Trebalo bi provjeriti u pouzdanom službenom izvoru."
Ipak, ništa nije savršeno.
Kako mi možemo pomoći u komunikaciji s AI-om?
Možemo pomoći AI-ju da bude oprezniji načinom na koji postavimo pitanje. Na primjer:
"Ako nisi siguran, reci da nisi siguran." ili "Navedi stupanj sigurnosti od 1 do 10.", "Nemoj nagađati; reci ako nemaš dovoljno podataka." ili pak "Prvo procijeni koliko si siguran, pa onda odgovori."
Takve upute često rezultiraju opreznijim odgovorima. Postoji i praktičan razlog. Korisnici često žele brz i direktan odgovor i to povećava vjerojatnost pogreške.
Pogreške jednog AI alata mogu postati i sredstvo konkurentske borbe na tržištu
Tvrtke koje razvijaju AI sustave mogu isticati pogrešne ili netočne odgovore svojih konkurenata kako bi pokazale da je njihov alat pouzdaniji, precizniji i sigurniji. Tako pojedinačne pogreške ne utječu samo na korisnike nego mogu postati dio marketinške i poslovne strategije u borbi za tržišni udio. Zbog toga je važno biti oprezan i prema tvrdnjama samih proizvođača AI alata te njihove usporedbe promatrati kritički, jer ni jedan sustav nije potpuno bez pogrešaka.
Zaključak
AI može biti vrlo koristan i moćan alat, ali njegovi odgovori nisu uvijek točni, čak ni kada zvuče potpuno uvjerljivo. Zato je važno znati da sigurnost i samouvjerenost u odgovoru ne znače nužno i točnost. Kada je informacija važna, potrebno ju je provjeriti u pouzdanim izvorima. Najbolji način korištenja AI-ja je kao pomoćnika koji može ubrzati učenje i pronalaženje informacija, ali ne kao nepogrešivog izvora istine.
Kad bi AI prečesto odgovarao "ne znam", bio bi manje koristan za mnoge zadatke i neupotrebljiv. Zato je cilj pronaći ravnotežu: a to je dati koristan odgovor, kada postoji dovoljno osnove za njega, a jasno istaknuti nesigurnost kada je ona stvarna. Poboljšanje te ravnoteže jedno je od glavnih područja razvoja modernih AI sustava. Ipak, dok se ne dođe do te naprednije faze treba biti jako oprezan. Vidjeli ste iz moga primjera kako sam mogla "nasjesti" da nemam u sebi sumnjičavog crva i često pušem na hladno, pa neke stvari volim više puta provjeriti.
Podijelite s nama u komentarima koje su AI "halucinacije", krivi naputci i dezinformacije koje ste vi doživjeli u komunikaciji s AI alatima?