Miért talál ki dolgokat az AI, és hogyan ellenőrizd?

Az AI azért talál ki tényeket, mert a nyelvmodell a legvalószínűbb következő szavakat írja le, a tanítása pedig a találgatást jutalmazza a „nem tudom” válasz helyett. Védekezni három szabállyal lehet: kérj forrást, a számokat és neveket ellenőrizd le, és kockázatos kérdésben ne fogadd el az első választ.

Miért állít valótlant az AI, ha egyszer magabiztosan ír?

A nyelvmodell nem tényeket keres elő egy adatbázisból. Szövegrészeket folytat: a tanult minták alapján azt írja le, ami a legvalószínűbben következik. Ha a kérdésre sok jó példát látott tanítás közben, ez többnyire pontos. Ha ritka dologról kérdezel, például egy kis magyar cég adatairól vagy egy pontos jogszabályhelyről, a modell attól még választ ad, csak alakra helyes a válasz, tartalomra nem.

Az OpenAI kutatói 2025 szeptemberében publikáltak erről egy tanulmányt „Why Language Models Hallucinate” címmel. Érvelésük szerint a modellek azért találgatnak, mert a legtöbb teszt pontot ad a találatra, a „nem tudom” válaszra viszont nullát. Aki így méri a modelleket, a bátor tippelőt jutalmazza. A szakirodalom ezt a jelenséget hívja hallucinációnak.

A gyakorlati tanulság egyszerű: a magabiztos hangnem semmit nem mond a válasz pontosságáról. Egy kitalált hivatkozás ugyanolyan folyékonyan megfogalmazott, mint egy valódi.

Milyen feladatoknál téved leggyakrabban?

Nem minden feladat egyformán veszélyes. Ahol a modell a te szövegedből dolgozik, ritkán talál ki valamit. Ahol a saját emlékezetére hagyatkozik, ott gyakran.

FeladatHibakockázatMit tegyél
Általad megadott szöveg összefoglalása, átírásaAlacsonyGyors átolvasás
Ötletelés, címváltozatok, vázlatAlacsony, nincs mit tévesztenieVálogatás
Konkrét szám, ár, dátum, verziószámMagasEllenőrzés a hivatalos oldalon
Hivatkozás, tanulmány, bírósági ügy, idézetNagyon magas, gyakran létezik a cím, de a tartalom nem azA forrás megnyitása
Jogi, orvosi, pénzügyi kérdésMagas, és a tét is nagySzakember dönt

A táblázat tapasztalati iránymutatás, nem mérés. Ha új feladatot adsz az AI-nak, kérdezd meg magadtól, honnan tudná a választ. Ha a megadott szövegedből, jó. Ha csak a tanult mintákból, ellenőrizz.

Mennyibe kerülhet egy kitalált tény?

Két ismert eset mutatja, hogy a hiba nem marad az AI-nál. A 2023-as Mata kontra Avianca ügyben két amerikai ügyvéd ChatGPT-vel kutatott bírósági döntések után, és olyan ügyeket nyújtott be, amelyek nem léteztek. A bíró a két ügyvédet és az irodát együtt 5 000 dollár pénzbírságra kötelezte, és azt írta, hogy a mesterséges intelligencia használata önmagában nem szabálytalan, de az ügyvédnek ellenőriznie kell, amit benyújt.

A másik eset egy cégé. Egy utas 2022 novemberében az Air Canada weboldalának chatbotját kérdezte a gyászesetre szóló kedvezményes jegyről. A bot azt mondta, hogy a kedvezményt utólag is kérheti, a weboldal másik oldala szerint viszont erre nincs lehetőség. A British Columbia-i polgári vitarendező testület 2024. február 14-én az utasnak adott igazat: a cég felel a weboldalán megjelenő információért, akár statikus oldal mondja, akár chatbot. A kártérítés, a kamat és a költségek együtt 812 kanadai dollárt tettek ki. Az összeg kicsi, az elv nem: ha a céged botja ígér valamit, azt te tartod be. Erről bővebben az AI ügyfélszolgálatról szóló cikkben írtam.

Hogyan ellenőrizd az AI válaszát három lépésben?

  1. Kérj forrást, és nyisd meg. Írd hozzá: „Add meg a forrás linkjét, és ha nem találsz, mondd ki.” A kapott linket nézd meg, mert a modell létező webcímet is kitalálhat.
  2. Keresd ki a konkrétumokat. Minden árat, dátumot, névvel megadott állítást és szakkifejezést egyszer ellenőrizz a szolgáltató vagy a hatóság saját oldalán. Egy cikk esetében ez tíz-tizenöt perc, és pont ezt idézik tovább mások.
  3. Kérdezz rá másképp. Tedd fel ugyanazt a kérdést egy másik modellnek, vagy kérd meg ugyanazt az AI-t, hogy keressen hibát a saját válaszában. Ha a két válasz eltér, az a hely, ahol utána kell nézned.

Segít az is, ha a feladatot úgy fogalmazod meg, hogy a modell a te anyagodból dolgozzon. Ha beillesztesz egy dokumentumot, és csak abból kérsz választ, sokkal kisebb a találgatás esélye. A jó kérések felépítéséről a prompt engineering cikkben olvashatsz. Ha ügyféladatot is beillesztenél, előbb nézd meg, mit szabad feltölteni.

Hogyan hat ez egy kisvállalkozás napi munkájára?

Vegyünk egy példát. Egy webshop tulajdonosa megkéri az AI-t, hogy írjon termékleírást egy importált kávéfőzőhöz. A szöveg jól olvasható lesz, de beleírja, hogy a gép 15 bar nyomású és két év garanciával jár. Ha a gyártói adatlapon 9 bar és egy év áll, a vásárló a te leírásodra hivatkozik, nem az AI-ra. Itt nem a szöveg a baj, hanem az, hogy a műszaki adatokat a modell tippelte.

A megoldás nem bonyolult: a műszaki adatokat te adod meg a kérésben, a modell csak megfogalmazza. Ilyenkor a hibalehetőség a te adatlapodra szűkül, amit egyszer ellenőrzöl.

Ugyanez igaz a hírlevélre, az ajánlatra és a közösségi posztra. Ahol a szövegben szám vagy állítás van, azt az utolsó olvasásnál húzd alá, és csak az aláhúzott részeket ellenőrizd le. Ez ritkán tart tovább néhány percnél.

Miért nem szűnik meg ez magától?

Az újabb modellek általában kevesebbet tévednek, de a probléma nem tűnt el, mert a működés alapja ugyanaz. A modell mindig tud valamit írni, és nincs belső jelzése arról, hogy egy adat a tanítóanyagból származik, vagy csak illik a mondatba. Az OpenAI tanulmánya is azt javasolja, hogy a tesztek büntessék a magabiztos hibát, és ne büntessék a bizonytalanság kimondását. Amíg ez nem általános, a hibákkal számolnod kell.

Egy bevált szabály csapatban: amit az AI hozott, azt valaki más is átnézi, mielőtt kimegy az ügyfélhez. Egyedül dolgozva ez azt jelenti, hogy másnap, friss szemmel olvasod át a szöveget.

Mikor nem kell túlzottan aggódnod?

Ötletelésnél, vázlatnál, hangnem-átírásnál és saját szöveg tömörítésénél a hallucináció ritkán okoz kárt, mert nincs mit elhibázni. A munka nagy része ilyen. A figyelmet érdemes arra a pár pontra összpontosítani, ahol szám, név vagy hivatkozás kerül a szövegbe, és ahol az olvasód vagy az ügyfeled döntést hoz belőle.

Jogi, orvosi és pénzügyi kérdésben az AI a szempontokat segít összeszedni, a döntéshez viszont szakember kell.

GYIK

Megbízhatóbb az AI, ha internetes keresést is használ?

Általában igen, mert a válasz mögött konkrét weboldal áll, amit megnyithatsz. A keresés nem szünteti meg a hibát: a modell félreolvashatja az oldalt, vagy rossz forrást választ. A hivatkozott oldalt ilyenkor is nyisd meg, mielőtt továbbadod az állítást.

Mondhatom az AI-nak, hogy ne találjon ki semmit?

Segít, de nem old meg mindent. Ha azt írod, hogy bizonytalanság esetén mondja ki, hogy nem tudja, a modell ritkábban tippel. Teljes védelmet ez nem ad, ezért a konkrét adatokat így is ellenőrizd.

← Összes cikk