Az AI nem direkt hazudik, csak hallucinál
A hazug embert könnyebb utolérni, mint a sánta kutyát? A magyar közmondás szerint mindenképp, de az AI világában az algoritmikus nagyotmondás, füllentés, kitaláció mindennapos jelenség. Nehezebb is elcsípni. De miért alakult ez így?

A hazug embert könnyebb utolérni, mint a sánta kutyát? A magyar közmondás szerint mindenképp, de az AI világában az algoritmikus nagyotmondás, füllentés, kitaláció mindennapos jelenség. Nehezebb is elcsípni. De miért alakult ez így?
Magabiztos, csak nem igaz
2023 júniusában egy New York-i ügyvéd hat korábbi bírósági ítéletre hivatkozott egy kártérítési beadványban. A hivatkozások pontos ügyszámokkal, dátumokkal, szó szerinti idézetekkel érkeztek, csak épp egyik ítélet sem létezett. A ChatGPT találta ki mindet, az ügyvéd pedig nem nézett utána. A bíróság 5000 dolláros bírságot szabott ki, az ügy pedig az AI-hallucinációk első nagy port kavaró bírósági precedensévé vált.
Két évvel később a Deloitte Australia egy 237 oldalas kormányzati ellenőrzési jelentésbe épített be nem létező bírósági ítéleteket és kitalált tudományos hivatkozásokat. Ezúttal nem egy magányos ügyvéd hibázott: az egyik legnagyobb, az üzleti életben etalonnak számító tanácsadó cég auditált munkája bukott meg. Nem volt happy end: a végén a munkadíj, a 440 000 ausztrál dollár egy részét kénytelenek voltak visszafizetni a kormánynak, és egy független kutató leleplezése nyomán el kellett ismerniük az AI használatát.
Miért hazudik ilyen magabiztosan a gép?
Mielőtt etikát kérnénk számon az AI-on, érdemes megismerni a hazugság, vagy elegánsabb kifejezéssel: a hallucináció technológiai alapjait.
A nagy nyelvi modellek nem tudásbázisok. Nem néznek utána semminek, nem ellenőriznek tényeket. Egyetlen dolgot csinálnak: megbecsülik, melyik szótöredék (token) következik a legnagyobb valószínűséggel az addig leírtak után. Gyakori témáknál ez remekül működik. Ritka, alig dokumentált kérdéseknél viszont a modellnek egyszerűen nincs miből építkeznie, mégis válaszol, méghozzá ugyanolyan gördülékenyen, mint amikor tényleg tudja a választ. (Hogy miért válaszol? Mert arra van trenírozva, hogy mindenképp ezt tegye.)
Az Anthropic cég 2025 márciusában publikált kutatása szerint a Claude modellcsalád belsejében egyfajta versengés dönt erről. Van egy alapértelmezett „nem tudom" mechanizmus, amely bizonytalanság esetén aktiválódna. Amint viszont a modell felismer egy ismerős nevet vagy fogalmat a kérdésben, egy másik folyamat felülírja ezt, és a modell inkább akkor is válaszol, ha a részletekkel valójában semmit nem tud kezdeni. A segítőkészség legyőzi az óvatosságot.
Ez nem egy kijavítható szoftverhiba. A Szingapúri Nemzeti Egyetem kutatói 2025-ben matematikai bizonyítást közöltek arról, hogy nyílt, korlátlan információs környezetben egyetlen nyelvi modell sem tudja teljesen kiküszöbölni a hallucinációt. Meglepő módon a fejlettebb, több lépésben gondolkodó modellek néha rosszabbul teljesítenek ezen a téren, mint egyszerűbb elődeik. A hosszabb érvelési lánc több alkalmat ad arra, hogy a modell téves feltevésből induljon ki, és logikailag konzisztens, ám tényszerűen hibás következtetésre jusson.
Ahol már az egészség a tét
A probléma túlmutat a jogi eseteken. Egy 2025-ös orvosi vizsgálat szerint az AI által írt zárójelentések és ambuláns lapok 70 százaléka tartalmazott legalább egy hibát, jegyzetenként átlagosan majdnem három tévesztéssel. A hibák egy része súlyos volt, vagyis közvetlen hatással lehetett volna a beteg kezelésére, ha az orvos nem javítja ki időben.
Van egy még alattomosabb jelenség: az automatizációs elfogultság. Amikor az emberek megszokják, hogy a gép megbízható, kritika nélkül elfogadják a válaszait, még akkor is, ha azok tévesek. Egy radiológusokkal végzett vizsgálat szerint egy hibás AI-döntéstámogató rendszer mellett a tapasztalatlan orvosok diagnosztikai pontossága 79,7 százalékról 19,8 százalékra zuhant. A nagy gyakorlattal rendelkező szakorvosoké is 82,3 százalékról 45,5 százalékra esett vissza. A gép tévedett, az ember pedig hitt neki, és ebből rendszert csinált.
Üzleti környezetben ugyanez zajlik kisebb tétben, nagyobb gyakorisággal. A McKinsey 2025 novemberi felmérése szerint a vállalatok 88 százaléka már integrált valamilyen AI-megoldást, mégis alig 5,5 százalékuk számolt be jelentős megtérülésről. Egy másik adat szerint a vállalati felhasználók 47 százaléka hozott már üzleti döntést olyan riport alapján, amelyről utólag kiderült, hogy hallucinációkat tartalmazott.
A szabályozás próbál lépést tartani
Az amerikai pénzügyi felügyelet, a FINRA már kockázati tényezőként azonosította a hallucinációt, és állandó emberi ellenőrzést vár el minden AI-generált kimenet mögött, mielőtt az ügyfélhez kerülne. Az EU mesterséges intelligenciáról szóló rendelete a magas kockázatú rendszerekre kötelező naplózást, átláthatóságot és emberi felügyeletet ír elő. Az ügyvédi kamarák világszerte hasonló irányba mozdulnak: a szakmai és jogi felelősség sosem hárítható át a gépre.
Tökéletesség? Ne várjon erre
A jó hír, hogy a hallucináció mértéke nem sorsszerű. A leghatékonyabb védekezés a Retrieval-Augmented Generation, azaz a RAG-technológia: a modellt egy ellenőrzött, saját dokumentumtárhoz kötik, és megkövetelik, hogy kizárólag onnan építkezzen. Nyílt kérdéseknél a hallucinációs ráta akár 15–30 százalék is lehet. Ugyanez a modell egy jól felépített, saját tudásbázison futó RAG-rendszerben 2-5 százalék alá szorítható.
Ehhez viszont saját, ellenőrzött, naprakész tudásbázis kell, és egy csapat, amely tudja, mikor higgyen a gépnek, és mikor kérdőjelezze meg. A technológia önmagában nem old meg semmit. Az emberi ellenőrzés innentől is a folyamat szerves része.
A SERCO Informatika Zrt. AI és Innovációs üzletága pontosan ezt a két elemet fedi le: saját infrastruktúrán futó, a vállalat ellenőrzött dokumentumaira épülő AI-rendszert, és a SERCO AI Lab képzési programját, amely arra is megtanítja a munkatársakat, hogyan ismerjék fel, ha a gép magabiztosan, de tévesen válaszol.
A modell nem fog megváltozni. Attól, hogy valami magabiztosan hangzik, még nem lesz igaz, se a bíróságon, se a kórházban, se a saját irodánkban.
A cikk megjelenését a SERCO Informatika Zrt. AI és Innovációs üzletága támogatta.
Fotó: Envato




