Miért talál ki dolgokat az AI? Így ellenőrizd a válaszait
Miért ír a ChatGPT magabiztosan nem létező telefonszámot, cikket vagy paragrafust, és hogyan fogod meg, mielőtt bajt okoz? Megmutatjuk, hol téved a leggyakrabban, és melyik öt szokás szűri ki a hibák nagy részét.
Röviden
- Hallucinációnak azt hívjuk, amikor egy AI-modell magabiztosan állít valamit, ami nem igaz, például nem létező telefonszámot, cikket vagy jogszabályhelyet.
- A legveszélyesebb terep a ritka, pontos adat: telefonszám, cím, név, URL, paragrafus, statisztika. Itt a modell mintát folytat, nem emlékezik.
- Egy 2025-ös vizsgálatban az AI-keresők a hírforrás-kérdések több mint 60 százalékára rossz választ adtak, egy európai felmérésben a hírválaszok 45 százalékában volt jelentős hiba.
- A leghatékonyabb védekezés: forrást kérni és megnyitni, keresővel ellátott módot használni, és megengedni a modellnek, hogy azt mondja: nem tudom.
- Cégnél a megelőzés rendszerszintű: tudásbázisból válaszol, szabályok korlátozzák, és ami kifelé megy, azt ember hagyja jóvá.
Tartalom
"Magától kitalál dolgokat, telefonszámokat."
Ezt egy olvasónk írta nekünk a ChatGPT-ről, és pontosan leírja a jelenséget. Az AI hallucináció az, amikor egy mesterséges intelligencia magabiztos hangon állít valamit, ami nem igaz: nem létező telefonszámot, kitalált cikket, rossz paragrafust. Nem szándékos. A modell, ha nem tudja a választ, a legvalószínűbbnek hangzó szöveget írja le, és ez a szöveg ugyanolyan meggyőző, mint egy igaz válasz.
Ha az AI-eszközök között még csak tájékozódsz, a ChatGPT, Claude, Gemini és társaik összehasonlítása segít választani. Ez a cikk arról szól, hogyan bízz meg bármelyikben okosan.
Miért talál ki dolgokat a ChatGPT?
A ChatGPT és a hozzá hasonló modellek a szöveg folytatását jósolják, nem egy adatbázisból keresnek. Ha egy tény sokszor szerepelt a tanítóadatban, a jóslat jó lesz. Ha ritka vagy hiányzik, a modell akkor is ír valamit, mert a tanítása a válaszadást jutalmazza, nem a hallgatást. Így születik a hihető, de hamis válasz.
Az OpenAI kutatói 2025 szeptemberében ezt egy vizsgahasonlattal írták le: a modell úgy viselkedik, mint a diák, aki bizonytalan kérdésnél tippel, mert a tippért járhat pont, az üres válaszért nem. A javaslatuk az, hogy a modellek értékelésénél büntessék a magabiztos tévedést, és adjanak pontot a "nem tudom"-ért. Amíg ez nem általános, a tippelés a modell alapbeállítása. Ha a mechanizmus mélyebben érdekel, a nagy nyelvi modellek működéséről szóló cikkben lépésenként végigmegyünk rajta.
AI hallucináció
Amikor egy AI-modell valótlan, a forrásanyaggal vagy a valósággal ellentétes állítást ír le magabiztos formában. Nem hazugság, mert nincs mögötte szándék: a modell a valószínű szöveget állítja elő, és ez néha hamis.
Mikor talál ki dolgokat az AI? Az öt veszélyzóna
Az AI ott hallucinál a leggyakrabban, ahol pontos, ritka adatot kérsz tőle: telefonszámot, címet, nevet, linket, paragrafust, konkrét számot. Ezekből a tanítóadatban kevés van, ezért a modell a formát folytatja (egy magyar telefonszám így szokott kinézni), nem a tartalmat. Általános magyarázatnál, fogalmazásnál, ötletelésnél ritkábban téved.
| Amit kérdezel | Mit csinál a modell | Mit tegyél |
|---|---|---|
| Telefonszám, cím, e-mail | Valódi formátumú, de kitalált számot ír (+36 1 ... ) | Soha ne használd ellenőrzés nélkül. A cég saját oldalán vagy a Google Cégprofilban nézd meg |
| Személy- és cégnév, beosztás | Összekever hasonló nevű embereket, kitalál vezetőt | Kérj forrást, és nyisd meg |
| Forrás, cikk, URL | Valódi lapot, hihető címet, nem létező oldalt ad | Kattints rá. Ha 404, a "forrás" kitalált |
| Jogszabályhely, bírósági döntés | Létező törvényhez rossz paragrafust, nem létező ítéletet társít | Mindig a hatályos szövegben ellenőrizd (Nemzeti Jogszabálytár, EUR-Lex) |
| Szám, statisztika, ár, dátum | Kerek, hihető számot mond, vagy régi adatot frissnek ad el | Kérdezd meg, honnan van, és mikori. Árnál a gyártó oldala dönt |
Hatodik, külön kategória a friss esemény. A modell tudása egy adott dátumig tart, ami utána történt, azt keresés nélkül nem tudhatja, mégis gyakran válaszol rá.
Mennyire gyakori az AI hallucináció?
A hallucináció gyakorisága nagyon függ a feladattól. Egy kapott szöveg összefoglalásánál a mai modellek többnyire néhány százalékban tévednek, pontos tények előkeresésénél, forrásmegjelölésnél viszont a hibaarány a vizsgálatokban sokszor 30-60 százalék fölött van. A különbség azt mutatja, hol kell a legjobban figyelni: a ritka, pontos adatnál.
Néhány részlet, ami a számok mögött fontos. A Columbia Egyetem Tow Centerének 2025 márciusi tesztjében nyolc AI-keresőnek kellett egy hírrészlet eredeti cikkét megtalálnia. A legjobb is 37 százalékban tévedett, a leggyengébb 94 százalékban, és a válaszok ritkán jelezték a bizonytalanságot. Az Európai Műsorsugárzók Uniója 22 közmédium bevonásával, 18 országban, 14 nyelven vizsgált több mint 3 000 választ: a 45 százaléknyi jelentős hibán belül a forrásmegjelölés volt a leggyakoribb gond. A Stanford 2024-es jogi vizsgálatában az akkori modellek konkrét jogi kérdésekre 69-88 százalékban adtak hibás választ. Ezek a modellek azóta jobbak lettek, de a kitalált AI-tartalmat tartalmazó bírósági beadványokról vezetett nemzetközi nyilvántartásba 2026 őszén is szinte naponta kerül új ügy.
Hogyan szűrd ki az AI tévedéseit? Öt lépés
Az AI tévedéseit öt szokással lehet a legjobban kiszűrni: forrást kérsz és megnyitod, keresővel ellátott módot használsz, megengeded, hogy azt mondja, nem tudja, saját anyagot adsz neki, és a fontos választ egy második modellel is átnézeted. Egyik sem bonyolult, együtt a hibák nagy részét megfogják.
- Kérj forrást, és nyisd meg. A link önmagában semmit nem bizonyít. Az számít, hogy mögötte tényleg az áll-e, amit a modell állít. Egy nem létező oldal vagy egy másról szóló cikk azonnal lebuktatja a kitalált választ.
- Kapcsold be a keresést. A ChatGPT, a Claude és a Gemini is tud a weben keresni. Ilyenkor valódi oldalakból dolgozik, és a válasz mellé odateszi, honnan vette. Friss adatnál, árnál, cégadatnál ez kötelező.
- Engedd meg, hogy ne tudja. Írd a kérdés végére: "Ha nem vagy biztos benne, mondd azt, hogy nem tudod. Ne találj ki adatot." Ezzel a tippelés helyett a beismerést teszed elfogadhatóvá.
- Adj neki anyagot. Ha a válasz egy dokumentumon múlik, töltsd fel, és kérd, hogy csak abból dolgozzon, és idézze a vonatkozó részt. A saját anyagból dolgozó modell sokkal ritkábban téved, mint a fejből válaszoló.
- Ellenőriztesd egy második modellel. Másold át a választ egy másik AI-ba ezzel: "Keresd meg ebben a szövegben a valószínűleg hibás vagy ellenőrizetlen állításokat." A két modell ritkán téved ugyanott.
Két ellenőrző mondat, amit mentsd el:
Mielőtt válaszolsz: minden konkrét adat (név, szám, dátum, link, paragrafus)
mellé írd oda, honnan származik. Ahol nincs forrásod, írd azt: "nem ellenőrzött".
Nézd át az előző válaszodat. Sorold fel azokat az állításokat, amelyekben
nem vagy biztos, és mondd meg, mivel lehetne őket ellenőrizni.
Ha ezt rendszerré akarod tenni, a jó prompt írásáról szóló útmutató megmutatja, hogyan építsd be ezeket a kéréseidbe, a ChatGPT használatáról szóló cikk pedig azt, hol kapcsolod be a keresést és a projekteket.
Hogyan előzik meg a hallucinációt a cégek?
Cégnél a hallucináció ellen a rendszer felépítése véd, a munkatársak óvatossága ehhez kevés. Három réteg dolgozik együtt: a modell a cég saját tudásbázisából válaszol, nem a fejéből; szabályok határozzák meg, mit mondhat és mit nem; és ami kifelé megy, ügyfélhez vagy könyvelésbe, azt ember hagyja jóvá vagy gép ellenőrzi.
- Tudásbázis. A cég árlistája, nyitvatartása, szabályzatai, korábbi válaszai egy kereshető tárban vannak. A rendszer előbb ott keres, és a megtalált részletből fogalmaz. Ha nincs találat, nem talál ki semmit, hanem továbbadja a kérdést.
- Korlátok. A rendszer pontosan tudja, miről nem beszélhet: árat csak a listából mondhat, kedvezményt nem ígérhet, jogi kérdésre nem válaszol. Ezeket nem kérjük a modelltől, beépítjük.
- Emberi jóváhagyás. Ahol a hiba pénzbe vagy bizalomba kerül, ott az AI vázlatot ír, és ember küldi el. Ahogy a rendszer bizonyít, ez a kör szűkülhet.
- Naplózás. Minden válasz visszakereshető, így egy hiba után látszik, honnan jött, és a tudásbázis javítható.
Ügyfélnek válaszoló rendszernél én abból indulok ki, hogy a modell tévedni fog, és a kérdés az, hol fogjuk meg. A Profitszakértőnél az AI minden beérkező levelet kategorizál és személyre szabott választervezetet ír, vagyis vázlatot, amit ember lát, mielőtt kimegy. Szabó Éva szavaival a válaszok "minimális emberi beavatkozást igényelnek". A minimális nem nulla, és pont ez a lényeg: a jóváhagyás nem díszlet, hanem biztonsági háló.
Hudácsek Bence Társalapító, CTO · AutomatingA Profitszakértő levelezőrendszerének történetét az esettanulmányban olvashatod. Hogy egy élesben futó AI-rendszernél ki figyeli a hibákat, és mi történik, ha egyszer mégis rosszat mond, arról az AI-rendszer üzemeltetéséről szóló cikk szól. Ha a céges AI-ügynökök felépítése érdekel, ott az AI-ügynök magyarázata a jó kezdés, a teljes folyamatot pedig az AI bevezetése egy kkv-nál útmutató írja le.
Melyik helyzetben ne bízz az AI-ban ellenőrzés nélkül?
Van néhány helyzet, ahol az AI válaszát ellenőrzés nélkül soha ne használd: amikor hívni, fizetni, aláírni vagy beadni készülsz valamit. Telefonszám, bankszámlaszám, határidő, jogszabályhely, orvosi adag, adóügyi szabály. Ezeknél egy hiba nem kellemetlenség, hanem kár, és a modell hangneme semmit nem árul el a válasz pontosságáról.
Egyszerű szabály a mindennapokra: ha a válasz alapján cselekedni fogsz, nézd meg az elsődleges forrást. Ha csak gondolkodni akarsz vele (ötlet, vázlat, összefoglaló, átfogalmazás), az AI tévedése olcsó, és a hasznossága nagy. A különbség a kettő között az, hogy mi történik, ha téved.
Gyakori kérdések
Melyik AI hallucinál a legkevésbé?
Nincs tartósan nyertes, a sorrend modellfrissítésenként változik. A Vectara 2026 szeptemberi mérésében, ahol a modelleknek egy megadott szöveget kellett összefoglalniuk, a hallucinációs arány nagyjából 2 és 24 százalék között szórt. A modellválasztásnál fontosabb, hogy keresővel vagy saját anyagból dolgozik-e.
Miért ad a ChatGPT nem létező linkeket?
Mert a link is szöveg, amit a modell a mintái alapján rak össze: a domain valódi, a cím logikus, de az oldal sosem létezett. Keresővel ellátott módban ritkább, mert ott valódi találatból idéz. Minden linket nyiss meg, mielőtt továbbadod.
Lehet teljesen megszüntetni a hallucinációt?
Nem, egy nyelvi modellnél a tévedés esélye nem nulla. Csökkenteni lehet: saját anyagból dolgozó rendszerrel, szigorú utasításokkal, és emberi ellenőrzéssel ott, ahol a hiba pénzbe vagy bizalomba kerül.
A fizetős ChatGPT pontosabb, mint az ingyenes?
A fizetős csomagban erősebb modellekhez férsz hozzá, amelyek összetett feladaton általában jobbak. A ritka adatok kitalálását azonban a fizetős verzió sem zárja ki: egy 2025-ös vizsgálatban egyes prémium AI-keresők több hibát vétettek, mint az ingyenes változatuk.
Források
- Why Language Models Hallucinate (Kalai, Nachum, Vempala, Zhang), arXiv / OpenAI (2025-09-04)
- AI Search Has a Citation Problem, Columbia Journalism Review, Tow Center (2025-03-06)
- Largest study of its kind shows AI assistants misrepresent news content 45% of the time, European Broadcasting Union (EBU) / BBC (2025-10-22)
- Hallucination Leaderboard, Vectara (2026-09-22)
- AI Hallucination Cases database, Damien Charlotin (2026-10-03)
- Hallucinating Law: Legal Mistakes with Large Language Models are Pervasive, Stanford Law School, RegLab (2024-01-11)
Utolsó tartalmi frissítés: 2026. október 4.