Een AI-chatbot kan een overtuigend antwoord geven met een verzonnen bron, een verkeerd jaartal of een onderzoek dat niet bestaat. Waarom gebeurt dat? Onderzoekers wijzen op een opvallende oorzaak: de manier waarop AI wordt getraind en beoordeeld kan gokken aantrekkelijker maken dan toegeven dat het antwoord onzeker is.
Dat is een belangrijke boodschap uit Why Language Models Hallucinate, een onderzoek dat OpenAI in september 2025 publiceerde. Het helpt verklaren waarom ook geavanceerde modellen met veel zelfvertrouwen fouten kunnen maken.
Wat is een AI-hallucinatie?
Een hallucinatie is een antwoord dat geloofwaardig klinkt, maar feitelijk onjuist of verzonnen is. Dat kan een compleet fictieve publicatie zijn, maar ook een bestaand onderzoek waarvan de conclusie verkeerd wordt weergegeven.
Juist die combinatie maakt fouten lastig te herkennen. Een antwoord kan grotendeels kloppen, terwijl één belangrijk detail fout is. Een nette tabel, duidelijke uitleg en professionele toon bieden daarbij geen garantie.
Een taalmodel leert patronen uit grote hoeveelheden tekst en bouwt daarmee antwoorden op. Het produceren van een plausibele tekst betekent niet automatisch dat alle uitspraken daarin zijn gecontroleerd.
Waarom kan gokken beter scoren dan ‘ik weet het niet’?
De onderzoekers vergelijken het probleem met een moeilijke toets. Als een goed antwoord punten oplevert en zowel een fout antwoord als een leeg vakje niets oplevert, loont gokken. Misschien heb je toevallig gelijk.
Veel AI-tests werken volgens een vergelijkbaar principe. Ze tellen hoeveel antwoorden correct zijn, maar maken onvoldoende onderscheid tussen een overtuigende fout en terecht uitgesproken onzekerheid. Daardoor kan een model dat vaak gokt beter scoren dan een voorzichtig model.
De onderzoekers pleiten daarom voor beoordelingen die zelfverzekerde fouten zwaarder bestraffen en passende onzekerheid waarderen. Dat is een mogelijke verbeterroute, geen aankondiging dat hallucinaties zijn opgelost.
Wat kun je als gebruiker doen?
Onze kijk: beoordeel een AI-antwoord op controleerbaarheid. Vraag bij belangrijke uitspraken om de oorspronkelijke bron en open die zelf. Controleer of de publicatie bestaat én of de inhoud de bewering ondersteunt.
Bij een samenvatting kun je de opdracht afbakenen:
“Gebruik uitsluitend de onderstaande tekst. Ontbreekt informatie om mijn vraag te beantwoorden? Benoem dan wat ontbreekt. Vul geen namen, cijfers of bronnen zelf aan.”
Zo maak je duidelijk wat je verwacht, maar ook deze instructie garandeert geen foutloos antwoord. Gebruik belangrijke teksten als concept en controleer de feiten voordat je ze publiceert of er een beslissing op baseert.
Voor organisaties hoort daar een duidelijke afspraak bij: wie controleert de informatie en wie keurt het resultaat goed? De gevolgen van ontbrekende broncontrole kwamen ook aan bod in ons artikel over AI-hallucinaties in een KPMG-rapport.
Factcheckprompt: laat AI zijn antwoord kritisch nalopen
Met deze vervolgprompt kun je mogelijke fouten en ontbrekende bronnen zichtbaar maken. Kopieer hem na een antwoord dat je wilt controleren:
Controleer je vorige antwoord op feitelijke juistheid. Neem niet aan dat je eerdere uitspraken kloppen.
- Haal de controleerbare beweringen uit het antwoord, waaronder namen, cijfers, datums en verwijzingen naar onderzoeken.
- Controleer elke bewering met oorspronkelijke bronnen, als je toegang hebt tot internet. Geef per bron de link en leg uit welke informatie de bewering ondersteunt.
- Zet de resultaten in een tabel: bewering, beoordeling, bron en eventuele correctie. Gebruik de beoordelingen ‘ondersteund’, ‘tegengesproken’ en ‘niet te verifiëren’.
- Maak onderscheid tussen feiten, aannames en meningen.
- Geef daarna een gecorrigeerde versie. Laat onbevestigde informatie weg of benoem de onzekerheid.
Heb je geen toegang tot de benodigde bronnen? Zeg dat expliciet. Verzin geen links of publicaties en presenteer een bewering niet als gecontroleerd omdat je die eerder zelf hebt genoemd.
Onze tip: gebruik dit als extra controle en open de genoemde bronnen zelf. Ook bij een factcheck kan AI fouten maken of zijn eerdere antwoord ten onrechte bevestigen.
