Betrouwbaarheid

Is AI betrouwbaar?

Doe de test: vraag ChatGPT wat jouw bedrijf doet en voor wie. Het antwoord leest soepel, klinkt overtuigend, en er zit vrijwel zeker iets in dat niet klopt. Een dienst die je niet levert, een vestiging die je nooit had, een oprichtingsjaar dat nergens op slaat.

Dat is AI-betrouwbaarheid in het klein: betrouwbaar voor werk dat je nakijkt, onbetrouwbaar voor werk dat je blind wegstuurt. Een taalmodel voorspelt het volgende woord op basis van patronen. Het weet niet wat waar is, maar kan het antwoord wel heel lekker opschrijven. Daarom klinken fouten net zo zelfverzekerd als de rest van het antwoord. Dat is het echte risico: een fout die eruitziet als een feit.

Hoe duur dat kan worden, liet Air Canada zien. Hun chatbot vertelde in 2024 een passagier dat hij een rouwtarief achteraf kon aanvragen. Dat kon helemaal niet, en de rechter oordeelde dat de luchtvaartmaatschappij gewoon moest betalen: een bedrijf is aansprakelijk voor wat zijn chatbot zegt. Het verweer dat de chatbot een aparte entiteit was, haalde het niet. Voor jou betekent dat: wat jouw AI naar een klant stuurt, is jouw belofte.

Hoe voorkom je hallucinaties?

De werkende ingreep is organisatorisch, geen techniek: zet een mens op de plek waar het werk de deur uit gaat. Daarnaast drie dingen die je vandaag kunt regelen:

  1. geef het model je eigen bronnen: een AI die uit je tarievenlijst en je klantdossier put, verzint minder dan een AI die uit zijn geheugen praat
  2. vraag om onzekerheid: laat het model markeren wat het niet zeker weet, met een tag als [VERIFIEER]; dat is één regel in je instructie en zorgt voor controle op de juiste plek
  3. check feiten, geen taal: namen, bedragen, aantallen en datums zijn waar het misgaat, de formulering is meestal prima. Zeker in combinatie met een duidelijk tone-of-voicedocument

Voor taken waar een fout geld of vertrouwen kost, bouw je een harde stop in: geen offerte de deur uit zonder een menselijke blik, geen bedragen uit een model dat je prijslijst niet kent. Dat is dezelfde afspraak die je met een nieuwe collega maakt, en dat noemt niemand wantrouwen.

En die test van hierboven? Alles wat het model over je bedrijf verzon, zijn de gaten die jij nog niet hebt gevuld. Intern werkt het precies zo: hoe beter je eigen informatie op orde is, hoe minder er te verzinnen valt. Wij bouwen daarom zo: één proces, vier weken, en de controle blijft bij de mensen die het werk kennen.

Wil je weten of jouw organisatie die controle heeft staan? De gratis AI Readiness Scan checkt onder meer je beslisstructuur en je faalruimte, en stuurt je een plan van aanpak.