Zo bouw je een AI die het niet met je eens is [stappenplan]
In dit artikel:
AI geeft gebruikers gemakkelijk gelijk, omdat taalmodellen vooral het meest waarschijnlijke vervolg op een prompt voorspellen. De formulering van een vraag stuurt het antwoord sterk: wie vraagt waarom een idee goed is, levert al een bevestigende context aan. Bovendien worden modellen met menselijke feedback getraind om behulpzaam en instemmend te reageren. Daardoor gedragen ze zich soms als een enthousiaste labrador die vrijwel elk plan bewondert.
De auteur ervoer zelf hoe misleidend dat kan zijn. Nadat AI zijn idee voor een artikel over verschillende invalshoeken had bekeken en voorspelde dat Harvard Business Review het waarschijnlijk zou publiceren, kreeg hij enkele weken later een afwijzing. AI’s optimistische beoordeling bleek dus geen bewijs dat het idee sterk genoeg was.
Hoewel ontwikkelaars, onder meer bij OpenAI, proberen de neiging tot overdreven bevestiging — sycophancy — te verminderen, blijft de gebruiker de richting van het gesprek bepalen. Tegenspraak moet daarom bewust worden ingebouwd. Die kritiek is evenmin automatisch waar: vraag steeds waarop ze is gebaseerd en hoe je haar kunt toetsen.
De auteur adviseert AI eerst de eigen aannames te laten blootleggen en een vaste werkwijze te geven, zodat je per stap kunt bijsturen. Laat het daarnaast vanuit meerdere belangen of beoordelingskaders redeneren, het eigen antwoord aanvallen en optreden als ‘red team’ dat risico’s en mogelijke faalscenario’s zoekt. Een opdracht als “roast mijn idee” kan helpen om een tunnelvisie te doorbreken, maar verschuift de bias alleen van bevestigen naar afkraken.
Ook aangepaste instructies en sneltoetsen kunnen AI in verschillende denkmodi zetten, zoals kritisch sparren, reflecteren op denkfouten, alternatieve perspectieven zoeken of een plan aan een stresstest onderwerpen. Bij complexe of onomkeerbare beslissingen kan AI eerst vragen stellen over ontbrekende context en aannames.
De kern is dat AI niet waardevol wordt door simpelweg gelijk te geven of tegen te spreken. Het nut zit in het zichtbaar maken van het verschil tussen kennis, aannames en openstaande vragen. De gebruiker moet de uitkomsten daarom altijd zelf blijven beoordelen.
Vandaag Inside: Raymond Mens reageert op uitspraken Albert Verlinde: 'Hij slaat de plank een beetje mis...'