Gespecialiseerde groepen die kunstmatige intelligentiesystemen testen, staan centraal in discussies over ai-risico’s. Deze evaluators beïnvloeden nu hoe snel nieuwe modellen op de markt komen en hoe investeerders de sector beoordelen.
Microsoft-president Brad Smith sprak tijdens een interview met Bloomberg Television zijn steun uit voor externe beoordelingen. “We moeten onafhankelijke evaluators hebben,” zei hij. “Uiteindelijk moet de wereld vertrouwen hebben in deze evaluators. Ze moeten goed worden gekozen en echte onafhankelijkheid hebben.”
Bedrijven als Anthropic PBC, Meta Platforms Inc. en Microsoft Corp. wenden zich steeds vaker tot deze beoordelaars om modellen te controleren op mogelijke schade voordat ze worden uitgebracht.
Ambtenaren van het Amerikaanse ministerie van Handel bij het Center for AI Standards and Innovation, of CAISI, hebben voorlopige gesprekken gevoerd met groepen als METR en het AI Evaluator Forum. Doel is te bepalen of deze organisaties kunnen helpen bij het opstellen van betrouwbare veiligheidsbenchmarks die bedrijven vertrouwen geven om ai-tools te gebruiken.
Verschillende vooraanstaande evaluators hebben nauwe banden met de beweging van effectief altruïsme. Critici, waaronder voormalig ai-adviseur David Sacks, stellen dat deze banden de onafhankelijkheid ondermijnen. Sacks noemde externe beoordelingen “pseudowetenschap” en waarschuwde tegen het inbedden van “onontslaagbare ea-toezichthouders” binnen ai-bedrijven.
President Donald Trump heeft existentiële ai-angsten als overdreven afgedaan en geeft prioriteit aan snelle innovatie ter ondersteuning van economische groei en marktprestaties.
Ondanks politieke tegenwind nodigen bedrijven nog steeds externe controleurs uit. Anthropic haalde evaluators met diepe modeltoegang binnen via Accenture. OpenAI kondigde aan dat derden eerder in het ontwikkelproces beoordelingen mogen uitvoeren. Grote gebruikers als Target Corp. en Mount Sinai Health System steunen de aanpak om het publieke vertrouwen te vergroten.
METR, of Model Evaluation and Threat Research, heeft modellen beoordeeld voor OpenAI en Anthropic. De groep, geleid door voormalig OpenAI-onderzoeker Beth Barnes, stelt dat ze interne informatie naar buiten wil brengen in plaats van uitkomsten te sturen. Ook wil ze medewerkers met diverse opvattingen aantrekken zodat resultaten niet strikt met één filosofie samenvallen.
Vertrouwen is essentieel en wordt verdiend door transparantie, onafhankelijkheid en de vrijheid om de waarheid te zeggen tegen de macht.
Het AI Evaluator Forum, waar METR deel van uitmaakt, benadrukt dat ontwikkelaars toegang en garanties moeten bieden zodat beoordelingen aan hoge wetenschappelijke normen voldoen.