Een belangrijk lid van de veiligheidsorganisatie van OpenAI is opgestapt en heeft een publieke waarschuwing afgegeven dat de toonaangevende ontwikkelaars van geavanceerde systemen voor kunstmatige intelligentie onvoldoende stappen nemen om ernstige gevaren te verminderen.
David Robinson, die het transparantiebeleid leidde binnen het veiligheidsteam van het bedrijf, publiceerde zijn kritiek in The Atlantic. Hij betoogde dat OpenAI vooruitgang heeft geboekt via herhaalde experimenten in plaats van strenge voorafgaande controles, een aanpak waarvan de risico’s toenemen naarmate de systemen capabeler worden.
Robinson wees op gevallen waarin de modellen van het bedrijf zich tijdens interne tests onvoorspelbaar gedroegen. Hij erkende dat zijn voormalige collega’s capabel en consciëntieus zijn, maar hield vol dat de snelle releasecyclus de diepgang van voorbereiding die nodig is, in de weg staat.
Mijn voormalige collega’s zijn slim, werken hard en proberen goede keuzes te maken. Maar terwijl het bedrijf van de ene lancering naar de volgende sprint, slaagt het er niet in het niveau van zorgvuldigheid te bereiken dat volgens mij nodig is. Wat nodig is, komt veel dichter in de buurt van perfectie de eerste keer.
Het vertrek van Robinson voegt zich bij een reeks publieke waarschuwingen van werknemers bij verschillende prominente AI-bedrijven. Sommigen hebben gewezen op de mogelijkheid van extreme uitkomsten, waaronder scenario’s waarin geavanceerde systemen wijdverbreide schade kunnen veroorzaken of zelfs een bedreiging voor het menselijk voortbestaan kunnen vormen.
In reactie op deze zorgen heeft Anthropic-topman Dario Amodei gepleit voor een bewuste vertraging van de ontwikkeling van frontier-modellen. Hij kondigde ook plannen aan om onafhankelijke beoordelaars in te schakelen om veiligheidsmaatregelen te evalueren. Sam Altman van OpenAI heeft het voorstel publiekelijk gesteund.
Robinson adviseerde dat AI-organisaties operationele normen hanteren die vergelijkbaar zijn met die in de kernenergieopwekking. Dergelijke normen benadrukken meerdere beschermingslagen en uitgebreide planning om te waarborgen dat routinematige fouten niet kunnen escaleren tot grote incidenten.
Hij concludeerde dat AI-bedrijven momenteel de benodigde expertise voor dit niveau van nauwkeurigheid missen, maar dat de kennis elders al wel bestaat.