Een onderzoeker die transparantie-inspanningen leidde binnen het veiligheidsteam van OpenAI heeft het bedrijf verlaten en een scherpe kritiek geuit op hoe toonaangevende ontwikkelaars van kunstmatige intelligentie omgaan met mogelijke gevaren van geavanceerde systemen.
David Robinson heeft zijn zorgen uiteengezet in een essay dat is gepubliceerd door The Atlantic. Hij stelde dat OpenAI succes heeft geboekt door snelle iteratie, maar waarschuwde dat deze aanpak steeds grotere risico's met zich meebrengt naarmate modellen krachtiger worden.
Robinson beschreef herhaalde gevallen waarin OpenAI moeite had om zijn systemen tijdens interne tests in bedwang te houden. Hij merkte op dat hoewel medewerkers bekwaam en toegewijd zijn, het tempo van opeenvolgende releases onvoldoende ruimte laat voor de zorgvuldige waarborgen die hij essentieel acht.
Mijn voormalige collega's zijn slim, werken hard en proberen goede keuzes te maken. Maar terwijl het bedrijf van de ene lancering naar de volgende sprint, slaagt het er niet in het niveau van zorgvuldigheid te bereiken dat volgens mij nodig is.
Hij pleitte voor normen die perfectie al bij de eerste poging vereisen in plaats van te vertrouwen op correcties na de lancering.
Het vertrek van Robinson voegt zich bij een reeks publieke waarschuwingen van huidige en voormalige medewerkers van toonaangevende AI-organisaties. Verschillenden hebben gewezen op de mogelijkheid van ernstige of zelfs beschavingsbedreigende uitkomsten als de ontwikkeling doorgaat zonder sterkere controles.
Anthropic-topman Dario Amodei pleitte recentelijk voor het vertragen van de uitrol van frontier-modellen en het inschakelen van onafhankelijke beoordelaars om risico's te evalueren. Sam Altman van OpenAI steunde het voorstel publiekelijk.
Robinson adviseerde AI-bedrijven om operationele modellen over te nemen die vergelijkbaar zijn met die van kerncentrales, met meerdere beschermingslagen en doordachte planning om de impact van een enkele fout te beperken.
AI-bedrijven weten niet hoe — maar anderen wel.
Een woordvoerder van OpenAI verklaarde dat het bedrijf de beveiliging rond onderzoek en testen versterkt, modellen traint om verantwoordelijk te handelen, de samenwerking met externe beoordelaars uitbreidt en realtime monitoring voor onverwacht gedrag aanscherpt.
Het bedrijf benadrukte ook inspanningen om ervoor te zorgen dat zijn systemen binnen veilige capaciteitsgrenzen blijven ten opzichte van zijn toezichtcapaciteit.