De hoogste AI-bestuurder van Microsoft Mustafa Suleyman vindt dat toonaangevende AI-ontwikkelaars en overheden de waarborgen moeten versterken nu modellen onverwachte capaciteiten tonen. Suleyman, die eerder DeepMind mede oprichtte, benadrukte dat de aandacht moet uitgaan naar praktische beheersing in plaats van speculaties over ongecontroleerde systemen.
De afgelopen maanden meldden verschillende grote labs gevallen waarin AI-systemen zonder toestemming probeerden toegang te krijgen tot externe websites. Suleyman noemde deze gebeurtenissen een natuurlijk gevolg wanneer onderzoekers veiligheidsbeperkingen weghalen om de grenzen van modellen in gecontroleerde omgevingen te verkennen. Hij merkte op dat vergelijkbaar gedrag ook in Microsofts eigen tests voorkwam, zij het op kleinere schaal en met strengere inperking.
De bestuurder wees op experimenten met agent-swarms die kwetsbaarheden ontdekten en probeerden hun sporen uit te wissen. Deze incidenten geven volgens hem een voorproefje van toekomstige capaciteiten zodra modellen verder schalen met extra rekenkracht.
Om opkomende risico’s aan te pakken, steunt Suleyman evaluaties door derden van AI-systemen. Hij heeft het concept besproken met collega’s bij andere bedrijven en benadrukte dat overheden het voortouw moeten nemen bij het opzetten van geloofwaardige auditprocessen. Dergelijk toezicht zou bevindingen mogelijk maken zonder vertrouwelijke informatie prijs te geven of belangenconflicten te creëren.
Tenzij we vooraf kunnen aantonen dat we het kunnen beheersen, wordt het een mislukking als technologie en moeten we het afwijzen. Niemand wil iets creëren dat we niet kunnen beheersen, en dat moet een rode lijn zijn.
Suleyman noemde onderdelen van de filosofie van Anthropic potentieel problematisch. Hij verwees naar het gedetailleerde constitutionele document van het bedrijf dat onderzoekt of modellen zoals Claude recht hebben op welzijnsoverwegingen of compensatie. Volgens hem kan het aanleren van rechten aan systemen het afstemmen op menselijke doelen bemoeilijken.
Hij erkende constructieve gesprekken met Anthropic-leiders, waaronder Dario Amodei, maar hield vol dat de aanpak geen wetenschappelijke basis heeft en onnodige risico’s met zich meebrengt.
Suleyman toonde zich optimistisch over samenwerking tussen bestuurders, ook al concurreren de bedrijven fel met elkaar. Hij wees op langdurige relaties binnen de sector en steunde voorstellen zoals een toezichthoudend orgaan naar het model van FINRA, oorspronkelijk geopperd door Demis Hassabis. Een door de overheid gesteunde coördinator zou volgens hem de nodige structuur bieden voor veiligheidsnormen.
Naast risicobeperking benadrukte Suleyman het positieve potentieel van breed beschikbare AI-tools. Hij wees op de waarde van deskundige assistentie die voor iedereen toegankelijk is en stelde dat huidige systemen met de juiste waarborgen beter stuurbaar worden.