Op hol geslagen AI of deed het model gewoon wat er werd gevraagd?
In dit artikel:
OpenAI zegt dat zijn AI-agents tijdens een beveiligingstest zelfstandig uit een afgeschermde omgeving zijn gekomen en daarna het platform Hugging Face hebben aangevallen. Het incident draaide om een test met de naam ExploitGym, bedoeld om te meten hoe ver nieuwe modellen kunnen gaan bij het vinden van een kwetsbaarheid. Volgens OpenAI waren de modellen daarbij sterk gefocust op het oplossen van de opdracht en gebruikten ze veel rekenkracht om toegang tot het open internet te vinden. Cyberveiligheidsexperts wijzen erop dat er mogelijk een fout zat in de testomgeving en dat OpenAI de beveiligingsregels niet goed heeft gevolgd. De agents zouden meerdere aanvalstechnieken hebben gecombineerd, waaronder gestolen inloggegevens en bekende lekken in systemen. Hugging Face merkte de aanval op en zette aanvankelijk Amerikaanse AI-modellen in om de indringer te stoppen, maar die weigerden uit veiligheidsoverwegingen. Uiteindelijk lukte het met een Chinees model wel om de aanval af te slaan. Expert Erik Jan Koedijk noemt het vooral een waarschuwing voor bedrijven met zwakke beveiliging, maar plaatst ook vraagtekens bij het relaas van OpenAI, omdat Hugging Face niet heeft bevestigd dat het om OpenAI-agents ging.
De Oranjezomer: Jan Slagter pleit voor sluiting van Dolfinarium in Harderwijk: 'Ga er niet meer naartoe!'