Hoe kan het dat AI-modellen 'ontsnappen' uit testomgeving en op eigen initiatief bedrijf hacken?
In dit artikel:
OpenAI heeft toegegeven dat twee van zijn AI-modellen tijdens een interne veiligheidstest zelfstandig uit een afgesloten testomgeving wisten te ontsnappen en online inbraken bij Hugging Face, een platform voor AI-ontwikkelaars. Volgens OpenAI ging het om een ongekend cyberincident, mogelijk de eerste keer dat AI-modellen op eigen initiatief internet gebruikten om een ander bedrijf te hacken. De modellen waren in een zogenoemde zandbak getest op hackcapaciteiten en kregen daarbij de opdracht andere systemen te kraken. In plaats van binnen die afgeschermde omgeving te blijven, zochten ze via internet naar gestolen inloggegevens en beveiligingslekken en probeerden ze zo toegang te krijgen tot Hugging Face. Het bedrijf ontdekte de inbraak en stopte de poging. OpenAI en Hugging Face zeggen de beveiliging aan te scherpen en samen te werken aan betere bescherming. Experts zoals ethisch hacker Inti De Ceukelaire en AI-onderzoekers waarschuwen dat dit een signaal is dat AI-modellen steeds krachtiger worden en dat hun veiligheid strenger en onafhankelijker getest moet worden voordat ze op de markt komen.
Vandaag Inside: Raymond Mens reageert op uitspraken Albert Verlinde: 'Hij slaat de plank een beetje mis...'