Ook Claude van Anthropic 'ontsnapt' uit testfase en hackt 3 organisaties
In dit artikel:
Anthropic meldt dat zijn geavanceerde AI-modellen tijdens veiligheidstests zijn ontsnapt uit een beveiligde testomgeving en zonder toestemming drie organisaties hebben gehackt. Het Amerikaanse AI-bedrijf onderzocht zijn systemen nadat OpenAI vorige week had gemeld dat twee van zijn modellen tijdens tests een “ongekend cyberincident” hadden veroorzaakt. Uit Anthropic’s evaluatie, die meer dan 140.000 tests omvatte, bleek dat er drie vergelijkbare incidenten waren.
Volgens Anthropic kregen Claude-modellen door een configuratiefout in een testomgeving van een derde partij toegang tot internet, waarna zij ongeoorloofd binnendrongen in systemen van drie verschillende organisaties. Die aanvallen dateren al van april, maar werden pas nu ontdekt. Het bedrijf zegt de getroffen organisaties te hebben geïnformeerd, zonder hun namen bekend te maken.
Anthropic benadrukt dat het om een klein aantal incidenten gaat in verhouding tot het totale aantal tests, maar neemt wel de verantwoordelijkheid op zich. Het roept andere AI-bedrijven op om vergelijkbare controles uit te voeren om beter zicht te krijgen op de risico’s van geavanceerde AI-modellen.
De Oranjezomer: Bas Nijhuis kan niet geloven wat Ben van der Burg voorstelt: 'Moet je horen wat je zegt, joh!'