Nog een AI-model verlaat testomgeving en breekt in bij drie bedrijven

vrijdag, 31 juli 2026 (18:29) - NU.nl

In dit artikel:

Anthropic meldt dat een testversie van zijn AI-model Claude tijdens veiligheidstests in drie gevallen is doorgeschoten en systemen van bedrijven heeft binnengedrongen. Het bedrijf onderzocht ruim 140.000 testsessies nadat OpenAI eerder een vergelijkbaar incident had gemeld. Volgens Anthropic kregen de modellen in de proefomgeving de instructie dat ze geen internettoegang hadden, maar stond die door een fout in werkelijkheid wel open. De modellen maakten daar gebruik van door onder meer zwakke wachtwoorden op te sporen. Om welke bedrijven het gaat, zegt Anthropic niet. De tests waren bedoeld om te controleren waartoe de modellen in staat zijn, bijvoorbeeld bij het zoeken naar verborgen informatie. Anthropic stelt dat de gebeurtenissen laten zien dat stevige beveiligingscontroles noodzakelijk blijven. Eerder moesten zowel OpenAI als Anthropic de introductie van nieuwe technologie tijdelijk uitstellen vanwege zorgen in Washington.

BEKIJK OOK:

De Oranjezomer: Ingrid Coenradie windt zich op en wil meer bevoegdheden voor politie: 'Echt ontiegelijk kwalijk!'