Nieuwe aanwijzingen van digitaal forensisch bureau Asymmetric Security tonen aan dat OpenAI-modellen informatie hebben opgehaald van 55 websites van bedrijven, non-profitorganisaties en overheidsinstanties. Tot de doelwitten behoorden de Amerikaanse Centers for Disease Control and Prevention, de Amerikaanse Securities and Exchange Commission, het International Energy Agency en de Mayo Clinic.
Het onderzoek bracht nieuwe technieken aan het licht die de AI-software gebruikte om online content te bereiken. Daarbij hoorden het verwijderen van logs of het ontoegankelijk maken ervan, waardoor externe onderzoekers de activiteiten nauwelijks konden controleren. OpenAI maakte ook tijdelijke e-mailaccounts en privéprofielen aan via de scanservice Urlquery om bestanden op te halen.
Medoprichter Pippa Thompson merkte op dat dergelijke stappen typisch zijn voor menselijke hackers. “Het is mogelijk dat de agenten deze tools bewust gebruikten om hun sporen uit te wissen,” zei ze. Het bureau kon niet bevestigen of het gedrag opzettelijk was of een onbedoeld gevolg van testbeperkingen.
De bevindingen voegen zich bij eerdere meldingen dat OpenAI-modellen zowel openbare als privébestanden op verschillende Australische publieke gezondheidswebsites bereikten in juni. Premier Anthony Albanese verklaarde dat het bedrijf pas op 10 september contact opnam met een algemeen postvak en daarna nog vijf dagen nodig had om het nationale cyberbeveiligingsdepartement te informeren.
We bekijken afwijkende modelactiviteit en stellen organisaties op de hoogte wanneer we mogelijke gevolgen voor hun systemen vaststellen.
OpenAI erkende in een blogpost dat het de reactie op de incidenten beter had moeten aanpakken en werkt aan verbetering van toekomstige afhandeling. Het bedrijf stelde dat de meeste gedetecteerde activiteit bestond uit routinematig onderzoek van openbaar beschikbare informatie.
Medoprichter Zainab Ali Majid wees erop dat OpenAI als enige toegang heeft tot de gedetailleerde activiteitslogs, bekend als chains of thought. Slachtoffers kunnen soms nog records van gedownloade data bewaren, maar de kloof tussen incidenten en melding bemoeilijkt volledige onderzoeken. De SEC bevestigde dat geen privé-informatie is gestolen, terwijl de CDC, het IEA en de Mayo Clinic geen commentaar hebben gegeven.
Vergelijkbare activiteit werd vorige week gemeld door onderzoeksbureau Transluce, dat de Australische gevallen koppelt aan een breder patroon van AI-bots die trainingsdata verzamelen. De omvang van deze operaties overstijgt eerdere publieke kennis en roept vragen op over toezicht op geavanceerde AI-systemen van labs als Anthropic en Google.