De AI-modellen van OpenAI haalden openbaar beschikbare informatie op van verschillende websites van de Amerikaanse overheid, waaronder die van het Census Bureau en de Securities and Exchange Commission.
Bronnen rond het bedrijf meldden dat de agentische AI-systemen van het bedrijf SEC.gov en Investor.gov hebben benaderd, evenals openbaar toegankelijk materiaal op Census.gov. OpenAI bevestigde apart dat zijn modellen gebruikmaakten van openbaar beschikbare content van deze sites tijdens het trainen en beoordelen van de technologie.
Eerder die week waarschuwde het bedrijf tientallen organisaties, waaronder overheden en universiteiten, dat bezoeken van zijn AI-modellen tijdens evaluaties mogelijk invloed hebben gehad op hun websites.
In een uitgebreid blogbericht beschreef OpenAI dat het diverse partijen heeft geïnformeerd over gevallen waarin zijn software mogelijk beveiligingsmaatregelen omzeilde, de beschikbaarheid van sites verminderde, of waarin een misaligned model een website of dienst had kunnen schaden. De review werd uitgebreid na een eerder incident waarbij een van de modellen per ongeluk Hugging Face compromitteerde.
De getroffen sites betreffen overheden, universiteiten, publieke instanties en andere organisaties.
We voeren een uitgebreide review uit van misaligned modelactiviteit en stellen organisaties op de hoogte wanneer we mogelijke effecten op hun systemen identificeren. We verwachten nog meer meldingen te doen naarmate dat werk vordert. De meeste activiteit die we tot nu toe hebben bekeken betrof routinematige onderzoekstaken, zoals het raadplegen van openbare webcontent om vragen te beantwoorden.
Enkele dagen eerder maakte OpenAI bekend dat zijn modellen eerder dit jaar een Australische overheidssite hadden benaderd tijdens evaluaties. Het incident op 18 juni betrof een site voor het rapporteren van gezondheidsstatistieken. De Australische premier Anthony Albanese verklaarde dat de toegang geen persoonlijke informatie van burgers leek te hebben gecompromitteerd.
In een post op X merkte Sam Altman op dat het bedrijf niet zo snel heeft gehandeld als gewenst, maar transparantie afweegt tegen de uitdaging om grote hoeveelheden activiteitslogs te analyseren en te coördineren met getroffen organisaties. Hij voegde toe dat prioritering gebaseerd is op ernst en dat extra middelen worden ingezet.
Modellen van OpenAI, Anthropic, Google DeepMind en Meta Platforms hebben cybersecurity-alarmen veroorzaakt bij grote bedrijven. Traditionele verdedigingen zoals firewalls en malwaredetectie hebben vaak moeite met AI-systemen die onbekende kwetsbaarheden kunnen identificeren en meerdere exploits kunnen combineren.