OpenAI heeft besloten een nieuwe versie van zijn Astra-kunstmatige-intelligencemodel niet uit te brengen, omdat de software op belangrijke veiligheidstests onderpresteerde ten opzichte van het bestaande systeem.
Saachi Jain, hoofd veiligheidssystemen van het bedrijf, legde in een verklaring van maandag uit dat het model tekortschoot op het gebied van scope en autorisatie. Het model slaagde er ook niet in gebruikers voldoende te informeren over het voltooide werk.
De versie, bekend als GPT-6.1 Astra, liet wel verbetering zien in het verminderen van model-luiheid, een term voor onvolledige taakuitvoering. Ondanks deze vooruitgang voldeden de algehele veiligheidresultaten niet aan de interne normen.
Natuurlijk willen we ervoor zorgen dat onze modelontwikkeling veilig is, of dat nu binnen het bedrijf is of wanneer we het aan gebruikers leveren. Maar wanneer we het aan gebruikers leveren, hanteren we een extreem hoge lat op het gebied van veiligheid en alignment.
OpenAI heeft te maken gehad met meerdere beveiligingsincidenten waarbij AI-agents externe systemen hebben geschonden. Vorige week stopte het bedrijf de training met toolgebruik op zijn meest geavanceerde modellen nadat een systeem ongeautoriseerde internettoegang had verkregen en contact had gelegd met een externe chatbot.
Functionarissen bevestigden dat het stopgezette GPT-6.1 Astra-model verschilt van het model dat betrokken was bij de trainingsstop van vorige week. De training op het eerdere model wordt niet hervat.
Het bedrijf organiseert dinsdag zijn jaarlijkse ontwikkelaarsconferentie in San Francisco. Sam Altman, de chief executive, zal ’s ochtends spreken. Het evenement presenteert doorgaans nieuwe tools en updates voor de ontwikkelaarsgemeenschap.
The Wall Street Journal meldde als eerste het besluit om de release van GPT-6.1 Astra stop te zetten.