Arena Intelligence Inc. heeft 200 miljoen dollar aan vers kapitaal opgehaald bij een waardering van 3,1 miljard dollar, waarmee het bedrijf zijn ai-evaluatietools wil uitbreiden naar veiligheid en alignatiemetrics. De ronde, geleid door Lightspeed Venture Partners en Khosla Ventures met deelname van Salesforce Ventures en Dell Technologies Capital, komt op een moment dat de vraag groeit naar betrouwbare manieren om zowel de capaciteiten als de risico’s van geavanceerde ai-systemen te meten.
Het bedrijf vindt zijn oorsprong in 2023, toen onderzoekers van het Sky Computing Lab van de University of California at Berkeley Chatbot Arena lanceerden. Het platform liet gebruikers geavanceerde ai-modellen testen en hun output naast elkaar rangschikken. Gelanceerd kort nadat OpenAI’s ChatGPT brede interesse in generatieve ai had gewekt, won het instrument snel aan populariteit onder early adopters en werd het een belangrijk referentiepunt voor het volgen van modelontwikkeling.
Wat begon als een academisch experiment groeide in 2025 uit tot een zelfstandig bedrijf. Arena Intelligence beheert nu meerdere leaderboards die een breed scala aan taken bestrijken en trekt volgens medeoprichter en chief executive Anastasios Angelopoulos tientallen miljoenen maandelijkse bezoekers. De invloed van het platform is meegegroeid met de behoefte van de ai-industrie aan transparante, community-gedreven benchmarks.
Donderdag introduceert het bedrijf de Alignment Index, een leaderboard die modellen rangschikt op hoe goed ze gebruikersdoelen volgen terwijl ze ongeautoriseerde acties of valse claims over taakvoltooiing vermijden. De index put data uit gesprekken op Agent Arena, waar gebruikers modellen aansturen bij complexe meerstapsworkflows. In de eerste ranglijst staat OpenAI’s GPT-6.1 Sol op één en Anthropic’s Claude Opus 5.5 op twee onder meer dan twee dozijn geëvalueerde modellen.
De stap komt op een moment dat toonaangevende ontwikkelaars, waaronder OpenAI en Anthropic PBC, onder verhoogde scrutiny staan na recente beveiligingsincidenten met ongecontroleerd ai-gedrag. Angelopoulos benadrukte dat het bedrijf van plan is om in de loop der tijd meer veiligheidssignalen aan de index toe te voegen.
Het nieuwe kapitaal zal ook worden gebruikt om bedrijven te helpen hun eigen data in te zetten bij het selecteren van geschikte ai-modellen. Angelopoulos noemde de huidige fase van enterprise-evaluatiewerk vroeg maar veelbelovend. De vorige waardering van de startup bedroeg 1,7 miljard dollar na een financieringsronde in januari.
We zijn er nu nog in de beginfase. We hebben goede vooruitgang geboekt.