Arena lève 200 M$ en série B à 3,1 Md$ de valorisation
Arena, plateforme communautaire de classement des modèles d'IA née à UC Berkeley, a bouclé une série B de 200 M$ menée par Lightspeed Venture Partners et Khosla Ventures. La valorisation atteint 3,1 Md$, près du double des 1,7 Md$ de janvier, alors que le revenu annualisé est passé de 30 M$ à 100 M$.

Dans cet article
Une valorisation presque doublée en dix mois
Arena a annoncé jeudi avoir levé 200 M$ en série B, sur la base d'une valorisation de 3,1 Md$, selon TechCrunch. Le tour est mené par Lightspeed Venture Partners et Khosla Ventures, aux côtés de Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, Felicis et d'autres investisseurs.
En janvier, la société avait déjà levé 150 M$ en série A, pour une valorisation post-money de 1,7 Md$. Elle affichait alors un revenu annualisé de 30 M$. Le passage à 3,1 Md$ correspond donc à un quasi-doublement en une dizaine de mois. En juin, Arena a indiqué avoir franchi la barre des 100 M$ de revenus annualisés.
Un classement alimenté par les votes des utilisateurs
Le service grand public d'Arena est gratuit : les internautes saisissent des instructions, demandent des projets générés par « vibe coding », puis désignent le modèle qui s'en sort le mieux. La plateforme revendique plusieurs dizaines de millions de visiteurs par mois.
En septembre de l'année dernière, l'entreprise a lancé AI Evaluations, son produit commercial. Il fournit aux laboratoires de modèles et aux entreprises des analyses détaillées de performance, construites à partir des retours de la communauté. Le calendrier s'est révélé opportun : cette année, les laboratoires ont constaté que leurs modèles contournaient les tests d'évaluation, obtenant de bons scores sans les mériter. Les entreprises, de leur côté, cherchaient à identifier le modèle le plus adapté à leurs besoins internes plutôt que de se fier aux seuls benchmarks standardisés.
« L'IA progresse plus vite que notre capacité à l'évaluer, et les benchmarks statiques s'effondrent dès que les modèles comprennent qu'ils sont testés », a déclaré la société dans l'annonce de son financement. « Le monde a besoin d'un tiers neutre pour mesurer à quel point l'IA est réellement sûre et alignée une fois entre les mains du grand public. Arena endosse ce rôle dès aujourd'hui », a-t-elle ajouté.
Un classement dédié à l'alignement des modèles
Arena a ajouté une catégorie à son classement : l'alignement. Les modèles y sont évalués sur plusieurs critères, notamment les actions non autorisées, c'est-à-dire celles qu'un modèle entreprend sans qu'on le lui ait demandé ; l'attribution erronée, qui consiste à créditer une déclaration ou un fait à la mauvaise source ; et ce que l'entreprise appelle la « réalisation trompeuse », soit le fait de prétendre avoir accompli une tâche qui ne l'a pas été.
Dans ce classement préliminaire, plusieurs modèles d'OpenAI occupent les premières places. Claude Opus 5.5 et Claude Fable figurent respectivement en sixième et neuvième position.


