AIO APEX

Arena, le leaderboard d'AI, lève 200 millions de dollars en Série B à une valorisation de 3,1 milliards, doublant en 10 mois

TechCrunch
Partager:
Arena, le leaderboard d'AI, lève 200 millions de dollars en Série B à une valorisation de 3,1 milliards, doublant en 10 mois

Arena, la plateforme d'évaluation de modèles d'AI issue d'un projet de recherche de UC Berkeley, a levé 200 millions de dollars en Série B à une valorisation de 3,1 milliards de dollars — soit presque le double des 1,7 milliard auxquels la société était valorisée lors de sa Série A il y a tout juste dix mois. Lightspeed Venture Partners et Khosla Ventures ont mené le tour de table, auxquels se sont joints Salesforce Ventures, a16z, Felicis, Dell Technologies Capital, 01 Advisors et Endeavor Catalyst.

La société a atteint 100 millions de dollars de chiffre d'affaires annualisé en juin 2026, contre 30 millions au moment de la Série A — une croissance des revenus multipliée par trois qui alimente l'accélération de la valorisation.

Arena a débuté en 2023 comme une expérience participative gratuite : présenter côte à côte les réponses de deux modèles d'AI et demander anonymement aux utilisateurs laquelle est la meilleure. Cette approche, baptisée «chatbot arena», réunit désormais des dizaines de millions de visiteurs mensuels qui votent collectivement sur la qualité des modèles pour un large éventail de tâches. Ces données sont devenues l'un des benchmarks les plus cités dans l'AI — des laboratoires d'Anthropic à Google s'y réfèrent lors de l'annonce de nouveaux modèles.

Le produit commercial s'appelle AI Evaluations, lancé en septembre 2025, et fournit aux laboratoires de modèles et aux entreprises des analyses de performance dérivées de ces retours communautaires. L'argument central : les benchmarks statiques perdent en pertinence car les laboratoires d'AI ont appris à les optimiser, et les modèles peuvent même détecter quand ils sont évalués sur des suites standards. Une évaluation en conditions réelles, pilotée par les utilisateurs, est bien plus difficile à manipuler.

Arena a récemment élargi son leaderboard pour inclure une catégorie alignement, classant les modèles sur les actions non autorisées, les fausses attributions et ce qu'elle appelle la «deceptive completion». Dans ces classements préliminaires, les modèles d'OpenAI occupent les premières places ; Claude Opus 5.5 se classe sixième et Claude Fable neuvième.

Ce financement traduit la conviction grandissante des investisseurs que l'évaluation indépendante de l'AI constitue un marché pérenne, et non une lacune temporaire que les laboratoires combleront eux-mêmes. À mesure que le déploiement de l'AI au sein des entreprises s'accélère, la demande pour une assurance qualité par des tiers — notamment dans les secteurs réglementés — devrait croître en parallèle.

Selon les informations de TechCrunch, le tour de table a été bouclé en octobre 2026.

Initialement rapporté par TechCrunch. Lisez l'article original pour plus de détails.

Voir la source originale
Partager: