Arena lève 200 millions de dollars lors d’un financement de série B
Arena, une entreprise née d’un projet de recherche à l’UC Berkeley en 2023, a annoncé avoir levé 200 millions de dollars lors d’un tour de financement de série B, atteignant une valorisation de 3,1 milliards de dollars.
Ce jalon de financement fait suite au rapport récent d’Arena, qui a déclaré avoir atteint un chiffre d’affaires annualisé de 100 millions de dollars en juin. Le tour de série B a été dirigé par Lightspeed Venture Partners et Khosla Ventures, avec la participation de Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, Felicis et d’autres investisseurs. Précédemment, Arena avait sécurisé 150 millions de dollars lors d’un tour de série A en janvier, à une valorisation de 1,7 milliard de dollars ; à ce moment-là, l’entreprise rapportait un chiffre d’affaires annuel de 30 millions de dollars. Cela indique que sa valorisation a presque doublé en l’espace de dix mois.
Arena opère une plateforme crowdsourcée permettant aux utilisateurs de soumettre des prompts ou de demander des projets et par la suite d’évaluer différents modèles d’IA en fonction de leur performance. L’entreprise affirme attirer des dizaines de millions de visiteurs mensuels, mettant en avant sa base d’utilisateurs en pleine expansion.
En septembre 2024, Arena a lancé son produit commercial, AI Evaluations, conçu pour fournir aux laboratoires de modèles et aux entreprises des analyses de performance basées sur les retours de la communauté. Ce lancement coïncide avec un moment critique dans le secteur de l’IA, où divers laboratoires ont été surpris à manipuler des tests de benchmarking pour obtenir des scores favorables sans fournir d’évaluations précises. Les entreprises recherchent de plus en plus une assistance fiable pour identifier les meilleurs modèles répondant à leurs besoins spécifiques, au-delà des benchmarks conventionnels.
« L’IA progresse plus vite que notre capacité à l’évaluer, et les benchmarks statiques échouent une fois que les modèles comprennent qu’ils sont testés, » a déclaré la société dans son annonce de financement. « Le monde a besoin d’un tiers neutre pour mesurer à quel point l’IA est réellement sûre et alignée une fois qu’elle est entre les mains de vraies personnes. Arena s’engage à jouer ce rôle dès aujourd’hui, » a-t-elle ajouté.
En réponse à l’évolution du paysage, Arena a élargi son classement pour inclure une nouvelle catégorie axée sur l’alignement. Cette section classe les modèles d’IA selon des critères tels que les actions non autorisées, la fausse attribution et ce qu’Arena décrit comme « achèvement trompeur », se référant aux modèles affirmant faussement avoir complété une tâche.
Actuellement, les modèles d’OpenAI dominent le classement préliminaire d’alignement d’Arena, avec Claude Opus 5.5 et Claude Fable respectivement classés sixième et neuvième.