Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
Design Arena est un benchmark de design IA en ligne : vous soumettez un prompt créatif, plusieurs modèles d’IA y répondent, et vos votes à l’aveugle décident quel résultat l’emporte. Ses conditions le décrivent comme une plateforme de benchmark pour évaluer et classer des modèles de machine learning via des designs générés par IA, proposée par Arcada Labs Incorporated.
La même session sert aussi d’outil de création. Les utilisateurs décrivent ce qu’ils veulent produire, d’un site web ou d’un jeu à une image, une vidéo, une présentation ou une application, et voient côte à côte comment les meilleurs modèles la concrétisent.
Les chiffres d’audience proviennent de deux sources différentes. La page d’accueil affirme que des millions de personnes dans plus de 190 pays utilisent Design Arena pour découvrir et comparer des modèles. Un article de presse indépendant d’août 2026 évoquait 5,3 millions de personnes dans le monde.
Le nom se confond facilement avec Arena (anciennement LMArena et Chatbot Arena), une plateforme web publique qui évalue les grands modèles de langage. Les propres conditions de Design Arena désignent Arcada Labs Incorporated comme fournisseur ; le service vise les rendus visuels et interactifs plutôt que les réponses de chat.
Chaque session de vote tire quatre modèles du pool actif, plus un de réserve, et tous reçoivent exactement le même prompt. L’identité des modèles reste masquée pendant toute l’évaluation pour éviter le biais de marque. Les résultats sont aussi dévoilés simultanément pour que les modèles les plus rapides ne soient pas avantagés ; selon les notes méthodologiques, cette règle pourrait changer plus tard.
La session forme un petit tableau de tournoi plutôt qu’un choix unique entre A et B. Deux paires sont d’abord départagées, puis gagnants et perdants s’affrontent, et chacun des cinq duels produit un vote qui alimente à la fois les taux de victoire et le modèle de notation. On obtient ainsi un classement complet du 1er au 4e à partir d’un seul prompt.
Dans la Model Arena principale, un modèle ne peut participer que s’il accepte une entrée texte et renvoie un fichier de code HTML/JS/CSS unique. Les prompts système restent identiques d’un fournisseur à l’autre pour minimiser les biais ; chaque modèle suit donc les mêmes instructions.
Les classements sont calculés avec le modèle de Bradley-Terry, une méthode statistique conçue pour les données de comparaison par paires, et affichés en notes de type Elo. La force estimée de chaque modèle est convertie selon Rating = 400 × log₁₀(strength). La marge d’erreur repose sur un intervalle de confiance de Wilson à environ 95 %. Chaque vote par paire a le même poids, sans filtrage ni ajustement éditorial. Le classement est mis à jour avec les résultats en direct toutes les deux heures, et les modèles comptant moins de 50 votes portent une étiquette « new » (nouveau) signalant que leur position peut encore bouger.
La liste des modèles change souvent, ce qui explique en partie l’utilité de Design Arena comme classement de modèles d’IA. Le 22 septembre 2026, le journal a enregistré l’ajout de claude-opus-5-5, gpt-6-sol et gpt-6-luna. Les retraits sont brièvement motivés, par exemple un modèle systématiquement classé dernier dans toutes les catégories.
Le service n’est pas destiné aux moins de 18 ans : les conditions n’en autorisent l’usage qu’aux personnes de 18 ans ou plus capables de conclure un contrat contraignant.
Aucune page de tarifs dédiée n’a été trouvée parmi les pages consultées, et /pricing renvoyait « not found » (introuvable). Les conditions précisent qu’aucun frais n’est facturé pour l’utilisation des Services sauf indication contraire, par exemple pour certaines fonctionnalités supplémentaires limitées. Les règles payantes ci-dessous viennent des textes de l’interface compte et facturation.
| Mode d’accès | Ce qu’il couvre | Coût publié |
|---|---|---|
| Offre gratuite | Prompts et votes au quotidien dans les limites d’usage | Aucun frais selon les conditions |
| Crédits prépayés | Usage au-delà de l’offre gratuite, plus avantages Pro | Recharges de $5 à $100 |
| Mode Premium | Modèles les mieux classés par Elo pour une génération | Coût réel par génération |
| API du classement | Données de classement programmatiques | Gratuite, avec attribution |
Les crédits forment un solde prépayé, déduit seulement quand vous dépassez les limites de l’offre gratuite. Les recharges vont de $5 à $100 par achat. L’usage gratuit comporte des plafonds par catégorie en plus d’une limite quotidienne commune, et ces limites varient selon la complexité du prompt ; le nombre de générations gratuites n’est donc pas un chiffre fixe. L’un des avantages Pro concerne la durée des vidéos : jusqu’à 15 secondes, contre 5 secondes avec l’offre gratuite.
Le mode Premium sélectionne les meilleurs modèles selon Elo pour la génération concernée et facture le coût réel par génération. Les prix par type se chargent dans l’espace du compte et n’apparaissaient pas sur les pages consultées.
La disponibilité d’une catégorie peut dépendre des crédits. Lorsqu’une catégorie est en pause, un message indique qu’elle sera bientôt de retour et utilisable dès maintenant en ajoutant des crédits, tandis que les diaporamas et les sites web restent accessibles sans limite.
L’API du classement est un parcours distinct : ses données sont gratuites pour les projets personnels et commerciaux.
La comparaison la plus proche est une arène centrée sur le texte. Un article de presse indépendant a décrit LM Arena comme adoptant une approche similaire pour les réponses textuelles. Ce service, désormais appelé Arena et hébergé sur arena.ai, propose aussi des classements pour modèles WebDev, modèles de texte, génération d’images et génération de vidéos ; les deux se recoupent donc sur les tâches web et image, tout en différant par leur origine et leur orientation.
Artificial Analysis emprunte une autre voie : il publie des benchmarks indépendants des modèles d’IA et des fournisseurs d’API portant sur la qualité, le prix, la vitesse de sortie et la latence. Il gère aussi les classements Image Arena et Video Arena, ce qui en fait le meilleur choix lorsque le coût et la vitesse comptent autant que le goût.
| Option | Signal principal | Idéal pour |
|---|---|---|
| Design Arena | Votes à l’aveugle de la communauté sur des rendus visuels et interactifs | Sites web, UI, diapositives, logos, jeux |
| Arena.ai | Votes de la communauté, texte d’abord, avec classements WebDev et médias | Chat et choix d’un modèle généraliste |
| Artificial Analysis | Qualité, prix, vitesse et latence mesurés | Arbitrages entre coût et performance |
Les propres pages de Design Arena ne décrivent pas les règles de classement de la même manière :
Les classements reflètent donc la préférence de la communauté selon ces règles, et non une batterie de tests figée, et un nouvel entrant peut bouger de façon notable.
Les prompts des utilisateurs sont modérés via un appel API à gemini-2.5-flash-lite-preview-09-2025, un modèle choisi pour son coût selon les notes. Les instructions de modération publiées lui demandent aussi de vérifier si les prompts contiennent quoi que ce soit de politique, des personnalités politiques ou des symboles politiques ou religieux ; des briefs de design liés à l’actualité ou de style campagne électorale peuvent donc être signalés.
Les prompts et votes de base sont sans frais selon les conditions, dans des limites d’usage gratuit qui varient selon la catégorie et la complexité du prompt. Des crédits prépayés de $5 à $100 couvrent l’usage au-delà de ces limites, et le mode Premium facture le coût réel par génération.
Les votes issus de duels à l’aveugle alimentent un modèle de Bradley-Terry, qui produit des notes de type Elo. Le classement est actualisé toutes les deux heures, et les modèles comptant moins de 50 votes sont signalés comme nouveaux.
Oui. L’API Design Arena est gratuite pour les projets personnels et commerciaux une fois la demande approuvée, mais tout usage public doit citer Design Arena et renvoyer vers designarena.ai.
Les prompts, résultats et médias téléversés peuvent être partagés avec des fournisseurs tiers de technologies d’IA, y compris pour l’entraînement. Design Arena prend d’abord des mesures pour retirer les noms d’utilisateur et adresses e-mail, mais les informations personnelles écrites dans le contenu lui-même peuvent encore être partagées.
Non. Arena (anciennement LMArena et Chatbot Arena) est une plateforme distincte consacrée à l’évaluation des grands modèles de langage, tandis que Design Arena, d’Arcada Labs Incorporated, classe les modèles selon leurs rendus de design visuels et interactifs.