Données de démonstration. Échantillon représentatif (issu d'un 1er scrap de benchmarks) en attendant l'import des modèles réels. Dès qu'un modèle est publié en back-office, ce jeu de démo disparaît.
| Rang | Modèle | IA | Éditeur | ||
|---|---|---|---|---|---|
| 1 | Qwen 3.7 Plus Récent Qwen · Alibaba | 91,4/100 | Qwen | Alibaba | Juillet 2026 |
| 2 | Gemini 3 Pro Gemini · Google | 90,8/100 | Gemini | Mars 2026 | |
| 3 | GPT-5.1 ChatGPT · OpenAI | 89,1/100 | ChatGPT | OpenAI | Avril 2026 |
| 4 | Kimi K3 Récent Kimi · Moonshot AI | 88,8/100 | Kimi | Moonshot AI | Juin 2026 |
| 5 | DeepSeek V3.2 (Thinking) DeepSeek · DeepSeek | 88,7/100 | DeepSeek | DeepSeek | Février 2026 |
| 6 | Claude Opus 4.6 (Thinking) Claude · Anthropic | 88,1/100 | Claude | Anthropic | Janvier 2026 |
| 7 | Grok 4.5 Récent Grok · xAI | 86,0/100 | Grok | xAI | Juin 2026 |
| 8 | Claude Fable 5 Récent Claude · Anthropic | 85,1/100 | Claude | Anthropic | Juillet 2026 |
| 9 | MiMo V2.5 Pro Récent MiMo · Xiaomi | 84,7/100 | MiMo | Xiaomi | Juin 2026 |
| 10 | GPT-5.4 Récent ChatGPT · OpenAI | 84,1/100 | ChatGPT | OpenAI | Mai 2026 |
| 11 | Gemma 4 26B Gemini · Google | 83,7/100 | Gemini | Avril 2026 | |
| 12 | Qwen 3.5 27B Qwen · Alibaba | 82,8/100 | Qwen | Alibaba | Mars 2026 |
| 13 | Gemini 3.5 Flash Récent Gemini · Google | 81,8/100 | Gemini | Juillet 2026 | |
| 14 | GLM-4.5 ChatGLM · Zhipu AI | 81,7/100 | ChatGLM | Zhipu AI | Décembre 2025 |
| 15 | MiniMax M2 MiniMax · MiniMax | 80,7/100 | MiniMax | MiniMax | Février 2026 |
| 16 | Claude Sonnet 5 Récent Claude · Anthropic | 80,6/100 | Claude | Anthropic | Juillet 2026 |
| 17 | DeepSeek V4 Pro Récent DeepSeek · DeepSeek | 80,6/100 | DeepSeek | DeepSeek | Juillet 2026 |
| 18 | DeepSeek V3.2 DeepSeek · DeepSeek | 79,7/100 | DeepSeek | DeepSeek | Janvier 2026 |
| 19 | Claude Opus 4.8 Récent Claude · Anthropic | 78,6/100 | Claude | Anthropic | Juillet 2026 |
| 20 | Nemotron 3 Ultra 550B Récent Nemotron · NVIDIA | 78,0/100 | Nemotron | NVIDIA | Juin 2026 |
| 21 | GPT-5.5 Récent ChatGPT · OpenAI | 77,5/100 | ChatGPT | OpenAI | Juillet 2026 |
| 22 | Claude Opus 4.7 Claude · Anthropic | 77,2/100 | Claude | Anthropic | Avril 2026 |
| 23 | Gemini 2.5 Flash Gemini · Google | 75,2/100 | Gemini | Novembre 2025 | |
| 24 | Grok 4.3 Récent Grok · xAI | 74,8/100 | Grok | xAI | Juin 2026 |
| 25 | DeepSeek V3 DeepSeek · DeepSeek | 74,2/100 | DeepSeek | DeepSeek | Octobre 2025 |
| 26 | Kimi K2.6 Kimi · Moonshot AI | 73,1/100 | Kimi | Moonshot AI | Février 2026 |
| 27 | Llama 4 Maverick Meta AI · Meta | 72,4/100 | Meta AI | Meta | Janvier 2026 |
| 28 | Mistral Large 3 Le Chat · Mistral AI | 71,9/100 | Le Chat | Mistral AI | Mars 2026 |
| 29 | GPT-5 Mini ChatGPT · OpenAI | 70,0/100 | ChatGPT | OpenAI | Mars 2026 |
| 30 | Claude Haiku 4.5 Claude · Anthropic | 67,9/100 | Claude | Anthropic | Décembre 2025 |
Aucun modèle ne correspond à votre recherche.
Note = score global /100 (façon benchmarks). Rang par note (à égalité, sortie la plus récente d'abord). « IA » = l'outil auquel le modèle se rattache. Cliquez les en-têtes pour trier, les pastilles pour filtrer par domaine.
Comment la note est-elle calculée ?
Chaque modèle porte aujourd'hui un score global unique sur 100. À terme, ce score agrégera plusieurs classements publics de référence, chacun ramené sur 100 puis pondéré :
- LMArenapréférences humaines (Elo)
- Artificial Analysisindice de qualité global
- MMLU-Pro · GPQAconnaissances & raisonnement
- SWE-bench · LiveCodeBenchcode
Méthodologie cible : la ventilation par source ci-dessus n'est pas encore branchée (un seul champ de note en base). Elle décrit l'agrégation prévue, pas un détail déjà mesuré modèle par modèle.