Les meilleurs modèles d'IA pour le chat
Chat : la capacité du modèle à tenir une conversation utile — comprendre la demande, répondre juste, clairement et avec le bon ton, quel que soit le sujet. Réussir, c'est être la réponse que l'on préfère quand on en lit deux côte à côte. Score : système Elo, d'après les votes d'Arena — comment ça marche ?
| Écart de rang | IA | ||||||
|---|---|---|---|---|---|---|---|
| 6 | 28 | Qwen 3.7 Plus Récent Alibaba · Qwen | 1495±5 | 45 800 | Qwen | ||
| 2 | 18 | Gemini 3 Pro Google · Gemini | 1510±12 | 62 100 | Gemini | $2 / $12 | 2M |
| 4 | 18 | GPT-5.1 OpenAI · ChatGPT | 1507±12 | 52 600 | ChatGPT | $1.25 / $10 | 400K |
| 1 | 16 | Kimi K3 Récent Moonshot AI · Kimi | 1512±10 | 7 100 | Kimi | ||
| 5 | 18 | DeepSeek V3.2 (Thinking) DeepSeek · DeepSeek | 1500±4 | 31 000 | DeepSeek | ||
| 10 | 715 | Claude Opus 4.6 (Thinking) Anthropic · Claude | 1477±10 | 5 600 | Claude | ||
| 3 | 18 | Grok 4.5 Récent xAI · Grok | 1507±8 | 66 200 | Grok | ||
| 7 | 110 | Claude Fable 5 Récent Anthropic · Claude | 1494±10 | 69 500 | Claude | ||
| 13 | 919 | MiMo V2.5 Pro Récent Xiaomi · MiMo | 1467±10 | 39 700 | MiMo | ||
| 9 | 713 | GPT-5.4 Récent OpenAI · ChatGPT | 1481±5 | 19 000 | ChatGPT | ||
| 15 | 1319 | Gemma 4 26B Google · Gemini | 1460±5 | 43 600 | Gemini | ||
| 8 | 210 | Qwen 3.5 27B Alibaba · Qwen | 1491±8 | 45 700 | Qwen | ||
| 11 | 914 | Gemini 3.5 Flash Récent Google · Gemini | 1474±4 | 9 300 | Gemini | ||
| 12 | 915 | GLM-4.5 Zhipu AI · ChatGLM | 1473±6 | 70 200 | ChatGLM | ||
| 14 | 1019 | DeepSeek V4 Pro Récent DeepSeek · DeepSeek | 1465±10 | 52 600 | DeepSeek | $0.28 / $0.42 | 128K |
| 18 | 1125 | MiniMax M2 MiniMax · MiniMax | 1455±13 | 46 100 | MiniMax | ||
| 21 | 1725 | Claude Sonnet 5 Récent Anthropic · Claude | 1447±4 | 58 100 | Claude | ||
| 19 | 1622 | DeepSeek V3.2 DeepSeek · DeepSeek | 1450±4 | 67 300 | DeepSeek | 128K | |
| 16 | 1320 | Claude Opus 4.8 Récent Anthropic · Claude | 1459±6 | 48 200 | Claude | $5 / $25 | 1M |
| 22 | 1825 | Nemotron 3 Ultra 550B Récent NVIDIA · Nemotron | 1443±6 | 12 300 | Nemotron | ||
| 17 | 1321 | GPT-5.5 Récent OpenAI · ChatGPT | 1456±5 | 59 500 | ChatGPT | ||
| 20 | 1325 | Claude Opus 4.7 Anthropic · Claude | 1449±13 | 54 100 | Claude | 200K | |
| 26 | 2427 | Gemini 2.5 Flash Google · Gemini | 1429±6 | 44 200 | Gemini | 1M | |
| 27 | 2530 | Grok 4.3 Récent xAI · Grok | 1417±12 | 26 600 | Grok | ||
| 24 | 1926 | DeepSeek V3 DeepSeek · DeepSeek | 1437±7 | 52 900 | DeepSeek | ||
| 25 | 1927 | Kimi K2.6 Moonshot AI · Kimi | 1435±10 | 41 200 | Kimi | ||
| 29 | 2730 | Llama 4 Maverick Meta · Meta AI | 1408±12 | 25 300 | Meta AI | ||
| 23 | 1925 | Mistral Large 3 Mistral AI · Le Chat | 1440±4 | 63 700 | Le Chat | ||
| 28 | 2730 | GPT-5 Mini OpenAI · ChatGPT | 1409±13 | 62 100 | ChatGPT | 200K | |
| 30 | 2730 | Claude Haiku 4.5 Anthropic · Claude | 1398±13 | 37 100 | Claude |
Aucun modèle ne correspond à votre recherche.
Aucun modèle classé en Chat pour le moment.
Score Elo façon Arena (préférences humaines) : « 1506 ±5 » = score et intervalle de confiance à 95 %. Rang par score ; l'écart de rang = la fourchette compatible avec cet intervalle. Votes = nombre de duels jugés. « IA » = l'outil auquel le modèle se rattache. Cliquez les en-têtes pour trier, les pastilles pour changer de classement.
Comment le score est-il calculé ?
Le score est un Elo, à la façon d'Arena : des personnes comparent deux modèles à l'aveugle sur une même demande et désignent le meilleur. Chaque duel déplace le score des deux modèles ; plus un modèle gagne face à des adversaires forts, plus il monte. Le « ± » est l'intervalle de confiance à 95 % : il se resserre à mesure que les votes s'accumulent.
Le rang suit le score. L'écart de rang (« 1 ⊸ 7 ») donne les places qu'un modèle peut réellement occuper une fois l'incertitude prise en compte : deux modèles dont les intervalles se recouvrent ne sont pas départagés. Chaque classement (général, par modalité, par tâche) a ses propres scores, votes et rangs ; un modèle qui n'a pas été évalué dans un classement n'y figure pas.