Les meilleurs modèles d'IA pour le chat

Chat : la capacité du modèle à tenir une conversation utile — comprendre la demande, répondre juste, clairement et avec le bon ton, quel que soit le sujet. Réussir, c'est être la réponse que l'on préfère quand on en lit deux côte à côte. Score : système Elo, d'après les votes d'Arena — comment ça marche ?

Mis à jour en continu ·30 modèles classés ·Septembre 2026
Écart de rang IA
6 28 Qwen 3.7 Plus Récent Alibaba · Qwen 1495±5 45 800 Qwen
2 18 Gemini 3 Pro Google · Gemini 1510±12 62 100 Gemini $2 / $12 2M
4 18 GPT-5.1 OpenAI · ChatGPT 1507±12 52 600 ChatGPT $1.25 / $10 400K
1 16 Kimi K3 Récent Moonshot AI · Kimi 1512±10 7 100 Kimi
5 18 DeepSeek V3.2 (Thinking) DeepSeek · DeepSeek 1500±4 31 000 DeepSeek
10 715 Claude Opus 4.6 (Thinking) Anthropic · Claude 1477±10 5 600 Claude
3 18 Grok 4.5 Récent xAI · Grok 1507±8 66 200 Grok
7 110 Claude Fable 5 Récent Anthropic · Claude 1494±10 69 500 Claude
13 919 MiMo V2.5 Pro Récent Xiaomi · MiMo 1467±10 39 700 MiMo
9 713 GPT-5.4 Récent OpenAI · ChatGPT 1481±5 19 000 ChatGPT
15 1319 Gemma 4 26B Google · Gemini 1460±5 43 600 Gemini
8 210 Qwen 3.5 27B Alibaba · Qwen 1491±8 45 700 Qwen
11 914 Gemini 3.5 Flash Récent Google · Gemini 1474±4 9 300 Gemini
12 915 GLM-4.5 Zhipu AI · ChatGLM 1473±6 70 200 ChatGLM
14 1019 DeepSeek V4 Pro Récent DeepSeek · DeepSeek 1465±10 52 600 DeepSeek $0.28 / $0.42 128K
18 1125 MiniMax M2 MiniMax · MiniMax 1455±13 46 100 MiniMax
21 1725 Claude Sonnet 5 Récent Anthropic · Claude 1447±4 58 100 Claude
19 1622 DeepSeek V3.2 DeepSeek · DeepSeek 1450±4 67 300 DeepSeek 128K
16 1320 Claude Opus 4.8 Récent Anthropic · Claude 1459±6 48 200 Claude $5 / $25 1M
22 1825 Nemotron 3 Ultra 550B Récent NVIDIA · Nemotron 1443±6 12 300 Nemotron
17 1321 GPT-5.5 Récent OpenAI · ChatGPT 1456±5 59 500 ChatGPT
20 1325 Claude Opus 4.7 Anthropic · Claude 1449±13 54 100 Claude 200K
26 2427 Gemini 2.5 Flash Google · Gemini 1429±6 44 200 Gemini 1M
27 2530 Grok 4.3 Récent xAI · Grok 1417±12 26 600 Grok
24 1926 DeepSeek V3 DeepSeek · DeepSeek 1437±7 52 900 DeepSeek
25 1927 Kimi K2.6 Moonshot AI · Kimi 1435±10 41 200 Kimi
29 2730 Llama 4 Maverick Meta · Meta AI 1408±12 25 300 Meta AI
23 1925 Mistral Large 3 Mistral AI · Le Chat 1440±4 63 700 Le Chat
28 2730 GPT-5 Mini OpenAI · ChatGPT 1409±13 62 100 ChatGPT 200K
30 2730 Claude Haiku 4.5 Anthropic · Claude 1398±13 37 100 Claude

Score Elo façon Arena (préférences humaines) : « 1506 ±5 » = score et intervalle de confiance à 95 %. Rang par score ; l'écart de rang = la fourchette compatible avec cet intervalle. Votes = nombre de duels jugés. « IA » = l'outil auquel le modèle se rattache. Cliquez les en-têtes pour trier, les pastilles pour changer de classement.

Comment le score est-il calculé ?

Le score est un Elo, à la façon d'Arena : des personnes comparent deux modèles à l'aveugle sur une même demande et désignent le meilleur. Chaque duel déplace le score des deux modèles ; plus un modèle gagne face à des adversaires forts, plus il monte. Le « ± » est l'intervalle de confiance à 95 % : il se resserre à mesure que les votes s'accumulent.

Le rang suit le score. L'écart de rang (« 1 ⊸ 7 ») donne les places qu'un modèle peut réellement occuper une fois l'incertitude prise en compte : deux modèles dont les intervalles se recouvrent ne sont pas départagés. Chaque classement (général, par modalité, par tâche) a ses propres scores, votes et rangs ; un modèle qui n'a pas été évalué dans un classement n'y figure pas.

Maîtrisez l'IA et les Agents IA dès aujourd'hui !

Inscrivez-vous à notre newsletter pour recevoir en exclusivité les dernières tendances, innovations et astuces sur l'intelligence artificielle. Rejoignez-nous maintenant !

En vous abonnant, vous certifiez que vous avez examiné et accepté notre Politique de Confidentialité et notre Politique de Cookies mises à jour.