Les meilleurs modèles d'IA pour les conversations à plusieurs tours
Conversation à plusieurs tours : la capacité du modèle à tenir un échange long, à plusieurs tours, où chaque réponse doit s'appuyer sur les précédentes. Réussir, c'est garder le fil et rester cohérent jusqu'à la fin. Score Elo calculé par Arena. Comment ça marche ?
| Éditeur | |||||
|---|---|---|---|---|---|
| 7 | Claude Opus 4.8 Sa place en Conversation à plusieurs tours | 1 498 | $5 / $25 | 1 M | |
| 1 | Muse Spark 1.2 | 1 522 | $1.25 / $4.25 | 1,05 M | |
| 2 | Claude Fable 5 | 1 518 | $10 / $50 | 1 M | |
| 3 | Claude Opus 4.6 | 1 518 | $5 / $25 | 1 M | |
| 4 | Claude Opus 4.7 | 1 516 | $5 / $25 | 1 M | |
| 5 | Gemini 3.8 Flash | 1 501 | $0.75 / $3.75 | 1,05 M | |
| 6 | Kimi K3 | 1 500 | $1.29 / $14 | 1,05 M | |
| 7 | Claude Opus 4.8 | 1 498 | $5 / $25 | 1 M | |
| 8 | Claude Opus 5.5 | 1 497 | $4 / $20 | 1 M | |
| 9 | Gemini 3.7 Flash | 1 496 | $0.75 / $3.75 | 1,05 M | |
| 10 | Muse Spark 1.1 | 1 496 | $1.25 / $4.25 | 1,05 M | |
| 11 | Gemini 3.1 Pro Preview | 1 496 | $2 / $12 | 1,05 M | |
| 12 | GPT-5.4 | 1 493 | $2.5 / $15 | 1,05 M | |
| 13 | Muse Spark 1.3 | 1 491 | $1.25 / $4.25 | 1,05 M | |
| 14 | GPT-6 Astra | 1 489 | $10 / $50 | 1,05 M | |
| 15 | Gemini 3.6 Flash | 1 488 | $0.75 / $3.75 | 1,05 M | |
| 16 | Claude Fable 5.1 | 1 487 | $10 / $50 | 1 M | |
| 17 | GPT-5.6 Sol | 1 487 | $2 / $10 | 1,05 M | |
| 18 | GPT-5.5 | 1 487 | $5 / $30 | 1,05 M | |
| 19 | Claude Opus 5 | 1 486 | $5 / $25 | 1 M | |
| 20 | Qwen3.7 Max | 1 483 | $1.48 / $4.43 | 1 M | |
| 21 | Claude Sonnet 4.6 | 1 482 | $3 / $15 | 1 M | |
| 22 | GLM 5.3 | 1 481 | $0.06 / $7 | 1,05 M | |
| 23 | Gemini 3.5 Flash | 1 481 | $1.5 / $9 | 1,05 M | |
| 24 | MiMo-V2.5-Pro | 1 481 | $0.44 / $0.87 | 1,05 M | |
| 25 | GLM 5.1 | 1 479 | $1.4 / $4.4 | 205 k | |
| 26 | GLM 5.3 Flash | 1 475 | $0.15 / $0.5 | 1,05 M | |
| 27 | GLM 5.2 | 1 475 | $0.032 / $12 | 1,05 M | |
| 28 | DeepSeek V4 Pro Preview | 1 475 | $0.21 / $0.42 | 1,05 M | |
| 29 | Claude Sonnet 5 | 1 474 | $2 / $10 | 1 M | |
| 30 | Grok 4.5 | 1 472 | $2 / $6 | 500 k | |
| 31 | GLM 5 | 1 471 | $0.6 / $1.92 | 205 k | |
| 32 | GPT-5.6 Terra | 1 470 | $2 / $12 | 1,05 M | |
| 33 | GPT-6 Sol | 1 469 | $2 / $10 | 1,05 M | |
| 34 | Qwen3.6 Max Preview | 1 468 | $1.03 / $6.16 | 262 k | |
| 35 | Gemini 3.5 Flash Lite | 1 465 | $0.3 / $2.5 | 1,05 M | |
| 36 | GPT-5.4 Mini | 1 465 | $0.75 / $4.5 | 400 k | |
| 37 | Qwen3.7 Plus | 1 464 | $0.32 / $1.28 | 1 M | |
| 38 | GPT-5.1 | 1 464 | $1.25 / $10 | 400 k | |
| 39 | DeepSeek V4.1 Flash | 1 462 | $0.3 / $1.2 | 1,05 M | |
| 40 | Kimi K2.6 | 1 461 | $0.95 / $4 | 262 k | |
| 41 | GPT-5.6 Luna | 1 457 | $0.2 / $1.2 | 1,05 M | |
| 42 | GLM 4.7 | 1 457 | $0.6 / $2.2 | 205 k | |
| 43 | MiMo-V2.6-Pro | 1 455 | $0.44 / $0.87 | 1,05 M | |
| 44 | GPT-6 Luna | 1 455 | $0.1 / $0.5 | 1,05 M | |
| 45 | Qwen3.5 397B A17B | 1 454 | $0.55 / $3.5 | 262 k | |
| 46 | MiMo-V2.6-Flash | 1 453 | $0.14 / $0.28 | 1,05 M | |
| 47 | DeepSeek V4 Flash 0423 | 1 453 | $0.03 / $1.28 | 1,05 M | |
| 48 | Kimi K2.5 | 1 452 | $0.45 / $2.25 | 262 k | |
| 49 | Tencent Hy3 | 1 451 | $0.083 / $0.33 | 262 k | |
| 50 | MiMo-V2.5 | 1 451 | $0.14 / $0.28 | 1,05 M | |
| 51 | MiniMax M3 | 1 450 | $0.3 / $1.2 | 1,05 M | |
| 52 | Gemini 2.5 Pro | 1 448 | $1.25 / $10 | 1,05 M | |
| 53 | Grok 4.3 | 1 447 | $1.25 / $2.5 | 1 M | |
| 54 | Qwen3.6 Plus | 1 445 | $0.33 / $1.95 | 1 M | |
| 55 | Grok 4.6 | 1 444 | $2 / $6 | 500 k | |
| 56 | GPT-5.2 | 1 444 | $1.75 / $14 | 400 k | |
| 57 | Qwen3.8 27B | 1 443 | $0.43 / $2.55 | 1 M | |
| 58 | Qwen3 Max | 1 442 | $0.78 / $3.9 | 262 k | |
| 59 | Thinking Machines Inkling | 1 440 | $0.95 / $4.05 | 524 k | |
| 60 | Mistral Medium 3.5 | 1 433 | $1.5 / $7.5 | 262 k | |
| 61 | GLM 5V Turbo | 1 433 | $1.2 / $4 | 203 k | |
| 62 | DeepSeek V3.2 | 1 429 | $0.26 / $0.42 | 164 k | |
| 63 | DeepSeek V3.2 Exp | 1 428 | $0.27 / $0.41 | 164 k | |
| 64 | MiniMax M2.7 | 1 427 | $0.21 / $0.84 | 205 k | |
| 65 | Grok 4.7 | 1 425 | $2 / $6 | 500 k | |
| 66 | Qwen3 VL 235B A22B Instruct | 1 425 | $0.21 / $1.9 | 262 k | |
| 67 | GLM 4.6 | 1 421 | $0.43 / $1.75 | 205 k | |
| 68 | GPT-5 | 1 420 | $1.25 / $10 | 400 k | |
| 69 | Qwen3.5-122B-A10B | 1 419 | $0.26 / $2.08 | 262 k | |
| 70 | Inkling Small | 1 417 | $0.45 / $1.2 | 524 k | |
| 71 | DeepSeek V3.1 Terminus | 1 417 | $0.3 / $1 | 164 k | |
| 72 | Qwen3.5-27B | 1 414 | $0.2 / $1.56 | 262 k | |
| 73 | GPT-5.4 Nano | 1 413 | $0.2 / $1.25 | 400 k | |
| 74 | DeepSeek R1 | 1 410 | $0.7 / $2.5 | 64 k | |
| 75 | Kimi K2 0905 | 1 404 | $0.6 / $2.5 | 262 k | |
| 76 | GLM 4.5 | 1 404 | $0.6 / $2.2 | 131 k | |
| 77 | DeepSeek R1 0528 | 1 404 | $0.5 / $2.15 | 164 k | |
| 78 | Gemini 2.5 Flash | 1 403 | $0.3 / $2.5 | 1,05 M | |
| 79 | Qwen3 Next 80B A3B Instruct | 1 400 | $0.1 / $1.1 | 262 k | |
| 80 | Step 3.5 Flash | 1 397 | $0.1 / $0.3 | 262 k | |
| 81 | MiniMax M2.5 | 1 396 | $0.27 / $1.08 | 205 k | |
| 82 | Qwen3.5-35B-A3B | 1 394 | $0.15 / $1 | 262 k | |
| 83 | MiniMax M2.1 | 1 393 | $0.3 / $1.2 | 205 k | |
| 84 | Qwen3 235B A22B Thinking 2507 | 1 393 | $0.23 / $2.3 | 131 k | |
| 85 | Solar Pro 4 | 1 391 | $0.09 / $0.36 | 524 k | |
| 86 | OpenAI o1 | 1 390 | $15 / $60 | 200 k | |
| 87 | Qwen3 VL 235B A22B Thinking | 1 384 | $0.4 / $4 | 131 k | |
| 88 | Qwen3 30B A3B Instruct 2507 | 1 379 | $0.048 / $0.19 | 262 k | |
| 89 | GPT-5 Mini | 1 372 | $0.25 / $2 | 400 k | |
| 90 | Qwen3 235B A22B | 1 370 | $0.46 / $1.82 | 131 k | |
| 91 | GLM 4.6V | 1 368 | $0.3 / $0.9 | 131 k | |
| 92 | GLM 4.5 Air | 1 368 | $0.13 / $0.85 | 131 k | |
| 93 | GLM 4.7 Flash | 1 360 | $0.061 / $0.4 | 200 k | |
| 94 | MiniMax M2 | 1 359 | $0.3 / $1.2 | 205 k | |
| 95 | Gemma 3 27B | 1 358 | $0.08 / $0.45 | 131 k | |
| 96 | MiniMax M1 | 1 357 | $0.55 / $2.2 | 1 M | |
| 97 | GLM 4.5V | 1 356 | $0.6 / $1.8 | 66 k | |
| 98 | Qwen3 Next 80B A3B Thinking | 1 350 | $0.15 / $1.2 | 262 k | |
| 99 | Trinity Large Thinking | 1 346 | $0.25 / $0.8 | 262 k | |
| 100 | Gemma 3 12B | 1 344 | $0.05 / $0.15 | 131 k |
Aucun modèle ne correspond à votre recherche.
Aucun modèle classé en Chat › Conversation à plusieurs tours pour le moment.
Score Elo calculé par Arena, d'après les préférences des utilisateurs. Le rang suit le score. La colonne de l'éditeur mène à l'outil qui utilise le modèle. Prix en dollars par million de tokens, en entrée puis en sortie. Cliquez sur un en-tête pour trier, sur une pastille pour changer de classement.
Comment le score est-il calculé ?
Le score est un Elo calculé par Arena. Des personnes comparent à l'aveugle les réponses de deux modèles à une même demande et désignent la meilleure. Chaque duel fait monter le gagnant et descendre le perdant, et battre un adversaire fort rapporte davantage.
Le rang suit le score. Chaque classement (général, par modalité, par tâche) a ses propres scores et ses propres rangs, et un modèle qui n'a pas été évalué dans un classement n'y figure pas. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.