Les meilleurs modèles d'IA pour les mathématiques

Mathématiques : la capacité du modèle à résoudre des problèmes (calcul, raisonnement, démonstration) et à expliquer le chemin. Réussir, c'est arriver au bon résultat par des étapes que l'on peut suivre. Score Elo calculé par Arena. Comment ça marche ?

Mis à jour chaque jour ·100 premiers modèles sur 118 classés ·Octobre 2026
Éditeur
26 Tencent Hy3 Sa place en Mathématiques Tencent 1 480 $0.083 / $0.33 262 k
1 Claude Opus 5 Anthropic 1 522 $5 / $25 1 M
2 Claude Fable 5 Anthropic 1 522 $10 / $50 1 M
3 Claude Fable 5.1 Anthropic 1 517 $10 / $50 1 M
4 Claude Opus 4.6 Anthropic 1 517 $5 / $25 1 M
5 Gemini 3.8 Flash Google 1 516 $0.75 / $3.75 1,05 M
6 Muse Spark 1.3 Meta 1 512 $1.25 / $4.25 1,05 M
7 Claude Opus 5.5 Anthropic 1 510 $4 / $20 1 M
8 Gemini 3.7 Flash Google 1 507 $0.75 / $3.75 1,05 M
9 Claude Opus 4.7 Anthropic 1 504 $5 / $25 1 M
10 DeepSeek V4.1 Flash DeepSeek 1 502 $0.3 / $1.2 1,05 M
11 Gemini 3.6 Flash Google 1 502 $0.75 / $3.75 1,05 M
12 GLM 5.3 Flash Z.ai 1 500 $0.15 / $0.5 1,05 M
13 Kimi K3 Moonshot AI 1 500 $1.29 / $14 1,05 M
14 GPT-5.5 OpenAI 1 499 $5 / $30 1,05 M
15 Gemini 3.5 Flash Google 1 496 $1.5 / $9 1,05 M
16 Claude Opus 4.8 Anthropic 1 494 $5 / $25 1 M
17 GPT-5.6 Sol OpenAI 1 493 $2 / $10 1,05 M
18 GLM 5.3 Z.ai 1 491 $0.06 / $7 1,05 M
19 Muse Spark 1.1 Meta 1 491 $1.25 / $4.25 1,05 M
20 GPT-5.4 OpenAI 1 491 $2.5 / $15 1,05 M
21 GPT-6 Astra OpenAI 1 490 $10 / $50 1,05 M
22 Gemini 3.1 Pro Preview Google 1 488 $2 / $12 1,05 M
23 GLM 5.2 Z.ai 1 487 $0.032 / $12 1,05 M
24 MiMo-V2.6-Pro Xiaomi 1 486 $0.44 / $0.87 1,05 M
25 Qwen3.7 Max Qwen 1 484 $1.48 / $4.43 1 M
26 Tencent Hy3 Tencent 1 480 $0.083 / $0.33 262 k
27 MiMo-V2.5-Pro Xiaomi 1 480 $0.44 / $0.87 1,05 M
28 Thinking Machines Inkling Thinking Machines 1 479 $0.95 / $4.05 524 k
29 GPT-5.6 Terra OpenAI 1 479 $2 / $12 1,05 M
30 Kimi K2.6 Moonshot AI 1 479 $0.95 / $4 262 k
31 Qwen3.6 Max Preview Qwen 1 476 $1.03 / $6.16 262 k
32 GPT-5.6 Luna OpenAI 1 475 $0.2 / $1.2 1,05 M
33 GLM 5.1 Z.ai 1 475 $1.4 / $4.4 205 k
34 Claude Sonnet 5 Anthropic 1 474 $2 / $10 1 M
35 Grok 4.5 SpaceXAI 1 473 $2 / $6 500 k
36 Kimi K2.5 Moonshot AI 1 471 $0.45 / $2.25 262 k
37 MiMo-V2.6-Flash Xiaomi 1 469 $0.14 / $0.28 1,05 M
38 Qwen3.7 Plus Qwen 1 466 $0.32 / $1.28 1 M
39 DeepSeek V4 Pro Preview DeepSeek 1 466 $0.21 / $0.42 1,05 M
40 Claude Sonnet 4.6 Anthropic 1 463 $3 / $15 1 M
41 Qwen3.8 27B Qwen 1 458 $0.43 / $2.55 1 M
42 GPT-5.1 OpenAI 1 458 $1.25 / $10 400 k
43 GPT-5.2 OpenAI 1 456 $1.75 / $14 400 k
44 GPT-6 Sol OpenAI 1 454 $2 / $10 1,05 M
45 Qwen3.6 Plus Qwen 1 454 $0.33 / $1.95 1 M
46 Qwen3.5 397B A17B Qwen 1 452 $0.55 / $3.5 262 k
47 GPT-6 Luna OpenAI 1 448 $0.1 / $0.5 1,05 M
48 Inkling Small Thinking Machines 1 447 $0.45 / $1.2 524 k
49 Grok 4.6 SpaceXAI 1 446 $2 / $6 500 k
50 Grok 4.7 SpaceXAI 1 445 $2 / $6 500 k
51 GLM 5 Z.ai 1 443 $0.6 / $1.92 205 k
52 Gemini 3.5 Flash Lite Google 1 442 $0.3 / $2.5 1,05 M
53 DeepSeek V4 Flash 0423 DeepSeek 1 441 $0.03 / $1.28 1,05 M
54 GPT-5.4 Mini OpenAI 1 439 $0.75 / $4.5 400 k
55 Gemini 2.5 Pro Google 1 439 $1.25 / $10 1,05 M
56 MiMo-V2.5 Xiaomi 1 438 $0.14 / $0.28 1,05 M
57 GLM 5V Turbo Z.ai 1 436 $1.2 / $4 203 k
58 Qwen3 Max Qwen 1 434 $0.78 / $3.9 262 k
59 GPT-5 OpenAI 1 434 $1.25 / $10 400 k
60 MiniMax M3 MiniMax 1 433 $0.3 / $1.2 1,05 M
61 Mistral Medium 3.5 Mistral AI 1 428 $1.5 / $7.5 262 k
62 GLM 4.7 Z.ai 1 428 $0.6 / $2.2 205 k
63 DeepSeek V3.2 DeepSeek 1 428 $0.26 / $0.42 164 k
64 Qwen3.5-122B-A10B Qwen 1 426 $0.26 / $2.08 262 k
65 GPT-5.4 Nano OpenAI 1 425 $0.2 / $1.25 400 k
66 Qwen3.5-27B Qwen 1 423 $0.2 / $1.56 262 k
67 MiniMax M2.7 MiniMax 1 422 $0.21 / $0.84 205 k
68 DeepSeek V3.2 Exp DeepSeek 1 421 $0.27 / $0.41 164 k
69 Grok 4.3 SpaceXAI 1 419 $1.25 / $2.5 1 M
70 GLM 4.6 Z.ai 1 418 $0.43 / $1.75 205 k
71 Solar Pro 4 Upstage 1 416 $0.09 / $0.36 524 k
72 Kimi K2 0905 Moonshot AI 1 416 $0.6 / $2.5 262 k
73 Qwen3 Next 80B A3B Instruct Qwen 1 414 $0.1 / $1.1 262 k
74 DeepSeek R1 DeepSeek 1 412 $0.7 / $2.5 64 k
75 GLM 4.5 Z.ai 1 411 $0.6 / $2.2 131 k
76 Qwen3 VL 235B A22B Instruct Qwen 1 409 $0.21 / $1.9 262 k
77 Step 3.5 Flash StepFun 1 407 $0.1 / $0.3 262 k
78 GPT-5 Mini OpenAI 1 405 $0.25 / $2 400 k
79 Gemini 2.5 Flash Google 1 405 $0.3 / $2.5 1,05 M
80 Qwen3 VL 235B A22B Thinking Qwen 1 400 $0.4 / $4 131 k
81 Qwen3 32B Qwen 1 399 $0.08 / $0.28 131 k
82 Qwen3.5-35B-A3B Qwen 1 398 $0.15 / $1 262 k
83 DeepSeek V3.1 Terminus DeepSeek 1 397 $0.3 / $1 164 k
84 Qwen3 235B A22B Thinking 2507 Qwen 1 397 $0.23 / $2.3 131 k
85 MiniMax M2.5 MiniMax 1 393 $0.27 / $1.08 205 k
86 DeepSeek R1 0528 DeepSeek 1 393 $0.5 / $2.15 164 k
87 MiniMax M2.1 MiniMax 1 392 $0.3 / $1.2 205 k
88 Qwen3 Next 80B A3B Thinking Qwen 1 392 $0.15 / $1.2 262 k
89 Qwen3 235B A22B Qwen 1 392 $0.46 / $1.82 131 k
90 GLM 4.5 Air Z.ai 1 387 $0.13 / $0.85 131 k
91 OpenAI o1 OpenAI 1 386 $15 / $60 200 k
92 Trinity Large Thinking Arcee AI 1 383 $0.25 / $0.8 262 k
93 gpt-oss-120b OpenAI 1 381 $0.037 / $0.17 131 k
94 o3 Mini OpenAI 1 381 $1.1 / $4.4 200 k
95 Qwen3 30B A3B Instruct 2507 Qwen 1 378 $0.048 / $0.19 262 k
96 MiniMax M1 MiniMax 1 370 $0.55 / $2.2 1 M
97 GLM 4.7 Flash Z.ai 1 362 $0.061 / $0.4 200 k
98 GLM 4.5V Z.ai 1 361 $0.6 / $1.8 66 k
99 Qwen3 30B A3B Qwen 1 351 $0.12 / $0.5 131 k
100 MiniMax M2 MiniMax 1 350 $0.3 / $1.2 205 k

Score Elo calculé par Arena, d'après les préférences des utilisateurs. Le rang suit le score. La colonne de l'éditeur mène à l'outil qui utilise le modèle. Prix en dollars par million de tokens, en entrée puis en sortie. Cliquez sur un en-tête pour trier, sur une pastille pour changer de classement.

Comment le score est-il calculé ?

Le score est un Elo calculé par Arena. Des personnes comparent à l'aveugle les réponses de deux modèles à une même demande et désignent la meilleure. Chaque duel fait monter le gagnant et descendre le perdant, et battre un adversaire fort rapporte davantage.

Le rang suit le score. Chaque classement (général, par modalité, par tâche) a ses propres scores et ses propres rangs, et un modèle qui n'a pas été évalué dans un classement n'y figure pas. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.