Les meilleurs modèles d'IA pour le design d'après référence
Design d'après référence : la capacité du modèle à reproduire une maquette ou une capture fournie (proportions, couleurs, typographie, détails). Réussir, c'est être fidèle à la référence, pas approximatif. Score Elo calculé par Arena. Comment ça marche ?
| Éditeur | |||||
|---|---|---|---|---|---|
| 62 | MiniMax M2.7 Sa place en Design d'après référence | 1 391 | $0.21 / $0.84 | 205 k | |
| 1 | Claude Opus 5.5 | 1 846 | $4 / $20 | 1 M | |
| 2 | GPT-6 Astra | 1 825 | $10 / $50 | 1,05 M | |
| 3 | Claude Fable 5.1 | 1 806 | $10 / $50 | 1 M | |
| 4 | GPT-6.1 Sol | 1 793 | $2 / $10 | 1,05 M | |
| 5 | Claude Sonnet 5.5 | 1 779 | $2 / $10 | 1 M | |
| 6 | GPT-6 Sol | 1 728 | $2 / $10 | 1,05 M | |
| 7 | Claude Opus 5 | 1 713 | $5 / $25 | 1 M | |
| 8 | Kimi K3 | 1 679 | $1.29 / $14 | 1,05 M | |
| 9 | Qwen3.8 Max (0902) | 1 671 | $2 / $6 | 1 M | |
| 10 | Muse Spark 1.3 | 1 667 | $1.25 / $4.25 | 1,05 M | |
| 11 | GPT-5.6 Sol | 1 655 | $2 / $10 | 1,05 M | |
| 12 | Claude Fable 5 | 1 655 | $10 / $50 | 1 M | |
| 13 | Grok 4.7 | 1 654 | $2 / $6 | 500 k | |
| 14 | Hy4 preview | 1 653 | $0.75 / $2.25 | 1,05 M | |
| 15 | MiMo-V2.6-Pro | 1 643 | $0.44 / $0.87 | 1,05 M | |
| 16 | GLM 5.3 | 1 641 | $0.06 / $7 | 1,05 M | |
| 17 | Grok 4.6 | 1 637 | $2 / $6 | 500 k | |
| 18 | GLM 5.3 Flash | 1 626 | $0.15 / $0.5 | 1,05 M | |
| 19 | DeepSeek V4.1 Flash | 1 618 | $0.3 / $1.2 | 1,05 M | |
| 20 | GLM 5.2 | 1 604 | $0.032 / $12 | 1,05 M | |
| 21 | Qwen3.8 27B | 1 597 | $0.43 / $2.55 | 1 M | |
| 22 | Gemini 3.7 Flash | 1 596 | $0.75 / $3.75 | 1,05 M | |
| 23 | Gemini 3.8 Flash | 1 589 | $0.75 / $3.75 | 1,05 M | |
| 24 | GPT-6 Luna | 1 585 | $0.1 / $0.5 | 1,05 M | |
| 25 | Claude Opus 4.7 | 1 582 | $5 / $25 | 1 M | |
| 26 | Claude Opus 4.8 | 1 577 | $5 / $25 | 1 M | |
| 27 | DeepSeek V4 Flash 0423 | 1 576 | $0.03 / $1.28 | 1,05 M | |
| 28 | Grok 4.5 | 1 575 | $2 / $6 | 500 k | |
| 29 | Claude Opus 4.6 | 1 561 | $5 / $25 | 1 M | |
| 30 | Muse Spark 1.1 | 1 557 | $1.25 / $4.25 | 1,05 M | |
| 31 | Claude Sonnet 5 | 1 552 | $2 / $10 | 1 M | |
| 32 | Muse Spark 1.2 | 1 548 | $1.25 / $4.25 | 1,05 M | |
| 33 | Gemini 3.6 Flash | 1 539 | $0.75 / $3.75 | 1,05 M | |
| 34 | GLM 5.1 | 1 535 | $1.4 / $4.4 | 205 k | |
| 35 | GPT-5.5 | 1 534 | $5 / $30 | 1,05 M | |
| 36 | Claude Sonnet 4.6 | 1 530 | $3 / $15 | 1 M | |
| 37 | GPT-5.6 Luna | 1 525 | $0.2 / $1.2 | 1,05 M | |
| 38 | GPT-5.6 Terra | 1 519 | $2 / $12 | 1,05 M | |
| 39 | Tencent Hy3 | 1 510 | $0.083 / $0.33 | 262 k | |
| 40 | Kimi K2.6 | 1 509 | $0.95 / $4 | 262 k | |
| 41 | Gemini 3.5 Flash | 1 504 | $1.5 / $9 | 1,05 M | |
| 42 | Kimi K2.7 Code | 1 482 | $0.67 / $3.35 | 262 k | |
| 43 | GPT-5.4 | 1 479 | $2.5 / $15 | 1,05 M | |
| 44 | MiniMax M3 | 1 476 | $0.3 / $1.2 | 1,05 M | |
| 45 | DeepSeek V4 Pro Preview | 1 475 | $0.21 / $0.42 | 1,05 M | |
| 46 | MiMo-V2.5-Pro | 1 475 | $0.44 / $0.87 | 1,05 M | |
| 47 | Qwen3.6 Max Preview | 1 472 | $1.03 / $6.16 | 262 k | |
| 48 | Qwen3.6 Plus | 1 465 | $0.33 / $1.95 | 1 M | |
| 49 | Gemini 3.1 Pro Preview | 1 455 | $2 / $12 | 1,05 M | |
| 50 | MiMo-V2.5 | 1 447 | $0.14 / $0.28 | 1,05 M | |
| 51 | GLM 5 | 1 443 | $0.6 / $1.92 | 205 k | |
| 52 | Kimi K2.5 | 1 440 | $0.45 / $2.25 | 262 k | |
| 53 | GLM 4.7 | 1 436 | $0.6 / $2.2 | 205 k | |
| 54 | GPT-5 | 1 419 | $1.25 / $10 | 400 k | |
| 55 | GPT-5.3-Codex | 1 418 | $1.75 / $14 | 400 k | |
| 56 | GPT-5.4 Mini | 1 410 | $0.75 / $4.5 | 400 k | |
| 57 | Thinking Machines Inkling | 1 402 | $0.95 / $4.05 | 524 k | |
| 58 | Inkling Small | 1 398 | $0.45 / $1.2 | 524 k | |
| 59 | Qwen3.5 397B A17B | 1 398 | $0.55 / $3.5 | 262 k | |
| 60 | GPT-5.2 | 1 394 | $1.75 / $14 | 400 k | |
| 61 | GPT-5.1 | 1 393 | $1.25 / $10 | 400 k | |
| 62 | MiniMax M2.7 | 1 391 | $0.21 / $0.84 | 205 k | |
| 63 | GLM 5V Turbo | 1 388 | $1.2 / $4 | 203 k | |
| 64 | MiniMax M2.1 | 1 372 | $0.3 / $1.2 | 205 k | |
| 65 | Solar Pro 4 | 1 367 | $0.09 / $0.36 | 524 k | |
| 66 | MiniMax M2.5 | 1 367 | $0.27 / $1.08 | 205 k | |
| 67 | Qwen3.5-122B-A10B | 1 363 | $0.26 / $2.08 | 262 k | |
| 68 | Qwen3.5-27B | 1 361 | $0.2 / $1.56 | 262 k | |
| 69 | Grok 4.3 | 1 360 | $1.25 / $2.5 | 1 M | |
| 70 | DeepSeek V3.2 | 1 354 | $0.26 / $0.42 | 164 k | |
| 71 | GPT-5.2-Codex | 1 350 | $1.75 / $14 | 400 k | |
| 72 | GLM 4.6 | 1 337 | $0.43 / $1.75 | 205 k | |
| 73 | GPT-5.1-Codex | 1 333 | $1.25 / $10 | 400 k | |
| 74 | MiniMax M2 | 1 290 | $0.3 / $1.2 | 205 k | |
| 75 | Mistral Medium 3.5 | 1 277 | $1.5 / $7.5 | 262 k | |
| 76 | DeepSeek V3.2 Exp | 1 273 | $0.27 / $0.41 | 164 k | |
| 77 | Qwen3.5-35B-A3B | 1 251 | $0.15 / $1 | 262 k | |
| 78 | GPT-5.1-Codex-Mini | 1 234 | $0.25 / $2 | 400 k | |
| 79 | Trinity Large Thinking | 1 230 | $0.25 / $0.8 | 262 k | |
| 80 | Gemini 2.5 Pro | 1 226 | $1.25 / $10 | 1,05 M | |
| 81 | Inception Mercury 2 | 1 184 | $0.25 / $0.75 | 128 k | |
| Gemini 3.5 Flash Lite | $0.3 / $2.5 | 1,05 M |
Aucun modèle ne correspond à votre recherche.
Aucun modèle classé en Code › Design d'après référence pour le moment.
Score Elo calculé par Arena, d'après les préférences des utilisateurs. Le rang suit le score. La colonne de l'éditeur mène à l'outil qui utilise le modèle. Prix en dollars par million de tokens, en entrée puis en sortie. Cliquez sur un en-tête pour trier, sur une pastille pour changer de classement.
Comment le score est-il calculé ?
Le score est un Elo calculé par Arena. Des personnes comparent à l'aveugle les réponses de deux modèles à une même demande et désignent la meilleure. Chaque duel fait monter le gagnant et descendre le perdant, et battre un adversaire fort rapporte davantage.
Le rang suit le score. Chaque classement (général, par modalité, par tâche) a ses propres scores et ses propres rangs, et un modèle qui n'a pas été évalué dans un classement n'y figure pas. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.