Revue publiée le Scores mis à jour le
Comparer

Moonshot AI : Kimi K2.5

Nouvelle version : Kimi K2.6

Kimi K2.5 est le modèle multimodal de Moonshot AI sorti le 27 janvier 2026, après Kimi K2 Thinking : il lit le texte et l’image, appelle des outils, et ses poids sont publiés sous licence MIT modifiée. Selon Moonshot AI, il génère du code à partir de maquettes et dirige jusqu’à 100 sous-agents en parallèle avec Agent Swarm.

Ce que Kimi K2.5 change par rapport à Kimi K2 Thinking

Sur OpenRouter, Kimi K2.5 reprend la fenêtre de contexte de Kimi K2 Thinking, 262 144 tokens, et s’en écarte sur deux points. En entrée, Kimi K2 Thinking ne lisait que le texte ; Kimi K2.5 lit le texte et l’image. Et la réflexion, obligatoire chez Kimi K2 Thinking, devient facultative chez Kimi K2.5. Selon Moonshot AI, Kimi K2.5 prolonge le pré-entraînement de Kimi K2 sur environ 15T tokens mêlant images et texte, et devient un modèle multimodal natif. L’éditeur y ajoute Agent Swarm, publié en préversion de recherche : Kimi K2.5 dirige lui-même jusqu’à 100 sous-agents qui travaillent en parallèle. Sur ses deux évaluations internes, Moonshot AI mesure un progrès de 59,3 % (AI Office Benchmark, la qualité des documents de bureautique) et de 24,3 % (General Agent Benchmark, les tâches d’agent en plusieurs étapes) face à Kimi K2 Thinking.

Le tableau d’écart résume ce qui se conserve et ce qui évolue entre les deux versions.

Par rapport à la version précédente

Kimi K2 ThinkingKimi K2.5
Contexte maximal (selon OpenRouter)262 k262 k
Formats compris (selon OpenRouter)textetexte, image
Réflexion (selon OpenRouter)Toujours activeActivée par défautModifié
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,60 $ / M tokens0,45 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)2,50 $ / M tokens2,25 $ / M tokens

À quoi sert Kimi K2.5

Chat

Selon Moonshot AI, l’agent de Kimi K2.5 mène de bout en bout un travail de bureau dense et livre directement dans la conversation des documents, des feuilles de calcul, des PDF et des présentations. Kimi K2.5 sait aussi appeler des outils et produire des sorties structurées.

Vision et compréhension

Kimi K2.5 lit le texte et l’image. Selon Moonshot AI, il est pré-entraîné sur des tokens de vision et de langage, et fort en connaissances visuelles, en raisonnement entre modalités et en usage d’outils à partir d’entrées visuelles. La fiche Hugging Face de Moonshot AI annonce aussi la vidéo en entrée, mais comme une fonction expérimentale, réservée à l’API officielle de l’éditeur.

Code

Selon Moonshot AI, Kimi K2.5 génère du code à partir de spécifications visuelles, comme des maquettes d’interface ou des enchaînements filmés en vidéo.

Front-end

Moonshot AI le dit particulièrement fort en développement front-end : selon l’éditeur, une simple conversation suffit à Kimi K2.5 pour produire une interface complète, avec mises en page interactives et animations, comme des effets déclenchés au défilement.

Les performances de Kimi K2.5

Moonshot AI présente Kimi K2.5 avec des scores publiés à sa sortie sur plusieurs domaines. Le tableau des scores rassemble ces annonces d’éditeur.

ÉvaluationDomaineScore annoncé
GPQA-DiamondRaisonnement et connaissances87,6
HLE-Full avec outilsRaisonnement et connaissances50,2
MMMU-ProImage et vidéo78,5
BrowseCompRecherche web en agent60,6
BrowseComp, mode Agent SwarmRecherche web en agent78,4
SWE-Bench VerifiedCode76,8

Sur SWE-Bench Verified, le même tableau de Moonshot AI place Kimi K2.5 (76,8) derrière GPT-5.2 (80,0) et Claude 4.5 Opus (80,9). Ce sont des annonces de l’éditeur à la sortie, pas un classement indépendant.

Bien utiliser Kimi K2.5 : modes Thinking et Instant

Sur OpenRouter, la réflexion de Kimi K2.5 est activée par défaut, et elle n’y est pas obligatoire : elle se désactive. Selon Moonshot AI, le modèle se prête à deux modes d’usage : Thinking pour garder la réflexion, et Instant pour la couper sur l’API officielle avec le paramètre thinking réglé sur disabled.

Moonshot AI recommande une température de 1,0 en mode Thinking et de 0,6 en mode Instant, avec un top_p de 0,95.

Caractéristiques techniques de Kimi K2.5

Kimi K2.5 est sorti le 27 janvier 2026. Il lit en entrée le texte et l’image.

Sur OpenRouter, sa fenêtre de contexte est de 262 144 tokens et une réponse plafonne à 235 929 tokens. Selon Moonshot AI, Kimi K2.5 repose aussi sur une architecture à mélange d’experts, avec 1 billion de paramètres dont 32 milliards activés.

Éditeur
Moonshot AI
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image
Licence
MIT modifiée
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Amazon Bedrock, AtlasCloud, Novita, SiliconFlow, Venice

Où utiliser Kimi K2.5, et comment il se facture

  • Kimi.ai et l’application Kimi : À sa sortie, Kimi K2.5 est disponible sur Kimi.ai et dans l’application Kimi.
  • API : Selon Moonshot AI, l’API de Kimi K2.5 est accessible sur platform.moonshot.ai, et compatible avec les formats d’API d’OpenAI et d’Anthropic.
  • Kimi Code : À sa sortie, Kimi K2.5 est aussi disponible dans Kimi Code, le nouveau produit de code de Moonshot AI, qui fonctionne dans le terminal et s’intègre à des IDE comme VSCode, Cursor ou Zed. Pour l’ingénierie logicielle, l’éditeur recommande d’associer Kimi K2.5 à Kimi Code.
  • Auto-hébergement : Moonshot AI publie le code et les poids de Kimi K2.5 sous une licence MIT modifiée. Selon sa fiche Hugging Face, il se déploie de préférence sur les moteurs d’inférence vLLM, SGLang ou KTransformers.

L'API chez des hébergeurs

Servi par d'autres hébergeurs que Moonshot AI, selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,45 $ / M tokens en entrée, 2,25 $ / M tokens en sortie.

Tarification0,45 $ en entrée, 2,25 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAmazon Bedrock, AtlasCloud, Novita, SiliconFlow, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Kimi K2.5 parmi les versions de Kimi

Kimi K2.5 s’inscrit après Kimi K2 Thinking dans la gamme Kimi, puis laisse place à Kimi K2.6. La frise des versions porte toutes les dates de sortie et permet de lire cette continuité d’un coup d’œil.

Kimi K2 0711 ouvre la séquence le 11 juillet 2025, puis Kimi K2 Thinking sort le 6 novembre 2025. Kimi K2.6 paraît le 20 avril 2026 et succède à Kimi K2.5 dans la gamme.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quel est le logiciel Kimi ?

Kimi est l’assistant de Moonshot AI. À sa sortie, Kimi K2.5 s’utilise sur Kimi.ai, dans l’application Kimi, par l’API et dans Kimi Code.

Kimi K2.5 est-il open source ?

Oui, le code et les poids de Kimi K2.5 sont publiés sous licence MIT modifiée. La licence autorise gratuitement l’usage, la modification et la redistribution, avec une seule modification : un produit commercial de plus de 100 millions d’utilisateurs actifs par mois, ou de plus de 20 millions de dollars de revenus mensuels, doit afficher « Kimi K2.5 » dans son interface.

En quoi le Mode Réflexion diffère-t-il du Mode Instantané ?

Selon Moonshot AI, Kimi K2.5 fonctionne en mode Thinking ou en mode Instant. Sur l’API officielle, le mode Instant s’obtient en désactivant la réflexion avec le paramètre thinking réglé sur disabled.

Quand Kimi K2.5 est-il sorti ?

Kimi K2.5 est sorti le 27 janvier 2026. Kimi K2 Thinking est la version qui le précède dans la gamme.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.