Inception Mercury 2, publié par Inception le 24 février 2026, lit du texte et produit des réponses par affinage parallèle, selon l’éditeur. Celui-ci le destine aux applications sensibles à la latence, notamment aux agents de code interactifs, aux interfaces vocales et aux chaînes de recherche.
Inception Mercury 2 vise, à sa sortie selon Inception, les applications où le délai de réponse compte, notamment les interfaces vocales. L’éditeur annonce un raisonnement compatible avec le rythme naturel de la parole. Il cite aussi les chaînes de recherche et de RAG, la génération augmentée par récupération de documents, auxquelles le modèle peut ajouter du raisonnement sans dépasser leur budget de latence. Parmi les autres usages annoncés figurent les boucles d’agents, où un programme enchaîne des actions pour accomplir une tâche.
Code
Inception Mercury 2 vise, selon Inception à sa sortie, l’autocomplétion de code et les suggestions de prochaine modification. Pour retravailler du code existant, l’éditeur cite les refactorisations, qui réorganisent le code sans en changer le comportement attendu. Il mentionne également les agents de code interactifs, parmi les applications de programmation pour lesquelles le délai de réponse compte.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances d’Inception Mercury 2
Inception Mercury 2 atteint une vitesse de 1 009 tokens par seconde sur les GPU NVIDIA Blackwell, selon l’annonce d’Inception à sa sortie. L’entreprise présente aussi sa qualité de raisonnement comme compétitive face aux principaux modèles optimisés pour la vitesse.
Bien utiliser Inception Mercury 2 : réflexion et effort
Inception Mercury 2 utilise une réflexion activée par défaut, selon les paramètres renseignés sur OpenRouter. Tu peux désactiver cette réflexion : elle reste facultative. Pour régler l’effort de réflexion, la plateforme propose les valeurs high, medium, low et none, avec medium comme valeur par défaut.
Caractéristiques techniques d’Inception Mercury 2
Inception Mercury 2 accepte du texte en entrée sur OpenRouter et repose, selon Inception, sur une architecture de raisonnement fondée sur la diffusion. Le tableau des caractéristiques reprend les données d’OpenRouter sur la fenêtre de contexte et la sortie maximale, ainsi que la date de sortie du modèle. Selon Inception, la génération procède par affinage parallèle de plusieurs tokens, les unités de texte traitées par le modèle, plutôt que par décodage séquentiel.
Éditeur
Inception
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
128 k tokens
Réponse maximale (selon OpenRouter)
50 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endHTMLJeuxConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Inception Mercury 2 était accessible à sa sortie dans le chat d’Inception et par l’API de l’entreprise, selon son annonce de lancement. Pour l’accès par programmation, l’entreprise annonçait une compatibilité avec l’API d’OpenAI. La carte d’accès présente les derniers prix relevés.
L'API Inception
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,25 $ / M tokens en entrée, 0,75 $ / M tokens en sortie.
Tarification0,25 $ en entrée, 0,75 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Inception Mercury 2 parmi les versions de Mercury
Inception Mercury 2 figure dans la frise des versions, qui situe les modèles de la famille Mercury avec leurs dates de sortie. Le 8 septembre 2026, Inception a annoncé Inception Mercury 2.5, présenté par l’entreprise comme une évolution apportant un net progrès de qualité. Selon l’entreprise, cette évolution conserve le même profil de service à faible latence et à faible coût.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Inception Mercury 2Vous êtes ici
Inception Mercury 2.5
Score
1257
Sortie
Contexte
128 k tokens
260 k tokens
Prix d'entrée
0,25 $ / M tokens
0,040 $ / M tokens
Prix de sortie
0,75 $ / M tokens
0,15 $ / M tokens
Entrées
Texte
Texte
Réflexion
Activée par défaut
Activée par défaut
Tâches
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, HTML, Jeux, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes
Ce qui le distingue
Inception Mercury 2, publié par Inception le 24 février 2026, lit du texte et produit des réponses par affinage parallèle, selon l’éditeur. Celui-ci le destine aux applications sensibles à la latence, notamment aux agents de code interactifs, aux interfaces vocales et aux chaînes de recherche.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Inception Mercury 2 est-il sorti ?
Inception Mercury 2 est sorti le 24 février 2026. Inception l’a annoncé à cette date.
Que peut lire Inception Mercury 2 ?
Inception Mercury 2 lit du texte en entrée sur OpenRouter. Pour la sortie, Inception annonce à son lancement la production de JSON aligné sur un schéma.
Quelle est la fenêtre de contexte d’Inception Mercury 2 ?
Inception Mercury 2 dispose d’une fenêtre de contexte de 128 000 tokens sur OpenRouter, correspondant au contexte de 128K annoncé par Inception à sa sortie. Lors de cette annonce, Inception présente également un raisonnement réglable et l’usage natif d’outils.
Quelle version succède à Inception Mercury 2 ?
Inception Mercury 2 est suivi par Inception Mercury 2.5, annoncé le 8 septembre 2026. Selon Inception, cette version apporte un net progrès de qualité tout en conservant le même profil de service à faible latence et à faible coût.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.