Revue publiée le Scores mis à jour le
Comparer

Meta : Llama 4 Maverick

Llama 4 Maverick, publié par Meta le 5 avril 2025, lit du texte multilingue et des images, et produit du texte multilingue et du code selon Meta. À sa sortie, Meta le destine aux usages d’assistant généraliste et de conversation et, selon Meta, il convient très bien à la compréhension précise des images et à l’écriture créative.

Llama 4 Maverick ou Llama 4 Scout : lequel choisir ?

Llama 4 Maverick était, à sa sortie, facturé au-dessus de Llama 4 Scout sur OpenRouter. Selon Meta, Scout était à sa sortie le modèle plus petit, avec 17 milliards de paramètres actifs, 16 experts et 109 milliards de paramètres au total. Côté déploiement, selon Meta, Scout tenait à sa sortie sur un seul GPU H100 avec une quantification Int4, qui réduit la précision des paramètres, tandis que Maverick tenait sur un seul hôte H100.

Selon Meta, Llama 4 Scout dispose d’une fenêtre de contexte de 10 millions de tokens, contre 1 million pour Llama 4 Maverick : cette fenêtre correspond au volume de texte que le modèle peut prendre en compte. À sa sortie, Meta associait celle de Scout au résumé de plusieurs documents, à l’analyse d’une activité d’utilisateur étendue pour des tâches personnalisées et au raisonnement sur de vastes bases de code.

À quoi sert Llama 4 Maverick

Conversation

Llama 4 Maverick est présenté par Meta, à sa sortie, comme le modèle généraliste de ses produits pour les usages d’assistant et de conversation. Selon la carte du modèle publiée par Meta, les versions ajustées aux instructions sont destinées à un usage d’assistant conversationnel. Selon Meta, Llama 4 prend en charge le français, l’anglais, l’arabe, l’allemand, l’hindi, l’indonésien, l’italien, le portugais, l’espagnol, le tagalog, le thaï et le vietnamien.

Compréhension d’images

Llama 4 Maverick lit du texte multilingue et des images, selon la carte du modèle publiée par Meta. À sa sortie, Meta le présente comme particulièrement adapté à la compréhension précise des images. Selon la carte du modèle publiée par Meta, les modèles Llama 4 sont optimisés pour la reconnaissance visuelle, le raisonnement sur image, la rédaction de légendes et les réponses aux questions générales sur une image.

Écriture créative

Llama 4 Maverick convient très bien à l’écriture créative, selon l’annonce de Meta à sa sortie.

Code

Llama 4 Maverick produit du texte multilingue et du code, selon la carte du modèle publiée par Meta. Sur OpenRouter, il prend aussi en charge l’appel d’outils et la production de sorties structurées.

  • Chat
  • Vision et compréhension
  • Rédaction créative
  • Code

Les performances de Llama 4 Maverick

Llama 4 Maverick figure, selon Meta, dans le tableau de scores des modèles ajustés aux instructions, aux côtés de Llama 3.3 70B, Llama 3.1 405B et Llama 4 Scout. Sur MMLU Pro, qui évalue le raisonnement et les connaissances, il obtient 80,5 contre 68,9 pour Llama 3.3 70B, selon Meta. Pour le test de raisonnement GPQA Diamond, son score atteint 69,8 contre 50,5 pour le même modèle de comparaison, selon Meta.

Sur LiveCodeBench, consacré au code, il obtient un score de 43,4 contre 33,3 pour Llama 3.3 70B dans le tableau publié par Meta, selon Meta. Pour MGSM, le test multilingue, son résultat est de 92,3 contre 91,1 pour ce même modèle dans la comparaison des modèles ajustés aux instructions, selon Meta.

Sur MMMU, consacré au raisonnement sur image, il obtient 73,4, selon Meta. Pour Llama 3.3 70B, Meta ne donne pas de score sur ce test, faute de prise en charge multimodale. Concernant les autres évaluations de compréhension d’images, ses résultats atteignent 90,0 sur ChartQA et 94,4 sur DocVQA dans le tableau des modèles ajustés aux instructions, selon Meta.

Caractéristiques techniques de Llama 4 Maverick

Llama 4 Maverick est sorti le 5 avril 2025. Le tableau des caractéristiques présente la date de sortie, le contexte, la réponse maximale, la réflexion, les entrées, la licence, les paramètres et les hébergeurs.

Selon Meta, à sa sortie, le modèle compte 17 milliards de paramètres actifs pour 400 milliards de paramètres au total. Avec Llama 4 Scout, il constitue, selon Meta, à sa sortie, la première génération de modèles de l’entreprise à mélange d’experts, ou MoE. Selon Meta, à sa sortie, ses couches MoE utilisent 128 experts routés et un expert partagé. Pour chaque token, selon Meta, à sa sortie, le calcul passe par l’expert partagé et par un seul des experts routés.

Selon la carte du modèle publiée par Meta, la fenêtre de contexte atteint 1M de tokens, les unités de texte traitées par le modèle. Sur OpenRouter, cette fenêtre est donnée pour 1 048 576 tokens. Une réponse peut atteindre au plus 16 384 tokens sur OpenRouter, une limite distincte de la capacité du contexte.

Selon la carte du modèle publiée par Meta, le pré-entraînement a porté sur environ vingt-deux mille milliards de tokens de données multimodales. Ces données s’arrêtent en août 2024, selon Meta. Selon sa carte du modèle, Meta a publié le modèle en accès ouvert sous la Llama 4 Community License, une licence commerciale propre à l’entreprise.

Éditeur
Meta
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Non prise en charge
Connaissances jusqu'à (selon OpenRouter)
août 2024
Entrées (selon OpenRouter)
Texte, Image
Licence
Llama 4 Community License
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_pseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
DigitalOcean, Google, Novita, Parasail

Où utiliser Llama 4 Maverick, et comment il se facture

Llama 4 Maverick pouvait être téléchargé à sa sortie sur le site de Meta et sur Hugging Face, selon Meta. D’après la carte du modèle publiée par Meta, les poids, c’est-à-dire ses paramètres, ont été publiés en BF16 et en version quantifiée FP8.

Selon la carte du modèle publiée par Meta, les poids FP8 tiennent sur un seul hôte H100 DGX tout en conservant la qualité. Sur OpenRouter, l’identifiant meta-llama/llama-4-maverick désigne le modèle pour les appels à l’API, l’interface de programmation. La carte d’accès donne les derniers prix relevés pour cet accès.

L'API chez des hébergeurs

Servi par d'autres hébergeurs que Meta, selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,19 $ / M tokens en entrée, 0,65 $ / M tokens en sortie.

Tarification0,19 $ en entrée, 0,65 $ en sortie, par million de tokens
Hébergé via OpenRouter chezDigitalOcean, Google, Novita, Parasail

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

FAQ

Quand Llama 4 Maverick est-il sorti ?

Llama 4 Maverick est sorti le 5 avril 2025.

Combien de paramètres compte Llama 4 Maverick ?

Llama 4 Maverick compte, à sa sortie, 17 milliards de paramètres actifs selon Meta. Selon Meta, le modèle compte au total 400 milliards de paramètres.

Llama 4 Maverick lit-il les images ?

Llama 4 Maverick lit des images et du texte multilingue, selon Meta. Selon Meta, il produit du texte multilingue et du code.

Quelle est la fenêtre de contexte de Llama 4 Maverick ?

Llama 4 Maverick a une fenêtre de contexte de 1 048 576 tokens sur OpenRouter.

Llama 4 Maverick prend-il en charge le français ?

Llama 4 Maverick prend en charge le français, selon Meta. Selon Meta, Llama 4 prend également en charge l’arabe, l’anglais, l’allemand, le hindi, l’indonésien, l’italien, le portugais, l’espagnol, le tagalog, le thaï et le vietnamien.

Sous quelle licence Llama 4 Maverick est-il distribué ?

Llama 4 Maverick est distribué sous la Llama 4 Community License. Il s’agit d’une licence commerciale propre à Meta.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.