Jukebox
Jukebox est un modèle de recherche d'OpenAI, publié le 30 avril 2020, qui génère des chansons en audio brut, chant rudimentaire compris, à partir d'un genre, d'un artiste et de paroles.
OpenAI a rendu publics le code, les poids et un explorateur d'échantillons, mais aucun service de génération : pour créer un morceau, il faut installer le modèle sur sa propre machine équipée d'un GPU. La licence interdit tout usage commercial, et le dépôt est archivé depuis le 8 avril 2026.
Lire plus Lire moins
- Éditeur
- OpenAI
- Création
- 2020
- Offre gratuite
- Oui
Jukebox en bref
C’est quoi ?
Jukebox est un réseau de neurones d’OpenAI qui produit de la musique directement en audio brut, avec un chant rudimentaire, dans une grande variété de genres et de styles d’artistes. Tu lui donnes un genre, un artiste et des paroles, et il compose un morceau inédit, ou prolonge un extrait que tu lui fournis en fichier wav.
Pourquoi ?
Jukebox sert surtout à comprendre ce que la génération musicale en audio brut sait faire, et où elle bute. Les morceaux tiennent la route sur quelques secondes, suivent des accords classiques et offrent parfois des solos. Les 10 musiciens consultés par OpenAI ne l’ont pourtant pas jugé utilisable tel quel pour créer.
Pour qui ?
Jukebox vise d’abord les chercheurs en IA et en génération audio, et les développeurs en apprentissage automatique capables d’installer un modèle avec conda et PyTorch sur un GPU. Un musicien curieux peut écouter les échantillons de l’explorateur sans rien installer, mais il ne générera pas ses propres morceaux depuis le navigateur.
Avantages et inconvénients
Les plus
- Génération en audio brut avec chant Jukebox produit directement un signal audio, voix comprise, et non une partition ou un fichier MIDI. Le chant reste rudimentaire, mais il suit les paroles fournies.
- Pilotage par genre, artiste et paroles Le modèle suit le genre, l’artiste et les paroles demandés, y compris des paroles jamais vues à l’entraînement. L’explorateur montre aussi des mélanges de deux styles.
- Prolongement de ta propre musique Le README décrit un mode d’amorçage : tu fournis des fichiers wav, et Jukebox continue la musique à partir de leurs premières secondes.
- Code, poids et explorateur publiés OpenAI a mis en ligne le code, les poids des modèles et un explorateur d’échantillons. Tu peux étudier le système, le réentraîner sur tes données ou écouter les résultats.
- Des milliers d’échantillons à écouter L’explorateur en ligne liste 7 116 morceaux générés, filtrables par modèle, collection, genre, artiste et température, sans compte ni installation.
Les moins
- Usage non commercial La licence du dépôt interdit d’utiliser le logiciel, ou tout contenu créé avec lui, à des fins commerciales. Un morceau généré ne peut donc ni se vendre ni servir un produit monétisé.
- Aucune génération en ligne Le site ne fait qu’écouter des échantillons déjà produits. Pour générer, il faut installer Jukebox avec conda et PyTorch sur une carte graphique puissante, en ligne de commande.
- Génération très lente L’échantillonnage autorégressif réclame des heures de calcul pour une seule minute de musique. Impossible, dans ces conditions, d’itérer vite ou d’en faire un usage interactif.
- Projet archivé Le dépôt GitHub d’OpenAI est archivé : plus aucun correctif ni nouvelle version, et des dépendances Python et PyTorch d’époque, délicates à réinstaller aujourd’hui.
- Chant encore rudimentaire Le chant reste sommaire et les morceaux manquent de grande structure : pas de refrain qui revient. Le passage par des codes compressés ajoute aussi un bruit audible.
Un outil entièrement gratuit
Aucun palier payant chez Jukebox (vérifié le 24 septembre 2026) : l’outil est entièrement gratuit, sans grille tarifaire. Projet de recherche d’OpenAI, il publie son code et ses poids sans contrepartie sous licence d’usage non commercial, et ni l’article de l’éditeur, ni l’explorateur d’échantillons, ni le dépôt GitHub n’affichent de formule, de montant ou de devise. La seule dépense tient au matériel : la génération tourne sur ta propre carte graphique.
Tarifs officiels de Jukebox, relevés le 24/09/2026
Ce que permet la formule gratuite
Jukebox donne tout sans contrepartie : son code, ses poids et l’accès à l’explorateur d’échantillons. Aucun compte OpenAI n’est demandé. Aucune formule payante ne vient non plus ajouter de fonctions ou de capacité de calcul, ni sur le site, ni sur le dépôt GitHub.
Jukebox pose en revanche deux limites fortes. Sa licence réserve le logiciel et ses créations à un usage non commercial, et le code archivé est livré en l’état, sans correctifs. Pour générer, il faut ta propre machine. Rien ne tourne chez OpenAI.
Ce que fait Jukebox
Par où passe la création
Jukebox compresse d’abord l’audio brut avec un VQ-VAE à trois niveaux (compression par 8, 32 et 128), puis des Sparse Transformers autorégressifs génèrent de nouveaux codes, que deux suréchantillonneurs affinent avant que le décodeur les reconvertisse en son. Le modèle écrit donc du son, jamais une partition.
Ce que changent les conditions
Le prior de haut niveau se règle sur l’artiste et le genre, ce qui oriente le style, et un encodeur de paroles, relié par des couches d’attention, cale le chant sur le texte. Pour aligner les paroles à l’entraînement, OpenAI a utilisé Spleeter et NUS AutoLyricsAlign.
Modèles publiés
Le dépôt chiffre la mémoire GPU des priors de haut niveau : 3,8 Go pour 1b_lyrics, 10,3 Go pour 5b et 11,5 Go pour 5b_lyrics, plus un cache par échantillon. Chaque prior empile 72 couches d’attention, et les réglages fournis visent une carte V100 de 16 Go.
Durée de calcul
Jukebox échantillonne de façon autorégressive, donc lentement : il faut environ 9 heures pour rendre entièrement une minute d’audio, selon OpenAI, et le README compte 3 heures sur une V100 pour 20 secondes de musique. Aucun usage interactif n’est possible.
Comment utiliser Jukebox
Prise en main initiale
Jukebox se découvre sans rien installer : ouvre l’explorateur d’échantillons en ligne et filtre les morceaux par modèle, collection, genre, artiste ou température. Pour générer toi-même, clone le dépôt GitHub et installe l’environnement conda, PyTorch et CUDA décrit dans le README.
Navigation dans l’interface
Jukebox n’a pas d’interface de création : l’explorateur est un simple tableau d’écoute, et la génération se lance en ligne de commande avec le script de génération du dépôt, en choisissant le modèle, la durée du morceau et le nombre d’échantillons produits en parallèle.
Utilisation et gestion de projets
Jukebox range chaque génération dans un dossier par niveau, avec les codes, l’audio et une page HTML qui anime les paroles pendant l’écoute. Tu peux ensuite prolonger un morceau déjà généré, suréchantillonner des codes sauvegardés ou amorcer le modèle avec tes propres fichiers wav.
Fonctionnalités principales
Jukebox réunit quelques fonctions de recherche, toutes accessibles depuis le code publié : génération, conditionnement, prolongement et réentraînement. Seule l’écoute des échantillons se fait en ligne, sans compte ni installation.
Génération de morceaux en audio brut
Produit un morceau inédit directement sous forme de son, voix chantée comprise, à partir d’un genre, d’un artiste et de paroles. Le chant reste rudimentaire, mais la sortie s’écoute telle quelle.
Conditionnement par genre, artiste et paroles
Oriente le style musical et vocal selon l’artiste et le genre choisis, et cale le chant sur les paroles fournies, y compris des paroles que le modèle n’a jamais vues pendant son entraînement.
Prolongement de morceaux générés
Reprend des codes déjà produits pour allonger un morceau de quelques dizaines de secondes, ou pour suréchantillonner plus tard un premier jet gardé au niveau le plus compressé.
Amorçage sur ta propre musique
Accepte tes propres enregistrements en fichiers wav : le modèle écoute leurs premières secondes, puis poursuit la musique dans la continuité, avec le style et les paroles demandés.
Réentraînement sur tes données
Permet d’entraîner un nouveau prior de haut niveau sur ton propre jeu de fichiers audio, en réutilisant le VQ-VAE et les suréchantillonneurs déjà entraînés par OpenAI, avec ou sans étiquettes.
Explorateur d’échantillons générés
Donne à écouter en ligne les morceaux produits par les modèles publiés, classés par collection : paroles inédites, reprises, continuations, nouveaux styles ou génération sans paroles.
Usages et métiers
Jukebox parle d’abord aux chercheurs et aux développeurs en apprentissage automatique, capables de faire tourner un modèle lourd sur leur propre GPU. Les musiciens y trouvent surtout matière à écouter ce que savait faire la génération audio à sa sortie.
Chercheurs en IA et en apprentissage automatique
Ils s’en servent pour analyser la génération de musique en audio brut, tester le pilotage par l’artiste, le genre et les paroles, et comparer les sorties avec leurs propres travaux. Cela remplace des essais sur des modèles dont le fonctionnement n’est pas accessible.
Chercheurs en génération de musique et d’audio
Ils explorent les échantillons produits, complètent des morceaux existants et observent comment le modèle gère les styles vocaux et instrumentaux. Cela remplace une recherche manuelle de pistes de référence et des tests dispersés sur plusieurs outils spécialisés.
Développeurs et ingénieurs en apprentissage automatique
Ils récupèrent le code et les poids publiés pour étudier l’architecture, rejouer les résultats et adapter le modèle à leurs propres expériences. Cela remplace un point de départ propriétaire où l’on ne peut ni inspecter ni modifier le système.
Musiciens et artistes qui expérimentent la musique générée par IA
Ils écoutent l’explorateur pour juger du rendu par genre et par artiste, ou testent l’amorçage sur leurs propres maquettes s’ils disposent d’une machine adaptée. La licence exclut toute sortie commerciale des morceaux obtenus.
Conseils d’utilisation
Conseils pour une utilisation efficace
Jukebox se teste d’abord à l’oreille : écoute les collections de l’explorateur pour le genre et l’artiste visés avant d’installer quoi que ce soit. Pour une première génération, commence par 1b_lyrics, le modèle le plus léger, et demande plusieurs échantillons en parallèle, puisque le suréchantillonnage prend l’essentiel du temps.
Erreurs communes à éviter
Jukebox n’offre aucun bouton de génération en ligne : n’y cherche pas un service prêt à l’emploi. Évite aussi de viser un morceau complet d’un coup ; produis de courts extraits, puis prolonge-les. Enfin, ne publie rien de commercial avec ses sorties, puisque la licence l’interdit.
Modèles et droits sur les créations
Jukebox repose sur un autoencodeur VQ-VAE et sur des Sparse Transformers entraînés par OpenAI, publiés en trois variantes : 5b et 5b_lyrics, à cinq milliards de paramètres, et 1b_lyrics, à un milliard. Seules les variantes lyrics se règlent sur des paroles ; 5b ne suit que l’artiste et le genre.
Côté droits, la licence du dépôt est claire : OpenAI ne revendique pas la propriété des contenus créés avec Jukebox, mais demande de les utiliser de façon responsable et d’indiquer clairement qu’ils viennent de Jukebox. Aucune partie du logiciel, ni aucun contenu créé avec lui, ne peut servir à des fins commerciales.
Jukebox a été entraîné sur des chansons collectées sur le web, avec leurs paroles et leurs métadonnées. L’article d’OpenAI mentionne d’ailleurs des recherches en cours sur la propriété intellectuelle : prudence avant de diffuser un morceau qui imite un artiste réel.
Accès
Jukebox s’écoute dans le navigateur, sur ordinateur comme sur mobile, via l’explorateur d’échantillons : rien ne s’y installe et aucun compte n’est demandé. Pour générer, l’accès passe par le dépôt GitHub, en open source, à installer sur ta propre machine équipée d’un GPU compatible CUDA.
Appareils, applications et systèmes compatibles
Jukebox existe sous deux formes : un explorateur d’échantillons sur le web et un code open source à héberger soi-même. Aucune application mobile, de bureau ou extension n’est publiée, et aucune API ne génère de musique à distance.
Disponible sur
Accès & intégrations
Langues disponibles
Jukebox ne propose que l’anglais : l’explorateur, l’article et le README sont rédigés dans cette langue. Le modèle a surtout appris sur des paroles anglaises ; pour un autre vocabulaire, le README demande de réentraîner le prior avec un nouveau jeu de caractères.
Avis et notes par Aikiwi
Note Globale de Jukebox 3,2
Jukebox a marqué la génération musicale en produisant directement de l’audio brut chanté, piloté par le style d’un artiste et par des paroles. Le code, les poids et l’explorateur d’échantillons restent en ligne et gratuits, ce qui en fait une référence à étudier plutôt qu’un outil de création.
Jukebox s’adresse aux chercheurs et aux développeurs prêts à installer un modèle ancien sur un GPU puissant et à patienter des heures pour quelques secondes de musique. Le dépôt archivé ne reçoit plus de correctifs, et l’aide se limite au README et à une adresse de contact.
Jukebox reste gratuit, mais sa licence interdit tout usage commercial des morceaux produits. Pour écouter ce que savait faire l’IA musicale à ses débuts, l’explorateur suffit ; pour créer des chansons à publier, il ne convient pas.
Avis détaillé sur Jukebox
Design et Ergonomie 3,0
Jukebox ne propose qu’un écran public, l’explorateur d’échantillons : un tableau dense de morceaux, cinq menus de filtre et un lecteur, sans outil pour composer. L’écoute est directe et sans compte, mais rien n’y guide un débutant ni n’explique les collections.
Facilité d’Utilisation 2,5
Jukebox demande d’installer conda, une version ancienne de PyTorch et CUDA, puis de lancer la génération en ligne de commande avec des paramètres techniques (niveaux, durée, taille des lots). Ce parcours suppose une solide pratique de l’apprentissage automatique et un GPU dédié : un non-spécialiste n’ira pas plus loin que l’explorateur.
Fonctionnalités et Outils 3,8
Jukebox couvre la génération de chansons en audio brut, le réglage du style et du chant, le prolongement de morceaux, l’amorçage sur tes propres fichiers wav et le réentraînement sur tes données. Le conditionnement par MIDI, lui, reste une piste de recherche évoquée par l’article : les modèles publiés ne le proposent pas.
Performance et Fiabilité 2,5
Jukebox est lent par construction : l’échantillonnage autorégressif impose des heures de calcul pour une minute de musique, et l’éditeur lui-même le juge inutilisable en usage interactif. Les morceaux gardent un bruit audible et ne construisent pas de refrain, ce qui borne aussi la fiabilité du résultat.
Innovation et Singularité 4,3
Jukebox a été l’un des premiers modèles à générer des chansons chantées directement en audio brut, avec une architecture VQ-VAE à trois niveaux et des Sparse Transformers conditionnés par les paroles. L’approche a ouvert une voie largement suivie depuis ; le projet, archivé, n’a en revanche plus évolué après sa publication.
Support et Ressources Disponibles 2,5
Jukebox n’a ni centre d’aide ni documentation au-delà du README et de l’article d’OpenAI. Le dépôt GitHub étant archivé en lecture seule, on ne peut plus y ouvrir de ticket : il reste les échanges déjà publiés et l’adresse jukebox@openai.com donnée par l’article.
Rapport Qualité-Prix 3,8
Jukebox ne demande aucun paiement : code, poids et explorateur sont gratuits, sans compte. La dépense réelle se déplace vers le matériel, puisqu’il faut un GPU puissant et beaucoup de temps de calcul, et la licence non commerciale ferme toute exploitation des morceaux. Pour la recherche, le rapport reste bon ; pour un usage professionnel, il n’a pas d’intérêt.
Questions fréquentes
Est-ce que Jukebox est bien ?
Jukebox est un modèle de recherche marquant, qui génère des chansons chantées en audio brut, mais ce n’est pas un outil de création prêt à l’emploi : aucune génération en ligne, un calcul très lent sur ton propre GPU et une licence non commerciale. Pour écouter et étudier, oui ; pour produire, non.
Quel est le prix de Jukebox ?
Jukebox est gratuit : OpenAI publie le code, les poids des modèles et l’explorateur d’échantillons sans formule payante ni compte. La seule dépense est le matériel pour générer, une machine équipée d’un GPU, et la licence interdit de tirer un revenu des morceaux créés.
Peut-on utiliser Jukebox en ligne ?
Pas pour générer : le site jukebox.openai.com n’est qu’un explorateur d’échantillons déjà produits, sans bouton de création. Pour obtenir un morceau, il faut installer le code du dépôt GitHub et lancer la génération sur une machine équipée d’un GPU compatible CUDA.
Qu’est-ce que Jukebox AI ?
Jukebox est un réseau de neurones d’OpenAI qui génère de la musique, chant rudimentaire compris, directement en audio brut. Il se règle sur un genre, un artiste et des paroles, peut prolonger un morceau existant, et son code comme ses poids sont publiés sous licence d’usage non commercial.
Les morceaux créés avec Jukebox sont-ils libres de droits ?
Pas pour un usage commercial. La licence du dépôt précise qu’OpenAI ne revendique pas la propriété des contenus créés, mais qu’aucun d’eux ne peut servir à des fins commerciales, et elle demande d’indiquer clairement qu’un morceau a été produit avec Jukebox.
Jukebox est-il toujours maintenu ?
Non. Le dépôt GitHub d’OpenAI est archivé et passé en lecture seule : le code est fourni en l’état, sans mises à jour prévues. L’explorateur d’échantillons reste en ligne, mais le projet n’a plus évolué depuis sa publication par l’équipe audio d’OpenAI.