Whisper Web
Whisper Web est un service web de transcription audio qui fait tourner le modèle OpenAI Whisper directement dans le navigateur. L'audio devient du texte, puis des sous-titres sont générés avant export en TXT, SRT, VTT ou JSON. En mode local sans compte, la formule gratuite accepte des fichiers jusqu'à 200 Mo ou 20 minutes par fichier.
Le nombre de transcriptions reste illimité. Plus de 19 langues sont prises en charge, avec détection automatique. Une version payante ajoute un palier sans ces limites, mais l'outil reste centré sur la transcription locale, hors API et hors installation lourde.
Lire plus Lire moins
- Offre gratuite
- Oui
- Essai gratuit
- Non
- Sans carte bancaire
- Oui
Whisper Web en bref
C’est quoi ?
Whisper Web transforme un fichier audio, un enregistrement au micro ou une URL audio en texte horodaté dans le navigateur. Il charge le modèle Whisper choisi dans le cache du navigateur, puis traite l’audio sur l’appareil. Tu obtiens une transcription lisible, exportable en TXT, SRT, VTT ou JSON, sans installation Python ni ligne de commande. Le mode local fonctionne sans compte et sans que l’audio quitte le navigateur.
Pourquoi ?
Cette approche règle la transcription quand il faut garder les fichiers sur l’appareil et éviter une chaîne technique lourde. Elle convient aussi quand tu dois sortir des sous-titres exploitables pour une vidéo, puis récupérer le texte pour un compte rendu, un rapport ou un flux de travail. Le traitement hors ligne après cache du modèle enlève la dépendance continue au réseau. Aucun compte n’est requis pour l’usage local.
Pour qui ?
Les créateurs de contenu et les monteurs vidéo qui ont besoin de sous-titres trouvent ici un outil adapté, surtout quand ils veulent exporter vers YouTube ou Premiere Pro. Les journalistes, chercheurs et étudiants l’emploient pour des entretiens et des cours. Les utilisateurs non techniques qui veulent Whisper sans Python, sans CLI et sans GPU y trouvent aussi un accès direct. Les profils sensibles à la vie privée bénéficient du traitement entièrement local.
Avantages et inconvénients
Les plus
- Traitement local dans le navigateur Whisper Web lance Whisper dans le navigateur, avec un traitement sur l’appareil et une transcription hors ligne après le cache du modèle. Tu gardes l’audio sur la machine, ce qui convient aux usages sensibles.
- Aucun compte requis en usage local Sur le mode local, l’outil fonctionne sans compte. Le premier essai est donc rapide quand tu veux tester une transcription sans créer d’espace utilisateur.
- Export des transcriptions dans plusieurs formats Les sorties s’exportent en TXT, SRT, VTT et JSON. Cette sortie facilite le passage vers un document, un sous-titrage ou un flux de travail qui attend du texte structuré.
- Entrée audio polyvalente Tu peux envoyer un fichier, parler au micro ou fournir une URL audio. Cette diversité d’entrée couvre autant l’interview que la dictée ou la transcription d’une source en ligne.
- Détection automatique de la langue L’outil transcrit en plus de cent langues avec détection automatique. Le repérage de la langue réduit la préparation quand la piste audio change d’un fichier à l’autre.
Les moins
- Le mode local reste borné par la taille des fichiers Sur l’offre gratuite, les fichiers sont limités à 200 Mo ou 20 minutes par fichier. Dès qu’un enregistrement dépasse ce cadre, le travail bascule vers un usage plus contraint.
- Le premier chargement demande de patienter Le modèle est téléchargé dans le cache du navigateur avant de servir hors ligne. L’attente initiale pèse surtout au premier usage, puis disparaît quand le modèle est déjà présent.
- Le résultat dépend des performances du navigateur L’accélération WebGPU améliore le traitement, mais l’outil garde un repli WebAssembly. Sur une machine moins à l’aise avec ces technologies, la transcription avance moins vite.
- Aucun accès par API L’usage reste centré sur l’interface web. Pour un intégrateur qui veut automatiser des transcriptions, l’absence d’API ferme une voie d’intégration directe.
- Pas d’application native dédiée Le service est disponible sur le web, sans version Windows, macOS, Linux, iOS ou Android. Pour un usage mobile ou de bureau installé, il faut donc passer par le navigateur.
Tableau des prix
Whisper Web suit un modèle freemium. En local, Whisper Web Free permet un usage gratuit. Whisper Web Unlimited supprime la limite d’accès au service payant. Tarif sur la page de tarification de l’éditeur, via le lien « Tarifs officiels » sous le tableau.
| Palier | Prix au 29 septembre 2026 | Inclus | Non inclus | Pour qui |
|---|---|---|---|---|
| Whisper Web Free | Gratuit | Usage local dans le navigateur ; détection automatique de la langue ; export TXT, SRT, VTT, JSON ; aucun compte | Accès payant ; exécution hors navigateur | Pour transcrire un fichier sans ouvrir de compte |
| Whisper Web Unlimited | $20 par mois — ou $10 par mois, facturé à l’année (120 $) | Traitement local dans le navigateur ; WebGPU ; export TXT, SRT, VTT, JSON ; prise en charge de 19 langues · Même accès que le palier mensuel | Limite de taille et de durée du palier gratuit | Pour un usage régulier avec abonnement · Pour payer à l’année |
Tarifs officiels de Whisper Web, relevés le 29/09/2026
Ce que permet la formule gratuite
Whisper Web gratuit ouvre l’usage local sans compte. Sur le palier gratuit, tu traites des fichiers jusqu’à 200 Mo par fichier ou 20 minutes par fichier. La limite arrive vite sur les fichiers volumineux. Les transcriptions restent sans plafond. Tu exportes en TXT, SRT, VTT et JSON.
Sans carte bancaire, l’accès local suffit pour tester le flux complet dans le navigateur. La détection automatique de langue fonctionne. Ce mode fonctionne avec le modèle chargé dans le cache, donc le service ne demande pas de paiement pour l’usage de base.
Dès l’import, la contrainte réelle se lit dans la taille du fichier et sa durée. Au-delà de ce cadre, il faut passer au palier payant, qui enlève la barrière d’accès du gratuit.
Aucun compte n’est requis pour l’usage local. La formule gratuite s’arrête là, avec des fichiers limités et un cadre pensé pour l’essai concret, pas pour des volumes lourds. Whisper Web reste donc sur un périmètre restreint.
Ce que fait Whisper Web
Whisper Web prend un fichier, une capture au micro ou une adresse audio. Il fait tourner Whisper dans le navigateur. Texte horodaté à la clé.
Sur le navigateur, le moteur charge le modèle dans le cache puis peut continuer hors ligne une fois la mémoire remplie. WebGPU accélère le calcul quand le support est présent, avec un repli WebAssembly si besoin ; l’entrée accepte aussi le micro, l’envoi de fichier et l’audio ouvert depuis une URL ou le navigateur. Le modèle pèse environ 75 Mo.
Chaque version privilégie la vitesse et le confort d’usage. Le palier gratuit garde le traitement local et les exportations. Côté payant, la contrainte qui borne l’accès au service disparaît.
Aucun canal mobile ou bureau n’ajoute de mode caché. Le choix se fait donc entre des modèles Whisper plus ou moins lourds, pas entre des produits différents.
Comment utiliser Whisper Web
Prise en main initiale
Whisper Web s’ouvre dans le navigateur. Le premier geste consiste à choisir un modèle, puis à charger un audio par glisser-déposer, micro ou URL. Le traitement démarre sur l’appareil, sans clé API ni installation Python.
Navigation dans l’interface
Tu retrouves d’abord le sélecteur de modèle, puis les entrées audio : glisser-déposer, micro ou URL. Le guide d’aide montre ensuite que la transcription apparaît segment par segment, avec des horodatages, et qu’elle peut être copiée ou exportée. Sur Chrome 113+ ou Edge, WebGPU accélère le traitement ; sinon, WebAssembly prend le relais.
Utilisation et gestion de projets
Une fois l’audio lancé, le texte reste consultable dans le navigateur, puis s’exporte en TXT, SRT, VTT ou JSON selon l’usage visé. Aucun compte n’est requis en usage local.
Fonctionnalités principales
Whisper Web repose sur une transcription locale dans le navigateur, sans compte requis pour l’usage local. Le modèle OpenAI Whisper est exécuté sur l’appareil, avec accélération WebGPU quand elle est disponible, puis repli WebAssembly.
Transcription locale dans le navigateur
L’outil exécute OpenAI Whisper localement, sans que l’audio quitte le navigateur. Tu obtiens un texte horodaté à partir d’un fichier audio, d’un enregistrement micro ou d’une URL.
Accessible sans compte pour l’usage local.
Détection automatique de la langue
La reconnaissance couvre plus de 19 langues et identifie la langue d’entrée automatiquement avant de transcrire. Le traitement reste sur l’appareil, avec sortie texte segmentée.
Accélération WebGPU avec repli WebAssembly
Le traitement passe par WebGPU quand le navigateur le prend en charge, avec un repli WebAssembly sinon. Le site annonce un traitement 3 à 5 fois plus rapide dans le cas accéléré.
WebGPU sur les navigateurs compatibles ; WebAssembly sinon.
Trois modes d’entrée audio
Tu peux lancer une transcription depuis le microphone, un envoi de fichier ou une URL de média dans le navigateur. Le même moteur produit ensuite le texte segmenté.
Transcription en continu
Le flux vocal s’écrit au fur et à mesure, segment par segment. Cette fonction sert surtout pour des prises de parole en direct ou des dictées longues.
Export en TXT, SRT, VTT et JSON
Le résultat s’exporte en texte brut, sous-titres ou structure JSON. Les formats SRT et VTT ciblent surtout les vidéos et les lecteurs compatibles.
Mode local hors ligne après cache du modèle
Une fois le modèle en mémoire locale, l’outil fonctionne hors ligne. Le texte reste traité sur l’appareil.
Limite gratuite de taille et de durée
Le palier gratuit prend en charge des fichiers de 200 Mo ou 20 min chacun. Toutes les autres fonctions de transcription locale restent accessibles.
Sur Whisper Web Free.
Aucun compte, aucune clé API, aucun quota minute
Le site annonce un usage local sans inscription, sans clé API et sans facturation à la minute. Le palier gratuit n’impose pas de limite sur le nombre de transcriptions.
Sur l’usage local gratuit.
Choix entre quatre modèles Whisper
L’interface propose tiny, base, small et medium pour adapter le compromis entre vitesse et rendu. Le modèle choisi est téléchargé dans le navigateur avant l’exécution.
Usages et métiers
Whisper Web sert d’abord aux créateurs de contenu et aux monteurs vidéo qui ont besoin de sous-titres exportables pour YouTube, Premiere Pro ou un lecteur vidéo. Il convient aussi aux journalistes, aux chercheurs et aux étudiants qui transcrivent des entretiens ou des cours. Les utilisateurs non techniques y trouvent l’accès à OpenAI Whisper sans installation locale. Les personnes attentives à la confidentialité s’en servent pour une transcription entièrement locale.
Créateurs de contenu et monteurs vidéo
Ils transcrivent une piste audio ou vidéo en texte horodaté, puis exportent un fichier SRT ou VTT pour le sous-titrage. L’outil remplace ici la transcription manuelle et le passage par une chaîne de sous-titrage séparée.
Quand la sortie doit rester compatible avec YouTube, Premiere Pro ou un lecteur vidéo.
Journalistes, chercheurs et étudiants
Ils convertissent des entretiens, des cours ou des prises de parole en transcription lisible, avec horodatage segment par segment. Whisper Web remplace la retranscription manuelle et la prise de notes au fil de l’écoute.
Utilisateurs non techniques
Ils lancent la transcription depuis le navigateur, avec import de fichier, enregistrement au micro ou chargement d’une URL audio. La plateforme remplace une installation locale de Whisper, avec Python, CLI ou configuration GPU.
Quand le besoin est d’utiliser OpenAI Whisper sans préparation technique.
Utilisateurs attentifs à la confidentialité
Ils font tourner la transcription localement, dans le navigateur, et gardent l’audio sur l’appareil. Whisper Web remplace un service qui envoie les fichiers vers un serveur distant.
Conseils d’utilisation
Conseils pour une utilisation efficace
Whisper Web garde de meilleurs résultats quand tu choisis un modèle adapté au volume et au temps de traitement. Avec un fichier long, le mode local fonctionne, mais la première ouverture prend plus de temps parce que le modèle doit d’abord être chargé dans le navigateur. Sur les enregistrements nets, l’entrée micro donne une transcription plus propre que des fichiers très compressés. Chaque export peut ensuite partir en TXT, SRT, VTT ou JSON.
Erreurs communes à éviter
Texte haché ou segments manquants : la cause vient souvent d’un audio trop bruité, d’une source trop compressée ou d’un modèle trop léger pour la qualité attendue. Transcription qui se lance lentement ou navigateur qui rame : la cause tient plutôt au chargement initial du modèle, surtout quand le navigateur n’exploite pas WebGPU et bascule sur WebAssembly.
Modèles et droits sur les créations
Whisper Web garde OpenAI Whisper en local, dans le navigateur, pour les paliers gratuits et payants. Au palier libre, la limite porte sur le volume de fichier et la durée par fichier ; le palier payant lève cette borne.
Chaque sortie reste réutilisable comme une transcription ou un sous-titre, mais le droit d’usage ne change pas le moteur. Tu gardes les exports TXT, SRT, VTT et JSON dans les deux cas ; le gratuit borne l’accès, pas le format de sortie.
Côté modèle, la sélection va de tiny à medium. Plus le modèle est lourd, plus le traitement local demande de ressources, et l’accélération WebGPU sert surtout à réduire l’attente quand elle est disponible.
Libre, l’outil limite donc la génération, pas le nombre de transcriptions. Payant, il enlève la contrainte de taille et de durée ; les sorties restent celles d’une transcription utilisable dans tes documents, tes sous-titres ou tes workflows.
Accès
Whisper Web s’atteint depuis le navigateur, avec un accès web sur ordinateur, tablette ou téléphone, et répond dans dix-neuf langues. Sur mobile comme sur desktop, l’outil garde le même principe : tu ouvres la page, puis tu passes au choix du modèle et à l’import. Le détail des appareils compatibles et la liste des langues vivent dans les sous-sections suivantes.
Appareils, applications et systèmes compatibles
Disponible sur
Accès & intégrations
Langues disponibles
Whisper Web prend en charge la transcription dans 19 langues.
Avis et notes par Aikiwi
Note Globale de Whisper Web 4,3
Whisper Web exécute le modèle OpenAI Whisper dans le navigateur, en traitement local, avec bascule WebGPU ou WebAssembly. L’outil accepte le microphone, un fichier ou une URL, puis produit une transcription horodatée qui peut être exportée en TXT, SRT, VTT ou JSON.
Il intéresse aussi les utilisateurs qui veulent des sous-titres exploitables dans YouTube, Premiere Pro ou d’autres lecteurs vidéo, sans passer par Python, la ligne de commande ou une configuration GPU. Le mode local répond aussi à un besoin de transcription sur appareil.
La formule inclut la détection automatique de la langue, l’export des transcriptions et la prise en charge de plus de cent langues. Le tableau des prix précise ensuite le passage au palier payant pour des besoins plus larges.
Avis détaillé sur Whisper Web
Design et Ergonomie 4,0
Whisper Web n’expose pas d’élément publié sur la hiérarchie de son interface, sur la clarté des écrans ou sur les choix d’accessibilité. Le lecteur obtient donc un outil centré sur la fonction, pas une promesse d’interface travaillée. Pour un usage ponctuel, cela suffit si le besoin principal est d’envoyer un fichier et d’obtenir un texte exploitable ; pour un usage intensif, l’ergonomie réelle reste un sujet à tester directement.
Facilité d’Utilisation 4,4
L’outil supprime aussi l’installation de Python, de ffmpeg et de CUDA, ce qui abaisse nettement la barrière d’entrée. Cette approche convient bien à un utilisateur qui veut transformer rapidement un fichier audio ou vidéo en texte lisible. La présence d’un mode local et d’exports prêts pour des sous-titres réduit les frictions au quotidien, surtout quand le besoin porte sur une transcription simple plutôt que sur un flux de production complexe.
Fonctionnalités et Outils 4,6
Whisper Web couvre un périmètre concret et cohérent : transcription locale, détection automatique de la langue, transcription en direct, export en TXT, SRT, VTT et JSON, plus plusieurs modes d’entrée. L’outil ajoute aussi des modèles Whisper de tailles différentes, avec accélération WebGPU et repli WebAssembly. Le lecteur y trouve donc davantage qu’un simple convertisseur audio-texte. Le format de sortie convient à la fois aux sous-titres, à la prise de notes et aux usages documentaires, tandis que le traitement sur appareil renforce l’intérêt pour les contenus sensibles ou les contextes sans connexion stable.
Performance et Fiabilité 4,0
Whisper Web ne publie ni page de statut, ni historique d’incidents, ni engagement de disponibilité. La régularité du service ne peut donc pas être constatée sur des données publiées. La fiche indique seulement un fonctionnement local dans le navigateur, avec cache du modèle après le premier chargement. Pour l’utilisateur, cela signifie que la logique technique réduit une partie des dépendances réseau, mais ne donne pas de garantie publique sur la stabilité du service lui-même. Le choix reste pertinent pour une transcription autonome, à condition d’accepter qu’aucune promesse de continuité n’est documentée par l’éditeur.
Innovation et Singularité 4,7
L’outil ajoute aussi une accélération WebGPU et conserve un mode de repli WebAssembly, ce qui rend l’approche plus singulière qu’un simple service en ligne. Cette architecture intéresse surtout les utilisateurs qui veulent une transcription sans envoi d’audio vers un serveur. Elle parle aussi aux profils techniques qui apprécient de contourner l’installation d’une pile locale, tout en gardant un contrôle fort sur les données et sur l’environnement d’exécution.
Support et Ressources Disponibles 4,1
Whisper Web publie un guide, une page de contact et un support par email. La documentation couvre le fonctionnement, le choix du modèle, les modes d’entrée et l’export, ce qui donne un socle utile pour démarrer sans assistance humaine immédiate. Le lecteur dispose donc d’un support léger mais réel, suffisant pour un produit simple à comprendre. En revanche, l’éditeur ne montre ni centre d’aide riche, ni communauté, ni canaux de support multiples ; l’accompagnement semble pensé pour l’autonomie plutôt que pour une prise en charge étendue.
Rapport Qualité-Prix 4,5
Whisper Web propose un palier gratuit sans compte requis, avec transcription locale et export des fichiers. Le palier payant ajoute un usage illimité ; les montants des formules payantes sont dans le tableau des prix. Pour une transcription locale sans configuration technique, le rapport valeur-prix reste solide. Le gratuit couvre déjà un besoin utile. Quand l’usage devient régulier, le palier payant prend surtout sens.
Questions fréquentes
Whisper Web est-il gratuit ?
Oui, Whisper Web propose une formule gratuite. Elle fonctionne dans le navigateur, sans compte requis pour l’usage local, et permet des fichiers jusqu’à 200 Mo ou 20 minutes par fichier. Le mode gratuit exporte aussi en TXT, SRT, VTT et JSON, avec détection automatique de la langue et plus de 19 langues prises en charge.
Quel est le tarif de Whisper Web ?
Whisper Web repose sur un modèle freemium, avec Whisper Web Free et Whisper Web Unlimited. Les montants figurent dans le tableau des prix. Sans compte, la formule gratuite couvre l’usage local dans le navigateur. Elle inclut les exports TXT, SRT, VTT et JSON. Des limites de taille et de durée par fichier s’appliquent aussi.
C’est quoi Whisper Web ?
Whisper Web est un outil de transcription vocale en ligne, basé sur le modèle OpenAI Whisper exécuté localement dans le navigateur. Il convertit l’audio en texte horodaté, prend en charge plus de 19 langues avec détection automatique, et fonctionne aussi hors ligne après mise en cache du modèle.
Comment utiliser Whisper Web ?
Whisper Web se lance dans le navigateur, puis l’utilisateur charge un fichier, enregistre au micro ou fournit une URL audio. Il choisit un modèle Whisper, puis démarre la transcription. Le texte apparaît segmenté et horodaté, avec export possible en TXT, SRT, VTT ou JSON.