Fiche créée le

Inworld

4,2 Freemium

Inworld fournit des modèles de voix en temps réel et l'infrastructure pour les servir : la synthèse vocale Realtime TTS-2, la transcription STT-1, une Realtime API pour le dialogue parlé et un Router vers des centaines de modèles de langage. Son éditeur, Theai, Inc., se présente comme un laboratoire de recherche et un fournisseur d'inférence pour les applications grand public.

Freemium, l'offre part d'un palier On-Demand gratuit facturé à l'usage, puis monte par abonnements à crédits mensuels jusqu'au sur-mesure Enterprise. Tout passe par l'API, le portail web et un Playground : aucune application native. Inworld ne vend pas un personnage clés en main ; il vend la voix, l'écoute et le routage de modèles qu'un développeur assemble lui-même.

Lire plus Lire moins
La fiche en bref
Éditeur
Theai, Inc. (Inworld AI)
Pays
États-Unis
Création
2021
Offre gratuite
Oui
Essai gratuit
Non
Plateformes
Web

Inworld en bref

C’est quoi ?

Inworld est une plateforme d’API pour la voix en temps réel. Tu envoies du texte, Realtime TTS-2 renvoie une voix expressive en streaming ; tu envoies de l’audio, STT-1 renvoie la transcription et un profil vocal ; la Realtime API enchaîne les deux avec un modèle de langage dans une seule session. Le Router, lui, distribue chaque requête vers le modèle le mieux placé. Inworld reste une brique technique, pas une application prête à l’emploi.

Pourquoi ?

Tu l’emploies quand un agent vocal doit répondre sans délai perceptible et garder une voix naturelle sur des millions d’échanges. Le pilotage par balises change le ton, le débit ou le volume au milieu d’une phrase ; le clonage instantané ou la conception par description fournit la voix voulue. Le Router évite de dépendre d’un seul fournisseur de modèles. Inworld vise le coût par interaction avant tout.

Pour qui ?

Les développeurs d’applications grand public : compagnons et réseaux sociaux à voix, apprentissage des langues, santé et bien-être, agents de support, jeux et médias narrés. L’éditeur cite Status, OtherHalf, Luvu, Talkpal et Bible Chat parmi ses clients. Tu choisis Inworld si tu écris du code : sans API ni SDK, l’outil ne sert à rien.

Avantages et inconvénients

Les plus

  • Voix expressive pilotée par balises Realtime TTS-2 lit des balises placées entre crochets au fil du texte : ton, vitesse, volume, style vocal, pauses. Un soupir ou un rire noté de la même façon sort en son. Le résultat se règle phrase par phrase, sans pipeline de prompt séparé.
  • Latence pensée pour le direct Inworld annonce moins de 100 ms avant le premier octet audio sur TTS-2, et 25 ms sur TTS-2 Flash, en streaming WebSocket. La Realtime API tient l’aller-retour parole-réponse sous la seconde. Un agent vocal répond avant que l’utilisateur ne perçoive l’attente.
  • Clonage et conception de voix Une voix se clone depuis quelques secondes d’audio, puis se localise dans d’autres langues en gardant son identité. Sans échantillon, tu décris l’accent, l’âge, le ton et l’énergie en langage naturel, et Inworld génère la voix.
  • Transcription avec profil vocal STT-1 renvoie, avec chaque morceau de transcription, l’émotion, le style vocal, l’accent, l’âge et la hauteur du locuteur, assortis d’un score de confiance. Ces signaux alimentent le modèle de langage et le pilotage de la synthèse dans la même session.
  • Routeur de modèles sans marge Le Realtime Router expose des centaines de modèles de langage derrière un seul point d’entrée, refacturés au tarif du fournisseur. Des règles sur les métadonnées choisissent le modèle, un test A/B compare deux variantes, et la bascule automatique reprend sur un autre modèle en cas de panne.

Les moins

  • Un produit pour développeurs Inworld se consomme par API, SDK, CLI ou Playground. Sans code, tu n’assembles rien : il n’existe ni application mobile, ni éditeur de personnage prêt à l’emploi.
  • Le gratuit reste un banc d’essai On-Demand inclut un volume de synthèse limité et peu de requêtes simultanées ; le reste se paie à l’usage, au tarif le plus élevé. Un projet régulier passe vite à Creator ou Builder.
  • Des crédits qui expirent Les crédits mensuels d’un abonnement ne se reportent que quelques mois, tant que l’abonnement reste actif. À la résiliation, le solde restant est perdu, et les paiements ne sont pas remboursés.
  • Interface et documentation en anglais Site, portail et documentation n’existent qu’en anglais, sans page en français. La voix parle français, l’outil qui la produit ne te parle qu’en anglais.

Tableau des prix

Inworld suit un modèle freemium. On-Demand n’a pas d’abonnement : tu paies ce que tu consommes, au tarif de base, après le volume inclus. Creator, Builder, Developer et Growth sont des abonnements dont le prix revient chaque mois sous forme de crédits, consommés par la synthèse, la transcription, la Realtime API et le Router au tarif remisé du palier ; le dépassement se facture au même tarif. La vue annuelle de la page affiche une mensualité réduite, sans total annuel, sous l’intitulé « deux mois offerts ». Les crédits non utilisés se reportent trois mois, et une recharge ponctuelle reste possible. Enterprise se négocie avec le service commercial : alignement sur les prix concurrents, SLA, résidence des données en Europe ou en Inde.

PalierPrix au 22 septembre 2026QuotaInclusPour qui
On-DemandGratuitJusqu’à 70 minutes de TTS incluses, 100 voix personnalisées, 5 requêtes simultanéesClonage et conception de voix, accès à la Realtime API, plus de 220 modèles via le Router, licence commerciale, support communautaireÉvaluation et prototypage
Creator$25 par mois — ou $20,83 par mois en facturation annuelleCrédits mensuels égaux au prix du palier, 500 voix personnalisées, 10 requêtes simultanéesJusqu’à 33 % de remise sur les tarifs TTS et STT, quarante mille caractères par requête dans le TTS Playground, tout On-DemandCréation de contenu et petits projets
Builder$100 par mois — ou $83,33 par mois en facturation annuelleCrédits mensuels égaux au prix du palier, trois mille voix personnalisées, 50 requêtes simultanéesJusqu’à 40 % de remise sur les tarifs TTS et STT, création et partage d’espaces de travail, gestion d’équipe, tout CreatorProjets en croissance et petites équipes
Developer$300 par mois — ou $250 par mois en facturation annuelleCrédits mensuels égaux au prix du palier, dix mille voix personnalisées, 150 requêtes simultanéesJusqu’à 47 % de remise sur les tarifs TTS et STT, clonage de voix professionnel en option, support e-mail prioritaire, tout BuilderApplications en production
Growth$1 500 par mois — ou $1 250 par mois en facturation annuelleCrédits mensuels égaux au prix du palier, trente mille voix personnalisées, 500 requêtes simultanéesJusqu’à 53 % de remise sur les tarifs TTS et STT, limites d’API relevées, un clone de voix professionnel, ZDR, HIPAA et BAA en option, tout DeveloperGrands déploiements et conformité
EnterpriseSur devisAlignement sur les prix concurrents, SLA et DPA, résidence des données en Union européenne ou en Inde, responsable de compte dédié et canal Slack, facturation sur factureTarifs, limites et conditions sur mesure

Tarifs officiels d'Inworld, relevés le 22/09/2026

Ce que permet la formule gratuite

Inworld ouvre On-Demand sans abonnement ni essai. Un compte gratuit sur platform.inworld.ai suffit pour démarrer. On-Demand inclut jusqu’à 70 minutes de synthèse vocale ou 400 minutes de transcription, 100 voix personnalisées, le clonage et la conception de voix, l’accès à la Realtime API et au Router, avec une licence commerciale. Au-delà du volume inclus, chaque produit se facture à l’usage au tarif de base, réglé par recharge de crédits.

Ce cadre vise l’évaluation et le prototypage, comme l’annonce la carte : cinq requêtes simultanées, deux mille caractères par requête dans le Playground, support communautaire, aucune création d’espace de travail. Certains modèles de langage premium demandent une carte bancaire enregistrée avant usage, même avec un solde de crédits.

Ce que fait Inworld

Inworld réunit quatre produits d’API. Realtime TTS-2 et sa version Flash transforment du texte en parole en streaming ; STT-1 transcrit l’audio en direct ou en différé ; la Realtime API relie transcription, modèle de langage et synthèse dans une session unique ; le Realtime Router distribue les requêtes texte vers des modèles tiers ou vers l’inférence maison.

Les balises entre crochets pilotent tout. Chacune fixe le ton, la vitesse, le volume ou une pause ; un profil vocal extrait par STT-1 remonte au modèle de langage, qui renvoie ses propres balises à la synthèse. Inworld appelle cela l’intelligence conversationnelle : la réponse s’adapte à la manière dont l’utilisateur a parlé, pas seulement à ses mots.

Côté modèles, Inworld sert ses propres modèles de voix et, par le Router, ceux d’OpenAI, Anthropic, Google, xAI, Meta, Mistral, DeepSeek, Qwen, Groq et DeepInfra, plus des modèles ouverts optimisés en interne comme Gemma 4, DeepSeek V3.2 ou GLM-5.1. Si un fournisseur tombe, ta chaîne de repli prend le relais. Inworld basculera sur le modèle suivant.

Côté accès, tout passe par des API REST, WebSocket et WebRTC, des SDK, une CLI et le TTS Playground du portail. Un changement d’adresse de base branche le Router sur les SDK OpenAI et Anthropic, et la Realtime API reste compatible avec l’OpenAI Realtime API.

Comment utiliser Inworld

Prise en main initiale

Inworld démarre sur platform.inworld.ai : tu crées un compte, tu génères une clé d’API, puis tu testes une voix dans le TTS Playground avant d’écrire une ligne de code. Le premier appel tient en une requête POST vers l’API TTS avec un texte, un identifiant de voix et le modèle choisi. La CLI installée par npm couvre le même geste depuis le terminal.

Navigation dans l’interface

Dans le portail Inworld, le Playground sert à comparer les modèles, cloner une voix depuis un court échantillon ou en concevoir une par description ; les pages Billing et Usage suivent le solde de crédits et la consommation. Les espaces de travail partagés et la gestion d’équipe apparaissent à partir du palier Builder. Le reste du produit se pilote par API, documenté sur docs.inworld.ai.

Utilisation et gestion de projets

Pour un agent vocal Inworld, tu ouvres une session Realtime API en WebSocket ou WebRTC, tu déclares le modèle de langage, le modèle de transcription et la voix, puis tu enregistres tes outils pour que l’agent appelle des fonctions sans couper l’audio. Pour le Router, tu conserves ton SDK OpenAI ou Anthropic et tu changes l’adresse de base vers api.inworld.ai. Les crédits se déduisent de l’usage au tarif du palier.

Fonctionnalités principales

Inworld regroupe des fonctions de synthèse vocale, de transcription, de dialogue parlé et de routage de modèles, toutes servies par API. La plupart s’ouvrent dès le palier gratuit ; les options d’équipe et de conformité arrivent avec les paliers supérieurs.

Synthèse Realtime TTS-2 et TTS-2 Flash

Synthèse vocale maison en streaming WebSocket, présentée par l’éditeur comme classée première sur Artificial Analysis. Flash vise les charges à fort volume où la latence prime sur la nuance.

Pilotage par balises

Des consignes entre crochets dans le texte règlent ton, vitesse, volume, style vocal et pauses ; des indications non verbales comme un soupir, un rire ou un « hmm » sont rendues en son, pas affichées.

Clonage instantané de voix

Une voix personnalisée depuis cinq à quinze secondes d’audio, localisable dans d’autres langues avec la même identité et sans accent importé.

Clonage professionnel en option à partir du palier Developer.

Conception de voix par description

Sans échantillon audio : tu décris accent, âge, ton et énergie en langage naturel, et la voix générée s’utilise dans le Playground comme par API, sous le même identifiant.

Horodatages et visèmes

Les sorties TTS portent des horodatages avec détails phonétiques et visèmes pour la synchronisation labiale ; l’audio se télécharge, et des modes asynchrone et par lot couvrent les contenus longs.

Transcription Realtime STT-1

Transcription en streaming bidirectionnel ou synchrone sur fichier, détection d’activité vocale sémantique et acoustique, horodatages par mot, diarisation des locuteurs, vocabulaire personnalisé et indications de langue.

Profil vocal

Émotion, style vocal, accent, âge et hauteur extraits de chaque morceau d’audio avec un score de confiance, injectés dans le contexte du modèle de langage et dans le pilotage de la synthèse.

Realtime API

Parole vers parole dans une session WebSocket ou WebRTC : détection de tour de parole à sensibilité réglable, gestion des interruptions, appel de fonctions en cours de conversation, gestion du contexte, compatibilité avec l’OpenAI Realtime API.

Realtime Router

Un point d’entrée pour plus de 220 modèles de langage sans marge, règles de routage écrites en CEL sur les messages et les métadonnées, affectation stable par utilisateur, tests A/B, bascule automatique et observabilité de chaque tentative.

Realtime Inference et Compute

Des modèles ouverts, Gemma 4, DeepSeek V3.2 et V4, GLM-5.1 et 5.2, réoptimisés par Inworld et servis sous le tarif public selon l’éditeur ; des capacités GPU dédiées pour les clients à fort trafic.

Compute réservé aux clients à fort trafic, sur devis.

Outillage développeur

TTS Playground, CLI installable par npm pour synthétiser, cloner, concevoir des voix et produire des livres audio, SDK, serveur MCP pour la documentation, intégration téléphonique Twilio et guide de migration depuis ElevenLabs.

Équipe et conformité

Espaces de travail partagés et gestion d’équipe, SSO SAML et provisionnement SCIM, RGPD et SOC 2 Type II, licence commerciale sur tous les paliers, rétention zéro et HIPAA en option, résidence des données en Union européenne ou en Inde et déploiement VPC.

Espaces partagés dès Builder ; rétention zéro et HIPAA sur Growth ; résidence des données et VPC sur Enterprise.

Usages et métiers

Inworld sert les développeurs d’applications grand public qui parlent et écoutent : compagnons, éducation, santé, support, jeux et médias. Chaque usage ci-dessous reprend un public nommé par l’éditeur et ce que le service remplace dans sa chaîne technique.

Développeurs d’applications à voix

Ajoutent une voix expressive et une écoute en temps réel à leur produit par API. Inworld remplace l’assemblage de trois fournisseurs séparés pour la transcription, le modèle de langage et la synthèse.

Applications de compagnons et réseaux sociaux

Font parler des compagnons vocaux à grande échelle, avec une voix stable d’une session à l’autre. L’éditeur cite Status et OtherHalf, deux applications de ce segment.

Apprentissage et éducation

Construisent des tuteurs de langue ou des exercices parlés qui répondent sans délai. Talkpal, cité par l’éditeur, s’appuie sur la synthèse d’Inworld pour ses apprenants.

Santé et bien-être

Proposent un accompagnement parlé au ton maîtrisé, guidé par le profil vocal de l’utilisateur. Bible Chat figure parmi les clients nommés sur le site.

Agents de support et assistants

Déploient des agents téléphoniques ou intégrés qui écoutent, réfléchissent et répondent dans la même session, avec appel d’outils métier. L’intégration Twilio couvre la téléphonie.

Studios de jeux et de médias

Donnent une voix à des personnages, des narrations et des histoires interactives, et branchent l’API dans Unreal, Unity ou un moteur maison. Le Router affecte un modèle rapide aux répliques d’ambiance et un modèle plus fort aux scènes clés.

Conseils d’utilisation

Conseils pour une utilisation efficace

Inworld se prend en main par le Playground avant l’API : compare TTS-2 et TTS-2 Flash sur ton texte réel, puis place des balises de ton et de pause là où la phrase le demande plutôt qu’en tête de prompt. Pour un agent, laisse STT-1 remonter le profil vocal au modèle de langage : la réponse gagne en justesse sans réglage manuel. Suis le solde de crédits sur la page Billing et active la recharge automatique si ton trafic est irrégulier. En cas de doute, la documentation, son assistant, la communauté Discord et l’adresse support@inworld.ai répondent.

Erreurs communes à éviter

Inworld punit trois habitudes. Rester sur On-Demand en production est un mauvais calcul : ce palier applique les tarifs à l’usage les plus hauts, alors qu’un abonnement rend son prix en crédits remisés. Laisser expirer un abonnement perd le solde de crédits, qui ne se rembourse pas. Multiplier les balises contradictoires dans une même phrase brouille la voix : une consigne par intention, et un test dans le Playground avant de déployer. Vérifie aussi la page de statut de l’éditeur avant d’incriminer ton code lors d’une hausse de latence.

Modèles et droits sur les créations

Inworld sert ses propres modèles : Realtime TTS-2, TTS-2 Flash et STT-1. Par le Router, il ouvre aussi des fournisseurs tiers comme OpenAI, Anthropic, Google, Mistral ou DeepSeek, et sa propre piste d’inférence sur modèles ouverts. Un catalogue public liste chaque modèle avec son contexte et ses tarifs d’entrée et de sortie.

Les conditions d’utilisation du 11 juin 2025 laissent au client ses droits sur ses entrées et lui cèdent les droits d’Inworld sur les sorties. Chaque palier porte la licence commerciale, gratuit compris. L’éditeur s’accorde une licence sur les contenus pour exploiter, maintenir et améliorer le service, et s’engage à ne pas entraîner ses modèles grand public sur des contenus non publics, hors retours volontaires et revue de sécurité.

L’usage est réservé aux personnes majeures, et les paiements ne sont pas remboursés. Un déploiement chez le client, sur sa propre infrastructure, reste possible quand l’éditeur l’autorise, avec la responsabilité de sa sécurité et de sa conformité.

Accès

Inworld s’utilise depuis un navigateur pour le portail et le Playground, et depuis ton code pour tout le reste : API REST, WebSocket et WebRTC, SDK, CLI. Aucune application Windows, macOS, Linux, iOS ou Android n’existe ; le service vit côté serveur et parle par API. Site, portail et documentation sont en anglais uniquement, tandis que la voix produite parle de nombreuses langues, dont le français.

Appareils, applications et systèmes compatibles

Inworld tient dans un navigateur pour le portail et son Playground, et dans l’API pour la production. Ni application iOS, ni application Android, ni client de bureau. Les SDK OpenAI et Anthropic pointent vers le Router par un changement d’adresse, la téléphonie passe par Twilio, et un serveur MCP expose la documentation aux assistants de code.

Disponible sur

WebOui
iOSNon
AndroidNon
WindowsNon
macOSNon
LinuxNon

Accès & intégrations

Extension navigateurNon
IntégrationsOui

Twilio (téléphonie), SDK OpenAI et Anthropic, serveur MCP de la documentation

Plug-inNon
API publiqueOui

API REST, WebSocket et WebRTC pour la synthèse, la transcription, la Realtime API et le Router, documentées sur docs.inworld.ai.

SDKOui

SDK et CLI documentés par l’éditeur, avec compatibilité des SDK OpenAI et Anthropic pour le Router.

Open sourceNon
Auto-hébergeableOui

Déploiement chez le client ou en VPC autogéré, réservé à l’offre Enterprise.

Avis et notes par Aikiwi

Note Globale d’Inworld 4,2

  • Design et Ergonomie3,8
  • Facilité d’Utilisation3,6
  • Fonctionnalités et Outils4,7
  • Performance et Fiabilité4,3
  • Innovation et Singularité4,5
  • Support et Ressources Disponibles4,1
  • Rapport Qualité-Prix4,4

Inworld réunit une synthèse vocale expressive en temps réel, une transcription qui lit l’état du locuteur, une Realtime API qui enchaîne les deux avec un modèle de langage et un Router sans marge vers des centaines de modèles. La note reflète une brique d’infrastructure solide, pensée pour le coût par interaction à grande échelle.

Inworld convient aux équipes qui écrivent du code et servent des utilisateurs finaux à la voix : compagnons, éducation, santé, support, jeux. Sans développeur, l’outil n’offre aucune prise ; avec, il remplace plusieurs fournisseurs par une session.

Le palier On-Demand permet d’évaluer la synthèse et la transcription sans abonnement ; le tableau des prix dit à partir de quel palier les crédits mensuels et les remises à l’usage rendent le service rentable pour un trafic soutenu.

Avis détaillé sur Inworld

Design et Ergonomie 3,8

Inworld expose son interface dans un portail web : Playground de synthèse, pages de facturation et d’usage, gestion d’équipe. L’éditeur ne publie ni capture commentée ni guide de l’écran ; la conception se juge sur la documentation et les démonstrations du site, où l’on essaie voix, transcription et routage sans compte. L’ergonomie réelle tient donc dans l’API : des endpoints cohérents, une compatibilité avec les SDK OpenAI et Anthropic, un même identifiant de voix partout. Pour un développeur, cette régularité vaut plus qu’un habillage. Pour un profil non technique, le portail reste un tableau de bord, pas un outil de création. La note reste prudente faute d’éléments publics sur l’organisation des écrans.

Facilité d’Utilisation 3,6

Inworld demande d’écrire du code, et c’est le seuil qui compte. Un premier appel se fait en une seule requête, et le Playground permet d’entendre une voix en quelques clics, mais un agent vocal complet suppose de gérer une session WebSocket, des outils et un modèle de langage. La documentation est structurée par produit, avec des quickstarts, une CLI et un serveur MCP pour les assistants de code. Les développeurs y trouvent un chemin court ; les autres n’ont pas d’entrée. Le site et le portail en anglais seul ajoutent une marche pour une équipe francophone. L’outil est simple pour son public, fermé pour les autres.

Fonctionnalités et Outils 4,7

Inworld couvre la chaîne entière d’une application vocale : synthèse pilotée par balises avec clonage et conception de voix, transcription avec profil vocal, Realtime API avec prise de parole, interruptions et appel de fonctions, Router vers des centaines de modèles avec règles, tests A/B et bascule automatique. S’ajoutent l’inférence maison sur modèles ouverts, des capacités GPU dédiées, des horodatages et des visèmes pour caler les lèvres, la téléphonie par Twilio, et une couche d’équipe et de conformité jusqu’à la résidence des données. Peu de fournisseurs réunissent la voix, l’écoute et le routage sous un même compte. Il manque un éditeur visuel ou une application, mais ce n’est pas la promesse.

Performance et Fiabilité 4,3

Inworld publie une page de statut par composant, GPU Compute, Realtime API, STT, Router et TTS, avec un historique d’incidents détaillé : hausses de latence sur la synthèse, taux d’erreur sur certains modèles routés, chacun daté, expliqué et clos en moins d’une heure dans les cas listés. L’éditeur annonce des latences de premier octet mesurées côté serveur et une bascule automatique vers un autre modèle quand un fournisseur tombe. Le service se tient donc à un niveau publié et vérifiable, ce qui est rare sur cette catégorie. Les incidents récents sur des modèles tiers rappellent que le Router dépend aussi de ses fournisseurs. La note repose sur cette transparence, pas sur nos propres mesures.

Innovation et Singularité 4,5

Inworld se distingue par le lien entre écoute et parole : le profil vocal extrait de la transcription, émotion, accent, âge, hauteur, style, remonte au modèle de langage, lequel renvoie des balises que la synthèse joue en son. Cette boucle, l’appel d’outils sans couper l’audio et le pilotage en langage naturel au fil du texte forment une proposition que peu d’API vocales offrent en une session. Le Router sans marge, avec des règles écrites sur les métadonnées de l’utilisateur, ajoute une logique de produit plutôt que de simple relais. Le positionnement en laboratoire de recherche et fournisseur d’inférence est cohérent avec cette offre. La singularité est réelle pour les agents conversationnels grand public.

Support et Ressources Disponibles 4,1

Inworld documente chaque produit sur docs.inworld.ai, avec quickstarts, référence d’API, guides de bonnes pratiques, notes de version, un assistant qui répond depuis la documentation et une communauté Discord. L’adresse support@inworld.ai reste le canal général ; le support e-mail prioritaire n’arrive qu’au palier Developer, et un responsable de compte avec canal Slack au palier Enterprise. La page de statut complète le dispositif. Tout est en anglais, sans centre d’aide grand public. L’ensemble convient à des intégrateurs qui lisent une documentation technique ; un utilisateur non développeur n’y trouvera pas d’accompagnement.

Rapport Qualité-Prix 4,4

Inworld rend son abonnement en crédits : le prix du palier revient chaque mois en solde à consommer, avec des tarifs à l’usage qui baissent à chaque palier et un Router refacturé au tarif du fournisseur. La vue annuelle offre deux mois. Le palier gratuit permet de tester sans abonnement, et l’éditeur revendique des coûts très inférieurs à ceux des concurrents cités sur son site. La contrepartie tient dans l’expiration des crédits et dans un ticket d’entrée qui grimpe vite pour un projet en production. Pour une application qui parle beaucoup, le calcul est favorable ; pour un usage occasionnel, On-Demand suffit.

Questions fréquentes

Comment utiliser Inworld gratuitement ?

Inworld propose le palier On-Demand sans abonnement : un compte sur le portail suffit pour obtenir une clé d’API et tester la synthèse dans le Playground. Le volume de synthèse inclus, le clonage de voix, la Realtime API et le Router sont accessibles ; au-delà, l’usage se facture au tarif de base, que tu règles par recharge de crédits.

Quel est le prix d’Inworld ?

Inworld affiche quatre abonnements à crédits mensuels : Creator à $25 par mois, Builder à $100 par mois, Developer à $300 par mois et Growth à $1 500 par mois, chacun un peu moins cher en facturation annuelle. Enterprise se négocie sur devis. Les deux rythmes et le contenu de chaque palier sont dans le tableau des prix.

Quelles langues Inworld prend-il en charge ?

Inworld annonce une synthèse vocale multilingue et nomme entre autres l’anglais, l’espagnol, le français, l’allemand, le japonais, le coréen, le chinois et l’hindi, avec un clonage qui conserve la voix d’une langue à l’autre. La transcription en direct se limite à l’anglais, au français, à l’espagnol, à l’allemand, à l’italien et au portugais. Le site et la documentation restent en anglais.

Inworld a-t-il une application mobile ?

Non. Inworld n’existe ni sur iOS ni sur Android, ni en application de bureau : le service se consomme par API, SDK et CLI, et le portail web sert à gérer les clés, les crédits et le Playground. Une application mobile utilise Inworld en coulisses, elle ne l’installe pas.

Qui édite Inworld ?

Inworld est édité par Theai, Inc., société de Mountain View, en Californie, qui exerce sous le nom commercial Inworld AI. L’éditeur se présente comme un laboratoire de recherche et un fournisseur d’inférence pour l’IA en temps réel ; ses fondateurs ont dirigé le produit LLM chez DeepMind et construit Dialogflow, racheté par Google.

Inworld sert-il encore à créer des personnages de jeu ?

Le site d’Inworld ne propose plus d’éditeur de personnages : l’offre du jour est la voix en temps réel, la transcription, la Realtime API et le Router. Un studio de jeu y branche ses personnages par API dans Unreal, Unity ou un moteur maison, et confie les répliques d’ambiance à un modèle rapide, les scènes clés à un modèle plus fort, par une règle du Router.

Inworld propose-t-il une API ?

Oui, Inworld est d’abord une API. Synthèse, transcription, Realtime API et Router se pilotent en REST, WebSocket ou WebRTC, avec des SDK, une CLI et une compatibilité directe avec les SDK OpenAI et Anthropic. Les limites de requêtes simultanées montent avec le palier.

La fiche en bref
Éditeur
Theai, Inc. (Inworld AI)
Pays
États-Unis
Création
2021
Offre gratuite
Oui
Essai gratuit
Non
Plateformes
Web

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.