Documentation ElevenLabs

Explorez notre documentation et nos guides pour intégrer ElevenLabs

Comment fonctionne ElevenLabs

ElevenLabs fournit une infrastructure d’IA vocale : synthèse vocale, transcription, clonage de voix, agents conversationnels et audio génératif. Vous pouvez l’utiliser de quatre façons, adaptées à différents publics.

ElevenCreative est une application web sans code qui permet aux créateurs, producteurs et monteurs de générer des voix off, de la musique, des doublages et des projets Studio directement dans le navigateur.

ElevenAgents est la plateforme permettant de concevoir et de gérer des agents vocaux conversationnels, avec un éditeur visuel pour les utilisateurs non techniques et un contrôle programmatique complet pour les développeurs.

ElevenAPI expose chaque fonctionnalité via une interface REST et des SDK Python et TypeScript officiels, afin que les développeurs puissent intégrer la voix à leurs propres applications et flux de travail.

Reception AI est un standardiste téléphonique IA prêt à déployer pour les petites et moyennes entreprises. Il répond aux appels, prend des rendez-vous et gère les opérations quotidiennes depuis un Dashboard unique.

Concepts

Les voix sont les personnalités vocales utilisées pour générer de l’audio. Chaque voix possède un ID unique, par exemple JBFqnCBsd6RMkjVDRZzb, que vous sélectionnez dans le Dashboard ou transmettez dans les requêtes API. ElevenLabs propose une bibliothèque de plus de 10 000 voix. Vous pouvez également cloner une voix à partir d’un enregistrement audio ou en générer une depuis une description textuelle.

Les modèles déterminent la qualité, la latence et la couverture linguistique de l’audio généré. eleven_v4 produit les résultats les plus expressifs dans plus de 90 langues. eleven_v4_turbo est conçu pour une utilisation en temps réel, avec une latence d’inférence médiane d’environ 100 ms. Chaque fonctionnalité, transcription, musique ou effets sonores, dispose de son propre modèle dédié.

Les crédits sont l’unité de consommation commune à tous les produits. La synthèse vocale coûte un crédit par caractère de texte saisi. Les autres opérations sont facturées à la seconde d’audio traitée. Les crédits sont réinitialisés chaque mois et les crédits non utilisés sont reportés pendant deux mois maximum. Consultez la tarification pour obtenir le détail complet.

Choisissez votre parcours

Découvrez les modèles

† Hors latence de l’application et du réseau

Parcourir par fonctionnalité