Dust ajoute la voix multilingue aux workflows d’entreprise pilotés par l’IA avec ElevenLabs
- Rédigé par
- Nicolò Scribani Rossi
- Publié
ÉcouterÉcouter cet article
Dust, le système d’exploitation des entreprises nativement IA, intègre désormais des entrées et sorties vocales multilingues, propulsées par ElevenLabs. Conçu pour intégrer des modèles au travail quotidien, Dust avait besoin de capacités vocales efficaces dans toutes les langues, sur tous les appareils et dans tous les contextes, avec une faible latence et un réalisme élevé.
Il ne s’agissait pas d’une expérimentation. La voix est devenue une priorité produit après des demandes récurrentes des clients. Résultat : un système qui permet d’interagir avec des agents en mains libres pendant les trajets, de collaborer en plusieurs langues au sein d’équipes internationales et de créer des contenus audio professionnels pour des workflows asynchrones.
Pourquoi la voix compte en entreprise
Dust a identifié quatre exigences essentielles pour la voix dans un contexte professionnel :
- Une qualité naturelle à la hauteur des exigences : Les contenus vocaux doivent être professionnels et humains, adaptés aux e-mails clients, podcasts ou démonstrations produit.
- Le multilinguisme par défaut : Les équipes travaillent dans des bureaux et des langues du monde entier. Passer du français à l’anglais puis à l’allemand au cours d’une même session ne doit pas être un cas particulier.
- Faible latence : Pour les entrées comme les sorties, la vitesse de réponse doit suivre le rythme de la réflexion et de la conversation.
- Gestion des données adaptée aux entreprises : L’absence de conservation des données, le routage par région et la conformité aux normes SOC 2 et au RGPD étaient indispensables.
Pourquoi Dust a choisi ElevenLabs
Après avoir évalué plusieurs fournisseurs, Dust a choisi ElevenLabs pour la qualité de ses solutions et leur disponibilité pour le déploiement :
- Text to Speech a fourni des voix au réalisme constamment élevé et à la large palette émotionnelle, essentielles aux outils Speech Generator et Sound Studio de Dust.
- Speech to Text prend en charge 99 langues de transcription, avec une grande fidélité entre les langues.
- La non-conservation des données et le routage multirégion ont assuré la conformité aux exigences des entreprises dès l’intégration.
- Des SDK et API prêts pour la production ont permis une intégration rapide et des performances constantes sur toutes les plateformes.
Comment Dust a intégré la voix
Dust a intégré la prise en charge vocale dans deux workflows principaux :
1. Entrée vocale : parler aux agents
Avec le modèle scribe_v1 d’ElevenLabs, les utilisateurs peuvent désormais parler aux agents via leur microphone. Le système détecte automatiquement la langue parlée, la transcrit et achemine la demande en conséquence. Il peut même déduire le nom des agents à partir du langage naturel.
La saisie vocale est disponible sur mobile, pour les moments où taper est le moins pratique.
2. Sortie vocale : audio généré par les agents
Grâce à Speech Generator, les agents Dust peuvent créer du contenu audio avec les modèles eleven_multilingual_v2 et eleven_v3 d’ElevenLabs. Les contenus générés incluent des podcasts, des briefings et des formats audio narratifs, destinés aussi bien à un usage interne qu’au partage externe.
Sound Studio, propulsé par Text to Sound Effects, ajoute des couches audio non verbales aux cas d’usage de formation et de création de contenu.
Les enseignements de Dust
- Le routage régional compte : Permettre de sélectionner la région UE ou États-Unis a réduit la latence et facilité les échanges sur la conformité.
- La sélection vaut mieux que l’abondance : Une sélection de 12 voix réduit la fatigue décisionnelle tout en couvrant tous les besoins essentiels.
- Qualité > vitesse : Malgré l’existence de modèles plus rapides, les utilisateurs ont systématiquement choisi des voix plus fidèles pour les contenus de production.
Ce que cela permet
- Productivité mobile avant tout : Capturez vos idées et collaborez où que vous soyez.
- Collaboration multilingue : Exprimez-vous naturellement dans votre langue, les agents s’occupent du reste.
Workflows accessibles et asynchrones : Transformez les recherches en audio, réduisez les barrières à la saisie et accompagnez différents modes de travail.
La suite
Dust explore les შესაძლებლités d’agents vocaux conversationnels en temps réel, une compréhension audio plus approfondie au-delà de la transcription, ainsi que la prise en charge de contenus longs comme les réunions et les présentations. En intégrant ElevenLabs, Dust fait de la voix une composante fluide de l’IA d’entreprise.
.png&w=3840&q=80)



