Créer un assistant vocal avec la plateforme ElevenAgents sur un Raspberry Pi
Créer un assistant vocal avec la plateforme ElevenAgents sur un Raspberry Pi
Créez un assistant vocal avec la plateforme ElevenAgents sur un Raspberry Pi.
Tutoriel · Suppose que vous avez suivi le guide de démarrage rapide d’ElevenAgents et disposez d’un Raspberry Pi avec Python installé.
Introduction
Dans ce tutoriel, vous apprendrez à créer un assistant vocal avec Agents Platform exécuté sur un Raspberry Pi. Comme les assistants domestiques classiques tels qu’Alexa sur Amazon Echo, Google Home ou Siri sur les appareils Apple, votre assistant vocal Eleven écoutera un mot d’activation, dans notre cas « Hey Eleven », puis lancera une session ElevenLabs Agents pour aider l’utilisateur.
Prérequis
- Un Raspberry Pi 5 ou un appareil similaire.
- Un microphone et un haut-parleur.
- Python 3.9 ou version ultérieure installé sur votre machine.
- Un compte ElevenLabs avec une clé API.
Configuration
Installer les dépendances
Sur les systèmes basés sur Debian, vous pouvez installer les dépendances avec :
Créer le projet
Sur votre Raspberry Pi, ouvrez le terminal et créez un nouveau répertoire pour votre projet.
Créez un nouvel environnement virtuel et installez les dépendances :
Installez les dépendances :
Créez maintenant un nouveau fichier Python nommé hotword.py et ajoutez le code suivant :
Configuration de l’agent
Créez un nouvel agent
Accédez à Agents Platform > Agents et créez un nouvel agent à partir du modèle vierge.
Définissez le premier message
Définissez le premier message et indiquez la variable dynamique pour la plateforme.
Définissez le prompt système
Définissez le prompt système. Consultez notre documentation sur les bonnes pratiques ici.
Configurez un outil webhook
Nous allons configurer un outil webhook simple qui récupérera les données météo. Suivez les étapes de configuration ici pour configurer l’outil.
Exécuter l’application
Pour exécuter l’application, définissez d’abord les variables d’environnement requises :
Exécutez ensuite simplement la commande suivante :
Dites maintenant « Hey Eleven » pour démarrer la conversation. Bonne discussion !
[Facultatif] Entraîner votre mot d’activation personnalisé
Générer l’audio d’entraînement
Pour générer les représentations du mot d’activation, vous pouvez utiliser ElevenLabs afin de générer quatre échantillons d’entraînement. Accédez simplement à Text to Speech dans votre application ElevenLabs, puis saisissez votre mot d’activation, par exemple « Hey Eleven ». Sélectionnez une voix et cliquez sur le bouton « Generate ».
Une fois l’audio généré, téléchargez le fichier audio et enregistrez-le dans un dossier nommé hotword_training_audio à la racine de votre projet. Répétez cette opération trois fois avec des voix différentes.
Entraîner le mot d’activation
Dans votre terminal, avec votre environnement virtuel activé, exécutez la commande suivante pour entraîner le mot d’activation :
Cette commande génère le fichier hey_eleven_ref.json dans le dossier hotword_refs. Il vous suffit ensuite de mettre à jour le paramètre reference_file de la classe HotwordDetector dans hotword.py afin qu’il pointe vers le nouveau fichier de référence, et tout est prêt !