Crea un assistente vocale con Agents Platform su Raspberry Pi
Tutorial · Presuppone che tu abbia completato la guida rapida di ElevenAgents e disponga di un Raspberry Pi con Python installato.
Introduzione
In questo tutorial imparerai a creare un assistente vocale con Agents Platform in esecuzione su un Raspberry Pi. Proprio come gli assistenti domestici tradizionali come Alexa su Amazon Echo, Google Home o Siri sui dispositivi Apple, il tuo assistente vocale Eleven ascolterà una hotword, nel nostro caso “Hey Eleven”, e poi avvierà una sessione ElevenLabs Agents per assistere l’utente.
Requisiti
- Un Raspberry Pi 5 o un dispositivo simile.
- Un microfono e un altoparlante.
- Python 3.9 o versione successiva installato sul tuo dispositivo.
- Un account ElevenLabs con una chiave API.
Configurazione
Installa le dipendenze
Sui sistemi basati su Debian puoi installare le dipendenze con:
Crea il progetto
Sul tuo Raspberry Pi, apri il terminale e crea una nuova directory per il progetto.
Crea un nuovo ambiente virtuale e installa le dipendenze:
Installa le dipendenze:
Ora crea un nuovo file Python chiamato hotword.py e aggiungi il codice seguente:
Configurazione dell’agente
Imposta il primo messaggio
Imposta il primo messaggio e specifica la variabile dinamica per la piattaforma.
Imposta il prompt di sistema
Imposta il prompt di sistema. Trovi qui la nostra documentazione sulle best practice qui.
Configura uno strumento webhook
Configureremo un semplice strumento webhook che recupererà per noi i dati meteo. Segui i passaggi di configurazione qui per configurarlo.
Esegui l’app
Per eseguire l’app, imposta prima le variabili d’ambiente richieste:
Poi esegui questo comando:
Ora di’ “Hey Eleven” per avviare la conversazione. Buona conversazione!
[Facoltativo] Addestra la tua hotword personalizzata
Genera l’audio di addestramento
Per generare gli embedding della hotword, puoi usare ElevenLabs per generare quattro campioni di addestramento. Vai a Text to Speech nella tua app ElevenLabs e inserisci la tua hotword, ad esempio “Hey Eleven”. Seleziona una voce e fai clic sul pulsante “Genera”.
Dopo aver generato l’audio, scarica il file audio e salvalo in una cartella chiamata hotword_training_audio nella root del progetto. Ripeti il processo altre tre volte con voci diverse.
Addestra la hotword
Nel terminale, con l’ambiente virtuale attivato, esegui il comando seguente per addestrare la hotword:
Verrà generato il file hey_eleven_ref.json nella cartella hotword_refs. Ora devi solo aggiornare il parametro reference_file nella classe HotwordDetector in hotword.py affinché punti al nuovo file di riferimento e sei pronto!