Zbuduj asystenta głosowego z Agents Platform na Raspberry Pi
Zbuduj asystenta głosowego z Agents Platform na Raspberry Pi
Zbuduj asystenta głosowego z Agents Platform na Raspberry Pi.
Poradnik · Zakłada, że ukończyłeś quickstart ElevenAgents i masz Raspberry Pi z zainstalowanym Pythonem.
Wprowadzenie
Z tego poradnika dowiesz się, jak stworzyć asystenta głosowego z Agents Platform działającego na Raspberry Pi. Tak jak standardowi asystenci domowi, np. Alexa na Amazon Echo, Google Home czy Siri na urządzeniach Apple, twój asystent głosowy Eleven będzie nasłuchiwać słowa aktywującego — w tym przypadku „Hey Eleven” — a następnie uruchomi sesję ElevenLabs Agents, aby pomóc użytkownikowi.
Wymagania
- Raspberry Pi 5 lub podobne urządzenie.
- Mikrofon i głośnik.
- Python 3.9 lub nowszy zainstalowany na urządzeniu.
- Konto ElevenLabs z kluczem API.
Konfiguracja
Zainstaluj zależności
W systemach opartych na Debianie zainstalujesz zależności poleceniem:
Utwórz projekt
Na Raspberry Pi otwórz terminal i utwórz nowy katalog projektu.
Utwórz nowe środowisko wirtualne i zainstaluj zależności:
Zainstaluj zależności:
Teraz utwórz nowy plik Python o nazwie hotword.py i dodaj poniższy kod:
Konfiguracja agenta
Skonfiguruj narzędzie webhook
Skonfigurujemy proste narzędzie webhook, które pobierze dla nas dane pogodowe. Wykonaj kroki konfiguracji tutaj, aby skonfigurować narzędzie.
Uruchom aplikację
Aby uruchomić aplikację, najpierw ustaw wymagane zmienne środowiskowe:
Następnie uruchom polecenie:
Teraz powiedz „Hey Eleven”, aby rozpocząć rozmowę. Miłego czatowania!
[Opcjonalnie] Wytrenuj własne słowo aktywujące
Wygeneruj audio treningowe
Aby wygenerować embeddingi słowa aktywującego, możesz użyć ElevenLabs do stworzenia czterech próbek treningowych. Przejdź do Text To Speech w aplikacji ElevenLabs i wpisz słowo aktywujące, np. „Hey Eleven”. Wybierz głos i kliknij przycisk „Generate”.
Po wygenerowaniu audio pobierz plik i zapisz go w folderze hotword_training_audio w katalogu głównym projektu. Powtórz ten proces jeszcze trzy razy, używając różnych głosów.
Wytrenuj słowo aktywujące
W terminalu, przy aktywnym środowisku wirtualnym, uruchom poniższe polecenie, aby wytrenować słowo aktywujące:
Spowoduje to utworzenie pliku hey_eleven_ref.json w folderze hotword_refs. Teraz wystarczy zaktualizować parametr reference_file w klasie HotwordDetector w pliku hotword.py, aby wskazywał nowy plik referencyjny — i gotowe!