Szybki start z Text to Dialogue
Dowiedz się, jak generować wciągający dialog z tekstu.
Ten przewodnik pokaże ci, jak generować wciągający, naturalnie brzmiący dialog z tekstu za pomocą API Text to Dialogue.
Aby generowanie działało niezawodnie, łączna długość wszystkich wartości inputs[].text w jednym żądaniu
nie może przekraczać 2000 znaków. Dłuższe skrypty podziel na fragmenty i połącz audio po stronie klienta.
Korzystanie z API Text to Dialogue
Utwórz klucz API
Utwórz klucz API w panelu tutaj, aby bezpiecznie uzyskać dostęp do API.
Przechowuj klucz jako zarządzany sekret i przekaż go do SDK jako zmienną środowiskową przez plik .env lub bezpośrednio w konfiguracji aplikacji — zależnie od preferencji.
Wyślij żądanie API
SDK
CLI
Utwórz nowy plik o nazwie example.py lub example.mts, zależnie od wybranego języka, i dodaj poniższy kod.
Dodaj tagi audio do każdej wartości text, aby określić sposób wypowiedzi danego mówcy. voice_id
wybiera głos mówcy dla tego samego elementu wejściowego.
Następnie uruchom:
Usłyszysz odtwarzany dialog.
Strumieniowanie przez WebSocket
Aby przesyłać dialog stopniowo przez długotrwałe połączenie z modelami Eleven v3, skorzystaj z Realtime Text to Dialogue. Porównanie tego WebSocket ze standardowym WebSocket TTS znajdziesz w Text to Speech vs Text to Dialogue WebSockets.