Audio-Umgebung

Fügen Sie einen Hintergrundsound hinzu und wenden Sie einen Stimmfilter auf die ausgehenden Agenten-Audios an.

Überblick

Die Audio-Umgebung steuert, wie die ausgehende Audioausgabe des Agenten für den Anrufer klingt. Es gibt zwei Einstellungen:

  • Hintergrundgeräusch spielt einen sich wiederholenden Ambient-Sound unter der Sprache des Agenten ab.
  • Stimmfilter wendet vor dieser Mischung einen Telefonfilter auf die Stimme des Agenten an.

Der Anrufer hört das Ergebnis. Der Agent hört das Hintergrundgeräusch nicht und es wird nicht an die Spracherkennung gesendet.

Dies ist getrennt von Tool-Aufruf-Sounds, die nur während der Ausführung eines Tools abgespielt werden.

Hintergrundgeräusch

Hintergrundgeräusche mischen während des gesamten Gesprächs ein integriertes Preset unter die Sprache des Agenten. Der Sound läuft weiter, wenn der Nutzer unterbricht; er stoppt nicht mit dem Zug des Agenten.

Presets umfassen Büro, Restaurant, Stadt, Tippen und Aufzugsmusik. Im Dashboard können Sie ein Preset vor dem Speichern anhören.

Konfigurieren Sie Hintergrundgeräusche mit conversation_config.conversation.background_sound.

Konfiguration

1

Audio-Umgebung öffnen

Öffnen Sie Ihren Agenten. Klicken Sie auf der Agentenseite neben Stimmen auf die Schaltfläche Audio-Umgebung.

2

Hintergrundgeräusch aktivieren

Aktivieren Sie Hintergrundgeräusch aktivieren. Wählen Sie unter Hintergrundgeräusch ein Preset aus. Verwenden Sie das Wiedergabesteuerelement neben dem Dropdown-Menü, um es anzuhören.

3

Lautstärke und Wiederholung festlegen

Legen Sie die Lautstärke fest. Lassen Sie Crossfade-Schleife aktiviert, damit beim Wiederholen kein hörbares Klicken entsteht. Speichern Sie Ihre Änderungen.

Bei sehr schlechten WebSocket-Verbindungen kann das Mischen von Hintergrundgeräuschen zu abgehacktem Audio führen.

Parameter

Gültige source_id-Werte sind office1, office2, restaurant, city, typing und elevator1 bis elevator4.

FeldTypStandardBeschreibung
source_typestringnicht festgelegtMuss preset sein, wenn ein Sound aktiviert ist. Zusammen mit source_id festlegen.
source_idstringnicht festgelegtKennung für ein integriertes Preset.
volumenumber0.15Pegel relativ zur Sprache des Agenten. Bereich 0.01–1.0.
crossfade_loopbooleantrueÜberblendet am Schleifenübergang, damit der Sound beim Wiederholen nicht klickt.

Stimmfilter

Der Stimmfilter verändert die generierte Stimme des Agenten. Er entzerrt oder entrauscht das Hintergrundgeräusch nicht. Der Filter wird zuerst angewendet; das Hintergrundgeräusch wird unter die gefilterte Sprache gemischt.

Der Stimmfilter ist nur im Dashboard verfügbar. Er ist nicht Teil der öffentlichen Agenten-API oder des CLI-Schemas und möglicherweise nicht in allen Workspaces verfügbar.

Legen Sie im selben Bereich Audio-Umgebung den Stimmfilter auf Aus oder ein Telefon-Preset fest und speichern Sie dann.

Einschränkungen

  • Nur integrierte Presets. Sie können keine benutzerdefinierte Datei hochladen oder auf eine beliebige URL verweisen.
  • Die Steuerelemente der Audio-Umgebung sind ausgeblendet, wenn der Agent nur Text unterstützt.
  • Hintergrundgeräusche werden nicht in Sprachantworten über WhatsApp gemischt. WhatsApp-Anrufe enthalten sie weiterhin.
  • Hintergrundgeräusche können nicht pro Gespräch über clientseitige Überschreibungen festgelegt werden; conversation_config_override enthält kein background_sound. Sie können es weiterhin in einem Workflow-Knoten ändern.

Ähnliche Themen