Stimmen

  • Neuer PVC-Ablauf: Neuen Ablauf zum Erstellen von Professional Voice Clones hinzugefügt. Testen Sie ihn hier.

Agents Platform

  • Agent-zu-Agent-Übergabe: Unterstützung für Agent-zu-Agent-Übergaben über ein neues System-Tool hinzugefügt. Das ermöglicht komplexere Gesprächsabläufe. Details finden Sie in der Dokumentation zum Agent-Transfer-Tool.
  • Verbessertes Tool-Debugging: Die Anzeige von Details zur Tool-Ausführung im Gesprächsverlauf für einfacheres Debugging verbessert.
  • Korrektur der Spracherkennung: Ein Problem mit dem erzwungenen Aufruf des Tools zur Spracherkennung behoben.

Synchronisation

  • Render-Endpunkt: Einen neuen Endpunkt eingeführt, um Audio- oder Video-Renderings für bestimmte Sprachen innerhalb eines Synchronisationsprojekts neu zu generieren. Fehlende Transkriptionen oder Übersetzungen werden automatisch verarbeitet. Siehe den Render-Dub-Endpunkt.
  • Erhöhtes Größenlimit: Die maximal zulässige Dateigröße für Synchronisationsprojekte auf 1 GiB erhöht.

API

Neue Endpunkte

Aktualisierte Endpunkte

Aussprachewörterbücher

Speech to Text

  • Speech-to-Text-Endpunkt aktualisiert (POST /v1/speech-to-text):
    • Parameter cloud_storage_url hinzugefügt, um die Transkription direkt über öffentliche S3- oder GCS-URLs zu ermöglichen (bis zu 2 GB).
    • Der Parameter file ist nun optional; es muss genau einer von file oder cloud_storage_url angegeben werden.

Speech to Speech

Agents Platform

Stimmen

  • Das Feld samples von GET /v1/voices/{voice_id} aktualisiert, um die optionalen Parameter trim_start und trim_end einzuschließen.

Audio Native