Scribe v2

Wir haben Scribe v2 veröffentlicht, das neue Transkriptionsmodell auf dem neuesten Stand der Technik. Erfahren Sie mehr über Scribe v2 in der Dokumentation.

Agents Platform

  • Zeitzonenunterstützung für die Planung von Batch-Anrufen: Sie können jetzt eine Zeitzone auswählen, wenn Sie Batch-Anrufe planen. Die geplante Zeit wird basierend auf Ihrer gewählten Zeitzone in UTC umgerechnet. Standardmäßig wird automatisch die Zeitzone Ihres Browsers ausgewählt. Eine Validierung verhindert, dass Anrufe für Zeitpunkte geplant werden, die in der ausgewählten Zeitzone bereits vergangen sind. So können Sie ausgehende Anrufe einfacher zur richtigen Zeit in den Zeitzonen Ihrer Empfänger planen.
  • URL der Knowledge-Base-Quelldatei: Ein neuer Endpunkt zum Abrufen der ursprünglichen Quelldatei-URL für Knowledge-Base-Dokumente wurde hinzugefügt und ermöglicht direkten Zugriff auf hochgeladene Dateien.
  • Timeout für LLM-Fallback-Kaskaden: Die Konfigurationsoption cascade_timeout_seconds wurde für Backup-LLM-Konfigurationen von Agents hinzugefügt. Damit lässt sich steuern, wie lange gewartet wird, bevor zum nächsten LLM gewechselt wird. Der Standardwert beträgt 8 Sekunden, der erlaubte Bereich liegt bei 2–15 Sekunden.
  • LLM-generierte Nachrichten bei Soft-Timeout: Die Option use_llm_generated_message wurde zur Soft-Timeout-Konfiguration hinzugefügt. Wenn sie aktiviert ist, generiert der Agent mit dem LLM eine kontextbezogene Nachricht, statt bei Auslösung des Soft-Timeouts eine vordefinierte Nachricht zu verwenden.
  • Ordnernavigation in der Knowledge Base: Antworten für Knowledge-Base-Dokumente enthalten jetzt das Feld folder_path, das die Pfadsegmente vom Stammverzeichnis zum übergeordneten Ordner zeigt. Dadurch lässt sich die Dokumenthierarchie leichter nachvollziehen.
  • Gesprächsfilterung nach Initiierungsquelle: Der Endpunkt zum Abrufen von Gesprächen unterstützt jetzt die Filterung über den Abfrageparameter conversation_initiation_source.

Synchronisation

  • Neuer Endpunkt für Transkriptformate: Der Endpunkt GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type} wurde hinzugefügt und unterstützt die Ausgabeformate srt, webvtt und json. Der bisherige Endpunkt GET /v1/dubbing/{dubbing_id}/transcript/{language_code} ist jetzt veraltet.
  • Erforderlicher Dateiname für synchronisierte Dateien: Knowledge-Base-Dateimodelle erfordern jetzt ein Feld filename.

Speech to Text

  • Entitätserkennung: Die Option entity_detection wurde zu Speech-to-Text-Anfragen hinzugefügt. Sie akzeptiert 'all', Strings für spezifische Entitätstypen oder ein Array von Entitätstypen. Erkannte Entitäten werden in einem neuen Antwortfeld entities mithilfe des Schemas DetectedEntity zurückgegeben.
  • Keyterm-Prompting: Der Array-Parameter keyterms wurde zu Speech-to-Text-Anfragen hinzugefügt, um die Transkription auf bestimmte Begriffe oder Phrasen auszurichten.

SDK-Releases

Python SDK

  • v2.29.0 – Entitätserkennung und Keyterm-Prompting für Speech to Text, LLM-Kaskaden-Timeout-Konfiguration, LLM-Nachrichtengenerierung bei Soft-Timeout und Zeitzonenunterstützung für Batch-Anrufe hinzugefügt
  • v2.28.0 – Felder zur Agent-Versionierung, Stimmensammlungs-IDs, Verbesserungen für Batch-Anrufe und Telefonnummernlabels hinzugefügt

JavaScript SDK

  • v2.30.0 – Entitätserkennung und Keyterm-Prompting für Speech to Text, LLM-Kaskaden-Timeout-Konfiguration, LLM-Nachrichtengenerierung bei Soft-Timeout und Zeitzonenunterstützung für Batch-Anrufe hinzugefügt
  • v2.29.0 – Felder zur Agent-Versionierung, Stimmensammlungs-IDs, Verbesserungen für Batch-Anrufe und Telefonnummernlabels hinzugefügt

MCP-Server

  • v0.9.1 – Unterstützung für Gemini-Erweiterungen hinzugefügt, Pfadverarbeitung für nicht absolute output_directory und fehlendes base_path korrigiert

API

Neue Endpunkte

Veraltete Endpunkte

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code} – Verwenden Sie stattdessen den neuen formatspezifischen Endpunkt

Aktualisierte Endpunkte

Agents Platform

Knowledge Base

  • Knowledge-Base-Dokumente auflisten
    • Den veralteten Abfrageparameter use_typesense entfernt
    • folder_path (Array aus Pfadsegmenten) zu Dokument-Antwortmodellen hinzugefügt
    • filename (String, erforderlich) zu Knowledge-Base-Dateimodellen hinzugefügt

Speech to Text

  • Sprache transkribieren
    • keyterms (Array aus Strings, optional) hinzugefügt, um die Transkription auf bestimmte Begriffe auszurichten
    • entity_detection (String, Array oder 'all', optional) zur Erkennung von Entitäten im transkribierten Text hinzugefügt
    • entities (Array aus DetectedEntity, optional) zum Antwortmodell hinzugefügt

Synchronisation

  • Synchronisationsprojekt erstellen
    • Die Beschreibung von mode aktualisiert, um darauf hinzuweisen, dass der Modus manual experimentell ist und nicht für den Produktionseinsatz empfohlen wird