Musik

  • Music-Finetunes-API: API-Unterstützung zur Verwaltung von Music Finetunes hinzugefügt. Fünf Endpunkte ermöglichen das Erstellen eines Finetunes aus hochgeladenem Audio, das Auflisten zugänglicher Finetunes, das Abrufen des Trainingsstatus, das Aktualisieren von Metadaten und Sichtbarkeit sowie das Löschen eines Finetunes. Alle SDK-Methoden zur Musikgenerierung stellen jetzt finetune_id bereit.

ElevenAgents

  • Externe Gesprächsreferenzen auflösen: GET /v1/convai/conversations/resolve hinzugefügt, um eine Slack-Nachrichten-URL oder Zendesk-Ticket-URL in ein Gespräch aufzulösen. Anfragen erfordern die String-Abfrageparameter agent_id und reference.
  • Wissensdatenbanken von Agenten abfragen: POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query für schreibgeschützte RAG-Abfragen in der Wissensdatenbank eines Agenten hinzugefügt. Die Anfrage erfordert query (String), akzeptiert optional branch_id (String) und gibt sortierte Chunks mit Metadaten zu Dokument, Chunk, Text und Vektordistanz zurück. Dieser Endpunkt ist von generierten SDKs ausgeschlossen.
  • Inhaltsformate der Wissensdatenbank: Antworten für Dateien, Text und URLs der Wissensdatenbank ergänzen optional content_format (html | markdown, standardmäßig html).
  • Agenten-Sprachkonfiguration: TTS-Überschreibungsschemas ergänzen optionales, clientseitig überschreibbares model_id (TTSConversationalModel). Der Standard für enable_phoneme_tags ändert sich von false zu true.
  • Schnellere Backup-LLM-Kaskade: Der Standardwert für cascade_timeout_seconds ändert sich von 8 auf 4 Sekunden. Der zulässige Bereich bleibt 2–15 Sekunden.
  • Quellen für Tool-Parameterwerte: Objekt-Tool-Parameter können jetzt dynamic_variable, constant_value oder is_omitted verwenden, entsprechend den bestehenden Steuerelementen für Skalare und Arrays. Überschreibungen für konstante Schemas akzeptieren jetzt beliebige Arrays und Objekte.
  • Guardrails für vollständige Antworten: Benutzerdefinierte Guardrails ergänzen optional evaluate_full_response_only (Boolean, standardmäßig false), um die vollständige Nicht-TTS-Antwort einmal auszuwerten. Diese Option erfordert den Blockierungsmodus.
  • Twilio-Anrufaufzeichnung: Die Telefonie-Anrufkonfiguration ergänzt optional twilio_call_recording_enabled (Boolean, standardmäßig false). Aufzeichnungen werden im verbundenen Twilio-Konto gespeichert, und andere Anbieter ignorieren diese Einstellung.
  • Widget-Texte für Datei-Uploads: Die Widget-Textkonfiguration ergänzt optionale Labels und Fehlermeldungen zum Anhängen und Entfernen von Dateien, Upload-Fehlern, nicht unterstützten Typen, zu großen Dateien, Dateianzahllimits und der Eingabeanzeige.
  • Synchronisierungsstatus der Wissensdatenbank: Antworten für Dateien der Wissensdatenbank ergänzen optional auto_sync_info und refresh_status (FileRefreshStatus). Ordnerantworten ergänzen das erforderliche document_count (Integer), eine rekursive Anzahl von Nicht-Ordner-Dokumenten mit einem Maximum von 1000.
  • Filter für Textsuche in Gesprächen: Gesprächsnachrichten per Text durchsuchen ergänzt die optionalen Array-Abfrageparameter exclude_statuses und termination_reasons.
  • LLM-Optionen: Die LLM-Konfiguration von Agenten ergänzt gpt-5.6-sol, gpt-5.6-terra und gpt-5.6-luna. LLMReasoningEffort ergänzt max.
  • WhatsApp-Eingabeanzeigen: Anfrage- und Antwortschemas für WhatsApp-Konten ergänzen optional enable_typing_indicator (Boolean).

Speech to Text

  • Einmalige Batch-Authentifizierung: Sprache in Text umwandeln ergänzt optional token (String) als Alternative zur API-Key- oder Bearer-Authentifizierung. Erstellen Sie das Einmal-Token mit POST /v1/single-use-token/batch_scribe; es läuft nach 15 Minuten ab.
  • Zuverlässigkeit des Realtime-Clients: @elevenlabs/client meldet jetzt Fehler bei der Mikrofoneinrichtung und fehlerhafte Serverfehler über RealtimeEvents.ERROR, gibt Mikrofonressourcen nach Einrichtungsfehlern und beim Schließen der Verbindung frei und verwirft verspätete Mikrofon-Frames nach dem Abbau des Sockets.

Text to Speech

Arbeitsbereiche

  • Webhook-Ereignisabonnements: Anfragen für Arbeitsbereichs-Webhook aktualisieren ergänzen optional events (WorkspaceWebhookEventType[]) mit voice_library_removal_notice, speech_to_text und agent_qa. Webhook-Antworten können die Liste abonnierter Ereignisse zurückgeben.
  • Dimensionen der Nutzungsanalyse: Arbeitsbereichsnutzung abrufen ergänzt surface und actor zu den group_by-Werten.
  • Servicekonto-Limits entfernen: API-Key für Servicekonto aktualisieren akzeptiert character_limit: "clear", um ein monatliches Zeichenlimit zu entfernen, neben "no_update" und Integer-Werten.
  • Referenzen für Alerting-Webhooks: Schemas für Alerting-Webhook-Benachrichtiger identifizieren einen Arbeitsbereichs-Webhook jetzt mit dem erforderlichen webhook_id (String), statt url, method und headers einzubetten.

SDK-Releases

JavaScript SDK

  • v2.59.0 - music.finetunes-Methoden zum Auflisten, Erstellen, Abrufen, Aktualisieren und Löschen von Music Finetunes hinzugefügt. Außerdem Auflösung von Gesprächsreferenzen, Filterung archivierter Aussprachewörterbücher und Einmal-Tokens für Speech to Text hinzugefügt.

Python SDK

  • v2.59.0 - Music Finetunes und Auflösung von Gesprächsreferenzen aus dem neuesten API-Schema hinzugefügt. OnPremInitiationData ergänzt außerdem typisierte Konfigurationen für post_call_transcription_webhook und post_call_audio_webhook mit optionalem hmac_secret für signierte Webhooks nach Anrufen.

Pakete

Android SDK

  • v0.11.1 - Verhindert, dass R8 und ProGuard ausgehende WebSocket- und WebRTC-Ereignisfelder wie text und type verschleiern.

CLI

  • @elevenlabs/cli@0.5.6 - Standard-Agentenvorlagen aktualisiert, um scribe_realtime statt des entfernten ASR-Anbieters elevenlabs zu verwenden. Minimale Vorlagen verwenden weiterhin den Serverstandard.

API

Neue Endpunkte

Musik

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • Erfordert die String-Abfrageparameter agent_id und reference
    • Gibt GetConversationResponseModel zurück
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Erfordert query (String) im Anfragetext
    • Akzeptiert optionalen Abfrageparameter branch_id (String)
    • Gibt AgentKnowledgeBaseRagQueryResponseModel zurück
    • Von generierten SDKs ausgeschlossen

Aktualisierte Endpunkte

ElevenAgents

Speech to Text

  • Sprache in Text umwandeln - POST /v1/speech-to-text
    • Optionalen Abfrageparameter token (String) für ein einmaliges Batch-Scribe-Token hinzugefügt

Text to Speech

Arbeitsbereiche

Schemaänderungen

ElevenAgents

  • Antwortschemas für ElevenAgents-Wissensdatenbanken ergänzen optional content_format (html | markdown, standardmäßig html)
  • Antwortschemas für Dateien der Wissensdatenbank ergänzen optional auto_sync_info und refresh_status (FileRefreshStatus)
  • Antwortschemas für Ordner der Wissensdatenbank ergänzen erforderliches document_count (Integer)
  • Agenten-TTS-Überschreibungsschemas ergänzen optional model_id (TTSConversationalModel)
  • Agenten-TTS enable_phoneme_tags ist jetzt standardmäßig true statt false
  • Backup-LLM cascade_timeout_seconds ist jetzt standardmäßig 4 statt 8 Sekunden
  • LLM-Konfiguration von Agenten ergänzt gpt-5.6-sol, gpt-5.6-terra und gpt-5.6-luna; LLMReasoningEffort ergänzt max
  • Benutzerdefinierte Guardrails ergänzen optional evaluate_full_response_only (Boolean, standardmäßig false)
  • Telefonie-Anrufkonfiguration ergänzt optional twilio_call_recording_enabled (Boolean, standardmäßig false)
  • Objekt-Tool-Parameter ergänzen dynamic_variable, constant_value und is_omitted; konstante Überschreibungen akzeptieren beliebige Array- und Objektwerte
  • Widget-Textkonfiguration ergänzt optionale Labels für Datei-Uploads und Eingabeanzeigen
  • WhatsApp-Kontoschemas ergänzen optional enable_typing_indicator (Boolean)
  • Simulations- und Testschemas ergänzen AutoGenerationMetadata und SimulationLibrarySettings

Musik

  • Anfrage-, Antwort-, Paginierungs-, Sichtbarkeits-, Ersteller-, Status- und Fehlergrundschemas für Music Finetune hinzugefügt
  • Alle Anfrageschemas für Musikgenerierung stellen finetune_id für generierte SDKs bereit

Arbeitsbereiche

  • Anfrage- und Antwortschemas für Arbeitsbereichs-Webhooks ergänzen optional events (WorkspaceWebhookEventType[])
  • Schemas für Alerting-Webhook-Benachrichtiger verwenden erforderliches webhook_id (String) statt url, method und headers