音楽

  • Music Finetunes API:Music Finetunesを管理するためのAPIサポートを追加しました。5つのエンドポイントで、アップロードしたオーディオからのFinetune作成、アクセス可能なFinetuneの一覧表示、トレーニングステータスの取得、メタデータと公開設定の更新、Finetuneの削除ができます。すべての音楽生成SDKメソッドでfinetune_idを公開するようになりました。

ElevenAgents

  • 外部会話参照の解決:SlackメッセージURLまたはZendeskチケットURLから会話を解決するGET /v1/convai/conversations/resolveを追加しました。リクエストにはagent_idとreferenceのクエリパラメーター(文字列)が必要です。
  • エージェントのナレッジベースをクエリ:エージェントのナレッジベースに対する読み取り専用RAGクエリ用のPOST /v1/convai/agents/{agent_id}/knowledge-base/rag-queryを追加しました。リクエストにはquery(文字列)が必要で、任意のbranch_id(文字列)を受け付け、ドキュメント、チャンク、テキスト、ベクトル距離のメタデータを含むランク付けされたチャンクを返します。このエンドポイントは生成SDKから除外されます。
  • ナレッジベースのコンテンツ形式:ナレッジベースのファイル、テキスト、URLレスポンスに、任意のcontent_format(html | markdown、デフォルトはhtml)を追加しました。
  • エージェント音声設定:TTSオーバーライドスキーマに、クライアントでオーバーライド可能な任意のmodel_id(TTSConversationalModel)を追加しました。enable_phoneme_tagsのデフォルトはfalseからtrueに変更されます。
  • 高速化されたバックアップLLMカスケード:cascade_timeout_secondsのデフォルトを8秒から4秒に変更しました。許容範囲は2~15秒のままです。
  • ツールパラメーター値のソース:オブジェクトツールパラメーターで、既存のスカラーおよび配列コントロールに合わせてdynamic_variable、constant_value、is_omittedを使用できるようになりました。定数スキーマオーバーライドは任意の配列およびオブジェクトを受け付けるようになりました。
  • 完全レスポンスのガードレール:カスタムガードレールに、完全な非TTSレスポンスを一度だけ評価する任意のevaluate_full_response_only(boolean、デフォルトはfalse)を追加しました。このオプションにはブロッキングモードが必要です。
  • Twilio通話録音:テレフォニー通話設定に、任意のtwilio_call_recording_enabled(boolean、デフォルトはfalse)を追加しました。録音は接続されたTwilioアカウントに保存され、他のプロバイダーではこの設定は無視されます。
  • ウィジェットのファイルアップロードテキスト:ウィジェットテキスト設定に、ファイルの添付・削除、アップロード失敗、非対応タイプ、ファイルサイズ超過、ファイル数上限、入力中インジケーター用の任意のラベルとエラーメッセージを追加しました。
  • ナレッジベース同期ステータス:ナレッジベースのファイルレスポンスに、任意のauto_sync_infoおよびrefresh_status(FileRefreshStatus)を追加しました。フォルダーレスポンスに、フォルダー以外のドキュメントを再帰的にカウントし、上限を1000とする必須のdocument_count(integer)を追加しました。
  • 会話テキスト検索フィルター:会話メッセージをテキスト検索に、任意のexclude_statusesおよびtermination_reasons配列クエリパラメーターを追加しました。
  • LLMオプション:エージェントLLM設定にgpt-5.6-sol、gpt-5.6-terra、gpt-5.6-lunaを追加しました。LLMReasoningEffortにmaxを追加しました。
  • WhatsApp入力中インジケーター:WhatsAppアカウントのリクエストおよびレスポンススキーマに、任意のenable_typing_indicator(boolean)を追加しました。

スピーチtoテキスト

  • 単回使用バッチ認証:音声をテキストに変換に、APIキーまたはBearer認証の代替として任意のtoken(文字列)を追加しました。単回使用トークンはPOST /v1/single-use-token/batch_scribeで作成でき、15分後に期限切れになります。
  • リアルタイムクライアントの信頼性:@elevenlabs/clientが、マイク設定エラーおよび不正なサーバーエラーをRealtimeEvents.ERRORで報告し、設定失敗および接続終了後にマイクのリソースを解放し、ソケット終了後に遅延したマイクフレームを破棄するようになりました。

テキスト読み上げ

  • アーカイブ済み発音辞書:発音辞書一覧に、任意のinclude_archived(boolean、デフォルトはtrue)を追加しました。

ワークスペース

  • Webhookイベントサブスクリプション:ワークスペースWebhookを更新のリクエストに、voice_library_removal_notice、speech_to_text、agent_qaを含む任意のevents(WorkspaceWebhookEventType[])を追加しました。Webhookレスポンスで購読イベント一覧を返せるようになりました。
  • 使用状況分析のディメンション:ワークスペース使用状況を取得のgroup_by値にsurfaceおよびactorを追加しました。
  • サービスアカウント上限のクリア:サービスアカウントAPIキーを更新で、"no_update"および整数値に加えて、月間文字数上限を削除するcharacter_limit: "clear"を受け付けるようになりました。
  • アラートWebhook参照:アラートWebhook通知スキーマで、url、method、headersを埋め込む代わりに、必須のwebhook_id(文字列)でワークスペースWebhookを識別するようになりました。

SDKリリース

JavaScript SDK

  • v2.59.0 - Music Finetunesの一覧表示、作成、取得、更新、削除を行うmusic.finetunesメソッドを追加しました。会話参照の解決、アーカイブ済み発音辞書のフィルタリング、単回使用のスピーチtoテキストトークンも追加しました。

Python SDK

  • v2.59.0 - 最新のAPIスキーマからMusic Finetunesおよび会話参照の解決を追加しました。OnPremInitiationDataには、署名付き通話後Webhook用の任意のhmac_secretを持つ、型付きのpost_call_transcription_webhookおよびpost_call_audio_webhook設定も追加されています。

パッケージ

Android SDK

  • v0.11.1 - textやtypeなどの送信WebSocketおよびWebRTCイベントフィールドがR8とProGuardによって難読化されないようにしました。

CLI

  • @elevenlabs/cli@0.5.6 - デフォルトのエージェントテンプレートを、削除されたelevenlabs ASRプロバイダーではなくscribe_realtimeを使用するよう更新しました。最小テンプレートは引き続きサーバーのデフォルトを使用します。

API

新しいエンドポイント

音楽

  • Music Finetunes一覧 - GET /v1/music/finetunes
    • カーソルページネーション、公開設定および作成者フィルター、作成日時または名前での並べ替えをサポート
  • Music Finetuneを作成 - POST /v1/music/finetunes
    • nameおよびprimary_genreが必要
    • 最大50個のオーディオファイル、タグ、公開設定、model_idを受け付け
  • Music Finetuneを取得 - GET /v1/music/finetunes/{finetune_id}
  • Music Finetuneを更新 - PATCH /v1/music/finetunes/{finetune_id}
    • name、tags、primary_genre、visibilityを更新
  • Music Finetuneを削除 - DELETE /v1/music/finetunes/{finetune_id}

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • agent_id(文字列)およびreference(文字列)クエリパラメーターが必要
    • GetConversationResponseModelを返す
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • リクエストボディにquery(文字列)が必要
    • 任意のbranch_id(文字列)クエリパラメーターを受け付け
    • AgentKnowledgeBaseRagQueryResponseModelを返す
    • 生成SDKから除外

更新されたエンドポイント

ElevenAgents

スピーチtoテキスト

  • 音声をテキストに変換 - POST /v1/speech-to-text
    • 単回使用バッチScribeトークン用に任意のtoken(文字列)クエリパラメーターを追加

テキスト読み上げ

  • 発音辞書一覧 - GET /v1/pronunciation-dictionaries
    • 任意のinclude_archived(boolean、デフォルトはtrue)クエリパラメーターを追加

ワークスペース

スキーマの変更

ElevenAgents

  • ElevenAgentsナレッジベースレスポンススキーマに、任意のcontent_format(html | markdown、デフォルトはhtml)を追加
  • ナレッジベースのファイルレスポンスに、任意のauto_sync_infoおよびrefresh_status(FileRefreshStatus)を追加
  • ナレッジベースのフォルダーレスポンスに、必須のdocument_count(integer)を追加
  • エージェントTTSオーバーライドスキーマに、任意のmodel_id(TTSConversationalModel)を追加
  • エージェントTTSのenable_phoneme_tagsのデフォルトをfalseではなくtrueに変更
  • バックアップLLMのcascade_timeout_secondsのデフォルトを8秒ではなく4秒に変更
  • エージェントLLM設定にgpt-5.6-sol、gpt-5.6-terra、gpt-5.6-lunaを追加。LLMReasoningEffortにmaxを追加
  • カスタムガードレールに、任意のevaluate_full_response_only(boolean、デフォルトはfalse)を追加
  • テレフォニー通話設定に、任意のtwilio_call_recording_enabled(boolean、デフォルトはfalse)を追加
  • オブジェクトツールパラメーターにdynamic_variable、constant_value、is_omittedを追加。定数オーバーライドで任意の配列およびオブジェクト値を受け付け
  • ウィジェットテキスト設定に、任意のファイルアップロードおよび入力中インジケーターラベルを追加
  • WhatsAppアカウントスキーマに、任意のenable_typing_indicator(boolean)を追加
  • シミュレーションおよびテストスキーマにAutoGenerationMetadataおよびSimulationLibrarySettingsを追加

音楽

  • Music Finetuneのリクエスト、レスポンス、ページネーション、公開設定、作成者、ステータス、失敗理由のスキーマを追加
  • すべてのMusic生成リクエストスキーマで、生成SDK向けにfinetune_idを公開

ワークスペース

  • ワークスペースWebhookのリクエストおよびレスポンススキーマに、任意のevents(WorkspaceWebhookEventType[])を追加
  • アラートWebhook通知スキーマで、url、method、headersの代わりに必須のwebhook_id(文字列)を使用