音楽

  • 詳細付き音楽ストリーミング:作曲したオーディオと詳細なメタデータをSSEストリーミングするためのStream music with details(POST /v1/music/detailed/stream)を追加しました。構成プラン、楽曲メタデータ、base64オーディオチャンク、with_timestampsによる任意の単語タイムスタンプが含まれます。

ElevenAgents

  • 会話シミュレーションの非推奨化:Simulate conversationとStream simulate conversationは非推奨となりました。代わりにCreate testとRun tests on the agentを使用してください。
  • ツール割り込みモード:disable_interruptionsは、エージェントツールおよびMCPサーバースキーマ全体で非推奨となりました。代わりにinterruption_mode(ToolInterruptionMode:allow、disable_during_tool、disable_during_tool_and_turn)を使用してください。ツールオーバーライドモデルのinterruption_modeにより、ツールごとにオーバーライドできます。
  • 数値評価スコアリング:評価基準スキーマに任意のscoring_mode(binary|numeric_uniform)、任意のmax_score(整数)、任意のscore_instructions(文字列)を追加しました。評価結果に任意の数値scoreを追加しました。会話分析ペイロードに任意のcall_success_scoreとsuccess_scoreを追加しました。
  • 会話推論:文字起こしおよび履歴モデルに任意のreasoning(ConversationReasoningModel)を追加し、文字起こしレスポンスに任意のreasoned(ブール値)を追加しました。エージェントプロンプトおよびLLMスキーマに任意のenable_reasoning_summary(ブール値)を追加しました。
  • 会話プラットフォーム課金:会話関連モデルに任意のplatform_charge、platform_price、platform_usageを追加しました。PlatformCategoryおよびPlatformCategoryUsageを通じてカテゴリ別の内訳を確認できます。
  • 会話コストメタデータ:会話履歴メタデータに、必須の読み取り専用cost_fiat(数値、USD)を追加しました。
  • 非マスキングWebhookイベント:非マスキングのペイロードが必要なWebhookサブスクリプション向けに、WebhookEventTypeにunredacted_transcriptとunredacted_audioを追加しました。
  • ワークフロー電話転送のUUI上限:SIP REFER転送時のRFC 7433 User-to-User Information用に、UUITransferConfig.dataの最大長を256文字から8192文字に増やしました。

Speech Engine

  • 任意の認証バイパス:JavaScriptおよびPython SDK v2.56.0で、Speech Engine WebSocketクライアントに任意のdisableAuth/disable_authを追加しました。これは、APIキー認証ではなくIP許可リストやカスタム認証ヘッダーなど、別の方法で接続を保護するインテグレーション向けです。

ワークスペース

  • プロフェッショナル音声スロットの追跡:統合請求を見えやすくするため、サブスクリプション形式モデルに、グループ全体のprofessional_voice_slots_usedの明確化と併せて、任意のprofessional_voice_slots_used_in_workspaceを追加しました。

ElevenCreative Studio

  • キャプションスタイリング:キャプションスタイルモデルにぼかしと角丸フィールドを追加しました。開始および終了アニメーション列挙型にslam、scale_down、slide_inを追加しました。

SDKリリース

JavaScript SDK

  • v2.56.0 - Speech Engine WebSocketクライアントに任意のdisableAuthを追加しました。最新のOpenAPIスキーマから再生成し、音楽の詳細ストリーミング、ツールのinterruption_mode、評価スコアリングモード、会話推論、プラットフォーム課金フィールドを含めました。

Python SDK

  • v2.56.0 - Speech Engine WebSocketクライアントに任意のdisable_authを追加しました。最新のOpenAPIスキーマから再生成し、音楽の詳細ストリーミング、ツールのinterruption_mode、評価スコアリングモード、会話推論、プラットフォーム課金フィールドを含めました。

CLI

  • @elevenlabs/cli@0.5.5 - 設定のラウンドトリップ忠実性を維持するため、エージェントの作成・更新リクエストをraw JSONとして送信するようになりました。

API

新しいエンドポイント

音楽

更新されたエンドポイント

ElevenAgents

スキーマの変更

ElevenAgents

  • ツールとMCP
    • disable_interruptionsを非推奨とし、代わりにinterruption_mode(allow、disable_during_tool、disable_during_tool_and_turn)を使用
    • MCPおよびツールオーバーライドモデルに、ツールごとのinterruption_modeオーバーライドを追加
  • 評価と分析
    • 評価基準に任意のscoring_mode、max_score、score_instructionsを追加
    • 評価結果に任意の数値scoreを追加
    • 会話分析ペイロードに任意のcall_success_scoreとsuccess_scoreを追加
  • 文字起こしと推論
    • 文字起こしおよび履歴モデルに任意のreasoning(ConversationReasoningModel)を追加
    • 文字起こしレスポンスに任意のreasoned(ブール値)を追加
    • エージェントプロンプトおよびLLMスキーマに任意のenable_reasoning_summary(ブール値)を追加
  • 課金とメタデータ
    • 会話モデルに任意のplatform_charge、platform_price、platform_usageを追加
    • 会話履歴メタデータに必須の読み取り専用cost_fiat(USD)を追加
  • Webhook
    • WebhookEventTypeにunredacted_transcriptとunredacted_audioを追加
  • ワークフロー
    • UUITransferConfig.dataの最大長を256文字から8192文字に増加

ワークスペース

  • 請求
    • サブスクリプション形式モデルに任意のprofessional_voice_slots_used_in_workspaceを追加

ElevenCreative Studio

  • キャプション
    • キャプションスタイルモデルにぼかしと角丸フィールドを追加
    • slam、scale_down、slide_inアニメーションタイプを追加