ElevenAgents

  • 並列ツール呼び出し:エージェントのプロンプト設定にenable_parallel_tool_calls(ブール値、デフォルトtrue)が含まれるようになりました。有効にすると、対応モデルは1ターンで複数のツールを実行できます。
  • エージェントモデル:エージェントLLMの選択肢にgpt-6-astraを追加しました。
  • アラート:エージェントのアラート機能で、PagerDutyおよびwebhook通知に加えてSlackチャンネルをサポートするようになりました。
  • 電話番号検索:プロバイダー、発信サポート、割り当て済みエージェントとブランチ、ラベル、電話番号でフィルタリングできる、カーソルページネーション対応の電話番号エンドポイントを追加しました。

画像とビデオ

  • GPT Image 2.5モデル:画像生成でgpt-image-2.5-flareとgpt-image-2.5-sunburstをサポートするようになりました。どちらのモデルも最大10枚の参照画像、maxまでの品質レベル、autoを含む14種類の固定アスペクト比、1K、2K、4K出力に対応します。

Speech Engine

  • カスケードタイムアウト:Speech Engineの作成・更新リクエストでcascade_timeout_seconds(数値、2~15、デフォルト4)を受け付けるようになりました。これにより、再試行前にElevenLabsがアップストリームSpeech Engineを待機する時間を制御できます。

テキスト読み上げ

  • マルチコンテキストのターン境界:is_final_audio_for_turnマーカーが、そのターンのバッファリングされたすべてのバイトの後に、MP3およびOpus出力を含めて送信されるようになりました。クライアントはPCMに切り替えることなく、このマーカーを正確なターン境界として使用できます。

SDKリリース

JavaScript SDK

  • v2.69.0 - リアルタイムのスピーチtoテキストラッパーにtranscriptEditを追加し、編集済みテキストがedited_transcriptイベントで配信されるようになりました。データレジデンシーサフィックスを持つAPIキーのSpeech Engine JWT検証を修正しました。テンプレートの一覧取得・取得、実行の一覧取得・作成・取得を行うphoneNumbers.listV2およびFlowsテンプレートメソッドを追加しました。GPT Image 2.5、Slackエージェントアラート、並列ツール呼び出し、gpt-6-astra、サービスアカウントAPIキーの同時実行数制限、Musicゼロ保持、会話フィルター、MCPツール承認ステータス向けのクライアントと型を再生成しました。

Python SDK

  • v2.69.0 - リアルタイムのスピーチtoテキストラッパーにtranscript_editを追加し、編集済みテキストがedited_transcriptイベントで配信されるようになりました。データレジデンシーサフィックスを持つAPIキーのSpeech Engine JWT検証を修正し、ffplayが失敗した場合にplayがエラーを発生させるようにしました。テンプレートの一覧取得・取得、実行の一覧取得・作成・取得を行うphone_numbers.list_v2およびFlowsテンプレートメソッドを追加しました。GPT Image 2.5、Slackエージェントアラート、並列ツール呼び出し、gpt-6-astra、サービスアカウントAPIキーの同時実行数制限、Musicゼロ保持、会話フィルター、MCPツール承認ステータス向けのクライアントと型を再生成しました。

ElevenLabs CLI

  • v1.3.2 - CLIの利用に関するフィードバックを収集するため、オプションの--intentメタデータを追加しました。CLIがサポートしていないワークフローを報告するためのelevenlabs feedback missing-capabilityを追加しました。

API

新しいエンドポイント

ElevenAgents

  • 電話番号ページを一覧表示 - GET /v1/convai/v2/phone-numbers
    • オプションのpage_size(整数、1~1,000、デフォルト100)およびcursor(null許容文字列)ページネーションパラメータを追加しました。
    • オプションのsearch、label、phone_number、provider、supports_outbound、agent_id、branch_id、sort_by、sort_directionフィルターを追加しました。sort_byはlabelまたはphone_numberを受け付けます。sort_directionのデフォルトはascです。
    • レスポンスには必須のphone_numbers(配列)、オプションでnull許容のnext_cursor(文字列)、has_more(ブール値、デフォルトfalse)が含まれます。

更新されたエンドポイント

ElevenAgents

  • エージェントを作成、エージェントを取得、エージェントを更新
    • プロンプト設定にenable_parallel_tool_calls(ブール値、デフォルトtrue)を追加しました。ワークフローのオーバーライドはnull許容のブール値を受け付けます。
    • LLM列挙型に、会話開始時のオーバーライドを含むgpt-6-astraを追加しました。
    • アラートインテグレーションの通知先で、integration_typeを使用してpagerdutyまたはslackを選択するようになりました。Slack通知先にはconnection_idとchannel_id(文字列)が必須です。channel_idは1~64文字を受け付けます。
  • 会話を一覧表示と会話参照を解決
    • data_collection_paramsではmissing演算子を受け付けなくなりました。フィールドが収集されなかった会話に一致させるには、空の値を使用してください。
    • dynamic_variable_paramsの空の値は、変数が設定されていない会話に一致します。
  • Speech Engineを作成、Speech Engineを取得、Speech Engineを更新
    • cascade_timeout_seconds(数値、2~15)を追加しました。作成リクエストのデフォルトは4で、更新リクエストではnull許容の値を受け付け、レスポンスではこのフィールドが必須です。

画像とビデオ

  • 画像生成を作成 - POST /v1/flows/image
    • gpt-image-2.5-flareおよびgpt-image-2.5-sunburst向けのリクエストバリアントを追加しました。
    • どちらのバリアントもpromptとmodel_idが必須で、最大10件のimagesを受け付け、resolution(1K、2K、4K、デフォルト1K)を追加します。
    • qualityはlow、medium、high、xhigh、maxを受け付け、デフォルトはhighです。aspect_ratioはautoと14種類の固定比率を受け付け、デフォルトは16:9です。

吹き替え

ナレッジベース

  • クロールジョブを作成 - POST /v1/convai/knowledge-base/crawl
    • max_depth(整数、デフォルト3)を非推奨にしました。このフィールドは現在何も実行せず、最小値・最大値の制約もなくなりました。
    • クロールジョブのメタデータでmax_depthが必須ではなくなりました。

ユーザー

スキーマの変更

テキスト読み上げ

  • マルチコンテキストWebSocketのaudioおよびfinalメッセージでは、ターンのバッファリングされたすべてのバイトが配信された後にis_final_audio_for_turnが発生するよう定義されました。