Vai alla navigazione

ElevenAgents

  • Mock degli strumenti specifici per test: le simulazioni degli agenti e i test unitari ora possono definire tool_mock_overrides, associati all’ID dello strumento, per sostituire i mock condivisi per un singolo test. ToolResponseMockConfig aggiunge anche is_error facoltativo (booleano, predefinito false) affinché un mock possa testare i percorsi di errore degli strumenti.
  • Messaggi del workflow tradotti: i messaggi letterali del nodo Say aggiungono text_translations, una mappa di chiavi linguistiche a oggetti TranslatedString. Il campo è facoltativo in input e obbligatorio in output, quindi i validatori di risposta rigorosi devono accettarlo.
  • Filtri della versione delle conversazioni: Elenca conversazioni e Ricerca testuale nei messaggi delle conversazioni aggiungono il parametro query facoltativo version_id (stringa) per filtrare i risultati in base alla versione dell’agente.
  • Strumento di sistema della knowledge base: la configurazione dell’agente aggiunge uno strumento di sistema knowledge_base con enabled_strategies configurabile (SearchStrategy[]). Le query RAG della knowledge base dell’agente aggiungono use_agent_defaults facoltativo (booleano, predefinito true); impostalo su false per usare impostazioni di recupero neutre mantenendo il modello di embedding dell’agente.
  • Rilevamento dell’attività vocale dell’agente: gli schemi di creazione, aggiornamento, risposta e override del workflow dell’agente aggiungono la configurazione vad. VADConfig attualmente supporta background_voice_detection (booleano, predefinito false).
  • LLM personalizzati WebSocket: CustomLLMAPIType aggiunge websocket.
  • Controlli della memoria dei file: la configurazione dell’input file del widget aggiunge max_files_in_memory (intero, 1–30, predefinito 10). I file oltre il limite vengono riepilogati e rimossi dalla memoria; max_files_per_conversation deve essere -1 o almeno il limite di memoria.
  • Oscuramento dell’input DTMF: DTMFInputConfig aggiunge redact_input facoltativo (booleano, predefinito false) per sostituire le cifre della tastiera del chiamante nelle trascrizioni, nei log delle conversazioni e nelle analisi. Le cifre ripetute dall’agente o passate agli strumenti rimangono invariate.

Speech to Text

  • Rilevamento di entità in tempo reale: Scribe v2 Realtime aggiunge l’opzione query entity_detection. Accetta all, un tipo o una categoria di entità, oppure un array di tipi e categorie, ed emette le entità rilevate negli eventi committed_transcript_entities. Consulta la guida al rilevamento delle entità per le categorie supportate.

Voci

  • Replica delle voci tra diverse residenze dei dati: aggiunto POST /v1/voices/{voice_id}/replicate-to-isolated-environment per copiare una voce Instant Voice Clone o Voice Design in un workspace nello stesso gruppo di fatturazione consolidato. Le richieste richiedono target_workspace_id (stringa) e accettano preserve_voice_id (booleano, predefinito true); le risposte restituiscono il voice_id di destinazione.
  • Metadati dei personaggi: le risposte dei personaggi aggiungono recommended_voice_ids (array di stringhe, predefinito []), i metadati aggiungono role nullable (CharacterRole) e CharacterAge sostituisce middle-aged con middle_aged.

Rilasci SDK

Pacchetti

Server MCP

  • v0.12.1 - Include gli aggiornamenti degli strumenti v0.11 e un aggiornamento delle dipendenze che risolve 44 avvisi di sicurezza.
  • v0.11.0 - Aggiunto simulate_conversation con comportamento dell’utente simulato configurabile, criteri di valutazione, output della trascrizione e analisi di superamento/non superamento. Lo strumento speech_to_text ora usa scribe_v2 per impostazione predefinita e voice_clone ora invia il contenuto dei file audio anziché stringhe di path.

API

Nuovi endpoint

Voci

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Replica una voce Instant Voice Clone o Voice Design nell’ambiente isolato di un altro workspace
    • Richiede target_workspace_id (stringa)
    • Accetta preserve_voice_id facoltativo (booleano, predefinito true)
    • Restituisce voice_id obbligatorio (stringa)

Endpoint aggiornati

ElevenAgents

  • Elenca conversazioni - GET /v1/convai/conversations
    • Aggiunto il parametro query facoltativo version_id (stringa)
  • Ricerca testuale nei messaggi delle conversazioni - GET /v1/convai/conversations/messages/text-search
    • Aggiunto il parametro query facoltativo version_id (stringa)
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Aggiunto il campo della richiesta facoltativo use_agent_defaults (booleano, predefinito true)

Modifiche allo schema

ElevenAgents

  • I payload di simulazione e test unitari aggiungono mappe tool_mock_overrides facoltative; ToolResponseMockConfig aggiunge is_error facoltativo (booleano, predefinito false)
  • SayNodeLiteralMessage aggiunge text_translations (mappa di TranslatedString); il campo è facoltativo in input e obbligatorio in output
  • La configurazione dell’agente aggiunge knowledge_base (KnowledgeBaseToolConfig) e vad (VADConfig)
  • CustomLLMAPIType aggiunge websocket
  • FileInputConfig aggiunge max_files_in_memory (intero, 1–30, predefinito 10)
  • DTMFInputConfig aggiunge redact_input facoltativo (booleano, predefinito false)
  • La configurazione dell’agente in tempo reale ora usa eleven_realtime_v1_mini per impostazione predefinita

Voci

  • Le risposte dei personaggi aggiungono recommended_voice_ids (array di stringhe, predefinito [])
  • I metadati dei personaggi aggiungono role nullable (CharacterRole)
  • Modifica incompatibile: CharacterAge sostituisce middle-aged con middle_aged; i client che inviano il vecchio valore devono eseguire la migrazione

Text to Speech

  • Modifica incompatibile: rimossi AudioFilterId e audio_filter dagli schemi di configurazione Text to Speech di ElevenAgents