Vai alla navigazione

Scribe v2

Abbiamo lanciato Scribe v2, il nuovo modello di trascrizione all’avanguardia. Scopri di più su Scribe v2 nella documentazione.

Piattaforma Agents

  • Supporto dei fusi orari per la pianificazione delle chiamate batch: ora puoi selezionare un fuso orario quando pianifichi chiamate batch. L’orario pianificato viene convertito in UTC in base al fuso orario scelto. Per impostazione predefinita viene selezionato automaticamente il fuso orario del browser e la convalida impedisce di pianificare chiamate per orari già trascorsi nel fuso orario selezionato. Così è più semplice pianificare chiamate in uscita nell’orario giusto per i fusi orari dei destinatari.
  • URL del file sorgente della knowledge base: aggiunto un nuovo endpoint per recuperare l’URL del file sorgente originale dei documenti della knowledge base, consentendo l’accesso diretto ai file caricati.
  • Timeout della cascata di fallback LLM: aggiunta l’opzione di configurazione cascade_timeout_seconds per le configurazioni LLM di backup degli agenti, che consente di controllare quanto attendere prima di passare al LLM successivo. Il valore predefinito è 8 secondi, con un intervallo consentito di 2-15 secondi.
  • Messaggi generati dall’LLM per il soft timeout: aggiunta l’opzione use_llm_generated_message alla configurazione del soft timeout. Se abilitata, quando si attiva il soft timeout l’agente genererà un messaggio contestuale usando l’LLM invece di un messaggio predefinito.
  • Navigazione delle cartelle della knowledge base: le risposte dei documenti della knowledge base ora includono il campo folder_path, che mostra i segmenti del percorso dalla radice alla cartella padre e rende più semplice comprendere la gerarchia dei documenti.
  • Filtraggio delle conversazioni in base all’origine di avvio: l’endpoint Ottieni conversazioni ora supporta il filtraggio tramite il parametro query conversation_initiation_source.

Doppiaggio

  • Nuovo endpoint per il formato delle trascrizioni: aggiunto l’endpoint GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, che supporta i formati di output srt, webvtt e json. Il precedente endpoint GET /v1/dubbing/{dubbing_id}/transcript/{language_code} è ora deprecato.
  • Nome file obbligatorio per i file doppiati: i modelli di file della knowledge base ora richiedono un campo filename.

Speech to Text

  • Rilevamento delle entità: aggiunta l’opzione entity_detection alle richieste Speech-to-Text. Accetta 'all', stringhe di tipi di entità specifici o un array di tipi di entità. Le entità rilevate vengono restituite in un nuovo campo di risposta entities che usa lo schema DetectedEntity.
  • Prompting dei termini chiave: aggiunto il parametro array keyterms alle richieste Speech-to-Text per orientare la trascrizione verso termini o frasi specifici.

Rilasci SDK

SDK Python

  • v2.29.0 - Aggiunti il rilevamento delle entità e il prompting dei termini chiave per Speech-to-Text, la configurazione del timeout della cascata LLM, la generazione di messaggi LLM per il soft timeout e il supporto dei fusi orari per le chiamate batch
  • v2.28.0 - Aggiunti campi per il versioning degli agenti, ID delle raccolte vocali, miglioramenti delle chiamate batch ed etichette dei numeri di telefono

SDK JavaScript

  • v2.30.0 - Aggiunti il rilevamento delle entità e il prompting dei termini chiave per Speech-to-Text, la configurazione del timeout della cascata LLM, la generazione di messaggi LLM per il soft timeout e il supporto dei fusi orari per le chiamate batch
  • v2.29.0 - Aggiunti campi per il versioning degli agenti, ID delle raccolte vocali, miglioramenti delle chiamate batch ed etichette dei numeri di telefono

Server MCP

  • v0.9.1 - Aggiunto il supporto per Gemini Extension, corretta la gestione del path per output_directory non assoluto e base_path mancante

API

Nuovi endpoint

Endpoint deprecati

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code} - Usa invece il nuovo endpoint specifico per il formato

Endpoint aggiornati

Piattaforma Agents

  • Invia chiamata batch
    • Aggiunto timezone (stringa, facoltativo) al body della richiesta per una pianificazione che considera il fuso orario
    • Aggiunto scheduled_time (stringa, facoltativo) come alternativa in formato ISO a scheduled_time_unix
  • Ottieni chiamata batch, Annulla chiamata batch, Riprova chiamata batch
    • Aggiunto timezone (stringa, obbligatorio) ai modelli di risposta delle chiamate batch
  • Crea agente, Aggiorna agente, Ottieni agente
    • Aggiunto cascade_timeout_seconds (intero, valore predefinito 8, intervallo 2-15, nullable) alla configurazione LLM di backup
    • Aggiunto use_llm_generated_message (booleano, valore predefinito false) alla configurazione del soft timeout
  • Ottieni conversazioni
    • Aggiunto il parametro query conversation_initiation_source (stringa, facoltativo) per filtrare le conversazioni in base all’origine di avvio
  • Simula conversazione, Simula stream della conversazione
    • Aggiornato entity_detection affinché accetti 'all', stringhe o array di stringhe invece di un booleano

Knowledge base

  • Elenca i documenti della knowledge base
    • Rimosso il parametro query deprecato use_typesense
    • Aggiunto folder_path (array di segmenti del path) ai modelli di risposta dei documenti
    • Aggiunto filename (stringa, obbligatorio) ai modelli di file della knowledge base

Speech to Text

  • Trascrivi audio
    • Aggiunto keyterms (array di stringhe, facoltativo) per orientare la trascrizione verso termini specifici
    • Aggiunto entity_detection (stringa, array o 'all', facoltativo) per rilevare le entità nel testo trascritto
    • Aggiunto entities (array di DetectedEntity, facoltativo) al modello di risposta

Doppiaggio

  • Crea progetto di doppiaggio
    • Aggiornata la descrizione di mode per specificare che la modalità manual è sperimentale e non consigliata per l’uso in produzione