Vai alla navigazione

Clonazione Vocale Professionale (PVC)

  • API PVC: Abbiamo introdotto una suite completa di endpoint API per gestire le Clonazioni Vocali Professionali (PVC). Ora puoi creare voci a livello programmatico, aggiungere/gestire/eliminare campioni audio, recuperare audio/forme d’onda, gestire la separazione dei parlanti, gestire la verifica e avviare l’addestramento. Per l’elenco completo dei nuovi endpoint, consulta il riepilogo delle modifiche API qui sotto o leggi il riferimento API PVC qui.

Speech to Text

  • Opzioni di esportazione migliorate: Abbiamo aggiunto opzioni per includere o escludere timestamp e ID dei parlanti durante l’esportazione dei risultati di Speech to Text in formato JSON segmentato tramite API.

Piattaforma Agents

  • Nuovi modelli LLM: Abbiamo aggiunto il supporto per i nuovi modelli GPT-4.1: gpt-4.1, gpt-4.1-mini e gpt-4.1-nano qui
  • Punteggio VAD: Abbiamo aggiunto un nuovo evento client che invia i punteggi VAD al client; consulta il riferimento qui

API

Nuovi endpoint

Endpoint aggiornati

Speech to Text

  • Endpoint aggiornato con le seguenti modifiche:

Modifiche allo schema

Piattaforma Agents

  • GET conversation details: aggiunti i campi booleani has_audio, has_user_audio, has_response_audio qui

Doppiaggio

  • GET dubbing resource : aggiunto il campo status a ogni rendering qui