Simula conversazioni
Questa guida e gli endpoint che utilizza sono deprecati. Usa invece il tipo di test dell’agente Simulazione.
Panoramica
L’API Agents di ElevenLabs ti consente di simulare e valutare conversazioni testuali con il tuo agente IA. Questa guida ti mostrerà come implementare un workflow completo di test delle simulazioni usando gli endpoint di simulazione delle conversazioni (batch e streaming), così potrai testare e migliorare in modo dettagliato le prestazioni del tuo agente per assicurarti che raggiunga i tuoi obiettivi di interazione.
Prerequisiti
- Un agente configurato in ElevenLabs Agents (creane uno qui)
- La tua chiave API ElevenLabs, che puoi creare nella dashboard
Implementare un workflow di test delle simulazioni
Identifica i parametri iniziali di valutazione
Esamina la cronologia delle conversazioni del tuo agente e individua i casi in cui le sue prestazioni non sono state soddisfacenti. Usa queste conversazioni per creare vari prompt per un utente simulato che interagirà con il tuo agente. Inoltre, definisci eventuali criteri di valutazione aggiuntivi non già specificati nella configurazione dell’agente, per verificare gli esiti che potresti desiderare per uno specifico utente simulato.
Simula la conversazione tramite l'SDK
Crea una richiesta all’endpoint di simulazione usando l’SDK di ElevenLabs.
Questo è un esempio di base. Per un elenco completo dei parametri di input, consulta il Riferimento API degli endpoint Simula conversazione e Simula conversazione in streaming.
Analizza la risposta
L’SDK fornisce un oggetto JSON completo che include l’intera trascrizione della conversazione e un’analisi dettagliata.
Conversazione simulata: registra ogni turno di interazione tra l’utente simulato e l’agente, descrivendo in dettaglio messaggi e utilizzo degli strumenti.
Analisi: offre informazioni sugli esiti dei criteri di valutazione, sulle metriche di raccolta dati e un riepilogo della trascrizione della conversazione.
Migliora i criteri di valutazione
Esamina attentamente le conversazioni simulate per valutare l’efficacia dei tuoi criteri di valutazione. Individua eventuali lacune o aspetti in cui i criteri potrebbero non riuscire a valutare le prestazioni dell’agente. Perfeziona e adatta di conseguenza i criteri di valutazione per assicurarti che siano in linea con i risultati desiderati e misurino accuratamente le capacità dell’agente.
Migliora il tuo agente
Quando sei sicuro dell’accuratezza dei tuoi criteri di valutazione, usa quanto appreso dalle conversazioni simulate per migliorare le capacità del tuo agente. Valuta di perfezionare il system prompt per guidare meglio le risposte dell’agente, assicurandoti che siano in linea con i tuoi obiettivi e le aspettative degli utenti. Inoltre, esplora altre funzionalità o configurazioni che potrebbero essere ottimizzate, ad esempio regolando il tono dell’agente, migliorando la sua capacità di gestire query specifiche o integrando ulteriori fonti di dati per arricchire le sue risposte. Applicando sistematicamente quanto appreso, puoi creare un agente conversazionale più solido ed efficace, in grado di offrire un’esperienza utente superiore.
Iterazione continua
Dopo aver completato un primo ciclo di test e miglioramento, creare una suite di test completa può essere un ottimo modo per coprire un’ampia gamma di scenari possibili. Questa suite può esplorare più conversazioni simulate usando prompt e condizioni iniziali variabili per gli utenti simulati. Grazie a iterazioni e perfezionamenti continui del tuo approccio, puoi assicurarti che il tuo agente rimanga efficace e reattivo alle esigenze in evoluzione degli utenti.
Suggerimenti utili
Prompt e criteri dettagliati
Creare prompt dettagliati e completi per utenti simulati, nonché criteri di valutazione dettagliati, può migliorare l’efficacia dei test di simulazione. Più contesto e specificità fornisci, meglio l’agente potrà comprendere e rispondere a interazioni complesse.
Configurazioni di strumenti mock
Usa configurazioni di strumenti mock per testare il processo decisionale del tuo agente. Ciò ti consente di osservare come l’agente decide di effettuare chiamate agli strumenti e di reagire ai diversi risultati delle chiamate. Per maggiori dettagli, consulta il parametro di input tool_mock_config nel Riferimento API.
Cronologia parziale della conversazione
Usa cronologie parziali delle conversazioni per valutare come gli agenti gestiscono le interazioni a partire da un punto specifico. È particolarmente utile per valutare la capacità dell’agente di gestire conversazioni in cui l’utente ha già formulato una domanda in un modo specifico o in cui alcune chiamate agli strumenti hanno avuto esito positivo o negativo. Per maggiori dettagli, consulta il parametro di input partial_conversation_history nel Riferimento API.