Vai alla navigazione

Input multimodale

Configura gli allegati di file e l'input da tastierino per il tuo agente.

Panoramica

Le impostazioni dell’input multimodale controllano i modi aggiuntivi con cui gli utenti possono inviare informazioni all’agente oltre alla voce. Si trovano nella scheda Avanzate dell’agente, in Input multimodale.

Input file

L’input file consente agli utenti di inviare immagini e PDF all’agente in chat. L’agente può leggere questi file quando il modello selezionato supporta l’input di immagini e/o documenti.

Gli allegati vengono ignorati se il modello non supporta il tipo di file, anche quando l’input file è abilitato.

Configurazione

CampoTipoPredefinitoDescrizione
enabledbooleantrueSe è true, gli utenti possono allegare immagini o PDF se il modello supporta quel tipo di input.
max_files_in_memoryinteger10Numero di file caricati di recente mantenuti contemporaneamente in memoria. Intervallo: da 1 a 10. Al raggiungimento del limite, i file meno recenti vengono sostituiti con un breve riepilogo.
max_files_per_conversationinteger10Numero totale di file che un utente può caricare in una conversazione. I caricamenti vengono fatturati per file. Usa -1 per nessun limite. Deve essere -1 o maggiore o uguale a max_files_in_memory.

Gli utenti possono allegare file nel widget, nei canali chat supportati come Slack o tramite l’API carica file della conversazione.

1

Apri Input multimodale

Apri il tuo agente nella dashboard, verifica che il modello selezionato supporti l’input di immagini e/o PDF, quindi vai alla scheda Avanzate.

2

Abilita gli allegati di file

In Input multimodale, attiva Consenti allegati di file.

3

Imposta i limiti dei file

Facoltativamente, imposta File mantenuti in memoria e Numero massimo di file per conversazione.

4

Salva le modifiche

Salva l’agente. Gli utenti potranno quindi allegare immagini e PDF in chat.

Input DTMF

L’input DTMF consente ai chiamanti di inserire cifre sul tastierino del telefono durante una chiamata. Usalo per raccogliere numeri di telefono, scelte di menu e altri input numerici senza ricorrere al riconoscimento vocale.

È l’opposto dello strumento di sistema riproduci tono del tastierino, che invia toni dall’agente.

È supportato solo il DTMF fuori banda da Twilio, SIP trunking (telefonia) o Genesys. I toni in banda nel flusso audio vengono ignorati. Il widget web e i canali chat non possono inviare DTMF.

Ogni pressione di un tasto viene memorizzata nel buffer fino al completamento della sequenza. Il completamento di una sequenza crea un turno dell’utente.

  1. Il chiamante preme un tasto. La prima cifra interrompe l’agente se sta parlando.
  2. Le cifre successive vengono aggiunte allo stesso buffer.
  3. La sequenza si completa quando il chiamante preme # (se la terminazione con cancelletto è abilitata) o quando non arrivano altre cifre prima del timeout.
  4. L’agente riceve le cifre raccolte come turno dell’utente e risponde.

# è un terminatore quando la terminazione con cancelletto è abilitata; non è incluso nella stringa raccolta. Un # premuto con un buffer vuoto viene ignorato. Il buffer accetta 0-9, *, # e A-D, fino a 50 caratteri.

Configurazione

conversation_config.conversation.dtmf_input_settings è null quando l’input DTMF è disabilitato. Quando è abilitato, i valori predefiniti sono:

CampoTipoPredefinitoDescrizione
dtmf_input_timeoutfloat2.0Secondi di attesa dopo l’ultima pressione di un tasto prima di completare la sequenza. Intervallo: da 0.5 a 10.0.
hash_terminatorbooleantrueSe è true, # completa immediatamente la sequenza e non viene incluso nelle cifre raccolte.
redact_inputbooleanfalseSe è true, le voci del tastierino vengono sostituite con <REDACTED> nella trascrizione archiviata, nel log della conversazione e nell’analisi.

L’oscuramento si applica al turno del tastierino nei dati della conversazione archiviati. Non nasconde le cifre all’agente durante la chiamata in tempo reale e non riscrive le cifre che l’agente ripete a voce o invia a uno strumento. È separato dall’oscuramento della cronologia della conversazione.

1

Apri Input multimodale

Apri il tuo agente nella dashboard e vai alla scheda Avanzate.

2

Abilita l'input DTMF

In Input multimodale, attiva Abilita input DTMF.

3

Configura timeout e oscuramento

Facoltativamente, imposta Timeout input DTMF, Usa # per completare l’input DTMF e Oscura input DTMF.

4

Salva le modifiche

Salva l’agente, quindi effettua una chiamata telefonica e inserisci le cifre sul tastierino.

Aggiorna il prompt di sistema dell’agente affinché sappia quando chiedere l’input dal tastierino. Ad esempio:

If you need the caller's phone number, ask them to type it on their keypad. Wait for the DTMF
input before continuing.