Przebieg rozmowy

Skonfiguruj, jak asystent obsługuje limity czasu, przerwania i zmianę tur podczas rozmów.

Omówienie

Ustawienia przebiegu rozmowy określają, jak asystent obsługuje ciszę użytkownika, przerwania w trakcie mówienia i zmianę tur. Pomagają tworzyć bardziej naturalne rozmowy i można je dostosować do konkretnego zastosowania.

Maksymalny czas rozmowy

Ustawienie Maksymalny czas rozmowy ogranicza łączny czas, przez który rozmowa może pozostać aktywna. Ten globalny limit zaczyna działać wraz z rozpoczęciem rozmowy i jest niezależny od limitów czasu poszczególnych tur. Domyślnie wynosi 600 sekund (10 minut). Możesz ustawić wartość od 60 do 7200 sekund.

Konfiguracja

W CLI i API skonfigurujesz to ustawienie w polu conversation_config.conversation.max_duration_seconds.

Otwórz agenta w panelu, przejdź do zakładki Zaawansowane i zmień Maksymalny czas rozmowy w sekcji **Limity połączeń **. Zapisz zmiany.

Rozmowy przez wiadomości WhatsApp mają domyślny 15-minutowy limit bezczynności, liczony od ostatniej odpowiedzi agenta. Ten limit może zakończyć rozmowę przez wiadomości przed upływem skonfigurowanego maksymalnego czasu. Klienci Enterprise, których zastosowanie wymaga innego limitu, powinni skontaktować się z pomocą pod adresem support@elevenlabs.io.

Przejmij turę po ciszy

Ustawienie Przejmij turę po ciszy określa, jak długo asystent czeka podczas ciszy użytkownika, zanim przejmie następną turę i poprosi o odpowiedź.

Konfiguracja

Wartość podaje się w sekundach i musi mieścić się w zakresie od 1 do 30 sekund. W CLI i API skonfigurujesz to ustawienie w polu conversation_config.turn.turn_timeout.

Otwórz agenta w panelu, przejdź do zakładki Zaawansowane i zmień wartość Przejmij turę po ciszy. Zapisz zmiany.

Ustawienie przejęcia tury po ciszy

Dobierz odpowiedni czas oczekiwania do swojego zastosowania. Krótsze limity sprawiają, że rozmowy są bardziej dynamiczne, ale mogą przerywać użytkownikom, którzy potrzebują więcej czasu na odpowiedź, przez co rozmowa będzie mniej naturalna.

Dobre praktyki

  • Ustaw krótsze limity (5–10 sekund) dla swobodnych rozmów, w których oczekiwana jest szybka wymiana zdań
  • Użyj dłuższych limitów (10–30 sekund), gdy użytkownicy mogą potrzebować więcej czasu na zastanowienie lub sformułowanie złożonej odpowiedzi
  • Weź pod uwagę kontekst użytkownika — obsługa klienta może skorzystać na krótszych limitach, a wsparcie techniczne na dłuższych

Miękki limit czasu

Miękki limit czasu zapewnia natychmiastową informację audio, gdy LLM potrzebuje więcej czasu niż oczekiwano na wygenerowanie odpowiedzi. Zamiast niezręcznej ciszy podczas oczekiwania agent wypowiada krótkie wypełnienie, np. „Hmm…” lub „Daj mi pomyśleć…”, aby rozmowa zachowała naturalny rytm.

Ta funkcja przydaje się do:

  • Złożonych zapytań wymagających dłuższego przetwarzania przez LLM
  • Obsługi zmiennego opóźnienia od dostawców LLM
  • Tworzenia bardziej ludzkich rozmów z naturalnymi pauzami na zastanowienie

Jak to działa

  1. Gdy użytkownik kończy mówić, system zaczyna generować odpowiedź LLM
  2. Uruchamia się licznik na podstawie skonfigurowanego limitu czasu
  3. Jeśli odpowiedź LLM nadejdzie przed upływem limitu, wypełnienie nie zostanie wypowiedziane
  4. Jeśli limit czasu zostanie osiągnięty zanim LLM odpowie:
    • Skonfigurowany komunikat wypełniający jest wypowiadany od razu
    • Agent nadal czeka na właściwą odpowiedź
    • Gdy odpowiedź jest gotowa, agent wypowiada pełną odpowiedź LLM

Miękki limit czasu uruchamia się tylko raz na turę, aby uniknąć kilku wypełnień z rzędu.

Konfiguracja

Otwórz agenta w panelu, przejdź do zakładki Zaawansowane i dostosuj ustawienia Miękki limit czasu. Zapisz zmiany.

Ustawienia miękkiego limitu czasu

Czas limitu

Czas w sekundach przed wypowiedzeniem komunikatu wypełniającego podczas oczekiwania na odpowiedź LLM.

UstawienieOpis
Domyślne-1 (wyłączone)
Zakresod 0.5 do 8.0 sek.
Zalecane3.0 sek.

Zacznij od 3,0 sekund — to wystarczająco długo, by uniknąć niepotrzebnych wypełnień przy szybkich odpowiedziach, i wystarczająco krótko, by zapobiec niezręcznej ciszy.

Wiadomość statyczna

Zdefiniowana wcześniej fraza wypełniająca, wypowiadana po uruchomieniu miękkiego limitu czasu.

UstawienieOpis
Domyślne"Hhmmmm...yeah."
Długość1–200 znaków

Ta wiadomość obsługuje:

  • Nadpisania języka: Automatycznie tłumaczy się na dodatkowe języki skonfigurowane dla agenta
  • Nadpisania klienta: Można ją dostosować dla każdego połączenia przez SDK

Wiadomość generowana przez LLM

Po włączeniu dynamicznie generuje odpowiednią kontekstowo frazę wypełniającą za pomocą lekkiego LLM zamiast wiadomości statycznej.

UstawienieOpis
Domyślnefalse
AwaryjnieUżywa wiadomości statycznej, jeśli generowanie się nie powiedzie

System wykorzystuje ostatni kontekst rozmowy (do 4 wiadomości, 1000 znaków), aby generować trafne wypełnienia, np. „Hmm…”, „Rozumiem…”, „Jasne…”, „Mam to…” lub „Dobrze…”.

Podczas korzystania z wiadomości generowanych przez LLM nadal wymagana jest statyczna wiadomość awaryjna.

Dobre praktyki

  • Unikaj wskaźników czasu w wiadomościach wypełniających (np. „Chwileczkę…”), ponieważ rzeczywisty czas odpowiedzi jest nieprzewidywalny
  • Wyłącz miękki limit czasu w szybkich botach FAQ, gdzie odpowiedzi są stale szybkie

Przerwania

Obsługa przerwań określa, czy użytkownicy mogą przerwać asystentowi, gdy mówi.

Konfiguracja

Ustawienia przerwań można skonfigurować w zakładce Zaawansowane agenta, w sekcji Zdarzenia klienta.

Aby włączyć przerwania, upewnij się, że przerwanie jest wybranym zdarzeniem klienta.

Przerwania włączone

Przerwanie dozwolone

Przerwania wyłączone

Przerwanie ignorowane

Wyłącz przerwania, gdy pełne przekazanie informacji jest kluczowe, np. w przypadku zastrzeżeń prawnych lub instrukcji bezpieczeństwa.

Dobre praktyki dotyczące przerwań

  • Włącz przerwania dla naturalnych rozmów, w których oczekiwana jest wymiana zdań
  • Wyłącz przerwania, gdy kluczowe jest dokończenie komunikatu (np. warunki i zasady, informacje o bezpieczeństwie)
  • Weź pod uwagę kontekst zastosowania — obsługa klienta może skorzystać na przerwaniach, a przekazywanie informacji niekoniecznie

Skłonność do przejęcia tury

Skłonność do przejęcia tury określa, jak szybko asystent reaguje na wypowiedzi użytkownika podczas rozmowy. To ustawienie decyduje, jak chętnie asystent przejmuje turę i zaczyna mówić na podstawie wykrytych wzorców mowy.

Jak to działa

Asystent zawiera teraz dwa kluczowe ulepszenia, które sprawiają, że zmiana tur jest bardziej naturalna:

  1. Szybsze generowanie odpowiedzi — Asystent zaczyna mówić po otrzymaniu wystarczającej liczby słów i przecinka od modelu językowego, zamiast czekać na pełne zdania. Zmniejsza to opóźnienie i sprawia, że rozmowy są bardziej dynamiczne, szczególnie gdy asystent udziela dłuższych odpowiedzi.

  2. Konfigurowalna skłonność do przejęcia tury — Określ, jak szybko asystent interpretuje pauzy lub wzorce mowy jako okazję do odpowiedzi.

Konfiguracja

Dostępne są trzy tryby:

  • Chętny — Asystent szybko reaguje na wypowiedzi użytkownika, włączając się przy pierwszej okazji. Najlepszy do szybkich rozmów, w których liczą się natychmiastowe odpowiedzi.
  • Normalny — Zrównoważona zmiana tur, która sprawdza się w większości scenariuszy rozmów. Asystent czeka na naturalne przerwy w rozmowie, zanim odpowie.
  • Cierpliwy — Asystent czeka dłużej przed przejęciem tury, dając użytkownikom więcej czasu na dokończenie myśli. Idealny do zbierania szczegółowych informacji lub gdy użytkownicy potrzebują czasu na sformułowanie odpowiedzi.

Otwórz agenta w panelu, przejdź do ustawień Agenta i wybierz odpowiedni tryb skłonności do przejęcia tury. Zapisz zmiany.

Skłonność do przejęcia tury jest szczególnie przydatna w połączeniu z workflow. Możesz dynamicznie dostosować szybkość reakcji asystenta do kontekstu — może szybciej się włączać podczas swobodnej rozmowy lub dłużej czekać przy zbieraniu poufnych danych, takich jak numery telefonów czy adresy e-mail.

Dobre praktyki dotyczące skłonności do przejęcia tury

  • Użyj trybu Chętny w obsłudze klienta, gdzie szybkie odpowiedzi poprawiają doświadczenie użytkownika
  • Użyj trybu Cierpliwy przy zbieraniu uporządkowanych informacji, takich jak numery telefonów, adresy lub adresy e-mail
  • Użyj trybu Normalny jako domyślnego dla ogólnych przebiegów rozmów
  • Połącz z workflow, aby dynamicznie dostosowywać skłonność do przejęcia tury do kontekstu rozmowy
  • Przetestuj różne ustawienia dla swojego zastosowania, aby znaleźć optymalną równowagę

Zalecane konfiguracje

  • Krótsze limity czasu (5–10 sekund) dla dynamicznych interakcji - Włącz przerwania, aby klienci mogli wtrącać pytania - Chętna skłonność do przejęcia tury dla szybkich, dynamicznych rozmów
  • Umiarkowane limity czasu (10–15 sekund), aby użytkownicy mieli czas na zebranie informacji - Włącz przerwania dla naturalnego przebiegu rozmowy - Cierpliwa skłonność do przejęcia tury przy zbieraniu numerów telefonów, adresów lub adresów e-mail
  • Dłuższe limity czasu (15–30 sekund), aby umożliwić złożone odpowiedzi - Wyłącz przerwania, aby zapewnić pełne przekazanie informacji prawnych - Normalna skłonność do przejęcia tury dla utrzymania stałego tempa
  • Dłuższe limity czasu (10–30 sekund), aby dać czas na zastanowienie i sformułowanie odpowiedzi - Włącz przerwania, aby uczniowie mogli wtrącać pytania - Cierpliwa skłonność do przejęcia tury, aby dać uczniom wystarczająco dużo czasu na odpowiedź