Przejdź do treści

Apna osiąga 7,5 miliona minut AI wywiadów dzięki ElevenLabs

Opublikowano

PosłuchajPosłuchaj tego artykułu

Przygotowanie do rozmów kwalifikacyjnych w Indiach od dawna nie działa jak powinno — jest ogólne, niespójne i niedostępne dla większości osób szukających pracy.

Apna, wiodąca indyjska platforma do szukania pracy i rozwoju kariery, postanowiła to zmienić, by każda próbna rozmowa przypominała prawdziwą — dopasowaną do stanowiska, firmy i kandydata.

Z ponad 60 milionami użytkowników, 10 000+ firm i 30 000+ stanowisk wizja Apna wymagała czegoś więcej niż modułów szkoleniowych. Potrzebna była rozmowa — z ludzkim tempem, empatią i znajomością branży — na ogromną skalę.

Aby to osiągnąć, Apna stworzyła jeden z najbardziej zaawansowanych ekosystemów rozmów kwalifikacyjnych AI, oparty na ElevenLabs Text to Speech i platformie orkiestracji głosu Blue Machines. Te systemy przeprowadziły łącznie ponad 1,5 miliona rozmów kwalifikacyjnych AI — 7,5 miliona minut głosu — przy opóźnieniu poniżej 300 ms.

Dlaczego Apna wybrała ElevenLabs

Aby symulacje rozmów kwalifikacyjnych brzmiały naturalnie, jakość głosu i szybkość reakcji muszą iść w parze. Każde słyszalne opóźnienie lub robotyczny ton niszczy wrażenie realizmu i zaufanie.

Apna wybrała ElevenLabs z trzech kluczowych powodów:

  • Streaming z niskim opóźnieniem — odtwarzanie odpowiedzi zaczyna się w ciągu 150–180 ms.
  • Obsługa wielu języków — płynna synteza indyjskiej odmiany angielskiego, hindi i wypowiedzi mieszających języki.
  • Emocjonalne niuanse — modulacja tonu odzwierciedlająca ludzką empatię i wymagający charakter rozmowy.

Dzięki temu Apna zachowuje rytm prawdziwej rozmowy i wiarygodność emocjonalną na dużą skalę.

Realizm ludzkiej rozmowy w czasie rzeczywistym, na dużą skalę 

Aby takie realistyczne rozmowy były możliwe, Apna musiała rozwiązać złożony problem orkiestracji. Próbna rozmowa, która brzmi prawdziwie, wymaga czegoś więcej niż zapisanego dialogu: precyzyjnego zsynchronizowania głosu, opóźnień, empatii i kontekstu — wszystko musi działać razem z szybkością maszyny.

Każda firma prowadzi rozmowy inaczej. Na stanowisku product managera można sprawdzać rozumowanie oparte na metrykach, na stanowisku analityka kredytowego w banku — znajomość zasad zgodności, a na stanowisku lidera platformy e-commerce — optymalizację tras.

Za kulisami platforma orkiestracji Apna, Blue Machines, stworzyła graf Retrieval-Augmented Generation (RAG) dla każdej kombinacji stanowiska i firmy: 

● 10 000+ firm × 50–100 stanowisk = ok. 500 milionów mikromodeli. 
● Każdy model opiera się na kryteriach oceny, tonie i słownictwie danej firmy.

Apna zintegrowała streamingowe Text to Speech od ElevenLabs bezpośrednio z pętlą konwersacyjną. Każda tura zaczyna się od wypowiedzi kandydata, przetwarzanej przez wielojęzyczne modele ASR i NLU. Następnie logika workflow ocenia intencję, emocje i kontekst, pobiera najtrafniejsze dane branżowe, układa kolejne pytanie i odtwarza je przez ElevenLabs — wszystko w około 300 milisekund end-to-end.

„Każda syntezowana odpowiedź zaczyna być odtwarzana w ciągu ok. 150–180 ms dzięki niskim opóźnieniom API ElevenLabs, zintegrowanym bezpośrednio z warstwą orkiestracji Apna i Blue Machines” — powiedział Abhishek Ranjan, CTO Apna.

Przy około 300 ms ludzki mózg odbiera mowę jako ciągłą, a nie opóźnioną — to próg, od którego naprawdę zaczyna się realizm. 

Funkcja
Wejście brzegowe
Regionalne bramy + inteligentne trasowanie
ASR + NLU
Streamingowe rozpoznawanie wielu języków
Logika workflow + persona
Logika stanowiska + modulacja empatii
Pobieranie kontekstu + ocena
Pobieranie i weryfikacja danych branżowych
Odtwarzanie TTS
Start syntezy głosu ElevenLabs
Łącznie
Czas (ms)
Wejście brzegowe
30
ASR + NLU
90
Logika workflow + persona
40
Pobieranie kontekstu + ocena
40
Odtwarzanie TTS
100
Łącznie
≈300 ms

Efektem jest system, który łączy techniczną precyzję z emocjonalną głębią. Tysiące rozmów odbywa się jednocześnie po angielsku w indyjskiej odmianie, po hindi i w wypowiedziach mieszających języki, a każda zachowuje rytm, empatię i wiarygodność prawdziwej rozmowy między ludźmi.

Wpływ na dużą skalę

Rezultat
Przeprowadzone próbne rozmowy AI
1,5 mln+
Minuty głosu
7,5 mln+
Średnie opóźnienie
<300 ms
Modele stanowisko–firma
500 mln+

Równe szanse dla wszystkich

24-letni kandydat z Pune w Indiach powiedział:

Osoba prowadząca rozmowę AI znała moje CV, przełączała się między hindi i angielskim i stawiała mi wyzwania jak prawdziwy panel rekrutacyjny banku HDFC. Przy kolejnej próbie dostałem tę pracę.

Po raz pierwszy kandydaci mogą ćwiczyć rozmowy, które naprawdę wydają się prawdziwe — dopasowane do ich CV, firmy i wymarzonego stanowiska.

AI Interview Prep od Apna pokazuje, jak technologia głosowa może demokratyzować dostęp do szans — dając milionom osób szukających pracy przygotowanie, które wcześniej było dostępne tylko dla nielicznych.

Dla wielu osób ćwiczenie z realistycznym rozmówcą buduje prawdziwą pewność siebie przed pierwszą rozmową z człowiekiem.

Łącząc głos w czasie rzeczywistym z adaptacyjnym kontekstem i empatią, Apna zmieniła przygotowanie w aktywny udział — dając każdemu, niezależnie od pochodzenia czy języka, równe szanse na sukces.

Nowy etap nauki

AI Interview Prep od Apna wyznacza kolejną generację nauki i rozmów kwalifikacyjnych wspieranych przez AI.

Realistyczne, responsywne głosy oparte na ElevenLabs Text to Speech API pozwalają kandydatom korzystać ze spersonalizowanych informacji zwrotnych, naturalnego tempa i płynności w dwóch językach, których ćwiczenia tekstowe nigdy nie zapewnią.

Dzięki tej współpracy Apna na nowo definiuje brzmienie nauki na dużą skalę — pokazując, że AI oparte na głosie może poszerzać ludzkie możliwości, a nie je zastępować.

Sukces Apna pokazuje, jak głos wysokiej jakości może zmieniać edukację, możliwości zatrudnienia i dostęp do szans w skali całego kraju.

Jeśli tworzysz narzędzia do nauki przez rozmowę, rozmówców kwalifikacyjnych AI lub dowolny system, w którym liczą się realizm i empatia, sprawdź możliwości Platformy ElevenLabs Conversational Agents.

Podobne artykuły

Twórz z najwyższej jakości audio AI