Przejdź do treści

Przywracanie tożsamości przez głos w Afryce: Senses Hub x ElevenLabs

Opublikowano
Ostatnia aktualizacja

PosłuchajPosłuchaj tego artykułu

Miliony ludzi na całym świecie żyją z zaburzeniami mowy lub utratą głosu spowodowaną udarem, ALS, porażeniem mózgowym, nowotworem albo urazem. Dla wielu technologia jest pomostem — urządzenia komunikacji wspomagającej i alternatywnej (AAC), które zamieniają tekst na mowę.

Większość głosów AAC opiera się głównie na modelach amerykańskiej i brytyjskiej angielszczyzny, dlatego brzmią obco, robotycznie lub nienaturalnie. Nie oddają akcentów, tonu ani kontekstu kulturowego użytkowników z miejsc takich jak Nairobi, Lagos czy São Paulo. To więcej niż luka techniczna — to utrata osobistej tożsamości i poczucia przynależności.

Gdy twój głos nie brzmi jak ty, komunikacja staje się trudniejsza. Rośnie liczba nieporozumień, spada pewność siebie, a stygmatyzacja się pogłębia. Dla zbyt wielu osób każda rozmowa przypomina, że ich głos nie jest naprawdę ich.

Przywracamy ludziom ich głosy

Senses Hub, z siedzibą w Nairobi, to jeden z czołowych afrykańskich ośrodków badawczych zajmujących się dostępnością i technologiami wspierającymi. Organizacja działa na rzecz technologii, które są dostępne, przystępne cenowo i odpowiadają potrzebom lokalnych społeczności.

Wraz z ElevenLabs Impact Program Senses Hub tworzy lokalne modele głosowe dla systemów AAC w całej Afryce, zapewniając głosy brzmiące autentycznie, naturalnie i po ludzku.

Senses Hub x ElevenLabs

Modele głębokiego uczenia ElevenLabs odtwarzają mowę z dużą dokładnością emocjonalną i obsługują wiele języków. Wystarczy kilka sekund nagrania, by odtworzyć oryginalny głos danej osoby lub stworzyć nowy, który jest osobisty i zgodny z jej kulturą.

Dla osób bez nagrań system dawców głosu pozwala wolontariuszom udostępniać swoje głosy. Nagrania są potem dostosowywane do preferencji i tożsamości użytkownika, aby każdy mógł brzmieć jak on sam.

Tworzymy inkluzywny ekosystem głosowy

Projekt zaczyna się w Afryce Wschodniej — w Kenii, Ugandzie, Tanzanii i Rwandzie — a następnie rozwija się dzięki regionalnej sieci partnerów Senses Hub. Skupia się na dwóch grupach:

  • Osobach, które mogą odtworzyć swój naturalny głos z istniejących nagrań.
  • Osobach, które wcześniej nie mówiły i mogą wybrać lub dostosować głos dawcy.

Te głosy będą zintegrowane z narzędziami AAC, aplikacjami komunikacyjnymi i platformami wspierającymi, ułatwiając codzienną komunikację w szkołach, miejscach pracy, szpitalach i domach.

Jak działa technologia

Technologie ElevenLabs Text to Speech i Professional Voice Cloning zapewniają:

  • Odtwarzanie głosu w wysokiej jakości na podstawie krótkich próbek audio.
  • Elastyczność akcentów i języków odzwierciedlającą lokalną różnorodność.
  • Ekspresyjną, ludzką mowę oddającą ton i emocje.
  • Prostą integrację z API dla deweloperów i platform AAC.
  • Etyczne tworzenie głosów, oparte na zgodzie, prywatności i przejrzystym wykorzystaniu danych.

Wpływ w realnym świecie

Osoba po udarze odzyskuje możliwość mówienia własnym głosem.

Uczeń z porażeniem mózgowym pewnie zabiera głos na lekcji.

Osoba z ALS prowadzi spotkania, korzystając z naturalnego głosu znanego w jej regionie.

W ochronie zdrowia, edukacji, usługach publicznych i codziennym życiu ta współpraca ma zastąpić ogólną syntetyczną mowę głosami, które przywracają pewność siebie i godność.

Wpływ w Afryce

Dzięki współpracy z Senses Hub pomagamy stworzyć podstawy bardziej inkluzywnego ekosystemu technologii głosowych w Afryce. Łącząc globalne innowacje z lokalną wiedzą, tworzymy rozwiązania odzwierciedlające różnorodność, kulturę i tożsamość społeczności, którym służą.

Dołącz do inicjatywy

Jeśli działasz w organizacji non-profit, która zwiększa dostępność dzięki głosowi, zapraszamy do współpracy — zgłoś się do naszego Impact Program.

Podobne artykuły

Twórz z najwyższej jakości audio AI