Pular para o conteúdo

O que é um fonema? Definição e os 44 fonemas do inglês

Escrito por
Jack Limebear
Publicado
Última atualização

OuvirOuça este artigo

Um fonema é a menor unidade sonora de uma língua capaz de mudar o significado de uma palavra. Ao trocar um único fonema, você pode formar uma palavra completamente diferente. /p/ e /b/, combinados com /æt/, formam “pat” e “bat”, duas palavras totalmente diferentes. 

No inglês especificamente, os fonemas explicam por que a escrita e o som muitas vezes não correspondem. Uma palavra como “fox” é formada por quatro fonemas distintos (/f/ /ɒ/ /k/ /s/), mas tem apenas três letras, enquanto “ship” tem quatro letras, mas apenas três fonemas (/ʃ/ /ɪ/ /p/). Entender os fonemas é essencial tanto para aprender idiomas quanto para compreender como os sistemas modernos de Text to Speech transformam palavras escritas em fala com som natural.

Este artigo explica exatamente o que é um fonema com exemplos, apresenta a tabela completa dos 44 fonemas do inglês e mostra como a tecnologia de voz IA usa controle no nível dos fonemas para acertar a pronúncia.

Resumo:

  • Um fonema é a menor unidade sonora de uma língua falada capaz de mudar o significado de uma palavra.
  • A maioria dos linguistas considera que há 44 fonemas no inglês: 24 sons consonantais e 20 sons vocálicos.
  • Os fonemas descrevem sons, enquanto os grafemas são as letras ou combinações de letras que representam um fonema na escrita.
  • O Alfabeto Fonético Internacional (IPA) padroniza os símbolos usados para representar fonemas e garantir consistência na pronúncia desses sons.
  • Ferramentas de Text to Speech convertem grafemas em fonemas antes de gerar um arquivo de áudio.

O que é um fonema?

Um fonema é a menor unidade sonora capaz de distinguir uma palavra de outra. Os linguistas identificam fonemas encontrando duas palavras que diferem em exatamente um som. Essas palavras são chamadas de pares mínimos. Veja alguns exemplos:

  • Pat / bat: /p/ e /b/ são os fonemas distintos neste par mínimo.
  • Ship / sheep: /ɪ/ e /iː/ são os fonemas que diferenciam essas palavras.
  • Bat / bad: /t/ e /d/ são os fonemas distintos que marcam a diferença entre essas palavras.

Se você encontrar uma palavra em que mudar um som produz uma nova palavra, esses dois sons são fonemas separados nessa língua. Se a mudança produzir apenas uma versão com som ligeiramente diferente da mesma palavra, eles serão apenas variantes do mesmo fonema.

A palavra “fonema” vem do grego phōnēma, que significa enunciado ou som produzido. É útil lembrar disso ao definir fonemas, pois eles são unidades de som, não informações sobre a escrita. Como veremos em breve, os fonemas vão além de letras isoladas e abrangem sons completos. 

Quantos fonemas existem no inglês?

No inglês, há 44 fonemas: 24 fonemas consonantais e 20 fonemas vocálicos. Mas isso é apenas uma estimativa geral. Dependendo do sotaque e de como os linguistas definem os diferentes sons, alguns consideram que existem apenas 42, enquanto outros chegam a 45. Por exemplo, o sotaque americano geral pronuncia o /r/ em “car”, enquanto a Received Pronunciation (britânica) não o pronuncia, resultando em uma contagem total diferente entre esses sotaques.

Outros sotaques podem unir vogais, removendo fonemas da contagem total. Fusões vocálicas, como quando alguns americanos pronunciam “cot” e “caught” da mesma forma, afetam a avaliação dos linguistas sobre os números totais. Alguns sons marginais, em que ditongos são vistos como combinações em vez de fonemas únicos, também podem influenciar esses números. Por exemplo, alguns sistemas consideram /ʍ/ (o som soproso no início de “which”) um fonema distinto, enquanto outros o tratam como uma combinação de /h/ e /w/.

A contagem padrão usa um modelo de 44 fonemas. A divisão exata é de 24 consoantes, 12 vogais monotongas e 8 ditongos, o padrão usado no ensino de fonética no Reino Unido e no ensino de inglês como segunda língua. 

Os 44 fonemas do inglês: tabela completa com exemplos

Fonemas consonantais (24)

Example words
/b/
bat, rubber
/d/
dog, add
/f/
fish, phone, laugh
/g/
go, egg
/h/
hat, who
/dʒ/
jam, bridge, giant
/k/
cat, kite, duck, school
/l/
leg, bell
/m/
map, hammer, comb
/n/
net, dinner, knee
/p/
pen, happy
/r/
rat, berry, write
/s/
sun, dress, city
/t/
top, letter, walked
/v/
van, of
/w/
wet, wheel
/j/
yes, onion
/z/
zip, fizz, rose
/θ/
thin, bath
/ð/
this, mother
/ŋ/
ring, sink
/ʃ/
ship, mission, ocean
/tʃ/
chip, match, nature
/ʒ/
measure, vision, beige
Common spellings
/b/
b, bb
/d/
d, dd, ed
/f/
f, ff, ph, gh
/g/
g, gg, gu
/h/
h, wh
/dʒ/
j, dge, g, ge
/k/
c, k, ck, ch, qu
/l/
l, ll
/m/
m, mm, mb
/n/
n, nn, kn, gn
/p/
p, pp
/r/
r, rr, wr
/s/
s, ss, c, ce, sc
/t/
t, tt, ed
/v/
v, ve, f
/w/
w, wh, u
/j/
y, i
/z/
z, zz, s, se
/θ/
th (voiceless)
/ð/
th (voiced)
/ŋ/
ng, n
/ʃ/
sh, ss, ti, ci, ch
/tʃ/
ch, tch, t
/ʒ/
s, si, ge

Fonemas vocálicos (12 monotongos + 8 ditongos = 20 no total)

Example words
/æ/
cat, hand
/e/
bed, bread
/ɪ/
sit, gym
/ɒ/
hot, want
/ʌ/
cup, son
/ʊ/
put, book
/ə/
about, teacher (the "schwa", English's most common sound)
/iː/
sheep, key
/ɑː/
car, father
/ɔː/
door, law
/uː/
moon, blue
/ɜː/
bird, nurse
/eɪ/
day, rain
/aɪ/
my, light
/ɔɪ/
boy, coin
/aʊ/
cow, house
/əʊ/
go, boat
/ɪə/
here, deer
/eə/
hair, bear
/ʊə/
tour, pure
Type
/æ/
short vowel
/e/
short vowel
/ɪ/
short vowel
/ɒ/
short vowel
/ʌ/
short vowel
/ʊ/
short vowel
/ə/
short vowel
/iː/
long vowel
/ɑː/
long vowel
/ɔː/
long vowel
/uː/
long vowel
/ɜː/
long vowel
/eɪ/
diphthong
/aɪ/
diphthong
/ɔɪ/
diphthong
/aʊ/
diphthong
/əʊ/
diphthong
/ɪə/
diphthong
/eə/
diphthong
/ʊə/
diphthong

Os símbolos seguem o sistema do inglês britânico (RP), usado na maioria dos currículos de fonética; as análises do inglês americano geral diferem ligeiramente nas vogais róticas.

Qual é a diferença entre um fonema e um grafema?

Um fonema é um som, enquanto um grafema é a representação escrita desse som. Um grafema pode ter uma letra (c-a-t), duas letras (um dígrafo, como sh ou ea), três (igh em “night”) ou quatro (ough em “though”).

A falta de correspondência entre fonemas e grafemas é o que torna a ortografia do inglês notoriamente difícil. Por exemplo:

  • Um fonema, muitos grafemas: o som /iː/ pode ser escrito ee (sheep), ea (leaf), e (be), ey (key), ie (chief) ou ei (ceiling).
  • Um grafema, muitos fonemas: as letras ough representam fonemas diferentes em “through” (/uː/), “though” (/əʊ/), “tough” (/ʌf/) e “thought” (/ɔː/).

Embora o inglês tenha 44 fonemas, ele usa mais de 200 grafemas para escrevê-los. Se você pensar em uma língua mais fonética, como o espanhol, em que o mapeamento é quase de um para um, o inglês se torna extremamente complexo de falar e transcrever. É também por isso que um modelo de Text to Speech não pode simplesmente ler as letras em voz alta, como veremos em breve. 

Comparison of English what is a phonemes and graphemes highlighting spelling complexity.

Fonemas vs. alofones

Alofones são pronúncias variantes do mesmo fonema que não mudam o significado da palavra. Se não houver um par mínimo em que um fonema crie duas palavras diferentes, trata-se de um alofone.

Por exemplo, o /p/ em “pat” soa diferente da versão não aspirada em “spat”. São sons diferentes, mas nenhum par de palavras em inglês se distingue apenas por essa aspiração, o que significa que os falantes de inglês os ouvem como essencialmente o mesmo som. Em outras línguas, como o tailandês, a diferença entre /p/ aspirado e não aspirado cria fonemas separados que distinguem completamente as palavras.

Isso significa que o que conta como fonema é totalmente específico de cada língua. Trata-se do efeito dos sons no significado das palavras, e não apenas de acústica. 

Como os fonemas viabilizam o Text to Speech

Todo sistema de Text to Speech precisa resolver o mesmo problema que o cérebro resolve ao ler em voz alta: converter grafemas em fonemas antes de falar. A conversão de grafema para fonema (G2P) é notoriamente difícil e é nela que muitos sistemas básicos cometem erros em TTS.

O texto pode ser ambíguo. A mesma palavra, “read”, pode ser /riːd/ no presente e /red/ no passado. Alguns nomes próprios, como nomes de marcas ou termos técnicos, podem nem seguir regras de escrita padrão. Modelos modernos de IA, como o Eleven v3, usam o contexto para resolver a maioria desses casos, mas você também pode controlar os fonemas com mais precisão para garantir a pronúncia:

  • Dicionários de pronúncia: Defina como cada palavra deve ser falada em todo um projeto. Ideal para nomes de marcas, personagens, termos médicos ou vocabulário específico da empresa que aparece repetidamente.
  • Tags de fonema SSML e IPA: Você pode controlar a pronúncia no nível da palavra com tags de fonema SSML nos modelos v2 ou escrevendo palavras diretamente com as tags de áudio do Eleven v3.

A mesma camada fonêmica também funciona na direção oposta. Para Speech to Text, os modelos precisam aprender padrões acústicos para mapear sequências de fonemas antes de reuni-las em palavras. A compreensão fonêmica é o que permite transcrever uma palavra que talvez nunca tenham visto antes.

Explanation of phonemes in text-to-speech, highlighting pronunciation differences and tools.

Como usar fonemas para aprender idiomas

Um dos principais motivos pelos quais uma pessoa pode querer saber mais sobre fonemas é que eles são extremamente úteis para aprender idiomas. A capacidade de uma criança de ouvir ou identificar fonemas individuais desde cedo influencia diretamente a aquisição posterior de conhecimentos fonológicos e a produção linguística durante toda a adolescência.

Ao aprender uma nova língua, seu cérebro precisa processar fonemas que seu ouvido nunca foi treinado para ouvir. Veja algumas estratégias práticas para usar fonemas e melhorar o aprendizado de idiomas:

  • Aprenda os símbolos do IPA: O Alfabeto Fonético Internacional aparece nos dicionários para mostrar como pronunciar cada palavra. Aprender IPA significa que você sempre saberá como ler uma palavra, mesmo ao vê-la pela primeira vez.
  • Ouça e imite os fonemas: Diminua a velocidade da fala para identificar cada fonema de uma língua e imitá-lo. Isso ajuda a criar um contexto sobre como pronunciar cada som e é mais eficaz do que repetir frases inteiras ao aprender idiomas.
  • Use pares mínimos para aperfeiçoar a pronúncia: Pares mínimos têm apenas uma mudança de fonema entre si. Praticar esses exemplos na fala ajuda a treinar sua língua e seu ouvido para reconhecer e reproduzir até mudanças sutis entre idiomas.

As ferramentas de voz IA também facilitaram muito o aprendizado de idiomas. Com um gerador de Text to Speech, você pode ouvir qualquer palavra ou frase em uma voz com sonoridade nativa, em dezenas de idiomas e diversos sotaques regionais. 

Experimente o Text to Speech da ElevenLabs no nível dos fonemas

Seja para explorar a fonética de um novo idioma ou aperfeiçoar sua língua materna, entender bem os fonemas é fundamental para dominar uma expressão eficaz e articulada. Mas uma compreensão acadêmica da linguística não é a única forma de nós, humanos, aprendermos idiomas. Também aprendemos ouvindo e imitando. 

Ferramentas de geração de Text to Speech são valiosas para desenvolver a consciência fonêmica e criar uma compreensão intuitiva de unidades sonoras, palavras inteiras e outros sons naturalmente presentes na comunicação falada.

Comece com a poderosa tecnologia de Text to Speech da ElevenLabs ou conheça mais sobre nosso conjunto de ferramentas criativas hoje.

Perguntas frequentes

Artigos relacionados

Crie com o áudio de IA da mais alta qualidade