A contagem real de fonemas em excesso
A palavra "excesso" tem 7 fonemas na maioria dos variantes do português brasileiro. A transcrição fonêmica básica fica /e'ksesu/. Vou explicar como chego nisso, porque a resposta não é tão simples quanto parece quando você trabalha com processamento de fala ou desenvolvimento de sistemas de texto-para-fala.
excesso tem quantos fonemas
O primeiro engano comum é confundir letras com fonemas. "Excesso" tem 7 letras, mas a relação grafema-fonema em português nunca é 1:1. O "xc" aqui funciona como um digrafo que se desdobra em dois fonemas: /k/ + /s/. O "s" duplo no meio também contribui com dois fonemas distintos, mesmo na escrita. Na prática, a análise segmental fica: vogal átona inicial /e/, oclusiva velar /k/, fricativa alveolar /s/, vogal tônica /e/, mais duas fricativas /s/ e /s/, e por fim a vogal posterior /u/ (que vem do "o" final). A sílaba tônica recai no segundo "e", então temos a marca de acento prosódico /e'ksesu/.
👉 Clique no botão abaixo para saber mais sobre o assunto!
Eu já vi pessoas contestando esse resultado porque acreditavam que o "o" final deveria ser contado como /o/. Em português europeu padrão, essa afirmação tem mais fundamento. No português lusitano, realmente pode-se encontrar [e'kses] ou variações próximas. Mas no Brasil, especialmente nas regiões sul e sudeste, a tendência é a centralização ou fechamento para /u/, o que justifica meu exemplo anterior. Um problema que encontrei desenvolvendo um módulo de normalização fonológica para um TTS foi justamente essa variação. Minha primeira versão assumia automaticamente a pronúncia padrão brasileira e gerava [e'ksesu]. Quando testei com falantes portugueses, o sistema soava artificialmente "estrangeirizado". A solução foi implementar um detector de variante dialectal baseado em features morfossintáticas e vocabulares do texto de entrada, depois aplicar regras de realinhamento fonêmico específicas. Economizei horas de retrabalho que teria gasto ajustando cada palavra manualmente.
Aqui vai um insight que pouca gente leva a sério: a análise fonêmica depende fortemente do nível de representação que você escolhe. Num nível estritamente fonêmico abstrato, alguns linguistas argumentam que o "s" duplo de "excesso" deveria ser analisado como um único fonema /s/ alongado, não como dois fonemas separados. Isso muda o resultado para 6 fonemas em vez de 7. A escolha depende se você adota uma visão morf fonológica ou estritamente fonológica. O mesmo vale para a vogal final. Em análises mais abstratas, o "o" pode ser representado como /o/ mesmo quando realizado foneticamente como [u], considerando que a alternância é previsível e regulada por regras fonológicas conhecidas do português. Se você fizer essa análise, terá /e'kses/o/, mantendo 7 segmentos mas justificando a variação fonética de outra forma.
A desvantagem óbvia é que diferentes escolas fonológicas chegam a resultados diferentes para a mesma palavra. Não existe um consensus absoluto. Se você precisa de um padrão para uso prático, recomendo seguir a convenção do Voz do Brasil ou da Nova Gramática do Português Contemporâneo, que tendem a optar pela análise com 7 fonemas para variedades brasileiras. Caso contrário, seus dados podem ficar inconsistentes dependendo da fonte consultada. Para aplicações computacionais, o mais seguro é trabalhar com uma representação intermediária que permita mapear fonema a realização fonética conforme o contexto dialectal. Isso evita que você precise decidir entre 6 ou 7 fonemas durante a fase de desenvolvimento e permite ajustes posteriores sem refazer todo o pipeline.