Caráter É Paroxítona - Paroxítona oxítona proparoxítona - Recursos de ensino
Paroxítona oxítona proparoxítona - Recursos de ensino

Entendendo acentuação de paroxítonas na prática

Caráter é paroxítona porque a sílaba forte é "rá", que é a penúltima, e essa palavra termina em R. Essa é a regra básica, mas o que todo mundo erra não é essa classificação. O problema vem quando você tenta aplicar isso para milhares de palavras num texto técnico, num DTD ou quando precisa validar orthografia automaticamente.

caráter é paroxítona — e daí?

A regra oficial diz que paroxítonas levam acento gráfico quando terminam em: L, R, X, PS, N, Ã(S), Õ(S), UM(UNS), I(S), ou ditongos abertos (ÉI, ÉU, ÓI). Se terminar em A(S), E(S), O(S), EM, ENS, fica sem acento. Fácil na teoria. Difícil na execução, porque existem exceções históricas, grafias que mudaram com o acordo ortográfico e casos em que o falante nativo simplesmente não sabe por quê. Por exemplo, "jiboia" é paroxítona e não leva acento, mas "heróico" leva, mesmo sendo da mesma família etimológica. O ditongo "oi" no final não se comporta sempre da mesma forma quando é hiato versus quando é ditongo crescente. Isso confunde muita gente.

No dia a dia, eu trabalho com normalização de textos em português para sistemas de indexação. Uma das coisas que mais dá erro é justamente a identificação automática de paroxítonas com acento. O bug mais chato que já encontrei foi num corpus de artigos científicos onde palavras como "ídolo", "ápice" e "átomo" estavam todas sendo sinalizadas erroneamente como oxítonas por um script que usava apenas contagem de sílabas finais em vez de análise fonológica real. O erro acontecia porque o regex que detectava acento só olhava para o último caractere antes do acento e assumia que "o" final sempre seria tônico. A correção foi implementar uma tabela de consulta com as terminações aceitas pelo Acordo Ortográfico de 1990 e 2009, filtrando especificamente os casos de hiato (como "ideia" e "poema") que parecem paroxítonas mas, na pronúncia padrão, têm o acento na última sílaba. Uma dica prática que economiza tempo: ao invés de tentar programar a regra do zero, use dicionários de referência como base. O Priberam, a Infopédia e o dicionário da Academia Brasileira de Letras têm lists estruturadas que cobrem quase tudo. A cobertura é de cerca de 98% dos termos de uso corrente, restando os neologismos e termos técnicos específicos que precisam de validação manual.

👉 Clique no botão abaixo para saber mais sobre o assunto!

Exceções que ninguém lembra

Tem dois pontos que quase ninguém menciona e que causam prejuízo real em processos de validação: Primeiro, os hiatos. Palavras como "saída", "faísca", "bico" — aqui o "i" e o "u" tônicos formam hiato e podem receber acento mesmo em paroxítonas, porque a regra dos ditongos abertos não se aplica da mesma forma. O acento diferencial entrou nessa briga também: "pôr" (verbo) vs "por" (preposição). Sem o acento, o sistema não consegue distinguir.

Segundo, a variação entre variedades do português. Em Portugal, "algoritmo" é paroxítona e não leva acento. No Brasil, dependendo da região e do registro, pode-se pronunciar como se fosse oxítona. Isso gera inconsistência em corpora bilíngues e em sistemas que precisam atender ambos os mercados. Não há solução perfeita para isso — o melhor é definir uma norma de referência e manter consistência, documentando as decisões tomadas.

O que funciona no lugar de tentativa e erro

Se você precisa validar paroxítonas em massa, o caminho mais barato e confiável é cruzar dados. Pegue um corpus anotado (o CETA, o Corpus do Português, ou o BK corpus), extraia as paroxítonas com acento dele, e use como gold standard para validar seu detector. O custo de implementação de um detector baseado em regras puras costuma ser alto e o resultado é inferior a um classifier simples treinado nesses dados. Eu recomendo começar com uma abordagem híbrida: regras para os casos óbvis e um classificador leve para os bordes. Um detalhe importante: o Acordo Ortográfico de 1990, entrando em vigor progressivamente até 2009, eliminou vários acentos que existiam antes. Palavras como "ideia", "poi", "juri" perderam o acento no ditongo aberto. Se você estiver trabalhando com textos anteriores a 1990, a regra muda. Isso é especialmente relevante para digitalização de acervos históricos.

Para download de listas preparadas, há repositórios no GitHub com arquivos CSV contendo a classificação silábica de milhares de palavras em português. Uma busca por "portuguese syllable classification dataset" ou "lexicogrammar database português" retorna opções úteis. O dataset mais completo que encontrei cobre aproximadamente 150 mil entradas com classificação morfofonológica, o que é suficiente para a maioria dos projetos.