O alfabeto português e aquelas 20 letras que todo mundo esquece
A maioria das pessoas acha que o alfabeto tem 26 letras. Tem, sim. Mas na prática, o português brasileiro trabalha quase exclusivamente com 20 delas. As outras seis — K, W, Y — entram por acaso, em nomes estrangeiros, siglas e regiões limítrofes. Esse detalhe faz diferença quando você configura um sistema, monta uma lista de validação ou precisa explicar para alguém por que certas palavras não existem no nosso idioma. Fui encarregado de padronizar um formulário de cadastro para uma rede de farmácias. Tinham milhares de registros com nomes contendo K e W porque os fornecedores usavam a grafia original de marcas importadas. O sistema só aceitava as 20 letras do alfabeto padrão. Tive que decidir se normalizava tudo para A, E, I, O, U ou criava um campo extra. Normalizei, depois fiz um relatório de inconsistências e mandei pro time de engenharia ajustar a validação no próximo sprint. Demorou uns dois dias. O problema real era que ninguém tinha pensado nisso antes do deploy.
20 letra do alfabeto — como funciona na prática
O alfabeto português é formado por 26 letras, mas o uso efetivo gira em torno de 20. As letras essenciais são: A, B, C, D, E, F, G, H, I, J, L, M, N, O, P, Q, R, S, T, U, V, X, Z.
Espera, deixei passar algo? Deixei de fora K, W e Y. Essas são as ausentes intencionais. A gente também poderia listar todas, mas aí a pergunta perde o sentido. O cerne é que K, W e Y não pertencem ao vocabulário nativo do português e aparecem em contextos muito específicos. K entra em nomes de família alemães e sulinos, em palavras como "kit", "karatê" e "kamikaze", e em estados como Rio Grande do Sul onde sobrenomes como "Koppers" são frequentes. Antes da Reforma Ortográfica, "k" era oficialmente parte do alfabeto; depois passou a ser considerado letra opcional. Na prática, muitos dicionários ainda registram a forma com K como variante.
👉 Clique no botão abaixo para saber mais sobre o assunto!
W e Y seguem a mesma lógica. Entram em nomes como "William", "Washington", "James Watt", em unidades de medida como "watt" e "yard", e em letras de músicas e nomes artísticos. Não são proibidas, só excepcionais. Um detalhe que pouca gente leva a sério: o til (~) e os acentos (á, ã, ê) não contam como letras separadas. Eles modificam vogais existentes. Isso causa confusão em planilhas e querys SQL onde alguém tenta contar caracteres acentuados como se fossem distintos. Use normalize NFC no banco se precisar de consistência.
Outro ponto que gera dor de cabeça é a distinção entre C e Ç. A cedilha não é uma letra nova; é uma variação gráfica do C. Em sistemas de ordenação alfabética, Ç geralmente é tratado como C, o que pode quebrar ordenações esperadas em relatórios. Se você usa sort padrão em Python ou Java, vai precisar de uma regra customizada para que "açúcar" venha depois de "acácia" e não junto com os C normais. Se quiser uma referência rápida e confiável, a base oficial está no Acordo Ortográfico de 1990, em vigor desde 2009 no Brasil. Não tem link direto para download porque o texto é de domínio público e está disponível no site da Imprensa Nacional e na página da Presidência. Para fins práticos, qualquer dicionário Houaiss ou Michaelis atualizado serve como fonte de consulta.
Se sua necessidade for diferente — tipo validar CPF, gerar senhas, ou montar uma tabela ASCII específica — as regras mudam. Mas para o alfabeto em si, o caminho mais direto é aceitar as 20 letras padrão e tratar K, W, Y como entradas especiais documentadas. Isso evita surpresas quando o usuário digitar um nome estrangeiro e o sistema rejeitar.