O alfabeto português e o que acontece com as letras "excluídas"
O alfabeto oficial da língua portuguesa tem 26 letras desde o Acordo Ortográfico de 1990, que entrou em vigor no Brasil em 2009. Antes disso, o alfabeto tinha apenas 23 letras: A a, B b, C c, D d, E e, F f, G g, H h, I i, J j, L l, M m, N n, O o, P p, Q q, R r, S s, T t, U u, V v, X x, Z z. As letras K, W e Y simplesmente não existiam na versão anterior. Isso significa que, para quem cresceu estudando o alfabeto de 23 letras, essas três parecem ter aparecido do nada. A sensação é de incompletude mesmo, porque todo mundo decora o alfabeto na escola e depois, anos mais tarde, descobre que havia letra de sobra nessa lista. O problema prático é que a maioria dos materiais didáticos, canções e flashcards ainda usa a versão antiga, então boa parte das pessoas nunca viu uma lista oficial atualizada nas primeiras séries do ensino fundamental.
Complete o alfabeto com as letras faltosas
A versão completa do alfabeto português, com todas as 26 letras, é esta: A a / B b / C c / D d / E e / F f / G g / H h / I i / J j / K k / L l / M m / N n / O o / P p / Q q / R r / S s / T t / U u / V v / W w / X x / Y y / Z z
As letras que antes estavam faltando são K, W e Y. Elas foram incorporadas oficialmente pelo acordo ortográfico para dar suporte a palavras de origem estrangeira, símbolos unitários e nomes próprios internacionalizados. Na prática, o efeito foi pequeno: a maioria dos textos em português nem se dá conta dessas letras. Mas em documentos oficiais, cadastros e sistemas que exigem ordenação alfabética rigorosa, a ausência delas causava problemas reais. Eu trabalhei com um sistema de cadastro governamental em que os campos de nome precisavam ser ordenados alfabeticamente. Quando migraram para a nova ordem, todos os relatórios que exportavam em CSV ficavam confusos porque a tabela ASCII pura coloca K antes de L, mas a ordem alfabética brasileira deveria manter a sequência correta. O workaround foi simples: usei a biblioteca locale do Python com pt_BR.UTF-8 para fazer a ordenação correta, e não a ordenação padrão do locale C. Isso resolveu em questão de minutos o que teria gerado horas de ajustes manuais em planilhas.
Por que essas letras existem e onde aparecem
Existem várias razões pelas quais K, W e Y permaneceram fora do português por tanto tempo. A primeira é histórica: o alfabeto latino chegou ao português medieval sem necessidade desses grafemas porque as línguas ibéricas tinham sons correspondentes representados por outras combinações. O som /k/ era escrito com C ou Q. O som /w/ era aproximado com U ou V. E o som /j/ ou /i/ era coberto por I ou Y em alguns casos isolados. Mas com a globalização e a padronização científica, manter um alfabeto incompleto ficou inviável. Unidades de medida como quilograma (kg), watts (W) e yen (¥) exigem K, W e Y respectivamente. Marcas estrangeiras, nomes de ruas em zonas turísticas, e até nomes de pessoas com origens não lusófonas tornaram-se comuns. O acordo de 1990 simplesmente reconheceu essa realidade em vez de continuar fingindo que não existia.
👉 Clique no botão abaixo para saber mais sobre o assunto!
Há um detalhe importante que poucos consideram: mesmo com K, W e Y agora oficiais, elas continuam sendo as letras menos frequentes do português. Em qualquer corpus grande, essas três aparecem muito abaixo de E, A, O e S. Isso significa que teclados, digitação preditiva e sistemas de reconhecimento de voz que fazem otimizações baseadas em frequência raramente dão atenção a elas. Se você trabalha com processamento de linguagem natural em português, ignore isso e seu modelo vai ter desempenho ruim com nomes próprios e termos técnicos.
O que ninguém te conta sobre a ordem alfabética brasileira
Um erro comum é assumir que a ordem alfabética brasileira é idêntica à inglesa. Não é. A ordem padrão no Brasil segue o alfabeto latino completo, o que significa que K vem antes de L, W antes de X, e Y antes de Z. Mas muitos sistemas legados, especialmente aqueles desenvolvidos antes de 2009, ainda usam uma ordem customizada que remove K, W e Y da sequência ou os trata como equivalentes de outras letras. Isso gera problemas sérios em bancos de dados e registros oficiais. Outro ponto negligenciado são os dígrafos. O português tem combinações como LH, NH, CH, SS, RR, SS, e os acentos e trema (embora o trema tenha sido abolido em 2009) que frequentemente confundem ordenadores inexperientes. A ordem correta não leva acentos em conta para fins de classificação alfabética — uma palavra como "oração" vem antes de "obrador" independentemente do acento. O mesmo vale para K, W e Y: elas são letras plenas, não variantes de outras.
Se você precisa verificar se um sistema está usando a ordem correta, faça um teste rápido. Coloque palavras como "kilo", "watt", "year" e "xenon" em uma ordenação alfabética. Se K não vier antes de L, se W não vier antes de X, e Y não vier antes de Z, o sistema está usando uma ordem desatualizada ou customizada. Corrigir isso varia de um ajuste de configuração do banco de dados até uma migração completa, dependendo da infraestrutura.
Alternativas e quando usar cada uma
Não há alternativa real para o alfabeto completo de 26 letras se você precisa de conformidade com o padrão atual. No entanto, para sistemas antigos que não suportam ordenação correta, existe uma saída pragmática: usar uma tabela de mapeamento que associa K a C, W a U/V, e Y a I, mantendo compatibilidade retroativa. Isso funciona bem para buscas e indexação interna, mas não deve ser usado em documentos oficiais ou publicações formais. Para a grande maioria dos casos — escola, comércio, documentação pessoal — basta saber que K, W e Y fazem parte do alfabeto oficial brasileiro e tratá-las como quaisquer outras letras. A lista completa com as letras faltosas é fácil de encontrar e não requer configuração especial em nenhuma plataforma moderna.