Por que o espaço depois da vírgula importa mais do que a maioria pensa
A maioria das pessoas não percebe até ter um documento estragado por culpa de uma regra simples. O espaçamento após a vírgula parece algo trivial, mas na prática ele define se um texto vai parecer profissional ou amador. Programas como Word colocam o espaço automaticamente quando você digita, mas ferramentas de automação, processamento de texto e geração de conteúdo muitas vezes ignoram isso completamente. Já vi relatórios inteiros com vírgulas coladas na palavra seguinte, criando uma visualização estranha que ninguém queria corrigir manualmente.
Como garantir o espaço depois da virgula
O processo básico funciona assim: você precisa encontrar todas as vírgulas que estão imediatamente antes de um caractere que não seja espaço, e inserir um espaço entre elas. Em Python, por exemplo, uma expressão regular simples resolve isso em linha de comando. O padrão `,(?=[^\s])` encontra vírgulas seguidas por qualquer coisa que não seja whitespace. A substituição troca cada match por `, `. Funciona para arquivos de texto puro, logs, scripts gerados automaticamente e até dados extraídos de sistemas legados onde o encoding quebrou a formatação original.
O problema real acontece quando você tem códigos numéricos decimais. No padrão brasileiro e europeu, vírgula é separador decimal. Se você aplicar a regex cegamente, vai transformar `1.234,56` em `1.234, 56`, quebrando todos os valores numéricos do arquivo. Isso aconteceu comigo em um script de ETL que processava exportações contábeis. O processo todo falhou silenciosamente porque os números viraram strings inválidas e a validação downstream não detectou. A solução foi ajustar a regex para excluir casos onde a vírgula está entre dígitos: `,(?=\d)` com lookahead negativo para contextos decimais, ou melhor ainda, tratar campos numéricos separadamente antes de aplicar a normalização geral.
Edge cases que destroem automações ingênuas
Além dos números decimais, existem outros cenários onde o espaço após a vírgula não é desejado ou precisa ser tratado de forma diferenciada. Listas em JSON têm vírgulas sem espaço após: `["a","b","c"]`. Aquiologar a transformação automática quebra a validade do arquivo. CSV também é um problema clássico, já que delimitadores de campo não precisam de espaço e muitos processadores falham se você inserir um.
Outro caso prático que encontrei recentemente envolvia textos gerados por modelos de linguagem. O próprio output vinha com vírgulas sem espaço em alguns fragmentos, especialmente quando o modelo estava respondendo em formato de lista ou código embutido no meio do parágrafo. A correção precisava ser seletiva: aplicar a normalização apenas nas partes de texto corrido, ignorando blocos de código e listas estruturadas. Usei uma abordagem de tokenização por blocos, identificando regiões de prose versus regiones de código pela presença de indentação e caracteres especiais, e apliquei a regex apenas onde fazia sentido tipográfico.
Herramenttas e métodos práticos
Para uso pessoal em documentos Word, a correção manual via substituição avançada é rápida. Ctrl+H com o padrão `,([^\s])` substituindo por `, $1` resolve na maior parte dos casos em segundos. No LibreOffice o comportamento é similar, mas o motor de regex é mais restritivo e às vezes exige configurações adicionais nas preferências de documentação.
Em linhas de comando, sed e awk são opções comuns, mas exigem cuidado com a sintaxe de lookahead, que nem sempre é suportada nativamente. O grep -P com Perl-compatible regex resolve melhor, ou então usar Python ou Node.js para um controle mais fino. Um script de uma linha em Python que eu uso frequentemente é:
```python
import re, sys
text = open(0).read()
print(re.sub(r'(?Limitações que ninguém menciona
Nenhuma automação dessa natureza é perfeita. O maior problema é contexto ambíguo. Uma vírgula em siglas como "E.U.A.," ou em abreviações técnicas pode cair em áreas cinzentas onde a regex não distingue uso tipográfico de uso estrutural. Também há o caso de aspas e travessões adjacentes a vírgulas, que em algumas formatações exigem regras específicas. E claro, a correção nunca é reversível com qualidade se o arquivo original foi perdido ou sobrescrito. Sempre mantenha backup antes de aplicar transformação em lote.
Se o seu trabalho envolve publicação editorial ou produção de conteúdo para impressão, considere usar um linter de tipografia dedicado, como o proselint ou ferramentas específicas para português. Eles reconhecem padrões de vírgula dentro de um contexto mais amplo de estilo e geralmente produzem menos falsos positivos do que expressões regulares genéricas.