Como descobrir o que esses dois textos falam sobre em comum
Achar o tema central de dois textos diferentes não é tão simples quanto selecionar palavras-chave e torcer. Na prática, o processo exige uma leitura ativa de ambas as fontes, identificação de conceitos sobrepostos e descarte do ruído. A maior parte das pessoas falha nessa etapa porque tenta forçar uma relação que não existe ou termina com uma generalização vaga como "falam sobre tecnologia", que na verdade não serve para nada. O primeiro passo é ler cada texto separadamente e sublinhar as ideias principais, não as palavras isoladas. Ideias são frases como "a regulamentação de dados pessoais ainda é incerta no Brasil" ou "o custo de migração para nuvem sobe 30% no segundo ano". Palavras soltas como "regulamentação" ou "custo" não carregam informação suficiente para fazer uma análise comparativa. Anote pelo menos três ideias de cada texto antes de avançar.
O que esses dois textos falam sobre: a interseção real
Depois de listar as ideias de ambos, cruze os conteúdos procurando interseções. Existem três tipos de relacionamento possível entre dois textos: sobreposição direta, tema-raiz compartilhado e relação tangencial. Sobreposição direta significa que os dois textos tratam exatamente do mesmo assunto com enfoques diferentes. Tema-raiz é quando os textos parecem falar de coisas distintas, mas um conceito mais amplo engloba ambos. Relação tangencial é quando há uma conexão tênue, muitas vezes forçada, e nesse caso é honesto dizer que não há um tema central forte em comum. No meu caso, trabalhei recentemente com dois relatórios setoriais que pareciam completamente desconectados à primeira vista. Um tratava de métricas de conversão em e-commerce e o outro analisava mudanças regulatórias na Lei Geral de Proteção de Dados. A maioria das ferramentas automatizadas que testei respondeu "falam sobre negócios e legislação", que é uma resposta tecnicamente correta mas absolutamente inútil. O que esses dois textos falam sobre, na verdade, era a adaptação de modelos de receita digital aos novos requisitos de consentimento do usuário. Cheguei a essa conclusão isolando os parágrafos que mencionavam "dados do consumidor", "trajetória de compra" e "conformidade", e percebendo que o recorte estratégico comum era exatamente esse.
👉 Clique no botão abaixo para saber mais sobre o assunto!
Para fazer esse cruzamento de forma mais eficiente, recomendo o método de espinha dorsal. Resuma cada texto em uma única frase que capture sua tese central. Se as duas frases puderem ser unidas por uma conjunção como "porque", "embora" ou "e", você encontrou a conexão. Se precisar de três frases para justificar a relação, a conexão é fraca demais e provavelmente não vale a pena forçá-la. Há ferramentas que ajudam nesse processo, como algoritmos de similaridade textual baseados em embeddings vetoriais, que convertem trechos de texto em vetores numéricos e calculam a distância angular entre eles. A precisão varia muito dependendo do domínio. Para textos técnicos e acadêmicos, esses sistemas costumam acertar em cerca de 70 a 80 por cento dos casos. Para conteúdo jornalístico ou opinativo, o índice de erro sobe consideravelmente porque o tom e a intenção nem sempre refletem o conteúdo factual. Uma alternativa mais confiável para textos longos e complexos é usar combinação de extração automática com validação humana, onde o algoritmo sugere os trechos em comum e um revisor confirma se a interseção faz sentido contextual.
Um problema frequente é o viés de confirmação. Quando você já tem uma ideia do que espera encontrar nos dois textos, tende a ignorar trechos que contradizem essa hipótese e destacar apenas o que parece encaixar. Isso é especialmente perigoso em análises para decisões empresariais, onde uma leitura tendenciosa pode levar a estratégias mal fundamentadas. Para mitigar isso, faça o exercício inverso: tente argumentar que os dois textos NÃO têm um tema em comum. Se você não conseguir montar um argumento razoável nessa direção, a interseção provavelmente é sólida. A densidade informacional do seu resultado final depende diretamente da qualidade das frases que você extraio de cada texto. Frases genéricas como "o mercado está em transformação" não geram valor. Frases com dados específicos, recortes temporais e contextos claros produzem análises muito mais úteis. Sempre que possível, preserve números, prazos e nomes próprios nas suas anotações preliminares.
Se os dois textos forem extremamente longos, como manuais técnicos ou livros inteiros, o método manual perde eficiência rapidamente. Nesse cenário, o uso de modelos de linguagem para sumarização ajuda a reduzir o volume, mas exige verificação cuidadosa porque resumidores automáticos frequentemente omitem nuances importantes. O ideal é usar o resumo como ponto de partida, não como produto final. A prática constante melhora significativamente a velocidade desse tipo de análise. Quem faz esse cruzamento com frequência consegue identificar interseções relevantes em quinze a vinte minutos para textos de tamanho médio, enquanto iniciantes podem levar mais de uma hora e ainda assim produzir conclusões superficiais. O ganho não vem de atalhos técnicos, mas de desenvolver o hábito de ler ativamente e de questionar continuamente se a conexão encontrada realmente sustenta uma análise mais profunda ou se é apenas um achismo bem vestido.