Como criar bonecas com olhos grandes usando geração por IA
Achei que era só botar "boneca com olhos grandes" num gerador e pronto. Errei. O processo é bem mais chato do que parece quando você tenta controlar os resultados.
Escolhendo a ferramenta certa
A maioria das ferramentas de geração de imagem funciona bem para isso, mas Stable Diffusion com checkpoints finetunados em estilo anime/doll dá o melhor controle. Eu testei vários: Midjourney, DALL-E, Leonardo AI. Cada um tem um viés diferente. O Midjourney tende a deixar tudo muito "bonito demais", com iluminação de catálogo de brinquedo. O Stable Diffusion roda lento no meu hardware mas permite ajuste fino real. O modelo que eu uso agora é o Anything V5 combinado com um LoRA de estilo doll. Rodando numa RTX 4090, cada geração leva uns 8 segundos em 512x512. Se você aumentar a resolução depois via upscaling, o tempo dobra.
O prompt que funciona na prática
Aqui está o que eu descobri testando por semanas. Comece assim: 1girl, doll, big eyes, shiny eyes, porcelain skin, detailed face, full body, white background, anime style, masterpiece quality
Mas o prompt sozinho não resolve. O problema real é que a IA tende a distorcer os olhos se você for muito direto. Já fiquei horas tentando gerar uma boneca com olhos grandes e o resultado sempre vinha com simetria quebrada ou pupils descentrados. A solução que encontrei foi adicionar symmetrical face, perfectly centered eyes ao prompt e usar o recurso of image padding no SD WebUI, gerando em 768x1024 em vez de 512x512. Isso dá mais espaço vertical para os olhos ficarem proporcionais sem esticar. Também ajusto o CFG scale pra 7 em vez do padrão 10. Em CFG alto, os olhos ficam com brilho excessivo e aspecto de plástico derretido. Com 7, o resultado é mais suave e natural.
ControlNet para simetria e pose
Se você quer a boneca em pose específica, o ControlNet com modelo openpose é essencial. Eu já tentei gerar sem ele e sempre acabava com membros tortos e olhos fora do lugar porque a rede não respeitava a estrutura facial correta. O passo que todo mundo pula: use depth map junto com o openpose. Assim a IA entende a profundidade do rosto e mantém os olhos grandes sem achatá-los contra o plano da imagem. Sem isso, os olhos parecem colados numa superfície plana.
👉 Clique no botão abaixo para saber mais sobre o assunto!
Upscaling e pós-processamento
Gerar em alta resolução direto gasta muita VRAM. O jeito certo é gerar em 512x512 ou 768x1024, depois upsclear com o modelo 4x-UltraSharp no ADetailer. O ADetailer também corrige rostos automaticamente — em 90% dos casos ele melhora a simetria dos olhos sem você precisar refazer a geração. Eu costumo gastar entre 10 a 20 tentativas por boneca final. O tempo total de um projeto completo, desde o prompt até a imagem pronta, fica entre 20 e 45 minutos dependendo da complexidade da pose e do nível de detalhe que você exige.
Problemas comuns e soluções
Dois erros que aparecem sempre: Olhos com brilho duplo — a IA adora colocar dois reflexos brancos em cada olho. Se quiser um visual mais realista, adicione single pupil reflection, subtle eye shine ao prompt. Se quiser o visual anime clássico, deixe dois reflexos mas adicione perfectly round pupils para evitar deformações.
Pele com textura de plástico — muitos checkpoints "doll" vem com skin texture muito lisa, tipo vinil. Se você quer algo menos artificial, adicione soft skin texture, subtle pores e reduza o weight do LoRA doll de 1.0 para 0.7. O resultado perde um pouco do aspecto "boneca" mas ganha credibilidade visual. O problema mais frustrante que eu enfrentei foi com tons de pele. Sempre que pedia pele morena ou negra, a IA ora clareava demais ora escurecia até perder os detalhes dos olhos. A workaround que funcionou foi separar: gerar primeiro o rosto em tons claros com os olhos bem definidos, depois usar inpainting local para ajustar o tom da pele sem mexer nos olhos. Leva mais tempo mas evita refazer a geração inteira.
Recursos e downloads
Os checkpoints e LoRAs que eu recomendo estão disponíveis no Civitai — busque por "doll eyes" e "anime girl" com maior número de favores. O Anything V5 está em versão 5.1, que é a mais estável. Para o ControlNet, use a versão openpose da network da ControlNet oficial no GitHub. A interface WebUI mais prática é o NovelAI Diffusion WebUI (fork do AUTOMATIC1111) com extensões de doll/anime já configuradas. Instalação leva uns 30 minutos se você já tiver Python e Git instalados.
Se você está começando do zero, não tente fazer tudo de uma vez. Gere primeiro apenas o rosto em close, acerte os olhos, e só depois expanda para corpo inteiro. Isso economiza tempo de GPU e evita frustração.