Como manter o mesmo personagem em várias imagens de IA sem o rosto mudar
Danilo Gato
Autor
Resposta rápida
O rosto muda porque cada imagem gerada por IA é uma interpretação nova, sem memória da anterior, então o jeito de travar a identidade é mandar uma foto de referência e dizer explicitamente pra IA preservar aquele rosto, em vez de descrever as feições em texto (isso quase sempre piora, não ajuda). Cada ferramenta trata isso de um jeito: no Gemini (Nano Banana Pro) você anexa de 2 a 4 fotos de referência e escreve uma “trava de consistência” na frase; no GPT Image você edita a foto original em vez de gerar do zero; no Midjourney você usa o parâmetro --oref com peso --ow. Nenhuma das três é perfeita depois de muitas variações, e mãos costumam ser o primeiro detalhe a quebrar.
Por que o rosto muda a cada imagem que a IA gera?
Um modelo de geração de imagem não lembra da imagem anterior, mesmo dentro da mesma conversa. Cada novo pedido é processado quase do zero, a partir do texto (e da referência, quando você manda uma). Sem uma foto ancorando a identidade, a IA reconstrói um rosto plausível pra combinar com a descrição, e como a descrição nunca é 100% específica (ela não sabe exatamente o formato do seu queixo ou a distância entre seus olhos), o resultado varia a cada geração. É o mesmo motivo pelo qual pedir “a mesma pessoa de novo, mas sorrindo” costuma dar uma pessoa parecida, não a mesma pessoa.
O que NÃO resolve (e todo mundo tenta primeiro)
Antes das técnicas que funcionam, vale economizar seu tempo com o que geralmente NÃO funciona:
- Descrever o rosto em mais detalhe. “Olhos castanhos, nariz fino, sobrancelha grossa” não trava identidade, só adiciona restrições vagas que a IA interpreta de um jeito novo a cada vez. Pior: se você também anexou uma foto de referência, descrever o rosto em texto pode CONTRADIZER a referência e a IA prioriza o texto, ignorando a foto.
- Pedir “parecido com a pessoa da referência”. Frases vagas de semelhança (“faça parecido”, “mesma pessoa”) são fracas justamente por não serem uma instrução de preservação, é um pedido de interpretação livre.
- Usar uma referência de baixa qualidade ou com ângulo estranho. Foto de perfil, com sombra forte no rosto ou resolução baixa, dá menos informação pra IA reconstruir os traços, então o resultado varia mais.
- Gerar de novo do zero repetidas vezes esperando “acertar”. Sem mudar a técnica, cada nova tentativa é só mais uma interpretação nova, não uma correção da anterior.
Como fazer no Gemini (Nano Banana Pro)
O Nano Banana Pro (modelo de imagem do Gemini 3 Pro) foi feito pra isso: segundo o anúncio oficial do Google, ele consegue misturar até 14 imagens numa composição mantendo a identidade de até 5 pessoas ao mesmo tempo. Pra um único personagem, o funcionamento prático é mais simples:
- Mande de 2 a 4 fotos de referência, priorizando uma frontal, com boa luz e sem obstrução no rosto. Fotos de ângulos e expressões diferentes ajudam mais que várias fotos parecidas.
- Escreva uma frase de “trava de identidade” explícita no prompt, tipo: “mantenha o rosto exatamente como na imagem de referência, sem alterar feições”. Isso pesa mais do que você imagina.
- Não descreva o rosto. Deixe a referência falar sozinha. Descreva só o que muda: roupa, cenário, pose, luz.
- Espere degradação depois de várias edições em sequência. Mãos e dedos costumam ser o primeiro detalhe a sair errado depois de 5 ou mais gerações encadeadas a partir da mesma base. Se as mãos aparecem na cena, descreva a posição delas explicitamente em vez de deixar a IA decidir.
Como fazer no GPT Image
O GPT Image (gpt-image-2, da OpenAI) trata isso de um jeito diferente: em vez de “gerar do zero olhando pra uma referência”, ele funciona melhor quando você literalmente edita a imagem original.
- Use o modo de edição, não geração nova, quando quiser manter o mesmo enquadramento e só mudar um detalhe (roupa, fundo, expressão). O modelo preserva os detalhes da imagem de entrada automaticamente, sem um controle de intensidade pra ajustar, ele sempre tenta manter o máximo possível.
- Quando precisar de uma pose ou corpo totalmente diferente, edição direta tende a “colar” demais na composição original. Nesse caso, uma técnica que funciona bem é recortar só o rosto da referência (ou montar um grid só com o rosto em ângulos diferentes) e pedir uma fotografia nova, não uma edição, deixando claro que é uma cena nova com aquela pessoa.
- Fidelidade alta é o padrão, então cuidado com referências que têm algo que você NÃO quer manter (uma marca d’água, um objeto no fundo): o modelo tende a preservar isso também.
Como fazer no Midjourney
O Midjourney mudou a forma de fazer isso na versão 7: o parâmetro antigo --cref (character reference) não é mais o caminho recomendado nessa versão, foi substituído pelo Omni-Reference.
- Sintaxe: adicione
--oref <link da imagem>no fim do prompt, com a imagem hospedada num link público. - Controle de intensidade:
--ow <valor>, de 1 a 1000 (padrão 100). Valores baixos (25 a 50) dão mais liberdade criativa preservando só o essencial; valores altos (400+) grudam bem mais na referência. - Referência de rosto de frente, expressão neutra funciona melhor que rosto de perfil ou com expressão forte.
- Detalhes miúdos não transferem bem: sardas específicas, logotipo de roupa e padrões complexos raramente saem idênticos sem edição manual depois.
Um modelo de prompt pra copiar e adaptar
Pra fechar com algo prático, aqui vai a estrutura de frase que costuma funcionar melhor nas três ferramentas, adaptando só a sintaxe de cada uma:
[o que muda: roupa, cenário, ação, iluminação]
+ trava de identidade: "mantenha o rosto e as feições exatamente
como na imagem de referência, sem alterar"
+ [parâmetro técnico da ferramenta, se houver: --oref/--ow no
Midjourney, ou anexar a referência direto no Gemini/GPT Image]
Exemplo aplicado (Gemini, com 2 fotos de referência anexadas): “a mesma pessoa da referência, de pé numa cozinha moderna, luz natural de janela lateral, expressão tranquila, mantenha o rosto e as feições exatamente como na referência, sem alterar.” Note que a frase não descreve nenhum traço físico novo, só o cenário e a pose, deixando toda a informação de identidade pra imagem anexada.
Perguntas frequentes
Como fazer a IA gerar a mesma pessoa em imagens diferentes?
Mande uma foto de referência de boa qualidade (de preferência mais de uma, com ângulos diferentes) e escreva uma instrução explícita de preservação de identidade, em vez de descrever o rosto em palavras. Cada ferramenta tem seu mecanismo: referência múltipla no Gemini, edição no GPT Image, --oref/--ow no Midjourney.
Por que o rosto muda mesmo usando uma foto de referência?
Geralmente por dois motivos: a referência tem qualidade baixa ou ângulo ruim, ou o prompt descreve o rosto em texto de um jeito que contradiz a referência, fazendo a IA priorizar a descrição em vez da imagem.
Como usar uma foto de referência pra manter o personagem?
Anexe a foto (ou fotos) diretamente na ferramenta, no campo de referência de imagem, não só descreva ela em palavras. E escreva no prompt uma frase clara pedindo pra preservar o rosto da referência.
Dá pra manter mais de uma pessoa consistente na mesma imagem?
No Nano Banana Pro sim, o modelo suporta até 5 pessoas com identidade preservada numa composição com até 14 imagens de referência ao todo. Nas outras ferramentas, o ideal é gerar cada personagem separadamente e compor depois, porque a consistência de múltiplas pessoas ao mesmo tempo ainda é o ponto mais frágil da maioria dos modelos.
Leia também
- Como escrever prompts: guia de engenharia de prompt
- Ângulos de câmera para prompt de imagem
- Iluminação e lente para prompt de imagem
A CPDF (Comunidade Profissionais do Futuro - por Danilo Gato) tem conteúdo gratuito sobre como usar IA generativa de imagem no dia a dia e no trabalho.
Leia também
Prompt negativo: como dizer para a IA o que ela NÃO deve fazer na imagem
Prompt negativo é campo real no Stable Diffusion e Midjourney (--no), mas não existe no GPT Image nem no Gemini. Veja o que fazer em cada um.
6 min de leituraia-para-investimentosIA para finanças pessoais e investimentos: as melhores ferramentas em 2026
IA generativa ajuda a organizar orçamento e entender investimentos — mas não substitui consultor. Prompts prontos e o que evitar.
6 min de leituraia-generativaExemplos de IA generativa: 20+ casos práticos por área em 2026
20+ exemplos reais de IA generativa por área — marketing, jurídico, educação, design — com prompt pronto pra copiar em cada um.
8 min de leituraTecnologia e IADr. Dre usa IA para produzir músicas, críticos temem aprender
Dr. Dre confirmou ao New York Times que usa IA para produzir músicas e criticou quem vê a tecnologia como ameaça. Plataformas como Spotify e Apple Music avançam em rotulagem de IA, e gravadoras fecham acordos para proteger artistas. Veja o que muda para produtores, selos e fãs.
10 min de leitura