Como manter o mesmo personagem em várias imagens de IA sem o rosto mudar
prompt-de-imagem

Como manter o mesmo personagem em várias imagens de IA sem o rosto mudar

Danilo Gato

Autor

24 de agosto de 2026
6 min de leitura

Resposta rápida

O rosto muda porque cada imagem gerada por IA é uma interpretação nova, sem memória da anterior, então o jeito de travar a identidade é mandar uma foto de referência e dizer explicitamente pra IA preservar aquele rosto, em vez de descrever as feições em texto (isso quase sempre piora, não ajuda). Cada ferramenta trata isso de um jeito: no Gemini (Nano Banana Pro) você anexa de 2 a 4 fotos de referência e escreve uma “trava de consistência” na frase; no GPT Image você edita a foto original em vez de gerar do zero; no Midjourney você usa o parâmetro --oref com peso --ow. Nenhuma das três é perfeita depois de muitas variações, e mãos costumam ser o primeiro detalhe a quebrar.

Por que o rosto muda a cada imagem que a IA gera?

Um modelo de geração de imagem não lembra da imagem anterior, mesmo dentro da mesma conversa. Cada novo pedido é processado quase do zero, a partir do texto (e da referência, quando você manda uma). Sem uma foto ancorando a identidade, a IA reconstrói um rosto plausível pra combinar com a descrição, e como a descrição nunca é 100% específica (ela não sabe exatamente o formato do seu queixo ou a distância entre seus olhos), o resultado varia a cada geração. É o mesmo motivo pelo qual pedir “a mesma pessoa de novo, mas sorrindo” costuma dar uma pessoa parecida, não a mesma pessoa.

O que NÃO resolve (e todo mundo tenta primeiro)

Antes das técnicas que funcionam, vale economizar seu tempo com o que geralmente NÃO funciona:

  • Descrever o rosto em mais detalhe. “Olhos castanhos, nariz fino, sobrancelha grossa” não trava identidade, só adiciona restrições vagas que a IA interpreta de um jeito novo a cada vez. Pior: se você também anexou uma foto de referência, descrever o rosto em texto pode CONTRADIZER a referência e a IA prioriza o texto, ignorando a foto.
  • Pedir “parecido com a pessoa da referência”. Frases vagas de semelhança (“faça parecido”, “mesma pessoa”) são fracas justamente por não serem uma instrução de preservação, é um pedido de interpretação livre.
  • Usar uma referência de baixa qualidade ou com ângulo estranho. Foto de perfil, com sombra forte no rosto ou resolução baixa, dá menos informação pra IA reconstruir os traços, então o resultado varia mais.
  • Gerar de novo do zero repetidas vezes esperando “acertar”. Sem mudar a técnica, cada nova tentativa é só mais uma interpretação nova, não uma correção da anterior.

Como fazer no Gemini (Nano Banana Pro)

O Nano Banana Pro (modelo de imagem do Gemini 3 Pro) foi feito pra isso: segundo o anúncio oficial do Google, ele consegue misturar até 14 imagens numa composição mantendo a identidade de até 5 pessoas ao mesmo tempo. Pra um único personagem, o funcionamento prático é mais simples:

  • Mande de 2 a 4 fotos de referência, priorizando uma frontal, com boa luz e sem obstrução no rosto. Fotos de ângulos e expressões diferentes ajudam mais que várias fotos parecidas.
  • Escreva uma frase de “trava de identidade” explícita no prompt, tipo: “mantenha o rosto exatamente como na imagem de referência, sem alterar feições”. Isso pesa mais do que você imagina.
  • Não descreva o rosto. Deixe a referência falar sozinha. Descreva só o que muda: roupa, cenário, pose, luz.
  • Espere degradação depois de várias edições em sequência. Mãos e dedos costumam ser o primeiro detalhe a sair errado depois de 5 ou mais gerações encadeadas a partir da mesma base. Se as mãos aparecem na cena, descreva a posição delas explicitamente em vez de deixar a IA decidir.

Como fazer no GPT Image

O GPT Image (gpt-image-2, da OpenAI) trata isso de um jeito diferente: em vez de “gerar do zero olhando pra uma referência”, ele funciona melhor quando você literalmente edita a imagem original.

  • Use o modo de edição, não geração nova, quando quiser manter o mesmo enquadramento e só mudar um detalhe (roupa, fundo, expressão). O modelo preserva os detalhes da imagem de entrada automaticamente, sem um controle de intensidade pra ajustar, ele sempre tenta manter o máximo possível.
  • Quando precisar de uma pose ou corpo totalmente diferente, edição direta tende a “colar” demais na composição original. Nesse caso, uma técnica que funciona bem é recortar só o rosto da referência (ou montar um grid só com o rosto em ângulos diferentes) e pedir uma fotografia nova, não uma edição, deixando claro que é uma cena nova com aquela pessoa.
  • Fidelidade alta é o padrão, então cuidado com referências que têm algo que você NÃO quer manter (uma marca d’água, um objeto no fundo): o modelo tende a preservar isso também.

Como fazer no Midjourney

O Midjourney mudou a forma de fazer isso na versão 7: o parâmetro antigo --cref (character reference) não é mais o caminho recomendado nessa versão, foi substituído pelo Omni-Reference.

  • Sintaxe: adicione --oref <link da imagem> no fim do prompt, com a imagem hospedada num link público.
  • Controle de intensidade: --ow <valor>, de 1 a 1000 (padrão 100). Valores baixos (25 a 50) dão mais liberdade criativa preservando só o essencial; valores altos (400+) grudam bem mais na referência.
  • Referência de rosto de frente, expressão neutra funciona melhor que rosto de perfil ou com expressão forte.
  • Detalhes miúdos não transferem bem: sardas específicas, logotipo de roupa e padrões complexos raramente saem idênticos sem edição manual depois.

Um modelo de prompt pra copiar e adaptar

Pra fechar com algo prático, aqui vai a estrutura de frase que costuma funcionar melhor nas três ferramentas, adaptando só a sintaxe de cada uma:

[o que muda: roupa, cenário, ação, iluminação]
+ trava de identidade: "mantenha o rosto e as feições exatamente
  como na imagem de referência, sem alterar"
+ [parâmetro técnico da ferramenta, se houver: --oref/--ow no
  Midjourney, ou anexar a referência direto no Gemini/GPT Image]

Exemplo aplicado (Gemini, com 2 fotos de referência anexadas): “a mesma pessoa da referência, de pé numa cozinha moderna, luz natural de janela lateral, expressão tranquila, mantenha o rosto e as feições exatamente como na referência, sem alterar.” Note que a frase não descreve nenhum traço físico novo, só o cenário e a pose, deixando toda a informação de identidade pra imagem anexada.

Perguntas frequentes

Como fazer a IA gerar a mesma pessoa em imagens diferentes?

Mande uma foto de referência de boa qualidade (de preferência mais de uma, com ângulos diferentes) e escreva uma instrução explícita de preservação de identidade, em vez de descrever o rosto em palavras. Cada ferramenta tem seu mecanismo: referência múltipla no Gemini, edição no GPT Image, --oref/--ow no Midjourney.

Por que o rosto muda mesmo usando uma foto de referência?

Geralmente por dois motivos: a referência tem qualidade baixa ou ângulo ruim, ou o prompt descreve o rosto em texto de um jeito que contradiz a referência, fazendo a IA priorizar a descrição em vez da imagem.

Como usar uma foto de referência pra manter o personagem?

Anexe a foto (ou fotos) diretamente na ferramenta, no campo de referência de imagem, não só descreva ela em palavras. E escreva no prompt uma frase clara pedindo pra preservar o rosto da referência.

Dá pra manter mais de uma pessoa consistente na mesma imagem?

No Nano Banana Pro sim, o modelo suporta até 5 pessoas com identidade preservada numa composição com até 14 imagens de referência ao todo. Nas outras ferramentas, o ideal é gerar cada personagem separadamente e compor depois, porque a consistência de múltiplas pessoas ao mesmo tempo ainda é o ponto mais frágil da maioria dos modelos.

Leia também

A CPDF (Comunidade Profissionais do Futuro - por Danilo Gato) tem conteúdo gratuito sobre como usar IA generativa de imagem no dia a dia e no trabalho.

Leia também

Tags

prompt-de-imagemconsistencia-de-personagemia-generativa