Expressão e pose no prompt de imagem: as palavras que tiram o sorriso robótico da pessoa gerada (2026)
Danilo Gato
Autor
Resposta rápida
Pedir “sorrindo” ou “posando” no prompt de imagem é o motivo mais comum de rosto travado e corpo em pé feito estátua. O modelo de IA não entende emoção como conceito, entende como combinação de músculos e ângulos, então quanto mais você descrever a expressão em nível de músculo (bochecha levantada, olhos participando do sorriso) e a pose em nível de decisão (pra onde vai o peso do corpo, onde fica cada mão, o ângulo da cabeça), mais natural sai o resultado. A ciência por trás disso tem nome: o Sistema de Codificação de Ações Faciais (FACS), criado pelo psicólogo Paul Ekman, decompõe qualquer expressão em unidades de ação (AUs) específicas, e um sorriso genuíno, o chamado sorriso de Duchenne, é a combinação de exatamente duas: AU6 (levantar a bochecha) e AU12 (puxar o canto da boca). Esse artigo traz o vocabulário de expressão e de pose pronto pra usar, com tabela, exemplo antes/depois e um prompt combinado pra copiar.
Por que “sorrindo” sai com aquele sorriso travado de boneco
Todo mundo que já gerou um retrato com IA reconhece o problema: pede “smiling” no prompt e recebe de volta um sorriso que usa só a boca, com os olhos parados, sem nenhuma ruga de expressão ao redor deles. Isso tem explicação técnica. “Smiling” é uma palavra genérica demais, o modelo já viu milhares de imagens de treino rotuladas com essa palavra e a maioria delas é sorriso posado de foto de banco de imagens, boca aberta, olhos neutros, porque é o tipo de foto que mais existe na internet rotulada assim.
Um sorriso real nunca usa só a boca. Segundo o próprio FACS, publicado por Ekman e Wallace Friesen em 1978 e ainda hoje referência padrão em psicologia, animação e reconhecimento facial por computador, a diferença entre um sorriso genuíno e um sorriso forçado está nos olhos: o AU6 (levantador de bochecha) contrai o músculo orbicular ao redor do olho, criando aquelas rugas finas no canto (as “pés de galinha”), enquanto um sorriso social usa só o AU12, puxando a boca sem envolver o olho nenhum. Quando o prompt menciona só “smiling”, o modelo tende a gerar o AU12 sozinho, que é exatamente o sorriso que parece falso pra qualquer pessoa que olhar a imagem por mais de dois segundos.
A correção é simples: em vez de descrever a emoção como rótulo, descreva o que o rosto está fazendo fisicamente. “Genuine smile, cheeks raised, eyes crinkled, warm gaze” produz um resultado consistentemente mais real do que só “happy woman smiling”, porque está descrevendo as mesmas pistas visuais que qualquer fotógrafo de retrato profissional pede pro modelo humano fazer antes de apertar o gatilho.
O vocabulário de expressão: da emoção genérica pro músculo específico
A tabela abaixo troca o rótulo de emoção (que o modelo interpreta de forma rasa) pela descrição física (que o modelo interpreta de forma consistente).
| Emoção que você quer | Rótulo genérico (evite) | Descrição física (use) | Exemplo de prompt |
|---|---|---|---|
| Felicidade genuína | “happy”, “smiling” | Bochecha levantada + olho enrugado + canto da boca puxado | “genuine smile, cheeks lifted, crow’s feet at the eyes, warm engaged gaze” |
| Sorriso contido/profissional | “smiling slightly” | Canto da boca puxado sem abrir, olhar suave | “subtle closed-mouth smile, soft relaxed eyes, calm confident expression” |
| Surpresa real | “surprised” | Sobrancelha levantada + olho arregalado + boca entreaberta | “raised eyebrows, widened eyes, slightly parted lips, genuine surprise” |
| Seriedade confiante | “serious” | Maxilar relaxado, olhar direto, sem tensão na testa | “relaxed jaw, direct steady gaze, neutral confident expression, no tension in the forehead” |
| Pensativo/introspectivo | “thinking” | Olhar desviado, sobrancelha levemente franzida, boca fechada relaxada | “gaze drifting off-frame, slight brow furrow, relaxed closed mouth, contemplative expression” |
| Riso espontâneo | “laughing” | Boca aberta, olho quase fechado, cabeça levemente inclinada | “open-mouth genuine laugh, eyes almost closed, head tilted slightly back” |
Dica prática: troque adjetivo por músculo sempre que puder. “Cheeks lifted”, “eyes crinkled”, “jaw relaxed” e “brow furrowed” funcionam como atalho pro modelo entender fisicamente o que fazer, do mesmo jeito que “85mm f/1.8” funciona melhor que “desfoca o fundo”.
O vocabulário de pose: o corpo tem seis decisões, não uma
Pedir só “posando” deixa seis decisões em aberto que o modelo preenche de qualquer jeito, e o resultado mais comum é a pessoa em pé, de frente reta, braços colados no corpo, peso igual nas duas pernas, olhando direto pra câmera: a pose mais rígida e menos natural que existe. Uma direção de pose que funciona nomeia as seis coisas de propósito:
- Tipo de enquadramento: corpo inteiro, três quartos, busto, close.
- Posição do corpo: de frente, de lado, três quartos de giro.
- Distribuição de peso: essa é a que mais muda o resultado. Peso jogado numa perna só, o chamado contrapposto (termo que vem da escultura clássica e continua sendo o vocabulário técnico usado hoje em fotografia de moda e em prompt de IA), torce levemente o quadril contra o ombro e tira a rigidez de estátua.
- Posição de mão e braço: mão no bolso, braço apoiado, mão tocando o colarinho, o que for, mas sempre definido, porque mão sem instrução é o ponto que mais sai deformado ou “grudado” no corpo.
- Ângulo de cabeça e olhar: queixo inclinado, olhando pra câmera ou pra fora do quadro.
- Um micro gesto de expressão: lábio levemente entreaberto, sobrancelha relaxada, algo pequeno que evita a cara “congelada” de quem está esperando o flash.
Um exemplo de prompt de pose montado com as seis peças: “three-quarter shot, standing in contrapposto, weight shifted to the left hip, right hand resting on the collarbone, left arm loose at the side, chin tilted slightly down, gaze drifting off-frame, lips softly parted”. Repare que nenhuma palavra aí é “posando bonito”: são seis instruções concretas, cada uma resolvendo uma parte do corpo.
Antes e depois: o mesmo retrato, com e sem vocabulário de expressão e pose
Sem vocabulário técnico (resultado genérico):
“a woman standing, smiling, looking at the camera”
Tende a sair com os dois pés apontados pra frente, braços colados no corpo, sorriso só de boca, olhar reto e parado: a composição mais chapada que um gerador de imagem produz quando não recebe nenhuma decisão.
Com vocabulário técnico (resultado natural):
“a woman in three-quarter shot, standing in contrapposto with weight on her left hip, right hand resting near her collarbone, genuine smile with cheeks lifted and eyes crinkled, chin tilted slightly down, gaze drifting off to the side”
Mesma pessoa, mesma cena, mas agora o corpo tem peso pra um lado, a mão tem função, e o sorriso usa o rosto inteiro em vez de só a boca. É a diferença entre pedir “uma foto de alguém sorrindo” e pedir “esta pose específica, com esta expressão específica”.
Perguntas frequentes
Como pedir um sorriso natural no prompt de imagem com IA?
Troque “smiling” por uma descrição de músculo: “genuine smile, cheeks lifted, eyes crinkled, warm engaged gaze”. O ponto central é sempre envolver o olho na descrição, porque é o AU6 (levantador de bochecha), não a boca sozinha, que separa o sorriso genuíno do sorriso de boneco.
Por que o rosto gerado por IA sempre parece “travado” ou “grudado”?
Na maioria dos casos porque o prompt descreveu a emoção como rótulo (“happy”, “serious”) em vez de como ação física. O modelo preenche o resto com o padrão mais comum do material de treino, que costuma ser sorriso só de boca e olhar parado. Descrever bochecha, olho, maxilar e sobrancelha separadamente resolve a maior parte dos casos.
Que palavras usar pra uma pose de corpo inteiro que não pareça estátua?
A palavra que mais muda o resultado é “contrapposto” ou “weight shifted to one hip”, porque tira o peso igual das duas pernas, que é o que deixa a pose reta e rígida. Combine com uma instrução clara de mão (“hand resting on…”, “arm loose at the side”), porque mão sem instrução é o ponto do corpo que mais sai deformado.
Dá pra combinar expressão e pose com ângulo de câmera no mesmo prompt?
Dá, e o resultado melhora bastante quando os três aparecem juntos: ângulo de câmera define de onde a cena é vista, pose define o que o corpo está fazendo, expressão define o que o rosto está fazendo. Se você quer o vocabulário completo de enquadramento e movimento de câmera, o artigo sobre ângulos e movimentos de câmera no prompt complementa este aqui.
Preciso escrever expressão e pose em inglês no prompt?
Na prática funciona melhor em inglês, pelo mesmo motivo que vale pra luz e lente: é o vocabulário técnico que domina o material de treino dos modelos, então termos como “cheeks lifted”, “contrapposto” e “gaze off-frame” performam de forma mais consistente do que a tradução literal pro português. O resto do prompt (cenário, roupa, contexto) pode continuar em português na maioria das ferramentas atuais.
Qual a diferença entre “olhando pra câmera” e “gaze off-frame” no resultado final?
Olhar direto pra câmera cria uma sensação de confronto ou de retrato formal, ótimo pra foto de perfil profissional. Olhar pra fora do quadro (gaze off-frame ou gaze drifting) cria uma sensação mais candid, de momento capturado, e costuma combinar melhor com pose em contrapposto e expressão sutil, porque tira o ar de “posando pra câmera” e aproxima de foto espontânea.
Prompt combinado pronto pra copiar
Juntando expressão e pose numa estrutura só:
[assunto], [enquadramento], [posição do corpo + distribuição de peso], [posição de mão/braço], [expressão física: bochecha/olho/maxilar], [ângulo de cabeça e olhar]
Exemplo pronto: “a man in his 30s, three-quarter shot, standing in contrapposto with weight on his right leg, left hand in pocket, genuine smile with cheeks lifted and eyes crinkled, chin level, gaze drifting slightly off to the side”.
Troque o assunto, mantenha as seis decisões de pose mais a descrição física da expressão, e o resultado sai consistentemente mais próximo de gente de verdade posando pra uma foto do que de avatar gerado por IA parado no lugar. Esse tipo de vocabulário técnico de retrato (expressão, pose, luz, lente) é exatamente o que a gente destrincha com prática guiada no curso de Criação Profissional de Imagens com IA da CPDF (Comunidade Profissionais do Futuro - por Danilo Gato).
Leia também
Leia também
Os 7 erros mais comuns de quem começa a usar IA no trabalho (e como corrigir cada um)
Os 7 hábitos que fazem a IA parecer fraca no trabalho, com o antes e depois de cada correção.
8 min de leituraprompt de imagemIluminação e lente no prompt de imagem: o vocabulário que separa a foto realista do desenho de IA (2026)
Vocabulário de luz e lente para escrever prompt de imagem com IA que sai com cara de foto real, não de ilustração.
9 min de leituraprompt engineeringÂngulos e movimentos de câmera no prompt: o vocabulário cinematográfico que melhora imagem e vídeo com IA (2026)
Vocabulário de planos, ângulos e movimentos de câmera pra escrever prompts de imagem e vídeo com IA como um diretor de cinema.
9 min de leituraleonardo aiComo usar o Leonardo AI: guia completo pra criar imagens com IA (2026)
Guia prático do Leonardo AI: Elements, Image Guidance e Canvas — as técnicas que vão além do prompt básico.
8 min de leitura