O que não colocar no prompt da IA: dado de cliente, documento e o que a empresa não pode deixar vazar
seguranca de dados

O que não colocar no prompt da IA: dado de cliente, documento e o que a empresa não pode deixar vazar

Danilo Gato

Autor

27 de setembro de 2026
7 min de leitura

Resposta rápida

Antes de colar qualquer texto num prompt de IA, tire de dentro dele: nome completo de cliente, CPF, RG, endereço, telefone, e-mail pessoal, número de contrato ou processo, dado de cartão ou conta bancária, senha, token de acesso, prontuário médico e qualquer informação de menor de idade. A regra prática é simples: se o dado identifica uma pessoa real ou destrava acesso a algo, ele sai do prompt e entra um apelido no lugar (Cliente A, Empresa X, CPF 000.000.000-00). A IA continua entendendo o contexto perfeitamente, e você elimina o risco sem perder a qualidade da resposta. Mais abaixo tem a lista completa por categoria e o passo a passo de como trocar o dado real por um genérico em menos de um minuto.

Essa dúvida aparece toda semana aqui na CPDF (Comunidade Profissionais do Futuro, por Danilo Gato), porque é o tipo de pergunta que só vem à cabeça depois que a pessoa já colou o dado e ficou com aquela pontinha de dúvida. Faz sentido: usar IA no trabalho virou rotina, e ninguém para pra pensar em segurança da informação no meio de uma tarefa corrida.

Por que colar dado de cliente na IA é arriscado mesmo que ninguém descubra

O risco de verdade mora no que acontece com o dado depois que ele sai da sua tela, não em alguém estar olhando o chat naquela hora. Um levantamento da LayerX com o relatório Enterprise AI and SaaS Data Security Report 2025 mostrou que 45% dos funcionários de empresas já usam ferramentas de IA generativa no trabalho, e 77% deles fazem copia e cola direto de informação real pra dentro do chat. Entre essas colagens, 22% continham dado pessoal ou de cartão, e 82% partiram de uma conta pessoal, sem qualquer gestão da empresa por trás.

O problema fica mais caro quando vira incidente de verdade. O IBM Cost of a Data Breach Report 2025 mediu o efeito da chamada shadow AI, que é o uso de ferramenta de IA sem aprovação nem controle do time de segurança: empresas com esse padrão de uso pagaram, em média, 670 mil dólares a mais em cada vazamento, e 20% das organizações pesquisadas já sofreram um incidente ligado a isso. Ou seja, o custo não é hipotético. Ele já está na conta de gente que só queria agilizar um relatório.

O que exatamente conta como dado pessoal pra LGPD dentro de um prompt

A Lei Geral de Proteção de Dados não trata prompt de IA como uma categoria especial. Ela olha pro conteúdo: qualquer informação que identifique ou torne identificável uma pessoa física é dado pessoal, esteja ela num contrato, numa planilha ou dentro de um prompt de chat. Isso inclui nome, CPF, RG, endereço, telefone, e-mail, placa de veículo, dado de saúde, biometria e até informação que, combinada com outra, permite chegar até alguém (como cargo mais empresa mais cidade, num time pequeno).

A ANPD (Autoridade Nacional de Proteção de Dados) publicou em 2025 a Nota Técnica nº 12, reunindo contribuição de empresas, academia e especialistas sobre uso de dado pessoal em treinamento de modelo e mitigação de risco, e já colocou inteligência artificial como um dos quatro temas prioritários de fiscalização pro biênio 2026-2027. Na prática, isso quer dizer mais atenção da autoridade daqui pra frente, não menos. Empresa flagrada usando dado pessoal sem cuidado em ferramenta de IA está sujeita a multa de até 2% do faturamento, limitada a 50 milhões de reais por infração.

Dá pra usar CPF, endereço ou número de contrato se eu tirar só o nome

Não. Esse é o erro mais comum de quem já ouviu falar do risco e tenta resolver pela metade. Tirar o nome e deixar o CPF, o endereço completo ou o número do contrato não anonimiza nada: qualquer um desses dados sozinho já reidentifica a pessoa, porque são únicos. O mesmo vale pra combinação de dados que parecem inofensivos isolados (data de nascimento mais bairro mais profissão, por exemplo), mas que juntos apontam pra uma pessoa só.

A técnica que funciona de verdade é a substituição completa, não a remoção parcial. Ao invés de apagar um campo, você troca cada dado sensível por um apelido fixo e reutiliza esse apelido no prompt inteiro, preservando a estrutura da informação:

  • Nome completo do cliente vira Cliente A (ou Fulano, Beltrana)
  • CPF ou CNPJ vira 000.000.000-00 ou 00.000.000/0001-00
  • Endereço vira Rua Genérica, 123, Bairro X
  • Telefone e e-mail viram (00) 00000-0000 e cliente@exemplo.com
  • Número de contrato, processo ou chamado vira CT-0000
  • Dado de cartão ou conta bancária nunca entra no prompt, nem anonimizado. Some com ele da conversa
  • Prontuário médico, diagnóstico ou informação de saúde segue a mesma regra do cartão: fora do prompt
  • Dado de menor de idade (nome, escola, foto) também fica de fora, sempre

Repare que a estrutura da informação continua ali (um CPF ainda parece um CPF, um endereço ainda tem rua e número), e é exatamente isso que faz a IA entender o contexto e responder com a mesma qualidade de antes. O que sai é só o que identifica a pessoa real.

Como trocar o dado real por um genérico sem perder o contexto que a IA precisa

O jeito mais rápido, pra quem lida com o mesmo tipo de documento toda semana (um e-mail de cliente, um contrato, um laudo), é montar um dicionário de apelidos fixo antes de precisar dele. Você define de uma vez que “Cliente A” sempre vai ser o mesmo apelido pro cliente em questão dentro daquela conversa, “CT-0000” sempre representa o número de contrato, e assim por diante. Daí, antes de colar qualquer texto, você roda uma passada de busca e substituição (o próprio editor de texto ou uma planilha resolve) trocando cada dado real pelo apelido combinado.

Um exemplo prático: se o texto original diz “Maria Fernanda Costa Silva, CPF 123.456.789-00, mora na Rua das Acácias, 450, em Sorocaba, e está com um atraso de 3 meses no contrato 88291”, o texto que vai pro prompt fica “Cliente A, CPF 000.000.000-00, mora na Rua Genérica, 450, em uma cidade do interior de São Paulo, e está com atraso de 3 meses no contrato CT-0001”. A IA recebe exatamente o mesmo problema pra resolver, com a mesma quantidade de detalhe, e nenhuma informação real sai da sua máquina.

Isso conecta direto com engenharia de prompt: quanto mais estruturado o seu prompt, menos trabalho dá pra anonimizar, porque você já separa contexto de identificação por hábito. Times que lidam com o mesmo tipo de caso todo dia costumam montar uma biblioteca de prompts da empresa já com os apelidos padronizados, pra ninguém reinventar a roda a cada atendimento.

Que ferramentas de IA são mais seguras pra dado de trabalho

Nenhuma ferramenta de IA torna seguro colar dado real sem anonimizar, então a pergunta certa não é “qual IA aceita”, e sim “qual ferramenta dá controle sobre o que acontece com o que eu mandei”. A diferença prática está em três pontos: se a empresa que você usa tem um plano corporativo (Team, Enterprise ou Business) com contrato de proteção de dados e retenção configurável, se existe opção de desativar o uso da sua conversa pra treinar o modelo, e se o acesso passa pela conta da empresa em vez de uma conta pessoal, que é justamente o padrão que apareceu em 82% das colagens de risco no levantamento da LayerX.

Se você quer entender a diferença entre uma conta pessoal e um ambiente corporativo de verdade, vale a leitura de ChatGPT é seguro? Privacidade e proteção de dados e de IA e LGPD na empresa, sem riscos, que detalham como configurar isso passo a passo. E se a dúvida for especificamente se a conversa que você já teve alimenta o modelo, o artigo a IA treina com meus dados? explica onde fica esse botão em cada ferramenta.

O que fazer se eu já colei um dado que não devia

Primeiro, respire: colar um dado sensível uma vez não é, sozinho, um vazamento consumado, mas pede ação rápida em três frentes. Primeiro, se a informação envolvia senha, token de acesso ou dado bancário, troque a credencial na hora, antes de fazer qualquer outra coisa. Segundo, apague a conversa na ferramenta (a maioria tem essa opção no histórico) e, se a plataforma permitir, desative o uso daquele histórico pra treinamento. Terceiro, avise o responsável pela segurança da informação ou o encarregado de dados da empresa (o DPO), porque a LGPD trata comunicação de incidente como parte da resposta correta, não como delação. Quem esconde o problema é quem aumenta o risco, não quem avisa.

A partir daí, o hábito que resolve pra sempre é o mesmo do resto deste artigo: nunca deixar o dado real chegar no prompt. Cinco segundos de busca e substituição custam muito menos do que uma manhã inteira resolvendo um incidente.

Leia também

Tags

seguranca de dadoslgpdprompt de ia