O que você nunca deve colar numa IA

Um bloco de resposta bem formatado com um X vermelho grande por cima.

Credencial, dado de outra pessoa e segredo que não é seu. Esses três nunca, por mais que colar resolvesse o seu problema em dois segundos. A régua que decide é uma pergunta só, e ela funciona antes de você precisar entender qualquer detalhe técnico: você mandaria isso por e-mail para alguém de fora da empresa?

Se a resposta for não, não cola. O motivo é simples e não depende de qual ferramenta você usa: o que sai da sua máquina não volta. Você deixa de controlar onde aquilo é armazenado, por quanto tempo, quem tem acesso e o que acontece com ele numa mudança de política ou num incidente. Nenhuma configuração desfaz um dado que já saiu.

O vídeo cobre os dois lados: como conferir, e o que não entregar. Este texto vai fundo no segundo.

Leve o mapa mental desta aula com você

O vídeo tem um apoio visual desenhado à mão, o mesmo que aparece na abertura e no fecho da aula. Está disponível pra download em Excalidraw, e abre arrastando o arquivo pra dentro do excalidraw.com, de graça, sem instalar nada.

O contexto, em três linhas

Sou engenheiro de software sênior e passei os últimos anos colocando modelos de linguagem em produção, em sistema que outras pessoas usam.

Esse assunto costuma ser tratado com susto, e susto não vira critério. A ideia aqui é o contrário: uma régua curta que você aplica sem pensar, e uma lista de categorias que resolve os casos duvidosos.

Por que a gente baixa a guarda justamente ali

Um bloco de resposta bem formatado com um X vermelho grande por cima.
A conversa parece privada e o texto parece competente. Nenhuma das duas impressões é informação.

Existe um efeito de intimidade que a interface cria. É uma caixa de texto, parece uma conversa, ninguém mais está vendo. A sensação é de bloco de notas, e bloco de notas você preenche sem pensar. Só que a caixa é a porta de entrada de um serviço, e o que entra ali sai da sua máquina.

Some a isso a competência aparente do texto que volta. Quando a resposta é boa, a confiança sobe de forma geral, e não só sobre aquele conteúdo. A pessoa passa a colar mais, sem perceber que mudou de comportamento. É por isso que o critério precisa ser mecânico: ele tem que funcionar exatamente no momento em que você não está desconfiando.

A lista, por categoria

Um escudo separando alguns documentos que passam de outros que ficam de fora.
Não é sobre ser cauteloso com tudo. É sobre saber quais categorias nunca passam.

Quatro categorias respondem quase todos os casos.

  • Credencial de qualquer tipo. Senha, chave de acesso, token, string de conexão, certificado. Isso não é dado sensível, é acesso. Colar uma chave é entregar a porta, não a informação.
  • Dado pessoal de outra pessoa. Nome com documento, endereço, telefone, dado de saúde, histórico de cliente. O consentimento que essa pessoa deu foi para você, não para uma cadeia de serviços que ela não conhece.
  • Segredo que não é seu para compartilhar. Contrato sob confidencialidade, código de cliente, material de parceiro, informação financeira não divulgada. A regra aqui não é técnica, é contratual.
  • Coisa cuja divulgação você não conseguiria explicar. Se vazasse e alguém perguntasse por que aquilo estava ali, e você não tivesse resposta boa, já é motivo suficiente para não colar.

Repare que nenhuma das quatro depende de saber como a ferramenta guarda dado. Elas funcionam sem esse conhecimento, e continuam funcionando quando a política mudar.

Você mandaria isso para alguém de fora da empresa? Se a resposta demora, a resposta é não.

E quando você precisa mesmo daquele dado

Essa é a parte prática que falta na maioria dos textos sobre o assunto, que param no aviso. Na maior parte dos casos, o dado sensível não é o que decide a resposta. Ele está junto por preguiça de separar.

  1. Troque por um marcador. Nome do cliente vira CLIENTE, o e-mail vira EMAIL, o valor real vira um valor de exemplo. A estrutura do problema continua inteira, e é ela que você quer resolver.
  2. Mande o formato, não o conteúdo. Para resolver um erro de importação, a IA precisa ver o formato da linha, não os dados reais dela. Uma linha inventada com a mesma estrutura resolve igual.
  3. Reduza ao mínimo que reproduz. É a mesma disciplina de abrir um bug decente, e ela reduz exposição e melhora a resposta ao mesmo tempo.
  4. Se nada disso servir, o problema não é para uma ferramenta pública. Existe caso legítimo assim, e reconhecer isso é parte do critério, não desistência.

Vale reforçar o outro lado: colocar material na conversa continua sendo a maior alavanca que existe. Este texto não limita a prática. Limita quatro categorias dentro dela.

O trabalho mudou de lugar, não desapareceu

Tres caixas de verificacao empilhadas, duas marcadas e uma sendo marcada.
Você deixou de escrever e passou a julgar. Julgar é mais rápido, e continua sendo trabalho.

Decidir o que entra é metade do trabalho novo. A outra metade é decidir no que confiar quando a resposta chega, e conferir a resposta é outro assunto, com método próprio, que eu já detalhei em outro texto.

As duas metades juntas formam o mesmo ponto: o trabalho não sumiu, mudou de lugar. Você deixou de escrever e passou a julgar, na entrada e na saída. Julgar é bem mais rápido que escrever, e é aí que está o ganho de verdade. Quem pula essa parte devolve o ganho em retrabalho, ou em coisa pior.

Onde tudo isso fica registrado

Escrevo tudo o que aprendo aqui neste blog, que roda num plano de quatro anos da Hostinger, que eu recomendo.

O vídeo lá em cima é a aula sobre verificação e limites de um curso gratuito de fundamentos de inteligência artificial, com aulas curtas e um conceito por vez. Ela é a penúltima, e o curso fecha com a escolha que sobra: qual usar em cada situação.

O que eu faria diferente se começasse hoje

Eu adotaria a pergunta única desde o primeiro dia, em vez de decidir caso a caso. Eu substituiria dado real por marcador por reflexo, não por disciplina. E eu trataria credencial numa conversa como credencial num repositório público: mesma gravidade, mesma resposta.

No fundo é a regra que a gente já aprendeu com log e com print de debug. O problema nunca foi a ferramenta. Foi o dado que ninguém pensou que ia parar ali, e que só apareceu quando alguém foi olhar.


A newsletter sai todo domingo, com o bastidor do que eu estou construindo, incluindo o que não deu certo.

Receba as análises da semana

Um e-mail por semana com o que foi publicado e analisado.

Gabriel Carvalho

Quem escreve

Gabriel Carvalho

Engenheiro fullstack sênior e especialista em IA. Liderou avaliação de LLMs, sistemas RAG e agentes autônomos em uma das maiores plataformas de IA da América Latina.

LinkedIn · Instagram