Um chatbot termina no texto que aparece na sua tela. Um agente termina numa coisa mudada: um arquivo salvo, um e-mail enviado, um registro criado. Essa é a linha inteira entre os dois, e ela não é sobre o modelo ser melhor. É sobre ele ter recebido ferramentas e permissão para usá-las.
A consequência é que a pergunta muda de lugar. Com chat, a sua pergunta é o que eu peço. Com agente, a pergunta passa a ser o que eu deixo ele fazer. É por isso que agente exige um cuidado que chat nunca exigiu: o erro deixou de sair em texto e passou a sair em ação.
Leve o mapa mental desta aula com você
O vídeo tem um apoio visual desenhado à mão, o mesmo que aparece na abertura e no fecho da aula. Está disponível pra download em Excalidraw, e abre arrastando o arquivo pra dentro do excalidraw.com, de graça, sem instalar nada.
O contexto, em três linhas
Sou engenheiro de software sênior e passei os últimos anos colocando modelos de linguagem em produção, em sistema que outras pessoas usam.
A palavra agente virou rótulo de qualquer coisa que responde bem, o que apaga justamente a diferença que importa. Recuperar essa diferença é o que evita comprar risco achando que comprou conveniência.
A escada, e ela tem mais degraus que dois

Na prática existem três degraus, e boa parte da confusão de mercado vem de chamar todos de agente.
- Chat. Você pergunta, ela responde. Nada acontece fora da conversa.
- Chat com ferramenta. Ela consegue buscar, ler um arquivo ou consultar algo, e usa o resultado para responder melhor. Continua terminando em texto.
- Agente. Ela decide sozinha quais ferramentas usar, em que ordem, quantas vezes, e para quando um critério for atingido. Termina numa mudança.
O salto que importa não é ter ferramenta. É decidir o próprio próximo passo com base no resultado do passo anterior. É isso que transforma uma resposta numa sequência de ações.
O ciclo, em quatro passos

O desenho é mais simples do que o vocabulário sugere. Ela pensa, aciona uma ferramenta, lê o que voltou, e decide de novo com essa informação nova em mãos. Repete até um critério de parada ser atingido.
O detalhe que fecha o entendimento: o resultado da ferramenta volta pra dentro do contexto, exatamente como um pedaço de texto que você tivesse colado. Não existe canal privilegiado. O agente não sabe mais do que está escrito na frente dele, e isso é o que mantém tudo previsível, inclusive os erros.
Sem critério de parada, ele não sabe a hora de sair. E não saber sair, num ciclo, tem nome antigo em computação.
Onde ele trava, e são dois lugares

O primeiro é a ferramenta que falha ou devolve algo estranho. Aí ele segue adiante com material ruim, e é a mesma invenção de sempre, agora com mão: ele faz a coisa errada com a mesma confiança com que faria a certa.
O segundo é o critério de parada mal definido. Sem um critério claro, o ciclo roda em círculo, refaz o que já fez e queima recurso à toa. Com um critério frouxo, ele para cedo demais e entrega meio caminho como se fosse conclusão.
Repare que nenhum dos dois é “o modelo é ruim”. Os dois são desenho. É por isso que agente bom e agente perigoso podem rodar sobre exatamente a mesma IA.
Onde colocar a sua aprovação
Autonomia não é um estado, é um botão com várias posições. E decidir onde ele fica é a decisão mais importante do projeto, muito mais do que a escolha do modelo. O critério que eu uso é o raio de estrago: quanto custa desfazer.
- Ação que só lê: solta. Buscar, consultar, resumir, comparar. Errar aqui custa tempo, e tempo você recupera.
- Ação que escreve e é reversível: solta com registro. Criar rascunho, abrir tarefa, salvar arquivo novo. Deixe rastro do que foi feito, e siga.
- Ação que sai do seu controle: sempre com aprovação. Enviar mensagem para outra pessoa, publicar, pagar. Depois de sair, não tem desfazer.
- Ação destrutiva: aprovação e confirmação explícita. Apagar, sobrescrever, encerrar. E de preferência com o que vai ser afetado listado antes.
Quem promete autonomia total está vendendo alguma coisa. Não porque a tecnologia não permita, mas porque a pergunta certa nunca foi quanto ela consegue fazer sozinha. Foi quanto você aceita que seja feito sem você olhar.
Onde tudo isso fica registrado
Escrevo tudo o que aprendo aqui neste blog, que roda num plano de quatro anos da Hostinger, que eu recomendo.
O vídeo lá em cima é a aula sobre agentes de um curso gratuito de fundamentos de inteligência artificial, com aulas curtas e um conceito por vez. Depois de entender o ciclo, a pergunta seguinte do curso é como ela ganha acesso às suas ferramentas sem gambiarra.
O que eu faria diferente se começasse hoje
Eu escreveria o critério de parada antes de escrever qualquer outra coisa. Eu classificaria cada ferramenta pelo custo de desfazer, e não pela conveniência. E eu trataria autonomia como configuração de projeto, não como característica do produto que eu escolhi.
No fundo é engenharia de sistema distribuído com outro nome. Retry sem limite, operação sem idempotência, processo sem condição de saída: a gente já sabe o que cada um desses custa em produção. A novidade é que agora quem decide o próximo passo não é um código que você leu.
A newsletter sai todo domingo, com o bastidor do que eu estou construindo, incluindo o que não deu certo.
