Agentes de IA para empresas: o que realmente funciona hoje e o que ainda não

    Por Patrick BonomettiAtualizado em 10 min de leitura

    Resposta rápida

    Um agente de IA é um sistema que executa ações em ferramentas reais — consultar sistemas, criar registros, disparar processos — e não apenas responde em texto. Ele funciona bem em tarefas reversíveis, verificáveis e de baixo custo de erro. Em tarefas irreversíveis, que envolvem dinheiro ou pessoas, exige supervisão humana explícita.

    Agente de IA é hoje o termo mais inflacionado do mercado de tecnologia. Boa parte do que é vendido com esse nome é um chatbot com uma integração; boa parte do que é prometido — o sistema que 'cuida do processo sozinho' — ainda não é confiável o suficiente para rodar sem gente olhando. Ao mesmo tempo, existe uma faixa estreita e real de tarefas em que agentes já entregam ganho consistente. Este artigo tenta separar as duas coisas com honestidade.

    A distinção que importa para quem decide não é técnica, é de risco. Um agente é um software que age em nome da empresa com julgamento probabilístico. Toda a discussão sobre onde usar, quanto autonomizar e quanto auditar deriva dessa frase.

    O que é um agente de IA (e o que não é)

    Um assistente de IA convencional recebe texto e devolve texto. Você pergunta, ele responde, você decide o que fazer. Um agente recebe um objetivo, decide sozinho quais passos dar, chama ferramentas para executá-los — uma consulta ao ERP, uma busca na base de conhecimento, a criação de um chamado — observa o resultado de cada passo e continua até concluir ou desistir.

    Três elementos definem um agente de verdade: acesso a ferramentas que produzem efeito fora do chat, um laço de decisão em que ele escolhe o próximo passo com base no resultado do anterior, e algum critério de parada. Se falta o primeiro, é um chatbot. Se falta o segundo, é uma automação comum com um modelo de linguagem no meio — o que, aliás, muitas vezes é a escolha certa e mais barata.

    DimensãoChatbotAutomação com IAAgente
    Quem decide o caminhoA pessoaO fluxo, definido antesO modelo, em tempo de execução
    Efeito no mundoNenhum — só textoFixo e previsívelVariável, depende do que ele escolher
    PrevisibilidadeAltaAltaMédia — é a principal fraqueza
    Custo de errarBaixoContido pelo desenho do fluxoDepende inteiramente das permissões
    Quando faz sentidoConsulta e redaçãoProcesso estável e bem mapeadoProcesso com variação que uma regra fixa não cobre
    Chatbot, automação com IA e agente: o que muda de fato

    Vale insistir na coluna do meio. Uma parcela grande dos projetos apresentados como 'agentes' seria mais barata, mais rápida e mais confiável como automação determinística chamando um modelo em um ou dois pontos específicos. Agente só se justifica quando a variação do caso real é grande demais para caber em regras — e é honesto verificar isso antes de assinar o projeto.

    O problema central: confiabilidade composta

    A pergunta que derruba a maior parte das demonstrações de agente é simples: qual a taxa de acerto e qual o custo de cada erro? Modelos de linguagem são probabilísticos. Eles não acertam sempre, e — pior para agentes — não avisam de forma confiável quando erraram. Um agente que interpreta mal um pedido segue executando com convicção.

    Há um efeito de composição que costuma passar despercebido: um agente que executa uma cadeia de passos precisa acertar todos eles. Se cada passo tem alta chance de estar certo, a chance de a cadeia inteira estar certa cai a cada passo adicional. É por isso que demonstrações de três passos impressionam e implantações de doze passos frustram. Cadeias curtas são mais robustas que cadeias longas, e essa é uma das poucas regras estáveis do assunto.

    Há ainda um segundo tipo de falha, menos discutido e mais desconfortável: o agente pode estar tecnicamente correto em cada passo e ainda assim resolver o problema errado, porque interpretou o objetivo de forma diferente da pretendida. Nenhum log de execução pega isso; só a revisão de resultado por alguém que entende o processo pega.

    Onde agentes fazem sentido hoje

    O critério prático tem três perguntas. A tarefa é reversível? O resultado é verificável rapidamente por quem recebe? O custo de um erro é baixo? Três sins e o agente é candidato. Um não em qualquer delas e você precisa de supervisão humana obrigatória no ponto crítico — ou de outra abordagem.

    TarefaAdequaçãoPor quê
    Triar e classificar tíquetes de suporteAdequadaReversível, verificável na hora, erro custa um reencaminhamento
    Consolidar dados de vários sistemas em um relatórioAdequadaSomente leitura; o erro aparece na conferência antes de virar decisão
    Rascunhar respostas para o time revisar antes de enviarAdequadaExiste um humano entre a saída do agente e o cliente
    Enriquecer cadastros com dados públicos em campo de rascunhoAdequadaEscrita isolada, desfazível, sem efeito em processo a jusante
    Monitorar e sinalizar anomalias para alguém decidirAdequadaO agente alerta; a decisão continua sendo humana
    Aprovar, emitir ou conciliar pagamentosInadequadaMove dinheiro, erro é caro e a reversão é burocrática
    Enviar mensagens a clientes sem revisãoInadequadaIrreversível na prática — a mensagem já foi lida
    Decidir sobre pessoas (contratação, desligamento, crédito)InadequadaAlto custo humano e jurídico; exige responsabilidade nominal
    Alterar dados de produção sem etapa de revisãoInadequadaErro se propaga por sistemas a jusante antes de alguém notar
    Negociar prazos ou condições comerciaisInadequadaCompromete a empresa perante terceiros
    Tarefas adequadas e inadequadas para agentes de IA

    Repare no padrão: a fronteira não é a dificuldade técnica da tarefa. Conciliar pagamentos é tecnicamente mais fácil que triar tíquetes ambíguos. A fronteira é o custo do erro e a existência de um ponto de conferência antes de o efeito se tornar definitivo.

    Permissões, limites e trilha de auditoria

    Um agente é, para efeitos de segurança, um usuário do sistema. Só que um usuário que age rápido, em volume, e cuja lógica de decisão não é totalmente inspecionável antes da execução. Isso muda o desenho de controle: não se confia no bom comportamento do agente, se restringe o que ele consegue fazer mesmo quando erra.

    • Credencial própria, nunca a de uma pessoa. Se o agente usa o login de alguém, você perde a distinção entre o que a pessoa fez e o que o agente fez — e a auditoria deixa de existir.
    • Menor privilégio real: acesso apenas às tabelas, campos e ações que a tarefa exige. Leitura ampla e escrita estreita costuma ser o desenho correto.
    • Limites duros aplicados fora do modelo: teto de registros por execução, teto de valor, lista fechada de destinatários. Instrução no prompt não é controle de segurança — é sugestão.
    • Log de cada ação com entrada, ferramenta chamada, saída e decisão, guardado onde o agente não possa alterar.
    • Uma forma clara de desligar. Alguém do negócio precisa conseguir parar o agente sem abrir chamado para a TI.
    • Reversão pensada antes: como desfazer um lote de escritas erradas em quinze minutos.

    Supervisão humana nos pontos certos

    Supervisão humana não significa alguém lendo tudo — isso anula o ganho e ninguém sustenta por mais de duas semanas. Significa escolher poucos pontos de conferência, colocá-los onde o erro ainda é barato de corrigir, e deixar o resto correr.

    1. 1Antes de qualquer ação irreversível: envio externo, pagamento, exclusão, publicação. Aprovação explícita, sempre.
    2. 2Quando o agente sinaliza incerteza ou o caso sai do padrão previsto. Vale desenhar o agente para escalar em vez de arriscar — uma taxa de escalonamento saudável é sinal de bom desenho, não de fracasso.
    3. 3Por amostragem no fluxo normal, mesmo quando tudo parece bem. É como a degradação silenciosa aparece antes de virar incidente.
    4. 4Em revisão periódica de logs, procurando padrões de erro repetidos em vez de casos isolados.

    Um alerta sobre o fator humano: quando o agente acerta com frequência, o revisor para de revisar de verdade e passa a aprovar por reflexo. É um efeito documentado em qualquer sistema de supervisão e vale planejar contra ele — variando quem revisa, medindo a taxa de rejeição e desconfiando quando ela cai para zero.

    Como começar pequeno

    Colocar o primeiro agente em produção com risco controlado

    1. 1

      1 — Escolher uma tarefa só, e a mais chata possível

      Repetitiva, com volume relevante, resultado verificável em segundos e efeito desfazível. Se o time descreve a tarefa em uma frase, é boa candidata. Se a descrição precisa de 'depende', não é a primeira.

    2. 2

      2 — Definir o que é acerto antes de construir

      Monte um conjunto de 30 a 50 casos reais, com o resultado correto anotado por alguém do processo. Sem essa régua, você não terá como afirmar que o agente funciona — só que ele parece funcionar.

    3. 3

      3 — Rodar em somente-leitura

      O agente executa a tarefa completa mas não escreve em lugar nenhum: propõe o resultado e registra. Compare com o que a pessoa faria. É a fase que revela os erros silenciosos, e não deve ser pulada por pressa.

    4. 4

      4 — Ligar a escrita com aprovação obrigatória

      Cada ação passa por um humano que aprova ou corrige. Meça a taxa de correção e, principalmente, o tipo de correção — erros concentrados em um mesmo padrão são consertáveis; erros espalhados indicam que a tarefa não é adequada.

    5. 5

      5 — Ampliar autonomia só onde os números sustentam

      Libere autonomia por faixa de caso, não por atacado: os casos simples e de baixo valor rodam sozinhos, o resto continua com aprovação. Mantenha os limites duros e a amostragem para sempre.

    6. 6

      6 — Revisar o custo real em 90 dias

      Some construção, operação, manutenção e o tempo de quem revisa. Um agente que economiza duas horas por semana e consome três de supervisão precisa ser desligado ou reduzido de escopo — e essa decisão precisa ser combinada desde o início.

    Prompt: avaliar se uma tarefa é candidata a agente
    Você é um arquiteto de soluções cético, especializado em automação com IA. Seu trabalho é evitar que a empresa construa um agente onde ele não se justifica.
    
    TAREFA QUE QUERO AUTOMATIZAR:
    [descreva o processo passo a passo, como ele é hoje]
    
    SISTEMAS ENVOLVIDOS: [liste]
    VOLUME: [quantas vezes por dia/semana]
    QUEM FAZ HOJE: [cargo e tempo gasto]
    
    Analise e responda:
    
    1. REVERSIBILIDADE — cada passo pode ser desfeito? Quais não podem, e em quanto tempo o efeito se torna definitivo?
    2. VERIFICABILIDADE — como alguém confirma que o resultado está certo, e quanto tempo isso leva? Se for mais lento que fazer a tarefa, diga.
    3. CUSTO DO ERRO — pior cenário realista de uma execução errada, em dinheiro, tempo e relacionamento.
    4. VARIAÇÃO — essa tarefa caberia em regras fixas? Se sim, diga que uma automação determinística é a melhor opção e explique por quê.
    5. PONTOS DE APROVAÇÃO — onde exatamente um humano precisa aprovar, e por quê.
    6. VEREDITO — uma de três opções: (a) boa candidata a agente, (b) melhor como automação sem agente, (c) manter humana por ora. Justifique em até 5 linhas.
    
    Seja direto. Se a resposta for 'não automatize', diga isso.

    O que ainda não funciona bem

    Ser útil aqui exige dizer o que não está pronto. Nenhum dos itens abaixo é impossível em princípio; todos são frágeis o suficiente hoje para não sustentarem um processo crítico.

    • Autonomia longa sem checkpoints. Cadeias com muitos passos e sem conferência intermediária derivam do objetivo, e o desvio só aparece no final.
    • Processos que dependem de conhecimento tácito não escrito. Se a regra real mora na cabeça de duas pessoas e não em nenhum documento, o agente vai inventar uma versão plausível dela.
    • Interação direta com clientes sem revisão, em qualquer contexto com implicação contratual, financeira ou de reputação.
    • Julgamento em zona cinzenta — exceções, casos-limite, situações em que a resposta certa depende de contexto político interno.
    • Autoavaliação confiável. O agente que verifica o próprio trabalho tende a concordar consigo mesmo; verificação precisa vir de fora, por regra determinística ou por pessoa.

    Uma observação de honestidade sobre prazos: os modelos que sustentam agentes — a família Claude, da Anthropic, e concorrentes diretos — melhoraram rápido em seguir instruções, usar ferramentas e manter coerência ao longo de tarefas. É razoável esperar que parte desta lista encolha. Não é razoável construir um processo crítico hoje apostando em quando isso vai acontecer.

    Quanto custa manter um agente vivo

    O custo de construir um agente é o menor dos custos. O que pesa ao longo do tempo é o resto: manter os prompts e as ferramentas quando o processo de negócio muda, refazer testes quando o modelo é atualizado, sustentar a supervisão, tratar exceções e responder às perguntas de auditoria. Projetos que ignoram isso na conta inicial costumam ser desligados no segundo semestre — não por falha técnica, mas porque ninguém foi designado para cuidar deles.

    A pergunta certa antes de aprovar um projeto de agente não é 'quanto custa construir', e sim 'quem é o dono disso daqui a seis meses, e quanto do tempo dessa pessoa isso consome'.

    Automatizar um processo ruim só faz você errar mais rápido e em maior escala.

    Inteligência Artificial para Negócios

    Pontos-chave

    Qual a diferença entre um agente de IA e um chatbot?

    O chatbot devolve texto e para por aí; a decisão e a execução continuam com a pessoa. O agente tem acesso a ferramentas e executa passos em sistemas reais — busca dados, escreve em uma base, abre um chamado. A diferença não é de inteligência, é de permissão.

    Por que 90% de acerto pode ser um resultado ruim?

    Porque o valor de um agente depende do custo do erro, não da taxa média. Em uma tarefa reversível, 10% de erro é ruído que a revisão absorve. Em uma tarefa que move dinheiro ou fala com clientes, 10% é um incidente por semana — e ninguém opera assim.

    Como começar com agentes sem correr risco alto?

    Comece por uma tarefa única, repetitiva, com resultado verificável em segundos e efeito desfazível. Rode em modo somente-leitura primeiro, depois com aprovação humana antes de cada escrita, e só então dê autonomia — se os números justificarem.

    Perguntas frequentes

    Agente de IA substitui automação tradicional (RPA, integrações)?

    Não, e na maior parte dos casos o contrário é verdadeiro. Se o processo é estável e cabe em regras, uma automação determinística é mais barata, mais rápida e mais previsível. O agente ganha onde há variação e ambiguidade que uma regra fixa não cobre — e o desenho mais robusto costuma ser híbrido: automação para o caminho previsível, modelo apenas nos pontos que exigem interpretação.

    Qual taxa de acerto é aceitável para colocar um agente em produção?

    Não existe um número universal, e desconfie de quem oferece um. O critério é a relação entre a taxa de erro e o custo de cada erro. Em triagem de tíquetes, uma taxa alta de erro ainda é operável porque a correção é trivial. Em qualquer ação irreversível, a resposta prática é que nenhuma taxa dispensa aprovação humana — o controle vem do desenho de permissões, não da acurácia.

    Preciso de um agente ou de um copiloto para o meu time?

    Se o objetivo é dar velocidade a pessoas que continuam decidindo, você quer um copiloto: ele responde, rascunha e consulta, e o humano executa. Se o objetivo é tirar uma tarefa repetitiva do fluxo de trabalho de alguém, aí é agente. A maioria das empresas obtém mais retorno começando pelo copiloto, porque o risco é menor e a adoção é imediata.

    Como saber se um fornecedor está vendendo um agente de verdade?

    Faça três perguntas concretas. Quais ações ele executa em quais sistemas, e com que credencial? O que acontece quando ele erra — onde fica o log, quem é avisado e como se desfaz? Qual foi a taxa de acerto em um conjunto de casos reais da minha empresa, não da demonstração? Fornecedor que não responde a essas três com objetividade está vendendo um chatbot com integração, ou não terminou de pensar no problema.

    Continue lendo

    Mais sobre Implementação de IA