Edição #9 - Um agente não fecha o mês. Uma frota, sim.

O que muda quando você para de automatizar uma rotina do fechamento e passa a desenhar o fechamento inteiro com agentes, e por que a maioria das empresas grandes começa pelo lugar errado.
Quase todo projeto de IA em contabilidade que eu vejo começa igual: alguém automatiza a rotina mais chata do próprio time, monta uma demonstração bonita, mostra o resultado numa reunião em que todo mundo aplaude, e no mês seguinte o fechamento continua saindo exatamente no mesmo dia de sempre.
Não é falta de tecnologia, e quase nunca é falta de gente boa no time, é erro de escopo, porque o que foi automatizado não era o que segurava o calendário.
Numa empresa grande, o fechamento é uma cadeia com dependência e não um conjunto de tarefas que podem ser atacadas em qualquer ordem, porque cada elo espera o anterior terminar. A conciliação bancária alimenta a análise de caixa, a apuração de tributos depende do cut-off de notas estar fechado, a consolidação só começa quando a última filial entrega, e a análise de variação fica parada até o balancete parar de mudar. Cada elo parece autônomo quando você olha o organograma, mas na prática nenhum deles anda sozinho.
Cadeia com dependência tem uma propriedade cruel, que é andar na velocidade do elo mais lento e não na média dos elos.
Você pode colocar um agente para resolver em dez minutos uma tarefa que levava quatro horas e, se o insumo dela continua chegando no D+4, o seu fechamento continua saindo no D+9, com a diferença de que agora você tem um analista muito bem equipado esperando.
É por isso que esta edição trata da frota inteira em vez de tratar de um agente isolado, e trata principalmente de decidir em que ordem os pedaços dessa frota entram no ar.
O fechamento de uma empresa grande, mapeado
Antes de decidir onde a IA entra, vale ter o mapa na mesa, porque a conversa muda bastante quando você olha o calendário inteiro em vez de olhar só a sua parte dele.
Toda vez que eu sento com um time e peço para listar o fechamento etapa por etapa, com data e dependência, aparece pelo menos uma amarração que ninguém tinha percebido, e às vezes aparece a descoberta desconfortável de que a etapa mais penosa do mês está esperando um arquivo que uma pessoa manda por e-mail no D+2.
O que descrevo abaixo é o padrão que eu vejo em empresa com várias unidades, ERP consolidado e reporte para matriz ou conselho, e ele costuma se repetir com pequenas variações de nomenclatura.
O bloco de D-3 a D0 é o pré-fechamento, e ele é feito quase todo de conferência: cut-off de compras e vendas, notas em trânsito, mercadoria recebida sem nota, inventário rotativo e acurácia de estoque.
De D+1 a D+3 vem a camada de alto volume, com a conciliação de bancos em todas as contas e todas as empresas do grupo, adquirentes e meios de pagamento, contas a receber e contas a pagar batidas contra o razão, e a apuração de tributos sobre entradas e saídas.
Entre D+3 e D+5 entram os lançamentos de competência, que é onde ficam as provisões de férias, décimo terceiro, bônus e PLR, a depreciação e a amortização, o rateio de custos entre centros e unidades, as despesas antecipadas e receitas diferidas, a equivalência patrimonial e a conversão de moeda quando existe operação no exterior.
De D+5 a D+7 o time entra na amarração e na análise, conciliando as contas de balanço contra os auxiliares, amarrando razão contra balancete, rodando variação de orçado contra realizado, mês contra mês e ano contra ano, e escrevendo o comentário que explica cada desvio relevante.
Finalmente, de D+7 a D+10, vem a entrega, com a consolidação das empresas do grupo, as obrigações acessórias, o board pack, o reporte gerencial e o pacote que segue para a matriz.
Olhe esse mapa com calma e responda uma coisa:
em quantas dessas linhas o trabalho é, no fundo, comparar duas listas, aplicar uma regra que já está escrita em algum lugar ou preencher um template que não muda há três anos?
Na minha conta, mais da metade, e é exatamente essa metade que a frota assume, enquanto a parte que sobra, a que exige julgamento de verdade, é justamente a que hoje recebe menos tempo porque as pessoas chegam nela exaustas.
O que a frota assume, etapa por etapa
O padrão se repete em todas as camadas do calendário: o agente faz o trabalho mecânico e para na borda da decisão, entregando o resultado no ponto exato em que o seu julgamento precisa entrar.
Não é uma divisão que eu inventei numa lousa, é o que sobra depois de você tentar empurrar o agente para dentro do julgamento e descobrir, no primeiro mês, que ele acerta a regra e erra o contexto. Vale percorrer o calendário de novo, agora com os agentes descritos dentro de cada etapa, porque é assim que a arquitetura fica visível.
No pré-fechamento entram os agentes de conferência, que varrem o que entrou sem nota, o que tem nota sem entrada e o que ficou com data de competência trocada em relação ao cut-off. Esse é trabalho de resistência puro, daqueles que ninguém quer fazer na sexta à noite, mas é ali que nasce metade do retrabalho do mês.
Nas conciliações entram os agentes de casamento, um para banco, outro para adquirente, outro para contas a receber e outro para contas a pagar, cada um cruzando duas fontes e devolvendo exceção já classificada em vez de uma pilha bruta de divergências. Essa costuma ser a camada de maior ganho imediato porque o volume é alto e a regra é clara, o que significa que o agente acerta muito e erra de forma previsível.
Nos lançamentos de competência entram os agentes de template, que montam depreciação, rateio, provisão fixa e apropriação de seguro, deixando o lote pronto em rascunho para revisão, porque ninguém lança nada sozinho e essa regra não tem exceção.
Na amarração entram os agentes de verificação cruzada, que confrontam razão contra balancete contra auxiliar, e repare que aqui o agente não produz número nenhum, ele procura o ponto em que três fontes que deveriam bater não batem. Essa é a rotina mais subestimada da lista inteira e, ao mesmo tempo, a que mais protege o fechamento, porque pega o erro antes que ele vire insumo de outra coisa.
Na análise entram os agentes de primeira versão, que calculam a variação, separam efeito preço de efeito volume e devolvem um comentário já no formato do report. O texto final continua sendo seu, mas você passa a começar de uma minuta com os números certos em vez de uma tela em branco às onze da noite.
Na entrega, por fim, entram os agentes de montagem, que consolidam seguindo a regra já definida, preenchem o board pack no template padrão e rodam o checklist de obrigação acessória com todas as travas antes da transmissão, e não depois de a multa aparecer.
Olhando as seis camadas juntas, o que salta é que em nenhuma delas o agente decide qualquer coisa, ele empurra o trabalho até a beirada em que alguém precisa julgar e para ali, e é a posição exata dessa beirada que separa uma frota que funciona de uma que vira passivo.
Essa é a linha que o resto da edição tenta desenhar com alguma precisão, primeiro no calendário, depois na fila de exceções e por último na governança.
O erro que quase toda empresa grande comete
O erro é começar pela rotina mais visível em vez de começar pela que trava a cadeia, e ele é tão comum que dá para prever qual projeto vem primeiro só olhando o organograma.
Ninguém pede um projeto para automatizar conferência de nota em trânsito, porque isso não rende slide, não impressiona ninguém na reunião de diretoria e não muda a percepção que a empresa tem da área.
O problema é que a análise de variação fica no final da cadeia, e automatizar o final antes do começo produz um analista que termina o trabalho dele em uma hora e depois passa três dias esperando o balancete parar de mudar. O ganho existe, é real e é mensurável dentro da tarefa, mas ele evapora no calendário, porque o tempo economizado vira tempo de espera e o mês continua fechando no mesmo dia.
Você ganhou tempo numa etapa que não era restrição, o calendário não se move um dia sequer, e o projeto que parecia bem-sucedido na demonstração vira aquela ferramenta que ninguém sabe explicar por que não encurtou nada. O resultado talvez seja pior do que o cenário anterior, porque agora existe dentro da empresa a sensação de que a IA foi tentada e não funcionou. Essa sensação é cara, e ela costuma custar o orçamento do ano seguinte inteiro, já que a segunda tentativa precisa vencer uma desconfiança que a primeira criou sozinha.
O gargalo real quase sempre está lá atrás, na camada que ninguém quer mostrar em reunião, ou seja, cut-off, conciliação e amarração, que é o trabalho feio, chato e invisível que efetivamente segura o mês. Isso explica por que tanto piloto morre bonito: ele foi desenhado para impressionar, não para destravar. Automatize na ordem da dependência, não na ordem da visibilidade.
O produto novo que ninguém desenha: a fila de exceções
Aqui está o ponto que separa quem já rodou isso em escala de quem só leu sobre o assunto, e ele quase nunca aparece nas conversas de fornecedor.
Com um agente, o output do processo é o trabalho feito, e você olha o resultado, aprova e segue. Com doze agentes, o output do processo deixa de ser o trabalho feito e passa a ser uma fila de exceções, e fila mal desenhada mata um projeto muito mais rápido do que agente mal configurado.
Pense no que acontece na prática:
Doze agentes rodam de madrugada e, às sete da manhã, você tem trezentas exceções espalhadas em doze relatórios diferentes, cada um com formato próprio, cada um com uma noção diferente do que é relevante. Se ninguém desenhou a fila antes, o time abre o dia com trezentos itens sem prioridade, sem dono e sem prazo, gasta a manhã inteira decidindo por onde começar, e a reação natural de qualquer profissional sensato é voltar para o método que ele controla. Em dois meses todo mundo está de novo na planilha, que pelo menos era previsível, e o projeto morre sem que ninguém precise cancelá-lo formalmente.
Uma fila que funciona tem quatro propriedades, e a parte incômoda disso é que nenhuma delas é sofisticada, todas são apenas disciplinadas, do tipo que qualquer time consegue implementar e quase nenhum implementa porque parece detalhe operacional diante do brilho de configurar o agente. Nenhuma das quatro é opcional, e a fila que abre mão de uma costuma perder as outras três em poucas semanas.
Classificação, não listagem. Cada exceção precisa chegar com um tipo definido, e cada tipo precisa ter uma ação padrão associada, senão a triagem vira um trabalho manual novo no lugar exato do trabalho manual que você acabou de automatizar.
Materialidade. Uma diferença de oitenta centavos e uma de oitenta mil não podem chegar com o mesmo peso visual na mesma tela, porque no momento em que chegam iguais o time perde a régua e passa a tratar tudo como igualmente urgente, que é o mesmo que tratar tudo como igualmente adiável.
Dono. Exceção sem nome ao lado não é resolvida, ela é herdada pela próxima pessoa que abrir o relatório, e depois de duas semanas ninguém sabe mais quem estava olhando o quê.
Idade. O que está parado há cinco dias precisa gritar mais alto na tela do que o que entrou hoje de manhã, senão a fila vira pilha e a pilha vira surpresa no dia da entrega.
Repare que as quatro atacam a mesma coisa por ângulos diferentes, que é transformar um monte de itens soltos numa ordem de trabalho, e é isso que o time precisa encontrar pronto às sete da manhã em vez de construir do zero todos os dias. Se você for tirar uma única coisa desta edição, tire essa: em escala, o desenho da fila importa mais que a qualidade individual de cada agente, porque doze agentes ótimos despejando resultado numa fila ruim produzem menos valor que seis agentes medianos numa fila bem pensada.
Onde o julgamento continua sendo humano
Vale ser explícito sobre a divisão de trabalho, porque quando a frota cresce a tentação de empurrar a fronteira aumenta junto, e cada cadeira do time tem um tipo de decisão que não sai de lá.
O controller continua decidindo se uma pendência é erro de lançamento, ajuste de exercício anterior ou política contábil que o agente simplesmente não conhece, e continua decidindo o que é material o bastante para segurar o fechamento, que é uma chamada de julgamento e não de regra.
O contador responsável assina, e isso não muda: o agente adianta o serviço até a borda da decisão, mas a responsabilidade técnica não é delegável e nenhuma automação altera esse fato.
O CFO decide o que entra no board pack e o que fica de fora, e decide também quando um número está bom o suficiente para sustentar uma decisão. Isso é bem diferente de estar perfeito, porque perfeição no dia D+8 costuma custar mais do que vale, e quem senta na mesa da diretoria sabe reconhecer a diferença.
A auditoria interna define o escopo de autonomia de cada agente e revisa o log, e o papel dela muda de natureza quando existe frota. O risco deixa de ser o erro isolado e passa a ser o erro que alimenta outras três rotinas antes de alguém perceber.
Do lado fiscal, o enquadramento e o tratamento de operação atípica seguem sendo leitura humana, porque regra o agente aplica bem, mas exceção regulatória exige alguém que entenda o contexto e o histórico daquela operação específica.
E o FP&A continua decidindo qual cenário vira narrativa para a diretoria, que é a parte do trabalho em que o número já está pronto e o que está em jogo é o significado dele, ou seja, exatamente o tipo de escolha que não tem resposta certa esperando dentro do sistema.
Como escolher a primeira rotina, em quatro perguntas
Depois de mapear a cadeia e entender onde o julgamento fica, sobra questionamento prático: por onde começar sem transformar o projeto num experimento caro.
Não existe uma rotina que sirva para toda empresa, porque a resposta depende do desenho da cadeia de cada uma, então o que eu uso é um filtro de quatro perguntas, sempre nesta ordem.
Cada uma delas elimina um tipo diferente de projeto que ia fracassar por motivo previsível, e juntas elas costumam derrubar noventa por cento dos candidatos antes da primeira reunião técnica. Se a rotina passar pelas quatro, ela é uma boa aposta, e se reprovar em qualquer uma, o trabalho real está em outro lugar que não é configurar agente.
Ela trava alguma outra rotina? Se a resposta for sim, ela passa na frente de qualquer rotina que dependa dela, sem discussão, porque destravar o elo lento é o único movimento que encurta o calendário.
O insumo chega em formato estável? Se metade dos arquivos ainda chega por e-mail e WhatsApp em layout diferente a cada mês, o problema é de processo e não de IA, e agente nenhum resolve isso por você.
Existe regra escrita ou só prática de quem faz há anos? Se a regra vive na cabeça de uma pessoa, o primeiro trabalho é escrever a regra e não configurar o agente, porque o que você não consegue explicar você também não consegue delegar.
Quem revisa o resultado, e a que horas? Rotina sem revisor com horário definido não é automação, é acúmulo silencioso de pendência, e o problema só aparece quando já virou uma pilha grande demais para tratar antes da entrega.
Quatro respostas boas e você tem a sua primeira rotina definida com bem mais segurança do que a intuição daria.
Vale registrar que a terceira pergunta costuma pagar sozinha o tempo da conversa, porque escrever a regra que hoje vive na cabeça de uma pessoa tem valor mesmo que a automação nunca saia do papel.
Comece por uma rotina só, prove o resultado em um ciclo inteiro de fechamento, e só depois expanda, porque cada agente novo que entra antes da hora aumenta o custo de descobrir que a arquitetura estava errada.
O que muda na governança quando são doze e não um
Quando existe um agente só, governança é praticamente uma conversa entre duas pessoas, mas quando existe frota o assunto vira desenho de processo, e algumas regras precisam estar escritas antes da primeira execução.
A primeira é o escopo por agente: o que cada um faz sozinho e o que ele apenas sinaliza e espera são duas listas diferentes, e a linha entre elas tem que estar clara no papel, e não descoberta depois de um erro no dia da entrega.
A segunda é que nenhum agente lança direto no ERP, e essa regra vale mesmo para o lançamento óbvio, porque o custo de reverter um lançamento errado que já se propagou em cascata é sempre maior que o tempo economizado ao pular a aprovação.
A terceira é log de tudo, sempre, e essa costuma ser a mais fácil de vender internamente: um processo que roda sozinho e deixa rastro completo é mais auditável que um processo manual bem feito, porque a evidência não depende de alguém lembrar de salvar a planilha intermediária na pasta certa.
A quarta é ordem de execução explícita, e ela é sutil, já que em cadeia com dependência um agente rodando fora de ordem produz resultado tecnicamente correto sobre insumo desatualizado, que é o pior tipo de erro que existe justamente porque parece certo e passa por todas as conferências.
A quinta regra é revisão com horário fixo, com alguém abrindo a fila toda manhã antes que o resultado vire insumo de outra entrega, porque a frota trabalha de madrugada e a janela para corrigir sem contaminar o resto do processo é curta.
Repare que nenhuma dessas cinco é sobre tecnologia, todas são sobre processo, e é por isso que times que já têm disciplina de fechamento absorvem frota de agentes muito mais rápido que times que estavam contando com a automação para criar essa disciplina.
Fecho essa parte com o que eu não automatizaria de jeito nenhum, e a lista é curta:
lançamento direto no ERP mesmo quando parece óbvio,
julgamento de materialidade,
classificação de operação atípica
qualquer coisa cujo erro precise ser explicado em vez de simplesmente refeito.
A régua que eu uso é simples e cabe numa frase: automatize até a borda da decisão, e a borda é exatamente o ponto onde o custo do erro deixa de ser refazer e passa a ser explicar.
Onde isso deixa de ser teoria
Nas últimas semanas eu montei um desses agentes ponta a ponta e documentei o processo inteiro, tela por tela, para a conversa não ficar só no plano da arquitetura.
Ele varre a pasta onde cai o extrato do banco e a pasta onde cai o razão do ERP, cruza lançamento a lançamento, isola o que não bate e classifica cada exceção pelo tipo, e no fim me manda um e-mail pedindo revisão. Faz isso todo dia útil às sete da manhã, sem ninguém precisar pedir e sem ninguém precisar abrir nada.
No ciclo que eu documentei ele fechou 89 dos 93 lançamentos sozinho, e os quatro que sobraram são justamente a parte interessante da história, porque é ali que fica a discussão sobre até onde vai a autonomia. É neles que aparece a diferença entre a regra escrita e o contexto de quem senta na cadeira, e é por isso que a fila de exceções, mais do que a taxa de acerto, é o primeiro número que eu olho quando alguém me mostra um agente rodando em produção.
Eu levo esse caso inteiro, com as telas do processo e a fila de exceções montada, para a Imersão Claude para Contadores, 2ª turma, sábado 22 de agosto, ao vivo e com gravação por 30 dias, que é um dia inteiro construindo entregas executivas reais com IA dentro da rotina de contabilidade, controladoria e FP&A.
Se o seu fechamento hoje trava numa etapa que você já sabe apontar de cabeça, é exatamente esse tipo de caso que a gente monta junto durante o dia.
A pergunta chave
A pergunta que separa projeto de IA que funciona de projeto que morre em piloto não é qual ferramenta usar, e nunca foi, porque a ferramenta é a parte mais fácil e a que menos diferencia um resultado do outro.
Se você ainda não sabe qual é a sua, o teste é o mais simples possível: pergunte ao time qual etapa costuma ficar esperando outra, e depois pergunte quantos dias por mês essa espera custa.
As duas respostas juntas apontam o primeiro agente com muito mais precisão do que qualquer lista de casos de uso que um fornecedor vá te mostrar.
Me conta nos comentários qual etapa trava o seu fechamento hoje, e eu respondo com a ordem em que eu atacaria.
Publicado originalmente por Johnathan Pires no LinkedIn. Ver a publicação original.