Por Que Agentes Falham: O Cemiterio de PoCs

Created on 2026-09-01 — updated on September 28, 2026


Tempo de leitura: 4 minutos. Autor: Hugo S. Nascimento.

Contexto: Escrevi este ensaio apos uma reuniao a portas fechadas na Avenida Paulista com o CIO de uma grande corporacao que gastou quatrocentos mil dolares em tres demonstracoes de diretoria que jamais passariam na revisao de seguranca. Aqui explico por que pilotos corporativos travam e como nos os puxamos para producao.

Mais de oitenta e cinco por cento dos pilotos corporativos de IA generativa nunca chegam a producao. Eles sao silenciosamente enterrados no que chamo de Cemiterio de PoCs.

Nos meus anos construindo empresas de software com venture capital e implantando sistemas corporativos, assisti a esse filme repetidamente. Uma equipe interna de inovacao ou uma agencia externa recebe meio milhao de dolares para construir um prototipo de inteligencia artificial. Eles abrem um notebook, jogam trinta manuais em PDF dentro de um banco vetorial, criam uma interface bonita em React e apresentam para a diretoria.

A sala de reuniao fica entusiasmada. O conselho aprova mais verba.

Entao chega a segunda-feira de manha. O projeto passa para as equipes de arquitetura corporativa e seguranca da informacao. No instante em que aquele prototipo tenta tocar dados reais de producao, toda a iniciativa para de forma abrupta.

A demonstracao nao era um produto corporativo. Era apenas um truque de palco.

As Tres Razoes Estruturais Pelas Quais Agentes Corporativos Falham

Software corporativo nao opera dentro de espacos vetoriais limpos. Ele opera sobre trinta anos de debito relacional acumulado.

1. O Choque dos Schemas Legados

Um ambiente de sandbox e limpo. Sistemas corporativos reais sao sujos.

Quando um agente autonomo se conecta a uma instancia real de producao do SAP ECC ou Totvs Protheus, ele nao encontra objetos JSON limpinhos. Ele encontra tabelas sem documentacao, colunas customizadas criadas ha dez anos, chaves estrangeiras nulas e excecoes de negocio silenciosas.

Modelos de linguagem possuem zero entendimento inerente de integridade relacional. Em um ambiente sem limites estritos, eles chutam. Eles alucinam joins de tabelas e inventam colunas inexistentes. Uma unica chave estrangeira alucinada interrompe uma rotina batch de ERP e corrompe relatorios contabeis.

2. A Armadilha de Latencia Multiagente

Durante uma apresentacao de diretoria, um executivo espera com paciencia quinze segundos por uma resposta articulada. Em um barramento de servicos corporativos em producao, quinze segundos e uma eternidade que dispara timeouts em cascata.

Quando equipes constroem sistemas multiagente ingenuos sem limites formais, os modelos entram em loops de raciocinio desgovernados. No mes passado, auditei a base de codigo de um cliente corporativo onde uma simples consulta de cliente disparou quarenta e duas chamadas consecutivas de ferramentas, estourando limites de requisicoes da nuvem e queimando o orcamento mensal de API em apenas tres dias.

Se o seu agente exige sessenta chamadas de ferramentas para encontrar o status de uma fatura, voce nao possui uma arquitetura. Voce possui um ataque de negacao de servico distribuido contra a sua propria infraestrutura.

3. A Barreira de Seguranca Nao E Negociavel

Todo Chief Information Security Officer com quem converso na Faria Lima e na Paulista tem a mesmissima reacao justificada: eles jamais vao conceder permissoes diretas de escrita para um prompt probabilistico.

Se um sistema autonomo nao puder provar isolamento de perimetro, separacao estrita de limites somente leitura e validacao criptografica rigida em cada mutacao, a equipe de seguranca bloqueara o projeto por tempo indeterminado. A PoC morre nao porque o modelo e burro, mas porque a engenharia foi irresponsavel.

Como a HSN Labs Escapa do Cemiterio

Na HSN Labs, nao construimos apresentacoes de slides para conselhos nem demos frageis de sandbox. Quando nossos engenheiros entram em um cliente corporativo, aplicamos tres regras inegociaveis:

  • Ancorar Cada Passo em Ontologias Explicitas: Modelos nunca consultam bancos relacionais diretamente. Eles interagem com grafos de dominio pre-compilados que impoem invariantes de esquema antes de qualquer execucao.
  • Delimitar a Execucao com Maquinas de Estados Finitos: Cada fluxo de trabalho agentico precisa operar dentro de transicoes de estado matematicamente comprovaveis. O modelo pode sugerir o caminho, mas travas de software em nivel de codigo impoem os limites.
  • Executar Testes de Regressao em Nivel de Codigo: Testamos agentes contra dados reais de transacoes anteriores, medindo conformidade e precisao com tolerancia zero a alucinacoes.

O valor corporativo nao e medido por chatbots conversadores. Ele e medido por software em producao que escreve em bancos de dados centrais sem quebrar a operacao da empresa.

Recursos Estrategicos e Ensaios Relacionados


Artigo publicado originalmente em HSN Labs. Autor: Hugo S. Nascimento.