← Artigos
13 de setembro de 2026 · leitura de 6 minutos

O andar dos construtores

Todo material de venda de agente de IA lidera com acurácia: noventa e cinco por cento, noventa e oito, noventa e nove. É a métrica errada. Risco não é probabilidade de erro. É probabilidade multiplicada por alcance.

A métrica que todo mundo sabe produzir

Todo material de venda de agente de IA abre com acurácia. Noventa e cinco por cento, noventa e oito, noventa e nove. É a métrica que a engenharia sabe produzir e o comprador sabe comparar. E ela responde à pergunta errada.

Risco não é probabilidade de erro. É probabilidade multiplicada por alcance.

O mesmo modelo, dois riscos diferentes

Um agente com noventa e nove por cento de acerto que redige rascunhos é excelente: o pior erro possível é um parágrafo ruim, que alguém corrige antes de publicar. O mesmo agente, com a mesma acurácia, executando estornos financeiros, alterando cadastro de fornecedor ou publicando em nome da empresa, é uma decisão completamente diferente. A diferença não está no modelo. Está no que você deixou o modelo alcançar.

Alcance é escolha de projeto. Acurácia é característica do fornecedor. Uma das duas está sob o seu controle, e não é a que aparece na proposta.

A superfície nova não está no modelo

A distinção deixou de ser teórica no momento em que os agentes ganharam ferramentas. Servidores MCP, a interface por onde um agente acessa sistemas e ferramentas externas, já acumulam vulnerabilidades divulgadas desde que o protocolo existe, partindo de praticamente zero. A superfície nova de risco não mora no modelo de linguagem. Mora na tubulação que dá alcance a ele.

Por isso a ordem certa da conversa é outra. Antes de perguntar o quanto o sistema acerta, defina até onde ele pode chegar. A régua não é o quanto você confia nele. É o que acontece quando ele erra, e quanto custa desfazer.

Ação que se desfaz em minutos suporta autonomia alta, mesmo com acurácia mediana. Ação que se desfaz em semanas exige aprovação real, sempre. Ação que não se desfaz não deveria estar delegada, por melhor que o modelo pareça na demonstração.

Delegar sem confiar, muito antes de existir agente

Aprendi a delegar assim antes de qualquer agente existir. Sempre trabalhei cercado de gente tecnicamente melhor do que eu, o que considero obrigação de quem lidera, não concessão. Funcionou por um motivo que não é confiança: era claro, para mim e para elas, quais decisões voltavam para a minha mesa, e por quê.

Autonomia sem essa fronteira explícita não é delegação. É omissão com aparência de modernidade.

A maioria da supervisão que existe é teatro

A maior parte dos controles de supervisão humana que vejo em produção é teatro. Existe uma tela, um botão de aprovar, um registro de quem clicou. E existe uma pessoa recebendo centenas de solicitações por dia, sem contexto real para avaliar nenhuma, cuja recusa atrasaria um processo que a organização inteira cobra que seja rápido.

Supervisão só existe quando recusar é possível de verdade. Se recusar tem custo proibitivo, você não tem supervisão humana. Tem uma assinatura, e assinatura serve para atribuir culpa depois do fato, não para evitar o dano antes dele.

O que isso põe na sua mesa

A pergunta que separa quem tem controle de quem tem esperança não é se a empresa usa IA. É: qual ação um sistema já executa hoje, sozinho, que a empresa não consegue desfazer em uma semana?

Numa resposta, alguém já decidiu por escrito até onde essa ação pode ir. Na outra, o limite nunca foi formalizado: a autonomia cresceu por omissão, não por decisão. A primeira é desenho. A segunda é sorte que ainda não acabou.

De onde vem a régua deste texto

A pergunta "o que acontece quando ele erra, e quanto custa desfazer" não é intuição pessoal. É a metade central do mesmo critério que organiza os outros textos desta série.

O primeiro eixo é o alcance do erro: um rascunho, um efeito interno, um efeito operacional e um efeito que atravessa a porta da empresa não podem viver sob a mesma permissão, porque o custo de desfazer cada um é de ordem de grandeza diferente. O segundo eixo é o controle que sobra do lado humano, que vai de examinar caso a caso até apenas constatar o efeito depois do fato consumado.

A regra que liga os dois cabe numa linha: o controle remanescente precisa ser maior ou igual à irreversibilidade do que foi delegado. Acurácia alta não substitui essa conta. Só muda a frequência do erro, nunca o tamanho dele.

As quatro faixas de alcance, os tetos de cada uma e as perguntas que fazem a régua morder estão publicados, com data, na página do método.

A prática de delegação descrita é de experiência profissional do autor, anterior à existência de agentes de IA. O acúmulo de vulnerabilidades divulgadas em servidores MCP desde o lançamento do protocolo é fato de conhecimento público no setor; nenhum número específico é citado aqui por não haver, no momento da publicação, uma contagem consolidada e verificável em fonte primária.

A régua deste texto está publicada, com data

As quatro faixas de alcance, os tetos de cada uma e as perguntas que fazem a régua morder. Nada disso é segredo: o que não se copia é a prática de aplicar caso a caso.

Ler o método
Aplicar ao seu próprio caso