Duas automações não formam uma segunda opinião
Um agente pode escrever código, preparar uma análise ou executar uma operação. Outro pode comparar a saída com regras, testes e exemplos. Essa separação aumenta cobertura e reduz fila, mas não garante independência: os dois podem compartilhar modelo, contexto, dados, ferramentas, instruções e pontos cegos.
A pergunta de governança não é apenas se houve revisão. É se o controle consegue detectar uma falha que o executor tenderia a repetir, se está protegido contra alteração pelo mesmo caminho e quem responde quando execução e revisão concordam sobre uma decisão errada.
Execução, verificação, revisão e aprovação são funções diferentes
O executor produz a mudança. O checker aplica testes determinísticos ou regras objetivas. O reviewer interpreta evidências, exceções e impacto. O approver aceita o risco e autoriza a liberação. Uma pessoa ou sistema pode acumular funções em baixo risco, desde que a decisão seja deliberada e rastreável.
Em ações materiais, a segregação precisa crescer com a consequência. Um agente não deve poder alterar silenciosamente a própria política, seus testes decisivos e a evidência usada para aprovar a mudança. Controle sem proteção vira apenas mais uma etapa da mesma execução.
Evals ampliam alcance; não transferem responsabilidade
A OpenAI descreve evals como um ciclo de especificar, medir e melhorar e recomenda que especialistas auditem regularmente avaliadores baseados em modelos e revisem logs do sistema. É orientação do fornecedor, não prova de qualidade ou retorno. O ponto útil é tratar o avaliador como componente que também precisa ser avaliado.
Automação pode testar mais casos, comparar versões e encontrar regressões antes da liberação. Ainda é necessário verificar se o conjunto representa o trabalho real, se a métrica corresponde ao outcome e se falhas graves não desaparecem dentro de uma média confortável.
Controle humano precisa ser significativo
A Anthropic apresenta controle humano, transparência, segurança e privacidade como princípios para agentes e exemplifica permissões que podem permitir, exigir aprovação ou bloquear ações. É uma proposta do próprio fornecedor. Ela não demonstra que uma configuração concreta está segura ou que a pessoa revisora possui tempo e contexto para decidir.
Aprovação humana simbólica apenas desloca responsabilidade. O aprovador precisa receber evidência compreensível, conhecer o limite de sua autoridade, conseguir interromper o fluxo e não ser pressionado a confirmar um volume impossível de examinar.
O risco define o desenho do gate
Classifique ações por impacto, reversibilidade, alcance e acesso a dados ou recursos. Mudanças reversíveis em ambiente isolado podem seguir com controles automáticos. Alterações financeiras, acesso privilegiado, comunicação externa, exclusão de dados ou efeitos sobre clientes exigem gates mais fortes, revisão apropriada e plano de recuperação.
O NIST AI RMF organiza risco como governar, mapear, medir e gerenciar e pede papéis e responsabilidades claros. O framework é voluntário e não certifica o sistema. Para a venture, ele reforça que controle é um processo contínuo, com liderança responsável, e não um selo aplicado ao final do pipeline.
O investidor deve pedir a cadeia de aceite
Peça um exemplo de mudança material: quem a solicitou, qual agente executou, que verificadores rodaram, quais evidências ficaram preservadas, quem aprovou, que versão foi liberada e como seria revertida. A existência de muitos comentários ou checks não demonstra que eles sejam independentes ou eficazes.
Observe também a economia do controle: tempo humano por liberação, taxa de override, falhas escapadas, retrabalho, incidentes e concentração de autoridade. Automação saudável reduz espera mantendo risco visível. Automação frágil aumenta volume e converte revisão em cerimônia.
Responsabilidade termina em uma decisão humana identificável
Para o empresário, a entrega mínima é uma matriz de autoridade por classe de ação, acompanhada de evidência versionada, logs, condição de parada e recuperação testada. Para o investidor, é a capacidade de demonstrar que a organização sabe quem pode aceitar cada risco e como aprende quando o controle falha.
Agentes podem propor, executar, comparar e escalar. Eles não ocupam a responsabilidade fiduciária, operacional ou ética de quem decide liberar capital e efeitos sobre terceiros. Quanto maior a autonomia, mais explícita precisa ser a autoria do aceite.
Sem complicar
- Checker
- Controle que aplica regras ou testes objetivos a uma saída; sua existência não garante cobertura ou independência.
- Reviewer
- Pessoa ou sistema que interpreta evidências, contexto e exceções antes de recomendar aceite ou correção.
- Approver
- Autoridade que aceita o risco residual e autoriza uma mudança ou ação a produzir efeitos.
- Override
- Intervenção autorizada que substitui, corrige, bloqueia ou reverte a decisão proposta pelo sistema.
Aprofunde pela sua frente
Separe executor, checker, reviewer e approver; proteja verificações e vincule a evidência à versão liberada. Explorar a FORGE ↗
Redesenhe o fluxo de trabalho para que automação reduza espera sem esconder responsabilidade ou criar uma nova fila opaca. Conhecimento Tech Human ↗
Quanto mais a IA executa, mais explícitos precisam ser direção, limites e autoria da decisão. Ler Fernando Parreiras ↗
Fontes, interpretação e limites
Síntese executiva baseada em referenciais públicos de risco, orientações de fornecedores e conteúdos próprios de aplicação. Não certifica independência, segurança ou conformidade, não define segregação universal e não substitui análise jurídica, técnica ou setorial do sistema operado.
Pesquisa, estrutura e redação tiveram assistência de IA. Fontes e limites revalidados em 2 de outubro de 2026; aprovação editorial final permanece humana.
Economia e investimento · 2 de outubro de 2026
O harness certo não vem pronto. Ele é descoberto em ciclos de contexto, modelos, ferramentas, evals e operação — e esse aprendizado consome caixa e conhecimento.
Ler perspectiva ↗Mercados e oportunidades · 30 de setembro de 2026
Quando produto e código se aproximam, a venture ainda precisa de alguém que mantenha tese, prioridade, economia, risco e aceite no mesmo contrato de decisão.
Ler perspectiva ↗