Conceitos
Todos os conceitos
67 conceitos organizados em seis camadas. Cada um com uma frase, um exemplo, o erro comum, como aplicar e quando está pronto.
67 / 67
Execução de Agentes
Agent Teams
O organograma aplicado a agentes.
Execução de Agentes
Agente
Recebe objetivo, decide ações, usa ferramentas, observa e itera. Chatbot só responde.
Execução de Agentes
APIs
Uma Cognitive Enterprise trata "ter API" como pré-requisito de qualquer sistema novo.
Execução de Agentes
CLI
A porta por onde um programa é operado por texto, sem tela. É o que separa software que pode ser delegado de software que só aceita mão humana.
Execução de Agentes
Context Engineering
É para o contexto o que gestão de capital é para caixa.
Execução de Agentes
Context Window
O recurso mais escasso da operação agêntica.
Execução de Agentes
Context7
Documentação atualizada de bibliotecas direto no contexto do agente.
Execução de Agentes
File System Access
O que permite estado persistente e arquivos como memória compartilhada entre agentes.
Execução de Agentes
Handoff / Escalation
Critérios claros de escalação são o que evita agente travado ou agindo além da competência.
Execução de Agentes
Harness
O modelo é o motor; o harness é o carro.
Execução de Agentes
Hooks
Automatizam governança sem depender do modelo lembrar.
Execução de Agentes
Knobs
Os botões de ajuste do sistema: parâmetros explícitos no lugar de comportamento fixo.
Execução de Agentes
LLM
O motor. Recebe texto e prevê a continuação mais provável. Memória, decisão e ação são construídas em volta dele.
Execução de Agentes
Loop
Pensar → agir → observar → repetir. Toda arquitetura agêntica é um loop com controles em volta.
Execução de Agentes
MCP (Model Context Protocol)
O USB-C da stack da Cognitive Enterprise.
Execução de Agentes
Memory
Sem memory, cada sessão começa do zero.
Execução de Agentes
Multi-agentes
Vale só quando um agente único não dá conta, porque a coordenação tem custo.
Execução de Agentes
Orquestrador / Routing
O gerente de tráfego: modelo caro para tarefa difícil, modelo barato para triagem.
Execução de Agentes
Python
A língua franca que agentes escrevem melhor e o formato padrão de automação verificável.
Execução de Agentes
Ralph Loop
Para tarefas longas: o agente acorda, lê o estado, avança um pouco, salva, e recomeça.
Execução de Agentes
Sandbox
Pré-requisito para dar autonomia com segurança: erro no sandbox não vaza para produção.
Execução de Agentes
Skills
Um SOP executável: pastas com instruções, exemplos e scripts carregadas sob demanda.
Execução de Agentes
Subagent
Agente filho com contexto próprio: paraleliza sem poluir o contexto do principal.
Execução de Agentes
Token
O pedaço de texto que o modelo conta. É a unidade de cobrança e o que enche a janela de contexto, mas nunca a sua unidade de resultado.
Execução de Agentes
Tools
Sem tools, o modelo só fala. Com tools, ele faz.
Execução de Agentes
Webhooks
O inverso da API: permitem agentes reativos a eventos, não só acionados por humanos.
Processo de Engenharia
Auto verificação
O agente confere o próprio trabalho antes de entregar e deixa evidência de que conferiu.
Processo de Engenharia
Compound Engineering
A unidade de valor não é a tarefa feita, é a capacidade acumulada.
Processo de Engenharia
Design Mock
O sistema representado visualmente antes da implementação, para o agente não inventar interface.
Processo de Engenharia
Research
Separar investigação de execução evita que o agente construa sobre premissa errada.
Processo de Engenharia
Rollback / Idempotência
Toda ação é classificada como reversível ou irreversível, e as irreversíveis exigem gate.
Processo de Engenharia
Spec / PRD-driven development
Humanos escrevem specs, agentes escrevem implementação. A spec vira o contrato.
Processo de Engenharia
State Management / Checkpointing
É o que torna tarefas longas robustas em vez de frágeis.
Processo de Engenharia
TDD (Test-Driven Development)
Em contexto agêntico o teste vira a especificação executável que o agente usa para saber se acertou.
Processo de Engenharia
Test Sprint
Ciclo curto e concentrado de testes, rodado por agentes em paralelo, antes de avançar.
Avaliação e Confiabilidade
Baseline humano
Quanto o processo acerta hoje, feito por gente. Sem esse número, "o agente errou" não significa nada.
Avaliação e Confiabilidade
Determinismo vs Variância
A mesma entrada pode gerar saídas diferentes. A pergunta certa não é "varia?", é "onde pode variar?".
Avaliação e Confiabilidade
Evals
Casos de teste mais critérios objetivos, rodados a cada mudança. Sem evals, todo ajuste de prompt é chute.
Avaliação e Confiabilidade
Golden Dataset
O gabarito da operação: exemplos com resposta correta conhecida, incluindo de propósito os casos difíceis.
Avaliação e Confiabilidade
LLM-as-Judge
Um modelo avalia a saída de outro, em escala, nos critérios que só um humano julgaria, desde que tenha rubrica e calibração.
Avaliação e Confiabilidade
Monitoramento (Traces)
Eval é antes, em laboratório. Monitoramento é depois, em produção. Você precisa dos dois.
Avaliação e Confiabilidade
Regressão
Uma mudança quebra algo que funcionava. Em sistemas de prompt, isso acontece em silêncio.
Avaliação e Confiabilidade
Satisfação (% de atingimento)
A versão informal do eval. Todo critério que se repete deve virar item da suíte.
Governança e Controle
Audit Trail / Provenance
A versão jurídico-organizacional do trace técnico.
Governança e Controle
Guardrails
Restrições duras implementadas em código, não no prompt.
Governança e Controle
Human-in-the-Loop / Approval Gates
Definir onde ficam os gates é o desenho organizacional da Cognitive Enterprise.
Governança e Controle
Kill Switch / Circuit Breaker
Como desligar um agente quando algo dá errado, e a versão automática, que para sozinha.
Governança e Controle
Least Privilege / Permissioning
Agente de marketing não lê folha de pagamento.
Governança e Controle
Níveis de Autonomia
1 lê, 2 sugere, 3 age com aprovação, 4 age sozinho. Sobe de nível quando os evals provam.
Governança e Controle
Políticas / Regras de Negócio
Precisam existir em formato legível por máquina para virarem guardrails.
Governança e Controle
Prompt Injection
Conteúdo externo com instruções maliciosas que o agente confunde com ordem legítima.
Conhecimento e Semântica
Graph Engineering
Guardar o conhecimento da empresa como coisas e ligações, não como pedaços de texto soltos. É o que permite responder pergunta que atravessa vários registros.
Conhecimento e Semântica
Ontologia
O mapa formal do que a empresa chama de cliente, lead e pedido, e de como eles se conectam.
Conhecimento e Semântica
RAG / Retrieval
Como o conhecimento institucional vira input do agente sem retreinar modelo.
Conhecimento e Semântica
SOP-as-Code
A documentação deixa de descrever o trabalho e passa a ser o trabalho.
Desenho Organizacional e Economia
AI Factory
A empresa como fábrica: insumo é contexto, produto é decisão executada.
Desenho Organizacional e Economia
Cognitive Enterprise
Empresa desenhada desde o início com agentes como força de trabalho primária.
Desenho Organizacional e Economia
Custo de Transação Interno
A tese econômica da Cognitive Enterprise: agentes colapsam o custo de coordenar internamente.
Desenho Organizacional e Economia
DRI (Directly Responsible Individual)
O DRI gerencia agentes, e a responsabilidade continua tendo nome e sobrenome.
Desenho Organizacional e Economia
Goal
O objetivo verificável dado ao agente numa tarefa. É diferente do outcome, e o sistema quebra quando os dois se desalinham.
Desenho Organizacional e Economia
Processo
Trabalho que se repete: começa num gatilho, passa por mãos, termina num resultado. É o que se fatia em tarefas.
Desenho Organizacional e Economia
Requisite Variety (Ashby)
O sistema de controle precisa de tanta variedade quanto o ambiente que controla, senão falha nas exceções.
Desenho Organizacional e Economia
Resultado / Outcome
O que a empresa quer no mundo. Todo desenho começa aqui, antes de qualquer agente.
Desenho Organizacional e Economia
Span of Control (redefinido)
Quantos agentes um humano supervisiona com qualidade. Depende de evals, traces e gates.
Desenho Organizacional e Economia
Tarefa
A unidade de trabalho que se delega inteira. Errar o tamanho dela é o erro mais caro do projeto.
Desenho Organizacional e Economia
Unit Economics de Agente
Custo por token → custo por tarefa → custo por resultado. Sem essa conta não dá para decidir o que automatizar.
Desenho Organizacional e Economia
VSM (Viable System Model)
O blueprint pré-histórico da Cognitive Enterprise: 5 sistemas que mapeiam para arquitetura multi-agente.
