A engenharia por trás da fábrica
10 agentes, 4 cérebros de domínio, pipeline de 7 etapas, arquitetura 6-level e um quality gate que executa. É a metodologia que transforma briefing em squad funcional, validado e pronto pra produção.
Os 4 frameworks aplicados
Cada decisão de design é ancorada em pesquisa documentada — síntese de boas práticas comprovadas, sem invenção.
ReAct (Shunyu Yao, ICLR 2023)
Reason + Act intercalados: o agente alterna entre raciocinar sobre o estado e executar tool calls. Reduz alucinação em 40% comparado a chain-of-thought puro. Aplicado no nível 4 (Behavior) de todo agente fabricado.
Agentic Design Patterns (Andrew Ng)
4 padrões compostáveis: Reflection (auto-crítica), Tool Use, Planning e Multi-agent. O create-squad usa Multi-agent; todo agente tem Reflection no nível 5.
Building Effective Agents (Anthropic)
Patterns oficiais: prompt chaining, routing, parallelization, orchestrator-workers, evaluator-optimizer. O pipeline da fábrica usa Orchestrator-Workers — o factory-chief orquestra, os demais executam.
Agentic Engineering (Simon Willison)
Práticas pragmáticas: prompt simples vence prompt complexo, tools sempre testáveis, eval scenarios obrigatórios. Aplicado nas regras do @qa-sentinel e nos checklists de validação.
A arquitetura 6-level
Todo agente sai com os 6 níveis preenchidos — é o que separa "prompt num .md" de agente funcional.
Como o agente é carregado
Frontmatter Anthropic (name, description, model, tools), trigger conditions, keywords de ativação e slash command. Sem isso, o Claude Code não sabe quando invocar.
Quem o agente é
Persona, voice DNA, exemplos de tom. Agente sem identidade clara muda de personalidade no meio da conversa.
O que o agente faz
Skills disponíveis, tools e MCPs integrados, commands acionáveis. Cada capacidade com trigger, input esperado e output garantido.
Como o agente raciocina
Padrões ReAct (reason, act, observe), Reflection loop antes de entregar, planning e tool use sequence. Aqui o agente vira pensante, não só respondedor.
O que o agente não faz
Vetos absolutos, palavras proibidas, situações de escalation, edge cases conhecidos e kill switches. Sem constraints, o agente inventa quando não sabe.
Como saber se funciona
3 a 5 exemplos canônicos de input/output, edge cases documentados, smoke tests rodáveis e eval scenarios mensuráveis. Sem examples, ninguém audita.
O pipeline de 7 etapas
Cada etapa tem responsável, output e gate. Pular etapa é entregar lixo.
| # | Etapa | Responsável | Output | Gate |
|---|---|---|---|---|
| 1 | Briefing | @factory-chief | Spec inicial (3 perguntas) | Incompleto? Repergunta |
| 2 | Research | @factory-chief | Notas dos frameworks aplicáveis | Sem research? Web search |
| 3 | Architecture | @architect | 6-level structure preenchida | Nível faltando? Completa |
| 4 | Persona | @promptsmith | Voice DNA + tom + exemplos | Voz inconsistente? Reescreve |
| 5 | Skill | @skillforger | SKILL.md + commands + tasks | Frontmatter fora? Ajusta |
| 6 | Quality gate | @qa-sentinel | Gate executável + score | Fora do padrão? Bloqueado |
| 7 | Delivery | @factory-chief | Pacote final + instalação | QA aprovado? Entrega |
Regras absolutas
Sem briefing, sem fabricação
Pedido vago ("cria um agente legal") é devolvido automaticamente pra completar o briefing. Não existe agente bom com briefing ruim.
Sem gate, sem entrega
Reprovou em naming, dependências, segurança, qualidade, acentuação ou score, o pacote não sai. Volta pro @architect ou @promptsmith até passar. Zero exceção.
Sem invenção de frameworks
Os 4 frameworks são documentados (papers, blogs oficiais, livros). Framework novo passa por research primeiro — nunca por chute.
6 níveis, sempre
Nunca 4, nunca 5, nunca "preencho depois". Nível incompleto reprova no QA.
3+ examples
Mínimo de 3 exemplos canônicos input/output em todo agente. O que não dá pra auditar, a fábrica não entrega.
O que esta fábrica não é
Gerador de prompt
Você não digita "quero um prompt sobre X" pra receber um parágrafo. A fábrica produz agente: estrutura, comportamento, validação e integração. Prompt é o nível 1 de 6.
Wrapper de ChatGPT
Os agentes rodam dentro do Claude Code, com tools nativos (Bash, Read, Edit, MCPs). Sem dependência de API externa — roda local.
Framework inventado
Tudo que a fábrica aplica é documentado (Anthropic, Andrew Ng, Shunyu Yao, Simon Willison). Chegou framework novo? Research antes de aplicar.
O quality gate
Não importa a urgência: todo agente e squad passa pelo gate executável. Prova: o api-forge, gerado pela própria fábrica, passou com score A+ (9,43/10).