A expertise que os agentes carregam
Skills operacionais ativadas automaticamente por contexto — de TDD a threat intelligence, de billing webhook a SLO burn-rate. Cada uma com gatilhos claros e agentes consumidores.
Test pyramid, risk-based testing, property-based (fast-check/hypothesis), mutation testing (Stryker), contract testing (Pact).
Vocabulário de deep modules (Ousterhout/Feathers): interface, seam, adapter, depth, leverage. Interfaces que escondem complexidade e ficam testáveis. Inclui DEEPENING + DESIGN-IT-TWICE.
Linguagem ubíqua, glossário CONTEXT.md e ADRs. Desafia termo vago e registra decisão arquitetural que não deve ser re-litigada.
Varre a codebase, acha oportunidades de deepening e entrega relatório HTML visual (Tailwind + Mermaid).
Loop de diagnóstico pra bug difícil: construir e apertar um feedback loop red-capable antes de hipotetizar. 6 fases + script HITL.
Pentesting autorizado: STRIDE/PASTA, MITRE ATT&CK, OWASP Top 10/Mobile/API/LLM. Recon, exploitation e post-exploitation com legal gates explícitos.
Cyber Threat Intelligence: 8 case patterns (incident response, fraude, BEC, ransomware), legal gates, OPSEC. Condensado pra operação real.
Eval-driven prompt design, decision tree few-shot vs zero-shot, structured outputs, prompt caching, otimização de token.
Multi-LLM (OpenRouter, Claude API, Gemini), retry com backoff, token tracking, fallback chain e RAG patterns.
DeepEval, Ragas, promptfoo, LangSmith. CI gate pra prompts, golden datasets, A/B de variantes.
Ollama, LM Studio, llama.cpp, vLLM. Quantization (GGUF/AWQ/GPTQ), context window, GPU offloading, API OpenAI-compat.
Diagnóstico 12-layer de stack de agente em produção: wrapper regression, memory pollution, repair loops escondidos. Findings por severidade com fix code-first.
SLI/SLO com error budget, multi-window burn-rate (Google SRE Workbook), alert design 1h/6h/3d, runbooks, postmortem blameless.
USE method, eBPF, perf, py-spy, heaptrack, async-profiler. Race conditions, memory leaks e p99 em produção.
Stripe, Polar, Paddle e Lemon Squeezy com verificação HMAC, idempotency keys, cálculo de MRR/ARR/churn, dunning e refund/chargeback.
Design de webhook (retries, dead-letter queue, idempotency), assinatura HMAC, replay protection e debugging com tunnels.
GitHub Actions, GitLab CI, CircleCI. Caching estratégico, matrix builds, reusable workflows, deployment gates.
Pages + Workers + Functions + KV + D1. wrangler CLI, custom domains, env vars, patterns HMAC em Functions.
Runbooks de VPS Hetzner/Hostinger: PM2, docker-compose, Caddy/nginx, systemd, hardening SSH, TLS, backups e healthchecks.
Audita o consumo de janela de contexto de agents, skills, MCPs e rules. Acha o que infla o token budget e corta com cirurgia.
Garbage collection humano-no-loop do ~/.claude: config stale, órfãos e duplicados com proposta de remoção segura.
Busca a documentação real da lib via llms.txt (context7) antes de responder por memória — API docs, features recentes e análise de repositório.
Constrói MCP server pra plugar serviço externo no LLM: decisão de transporte, esqueleto TypeScript ou Python, design de tools e registro no Claude Code.
Opera MCP no Claude Code — CLI de list/add/remove, escopos user/project/local, deferred tools no runtime e diagnóstico de conexão.
6 MCP configs por contexto
Em vez de carregar todos os MCPs sempre, o squad usa configs nichadas — você ativa só o relevante pro contexto. Versões pinadas, escopo mínimo.
| Config | MCPs incluídos | Quando usar |
|---|---|---|
cloudflare | cloudflare, hostinger, github | Pages, Workers, DNS |
devops | cloudflare, hostinger, github, gh-actions | Deploy, infra, CI/CD |
security | github, supabase, shodan, semgrep, stripe | Security audit, hardening, billing audit |
observability | grafana, datadog, sentry, logtail | Incidente, perf audit, SRE |
frontend | shadcn, context7, playwright | UI/UX, frontend dev |
fullstack | postgres, supabase, context7, github | Feature dev fullstack |
20 rules enforcadas
Padrões herdados por todos os agentes — nenhum escapa.
anti-ai-engineering-protocol · naming · error-handling · dependency-management · testing · performance
security · accessibility · monitoring · api-design · database · supabase-source-of-truth
cloudflare-bypass · cloudflare-pages-deploy · ci-cd-caching · monorepo-conventions · docs-site-structure
local-llm-routing · next-standalone-middleware
karpathy-guidelines · surgical-changes · no-fake-data · accentuation-pt-br