O Cortex saiu da v0.1 (fluxo funciona) pra v0.5 (fluxo funciona
bem). Mudança arquitetural grande, prompts repensados,
integração com GitHub como sistema de gestão.
Highlights
- 🧠 Prompts modulares com narrativa de negócio — toda
afirmação quantitativa segue a regra das 3 camadas: observação
→ significado → ação. Chega de tabelão solto. - 🚫 Sem fallback silencioso — nem
tryCatchmascarando
erro, nemexcept: pass. Erros vazam e são tratados, não
escondidos. - 🎯
decision_maker— quando um agente falha, um agente
dedicado decide entre retry com guidance, skip com
justificativa de negócio, ou abort. Honestidade analítica
no lugar de gambiarra. - 🔬
node_probe— o Cortex olha os dados antes de
planejar; plano é dataset-aware, não chute do briefing. - 🏗️ Pipeline multi-stage —
quality → hypothesis → mlcomo
nós separados. Cada etapa com seu código (R/01_quality.R,
R/02_hypothesis.R,R/03_ml.R), seu HTML (outputs/*.html),
seu summary. - 🌿 Branch por run — nada de pasta
run-xxx/poluindo
main. Cada run abre sua branch e seu PR. - 📋 GitHub como board — milestone por projeto, 1 issue por
etapa, PRrun/xxx → maincomCloses #N, comentário com
findings. - 💰 Token budget por run (
MAX_RUN_TOKENS) — run aborta
com status claro se estourar; não queima grana infinita. - 📊 Logs estruturados (
structlog) —run_id/project_id
em todo log; JSON em prod. - 🅡 R-only — trilha Python removida; Cortex focado em
tidyverse/tidymodels/echarts4r/Quarto.
PRs desta versão
- #2 Fase 1 — Prompts modulares + narrativa de negócio
- #3 Fase 2 — Erros barulhentos, token cap, logs estruturados
- #4 Fase 3 —
node_probe+decision_maker - #5 Fase 4a — Branch por run + arquivos na raiz
- #6 Fase 4b — Pipeline multi-stage
- #7 Fase 4c — GitHub como gestão
- #8 Fase 5 — R-only
Roadmap v0.6+
- FakeLLM pra testes sem token
- SSE endpoint pra visibilidade em tempo real
- Auth (Bearer) na API
- Backup Postgres automático
- CI/CD via GitHub Actions