Multi-Agent Paper Improvement System v0.2.2
发布日期:2026-03-23
Highlights
- 引入双引擎编排架构:支持
CLASSIC(原生编排)与LANGGRAPH(状态图编排)按环境变量切换。 - 新增 LangGraph 多轮闭环流程:
specialists -> chief -> policy -> next round,支持条件回环直到质量阈值或轮次上限。 - 新增 RL 风格在线策略更新模块:基于 reward 信号进行 Q 值更新与 epsilon-greedy 探索排序。
- 系统诊断接口新增
workflow配置返回,前端系统检查页可直接查看当前引擎与策略参数。 - README 完整补充双引擎说明、关系图(含环路)与 RL 风格策略环示意。
Upgrade Notes
- 本次版本无数据库 schema 变更。
- 升级后请确认
.env中新增配置:WORKFLOW_ENGINE(可选CLASSIC/LANGGRAPH)RL_MAX_ROUNDSRL_EXPLORATION_RATERL_LEARNING_RATERL_REWARD_THRESHOLD
- 若保持历史行为,可继续使用
WORKFLOW_ENGINE=CLASSIC。
Verification
- Backend:
npx tsc -p tsconfig.json - Frontend:
npm run build