v0.4.0: 智能调度系统 — 多优先级队列 + HumanEval 88.4%
🚀 v0.4.0: 智能调度系统
🏆 HumanEval Pass@1: 88.4% (145/164)
使用 OpenAI 官方 评测框架, 模型,完全公开可复现。
核心特性
🎯 多优先级队列调度
- 参考 OS 进程调度思想,模型按能力分 5 级队列 (Q1-Q5)
- 意图识别自动给任务打标签,分发到匹配队列
- 工作窃取机制:高优先级队列可借用低优先级模型
📊 BenchmarkFetcher
- 新模型注册时自动从 HuggingFace Open LLM Leaderboard 拉取评测分数
- 根据 MMLU/BBH/GSM8K/HumanEval 平均分自动定级
- 本地缓存 7 天,失败静默回退到名称推断
📜 /history 路由历史
- 记录每次调度决策:任务意图、复杂度、tier、选中模型、分数
- 环形缓冲区 100 条,可选持久化
🔄 Shift+Tab 切换范式
- 终端快捷键循环切换 8 种思考范式
- 状态栏 3 秒通知横幅
🔀 子任务级模型路由
- 多步任务每步独立选模型:规划用旗舰、执行用性价比
- 全部 7 种引擎已集成
💾 /resume 会话恢复
- 退出自动保存,启动提示可恢复
- 7 天自动过期清理
Bug 修复
- 全部 7 个引擎构造函数透传 model_pool + auto_router 参数
- _load_credentials yaml 优先于 env(对齐 provider_registry)
测试
- 925 单元测试全部通过
- 新增 53 个 v0.4.0 专项测试
🤖 Generated with Claude Code