Skip to content

v0.4.0: 智能调度系统 — 多优先级队列 + HumanEval 88.4%

Choose a tag to compare

@xianyu-sheng xianyu-sheng released this 13 Jul 05:02

🚀 v0.4.0: 智能调度系统

🏆 HumanEval Pass@1: 88.4% (145/164)

使用 OpenAI 官方 评测框架, 模型,完全公开可复现。

核心特性

🎯 多优先级队列调度

  • 参考 OS 进程调度思想,模型按能力分 5 级队列 (Q1-Q5)
  • 意图识别自动给任务打标签,分发到匹配队列
  • 工作窃取机制:高优先级队列可借用低优先级模型

📊 BenchmarkFetcher

  • 新模型注册时自动从 HuggingFace Open LLM Leaderboard 拉取评测分数
  • 根据 MMLU/BBH/GSM8K/HumanEval 平均分自动定级
  • 本地缓存 7 天,失败静默回退到名称推断

📜 /history 路由历史

  • 记录每次调度决策:任务意图、复杂度、tier、选中模型、分数
  • 环形缓冲区 100 条,可选持久化

🔄 Shift+Tab 切换范式

  • 终端快捷键循环切换 8 种思考范式
  • 状态栏 3 秒通知横幅

🔀 子任务级模型路由

  • 多步任务每步独立选模型:规划用旗舰、执行用性价比
  • 全部 7 种引擎已集成

💾 /resume 会话恢复

  • 退出自动保存,启动提示可恢复
  • 7 天自动过期清理

Bug 修复

  • 全部 7 个引擎构造函数透传 model_pool + auto_router 参数
  • _load_credentials yaml 优先于 env(对齐 provider_registry)

测试

  • 925 单元测试全部通过
  • 新增 53 个 v0.4.0 专项测试

🤖 Generated with Claude Code