Skip to content

Undefined v3.4.2

Choose a tag to compare

@github-actions github-actions released this 23 May 08:38
· 40 commits to main since this release
v3.4.2
1859133

v3.4.2 总结更准、上下文可配、高并发更稳

本版本主要解决三类实际问题:群聊消息变长、合并发送变多之后,/summary 容易慢、容易编、分块预算也不准;主对话注入历史的 200 条硬顶与模型真实窗口脱节;高并发下用户连问「在吗」「好了吗」时,机器人仍可能把旧任务当新活重跑。围绕这些痛点,版本把「用户主动要总结」和「AI 自己调总结能力」拆成两条更合适的链路,用可配置的上下文窗口统一约束注入与分块,并同步收紧提示词、史官侧写与定时任务持久化,让总结更可信、配置更贴近上游模型、并发场景下更少重复劳动。

变更内容

  • 提升消息总结的质量与效率。用户通过 /summary/sum 获取总结时,改为直连 summary 模型一次性完成,不再绕 Agent 工具链,响应更快、路径更简单;AI 在对话里调用总结能力时,仍保留 Agent + 拉取历史的灵活流程。长会话按模型上下文窗口自动分段、队列内合并,并配套「只读原始记录、禁止编造」的专用提示词,减少幻觉与无关发挥。
  • 理顺上下文与模型配置边界。取消历史注入 200 条的隐性上限,改由 context_recent_messages_limit 与历史存储上限共同决定;各模型节新增 context_window_tokens,总结分块、Prompt 预算与实际上游窗口对齐,不再依赖硬编码或误用 max_tokens。同时补齐 reasoning_content_replaysystem_prompt_as_user,便于 MiMo、DeepSeek 等 thinking 模型在多轮工具调用时正确续传思维链,或按网关要求改写 system 注入方式。
  • 强化高并发下的任务边界。系统提示词与 each 规则进一步明确:催促、寒暄不等于新任务,历史未完成任务不得自动拾取;启动业务工具前须检查是否已有同类或语义等价操作在处理,有则熔断为简短进度回复而非重跑;无依赖的工具与 Agent 仍鼓励并行,有数据依赖则必须串行,与 MessageBatcher 的批次语义一致。
  • 优化认知侧写的长期画像质量。史官合并侧写时必须先读取再更新,以增量补充稳定特征为主,一次性闲聊或无法沉淀为长期特质的事件应跳过,避免侧写被单轮对话冲散或写成流水账。
  • 修复「向未来的自己发指令」定时任务无法恢复。持久化任务若包含 self_instruction,此前会导致整表反序列化失败;现已补齐字段定义,自调用类定时任务可正常加载与执行。
  • 更新配置文档、WebUI 表单与相关测试,覆盖总结直连、上下文窗口、模型对接选项与并发防重复等关键路径。

📝 Detailed Changes

🐛 Bug Fixes

  • fix: summary pipeline, context cap, and model wire options (#59) (a1cc36a)

🛠 Maintenance & Others

  • chore(version): bump version to 3.4.2 (1859133)
  • docs: 更新README与认知记忆文档 (b1cf7b7)