Undefined v3.4.2
v3.4.2 总结更准、上下文可配、高并发更稳
本版本主要解决三类实际问题:群聊消息变长、合并发送变多之后,/summary 容易慢、容易编、分块预算也不准;主对话注入历史的 200 条硬顶与模型真实窗口脱节;高并发下用户连问「在吗」「好了吗」时,机器人仍可能把旧任务当新活重跑。围绕这些痛点,版本把「用户主动要总结」和「AI 自己调总结能力」拆成两条更合适的链路,用可配置的上下文窗口统一约束注入与分块,并同步收紧提示词、史官侧写与定时任务持久化,让总结更可信、配置更贴近上游模型、并发场景下更少重复劳动。
变更内容
- 提升消息总结的质量与效率。用户通过
/summary、/sum获取总结时,改为直连 summary 模型一次性完成,不再绕 Agent 工具链,响应更快、路径更简单;AI 在对话里调用总结能力时,仍保留 Agent + 拉取历史的灵活流程。长会话按模型上下文窗口自动分段、队列内合并,并配套「只读原始记录、禁止编造」的专用提示词,减少幻觉与无关发挥。 - 理顺上下文与模型配置边界。取消历史注入 200 条的隐性上限,改由
context_recent_messages_limit与历史存储上限共同决定;各模型节新增context_window_tokens,总结分块、Prompt 预算与实际上游窗口对齐,不再依赖硬编码或误用max_tokens。同时补齐reasoning_content_replay、system_prompt_as_user,便于 MiMo、DeepSeek 等 thinking 模型在多轮工具调用时正确续传思维链,或按网关要求改写 system 注入方式。 - 强化高并发下的任务边界。系统提示词与 each 规则进一步明确:催促、寒暄不等于新任务,历史未完成任务不得自动拾取;启动业务工具前须检查是否已有同类或语义等价操作在处理,有则熔断为简短进度回复而非重跑;无依赖的工具与 Agent 仍鼓励并行,有数据依赖则必须串行,与 MessageBatcher 的批次语义一致。
- 优化认知侧写的长期画像质量。史官合并侧写时必须先读取再更新,以增量补充稳定特征为主,一次性闲聊或无法沉淀为长期特质的事件应跳过,避免侧写被单轮对话冲散或写成流水账。
- 修复「向未来的自己发指令」定时任务无法恢复。持久化任务若包含
self_instruction,此前会导致整表反序列化失败;现已补齐字段定义,自调用类定时任务可正常加载与执行。 - 更新配置文档、WebUI 表单与相关测试,覆盖总结直连、上下文窗口、模型对接选项与并发防重复等关键路径。