v3.24.1
v3.24.0 省 token 规则的复审修复(GPT-6 Astra 独立审查 28 项,修 24 项):
- 恢复会话时 effort 只取最终恢复的那个模型自己的设置,不会再出现 Fable 5.1 配 high。
- 撞额度后自动续跑:按缓存真实年龄判断冷热(不再按「还要等多久」),到点再复核一次。
- 恢复隔夜的大会话,第一轮之前也按记录里的上下文大小决定要不要弹确认框,不会再当成 0 直接冷发;缓存剩余时间只认真实回复的时间。
/goal 条件的首轮也按省 token 规则处理(手动会问,计划里会先压再发)。- 回撤、换模型、改 effort 后,底栏和后台对缓存冷热的判断一致。
- 确认框 5 分钟自动处理前,先核对还是不是原来那个标签和会话。
- 保温只为算得出发送时间的消息做,预算按标签算,5 分钟缓存不保温,失败会如实显示。
- 灵动岛也显示「缓存可能还在」;计划启动失败的提示落在对应标签上。