Replies: 4 comments
|
根据原帖提供的 实际触发线怎么算
其中默认 代入原帖的值,在没有额外压缩策略覆盖的情况下: 因此,400K 的名义窗口,实际只到约 34K 请求压力就会触发压缩。这也解释了为什么仅调整触发比例不一定有效:限制来自第二项的减法预算,而不是比例。这条计算本身不需要再为 版本间也确实存在策略差异: 不合理之处预留输出空间本身有安全理由,但当前设计存在几个问题,不能简单归结为用户配置错误:
另外,轨迹中“压缩了约 1.4K–3.6K tokens”表示本次被替换的历史范围大小,不是完整请求大小,也不是压缩后的净节省量。有效触发线过低与这些小范围、低收益压缩结合,就容易形成原帖描述的频繁空转。 临时解决方法:主动设置较小的 output token 上限可以先保持真实 - id: deepseek-v4.1-flash
contextWindow: 400000
maxTokens: 64000 # 示例预算,按任务需要选择,不是模型能力上限在默认压缩策略下:
注意:
这是绕开过早触发的临时办法;有效预算展示、配置语义分离,以及无收益压缩的退避机制,仍值得在 Harness 层修正。 |
|
实测临时方法有效,也不知道这个版本怎么考虑的,这是明细的不合理设定。 |
|
我昨天光压缩就遇到差不多10次bug,让dsh自己去分析源码,才知道是因为我是主动限制了上下文窗口,因此导致的一个问题就是上面提到的减法后的结果是负数,进而导致压缩失败。我不太理解这么改的目的,之前的压缩策略明明挺好的,没遇到过问题,现在只能自己写个插件去临时解决,希望官方能优化这个问题 |

Uh oh!
There was an error while loading. Please reload this page.
环境
0.1.7-alpha.1(本地dsh --version/npx @deepseek-ai/dsh --version均为此版本)provider ohub / model deepseek-v4.1-flash,request/context中contextWindow: 400000,request/header中reasoningEffort: max, maxTokens: 300000session-6ec4299a-625f-4339-850e-9047d2eeef25,session.v4.jsonl共 261 条记录(user/message22,assistant/message26,tool/call32,tool/result39),基本集中在一个 turn 内(全程约 8 分钟)现象(有截图)
一次“深度搜索”(界面计时 5 分 38 秒)过程中,右侧轨迹密集出现“上下文已压缩”:
合计约 15 条、约 1.5 万 tokens,被拆成 6 次压缩,平均不到 1 分钟一次。每次只压 1
4 条、1.4k3.6k tokens,体感是“刚写一点就压一次”。对 session 日志的取证
session.v4.jsonl中与压缩相关的记录:compaction/start: 20 次compaction/end: 20 次compaction/summary: 16 次compaction/prune: 8 次(shadowedTokenCount多在 2400~8600 之间,均只覆盖单条 seq)其中 4 次
compaction/end带 error,全部是“摘要比被压缩内容还大”类空转:summary is not smaller than the shadowed content (1044 estimated framed tokens >= 137)summary is not smaller than the shadowed content (2239 estimated framed tokens >= 2239)summary is not smaller than the shadowed content (2417 estimated framed tokens >= 2409)summary is not smaller than the shadowed content (2688 estimated framed tokens >= 2687)即:阈值似乎压得很勤(小到 137 tokens 的 span 也会触发一次 compaction),而这种小 span 压完摘要反而更大,白白烧一次摘要调用,符合“频繁但无效”的观感。
已排查过的相关讨论(均不是同一个问题)
contextWindow 400000的大窗口,不属于该场景。0.1.7-alpha.1新出现的体感,且没有 checkpoint 死循环,只是阈值过勤 + 小 span 空转。期望
0.1.7-alpha.1是否收紧了 proactive compaction 的触发阈值(结合maxTokens: 300000+reasoningEffort: max的大预留下,实际可用窗口是否被提前吃掉很多,导致过早/过勤触发)。summary is not smaller than shadowed content这类可预判的空转能否在摘要调用前剪枝掉。session.v4.jsonl片段(完整文件 1.6MB,含本机路径等信息,故未直接贴附件)。All reactions