You signed in with another tab or window. Reload to refresh your session.You signed out in another tab or window. Reload to refresh your session.You switched accounts on another tab or window. Reload to refresh your session.Dismiss alert
reacted with thumbs up emoji reacted with thumbs down emoji reacted with laugh emoji reacted with hooray emoji reacted with confused emoji reacted with heart emoji reacted with rocket emoji reacted with eyes emoji
Uh oh!
There was an error while loading. Please reload this page.
Uh oh!
There was an error while loading. Please reload this page.
环境
0.1.0-rc.6dsh webcompaction-basic默认参数)openai-codex/gpt-5.6-sol272000严重程度与用户影响
严重程度:严重,已阻塞正常使用。
这不是偶发的一次慢请求。进入该状态后,长 session 会在几乎每个 step 后花费约 70 秒进行一次或两次压缩,且取消旧任务、在同一 session 启动新任务后仍无法恢复。实际工作时间大部分消耗在 compaction,session 已基本不可用。
该问题已经直接导致用户无法继续使用 DSH 完成长任务,不得不终止当前 session,并改用其他方式继续工作。
问题描述
在一个长会话中取消旧 turn 后,继续在同一 session 发起新任务。新 turn 并非主要慢在模型推理或工具执行,而是陷入非常频繁的自动压缩:几乎每个 step 结束后都会触发 compaction,且默认
compactionRetries: 1会让同一压力检查连续尝试两次。压缩完成后上下文仍高于 80% 阈值,因此下一 step 又会重复压缩,形成 compaction thrashing。
现场数据(已脱敏)
诊断时该 session 约有:
429个 turn1970个 step455000个持久事件20 MBZstd,解压后约48 MB最近一次提供方 usage / 压力数据:
默认
retainRatio: 0.16对应:在本地启发式表层只有约
47187的情况下,头部可选压缩范围非常小;现场多次 compaction 的shadowedTokenCount仅约3451、3745、4826、7559,而摘要输出通常约3900–4200tokens。因此频繁出现:
例如:
统计快照:
120次 compaction start119次已结束79次生成 summary37次因 summary 不小于源内容而失败64.3s77.0s73–79s7654s(约 2.1 小时)新 turn 的一个连续区间中:
77s379s提供方 prompt 从约
251K缓慢下降到约239K,但始终高于217.6K阈值,所以每个后续 step 仍会继续触发。复现特征
summary is not smaller than the shadowed content,压缩后压力仍高于阈值。初步定位
从当前实现和运行数据看,压缩触发与压缩范围选择使用了不同尺度:
measurement.totalTokens可以锚定提供方真实 usage;selectCompactableRange()的近期尾部保留和节点定价来自固定字符启发式;在该现场,同一上下文的本地 heuristic breakdown 约
55K,提供方实际压力约240K,相差 4 倍以上。结果是名义上保留 16% 的近期尾部,实际仍对应模型窗口的大部分;每次只能选择很小的头部范围,摘要很难产生有效净缩减。预期行为
summary is not smaller than the shadowed content连续发生时,不应形成持续的压缩重试循环。未附带原始 session、路径、用户内容或凭据;如维护者需要,可以进一步提供脱敏后的事件时序与统计脚本输出。
All reactions