[bug]dsh-0.1.3-alpha.1崩溃后重启无法恢复会话 #5870
tyzamTsing
started this conversation in
General
Replies: 1 comment
|
先给版本背景:0.1.3-alpha.1 是 master 开发线(刚发),这类崩溃恢复问题在 alpha 上出现不意外——但你这个报告的形状值得拆开看,因为它牵涉两个不同阶段。 dsh 对"中断"是分阶段的(源级)进程崩溃时会话里可能有两种未完成状态,恢复机制不一样:
你描述的"OOM 前在执行 grep → 重启后 pending → 若干时间(超时)后恢复"更像第 2 种 + 一个等待侧的悬空。这与本仓库已知的"unbounded wait"家族同形(#5056:follow-stream 不随 session dispose 终止;#1607/#2544:主体缺席时 promise/stream 永不 settle)——OOM 恰好制造了"主体缺席"。 几个判别问题(能定位到具体机制)
建议抓的东西崩溃时刻的 dsh 日志尾部 + 重启后 pending 阶段的日志(工具超时/重试会打点)+ 崩溃前最后一条 tool 相关事件。有了 1-4 的答案,就能判定是"resume 阶段漏关了某种 in-flight 操作"(core 修,落点可能在 agent-loop 的工具执行恢复路径)还是"OOM 触发点本身要治"(grep 大输出缓冲——那是另一个修面,UI/工具输出有界化)。 如果你愿意,贴一下 pending 时的界面截图 + 崩溃前日志尾部,我可以按源把具体等待点找出来。 |
0 replies
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Uh oh!
There was an error while loading. Please reload this page.
win10下dsh oom异常退出,异常前执行grep等操作,重启dsh后处于pending状态,估计是等待操作完成?继续会话没有响应,直到若干时间(超时)后恢复处理

All reactions