Replies: 4 comments
|
先确认一个代码层面的现状(对照 main/master HEAD agent-loop 没有内置"步数上限 / token 预算 / 成本熔断"。 建议先分三类定位你的日志(决定是不是同一种病):
立即可用的止损: dsh plugin --profile web add dsh-budget # 成本上限 + 超限策略(#2553 社区插件)另建议给 profile 配 per-tool timeout( 为了让官方/社区能定位,请补: ① dsh 版本;② session log 里 给官方的建议(本次事故的核心诉求): 在 agent-loop 增加可选的累计步数/成本熔断(默认关闭或低默认值,与 dsh-budget 语义协作),避免"跑一夜烧光预算"这类无断路器事故。这值得单独开一个 feature 提案帖。 |
|
应 #3228/#3229 两帖(两位都烧光余额/预算)整理一份 feature 提案草稿,供合并立项: 提案:agent-loop 内置可选的累计步数/成本熔断(circuit breaker) 动机:agent-loop 目前只有 设计(最小闭环):
落地位置:agent-loop 的 turn 边界计数(steps)+ token-meter 的累计计数器(tokens/cost)→ 熔断检查放在每步 dispatch 前。 回归测试:① 循环场景(模型连续请求同一工具)→ 步数上限触发 如果两位 OP(#3228/#3229)认可,我可以把这个草稿扩成完整的 proposal 帖(含代码位置与测试骨架)。 |
|
这个现象更像 Agent step loop 持续收到“成功的搜索结果”后再次决定调用工具,而不只是单次工具并发过高。当前源码里的 建议先按这个顺序止损和取证:
我把这些边界、四种循环类型和最小 incident bundle 整理成了一个独立英文 runbook(基于 如果能补充取消前后最后 5–10 个 Session events,会很容易判断是成功工具调用循环、工具失败循环还是 provider retry。 |
|
?? token..????????????????????????,????????????:??? dsh-budget ????/?/??? USD ??, ??: |
Uh oh!
There was an error while loading. Please reload this page.
harness使用flash模型,昨晚测试问了一个简单的问题:DeepSeek-v4-flash和pro对比,今天早上看token直接烧完了,烧了一亿多token,后面看执行日志,发现harness反复执行,最后直到api欠费才停止,希望可以优化
下述为harness循环执行的log:
All reactions