Replies: 2 comments 7 replies
|
先说统计口径(master c291e79):界面 token 数字 = 当前会话事件里 provider 上报的 usage 之和,不是估算。每条 assistant 消息的 usage 直接取自事件( 关键结论:
21 倍差异无法仅凭源码判定,但最可能的两项:① 子代理用量(界面看不到、但计费真实发生);② 计费侧口径(缓存读/写、reasoning token 的定价折算)——这两项都在 harness 之外,我无法验证(未验证)。 核账方法:把主会话与全部子会话的日志分别导出(或用量 CSV),逐 step 比对 usage 字段,就能定位差额来源。界面显示全口径(含子代理汇总)与费用熔断都是合理 feature request,目前都不存在;短期建议先在平台侧设预算上限兜底。 |
1 reply
|
我也是刚刚更新到dsh@0.1.5-rc.1,一个对话没有写任何代码突然给我扣了70多的费用 amount-2026-09-15_2026-09-15.csv |
6 replies
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment

Uh oh!
There was an error while loading. Please reload this page.
使用 DeepSeek Harness + deepseekv4.1-flash,2026-09-15 11:00-12:00 期间,12分钟烧掉 54.77 元 ,
但 Harness 对话框界面仅显示 7,874,011 Token,两者差距约 21 倍,非常离谱。
关键数据对比:
平均每 1.45 秒 调用一次 API,每次携带约 6.7 万 Token 上下文。
高度疑似 Harness 陷入工具调用死循环或后台重复请求,但界面只统计主会话可见部分,导致用户无法及时发现异常消耗。
建议:
修复 Harness 界面统计,显示所有后台请求的 Token 汇总。
增加预算熔断机制,避免用户短时间被高额扣费。
amount-2026-09-15_2026-09-15.csv
cost-2026-09-15_2026-09-15.csv
已附上官方导出的 cost 和 amount CSV 文件。
提醒大家:以账单为准,勿依赖界面统计,务必设置预算上限,避开高峰时段。
All reactions