Skip to content
Discussion options

You must be logged in to vote

这个错误可以直接按预算来读:

664,728 messages + 384,000 completion = 1,048,728
model window                         = 1,048,576
overflow                            =       152

所以不是 API key 问题,而是这次请求的“历史输入 + 最大输出预留”超过了模型上下文。建议按这个顺序处理:

  1. 在当前会话的模型设置里先把最大输出 token 从 384000 降到更实际的值,例如 128000,不要只减 152,应该留出后续消息和工具调用的余量。
  2. 如果当前 profile 提供 /compact,先执行一次 /compact,成功后只重试原请求一次。
  3. 如果没有可压缩历史或仍然超限,新建会话,只带目标、关键决策、文件路径、未解决错误和下一步,不要复制整个旧对话。

还需要区分两个同名配置:模型适配器的 maxTokens 是普通回复的输出上限;dsh-compaction-basic 里的 maxTokens 是摘要调用的上限。修改后可以用 dsh --profile web --dump-config 检查实际生效的 provider/model、contextWindowmaxTokens

我根据官方 adapter、overflow recovery 和 /compact 源码整理了完整的英文排查页,包含配置示例与验证清单:

https://github.com/sandbaseai/deepseek-harnes…

Replies: 3 comments 2 replies

Comment options

You must be logged in to vote
0 replies
Comment options

You must be logged in to vote
0 replies
Answer selected by wangzczgbaba-source
Comment options

You must be logged in to vote
2 replies
@IronsDu
Comment options

@IronsDu
Comment options

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment
Category
Q&A
Labels
None yet
4 participants