dsh-model-tester v0.1.2
修复:测试请求不再下发 maxTokens
问题
测试请求固定携带 maxTokens: 16(quick 模式)/ 1024(throughput 模式)。DSH 会把该值原样转成 max_output_tokens 下发(经 pi-ai 的 Math.max(v, 16) 下限钳制),而较小的输出额度会与推理模型的思维链 token 争抢同一份额度,导致上游提前截断并返回:
response incomplete: max_output_tokens
表现为偶发、且随模型而异的「假失败」。
修复
测试请求刻意完全不传 maxTokens。DSH 在该值为 undefined 时会彻底省略该字段,由上游提供方使用自身默认输出额度,探活结果才反映真实可用性。
同时移除了响应体中已失去意义的 maxTokens 字段回传。
变更
index.js:MODES与llm.stream调用中移除maxTokensREADME.md:中英文指标说明同步更新
完整变更:v0.1.1...v0.1.2