|
我发现dsh当前版本,llama.cpp的服务器运行的模型,会出现think->tool调用->(stream流断,重试)->think->tool调用->(stream流断,重试)的循环。 经过检查,确定是dsh的bug,因为我用trae和其他工具,使用这个模型都没有问题。 sseye-turn-1.json |
Replies: 4 comments 2 replies
|
花了5块钱,终于分析出问题了,似乎全网都没找到回答,.dsh\settings.yaml要做以下修改 重点 结论摘要 根因
|
|
可以可以,我同事也碰到过,我自己这边正常,但是不敢迭代了,等正式版。 |
|
看起来应该是llama.cpp的问题,整体过了一遍两边的代码: 我把结论和证据整理给你。先看我们这次实测的关键对照:
并且两种响应都带 直接回答你的三个问题1. 是设计如此吗?——不是「设计成每次都关」,更像一个实现缺陷(连接状态机没被正确回收)。 依据:
2. 有开关吗?——服务器侧没有。 我翻了当前 master 的 3. 为什么看起来“每次都关”? 因为 SSE( 结论与建议
顺带说明:这次补充的实测与源码抓取已归档到 |
|
llama.cpp的修复方案: 修复 |
llama.cpp的修复方案:
修复
文件:tools/server/server-http.cpp(第 569 行 return has_next; 改为 return true;,附注释)