**标题:关于提升“长文档完整性读取”及新用户开箱即用体验的建议** #3762
xuanku-001
started this conversation in
General
Replies: 2 comments 1 reply
|
“我做了一个简单测试:第一次让 Agent 读一个长 Word 文档,它只概括了开头和结尾。第二次让 Agent 读一个长网页链接,它又是只概括了开头和结尾。两次独立场景、同样的‘只读头尾’模式——这不是偶然,一定是底层机制在控制。后来我查了配置,发现 tool-result-pruner 阈值 8192 字符,超过就直接截断成头 4K + 尾 1K。这就解释了为什么两次都只看头尾。” |
0 replies
|
xuanku-001 定位得很准,
原理一句话:把一次大读取拆成多次小读取,绕开裁剪窗口。想根治可以调 (dsh-word-docs 为第三方项目,按需甄别使用。) |
1 reply
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Uh oh!
There was an error while loading. Please reload this page.
标题:关于提升“长文档完整性读取”及新用户开箱即用体验的建议
正文:
Harness 团队你好,
我在深度使用
Standard预设处理长文档(Word/PDF/长网页)时,通过调试agent.cordis.yml定位到了导致 Agent 回复“蜻蜓点水”(只概括头尾、遗漏中间核心内容)的三个机制级根因。同时,作为一名尝试入门的新用户,也感受到了较高的配置门槛。以下是具体的痛点及可落地的优化建议,供参考:
痛点 1:
tool-result-pruner阈值(8192字符)严重截断长文档内容thresholdChars从8192提升至 128K 或 256K(适配主流大模型的上下文窗口)。痛点 2:
persona缺少“完整性校验”的底层指令System Directive:痛点 3:
tool-web默认fetch: false限制了信息获取能力true。若担心 SSRF 风险,可改为 UI 界面的一个显性开关(如“允许 Agent 抓取网页全文”),让用户根据自身网络环境自行勾选,而非写死在 YAML 里让新手无从下手。痛点 4:配置修改对新手不友好(YAML 寻路难)
node_modules或缓存目录里翻找 YAML 文件,且修改后易被更新覆盖。总结:
Harness 的架构非常灵活,但默认配置目前更偏向“极客跑分”而非“普通用户处理实际文档”。调整上述 3 个 YAML 参数(Pruner阈值 + Persona指令 + Fetch开关)即可解决 80% 的“内容缺失”投诉,且改造成本极低。
All reactions