You signed in with another tab or window. Reload to refresh your session.You signed out in another tab or window. Reload to refresh your session.You switched accounts on another tab or window. Reload to refresh your session.Dismiss alert
reacted with thumbs up emoji reacted with thumbs down emoji reacted with laugh emoji reacted with hooray emoji reacted with confused emoji reacted with heart emoji reacted with rocket emoji reacted with eyes emoji
Uh oh!
There was an error while loading. Please reload this page.
OpenPI Web 的外部检索结果最终需要让用户看清:答案引用了哪篇内容、是哪次抓取、原文哪一段。社区包已经有可借鉴的低层机制,但是否值得增加OpenPI专门的来源展示,仍缺真实任务证据,先在这里讨论。
pi-web-access@811ef82a6dd04fe4abd73fa40b079aa39ee1870d(MIT)的ResearchSource/ResearchPassage记录URL、抓取时间、content hash、passage id、原文offset与fetch error;全文cache有容量与TTL边界,模型按需取片段。值得研究的是“摘要能回到具体版本的原文”,而不是继续增添搜索provider。同时要保留证据边界:这个包的
classifySource根据docs域名/path猜来源类别,assessClaim根据英文词重叠和极性词产生supported/contradicted/confidence。这些是启发式,不能直接成为OpenPI的“事实已验证”标签。运行时可以证明某个片段来自哪个抓取版本,结论仍由模型结合证据判断。想先回答三个问题:
建议先做小实验:选几组有冲突来源、网页更新、抓取失败以及较长文档的公开问题,同样的provider/模型/页面数据,比较A:普通Pi工具结果,B:最小来源展示。记录引用是否落到实际支持片段、用户回查步骤、模型输入/调用量、旧版本失效的呈现。只有出现稳定收益,再开实施Issue。
范围与#169的external provider seam相接;已有#345和#471继续跟踪一般文件/图片交付。这里仅讨论来源与片段的呈现收益,不新增研究编排、关键词真假裁判或第二套检索栈。本轮证据为固定源码审查,尚无运行或用户收益验证。
研究记录:Pi 社区能力研究与候选清单(2026-09-08)。源码证据、运行验证与采用决策分别记录。
All reactions