GateKeeper v0.4.3 — 门禁回灌 + 可比双来源 + HTML 组装协议
背景
DeepSeek 三次实测(v0.4.2):机制层面全部起效(规则文件零篡改、G7 距今月数列、search_log 角色分化、G8 固定区块),但暴露两类残留问题:
- D4 判而不行:G7 清单正确标注"2024 年市场数据超期,不入结论位",同一份报告的 TOP 1 风险与综合结论仍在使用该数据——门禁产物未回灌正文
- 定价数字失真:三家可比 PE 整体偏高 8-30%;"可比均值 190.22x"与其自家分项(117/206/107x)都对不上——G7 管时效管不了"新但错"
- HTML 生成靠试错:heredoc 引号冲突、python 运行时不可用(exit 49),模型多轮失败后才摸索出分块拼接路径
修复
- G7 回灌检查 + Step 4.5 一致性核对:D4/[STALE_DATA] 标注论断逐字扫描结论位(执行摘要/TOP 风险/关键数据/key_finding),出现即删除或改写——清单判定与报告正文必须一致
- 可比估值双来源规则:每家可比 ≥2 独立来源一致,或 1 来源 +「总市值÷TTM 净利润」交叉计算;聚合数字(均值/区间)必须可从快照分项复算
- HTML 组装协议(
references/templates/html-assembly.md):Write 分块 + cat 拼接为标准做法;禁止 Bash heredoc 写 HTML、禁止依赖 python/node 渲染;分块中间产物保留作审计证据 - 模板 TOP 3 放宽为 TOP 3-5
三轮实测演进
| v0.4.0 跑 | v0.4.1 跑 | v0.4.2 跑 | |
|---|---|---|---|
| 三处原始事实漂移 | 未复发 | 未复发 | 未复发 |
| 查询量/留痕 | 6 次 | ~17 次 | 48 次全留痕 |
| 规则文件完整性 | — | 自改规则书 | 干净 |
| G7 时效判定 | 漏判 | 算术误判 | 判定正确 |
| D4 后果执行 | — | — | 判而不行 → 本轮修复 |