Skip to content

v0.2.0 — 架构重构 + 提示词优化 + 主张验证工具化

Choose a tag to compare

@xxxxchaos xxxxchaos released this 08 Jul 07:20
· 6 commits to main since this release

omo-sci v0.2.0

这个版本包含两轮工作:架构重构(清仓 / 并档 / 通电)+ agent 提示词质量优化 / 主张验证工具化。距离上一个正式发布(v0.1.18)之间的所有改动都在这里。

这个版本变了什么

架构更干净了

  • 删除了约 3000 行从未被真正调用的代码(旧的 lifecycle hooks 系统、熔断器、用量追踪等),代码库不再有"看起来有保护机制、实际没通电"的死角
  • Agent 的模型分配/分类信息此前散落在 5 个地方(曾出现过互相矛盾的情况),现在收拢到单一数据源,并加了自动检测漂移的测试

流程强制力更真实了(这是本次最核心的变化)

  • Material Passport 的阶段推进和闸门检查,从"提示词里写着要这么做"升级为"真正会失败的工具调用":AI 想跳过闸门、想在主张没验证的情况下把闸门标记为"通过",工具调用会直接报错拒绝,不再是靠 AI 自觉遵守
  • 新增了主张验证工具 passport-record-claim:EBMer 验证论文里的关键陈述、Writer 审计参考文献时都要调用它记录结果;闸门想标记"通过",必须先有这些记录,不能空口说白话

9 个 agent 的提示词打磨了一轮

  • 统一了产物文件的路径约定(不再各写各的,导致互相找不到文件)
  • 修正了几处不准确的表述(比如暗示"后台并行搜索",实际执行是阻塞等待的)
  • 给 Submitter/Archimedes 的期刊数据(影响因子、接受率等)加了反幻觉约束——查不到真实数据就必须写"请自行核实",不能编数字
  • 给之前没有示例的几个 agent(Archimedes/IRBer/Writer/Submitter)补充了输出格式示例,提升国产模型的稳定性

⚠️ 给测试的朋友们:这几点重点关注

  1. Passport 强制工具是本版本最没底的部分:目前只跑通了单元测试和插件冒烟测试,从未在真实 OpenCode 对话中验证过。麻烦重点观察:Dubin 推进阶段、EBMer/Writer 记录闸门和主张时,是不是真的在调用这些工具(而不是自己在嘴上说"完成了");如果调用报错了,AI 有没有如实告诉你、而不是假装没事发生。
  2. beta 阶段,别直接用于正式投稿:生成的所有内容(研究设计、统计代码、论文)都需要你自己复核,IRBer/EBMer 的意见不是正式伦理批准。
  3. 模型配置:建议先跑 omo-sci configure 选择你实际有的 provider,再跑 omo-sci agent 看一眼模型分配对不对,最后 omo-sci doctor --models 做个体检。

安装

bun install -g github:xxxxchaos/oh-my-sci
cd 你的研究项目目录
omo-sci install
opencode .

进入 OpenCode 后输入 /sci-start 开始。

反馈渠道

遇到问题欢迎直接在这个仓库开 issue,或者告诉我:卡在哪一步、Dubin 有没有把闸门/工具调用的报错说清楚、生成的内容你觉得哪里不像真实科研产出。


详细改动记录见 CHANGELOG.md