Releases: KongFangXun/sofagent
Release list
v1.4.3 — 🚀 训练引擎 · 运行与需求 + 📊 审计聚合指标
🚀 训练任务从「能提交」到「可运维的长期资产」——跑得动(长任务监控 + GPU 显存预算队列)、找得到问题(七类失败诊断附修复建议)、出得了交付(沙箱隔离 + 离线可训 + 设备打包);--stats 让审计从逐次事件变成可汇报的治理 KPI。
TL;DR (EN): Training becomes operable, not just submittable: long-task monitoring + VRAM-budget queues, seven-class failure diagnosis with fix prescriptions, sandboxed offline training with device packaging; --stats turns audit into a reportable KPI. MCP 76→79, 3619 tests.
⚡ Install / Upgrade
# 新装(五形态任选:FDE 插件 / Skill / MCP / CLI / GitHub Action)
curl -fsSL https://raw.githubusercontent.com/KongFangXun/sofagent/main/install.sh | bash
# 已装用户升级到本版
npx @sofagent/audit@1.4.3 --doctor
# GitHub Action(PR 自动审计)
uses: KongFangXun/sofagent@v1.4.3
🔨 核心变更
📡 训练监控与 GPU 队列
train_status/train_list进度查询(status / step / loss / reward 曲线 / 日志尾部 + 历史任务过滤)——MCP 客户端可查训练进度- GPU 显存预算队列:多任务按预算排队(串行 or 按预算并发),并发不 OOM;训练完成/失败 webhook 推送
- 训练状态落盘
data/dashboard/train-status.json,Dashboard「训练任务」区块可读
🩺 训练失败诊断
train_diagnose:OOM / 数据格式错 / 超参发散 / 框架错误 / 环境不匹配 / 重复坍塌 / 精度异常——每类附修复建议(如精度异常 → LM head/优化器状态升 FP32)- 诊断报告自动收集上下文:失败日志尾部 + 环境 + 最近 checkpoint + 超参
📦 训练沙箱与设备打包
- 训练子进程隔离(无外网 / 只读数据源 / 只写产物目录),客户机房离线可训
- 训练运行时可打包进交付设备(U 盘/电脑形态交付)
🧭 需求推导与模板库
train analyze四步引导:workflow 节点 → 训练目标 / 数据需求 / 评估标准 / 配置- 模板库:QLoRA/SFT/DPO + RL 配方 grpo/dapo/cispo(含 ScaleRL 四技巧)+ MoE expert 覆盖防护;后训练 workflow 模板(七节点 DAG + 三个 HITL 确认点)
⚙️ FORGE DSH 执行深化收口
- 流式面重建 / 审查 step 分级切分 / usage 自动计量
📊 审计聚合指标
sofagent-audit --stats:安全边界触发率 / 阻断率 / 高危 Top5 +--json+ 落盘——审计从逐次事件变成可汇报的治理 KPI
🧹 存量清扫
- ao 工具链探测删除 /
composeWithDeepAgents更名composeWithReactAgent(旧名 @deprecated 一版)/fde_compose收窄 workflow-only - doctor 补 Ontology 完整性检查:frontmatter 坏格式从静默跳过变 WARN + 修复提示
- 训练反作弊基线默认化:reward hacking 四形态双防线(剥
.git+ 网络白名单)写进默认配置;train doctor补反作弊三项体检
🔒 BugFix(上版遗留)
- 四轮 fresh-eyes 审查 F-01~F-14 全量处置:E1 修复文案语义反转 / S219 阈值校准链对齐 / doctor 全局路径收口 SSOT / hook 基线 fail-closed 化
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 3619 tests 全绿 ✅ |
| acceptance-test | 293/293 场景 · 372/372 断言 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 102/102 全绿 ✅ |
| 回归检查 | 96 维度 ✅ |
| release-gate | verdict=GO ✅ |
| fresh-eyes | 4 轮独立审查 ✅ |
⚠️ 破坏性变更
升级必读——两条,第二条有迁移指引。
- MCP 工具数 76→79(新增
train_status/train_list/train_diagnose,全量见AGENTS.md「MCP 全量工具表」) checkHistoryChainIntegrity退役公告(移除归 v1.5.0):布尔返回无法区分「篡改 / 不可复验 / 历史不足」。如遇调用报弃用警告,迁移checkHistoryChainDetailed(dataDir)——原true对应status === 'ok';原false改读结构化字段(tampered/unverifiable/insufficient-history)。迁移示例:engine/audit/src/commands/verify.tsfde_compose收窄为 workflow-only:如遇 ontology action 返回迁移提示,改用fde_derive(五要素 → ontology 草稿)
🔗 深入了解
| 想看什么 | 链接 |
|---|---|
| 全部变更明细 | CHANGELOG |
| 上手指南 | HANDBOOK |
| 有问题 / 晒场景 | Discussions · good first issues |
| npm 包 | @sofagent/audit · @sofagent/fde · 共 13 包(npm) |
📖 详细开发日志
v1.4.2 — 🚀 训练引擎 · 数据与评估 + 🧩 FDE 六引擎
🚀 训练引擎吃得到数据、评得出好坏——企业异构数据(CSV/Excel/DB/API)经质量闸门进训练集,训练连着评估出报告,FDE 六引擎让方法论变成可执行工具。
TL;DR (EN): Training pipeline with data versioning + eval-in-the-loop for enterprise data (CSV/Excel/DB/API), plus six MCP-native FDE engines — methodology as executable tooling. 76 MCP tools, 2903 tests, MIT.
⚡ Install / Upgrade
# 新装(五形态任选:FDE 插件 / Skill / MCP / CLI / GitHub Action)
curl -fsSL https://raw.githubusercontent.com/KongFangXun/sofagent/main/install.sh | bash
# 已装用户升级到本版
npx @sofagent/audit@1.4.2 --doctor
# GitHub Action(PR 自动审计)
uses: KongFangXun/sofagent@v1.4.2
🔨 核心变更
📊 训练数据管道与版本
- 企业数据 → 训练集管道(
train_dataset_ingest等 MCP tool,CSV/Excel/JSON/文本 + PG/MySQL/REST 多源,CSV 类型推断端到端) - 训练集版本管理(dataset_version 台账三件套:指纹冻结 + 不可变 + 续跑版本锁,两版 diff)
🎯 训练评估闭环
- 训练中 eval 闭环(
train_eval_submit,阈值判定双态,不 eval 的训练是盲训) - 训练 dry-run 显存估算(单调性外推 + ScaleRL sigmoid 拟合建议,失败前预防)
- 训练报告
train_report(客户可读 Markdown+JSON 双产物归档,量化四字段 ROI)
🛠️ 训练环境与运维
- train env / train doctor(执行面前置,doctor 基线显性 fail +
--baseline子命令) - 训练异常退出资源回收四步链(S330 行为锁)
🧩 FDE 六引擎工作台
- 方法论 → 可执行引擎:
fde_interview/fde_classify/fde_quantify/fde_derive/fde_distill/fde_deploy(全部 MCP tool 化,data/fde/ 结构化资产 + 独立 fde-audit HMAC 留痕) - 入门:FDE 方法论 · WIKI 全局索引
📡 IM 桥远程指挥
- dsh-im 指南 + install.sh 可选分支(默认关/失败不阻断/不代装 DSH 三纪律)——无头设备 FDE 标准执行通道
🔒 BugFix(上版遗留)
- 四轮 16 视角审查 30 项全修:commit-msg 三层防线(P0)/ A2 密钥盲区补四类 / dataDir SSOT 收编 11 处 / webhook 脱敏 / 空白折叠
⚠️ 破坏性变更
升级必读——两条,第二条有迁移命令。
- MCP 工具数 67→76(新增 fde 六件 + 训练三件,全量见
AGENTS.md「MCP 全量工具表」) - doctor 基线缺失从「首跑自动记录」改为显性报错:如遇
doctor: baseline missing,执行npx @sofagent/audit@1.4.2 train doctor --baseline显式建立后重跑
🔗 深入了解
| 想看什么 | 链接 |
|---|---|
| 全部变更明细 | CHANGELOG |
| 上手指南 | HANDBOOK |
| 有问题 / 晒场景 | Discussions · good first issues |
| npm 包 | @sofagent/audit · @sofagent/fde · 共 13 包(npm) |
v1.4.1 — 🚂 训练引擎地基
🚂 训练不再是黑箱脚本——给企业专属模型建了一所「训练学校」的地基:可编排、可审计、可复现、可恢复,八块水电管线一次铺齐。
🔨 核心变更
🚂 训练任务编排(train-job)
- 新增
train_submitMCP tool(66→67 tools),语言对话即可提交训练任务;train doctorCLI 一键体检训练环境 - train-job 生命周期管理:创建幂等 + enterpriseId 强制绑定 + datasetVersion 续跑锁定
📒 训练全程可审计
- train_job 审计事件 HMAC 链:谁训的 / 用哪批数据 / 产物指纹 / 合规红线,全链留痕可回滚
- 权重产物 HMAC 签名 + 加载阻断——审计 DNA 从代码 diff 延伸到权重文件(防投毒)
🔐 多企业隔离与可复现
- enterpriseId 隔离边界(缺失拒绝创建)+ 企业数据覆写清理
- 可复现指纹:datasetHash + 环境快照 + HMAC 冻结,重冻结拒绝(A/B 对比训练的声称基础)
♻️ 异常退出守护
- 心跳守卫 + 四步资源回收(进程组杀除 / GPU 显存释放通知 / tmp 清理 / 审计入链)+ 孤儿进程巡检
- 引擎崩溃恢复:启动扫描 + 三选项决策 + 假活任务清理(engine-crash-log.jsonl)
🛡️ 训练安全基线
- 路径白名单 + 环境变量注入过滤 + 凭据脱敏(红队攻击面声明)
🔒 BugFix(上版遗留)
- install.sh 迁移失败中止叙事(return 1×set -e 场景用户可见 err)+ symlink 谎报守卫(ln -sf/sfn 全守卫)
- DSH 工具注入 zod schema 泄漏根治(判断层四 worker 全灭根因)+ 防回归单测 5 用例
- EXIT trap 吞退出码 + bash 3.2 多字节变量名两大系统性炸弹根治(acceptance 检查器层)
⚠️ 破坏性变更
- MCP 工具数 66→67(新增
train_submit,默认全量暴露不变) - 训练任务创建强制
enterpriseId(缺失抛 zod 校验错——多企业隔离的数据主权底线) SOFAGENT_FORCE_DSH环境变量废弃 →SOFAGENT_EXECUTION_BACKEND
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 3177 tests 全绿 ✅ |
| acceptance-test | 340/340 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 93/93 全绿 ✅ |
| 回归检查 | 94 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 24+24 视角审查闭环 ✅ |
📖 详细开发日志
🎉 v1.4.0 — 🧩 插件家族进生态与工作明细驾驶舱
📊 约束能力第一次走出 sofagent 本体——打包成插件家族直进 DSH 与 OpenClaw 生态,AI 的工作明细也人人可看。
🔨 核心变更
📊 Web 工作明细 + 🗺️ 图谱栏
- Dashboard 新增工作明细区块:按 Agent / Workflow / 周 + 人工介入四视角(读 worklog.json,示例数据降级)
- 图谱栏:FDE 双图谱(业务图谱 + 本体图谱)+ MCP 工具视图 + skill 加载链视图
- Dashboard HTML 产品化:随 install.sh 装到用户机(开发态/安装态双路径)
💰 成本审计
- 超支告警(WARN only 不拦截)+
cost_queryMCP tool + COST DecisionKind(决策日志新分型)——「成本超支」从不可见变成可审计、可告警
🔌 DSH 插件家族(9 款)+ 🦞 OpenClaw 插件家族(4 款)
- 约束层四能力外化双生态:audit / rollback / inject / evolve / ontology / commons / gate / daemon / fde(DSH inventory 全可见)+ inject / audit / rollback / evolve(ClawHub code-plugin)
- Cursor / Claude hook 拦截:共享 precommit 脚本 + 双平台薄配置(S321 CI 闭环验证)
📡 远程 API 通道 + 🔗 MLflow + 🌐 Agentic Browser
- 客户端→服务器 workflow 触发 + 状态查询(契约文档化)
logBenchmarkToMlflow接入评测链路(tracking server 不可达降级不抛)- Browser 4 工具(navigate / click / screenshot / assert)+ Playwright 真实驱动
⚡ DSH 默认启用 + 🔌 MCP 自动配置
- 不等 DSH 正式版——rc 期默认走 CLI 桥接(headless + 自带 fs/bash 工具链);
SOFAGENT_FORCE_DSH=1不再需要 - install.sh 补 codex/hermes 分支 + 各平台写 MCP 配置装完即连
🔄 联邦查询 + 🐚 bash 3.2 + 🔍 审计溯源
- 联邦链路双重验收:fork 版 10 断言(S320)+ 独立进程版 4 场景(S322)——配对 / 跨设备加密查询 / 篡改检测 / 离线降级全通
- 全 shell 脚本 /bin/bash 3.2 真实环境验证 EXIT=0
- 审计溯源字段回填:
whichDataVersion+beforeAfter结构化摘要(TODO(v1.x) 收口)
🔀 工具角色分层 + 瘦描述
- 66 个 MCP 工具按 7 角色面打标(audit / fde / eval / agent / ops / commons / browser),默认全量暴露,
SOFAGENT_MCP_ROLES显式收窄专职面 - description 瘦身:schema 降 14%(去版本号/历史注释——聚焦「做什么」改善选错率)
🔒 BugFix(上版遗留)
- Cordis 内嵌完整适配:worker 真正切到进程内驱动(boot + agents.create + followup,非 CLI 子进程桥接)
- argv[1] 守卫:node -e 宿主下 cordis-plugin-hmr 兼容(内嵌不再静默降级 CLI)
- 检查器 4 缺陷修复(维度 90/89/111 正则与解析 + 维度 49 参数动态化——误报根因系统性排查)
⚠️ 破坏性变更
- MCP 工具数 61 → 66:新增
cost_query(成本查询)+ browser 4 工具(navigate/click/screenshot/assert) - 工具默认全量暴露 + description 瘦身(schema 降 14%)——
SOFAGENT_MCP_ROLES显式收窄专职面(可选,不影响默认) - DSH 默认启用:
SOFAGENT_FORCE_DSH=1不再需要——rc 期默认走 CLI 桥接(原默认 LangGraph 降级);需 LangGraph 执行时显式SOFAGENT_EXECUTION_BACKEND=langgraph - DecisionKind 枚举 12 → 13:新增
COST(决策日志新分型) - 目录归位:
tools/pre-push-check.sh→tools/release/pre-push-check.sh(引用已同步) - DSH 插件更名:
cordis-plugin-audit→cordis-plugin-sofagent-audit(9 款全改,品牌统一)
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2937 tests 全绿 ✅ |
| acceptance-test | 332/332 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 75/75 全绿 ✅ |
| 回归检查 | 94 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 16 视角审查闭环 ✅ |
📖 详细开发日志
v1.3.9 — 🔍 官方 AST 规则引擎与 meta-harness 统一编排
🔍 规则引擎第一次有了官方参考实现,编排进入 meta-harness 时代——AI 干的每一件活,都有了可以审计的工作明细账。
🔨 核心变更
🔍 官方 AST 规则引擎
sofagent-ruleset-ast:语义级规则引擎(TypeScript AST 解析)——OWASP ASI01 目标劫持 + ASI04 供应链 SBOM 检测开箱即用(8+2 rule checks,与 v1.2.9 插件同管线)
🧩 meta-harness 统一编排
- 多 harness 策略强制下沉基础设施层——跨会话协作、动作前拦截 deny 优先、审计轨迹跨 harness 聚合(19 测试)
📊 AI 工作明细数据层
worklog:按 Agent/Workflow/周 + 人工介入记录——复用审计 + decision-log + LLM Trace,零新数据采集;worklog_queryMCP(60→61 tools)
🔬 API 分级治理
@public/@internal显式分级(1449 符号)+ CI 门禁基线——@internal 破坏性变更永不波及适配层
⚙️ FORGE driver 切 DSH
- 执行后端可切换:显式后端选择 + DSH CLI 桥接 + bash 全权限(
SOFAGENT_FORCE_DSH)——从 LangGraph 到 DSH 一键切换
📈 评估与生态
- MLflow agent 评估(13 指标 + LLM-as-Judge)· Agentic Browser(4 工具)· 跨平台适配器(Cursor/Codex/Gemini CLI 薄挂载)
🗂️ 工程与辅助
tools/物理分子目录(check/gen/forge/release)· ATTRIBUTION 归因引擎 · Dream Sandbox 沙盒审计(强制人审 + 路径穿越消毒)· FORGE driver 进程守护(daemon + watcher)
🔒 BugFix(上版遗留)
-
5MB diff 缝隙修复(spill 落盘 + 64MB 读回)· release-gate 三跑定谳(4 阻塞 FAIL + coverage 2 零覆盖全处置)
⚠️ 破坏性变更
- MCP 工具数 60→61(+1
worklog_query) - API 分级:
@public/@internal显式标注——适配层只依赖 @public 子集,@internal 破坏性变更不影响 - 执行后端:DSH 切换需显式启用(
SOFAGENT_FORCE_DSH=1),默认仍 LangGraph
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2903 tests 全绿 ✅ |
| acceptance-test | 329/329 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 73/73 全绿 ✅ |
| 回归检查 | 94 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 16 视角审查闭环 ✅ |
📖 详细开发日志
v1.3.8 — 🛡️ 代理网关硬边界与数据静态加密
🛡️ v1.3.7 给 SubAgent 建好了牢房,v1.3.8 给牢房配上了门禁、保险柜和录像机——Agent 的工具调用先过代理网关(权限只减不增 + 极高风险人工审批),写盘数据加密,执行副作用 WAL 日志可回滚。
🔨 核心变更
🛡️ 代理网关硬边界
- 唯一出入口:SubAgent 工具调用必经网关,四档风险分级 + 权限单调守卫(只减不增)
- 极高风险请求挂起入 HITL 审批队列(
hitl_resolve空转闭环首次激活——人工决议前请求不执行) - 网关攻击面四防:绕过防护 / DDoS 限速 / 请求伪造校验 / 日志注入防护
🔐 数据静态加密
- 审计历史落盘前透明加密(纯 TS AES-256-GCM,
SOFAGENT-AGE-V1格式,非 spawn age) - 密钥指纹强制备份确认(
--doctor检查密钥存在性 + 加解密 roundtrip 自检)
⏸️ Durable Execution L3
- WAL 三态崩溃恢复:committed 未确认→验证副作用 / aborted→回滚 / 未完成→按幂等策略
- undo 三档覆盖:可逆(git restore)/ 部分可逆 / 不可逆(
irreversible:true审计告警不回滚)
🤖 异步长任务自治
- cron 三档糖(@daily/@weekly/@monthly)展开落盘 + 依赖图前序 PASS 才触发
- 死循环检测(N 次无变化触发 replan 告警)+ 崩溃 WAL 续跑
⚙️ FORGE driver 保活三件套
- pm2 托管双 loop + resume 断点续跑(不重跑已完成 worker)+ liveness 探针(
--check-alive只认心跳)
🧩 托管 SDK sandbox:true 启用
harness.wrap三层沙箱正式接线:工具判定(tool-gate)/ 虚拟文件系统 / 网络白名单
🔻 release-gate 瘦身
--judgment-only一次直达判断层四步(省 61% token),F 循环 FAIL 即停
📊 fresh-eyes 成本重构
- usage.jsonl 逐步计量 +
_summary汇总 + B 侧复核模式 + 单次 16 视角草稿工具(视角零删减)
📸 快照写路径加固
- revert 两阶段原子化 + saveSnapshots 原子替换(中途失败原文件完整)
🔒 BugFix(上版遗留)
- 四 P0 安全修复:A1 后缀式敏感文件绕过 / A2 FFFD 短路绕过 / 安装链三重断链 / 声称断裂
- 防屎山四项:gen-* 抽公共库 + SOP 规则固化 + env.local 保险断言 + 垃圾清理
⚠️ 破坏性变更
harness.wrap的sandbox: true从报错改为启用(v1.3.7 传入会 throw,本版正式接线三层沙箱——显式传sandbox: true的调用方行为变化,未传者无感)--judgment-only为新增 CLI 参数(release-gate driver,纯增量,不影响既有--step单步模式)- MCP 工具数不变(60 tools 无增删——
hitl_resolve是激活既有空转 tool,非新增)
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2782 tests 全绿 ✅ |
| acceptance-test | 314/314 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 71/71 全绿 ✅ |
| 回归检查 | 91 维度 86PASS ✅ |
| release-gate | verdict=PASS(run-13)✅ |
| fresh-eyes | 16 视角审查闭环 ✅ |
📖 详细开发日志
v1.3.7 — 🏰 SubAgent 完整沙箱与场景驱动权限
🏰 SubAgent 第一次在真正隔离的环境里替企业干活——文件写入先进虚拟层审批才落盘,网络只能出白名单,工具调用过 fail-closed 门,未注册的影子 agent 也会被 AgentShield 扫出来。
🔨 核心变更
🏰 SubAgent 完整沙箱(六件套)
- 虚拟文件系统:写入先进虚拟层,审批后原子合并落盘(证据流 HMAC 链)
- 网络出站白名单:DNS 隧道 + raw socket 全拦,域名后缀 + CIDR 双规则
- 工具调用中介:Symbol 唯一 ID 判定,未注册一律 fail-closed
- 虚拟 key:vk- 前缀 + scope 数据流契约 + token bucket 限速 + 日志脱敏
- AsyncSubAgent 独立进程:stdout JSON 行回报 + SIGINT 优雅退出
- 真·实时 A/B 双跑:隔离环境并行执行 + 行级 diff
🔐 场景驱动权限
- 身份→场景匹配→风险等级→放行/deny/人工批准,每步 decision-log 留痕
- DSH 三硬约束:fail-closed / 守卫先于事件分发 / 最小权限面
- 敏感域自动提级(审计数据写删一律 critical)
🛡️ AgentShield 五类扫描
- MCP 配置风险画像 / Hook 注入分析 / Agent 配置审查(否定后行断言排除反向表述)/ 密钥检测增强
- Shadow AI 发现:扫进程/配置/仓库,揪出未注册的「影子 agent」——静态确定性,零 LLM 自评
🏥 行业 overlay 四套
- fintech(反洗钱留痕)/ medical(PHI 保护)/ government(等保留痕)/ ai(模型注册)
- context.md
industry:自动加载,未标注保守默认
⚡ 断路器 + 行为监控
- 连败熔断 + 冷却 half-open 探测自动恢复(ASI08)
- 三指标滑窗超阈值隔离切人工(ASI10,与沙箱联动:隔离态不接新任务)
🌳 ontology 生命周期
- lifecycle branch/trunk + 审阅门 migrateToTrunk(approver 必填)
- OKF 三件套:type 必填 / stale_after 信任时效 / verified 人审>机审分层
⚙️ FORGE 审查循环加固
- 自适应并发(按物理内存预算表 8GB→1 … ≥48GB→6)+ OOM 熔断降级
- LLM 调用全程 timeout+retry;resume 断点轮次守卫(run-27/28/29 三死根治)
🔒 BugFix(上版遗留)
- 26 项独立审查 bugfix 全部修复:verify-commit 洗白链 / 安装链断链 / 门禁三态等 4 项 P0 根治
- 红队四项防御增强:verify-chain 追加伪造判篡改 / A2 二进制 WARN / A9 伪造签名 / 验签 fail-closed
- S146 acceptance 深夜挂起根因(cwd 漂移致 registry 拉远端 vitest)根治
⚠️ 破坏性变更
- 本版无破坏性变更(全部为增量能力:沙箱/权限/Shield/overlay 均不改变既有 API 行为)
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2655 tests 全绿 ✅ |
| acceptance-test | 303/303 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 72/72 全绿 ✅ |
| 回归检查 | 89 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 3 轮独立审查 ✅ |
📖 详细开发日志
v1.3.6 — 🔌 引擎接口外化与机器审阅
🔌 模型层的产出第一次能标准化进约束层——workflow / ontology / 自定义 Agent / 后训练模型,三个数据接口 + 一个代码接口,进来就被审计、被约束、被追踪。
🔨 核心变更
📥 三个数据接口(进)
- Workflow 标准格式 + 运行容器(workflow_submit,含 merge_criteria/approver 审阅协议字段——workflow 升级为变更提案)
- Ontology 注册(ontology_import:校验→注册→D1-D5 审计留痕,失败可回滚)
- 模型注册 + 灰度切换(model_register / model_switch / model_unregister:评测→注册→灰度→晋升全流程审计 + 强制人审)
🧩 SubAgent 托管 SDK(代码接口)
- harness.wrap() 一行包装,自定义 LangGraph Agent 自动获得审计/审批/身份/Trace(createReactAgent 与纯 StateGraph 双形态)
🏋️ 训练协议 + 预算控制
- 双栈契约(job.json 单文件 / stdout JSON 行回报 / SIGINT 优雅退出)+ train_budget 超预算自动暂停人审
🧭 路由决策可解释性
- EndpointProfile 能力画像 + route-policy.yml 偏好策略 + routeReason 结构化理由链——路由决策从黑盒变可追问
✅ 机器可判定验收
- define_acceptance / check_acceptance 两个 MCP tool(复用 Benchmark 判定引擎),任务创建时附验收条件
🛡️ 可靠性五件
- FORGE worktree 隔离(审查 worker 与主仓物理分离)/ 双闸验证(postToolCall 副作用复查)/ Agent 疲劳度检测 / 分级降级梯队 / decisions.jsonl 五分类
🔌 DSH 执行后端补全
- runCordisAgent 对照正式版 Cordis API 重写 + Trajectory 采集 PoC(正式版发布前版本守卫拦截属预期)
🔒 BugFix(上版遗留 + 发版后 hotfix)
- fresh-eyes run-03:prompt 层脱敏补 Stripe sk_live_/sk_test_(与 tool 层同源)/ 漏洞报告渠道改 Security Advisory 单通道
- FORGE:两轮假 FAIL 根治(exit 语义归一化 + PROJECT_ROOT 注入)/ 两轮假 PASS 根治(零 commit 收敛拦截)
- 发版后 hotfix:ECDH 私钥 32 字节定长契约(前导零补齐 + 2000 次采样锁)
⚠️ 破坏性变更
- MCP 工具数 52→60(新增 8 个:workflow_submit / ontology_import / model_register / model_switch / model_unregister / train_budget / define_acceptance / check_acceptance)
- market_* → commons_* 更名:market_publish/search/invoke/rate/harvest_rule/retire → commons_*,DecisionKind.MARKET → COMMONS——不做 alias,data/market/ 旧数据随版本废弃
- DecisionWhy 新增可选 routeReason 字段(老日志不受影响,穷举 switch 需兼容缺省)
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2515 tests 全绿 ✅ |
| acceptance-test | 222/222 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 72/72 全绿 ✅ |
| 回归检查 | 87 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 2 轮独立审查 ✅ |
📖 详细开发日志
v1.3.5 — 🧬 自进化与运维闭环触手可及
🧬 自进化与运维闭环触手可及——Agent 摸得到进化的方向盘和回退的安全绳,四条 MCP 工具补上最后一块。
🔨 核心变更
🧬 自进化闭环(ab-test ×2)
- run_ab_test 发起 A/B 对比实验(current vs candidate + golden-set),promote_ab 晋升决策(强制人审)
🔧 运维闭环(daemon 快照 ×2)
- snapshot_list 审计快照时间线查询(只读),snapshot_restore 恢复(强制人审)
🧠 instinct→skill 自动进化
- 从 think.md + decision-log + 审计结果自动提取判断模式,置信度 ≥0.7 才注入,/evolve 聚合为可复用 skill
🤖 FDE 运维五件
- 陪跑期 / 进场记忆 / 节点注册表 / 审计问卷脚本(7 行业模板)
🔌 DSH MCP 互通
- 52 tools 经 stdio 即挂即用,DSH 今天就能调 sofagent 全部能力
🔒 BugFix(四份独立审查)
- 38 项修复——影子审计器防线激活 / 门禁假绿清零 / 泄漏清理 / 绕过检测
⚠️ 破坏性变更
- MCP 工具数 48→52(新增 4 个:run_ab_test / promote_ab / snapshot_list / snapshot_restore)
- automerge 1.x→3.x:旧包名 automerge → @automerge/automerge,API 签名全变(四文件约 40 处)
- vitest 1.x/3.x→4.1.10:breaking change,三包统一升级
- sofagent-audit --doctor 新增 --reset-baseline flag
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2283 tests 全绿 ✅ |
| acceptance-test | 291/291 断言全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 72/72 全绿 ✅ |
| 回归检查 | 84 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 四份独立审查 ✅ |
📖 详细开发日志
v1.3.4 — 🏪 组织能力市场(L3 五环)+ 🛡️ SkillScan 安全门
🏪 协作成果像内部应用商店一样流转——Skill/Agent/流程可发布、可评分、可退役,第三方 Skill 先过安全门。
🔨 核心变更
🏪 L3 组织能力市场
- 五环闭环:发布→发现→调用→评价→养护(6 个 market MCP tool:publish / search / invoke / rate / retire / harvest_rule)
- 评分公式 trust × 评价 × log(调用量+1)——高频高价值能力自然上浮
🛡️ SkillScan 安全门
- 第三方 Skill 发布/安装双触发静态扫描(注入/越权/泄漏检测)
- 三态判定:DANGEROUS 拦截 / SUSPICIOUS 人工确认 / SAFE 放行
📊 评估体系三步
- 真实差评自动提炼规则候选 → Benchmark 评测 → 业务方评审晋升生产回路
🔌 编排层与执行层分离
- ExecutionBackend 接口 + DSH 执行后端接入(rc 版本守卫自动回退 LangGraph,正式版发布后自动切换)
📜 市场审计
- DecisionKind 加 MARKET 市场动作专用分型 + daemon 双巡检(目录日更 + 健康周检)
🔒 BugFix(上版遗留)
- fresh-eyes 4 轮审查 47 项修复(文档漂移/假绿/叙事统一)
⚠️ 破坏性变更
- MCP 工具数 42→48(新增 6 个:market_publish / market_search / market_invoke / market_rate / market_retire / market_harvest_rule)
DecisionKind新增'MARKET'枚举值(engine/audit/src/decision-schema.ts)——switch 全枚举的 TS 消费者需补分支- orchestrator 新导出
ExecutionBackend接口 +createExecutionBackend()工厂(纯新增,无删除)
✅ 质量验证
| 检查项 | 结果 |
|---|---|
| npm test | 2235 tests 全绿 ✅ |
| acceptance-test | 202/202 场景全绿 ✅ |
| shellcheck | 零 error ✅ |
| check-version | 71/71 全绿 ✅ |
| 回归检查 | 83 维度 ✅ |
| release-gate | verdict=PASS ✅ |
| fresh-eyes | 6 轮独立审查 ✅ |
📖 详细开发日志