Skip to content

Releases: KongFangXun/sofagent

v1.4.3 — 🚀 训练引擎 · 运行与需求 + 📊 审计聚合指标

Choose a tag to compare

@KongFangXun KongFangXun released this 01 Sep 08:50

🚀 训练任务从「能提交」到「可运维的长期资产」——跑得动(长任务监控 + GPU 显存预算队列)、找得到问题(七类失败诊断附修复建议)、出得了交付(沙箱隔离 + 离线可训 + 设备打包);--stats 让审计从逐次事件变成可汇报的治理 KPI。

TL;DR (EN): Training becomes operable, not just submittable: long-task monitoring + VRAM-budget queues, seven-class failure diagnosis with fix prescriptions, sandboxed offline training with device packaging; --stats turns audit into a reportable KPI. MCP 76→79, 3619 tests.

⚡ Install / Upgrade

# 新装(五形态任选:FDE 插件 / Skill / MCP / CLI / GitHub Action)
curl -fsSL https://raw.githubusercontent.com/KongFangXun/sofagent/main/install.sh | bash

# 已装用户升级到本版
npx @sofagent/audit@1.4.3 --doctor

# GitHub Action(PR 自动审计)
uses: KongFangXun/sofagent@v1.4.3

🔨 核心变更

📡 训练监控与 GPU 队列

  • train_status / train_list 进度查询(status / step / loss / reward 曲线 / 日志尾部 + 历史任务过滤)——MCP 客户端可查训练进度
  • GPU 显存预算队列:多任务按预算排队(串行 or 按预算并发),并发不 OOM;训练完成/失败 webhook 推送
  • 训练状态落盘 data/dashboard/train-status.json,Dashboard「训练任务」区块可读

🩺 训练失败诊断

  • train_diagnose:OOM / 数据格式错 / 超参发散 / 框架错误 / 环境不匹配 / 重复坍塌 / 精度异常——每类附修复建议(如精度异常 → LM head/优化器状态升 FP32)
  • 诊断报告自动收集上下文:失败日志尾部 + 环境 + 最近 checkpoint + 超参

📦 训练沙箱与设备打包

  • 训练子进程隔离(无外网 / 只读数据源 / 只写产物目录),客户机房离线可训
  • 训练运行时可打包进交付设备(U 盘/电脑形态交付)

🧭 需求推导与模板库

  • train analyze 四步引导:workflow 节点 → 训练目标 / 数据需求 / 评估标准 / 配置
  • 模板库:QLoRA/SFT/DPO + RL 配方 grpo/dapo/cispo(含 ScaleRL 四技巧)+ MoE expert 覆盖防护;后训练 workflow 模板(七节点 DAG + 三个 HITL 确认点)

⚙️ FORGE DSH 执行深化收口

  • 流式面重建 / 审查 step 分级切分 / usage 自动计量

📊 审计聚合指标

  • sofagent-audit --stats:安全边界触发率 / 阻断率 / 高危 Top5 + --json + 落盘——审计从逐次事件变成可汇报的治理 KPI

🧹 存量清扫

  • ao 工具链探测删除 / composeWithDeepAgents 更名 composeWithReactAgent(旧名 @deprecated 一版)/ fde_compose 收窄 workflow-only
  • doctor 补 Ontology 完整性检查:frontmatter 坏格式从静默跳过变 WARN + 修复提示
  • 训练反作弊基线默认化:reward hacking 四形态双防线(剥 .git + 网络白名单)写进默认配置;train doctor 补反作弊三项体检

🔒 BugFix(上版遗留)

  • 四轮 fresh-eyes 审查 F-01~F-14 全量处置:E1 修复文案语义反转 / S219 阈值校准链对齐 / doctor 全局路径收口 SSOT / hook 基线 fail-closed 化

✅ 质量验证

检查项 结果
npm test 3619 tests 全绿 ✅
acceptance-test 293/293 场景 · 372/372 断言 ✅
shellcheck 零 error ✅
check-version 102/102 全绿 ✅
回归检查 96 维度 ✅
release-gate verdict=GO ✅
fresh-eyes 4 轮独立审查 ✅

⚠️ 破坏性变更

升级必读——两条,第二条有迁移指引。

  • MCP 工具数 76→79(新增 train_status / train_list / train_diagnose,全量见 AGENTS.md「MCP 全量工具表」
  • checkHistoryChainIntegrity 退役公告(移除归 v1.5.0):布尔返回无法区分「篡改 / 不可复验 / 历史不足」。如遇调用报弃用警告,迁移 checkHistoryChainDetailed(dataDir)——原 true 对应 status === 'ok';原 false 改读结构化字段(tampered / unverifiable / insufficient-history)。迁移示例:engine/audit/src/commands/verify.ts
  • fde_compose 收窄为 workflow-only:如遇 ontology action 返回迁移提示,改用 fde_derive(五要素 → ontology 草稿)

🔗 深入了解

想看什么 链接
全部变更明细 CHANGELOG
上手指南 HANDBOOK
有问题 / 晒场景 Discussions · good first issues
npm 包 @sofagent/audit · @sofagent/fde · 共 13 包(npm

📖 详细开发日志

v1.4.2 — 🚀 训练引擎 · 数据与评估 + 🧩 FDE 六引擎

Choose a tag to compare

@KongFangXun KongFangXun released this 28 Aug 16:02

🚀 训练引擎吃得到数据、评得出好坏——企业异构数据(CSV/Excel/DB/API)经质量闸门进训练集,训练连着评估出报告,FDE 六引擎让方法论变成可执行工具。

TL;DR (EN): Training pipeline with data versioning + eval-in-the-loop for enterprise data (CSV/Excel/DB/API), plus six MCP-native FDE engines — methodology as executable tooling. 76 MCP tools, 2903 tests, MIT.

⚡ Install / Upgrade

# 新装(五形态任选:FDE 插件 / Skill / MCP / CLI / GitHub Action)
curl -fsSL https://raw.githubusercontent.com/KongFangXun/sofagent/main/install.sh | bash

# 已装用户升级到本版
npx @sofagent/audit@1.4.2 --doctor

# GitHub Action(PR 自动审计)
uses: KongFangXun/sofagent@v1.4.2

🔨 核心变更

📊 训练数据管道与版本

  • 企业数据 → 训练集管道(train_dataset_ingest 等 MCP tool,CSV/Excel/JSON/文本 + PG/MySQL/REST 多源,CSV 类型推断端到端)
  • 训练集版本管理(dataset_version 台账三件套:指纹冻结 + 不可变 + 续跑版本锁,两版 diff)

🎯 训练评估闭环

  • 训练中 eval 闭环(train_eval_submit,阈值判定双态,不 eval 的训练是盲训)
  • 训练 dry-run 显存估算(单调性外推 + ScaleRL sigmoid 拟合建议,失败前预防)
  • 训练报告 train_report(客户可读 Markdown+JSON 双产物归档,量化四字段 ROI)

🛠️ 训练环境与运维

  • train env / train doctor(执行面前置,doctor 基线显性 fail + --baseline 子命令)
  • 训练异常退出资源回收四步链(S330 行为锁)

🧩 FDE 六引擎工作台

  • 方法论 → 可执行引擎:fde_interview / fde_classify / fde_quantify / fde_derive / fde_distill / fde_deploy(全部 MCP tool 化,data/fde/ 结构化资产 + 独立 fde-audit HMAC 留痕)
  • 入门:FDE 方法论 · WIKI 全局索引

📡 IM 桥远程指挥

  • dsh-im 指南 + install.sh 可选分支(默认关/失败不阻断/不代装 DSH 三纪律)——无头设备 FDE 标准执行通道

🔒 BugFix(上版遗留)

  • 四轮 16 视角审查 30 项全修:commit-msg 三层防线(P0)/ A2 密钥盲区补四类 / dataDir SSOT 收编 11 处 / webhook 脱敏 / 空白折叠

⚠️ 破坏性变更

升级必读——两条,第二条有迁移命令。

  • MCP 工具数 67→76(新增 fde 六件 + 训练三件,全量见 AGENTS.md「MCP 全量工具表」
  • doctor 基线缺失从「首跑自动记录」改为显性报错:如遇 doctor: baseline missing,执行 npx @sofagent/audit@1.4.2 train doctor --baseline 显式建立后重跑

🔗 深入了解

想看什么 链接
全部变更明细 CHANGELOG
上手指南 HANDBOOK
有问题 / 晒场景 Discussions · good first issues
npm 包 @sofagent/audit · @sofagent/fde · 共 13 包(npm

v1.4.1 — 🚂 训练引擎地基

Choose a tag to compare

@KongFangXun KongFangXun released this 27 Aug 03:09

🚂 训练不再是黑箱脚本——给企业专属模型建了一所「训练学校」的地基:可编排、可审计、可复现、可恢复,八块水电管线一次铺齐。

🔨 核心变更

🚂 训练任务编排(train-job)

  • 新增 train_submit MCP tool(66→67 tools),语言对话即可提交训练任务;train doctor CLI 一键体检训练环境
  • train-job 生命周期管理:创建幂等 + enterpriseId 强制绑定 + datasetVersion 续跑锁定

📒 训练全程可审计

  • train_job 审计事件 HMAC 链:谁训的 / 用哪批数据 / 产物指纹 / 合规红线,全链留痕可回滚
  • 权重产物 HMAC 签名 + 加载阻断——审计 DNA 从代码 diff 延伸到权重文件(防投毒)

🔐 多企业隔离与可复现

  • enterpriseId 隔离边界(缺失拒绝创建)+ 企业数据覆写清理
  • 可复现指纹:datasetHash + 环境快照 + HMAC 冻结,重冻结拒绝(A/B 对比训练的声称基础)

♻️ 异常退出守护

  • 心跳守卫 + 四步资源回收(进程组杀除 / GPU 显存释放通知 / tmp 清理 / 审计入链)+ 孤儿进程巡检
  • 引擎崩溃恢复:启动扫描 + 三选项决策 + 假活任务清理(engine-crash-log.jsonl)

🛡️ 训练安全基线

  • 路径白名单 + 环境变量注入过滤 + 凭据脱敏(红队攻击面声明)

🔒 BugFix(上版遗留)

  • install.sh 迁移失败中止叙事(return 1×set -e 场景用户可见 err)+ symlink 谎报守卫(ln -sf/sfn 全守卫)
  • DSH 工具注入 zod schema 泄漏根治(判断层四 worker 全灭根因)+ 防回归单测 5 用例
  • EXIT trap 吞退出码 + bash 3.2 多字节变量名两大系统性炸弹根治(acceptance 检查器层)

⚠️ 破坏性变更

  • MCP 工具数 66→67(新增 train_submit,默认全量暴露不变)
  • 训练任务创建强制 enterpriseId(缺失抛 zod 校验错——多企业隔离的数据主权底线)
  • SOFAGENT_FORCE_DSH 环境变量废弃 → SOFAGENT_EXECUTION_BACKEND

✅ 质量验证

检查项 结果
npm test 3177 tests 全绿 ✅
acceptance-test 340/340 场景全绿 ✅
shellcheck 零 error ✅
check-version 93/93 全绿 ✅
回归检查 94 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 24+24 视角审查闭环 ✅

📖 详细开发日志

🎉 v1.4.0 — 🧩 插件家族进生态与工作明细驾驶舱

Choose a tag to compare

@KongFangXun KongFangXun released this 24 Aug 10:53

📊 约束能力第一次走出 sofagent 本体——打包成插件家族直进 DSH 与 OpenClaw 生态,AI 的工作明细也人人可看。

🔨 核心变更

📊 Web 工作明细 + 🗺️ 图谱栏

  • Dashboard 新增工作明细区块:按 Agent / Workflow / 周 + 人工介入四视角(读 worklog.json,示例数据降级)
  • 图谱栏:FDE 双图谱(业务图谱 + 本体图谱)+ MCP 工具视图 + skill 加载链视图
  • Dashboard HTML 产品化:随 install.sh 装到用户机(开发态/安装态双路径)

💰 成本审计

  • 超支告警(WARN only 不拦截)+ cost_query MCP tool + COST DecisionKind(决策日志新分型)——「成本超支」从不可见变成可审计、可告警

🔌 DSH 插件家族(9 款)+ 🦞 OpenClaw 插件家族(4 款)

  • 约束层四能力外化双生态:audit / rollback / inject / evolve / ontology / commons / gate / daemon / fde(DSH inventory 全可见)+ inject / audit / rollback / evolve(ClawHub code-plugin)
  • Cursor / Claude hook 拦截:共享 precommit 脚本 + 双平台薄配置(S321 CI 闭环验证)

📡 远程 API 通道 + 🔗 MLflow + 🌐 Agentic Browser

  • 客户端→服务器 workflow 触发 + 状态查询(契约文档化)
  • logBenchmarkToMlflow 接入评测链路(tracking server 不可达降级不抛)
  • Browser 4 工具(navigate / click / screenshot / assert)+ Playwright 真实驱动

⚡ DSH 默认启用 + 🔌 MCP 自动配置

  • 不等 DSH 正式版——rc 期默认走 CLI 桥接(headless + 自带 fs/bash 工具链);SOFAGENT_FORCE_DSH=1 不再需要
  • install.sh 补 codex/hermes 分支 + 各平台写 MCP 配置装完即连

🔄 联邦查询 + 🐚 bash 3.2 + 🔍 审计溯源

  • 联邦链路双重验收:fork 版 10 断言(S320)+ 独立进程版 4 场景(S322)——配对 / 跨设备加密查询 / 篡改检测 / 离线降级全通
  • 全 shell 脚本 /bin/bash 3.2 真实环境验证 EXIT=0
  • 审计溯源字段回填:whichDataVersion + beforeAfter 结构化摘要(TODO(v1.x) 收口)

🔀 工具角色分层 + 瘦描述

  • 66 个 MCP 工具按 7 角色面打标(audit / fde / eval / agent / ops / commons / browser),默认全量暴露,SOFAGENT_MCP_ROLES 显式收窄专职面
  • description 瘦身:schema 降 14%(去版本号/历史注释——聚焦「做什么」改善选错率)

🔒 BugFix(上版遗留)

  • Cordis 内嵌完整适配:worker 真正切到进程内驱动(boot + agents.create + followup,非 CLI 子进程桥接)
  • argv[1] 守卫:node -e 宿主下 cordis-plugin-hmr 兼容(内嵌不再静默降级 CLI)
  • 检查器 4 缺陷修复(维度 90/89/111 正则与解析 + 维度 49 参数动态化——误报根因系统性排查)

⚠️ 破坏性变更

  • MCP 工具数 61 → 66:新增 cost_query(成本查询)+ browser 4 工具(navigate/click/screenshot/assert)
  • 工具默认全量暴露 + description 瘦身(schema 降 14%)——SOFAGENT_MCP_ROLES 显式收窄专职面(可选,不影响默认)
  • DSH 默认启用SOFAGENT_FORCE_DSH=1 不再需要——rc 期默认走 CLI 桥接(原默认 LangGraph 降级);需 LangGraph 执行时显式 SOFAGENT_EXECUTION_BACKEND=langgraph
  • DecisionKind 枚举 12 → 13:新增 COST(决策日志新分型)
  • 目录归位tools/pre-push-check.shtools/release/pre-push-check.sh(引用已同步)
  • DSH 插件更名cordis-plugin-auditcordis-plugin-sofagent-audit(9 款全改,品牌统一)

✅ 质量验证

检查项 结果
npm test 2937 tests 全绿 ✅
acceptance-test 332/332 场景全绿 ✅
shellcheck 零 error ✅
check-version 75/75 全绿 ✅
回归检查 94 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 16 视角审查闭环 ✅

📖 详细开发日志

v1.3.9 — 🔍 官方 AST 规则引擎与 meta-harness 统一编排

Choose a tag to compare

@KongFangXun KongFangXun released this 21 Aug 08:14

🔍 规则引擎第一次有了官方参考实现,编排进入 meta-harness 时代——AI 干的每一件活,都有了可以审计的工作明细账。

🔨 核心变更

🔍 官方 AST 规则引擎

  • sofagent-ruleset-ast:语义级规则引擎(TypeScript AST 解析)——OWASP ASI01 目标劫持 + ASI04 供应链 SBOM 检测开箱即用(8+2 rule checks,与 v1.2.9 插件同管线)

🧩 meta-harness 统一编排

  • 多 harness 策略强制下沉基础设施层——跨会话协作、动作前拦截 deny 优先、审计轨迹跨 harness 聚合(19 测试)

📊 AI 工作明细数据层

  • worklog:按 Agent/Workflow/周 + 人工介入记录——复用审计 + decision-log + LLM Trace,零新数据采集;worklog_query MCP(60→61 tools)

🔬 API 分级治理

  • @public/@internal 显式分级(1449 符号)+ CI 门禁基线——@internal 破坏性变更永不波及适配层

⚙️ FORGE driver 切 DSH

  • 执行后端可切换:显式后端选择 + DSH CLI 桥接 + bash 全权限(SOFAGENT_FORCE_DSH)——从 LangGraph 到 DSH 一键切换

📈 评估与生态

  • MLflow agent 评估(13 指标 + LLM-as-Judge)· Agentic Browser(4 工具)· 跨平台适配器(Cursor/Codex/Gemini CLI 薄挂载)

🗂️ 工程与辅助

  • tools/ 物理分子目录(check/gen/forge/release)· ATTRIBUTION 归因引擎 · Dream Sandbox 沙盒审计(强制人审 + 路径穿越消毒)· FORGE driver 进程守护(daemon + watcher)

🔒 BugFix(上版遗留)

  • 5MB diff 缝隙修复(spill 落盘 + 64MB 读回)· release-gate 三跑定谳(4 阻塞 FAIL + coverage 2 零覆盖全处置)

⚠️ 破坏性变更

  • MCP 工具数 60→61(+1 worklog_query
  • API 分级@public/@internal 显式标注——适配层只依赖 @public 子集,@internal 破坏性变更不影响
  • 执行后端:DSH 切换需显式启用(SOFAGENT_FORCE_DSH=1),默认仍 LangGraph

✅ 质量验证

检查项 结果
npm test 2903 tests 全绿 ✅
acceptance-test 329/329 场景全绿 ✅
shellcheck 零 error ✅
check-version 73/73 全绿 ✅
回归检查 94 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 16 视角审查闭环 ✅

📖 详细开发日志

v1.3.8 — 🛡️ 代理网关硬边界与数据静态加密

Choose a tag to compare

@KongFangXun KongFangXun released this 20 Aug 07:53

🛡️ v1.3.7 给 SubAgent 建好了牢房,v1.3.8 给牢房配上了门禁、保险柜和录像机——Agent 的工具调用先过代理网关(权限只减不增 + 极高风险人工审批),写盘数据加密,执行副作用 WAL 日志可回滚。

🔨 核心变更

🛡️ 代理网关硬边界

  • 唯一出入口:SubAgent 工具调用必经网关,四档风险分级 + 权限单调守卫(只减不增)
  • 极高风险请求挂起入 HITL 审批队列(hitl_resolve 空转闭环首次激活——人工决议前请求不执行)
  • 网关攻击面四防:绕过防护 / DDoS 限速 / 请求伪造校验 / 日志注入防护

🔐 数据静态加密

  • 审计历史落盘前透明加密(纯 TS AES-256-GCM,SOFAGENT-AGE-V1 格式,非 spawn age)
  • 密钥指纹强制备份确认(--doctor 检查密钥存在性 + 加解密 roundtrip 自检)

⏸️ Durable Execution L3

  • WAL 三态崩溃恢复:committed 未确认→验证副作用 / aborted→回滚 / 未完成→按幂等策略
  • undo 三档覆盖:可逆(git restore)/ 部分可逆 / 不可逆(irreversible:true 审计告警不回滚)

🤖 异步长任务自治

  • cron 三档糖(@daily/@weekly/@monthly)展开落盘 + 依赖图前序 PASS 才触发
  • 死循环检测(N 次无变化触发 replan 告警)+ 崩溃 WAL 续跑

⚙️ FORGE driver 保活三件套

  • pm2 托管双 loop + resume 断点续跑(不重跑已完成 worker)+ liveness 探针(--check-alive 只认心跳)

🧩 托管 SDK sandbox:true 启用

  • harness.wrap 三层沙箱正式接线:工具判定(tool-gate)/ 虚拟文件系统 / 网络白名单

🔻 release-gate 瘦身

  • --judgment-only 一次直达判断层四步(省 61% token),F 循环 FAIL 即停

📊 fresh-eyes 成本重构

  • usage.jsonl 逐步计量 + _summary 汇总 + B 侧复核模式 + 单次 16 视角草稿工具(视角零删减)

📸 快照写路径加固

  • revert 两阶段原子化 + saveSnapshots 原子替换(中途失败原文件完整)

🔒 BugFix(上版遗留)

  • 四 P0 安全修复:A1 后缀式敏感文件绕过 / A2 FFFD 短路绕过 / 安装链三重断链 / 声称断裂
  • 防屎山四项:gen-* 抽公共库 + SOP 规则固化 + env.local 保险断言 + 垃圾清理

⚠️ 破坏性变更

  • harness.wrapsandbox: true 从报错改为启用(v1.3.7 传入会 throw,本版正式接线三层沙箱——显式传 sandbox: true 的调用方行为变化,未传者无感)
  • --judgment-only 为新增 CLI 参数(release-gate driver,纯增量,不影响既有 --step 单步模式)
  • MCP 工具数不变(60 tools 无增删——hitl_resolve 是激活既有空转 tool,非新增)

✅ 质量验证

检查项 结果
npm test 2782 tests 全绿 ✅
acceptance-test 314/314 场景全绿 ✅
shellcheck 零 error ✅
check-version 71/71 全绿 ✅
回归检查 91 维度 86PASS ✅
release-gate verdict=PASS(run-13)✅
fresh-eyes 16 视角审查闭环 ✅

📖 详细开发日志

v1.3.7 — 🏰 SubAgent 完整沙箱与场景驱动权限

Choose a tag to compare

@KongFangXun KongFangXun released this 19 Aug 05:38

🏰 SubAgent 第一次在真正隔离的环境里替企业干活——文件写入先进虚拟层审批才落盘,网络只能出白名单,工具调用过 fail-closed 门,未注册的影子 agent 也会被 AgentShield 扫出来。

🔨 核心变更

🏰 SubAgent 完整沙箱(六件套)

  • 虚拟文件系统:写入先进虚拟层,审批后原子合并落盘(证据流 HMAC 链)
  • 网络出站白名单:DNS 隧道 + raw socket 全拦,域名后缀 + CIDR 双规则
  • 工具调用中介:Symbol 唯一 ID 判定,未注册一律 fail-closed
  • 虚拟 key:vk- 前缀 + scope 数据流契约 + token bucket 限速 + 日志脱敏
  • AsyncSubAgent 独立进程:stdout JSON 行回报 + SIGINT 优雅退出
  • 真·实时 A/B 双跑:隔离环境并行执行 + 行级 diff

🔐 场景驱动权限

  • 身份→场景匹配→风险等级→放行/deny/人工批准,每步 decision-log 留痕
  • DSH 三硬约束:fail-closed / 守卫先于事件分发 / 最小权限面
  • 敏感域自动提级(审计数据写删一律 critical)

🛡️ AgentShield 五类扫描

  • MCP 配置风险画像 / Hook 注入分析 / Agent 配置审查(否定后行断言排除反向表述)/ 密钥检测增强
  • Shadow AI 发现:扫进程/配置/仓库,揪出未注册的「影子 agent」——静态确定性,零 LLM 自评

🏥 行业 overlay 四套

  • fintech(反洗钱留痕)/ medical(PHI 保护)/ government(等保留痕)/ ai(模型注册)
  • context.md industry: 自动加载,未标注保守默认

⚡ 断路器 + 行为监控

  • 连败熔断 + 冷却 half-open 探测自动恢复(ASI08)
  • 三指标滑窗超阈值隔离切人工(ASI10,与沙箱联动:隔离态不接新任务)

🌳 ontology 生命周期

  • lifecycle branch/trunk + 审阅门 migrateToTrunk(approver 必填)
  • OKF 三件套:type 必填 / stale_after 信任时效 / verified 人审>机审分层

⚙️ FORGE 审查循环加固

  • 自适应并发(按物理内存预算表 8GB→1 … ≥48GB→6)+ OOM 熔断降级
  • LLM 调用全程 timeout+retry;resume 断点轮次守卫(run-27/28/29 三死根治)

🔒 BugFix(上版遗留)

  • 26 项独立审查 bugfix 全部修复:verify-commit 洗白链 / 安装链断链 / 门禁三态等 4 项 P0 根治
  • 红队四项防御增强:verify-chain 追加伪造判篡改 / A2 二进制 WARN / A9 伪造签名 / 验签 fail-closed
  • S146 acceptance 深夜挂起根因(cwd 漂移致 registry 拉远端 vitest)根治

⚠️ 破坏性变更

  • 本版无破坏性变更(全部为增量能力:沙箱/权限/Shield/overlay 均不改变既有 API 行为)

✅ 质量验证

检查项 结果
npm test 2655 tests 全绿 ✅
acceptance-test 303/303 场景全绿 ✅
shellcheck 零 error ✅
check-version 72/72 全绿 ✅
回归检查 89 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 3 轮独立审查 ✅

📖 详细开发日志

v1.3.6 — 🔌 引擎接口外化与机器审阅

Choose a tag to compare

@KongFangXun KongFangXun released this 17 Aug 18:36

🔌 模型层的产出第一次能标准化进约束层——workflow / ontology / 自定义 Agent / 后训练模型,三个数据接口 + 一个代码接口,进来就被审计、被约束、被追踪。

🔨 核心变更

📥 三个数据接口(进)

  • Workflow 标准格式 + 运行容器(workflow_submit,含 merge_criteria/approver 审阅协议字段——workflow 升级为变更提案)
  • Ontology 注册(ontology_import:校验→注册→D1-D5 审计留痕,失败可回滚)
  • 模型注册 + 灰度切换(model_register / model_switch / model_unregister:评测→注册→灰度→晋升全流程审计 + 强制人审)

🧩 SubAgent 托管 SDK(代码接口)

  • harness.wrap() 一行包装,自定义 LangGraph Agent 自动获得审计/审批/身份/Trace(createReactAgent 与纯 StateGraph 双形态)

🏋️ 训练协议 + 预算控制

  • 双栈契约(job.json 单文件 / stdout JSON 行回报 / SIGINT 优雅退出)+ train_budget 超预算自动暂停人审

🧭 路由决策可解释性

  • EndpointProfile 能力画像 + route-policy.yml 偏好策略 + routeReason 结构化理由链——路由决策从黑盒变可追问

✅ 机器可判定验收

  • define_acceptance / check_acceptance 两个 MCP tool(复用 Benchmark 判定引擎),任务创建时附验收条件

🛡️ 可靠性五件

  • FORGE worktree 隔离(审查 worker 与主仓物理分离)/ 双闸验证(postToolCall 副作用复查)/ Agent 疲劳度检测 / 分级降级梯队 / decisions.jsonl 五分类

🔌 DSH 执行后端补全

  • runCordisAgent 对照正式版 Cordis API 重写 + Trajectory 采集 PoC(正式版发布前版本守卫拦截属预期)

🔒 BugFix(上版遗留 + 发版后 hotfix)

  • fresh-eyes run-03:prompt 层脱敏补 Stripe sk_live_/sk_test_(与 tool 层同源)/ 漏洞报告渠道改 Security Advisory 单通道
  • FORGE:两轮假 FAIL 根治(exit 语义归一化 + PROJECT_ROOT 注入)/ 两轮假 PASS 根治(零 commit 收敛拦截)
  • 发版后 hotfix:ECDH 私钥 32 字节定长契约(前导零补齐 + 2000 次采样锁)

⚠️ 破坏性变更

  • MCP 工具数 52→60(新增 8 个:workflow_submit / ontology_import / model_register / model_switch / model_unregister / train_budget / define_acceptance / check_acceptance)
  • market_* → commons_* 更名:market_publish/search/invoke/rate/harvest_rule/retire → commons_*,DecisionKind.MARKET → COMMONS——不做 alias,data/market/ 旧数据随版本废弃
  • DecisionWhy 新增可选 routeReason 字段(老日志不受影响,穷举 switch 需兼容缺省)

✅ 质量验证

检查项 结果
npm test 2515 tests 全绿 ✅
acceptance-test 222/222 场景全绿 ✅
shellcheck 零 error ✅
check-version 72/72 全绿 ✅
回归检查 87 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 2 轮独立审查 ✅

📖 详细开发日志

v1.3.5 — 🧬 自进化与运维闭环触手可及

Choose a tag to compare

@KongFangXun KongFangXun released this 16 Aug 11:51

🧬 自进化与运维闭环触手可及——Agent 摸得到进化的方向盘和回退的安全绳,四条 MCP 工具补上最后一块。

🔨 核心变更

🧬 自进化闭环(ab-test ×2)

  • run_ab_test 发起 A/B 对比实验(current vs candidate + golden-set),promote_ab 晋升决策(强制人审)

🔧 运维闭环(daemon 快照 ×2)

  • snapshot_list 审计快照时间线查询(只读),snapshot_restore 恢复(强制人审)

🧠 instinct→skill 自动进化

  • 从 think.md + decision-log + 审计结果自动提取判断模式,置信度 ≥0.7 才注入,/evolve 聚合为可复用 skill

🤖 FDE 运维五件

  • 陪跑期 / 进场记忆 / 节点注册表 / 审计问卷脚本(7 行业模板)

🔌 DSH MCP 互通

  • 52 tools 经 stdio 即挂即用,DSH 今天就能调 sofagent 全部能力

🔒 BugFix(四份独立审查)

  • 38 项修复——影子审计器防线激活 / 门禁假绿清零 / 泄漏清理 / 绕过检测

⚠️ 破坏性变更

  • MCP 工具数 48→52(新增 4 个:run_ab_test / promote_ab / snapshot_list / snapshot_restore)
  • automerge 1.x→3.x:旧包名 automerge → @automerge/automerge,API 签名全变(四文件约 40 处)
  • vitest 1.x/3.x→4.1.10:breaking change,三包统一升级
  • sofagent-audit --doctor 新增 --reset-baseline flag

✅ 质量验证

检查项 结果
npm test 2283 tests 全绿 ✅
acceptance-test 291/291 断言全绿 ✅
shellcheck 零 error ✅
check-version 72/72 全绿 ✅
回归检查 84 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 四份独立审查 ✅

📖 详细开发日志

v1.3.4 — 🏪 组织能力市场(L3 五环)+ 🛡️ SkillScan 安全门

Choose a tag to compare

@KongFangXun KongFangXun released this 14 Aug 17:37

🏪 协作成果像内部应用商店一样流转——Skill/Agent/流程可发布、可评分、可退役,第三方 Skill 先过安全门。

🔨 核心变更

🏪 L3 组织能力市场

  • 五环闭环:发布→发现→调用→评价→养护(6 个 market MCP tool:publish / search / invoke / rate / retire / harvest_rule)
  • 评分公式 trust × 评价 × log(调用量+1)——高频高价值能力自然上浮

🛡️ SkillScan 安全门

  • 第三方 Skill 发布/安装双触发静态扫描(注入/越权/泄漏检测)
  • 三态判定:DANGEROUS 拦截 / SUSPICIOUS 人工确认 / SAFE 放行

📊 评估体系三步

  • 真实差评自动提炼规则候选 → Benchmark 评测 → 业务方评审晋升生产回路

🔌 编排层与执行层分离

  • ExecutionBackend 接口 + DSH 执行后端接入(rc 版本守卫自动回退 LangGraph,正式版发布后自动切换)

📜 市场审计

  • DecisionKind 加 MARKET 市场动作专用分型 + daemon 双巡检(目录日更 + 健康周检)

🔒 BugFix(上版遗留)

  • fresh-eyes 4 轮审查 47 项修复(文档漂移/假绿/叙事统一)

⚠️ 破坏性变更

  • MCP 工具数 42→48(新增 6 个:market_publish / market_search / market_invoke / market_rate / market_retire / market_harvest_rule)
  • DecisionKind 新增 'MARKET' 枚举值(engine/audit/src/decision-schema.ts)——switch 全枚举的 TS 消费者需补分支
  • orchestrator 新导出 ExecutionBackend 接口 + createExecutionBackend() 工厂(纯新增,无删除)

✅ 质量验证

检查项 结果
npm test 2235 tests 全绿 ✅
acceptance-test 202/202 场景全绿 ✅
shellcheck 零 error ✅
check-version 71/71 全绿 ✅
回归检查 83 维度 ✅
release-gate verdict=PASS ✅
fresh-eyes 6 轮独立审查 ✅

📖 详细开发日志