Releases: Jonah-Wu23/dsh-gungnir
Releases · Jonah-Wu23/dsh-gungnir
Release list
Gungnir v0.1.0 — Adaptive Loop Control Plane for DSH
Gungnir v0.1.0 (BPAR v0.1)
Lock the goal. Adapt the loop. Prove the hit.
首个面向 DeepSeek Harness、根据运行时证据在单次任务执行过程中动态切换 Agent Loop Strategy 的自适应 Loop 插件。基于环境证据链裁决任务完成度,在保证正常执行流畅的同时,精准拦截虚假完成与逻辑缺陷。
📦 npm 官方包
- 主插件包:[\dsh-gungnir](https://www.npmjs.com/package/dsh-gungnir)
- 核心算法包:[\gungnir-core](https://www.npmjs.com/package/gungnir-core)
- 驱动扩展包:[\dsh-gungnir-loop](https://www.npmjs.com/package/dsh-gungnir-loop)
兼容性
插件基于 dsh v0.1.2-alpha.1 开发,不兼容 dsh v0.1.1-rc2。
安装使用
在 DeepSeek Harness 工作区中安装:
\\powershell
pnpm add dsh-gungnir
\\
在 DSH 配置文件中启用:
\\yaml
plugins:
- name: dsh-gungnir
config:
passive: true
escalation: true
\\
核心特性
- Lock the goal(目标锁定):建立版本化目标契约,维护明确的预期交付物和检验标准。
- Adapt the loop(回路适配):作为 DSH 官方扩展,提供对智能体执行回路的平滑替换与策略调度。
- Prove the hit(证据裁决):将模型输出视为待检验的主张,通过测试退出码与文件状态等环境证据客观判定。
- 静默守护与最小介入:正常执行路径下保持静默,只有在观测到确定性证据冲突时才注入面向任务的明确反馈。
实验评测数据摘要
- 虚假完成拦截率 (T3):100% (2/2) 拦截,彻底消除虚假完成宣称(原生基线放行率 100%)。
- 复杂语义缺陷修复率 (T1/T2):100% (4/4) 成功规避并完成修复(原生基线仅 25%)。
- 正常任务性能开销 (H1):中位 Token 开销增幅仅 +7.8%(设计目标 ≤ +10%),额外模型往返轮次为 0 轮。