Skip to content

Releases: Jonah-Wu23/dsh-gungnir

Gungnir v0.1.0 — Adaptive Loop Control Plane for DSH

Choose a tag to compare

@Jonah-Wu23 Jonah-Wu23 released this 01 Sep 02:31

Gungnir v0.1.0 (BPAR v0.1)

Lock the goal. Adapt the loop. Prove the hit.

首个面向 DeepSeek Harness、根据运行时证据在单次任务执行过程中动态切换 Agent Loop Strategy 的自适应 Loop 插件。基于环境证据链裁决任务完成度,在保证正常执行流畅的同时,精准拦截虚假完成与逻辑缺陷。

📦 npm 官方包

  • 主插件包:[\dsh-gungnir](https://www.npmjs.com/package/dsh-gungnir)
  • 核心算法包:[\gungnir-core](https://www.npmjs.com/package/gungnir-core)
  • 驱动扩展包:[\dsh-gungnir-loop](https://www.npmjs.com/package/dsh-gungnir-loop)

兼容性

插件基于 dsh v0.1.2-alpha.1 开发,不兼容 dsh v0.1.1-rc2。

安装使用

在 DeepSeek Harness 工作区中安装:

\\powershell
pnpm add dsh-gungnir
\\

在 DSH 配置文件中启用:

\\yaml
plugins:

  • name: dsh-gungnir
    config:
    passive: true
    escalation: true
    \\

核心特性

  • Lock the goal(目标锁定):建立版本化目标契约,维护明确的预期交付物和检验标准。
  • Adapt the loop(回路适配):作为 DSH 官方扩展,提供对智能体执行回路的平滑替换与策略调度。
  • Prove the hit(证据裁决):将模型输出视为待检验的主张,通过测试退出码与文件状态等环境证据客观判定。
  • 静默守护与最小介入:正常执行路径下保持静默,只有在观测到确定性证据冲突时才注入面向任务的明确反馈。

实验评测数据摘要

  • 虚假完成拦截率 (T3):100% (2/2) 拦截,彻底消除虚假完成宣称(原生基线放行率 100%)。
  • 复杂语义缺陷修复率 (T1/T2):100% (4/4) 成功规避并完成修复(原生基线仅 25%)。
  • 正常任务性能开销 (H1):中位 Token 开销增幅仅 +7.8%(设计目标 ≤ +10%),额外模型往返轮次为 0 轮

文档