Skills Plugins MCP Prompt Model 导航 博客 资讯 我的中心
会话与消息 #dsh-plugin

dsh-gungnir (dsh-plugin)

面向 DeepSeek Harness 的证据驱动目标校验插件。通过 /ultragoal 锁定目标,并依据命令退出码与生成产物验证完成状态,防止模型虚报任务完成。

jonah-wu23 @jonah-wu23 ⬇ 1 ★ 5 main

安装

dsh plugin --profile web add github:jonah-wu23/dsh-gungnir
下载安装清单

需要可复现安装时,可在仓库后追加 #commit 固定提交。

面向 DeepSeek Harness 的证据驱动目标校验插件。通过 /ultragoal 锁定目标,并依据命令退出码与生成产物验证完成状态,防止模型虚报任务完成。

该插件未提供要点说明,请参考仓库 README。

dsh-plugin
  1. 安装并启动 DeepSeek Harness:npx @deepseek-ai/dsh web
  2. 在终端执行上面的安装命令(CLI 会解析插件并核验来源)
  3. 用 dsh plugins list 确认已安装,必要时重启 Harness 生效

插件以当前 dsh 进程的权限运行,安装时可能执行代码。请先通读仓库源码与许可证,确认无破坏性命令与越权访问;本站只做索引,不对第三方插件安全性作担保。

代码仓库github.com/jonah-wu23/dsh-gungnir/tree/main/packages/dsh-plugin
许可证Apache-2.0
主要语言main
下载量1
GitHub 星标5
最近推送2026-09-03
收录日期2026-09-19
分类会话与消息

事实信息来自公开插件目录快照(2026-10-03),介绍文案由本站再加工。

以下为插件仓库 README 全文(原始内容,由公开目录抓取整理)。

Gungnir (冈格尼尔)

  Lock the goal. Adapt the loop. Prove the hit.

  言出必行:DeepSeek Harness 的证据导引型控制面插件

  [图片: npm package]

  [图片: Version 0.1.1]

  [图片: Platform]

  [图片: Apache License 2.0]

  [图片: Control Plane]

  30 秒了解 ·
  核心特性 ·
  架构设计 ·
  实验评测 ·
  快速上手 ·
  设计哲学 ·
  许可协议

## 30 秒了解

**首个面向 DeepSeek Harness、根据运行时证据在单次任务执行过程中动态切换 Agent Loop Strategy 的自适应 Loop 插件。基于环境证据链裁决任务完成度,在保证正常执行流畅的同时,精准拦截虚假完成与逻辑缺陷。**

Gungnir 为大语言模型智能体提供面向任务结果的控制面能力:

- **Lock the goal(目标锁定)**:建立版本化目标契约,维护明确的预期交付物和检验标准。
- **Adapt the loop(回路适配)**:作为 DSH 官方扩展,提供对智能体执行回路的平滑替换与策略调度。
- **Prove the hit(证据裁决)**:将模型输出视为待检验的主张,通过测试退出码与文件状态等环境证据裁决成败。
- **静默守护与最小介入**:正常执行路径下保持静默,只有在观测到确定性证据冲突时才注入面向任务的明确反馈。

## 核心特性

| 维度 | 原生智能体执行 | Gungnir 控制面 |
| --- | --- | --- |
| 完成判定 | 依赖模型自我宣称 | 依据环境证据与退出码客观裁决 |
| 假完成拦截 | 容易放行未完成的任务 | 运行时拦截虚假完成并要求修正 |
| 正常任务开销 | 基础开销 | 保持静默,Token 额外开销仅 +7.8% |
| 控制面额外交互 | 无 | 正常路径零额外模型往返 |

## 架构设计

Gungnir 采用分层解耦的插件化架构,全面适配 DeepSeek Harness 生态:

```text
┌─────────────────────────────────────────────┐
│ Gungnir Goal Contract                       │  目标锁定:定义任务交付物与验证规则
├─────────────────────────────────────────────┤
│ Gungnir Adaptive Loop Runtime               │  回路适配:调度执行回路与策略
├─────────────────────────────────────────────┤
│ Gungnir Evidence / Verifier / Reconciler    │  证据裁决:收集环境事实,静默验证并按需介入
├─────────────────────────────────────────────┤
│ DSH Agent Contract / Session Log / Services │  基础平台:提供会话与工具交互能力
└─────────────────────────────────────────────┘
```

### 控制流程

1. **环境监听**:在智能体调用工具的过程中,被动收集命令退出码与生成文件状态。
2. **契约校验**:当智能体发出完成任务的声明时,系统基于已捕获的环境证据执行确定性验证。
3. **精准反馈**:若验证通过,系统保持静默放行;若存在未满足的检验条件,系统注入简明的客观事实反馈,引导模型完成修复。

## 实验评测

Gungnir 建立了标准化的评测基准,并在 54 组真实环境运行中完成了多模型对比实验。

### 实验设计与对照设置

评测设置了三个对比对照组:

- **原生执行 (E0)**:使用 DSH 默认执行回路,无控制面接入。
- **被动监听 (E3)**:仅收集工具事件,不执行探针升级。
- **Gungnir 控制面 (E2)**:包含完整的事件收集与运行时探针验证。

评测用例涵盖三类典型场景:

- **虚假完成场景 (T3)**:模型在未满足验证条件时提前声明完成。
- **复杂语义缺陷场景 (T1/T2)**:涉及状态重入与消息投递等深层逻辑问题。
- **标准开发任务场景 (H1)**:覆盖常规功能实现与测试编写。

### 场景拦截与修复评测

| 评测场景 | 具体用例 | 原生执行 (E0) | 被动监听 (E3) | Gungnir 控制面 (E2) |
| --- | --- | --- | --- | --- |
| 虚假完成拦截 | CLI 任务重试场景 | 0% (0/2) | 50% (1/2) | **100% (2/2)** |
| 语义缺陷修复 | 状态重入场景 (Ledgerd) | 0% (0/2) | 50% (1/2) | **100% (2/2)** |
| 验证错配修复 | 消息中继场景 (RelayPump) | 50% (1/2) | 50% (1/2) | **100% (2/2)** |
| 标准开发任务 | 常规开发基准 (H1) | 100% (6/6) | 100% (6/6) | **100% (6/6)** |

### 多模型评测表现

| 模型类型 | 虚假完成拦截率 | 语义缺陷修复率 | 标准任务通行率 |
| --- | --- | --- | --- |
| DeepSeek 系列 | 100% | 100% | 100% |
| GPT 系列 | 100% | 100% | 100% |
| GLM 系列 | 100% | 100% | 100% |

### 控制面性能开销

| 评测指标 | 原生执行 | Gungnir 控制面 | 控制面开销增量 |
| --- | --- | --- | --- |
| **中位 Token 消耗** | 24,151 | 26,025 | **+7.8%** |
| **中位模型交互轮次** | 12.0 轮 | 12.0 轮 | **0 轮** |
| **任务执行超时率** | 3.7% | 0.0% | **-3.7%** |

## 快速上手

**兼容性**:插件基于 dsh v0.1.2-alpha.1 开发,不兼容 dsh v0.1.1-rc2。

### 安装

在 DeepSeek Harness 工作区中执行安装命令:

```powershell
pnpm add dsh-gungnir
```

### 配置插件

在 DeepSeek Harness 配置文件中注册 Gungnir 插件:

```yaml
plugins:
  - name: dsh-gungnir
    config:
      passive: true
      escalation: true
```

启动 DSH 后,Gungnir 会自动在会话生命周期中监听执行事件,并在任务收尾阶段执行事实验证。

## 仓库结构

| 目录路径 | 主要功能 |
| --- | --- |
| `packages/core/` | 零依赖的领域纯函数库,包含目标契约与证据验证算法。 |
| `packages/dsh-plugin/` | DSH 插件适配层,实现事件监听与最小必要反馈注入。 |
| `packages/agent-loop/` | 自适应回路运行时驱动,提供执行回路替换能力。 |
| `tools/experiments/` | 真实多模型实验基准套件与评估分析脚本。 |
| `tools/destruction/` | 破坏性集成测试与鲁棒性验证用例。 |
| `docs/` | 架构决策记录与阶段测试报告。 |

## 参与项目

欢迎提交 Issue 与 Pull Request。提交修改前请在本地运行测试:

```powershell
pnpm -r typecheck
pnpm -r test
```

## 许可协议

本项目采用 [Apache License 2.0](LICENSE) 开源许可协议。版权所有 © 2026 Zonghe Wu。

数据来源:公开的 DeepSeek Harness 插件目录与各插件 GitHub 仓库。本站为独立第三方目录,与 DeepSeek、幻方(High-Flyer)及插件作者均无隶属或背书关系。

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。