deepseek-harness
deepseek-ai
DeepSeek Harness: Everything is a Plugin.
PROJECT TOPICS
PROJECT README
Keeps AI teams from breaking — not just running.
本地多 Agent 流水线治理——任务分级、拆解、排期、质检、验收、容灾全部装进引擎,人只做裁决:说清要什么,验收做出什么。门禁拦下半成品,检查点原地续跑——让一批 Agent 不只跑得起来,更跑不坏。
One agent is a helper; a governed swarm of agents is department-scale output in one person — breakdown, scheduling, gates, acceptance and recovery live in the engine, and you only judge: say what you want, accept what it made.
English: README.en.md
一个 Agent 好管:跑偏了,你盯一眼就能拽回来。一批 Agent 一起干活是另一回事——谁先跑、谁等谁、谁写哪个文件、崩了从哪续,没人管,跑起来就是事故现场。
几个跑过长任务的人都撞见过的痛点:
| 痛点 | 你得到的后果 |
|---|---|
| 半成品当完成品交 | 下游在上游产物没齐时就被派活,错误一路传到返工才暴露 |
| 一崩全丢 | 跑了几小时没有中间存档,一次崩溃全部归零 |
| 并发互相踩 | 几个 Agent 同时写同一个仓库,互相覆盖,出冲突说不清谁改了什么 |
| 越界调用悄悄发生 | Agent 把私钥写进子任务参数、把命令参数开到离谱上限,没人拦 |
| 拦了却说不清为什么 | 调用被拒,只收到一句「用户拒绝了该工具」,Agent 和人都不知道是护栏拦的、拦的是哪条规则 |
工具本身没坏——缺的是流程上的闸口。本插件把闸口装进引擎:产物不齐,不放行;干一步,存一档;同一份活,只许一个人写;每一次越界,拦得明明白白。
双层治理,两道防线。 批级编排与调用级护栏叠加生效,互不绕过:
三层门禁,拒绝半成品。 每个批次按「计划 → 执行 → 验收」分层推进,层与层之间以产物契约为闸:
为什么是引擎级,而不是协议级。 互联协议能把 Agent 连起来互相调用,但连出来的是聊天室——能对话,组织不成流水线。门禁要拦在工具调用链上:产出不齐不许开工、一步没验收不进下一步,这类检查只能长在宿主执行循环内部,协议层没有落点。
| 痛点 | 机制 | 你得到 |
|---|---|---|
| 半成品当完成品交 | 门禁引擎强制:派发前查上游产物、结算前查落盘、完结前查验收,缺件直接拒 | 半成品到不了你手里 |
| 一崩全丢 | 存档点保全:每完成一个子步骤即保全一次,崩溃后可查可续 | 中断只是停在存档点,不是从头再来 |
| 并发互相踩 | 单写者锁 + 隔离工作区:同一份活同时只许一个写者,各改各的树 | 冲突保留现场、交人裁决,不静默覆盖 |
| 越界调用 | 调用级护栏 + 拒绝收据:逐调用裁决,命中即拒绝并落可验篡改的收据 | 越界到不了执行面,事后可复核 |
| 拦得不明不白 | 拒绝可见性:被拦时收到的不是泛化提示,而是护栏标注、命中规则与违规说明 | Agent 知道为什么被拦,可按说明修正参数重发合规调用 |
| 规则心里没底 | 出厂零拦截 + 逐条审阅清单:装上不改行为,规则可先审后用 | 拦的是什么、为什么拦,全部摊开可核对 |
工具调用级护栏默认出厂零拦截(规则表为空),装上即用、不改变既有行为;规则按需启用。
随包提供可选规则预设,一句启用一套护栏:
自 0.4.3 起的三项新能力:
配置入口:Web UI 设置区的治理配置页可调护栏开关、规则与窗口,保存即时生效、免重启。
前置:已安装 DeepSeek Harness(dsh),Node.js ≥ 22。
# 安装并装入 dsh(profile 可按需替换为实际使用的 profile)
dsh plugin add dsh-punky-swarm
dsh web restart
备选:
npm install -g dsh-punky-swarm后以dsh plugin --profile <profile> add dsh-punky-swarm装入;开发路线亦可link:指向本地包目录。
交互演示页与界面截图将后续补充。
随包维护中英双语主题文档(7 组、每组含中英两版,随 npm 包分发),仓库内目录:packages/dsh-punky-swarm/docs:
| 主题 | 文档(同目录附对应 .en.md 英文版) |
|---|---|
| 治理技术细节(门禁语义、状态机、装配与工具参考) | governance-technical.md |
| 治理配置页说明(Web UI 护栏开关与能力开关的保存生效口径) | webui-governance-config.md |
| 护栏挂钩机制(调用级护栏运行期语义、规则示例与收据验签) | guardrails-hook.md |
| 单机能力边界(本地单机治理能力声明) | single-machine-capabilities.md |
| 合规对齐(AIP 描述结构:工具属性 / 智能体描述 / 消息映射) | aip-compliance.md |
| 通讯扩展(ACPs:对外端点 / 注册 / 发现,默认关闭) | acps-communication.md |
| 治理边界(能力边界声明:哈希链与 canonical 边界、规则同步维护口径) | governance-boundaries.md |
当前版本 0.4.3;863 项测试全绿(实测于 Node 24,CI 覆盖 Node 22/24);peer 依赖 @deepseek-ai/dsh-tools(^0.1.0-rc.6 || ^0.1.1-rc.2)与 @deepseek-ai/cordis(^4.0.1);已收录 awesome-dsh-plugin。
诚实边界:面向单机进程内治理——不做分布式集群同步、无成本控制、无模型分层路由,零云依赖、默认零网络暴露;失败即终态,重做即新建批次,不自动续跑。
GNU AGPL v3(AGPL-3.0-only) 为唯一许可:遵守 AGPL-3.0 可自由使用、修改、分发(含商用);修改后经网络提供服务须公开修改内容。
CLASSIFICATION EVIDENCE
系统优先读取 GitHub Topics,再与站内分类词典和词根规则比对。当前命中: 无有效分类标签。