OpenViking
volcengine
Self-evolving Context Database for AI Agents. Unify Agent Memory, Knowledge RAG and Skills.
PROJECT TOPICS
INSTALL REFERENCE
dsh plugin --profile web add github:nyantused-cpun/gewu-tools
该命令指向仓库当前默认分支;尚无绑定当前 commit 的完整验证结果。
PROJECT README
格物审视面:让 DSH 中无视觉能力的模型,通过视觉子代理完成需要「亲眼检查」的任务。
格物:《大学》「格物致知,考察事物而后知」——先把东西看仔细,再下结论。 English: README.en.md
npm i gewu-tools
pwsh node_modules\gewu-tools\scripts\install-gewu-plugins.ps1 -Install # 挂载进 DSH(幂等)
# 重启 DSH 会话后 gewu_prep / gewu_locate 即出现在工具目录;-Verify 三绿即安装成功
DSH 的会话主脑通常是纯文本模型——它读不了渲染出来的页面,自然回答不了「这页方案好不好看、挤不挤、图连对没有」。视觉子代理(如 subagent_vision,mimo-v2.5 等)看得见,但有两个短板:
格物把 2026-08-16 在 24 页售前方案上实测收敛的三步流水线做成两个工具:
① gewu_prep 截图 + 简报:HTML 逐页渲染 PNG,并生成一份完整的视觉子代理简报契约
(纪律声明 / 伪影声明 / 页码归属规则 / 输出要求)
② 视觉子代理 派发:把 briefing 全文作为 prompt 调 DSH 原生视觉子代理(subagent_vision 等)
③ gewu_locate 真值核验:把审阅发现中的文字/数字定位回 HTML 源码(页码 + 行号),
count=0 即 OCR 误读,不采信
实测收益:误报率显著下降(简报提供上下文)、关键数字零差错上会(源码核验)、整稿叙事线/密度/跨页一致性可审(子代理多图能力)。
本插件在视觉子代理 mimo-v2.5(稳) 与 qwen3.7-plus(洞察强、误报略多) 上实测验证。实测结论:模型档位不决定审阅结果的可信度——
档位差异只体现在审阅风格(高挡洞察更锐、稳挡结论更保守),不体现在结果对错上。无论接入何种档位的视觉模型,本流水线产出均可信、可审计——这也是格物把「核验」固化为流水线第三步的原因。
前置:Windows + Chrome/Edge + Node 24+(仅脚本验证用)。
方式一:npm(推荐,一行安装 + 一行挂载)
npm i gewu-tools
pwsh node_modules\gewu-tools\scripts\install-gewu-plugins.ps1 -Install
方式二:社区通道(若已接入 awesome-dsh-plugins 生态)
pwsh <workspace>\.dsh\setup\install-community-plugins.ps1 -Install
方式三:独立脚本(随项目分发)
pwsh gewu\scripts\install-gewu-plugins.ps1 -Install # 幂等
pwsh gewu\scripts\install-gewu-plugins.ps1 -Verify # 只验证
pwsh gewu\scripts\install-gewu-plugins.ps1 -Uninstall # 卸载
安装脚本做的事:在 DSH 的 agent preset(默认 pre-sales,可用环境变量 GEWU_PRESET 覆盖)里追加 gewu-tools 挂载行,指向 <workspace>\.dsh\gewu-tools(安装位,项目目录的 Junction)。
安装后必须重启 DSH 会话(host 插件无热更新)。验证:install-gewu-plugins.ps1 -Verify 应三绿(preset 挂载行 / junction 链 / import 加载)。
1. gewu_prep(html_path="output\<客户>\<客户>_方案_vN.html",
client="<客户>",
background="<项目定位/关键决策/业务标记语义,如 ⭐=核心能力>")
→ 返回 { pages: [...], briefing: "..." }
2. 把 briefing 全文作为 prompt 调视觉子代理(subagent_vision):
→ 逐页问题清单 + 整体结论
3. 对每条关键发现调 gewu_locate(html_path=..., needle=<发现中的文字/数字>)
→ 页码 + 行号;count=0 说明视觉模型 OCR 误读,该发现不采信
gewu_prep 参数
| 参数 | 说明 |
|---|---|
html_path |
方案 HTML 路径(必填) |
client / background |
写入简报的客户名与背景(强烈建议提供,上下文决定审阅质量下限) |
focus |
关注问题清单(默认:版式/规范一致性/密度/图表可读性/核心论断/跨页一致性) |
out_dir |
截图输出目录(默认 <工作区>/_tmp_vision_test/<文件名>_shots) |
width / height |
视口尺寸(默认 1280x900) |
nav_offset |
sticky 顶导航偏移(默认 64,无 sticky 导航设 0) |
gewu_locate 参数:html_path、needle(待核验文字/数字)、max_matches(默认 8)。
<section> 锚点(优先 v2-page 类),逐页用 headless Chrome 视口截图;sticky 导航经 iframe 上移推出画面;无锚点自动降级整页长截图。宿主进程直起 Chrome——不受 DSH 受限沙箱对子进程命名管道的限制。read_image 读图(防卡死);needle 在源码中逐次定位,返回所在 section 页码 + 行号 + 脱标签摘录。# 冒烟(不经 DSH,直接跑核心逻辑):需 Chrome + node
node gewu\index.js <任意带锚点的 HTML 路径> [输出目录]
# 预期:mode=anchors ok=true pages=N failed=-
gewu/
├── index.js # 插件本体(cordis + defineTool,含 standalone 冒烟入口)
├── package.json # @gewu/dsh-tools
├── README.md / README.en.md
├── CHANGELOG.md
├── LICENSE # MIT
├── docs/TESTING.md # 实测方法与结论摘要
└── scripts/install-gewu-plugins.ps1 # 安装脚本(Install/Verify/Uninstall/DryRun)
@deepseek-ai/dsh-tools(peer,经工作区 AiBridge 解析)CLASSIFICATION EVIDENCE
系统优先读取 GitHub Topics,再与站内分类词典和词根规则比对。当前命中: automation、review、subagent、vision。