deepseek-harness
deepseek-ai
DeepSeek Harness: Everything is a Plugin.
PROJECT TOPICS
PROJECT README
DeepSeek Harness 本地视觉插件:通过 LM Studio 的 OpenAI 兼容端点调用本地视觉模型(默认 qwen3-vl-8b-instruct-abliterated-v2.0)描述图片/截图。
fetch 直连,不需要 Python/Pillow/httpxpythonPath 后自动委托 scripts/vision-describe.py(带缩放/压缩,适合超大截图)1234 可访问sk-lm-... 的 API keyLMSTUDIO_API_KEY=sk-lm-xxxx node scripts/vision-probe.mjs "C:\path\to\image.png"
# 输出 HTTP 200 即通
npm install dsh-plugin-local-vision
在 agent preset 的 agent.cordis.yml 里加一行(该行只向宿主 tools 注册表注册工具、不发布服务,不需要 isolate realm,与官方 tool-web 行同理):
- id: tool-local-vision
name: dsh-plugin-local-vision
config:
baseUrl: http://127.0.0.1:1234
model: qwen3-vl-8b
# timeoutMs: 600000
# maxBytes: 10485760
# pythonPath: 留空则用 Node 后端;填解释器绝对路径则用 Python 后端
# apiKey: 建议不写这里,走环境变量 LMSTUDIO_API_KEY
插件配置优先级:config 字段 > 环境变量 > 默认值。
| config 字段 | 环境变量 | 默认值 | 说明 |
|---|---|---|---|
baseUrl |
LMSTUDIO_BASE_URL |
http://127.0.0.1:1234 |
LM Studio 地址,不带 /v1 |
apiKey |
LMSTUDIO_API_KEY |
空 | 开发者模式 key;别写进 cordis.yml |
model |
LMSTUDIO_VISION_MODEL |
qwen3-vl-8b-instruct-abliterated-v2.0 |
精确模型 ID |
timeoutMs |
— | 600000 |
请求超时(本地 VL 推理慢) |
maxBytes |
— | 10485760 |
Node 后端图片大小上限(10MB) |
pythonPath |
LMSTUDIO_VISION_PYTHON |
空 | 非空则用 Python 后端(带缩放压缩) |
vision_describe模型可直接调用,参数:
| 参数 | 必填 | 说明 |
|---|---|---|
imagePath |
✅ | 图片绝对路径(jpg/png/webp/bmp) |
prompt |
— | 自定义描述要求,缺省为详细中文描述 |
maxTokens |
— | 生成上限,默认 1200 |
返回模型生成的文字描述;出错时返回带原因的中文错误(HTTP 状态码 → 排查提示)。
旧方案是 ~/.dsh/skills/local-vision/SKILL.md(让 agent 自己拼命令跑 python)。本插件的工具版更稳:
见 docs/local-model-pitfalls.md——完整记录了我们接入本地模型时踩过的所有坑(端口/API key/模型 ID/代理拦截/图片过大/引号地狱/Anthropic 与 OpenAI 工具协议差异等),附"症状→原因→解法"速查表。
MIT
CLASSIFICATION EVIDENCE
系统优先读取 GitHub Topics,再与站内分类词典和词根规则比对。当前命中: 无有效分类标签。