返回目录
文件与数据 插件

dsh-gemini-bridge

xuxun-oss/dsh-gemini-bridge

DeepSeek Harness all-in-one: no model switching — regular DeepSeek auto-routes to vision & image gen. Multi-backend: Gemini + any OpenAI-compatible (GPT-4o, Qwen-VL, GLM-4V, gpt-image, DALL-E, Flux, OpenRouter). gemini_vision/gemini_generate_image/gemini_optimize_image with vision self-check. Better than modlens.

Stars
1
Forks
0
Issues
0
更新
今天

PROJECT TOPICS

项目标签

INSTALL REFERENCE

安装参考

未验证
dsh plugin --profile web add github:xuxun-oss/dsh-gemini-bridge

该命令指向仓库当前默认分支;尚无绑定当前 commit 的完整验证结果。

PROJECT README

README

dsh-gemini-bridge

DeepSeek Harness 插件:为 DeepSeek 模型桥接 Google Gemini 的多模态识别与图像生成。

当 DeepSeek 模型需要看图、生图、改图时,自动调用 Gemini:

工具 作用
gemini_vision 识别/读取/描述/分析图片(OCR、物体、图表),支持本地路径或 http(s) URL
gemini_generate_image 文本生图,生成后必定用 Gemini 视觉模型自检反馈(不达标时按优化 prompt 重绘)
gemini_optimize_image 改图/优化已有图片:先分析原图 → 生成改进版 → 自检迭代

核心卖点:全能一体,无需切换模型

  • 一个 DeepSeek 会话搞定一切:直接用常规 DeepSeek 模型(不必换成视觉模型),需要看图、生图、改图时,插件自动路由到对应的 Gemini 多模态/生图模型——全程零手动切换模型
  • 比 modlens 等更完整:modlens 只是「给纯文本模型装一只读图的眼睛」;本插件是视觉识别 + 图像生成 + 图像编辑 + 自检反馈的完整闭环,并且直接复用你自己的 Gemini API Key,不依赖任何第三方桥接、无额外订阅。
  • 自动调用,无需操心:识别 → gemini_vision;生图 → gemini_generate_image;改图 → gemini_optimize_image。DeepSeek 模型通过系统提示与工具描述自动选对工具,对用户完全透明。
  • 自检闭环,质量把关:生成/优化后,自动用 Gemini 视觉模型检查成品图,不达标按优化提示自动重绘,并把检查结论(画面描述 / 达标与否 / 问题清单)直接反馈出来。

安装

dsh plugin --profile web add /path/to/dsh-gemini-bridge
# 然后重启 dsh web(或按 dsh 的插件热载提示操作)

安装后打开 设置 → Gemini 视觉桥,填入 Google AI Studio 的 API Key,点「测试连接」即可。

多后端支持(不止 Gemini)

通过 provider 抽象层适配不同后端,同一个 DeepSeek 会话、无需切换模型

后端 视觉识别/自检 图像生成 兼容平台示例
gemini(默认) gemini-3.7-flashgemini-3.6-flashgemini-2.5-pro gemini-3.1-flash-lite-image(Nano Banana 2 Lite)、gemini-3.1-flash-image(Nano Banana 2)、gemini-3-pro-image(Nano Banana Pro)、imagen-4.0-generate-001 Google AI Studio(免费 Key)
openai(OpenAI 兼容) gpt-4ogpt-4o-minigpt-4.1qwen-vl-maxqwen2.5-vl-72bglm-4v-plusglm-4v-flashmoonshot-v1-visionminimax-vlinternvldeepseek-vl2* gpt-image-1dall-e-3flux-1.1-proflux-schnellstable-diffusionsd3.5-largeideogramrecrafthunyuan-imageseedream* OpenAI / OpenRouter / 智谱 GLM / 阿里云百炼 Qwen / Moonshot Kimi / MiniMax / 硅基流动 SiliconFlow / 各类中转与自建网关
  • 经 OpenAI 兼容端点/聚合平台提供。

设置页「后端 Provider」下拉切换;端点、模型列表、鉴权头(x-goog-api-key / Bearer)自动适配。换后端只需填对应的 API Key 与端点,工具调用方式完全不变——任何提供 OpenAI 兼容 /chat/completions(视觉)与 /images/generations/images/edits(生图/编辑)的服务均可接入

模型自动选择(auto)

  • 识别/自检:gemini-3.7-flashgemini-3.6-flashgemini-3.1-flash-litegemini-2.5-flash
  • 生图:gemini-3.1-flash-lite-image(Nano Banana 2 Lite)→ gemini-3.1-flash-image(Nano Banana 2)→ gemini-3-pro-image(Nano Banana Pro)→ gemini-2.5-flash-imageimagen-4.0-generate-001

设置页可下拉选择任意官方模型,或输入自定义模型名;模型不可用时自动沿链降级。

说明

  • 配置(含 API Key)保存在 ~/.dsh/gemini-bridge.json
  • 生成后自动用 Gemini 视觉模型检查成品图并给出反馈(闭环,不依赖 modlens)。
  • 图片保存在 ~/.dsh/gemini-bridge-images/,工具结果卡片内联显示图片并提供可点击链接 /api/gemini-bridge/images/<file>
  • 仅走 原生 Gemini REST APIgenerateContent / predict),端点勿加 /openai

目录

lib/index.js        宿主半:三个工具 + systemPrompt 引导 + 配置/模型 HTTP 路由
lib/client.js       浏览器半:设置页(settings.section)
cordis.patch.yml    组合 patch(insert 行)
package.json        包元数据(dsh.bundle / dsh.client)

CLASSIFICATION EVIDENCE

分类依据

项目类型插件
功能分类文件与数据
规则置信度

系统优先读取 GitHub Topics,再与站内分类词典和词根规则比对。当前命中: image-editing、image-generation、image-recognition、multimodal、ocr、text-to-image、vision、vision-language-model。