Releases: x-Xin23/dsh-vision-bridge
Releases · x-Xin23/dsh-vision-bridge
Release list
v1.2.0 — 自定义视觉后端 + 多路由自动发现
v1.2.0:解决适配度 A、B 两个核心问题
A. 自定义视觉后端(可换视觉模型)
- .credentials.yaml\ 可选 \VB_BASE_URL\ / \VB_MODEL\ / \VB_API_KEY\ / \VB_PROTOCOL\ / \VB_NEEDS_PROXY\
- 任意 OpenAI 兼容(或 Gemini 协议)视觉模型直接接入:qwen-vl、OpenRouter、自建 Ollama…
- 尝试链变为:自定义 → MiMo → GLM → Groq → Gemini(自定义失败自动回退内置)
- 缓存键含自定义端点 hash:换端点/模型自动失效
B. 多路由自动发现(换主模型视觉仍可用)
- deepseek-official 保持替换式无感增强(模型选择器不用动)
- 家族内其他文本路由(glm 等)自动注册 (vision)\ 变体——图片转描述后委托原路由
- \llm/adapters-updated\ 重扫覆盖延迟挂载的路由;原生视觉模型自动跳过
安装:node install.js 后重启 DSH。
v1.0.0 — Vision Bridge 正式发布
给 DeepSeek Harness 纯文本模型(deepseek-v4-flash)加上视觉能力(Windows)。
- 原生贴图:粘贴/拖拽图片进聊天框,缩略图正常显示
- 预注式视觉:图片后台自动生成描述,模型首轮即"看见"
- see_image 工具:按需精查(OCR / 布局 / 定向问题 / region 真实裁剪)
- 四后端自动容灾:MiMo → GLM → Groq → Gemini,限流自动重试
- 结果缓存 + 升级自愈 + 密钥保护 + 注入防护
- 零依赖纯 JS,一键安装(node install.js)
安装与配置见 README。