让纯文本模型也能粘贴图片发送:dsh-image-bridge 补丁 #733
baileyh8
started this conversation in
Show and tell
Replies: 2 comments
|
m |
0 replies
|
m |
0 replies
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Uh oh!
There was an error while loading. Please reload this page.
Uh oh!
There was an error while loading. Please reload this page.
让纯文本模型也能"粘贴图片发送":dsh-image-bridge 补丁
问题
DSH 要求"能发图 = 当前对话模型支持视觉"。当对话模型是纯文本的(如
deepseek-v4-flash)时,在输入框粘贴图片会报:方案
一个本地补丁,修改
dsh-host-apiproxy的admit():图片不再整体拒绝,而是落盘后改写成"本地路径文本",纯文本模型收到后自动调用可用的视觉工具,把图片交给视觉模型(如gpt-5.6-luna)处理。效果:图片走视觉模型,文本对话走原模型,粘贴即发。
与视觉插件配合
改写文本使用通用措辞,可搭配任一视觉工具插件(可共存):
view_imagevision_glance/vision_ground/vision_detect等 10 个技术要点(v2 更新)
realpath()穿透回无扩展名路径导致 "unsupported image format",硬链接则保持扩展名可见——实测dsh-vision-toolkit可直接读取。allowedDirs(仅 toolkit 需要):在其配置allowedDirs加入~/.dsh/attachments以便vision_*工具读取粘贴图片。使用方法
node apply-patch.mjs→ 重启 DSH支持
--dry-run(预检)、--rollback(回滚)、自动备份与语法检查。已验证(实测截图)
dsh-vision-toolkit共存:vision_glance对粘贴图片给出逐字文字、UI 元素清单、配色、布局层级的细粒度分析说明
admit()一处逻辑,不碰其他代码;升级 DSH 后需重新执行0.1.0-rc.6(@deepseek-ai/dsh-host-apiproxy同版本)补丁包下载(v2,硬链接版): https://gist.github.com/baileyh8/8a766bce1460342196a5d80332d8bb44
(含
apply-patch.mjs安装器、原始/补丁代码块、README)欢迎试用反馈;也希望官方能考虑把"上传图片自动桥接视觉模型"做成内置能力 🙂
All reactions