v2.0.0
dsh-image-vision v2.0.0
图片识别插件:DeepSeek Harness 纯文本 Agent 的「眼睛」。
核心特性
- 对话框直接粘贴/上传图片:注册「+ 自动识图」twin 模型路由(声明图片输入,通过 DSH 发送准入),图片走 DSH 原生草稿流程——输入框缩略图预览、对话中显示图片、发送后模型自动识别
- image_vision 工具:自动判断当前模型是否可识图;可识图则交给当前模型,否则调用插件配置的视觉模型(支持 OpenAI/Anthropic 兼容端点,多供应商管理)
- 7 种专业识别预设:病理 / 细胞 / 解剖 / 统计图 / 组合大图 / 临床 / 通用
- 模型输入层改写:image block 落盘为短标记,DeepSeek 只见文本,会话日志保留图片
- realtime 模型大图自动降级:超过帧限制自动走 OpenAI 兼容接口
设置页
- 多供应商管理:添加/编辑/删除、拖拽排序(卡片 + 模型行)、模型收纳折叠、余额查询、模型检测
- 视觉模型选择器(输入框内快速切换)
安装
dsh plugin --profile web add <插件目录>或直接下载本包后用 dev_install_package 热装配。
使用
- 聊天页右下角模型选择器选「DeepSeek + 自动识图」(或其它 + 自动识图组)
- 直接粘贴/拖拽/📎 上传图片
- 发送后对话区显示图片,模型自动调用 image_vision 识别