Skip to content

v2.0.0

Choose a tag to compare

@xiaoyuink xiaoyuink released this 16 Aug 15:45
· 23 commits to main since this release

dsh-image-vision v2.0.0

图片识别插件:DeepSeek Harness 纯文本 Agent 的「眼睛」。

核心特性

  • 对话框直接粘贴/上传图片:注册「+ 自动识图」twin 模型路由(声明图片输入,通过 DSH 发送准入),图片走 DSH 原生草稿流程——输入框缩略图预览、对话中显示图片、发送后模型自动识别
  • image_vision 工具:自动判断当前模型是否可识图;可识图则交给当前模型,否则调用插件配置的视觉模型(支持 OpenAI/Anthropic 兼容端点,多供应商管理)
  • 7 种专业识别预设:病理 / 细胞 / 解剖 / 统计图 / 组合大图 / 临床 / 通用
  • 模型输入层改写:image block 落盘为短标记,DeepSeek 只见文本,会话日志保留图片
  • realtime 模型大图自动降级:超过帧限制自动走 OpenAI 兼容接口

设置页

  • 多供应商管理:添加/编辑/删除、拖拽排序(卡片 + 模型行)、模型收纳折叠、余额查询、模型检测
  • 视觉模型选择器(输入框内快速切换)

安装

dsh plugin --profile web add <插件目录>

或直接下载本包后用 dev_install_package 热装配。

使用

  1. 聊天页右下角模型选择器选「DeepSeek + 自动识图」(或其它 + 自动识图组)
  2. 直接粘贴/拖拽/📎 上传图片
  3. 发送后对话区显示图片,模型自动调用 image_vision 识别