Replies: 1 comment
|
遇到了同样的问题,出了多模态的模型,官方的harness居然没有实时更新这部分的功能。。。 |
0 replies
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Uh oh!
There was an error while loading. Please reload this page.
设置页无法声明模型的输入模态(图片)
问题
在 dsh 的「设置 → 模型」里没有任何字段可以声明一个模型接受图片输入。这个字段在

settings.yaml里都存在(llm-deepseek叫inputModalities,llm-pi-ai叫input),但两种 provider UI界面都只能写id/name/contextWindow/maxTokens四个字段。后果
一个刚发布、还没进 dsh 内置目录的多模态模型,用户在 UI 里无论怎么点都是纯文本模型,所有图片能力(
read_image、MCP 图片结果、把图片paste到聊天框)都会被闸门拒掉,而 UI 上只提示"当前模型不支持图片,请切换支持图片的模型"。唯一出路是设置界面右上角「打开配置文件」手动修改settings.yaml。上游把「卡片只覆盖精选字段」当作已知的、有意的取舍写进了 README;本文记录的是这个取舍在「新模型 + 多模态」这个组合下产生的实际缺陷。
复现
0.1.0-rc.8,「设置 → 模型」新建一个自定义 provider(api: openai-completions,baseURL: https://api.deepseek.com)。deepseek-v4-flash-vision-exp。期望:模型是视觉模型,图片进上下文。
实际:被拒,返回一段「当前模型不支持图片,请切换支持图片的模型」的说明。UI 上没有任何地方能改变这一点。
All reactions