不支持多模态,我装了mcp识图,结果还限制发图,这不合理吧 #1464
Replies: 5 comments
|
你截图里卡住的是 Web 图片准入层,不是 MCP 识图本身。这个场景现在可以不改 Harness 源码直接跑通:安装 pi2dsh 后,每条纯文本模型路由都会自动获得独立的 DeepSeek + Vision Bridge 伴生路由。选它以后可以正常粘贴图片,但真正发往 DeepSeek 的请求仍然只有文本。 安装引擎一次,然后选择一种识图方式: dsh plugin --profile web add pi2dsh@0.11.0
# 自动识图并注入上下文
dsh plugin --profile web add @kassing/pi-vision
# 或:让 agent 按需调用 describe_image
dsh plugin --profile web add pi-vision-tool使用自动识图路线时,先配置一个公开的 OpenAI-compatible 视觉端点(以下用 OpenRouter 举例): export VISION_BRIDGE_BASE_URL=https://openrouter.ai/api/v1
export VISION_BRIDGE_MODEL=qwen/qwen2.5-vl-72b-instruct
export VISION_BRIDGE_API_KEY=your-openrouter-key如果你已有吃文件路径的 MCP 识图工具,也可以继续用:伴生路由会把附件物化成临时文件并把路径交给 agent。使用 重启 我们已经用 Web 真贴图做过独立蓝/绿探针:视觉分析完成后,纯文本 DeepSeek 一轮一步正确回答;发送到 DeepSeek 适配器前,图片块已经转换成文本,不会把像素误发给纯文本 API。 完整配置:https://github.com/weijiafu14/pi2dsh/tree/main/examples/vision-bridge |
|
卡住的是 Web 准入,不是 MCP 识图。装了看图工具,输入框照样会拒「当前模型不支持图片」。 dsh-plugin-multimodal 只补这一刀:让粘贴不被拒。不改模型卡片,也不把官方 DeepSeek 伪装成已经能看图。不是 |
|
可以试试https://github.com/silencieuxzero/Better_Deepseek_Harkness |

Uh oh!
There was an error while loading. Please reload this page.
All reactions