Skip to content

Releases: YOGEMOW/DeepSeek_Prism

v0.5.0

Choose a tag to compare

@YOGEMOW YOGEMOW released this 14 Aug 09:56

v0.5.0 — 设置界面集成(视觉 API 密钥掩码输入 + 模型选择)

新增

  • harness 设置页「插件」页新增 DeepSeek Prism 卡片deepseek-prism-dsh 设置命名空间):
    • 视觉 API 密钥type=password 只写控件——保存后仅显示「已配置」徽标,中间字符不展示、明文不随任何响应返回;密钥经 ctx.credentials 写入凭据库(.credentials.yaml)。
    • 视觉 Provider / 模型 / 区域 / 密钥环境变量名(凭据引用):写入设置段;保存后宿主自动把密钥与 VISION_PROVIDER / VISION_MODEL / VISION_REGION 注入 process.env,vision.mjs 子进程继承,无需任何 .env 文件
    • 客户端为手写 __ModuleLoader__ bundle(零构建,仅 require('react'));宿主侧设置/凭据包为可选动态导入,缺失时降级跳过。
  • harness 侧一行 allowlist 补丁(本地):WEB_SETTINGS_NAMESPACES 加入 deepseek-prism-dsh

验证

  • 插件测试 18 项(新增 env 注入/回退/不覆盖 4 项),全量 61 项通过。
  • 安装:pnpm dsh plugin --profile web add <本包 tarball>,重启 GUI 后:设置 → 插件 → DeepSeek Prism 卡片;上传图片自动降级并调用视觉 API(密钥来自设置)。

注:harness WEB_SETTINGS_NAMESPACES 的 allowlist 补丁需保留在本地 checkout(上游将 allowlist 声明迁移至 settings.register() 属于其 deferred work)。

v0.4.1

Choose a tag to compare

@YOGEMOW YOGEMOW released this 14 Aug 09:16

v0.4.1 — 修复插件降级失效 + 消除重复安装

Fixed

  • 插件图片降级从未生效的根因isCurrentModelTextOnly 以裸 { sessionId } 调用 sessions.models,真实 api-proxy 从 request.payload 解构导致抛错,被 catch 吞掉后回退上游,图片上传仍被拒绝(MODEL_DOES_NOT_SUPPORT_IMAGES)。已改为完整请求形状 { payload: { sessionId } } 并新增形状回归测试。实测(API 探测):修复后纯文本模型图片上传降级成功。

Changed

  • 消除 harness 上的重复安装:插件不再把技能素材物化到 $DSH_HOME/skills/deepseek-prism,改为启动时通过 ctx.skills.register 运行时注册技能(资源基准目录指向包内素材)——harness 上只有插件这一处技能来源;已清理 ~/.dsh/skills/deepseek-prism 旧副本与仓库内生成的素材副本(发布时由 prepack 按需生成)。

验证

  • 插件测试 14 项全部通过(新增 models RPC 形状回归、技能注册、无物化验证);全量 node --test 57 项通过。
  • 安装:pnpm dsh plugin --profile web add <本包 tarball>,重启 GUI 后技能出现在目录中(来源:插件运行时注册)。

v0.4.0

Choose a tag to compare

@YOGEMOW YOGEMOW released this 14 Aug 08:42

v0.4.0 — DSH 插件化 + Codex/DSH 双包发布

新增

  • DSH 插件 @yogemow/deepseek-prism-dshpackages/plugin-dsh,零依赖 Cordis 插件,dsh.bundle 声明自动激活):
    • 技能物化:插件启动时把包内 deepseek-prism 素材写入 $DSH_HOME/skills/deepseek-prism(版本戳防重复、保留用户 .env),skill-filesystem 自动发现;
    • 图片降级:包装 apiProxy.sessions.prompt,纯文本模型收到图片时降级为文本指针(描述 + 附件对象路径),视觉模型不受影响——不再需要修改/分叉 DSH 宿主源码
  • Codex 包 @yogemow/deepseek-prism-skillpackages/skill):含 deepseek-prism-skill 一键安装 CLI。
  • 发布编排 scripts/release.mjs:测试 → 同步版本 → npm pack(prepack 自动物化素材)→ 可选发布 GitHub Packages(需 classic PAT)。本版本双包以 GitHub Release 资产分发:
资产 用途
deepseek-prism-skill-0.4.0.tgz Codex:npx <资产URL>Copy-Item~/.codex/skills/
deepseek-prism-dsh-0.4.0.tgz DSH:pnpm dsh plugin --profile web add <资产URL>

验证

  • node --test 53 项全部通过(vision 43 + 插件 10:降级透传矩阵、校验回退、对象路径、素材物化与版本戳)。
  • skill-creator quick_validate.py 通过。
  • 双包 npm pack 通过(含技能素材物化)。

v0.3.1

Choose a tag to compare

@YOGEMOW YOGEMOW released this 14 Aug 03:43

v0.3.1 — DSH 纯文本模型识图链路修复

修复 DeepSeek Harness(DSH)下纯文本模型无法通过 deepseek-prism 识图的问题。

根因

DSH 宿主在图片上传时直接拒绝纯文本模型(MODEL_DOES_NOT_SUPPORT_IMAGES,提示“当前模型不支持图片”),图片从未进入会话,prism 技能无法触发。

修复

  • DSH 宿主侧(deepseek-harness):纯文本模型收到图片时不再拒绝,改为注入 [图片附件 <名称>:<宽>x<高> px…已保存到 <路径>] 文本块(路径为附件内容寻址对象),模型按 skill 指引对该文件运行视觉脚本即可。
  • 本技能readImageSource 在扩展名未知时按魔数嗅探 MIME(PNG/JPEG/GIF/BMP/WebP/AVIF/TIFF/SVG),直接支持 DSH 附件对象路径等无扩展名来源。
  • SKILL.md 补充 DSH 图片附件注入说明。

验证

  • node --test 43 项全部通过(新增 sniffImageMime 8 类魔数用例)。
  • skill-creator quick_validate.py 通过。
  • DSH 宿主 api-proxy 375 项测试通过(含新增的纯文本模型图片降级用例)。

v0.3.0

Choose a tag to compare

@YOGEMOW YOGEMOW released this 14 Aug 03:22

v0.3.0 — DeepSeek Harness(DSH)双平台适配

本版本将 Skill 升级为 Codex / DeepSeek Harness(DSH)双平台通用,DSH 用户安装后开箱即用。

新增

  • DSH sharp 自动发现scripts/vision.mjs 在 Codex 运行时之外新增 DSH Web 运行时候选(~/.dsh/profiles/node_modules/sharp,含 DSH_HOME 解析)与 DSH 用户根候选(~/.dsh/node_modules/sharp),DSH 环境大图等比缩放开箱即用。
  • SKILL.md 双平台化:触发协议补充 DSH read_image 工具;命令章节给出 Codex / DSH 两套默认安装路径;sharp 查找顺序说明双平台。
  • 文档同步:README 新增 DSH 安装方式(C:\Users\用户名\.dsh\skills\deepseek-prism);doctor 与缩放警告文案、references/providers.md、PROJECT / PLAN / STATUS / DECISIONS / RISKS 全部同步;DECISIONS 新增 D15。
  • agents/openai.yaml 仍仅 Codex 消费(DSH 忽略)。

验证

  • node --test 42 项全部通过(DSH sharp 环境实测:大图缩放、GIF 动画帧保留、AVIF/TIFF/SVG 回退、VISION_SHARP_PATH 重试)。
  • skill-creator quick_validate.py 通过。
  • SiliconFlow 真实冒烟通过:DSH 安装副本 see --json 正确提取报错截图(含文件:行号)。

安装

# Codex
Copy-Item -Recurse deepseek-prism C:\Users\用户名\.codex\skills\deepseek-prism
# DeepSeek Harness(DSH)
Copy-Item -Recurse deepseek-prism C:\Users\用户名\.dsh\skills\deepseek-prism

密钥配置见 README(环境变量或技能根目录 .env)。

v0.2.0

Choose a tag to compare

@YOGEMOW YOGEMOW released this 05 Aug 06:42

v0.2.0 (2026-08-05)

Added

  • 输出策略自动分级:小图/简单任务保持 VEP/1(<=520 字符);长内容任务自动走 --detail 完整通道(默认 4096 token)。
  • 超长内容自动续写并合并:检测截断后以锚点续写,模型回复 [完成]/“没有更多内容”即停止;VISION_MAX_CONTINUATIONS 可调;合并时折叠重复围栏。
  • 新增 --raw(cleanRaw 原文)、--full({raw, parsed} JSON 信封)、--compact(强制 VEP/1)。
  • 输入预处理:内置 sharp(libvips)等比缩放,不依赖宿主安装;AVIF/TIFF/SVG 通过 sharp metadata 回退识别尺寸并统一转 PNG;动画 GIF 保留全部帧;VISION_MAX_INPUT_PIXELS 防止超大输入。
  • Provider outputLimit 感知(OpenRouter/Groq 8192);doctor 输出 Node 版本与缩放后端状态。

Changed

  • 字段预算随 --max-chars 缩放(答案 45%/文本 35%/摘要 25%),截断显式标注 [截断]
  • 缓存:key 按输出通道隔离、旧格式/过期/损坏条目自动清理、临时文件+rename 原子写、--no-cache 不再写回。

Fixed

  • 11 项审计缺陷:--json 与自动 detail 契约、VISION_MAX_CONTINUATIONS=0--full 1000 字符截断、AVIF/TIFF 视觉 API 兼容、续写代码围栏保留与去重、哨兵空输出、sharp 失败重试、极小预算越界、参数优先级文档、缓存原子写。

Test

  • node --test 42/42 通过;skill-creator quick_validate 通过(PyYAML 已安装);SiliconFlow 真实冒烟通过(VEP / 自动 detail / --full / 大图缩放 / 256 token 强制截断下 5 次调用续写合并)。

v0.1.1

Choose a tag to compare

@YOGEMOW YOGEMOW released this 04 Aug 01:55

v0.1.1(2026-08-04)

Fixed

  • 密钥查找优化:vision.mjs 现在依次检查环境变量、运行目录 .env、脚本目录(scripts/).env、技能根目录 .env;凭据缺失时错误信息会列出实际查找位置,doctor 命令新增 .env 查找位置 展示。
  • 配置说明完善:SKILL.md 新增“密钥配置(必读)”一节;README 安装说明补充备选配置方式(用户环境变量 / 技能根目录 .env)。

Changed

  • 文档本机路径统一为通用写法 C:\Users\用户名\(隐私保护)。

DeepSeek Prism v0.1.0

Choose a tag to compare

@YOGEMOW YOGEMOW released this 02 Aug 15:07

DeepSeek Prism v0.1.0

为纯文本 DeepSeek 模型(如 deepseek-v4-flash)提供按需识图能力的 Codex Skill:图片由外部视觉 API 提取可见事实,压缩为低 Token 的 VEP/1 视觉证据包,由主模型继续完成推理与决策。

主要功能

  • 强制触发协议:主模型无法直接读图时自动调用 vision.mjs
  • VEP/1 紧凑证据输出(默认 ≤520 字符,约 50–150 tokens)
  • --detail 五模式分节报告:页面还原(A1–A7)/ 问题定位 / 报错日志 / 文本表格 / 图表数据
  • 多 Provider 预设与自动降级:SiliconFlow / 智谱 / ModelScope / 阿里 / OpenRouter / Groq
  • SHA-256 本地缓存(TTL 24 小时、上限 1000 条)
  • 零运行时依赖:仅需 Node.js >= 18

验证

  • 14 项单元与 mock 端到端测试全部通过;skill-creator quick_validate 通过
  • SiliconFlow zai-org/GLM-4.5V 真实冒烟与 7 次真实用户测试通过(截图解释、LSP 诊断、图表解读、设计稿/手绘稿还原、图片描述)

合规

  • 本项目采用 MIT License(Copyright (c) 2026 YOGEMOW)
  • 第三方声明与许可全文见 THIRD_PARTY_NOTICES.md