Releases: YOGEMOW/DeepSeek_Prism
Releases · YOGEMOW/DeepSeek_Prism
Release list
v0.5.0
v0.5.0 — 设置界面集成(视觉 API 密钥掩码输入 + 模型选择)
新增
- harness 设置页「插件」页新增 DeepSeek Prism 卡片(
deepseek-prism-dsh设置命名空间):- 视觉 API 密钥:
type=password只写控件——保存后仅显示「已配置」徽标,中间字符不展示、明文不随任何响应返回;密钥经ctx.credentials写入凭据库(.credentials.yaml)。 - 视觉 Provider / 模型 / 区域 / 密钥环境变量名(凭据引用):写入设置段;保存后宿主自动把密钥与
VISION_PROVIDER / VISION_MODEL / VISION_REGION注入process.env,vision.mjs 子进程继承,无需任何.env文件。 - 客户端为手写
__ModuleLoader__bundle(零构建,仅require('react'));宿主侧设置/凭据包为可选动态导入,缺失时降级跳过。
- 视觉 API 密钥:
- harness 侧一行 allowlist 补丁(本地):
WEB_SETTINGS_NAMESPACES加入deepseek-prism-dsh。
验证
- 插件测试 18 项(新增 env 注入/回退/不覆盖 4 项),全量 61 项通过。
- 安装:
pnpm dsh plugin --profile web add <本包 tarball>,重启 GUI 后:设置 → 插件 → DeepSeek Prism 卡片;上传图片自动降级并调用视觉 API(密钥来自设置)。
注:harness
WEB_SETTINGS_NAMESPACES的 allowlist 补丁需保留在本地 checkout(上游将 allowlist 声明迁移至settings.register()属于其 deferred work)。
v0.4.1
v0.4.1 — 修复插件降级失效 + 消除重复安装
Fixed
- 插件图片降级从未生效的根因:
isCurrentModelTextOnly以裸{ sessionId }调用sessions.models,真实 api-proxy 从request.payload解构导致抛错,被 catch 吞掉后回退上游,图片上传仍被拒绝(MODEL_DOES_NOT_SUPPORT_IMAGES)。已改为完整请求形状{ payload: { sessionId } }并新增形状回归测试。实测(API 探测):修复后纯文本模型图片上传降级成功。
Changed
- 消除 harness 上的重复安装:插件不再把技能素材物化到
$DSH_HOME/skills/deepseek-prism,改为启动时通过ctx.skills.register运行时注册技能(资源基准目录指向包内素材)——harness 上只有插件这一处技能来源;已清理~/.dsh/skills/deepseek-prism旧副本与仓库内生成的素材副本(发布时由 prepack 按需生成)。
验证
- 插件测试 14 项全部通过(新增 models RPC 形状回归、技能注册、无物化验证);全量
node --test57 项通过。 - 安装:
pnpm dsh plugin --profile web add <本包 tarball>,重启 GUI 后技能出现在目录中(来源:插件运行时注册)。
v0.4.0
v0.4.0 — DSH 插件化 + Codex/DSH 双包发布
新增
- DSH 插件
@yogemow/deepseek-prism-dsh(packages/plugin-dsh,零依赖 Cordis 插件,dsh.bundle声明自动激活):- 技能物化:插件启动时把包内 deepseek-prism 素材写入
$DSH_HOME/skills/deepseek-prism(版本戳防重复、保留用户.env),skill-filesystem 自动发现; - 图片降级:包装
apiProxy.sessions.prompt,纯文本模型收到图片时降级为文本指针(描述 + 附件对象路径),视觉模型不受影响——不再需要修改/分叉 DSH 宿主源码。
- 技能物化:插件启动时把包内 deepseek-prism 素材写入
- Codex 包
@yogemow/deepseek-prism-skill(packages/skill):含deepseek-prism-skill一键安装 CLI。 - 发布编排
scripts/release.mjs:测试 → 同步版本 → npm pack(prepack 自动物化素材)→ 可选发布 GitHub Packages(需 classic PAT)。本版本双包以 GitHub Release 资产分发:
| 资产 | 用途 |
|---|---|
deepseek-prism-skill-0.4.0.tgz |
Codex:npx <资产URL> 或 Copy-Item 到 ~/.codex/skills/ |
deepseek-prism-dsh-0.4.0.tgz |
DSH:pnpm dsh plugin --profile web add <资产URL> |
验证
node --test53 项全部通过(vision 43 + 插件 10:降级透传矩阵、校验回退、对象路径、素材物化与版本戳)。- skill-creator
quick_validate.py通过。 - 双包
npm pack通过(含技能素材物化)。
v0.3.1
v0.3.1 — DSH 纯文本模型识图链路修复
修复 DeepSeek Harness(DSH)下纯文本模型无法通过 deepseek-prism 识图的问题。
根因
DSH 宿主在图片上传时直接拒绝纯文本模型(MODEL_DOES_NOT_SUPPORT_IMAGES,提示“当前模型不支持图片”),图片从未进入会话,prism 技能无法触发。
修复
- DSH 宿主侧(deepseek-harness):纯文本模型收到图片时不再拒绝,改为注入
[图片附件 <名称>:<宽>x<高> px…已保存到 <路径>]文本块(路径为附件内容寻址对象),模型按 skill 指引对该文件运行视觉脚本即可。 - 本技能:
readImageSource在扩展名未知时按魔数嗅探 MIME(PNG/JPEG/GIF/BMP/WebP/AVIF/TIFF/SVG),直接支持 DSH 附件对象路径等无扩展名来源。 - SKILL.md 补充 DSH 图片附件注入说明。
验证
node --test43 项全部通过(新增sniffImageMime8 类魔数用例)。- skill-creator
quick_validate.py通过。 - DSH 宿主 api-proxy 375 项测试通过(含新增的纯文本模型图片降级用例)。
v0.3.0
v0.3.0 — DeepSeek Harness(DSH)双平台适配
本版本将 Skill 升级为 Codex / DeepSeek Harness(DSH)双平台通用,DSH 用户安装后开箱即用。
新增
- DSH sharp 自动发现:
scripts/vision.mjs在 Codex 运行时之外新增 DSH Web 运行时候选(~/.dsh/profiles/node_modules/sharp,含DSH_HOME解析)与 DSH 用户根候选(~/.dsh/node_modules/sharp),DSH 环境大图等比缩放开箱即用。 - SKILL.md 双平台化:触发协议补充 DSH
read_image工具;命令章节给出 Codex / DSH 两套默认安装路径;sharp 查找顺序说明双平台。 - 文档同步:README 新增 DSH 安装方式(
C:\Users\用户名\.dsh\skills\deepseek-prism);doctor与缩放警告文案、references/providers.md、PROJECT / PLAN / STATUS / DECISIONS / RISKS 全部同步;DECISIONS 新增 D15。 agents/openai.yaml仍仅 Codex 消费(DSH 忽略)。
验证
node --test42 项全部通过(DSH sharp 环境实测:大图缩放、GIF 动画帧保留、AVIF/TIFF/SVG 回退、VISION_SHARP_PATH重试)。- skill-creator
quick_validate.py通过。 - SiliconFlow 真实冒烟通过:DSH 安装副本
see --json正确提取报错截图(含文件:行号)。
安装
# Codex
Copy-Item -Recurse deepseek-prism C:\Users\用户名\.codex\skills\deepseek-prism
# DeepSeek Harness(DSH)
Copy-Item -Recurse deepseek-prism C:\Users\用户名\.dsh\skills\deepseek-prism密钥配置见 README(环境变量或技能根目录 .env)。
v0.2.0
v0.2.0 (2026-08-05)
Added
- 输出策略自动分级:小图/简单任务保持 VEP/1(<=520 字符);长内容任务自动走
--detail完整通道(默认 4096 token)。 - 超长内容自动续写并合并:检测截断后以锚点续写,模型回复
[完成]/“没有更多内容”即停止;VISION_MAX_CONTINUATIONS可调;合并时折叠重复围栏。 - 新增
--raw(cleanRaw 原文)、--full({raw, parsed} JSON 信封)、--compact(强制 VEP/1)。 - 输入预处理:内置 sharp(libvips)等比缩放,不依赖宿主安装;AVIF/TIFF/SVG 通过 sharp metadata 回退识别尺寸并统一转 PNG;动画 GIF 保留全部帧;
VISION_MAX_INPUT_PIXELS防止超大输入。 - Provider
outputLimit感知(OpenRouter/Groq 8192);doctor输出 Node 版本与缩放后端状态。
Changed
- 字段预算随
--max-chars缩放(答案 45%/文本 35%/摘要 25%),截断显式标注[截断]。 - 缓存:key 按输出通道隔离、旧格式/过期/损坏条目自动清理、临时文件+rename 原子写、
--no-cache不再写回。
Fixed
- 11 项审计缺陷:
--json与自动 detail 契约、VISION_MAX_CONTINUATIONS=0、--full1000 字符截断、AVIF/TIFF 视觉 API 兼容、续写代码围栏保留与去重、哨兵空输出、sharp 失败重试、极小预算越界、参数优先级文档、缓存原子写。
Test
node --test42/42 通过;skill-creator quick_validate 通过(PyYAML 已安装);SiliconFlow 真实冒烟通过(VEP / 自动 detail / --full / 大图缩放 / 256 token 强制截断下 5 次调用续写合并)。
v0.1.1
v0.1.1(2026-08-04)
Fixed
- 密钥查找优化:
vision.mjs现在依次检查环境变量、运行目录.env、脚本目录(scripts/).env、技能根目录.env;凭据缺失时错误信息会列出实际查找位置,doctor命令新增.env 查找位置展示。 - 配置说明完善:
SKILL.md新增“密钥配置(必读)”一节;README 安装说明补充备选配置方式(用户环境变量 / 技能根目录.env)。
Changed
- 文档本机路径统一为通用写法
C:\Users\用户名\(隐私保护)。
DeepSeek Prism v0.1.0
DeepSeek Prism v0.1.0
为纯文本 DeepSeek 模型(如 deepseek-v4-flash)提供按需识图能力的 Codex Skill:图片由外部视觉 API 提取可见事实,压缩为低 Token 的 VEP/1 视觉证据包,由主模型继续完成推理与决策。
主要功能
- 强制触发协议:主模型无法直接读图时自动调用
vision.mjs - VEP/1 紧凑证据输出(默认 ≤520 字符,约 50–150 tokens)
--detail五模式分节报告:页面还原(A1–A7)/ 问题定位 / 报错日志 / 文本表格 / 图表数据- 多 Provider 预设与自动降级:SiliconFlow / 智谱 / ModelScope / 阿里 / OpenRouter / Groq
- SHA-256 本地缓存(TTL 24 小时、上限 1000 条)
- 零运行时依赖:仅需 Node.js >= 18
验证
- 14 项单元与 mock 端到端测试全部通过;skill-creator quick_validate 通过
- SiliconFlow
zai-org/GLM-4.5V真实冒烟与 7 次真实用户测试通过(截图解释、LSP 诊断、图表解读、设计稿/手绘稿还原、图片描述)
合规
- 本项目采用 MIT License(Copyright (c) 2026 YOGEMOW)
- 第三方声明与许可全文见
THIRD_PARTY_NOTICES.md