Releases: chengyi-ai/native-subtitle-quote-image
Release list
v2.1.1 · Skill 新版本提醒
这一版为 Skill 增加低频、非阻塞的新版本提醒。
新增
- Skill 内新增独立
VERSION文件,使复制目录、安装器下载和插件安装都能读取本地准确版本。 - 每个新任务开始时,Agent 会比较本地版本与本项目的 GitHub Latest Release。
- 正常检查结果缓存 24 小时,不会每次使用都访问 GitHub。
- 发现新版时只提醒当前版本、最新版本与 Release 链接,不会自动覆盖本地 Skill。
- 断网、GitHub 不可用、缓存不可写或用户拒绝联网时,更新检查不会阻塞视频任务。
- 缓存只包含检查时间、最新版本号和 Release 链接,不记录账号、素材或使用行为。
- Python HTTPS 证书链不可用时,会回退到系统
curl的正常证书验证;不会通过-k等参数关闭 TLS 验证。 - 中文和英文 README 均补充更新提醒的行为、隐私边界与手动强制检查命令。
验证
- Skill 结构校验通过。
- 仓库与插件版本统一为
2.1.1。 - 20 项单元与集成测试通过,覆盖版本解析、新版提醒、24 小时缓存、缓存过期、断网降级和安全 HTTPS 回退。
- 使用真实 GitHub Latest Release API 完成联网验证,并确认第二次检查从缓存读取。
- GitHub Actions 的 Python 3.10 与 3.13 矩阵全部通过。
重要升级说明
已经安装 v2.1.0 或更早版本的用户还没有版本检查器,因此不会自动收到本次提醒。需要手动更新到 v2.1.1 一次;从 v2.1.1 开始,后续发布才会在使用 Skill 时按上述机制提醒。
重新安装或复制 skills/native-subtitle-quote-image/ 目录即可升级。
v2.1.0 · 脚本字幕与 YouTube 登录恢复
这版把“真实视频帧 + 经审核台词”的脚本字幕模式正式补齐,并修复 YouTube 公开请求被登录验证拦截后,Agent 容易误判为“只能处理本地视频”的问题。
重点更新
- 明确分离两种字幕来源:原生字幕只能来自视频像素;脚本字幕只能来自已审核的时间点与台词 JSON。
- 新增
render-script脚本字幕渲染流程,支持常见中日韩字体检测。 - 默认采用紧凑 3:4 版式:一张主画面约占 70%,四个字幕条各约占 7.5%,条间距为 0。
- 补充单张案例、成套总览和不同节目来源的完整案例,展示正确的台词密度与视觉层级。
- YouTube URL 先尝试无 Cookie 公开访问;遇到机器人登录验证、年龄验证或用户自己的非公开视频限制时,Agent 会说明原因并请求授权。
- 用户授权后,元数据、字幕与视频下载命令统一使用
yt-dlp --cookies-from-browser chrome,而不是退回“只支持本地视频”。 - Cookie 不导出、不保存、不上传、不写入仓库;默认配置失败时也不会自行遍历多个 Chrome 账户。
- URL 环境诊断新增可执行恢复提示,中文版与英文版 README 已同步。
验证
- Skill 结构校验通过。
- 仓库版本与插件元数据统一为
2.1.0。 - 14 项单元与集成测试通过。
- GitHub Actions 的 Python 3.10 与 3.13 矩阵验证通过。
- 使用真实 YouTube 链接完成 Chrome Cookie 授权、元数据读取、双语字幕下载、视频下载、脚本字幕成图和原尺寸/手机缩略图质检。
- 测试视频、浏览器 Cookie、字幕缓存和测试成品均未提交到公开仓库。
升级
重新安装或复制 skills/native-subtitle-quote-image/ 目录,即可让 Agent 读取新工作流。旧版安装不会自动获得本次规则更新。
v1.2.0 · 完整工作流与 URL 模式
这一版把原生字幕拼图从单一渲染器扩展为可复现的端到端 Skill。\n\n## 新增\n\n- 三种模式:本地成片、URL 完整流程、内容生产流程\n- yt-dlp、Deno/Node、字幕轨和可选 Whisper 的来源获取指南\n- 明确辅助文字稿只用于理解、选题和定位;最终字幕必须来自视频像素\n- 与视频理解、选题、写作 Skill 的协作边界\n- 从来源记录、候选主题、选句到逐张 QA 和有界返工的完整说明\n- 只读环境诊断:检查 Python、Pillow、FFmpeg、yt-dlp、JavaScript runtime 和可选语音识别\n- 聚焦采样:使用重复的 -t/--time 和 --around,为每个文字稿时间点生成前/中/后三帧\n\n## 验证\n\n- Python 3.10 与 3.13 GitHub Actions 通过\n- 9 项单元和集成测试通过\n- fresh clone 后仓库、Skill、环境与 CLI 验证通过\n- yt-dlp + Node.js 备用运行时完成公开 YouTube 链接只读解析测试\n\n升级后重新复制或安装 skills/native-subtitle-quote-image/ 目录,即可让 Agent 读取新工作流。
v1.1.0 · 候选帧总览与自动验证
新增
sample候选帧总览命令:自动均匀抽帧,也可指定起止时间和间隔- 仓库校验脚本、6 项单元/集成测试和 Python 3.10/3.13 GitHub Actions
- README 烧录字幕判断、素材来源和本地脚本说明
改进
- 缺失文件、无效时间点、损坏 manifest 和 FFmpeg 失败现在返回可读错误
- 修复默认整段抽帧在视频结束时刻无法解码的问题
- 总览图保持实际输出比例,不再固定按 3:4 缩略
- 修正 Codex 手动安装目录为
~/.codex/skills - Skill 不再假设用户安装了其他未随仓库提供的 Skill
安全变化
脚本现在默认拒绝覆盖已有图片。确认需要重新渲染并替换当前输出时,请显式添加 --overwrite。
完整验证已在本地、GitHub Actions 和 GitHub 新鲜克隆中通过。
原生字幕拼图 Skill v1.0.0
首个公共版本:提供可独立安装的 Agent Skill、Codex 插件清单、精确取帧与 3:4 拼图脚本、依赖说明和 MIT 许可证。公共包不包含原始视频、成品素材、账号资料或第三方视频参考图。