Releases: joeseesun/qiaomu-clipper
Release list
1.14.3 — 翻译更稳定,模型配置有引导
翻译更稳定
- 模型返回的内容里,格式完整的条目先收下,只对缺失的段落再问一次;截断的 JSON 也能救回。
- 仍失败就把这组对半拆,直到单段。一次坏输出最多损失一段,其余照常显示,「重试翻译」只补译不出的那一段。
- 429、5xx、断网会自动退避重试;密钥无效等错误立刻停止并提示,不再每批重复失败。
- 超时改为「一分钟没有新输出」,慢但在持续输出的模型不会被掐断。每批更小,3 批并发,某一批卡住不再拖住后面。
不知道该配什么模型
- 点「中文翻译」时如果没有 AI 模型,字幕条会说明「翻译需要 AI 模型,和生成字幕的语音识别是两回事」,并给出「设置翻译模型」按钮,直达模型页。
- 设置页里原来的「AI 解读」改名为「AI 模型」,并写明用于翻译、对话和解读。
- 「语音识别」和「AI 模型」两页顶部各有一句说明,并互相链接。
未验证
- 没有在真实 Chrome 和真实模型下跑过;只有 724 项单元测试、tsc 和三端构建通过。
- 设置页新文案和字幕条按钮的外观,没有逐项在真实页面里看过。
升级
只需重载扩展,不需要更新本地助手。Chrome 商店 1.14.2 仍在审核中,本版本只发布到 GitHub。
1.14.2 模型添加修复预览版
模型添加修复预览版。官方商店 1.14.1 审核已撤回;1.14.2 已于 2026-10-06 按用户指示提交正常审核,并选择审核通过后自动发布。当前仍待审核。真实安装与升级验收仍未完成。
- 关闭模板解释器仍可配置 AI 服务商和模型;远程目录请求不再阻塞入口。
- 保存失败回滚,重试与重复点击不再污染配置;保留当前选择,空目录支持手填。
- 大模型列表和账号凭证分块保存,避免 Chrome 同步单项容量限制;兼容旧配置。旧版无法读取大配置的新分块格式。
- 已核查本地分支和工作树;外部 PR #32/#33 仍未完整合并,详见开发审计。
验证:721 项前端、130 项助手测试、TypeScript 检查、Chrome/Firefox/Safari 构建;ZIP 完整性、manifest 资源、许可证和权限检查通过。构建仍有原有 bundle 大小警告。
真实扩展页面控制受到浏览器安全策略限制。安装/升级、真实 AI 调用及媒体站点运行仍须人工验收,不能将自动化通过视为这些流程已通过。人工清单:开发审计。
Chrome 包 SHA256:363e2db0f6e7b6fb85d41ac209e6b942c774574c29886477d9a00483fc9ac433
1.14.1 — 全新的添加服务商与模型界面
添加服务商、添加模型重新设计
- 添加服务商:带品牌图标的卡片页,可搜索,分「账号登录 / 聚合中转 / 服务商 / 本机 / 自定义」。内置 ChatGPT、Codex、词元跳动、硅基流动、OpenRouter、OpenAI、Anthropic、Gemini、DeepSeek、Kimi、智谱、通义千问、豆包、MiniMax、阶跃星辰、xAI、Mistral、Groq、Perplexity、Ollama、LM Studio。已添加的显示灰色并打钩,点它直接编辑。
- 点卡片后只显示需要的内容:账号登录是一个登录按钮,其他是 API Key(可显示/隐藏)和「获取 API Key」链接,接口地址收在折叠项里。
- 添加模型:先选服务商,再在可搜索的列表里一次勾选多个模型;已添加的会标出。获取列表失败时写明原因,可重试,也可手动填写模型 ID。
- 服务商和模型列表每一行都带图标和状态(已登录 / 未填写 Key / 域名)。
其他
- 输入框、下拉框、编辑器聚焦时统一为一圈很淡的灰色光晕,不再出现黑色双层描边。
- 新增
npm run package,只打包三个构建目录,并检查文件数,避免误打包。
未验证
- 设置页里重画的服务商和模型列表,只在测试里验证过,没有在真实 Chrome 里逐项看过。
- 新增服务商的接口地址按各家公开文档填写,没有逐个联网核对。
- ChatGPT / Codex / 词元跳动登录仍未用真实账号跑过。
升级
只需重载扩展,不需要更新本地助手。
1.14.0 — 用 ChatGPT / Codex / 词元跳动账号登录
用账号登录,不用再复制 API Key
- 词元跳动:在「添加服务商」选「词元跳动」,点「授权词元跳动」,在浏览器里确认后自动创建并填入 Key(按官方 PKCE 流程)。已内置,地址自动填好。
- ChatGPT 账号:点「登录 ChatGPT」,使用你的 ChatGPT 套餐额度,走 OpenAI 官方的「Sign in with ChatGPT」。
- Codex 订阅:点「登录 Codex」,使用 Codex 套餐额度。借用 Codex CLI 的登录身份,OpenAI 可能随时限制,介意请只用前两项。
- 登录后「添加模型」会用你的账号自动列出可用模型;令牌过期会自动刷新,被拒时提示重新登录。对话和 AI 解读都支持。
- 内置「硅基流动」预设。
修复
- 「获取模型列表失败」现在会写明原因(HTTP 状态、超时、网络被拦截等);Key 前后的空格和换行会自动去掉。
- 词元跳动的模型列表只显示能对话的模型,不再混入视频、语音、嵌入模型。
未验证
- 三种登录只通过了单元测试和构建,没有用真实账号在浏览器里完整跑过。若登录后页面没有自动继续,把最后停留页面的地址粘贴到弹出的输入框里即可。
- Codex 后端要求 Codex 的 User-Agent,浏览器可能设置不上,新模型可能报 Model not found。
- 仅 Chrome 系浏览器做了设计,Firefox / Safari 未测。
升级
只需重载扩展,不需要更新本地助手。
1.13.2 — 下载工具自动保持最新,修复生成字幕失败
生成字幕不再因为下载工具过旧而失败
- 修复「音频下载失败:The page needs to be reloaded」:旧版助手在 Python 3.9 上只能装到一年前的 yt-dlp,YouTube 已不再接受。现在优先使用 3.10 及以上的 Python;机器上没有时,改用 yt-dlp 官方独立版。
- yt-dlp 自动保持最新:生成字幕前每 12 小时检查一次更新(断网时跳过);遇到「站点变了」类报错会先更新再重试一次,仍失败时给出明确提示,而不是英文报错。
- 已经装在旧 Python 上的用户,下次生成字幕时自动换成新环境;失败会还原旧环境。只更新助手自己装的 yt-dlp,不动 Homebrew 的。
升级
必须同时更新本地助手:重新运行 python3 native/install.py(Windows 见 README),仅重载扩展不会更新助手。
Windows 助手仍未在真实 Windows 上测试。
1.13.1 — 抖音读取与转写修复、TED 官方字幕与双语
抖音能读到视频、转写并播放
- 修复抖音读取失败:校验视频与音频时长的函数在构建后失效,导致任何抖音视频都显示"还没读到这条视频";重复的音频请求不再被当成两个候选;识别新的普通 mp4 版本。
- 字幕条放到右侧栏顶部,不用滚动就能看到;读取失败的提示卡片重新设计,给出「重新读取」和「打开原视频」。
- 学习页以 douyin.com 作为来源播放原视频;助手下载使用浏览器标识,被拒绝时提示状态码。
TED 与翻译
- TED 优先使用官方视频与字幕,时间轴含片头;学习页可切换网站字幕语言。
- 有 AI 译文时可选原文 / 译文 / 双语,剪藏草稿按所选保存;翻译返回无效 JSON 时只重试失败的字幕组。
升级
必须同时更新本地助手:重新运行 python3 native/install.py(Windows 见 README),仅重载扩展不会更新助手。重载扩展后请关闭旧的学习页重新打开。
Windows 助手仍未在真实 Windows 上测试。
1.13.0 — 多站字幕条与视频、音频学习
多站字幕条与视频、音频学习
- 抖音、TikTok、Vimeo、Instagram、Facebook、Reddit、Twitch 录播/片段、Dailymotion、SoundCloud、Bandcamp、niconico、微博、喜马拉雅、网易云音乐、TED、Apple 播客的媒体详情页接入通用字幕条和「沉浸学习」,也可按
aaa。X 保留右侧卡片,其余站点默认收起为悬浮字幕条;站点开关仍然有效。 - 信息流只有能定位到当前媒体详情链接时才显示;切换条目会切换字幕缓存,避免显示上一条字幕。
- 视频复用 B 站使用的停靠、剧场、小窗与尺寸调整布局,使用原生视频控制,浏览器支持时可进入画中画;字幕未生成时也能使用布局控制。本地视频文件同样使用视频布局。
- 音频保留专门的音频播放器布局、播放进度与倍速控制。
- X 字幕条改为放在右侧卡片上方,避免被固定搜索框遮盖;没有合适右侧卡片时退回视频下方。学习页保留帖子正文、视频和字幕,剪藏及 AI 上下文也保留正文。
转写学习与本地助手
- 转写学习成为设置页,包含链接/文件主入口、最近学习与推荐播客弹层;设置菜单按学习、剪藏、AI 和模板分组。
- 换模型重新生成文字稿后自动读取新稿;按钮文案与样式统一为「生成字幕」「换模型生成文字稿」。
- 本地助手提供 Windows 安装支持,安装错误说明及可复制安装指令。
- 媒体读取优先选择带声音的 MP4/WebM 视频,优先不超过 720p;没有较小版本时保留可播放视频,不把无声视频误识别为音频。
升级
- 替换扩展目录后,在
chrome://extensions重新加载扩展并刷新网站页面。 - 必须同步更新本地助手:使用 1.13.0 源码运行
python3 native/install.py --vault <你的笔记库路径>;Windows 使用python native\install.py。仅重新加载扩展不会更新助手,旧助手会导致 X 学习页缺少正文和播放器。 - 刷新或重新打开学习页。可运行
python3 native/install.py --check检查助手安装。
验证及限制
- 本地通过 645 项前端测试、117 项助手测试、TypeScript 检查和 Chrome / Firefox / Safari 构建;最终提交的 GitHub CI 全部通过。
- 自动测试覆盖支持站点详情地址识别、当前媒体选择、跨域播放器识别、真实字幕组件挂载、条目切换缓存、站点开关、视频/音频布局、布局切换保持播放器节点及原生画中画调用。
- X 字幕条位置修复已在真实 Chrome 帖子上确认;已安装助手通过真实原生消息协议返回同一帖子的完整正文与 720p MP4,媒体地址返回 HTTP 200 video/mp4。
- 新增站点尚未逐站完成真实浏览器验收,自动测试不代表每个网站都能播放;扩展内部阅读页受自动浏览器访问限制,最终页面播放和画中画弹窗尚未实机验收。Windows 尚待真机验收。
- 网站读取取决于登录、网络和可播放媒体地址。直播、DRM 或仅提供流式地址的内容不保证可播放;部分跨域内嵌播放器的原页时间控制不可用,可进入学习模式对照字幕播放。
- 本次是 GitHub 开发版发布,不代表 Chrome 应用商店版本更新。
1.12.0 — 转写学习:无字幕视频和音频一键转写
无字幕的视频和音频,一键转写成字幕,再进入沉浸学习
生成字幕
- 视频或音频没有字幕时,字幕条里点「生成字幕」。可以在本机转写(Whisper、Qwen3-ASR、faster-whisper,选了没装的引擎会自动下载安装,不需要 Homebrew),也可以用你自己的云端服务(豆包、硅基流动 Qwen3-ASR、智谱、阶跃、小米 MiMo、Groq、OpenAI,或任何兼容 OpenAI 转写接口的服务,包括你本机运行的服务)。
- 弹层里一次选定识别方式和语言,勾选「直接开始」后下次点一下就开始;每个网站可以单独选识别方式,随时切换。云端服务的 API Key 只保存在浏览器本地,页面拿不到。
- 用视频的标题、作者、简介作为识别的背景,减少人名和术语写错(实测一集嘉宾「曾鸣」:不带背景时 Whisper 写成「曾敏」,带上后写对)。只对见效的模型开启,设置里可关。
- 设置 → 视频字幕 → 语音识别:推荐一个本机引擎和两个云端服务,其余收在「添加其他」里;每个服务在弹窗里配置,可保存同一服务的多个模型。
转写学习(新入口:设置侧栏,或弹窗「⋯」菜单)
- 粘贴 YouTube、B 站、小宇宙或其他音视频网站(Vimeo、X、TikTok、SoundCloud、微博、喜马拉雅等,凡是 yt-dlp 能读的都可以试)的链接,或选一个本地音频/视频文件,进入学习。
- 推荐播客:张小珺、42章经、半拿铁、晚点聊、Next Token|词元之外,以及 Latent Space、Dwarkesh、No Priors、Training Data、The Cognitive Revolution,从各自公开的 RSS 读最新几集,点一集即学。
- 播客学习页:封面、节目简介、文字稿跟随播放滚动、15/30 秒跳转、倍速、简介里的时间戳可点击跳转。
- 设置 → 视频字幕 → 支持的网站:每个网站一个开关,默认全部打开。
其他
- B 站:沉浸学习里字幕现在会跟随播放;字幕条可选字幕语言,AI 字幕是中文译文时可以「识别原声」。
- 设置菜单重新整理:通用、剪藏与保存、划线、属性、阅读模式、视频字幕、学习笔记、AI 解读、模板。
- 去掉了指向 Obsidian 官方的「给插件打分」和「帮助」,设置页标题改为「乔木剪藏」。
- 新增项目开发规则(CLAUDE.md)。
升级:在 chrome://extensions 重新加载扩展并刷新已打开的页面。要使用本机识别或转写学习,需要更新本地助手:python3 native/install.py --vault <你的笔记库路径>(助手新增了几个文件,旧版会提示「本地助手版本较旧」)。
验证:623 项前端测试、116 项助手测试、TypeScript、三个浏览器构建通过;用真实 Key 对豆包、硅基流动、智谱、阶跃、小米做了转写和背景信息的对比;在本机用真实的 B 站视频、小宇宙节目(2.6 小时)、RSS 节目(Next Token)、本地文件、SoundCloud 跑通了完整流程。
未验证:所有新界面(设置页、弹层、小宇宙播放器和学习页、推荐播客弹层)只在 jsdom 里测过,没有在真实 Chrome 里逐项点过;B 站内嵌播放器的时间回传没有在真实页面里验证;OpenAI、Groq 按公开接口接入,未实测;YouTube 在数据中心出口 IP 上仍可能要求登录才能下载音频;Vimeo 等网站是否能读取取决于网站和你的网络。GitHub 发布不代表 Chrome 商店版本更新。
1.11.2 — OpenAI / Magpie 地址兼容修复
修复 OpenAI-compatible / Magpie 服务地址兼容问题:仅填写服务根地址或 /v1 时,聊天请求会补全为正确的 /v1/chat/completions 地址;完整 endpoint 保持原有路径。模型列表地址解析复用同一套基础路径规则。
本版本选择性采纳 PR #33 的两项独立修复,保留原贡献者署名,见 PR #34。Whisper 实时字幕、设置页改版与翻译模型拆分尚未包含,PR #33 继续开放。
验证:479 项扩展测试、40 项本地助手测试、TypeScript 检查、Chrome / Firefox / Safari 生产构建及 ZIP manifest 检查通过。
下载对应浏览器 ZIP,解压后加载扩展。Chrome 商店版本与 GitHub Release 是独立发布渠道。
1.11.1 — 修复 B 站无字幕视频显示错误字幕
- 修复:B 站没有字幕的视频(或分 P),沉浸学习/阅读模式/剪藏不再显示别的视频的字幕。原因是 B 站一个旧接口(
player/v2?bvid=…)对没有字幕的分 P 会返回另一个视频的 AI 字幕,而提取器在可靠接口为空后会继续尝试它。现在只要可靠接口已经成功回答,就不再采信这个旧接口;可靠接口出错时仍保留它作为兜底。页面上的字幕工具栏本来就是对的,现在两边一致。
升级后在 chrome://extensions 重新加载扩展,并刷新已打开的 B 站页面。本次不涉及本地助手,无需重新安装。
验证:477 项前端测试、TypeScript、三个浏览器构建通过;在已登录的浏览器里确认了三个接口的原始返回。
未验证:修复后在真实扩展里对该视频第 20 P 进入阅读模式的实际显示(错误字幕只在登录状态下出现,Node 里无法复现前后对比)。GitHub 发布不代表 Chrome 商店版本更新。