v4.1.0
很高兴能在考试周前发布新版本,原谅我拖的有点久了~🙇♂️
这个版本带来了很多有意思的新功能和一些改进,以及修复了一些在反馈中搜集的 Bug。(特别感谢每一位使用过它的同学!)
🌟 TL;DR
- 智能去重与 AI 过滤 (重磅更新!) 为了帮大家省下手动删 PPT 的时间,全新的
后处理功能现在包含重复去除、排除列表及AI 过滤三个阶段:- ♻️
重复去除: 自动识别演讲者A -> B -> A的回放操作,只保留第一次出现的页面。 - 🚫
排除列表: 预置了No Signal,Black Screen,Desktop等无效画面的哈希值,自动剔除垃圾画面。 - 🤖
AI 过滤: AI 会帮你判断哪些不是全屏播放的幻灯片图像。- 💡 建议在
后处理完成后,点击查看应用回收站,稍微检查一下AI 过滤是否存在错误。
- 💡 建议在
- ♻️
Tip
vLLM 处理效果极佳,测试准确率达 99.9%!基本上可以完全信任程序的输出结果了!把时间放在复习上面吧~
AI 服务可在 内置 和 自定义 服务中进行切换。AutoSlides 内置有我免费提供的共享服务,在登录后可使用 gpt-4.1 模型;共享服务的可用性视情况而定。
推荐使用模型:gpt-4.1、Qwen/Qwen3-VL-235B-A22B-Instruct、Qwen/Qwen3-VL-30B-A3B-Instruct 及 Qwen/Qwen3-VL-8B-Instruct。测试中即便使用 LM Studio 本地运行的轻量模型 qwen3-vl-2b-instruct 也能取得良好的识别效果。
- 全新的 README 文档,这次终于不是 AI 写的了,是我一个个字敲出来的,我个人觉得我自己写的还是蛮清楚了哦~
其它的一些变动
- 新增了全新的 AI 过滤功能,包含过滤逻辑设计、图像预处理、提示词工程、速率限制、错误重试等内容
- 新增了应用回收站,现在被移除的图像不会直接移至系统回收站,便于检查及恢复
- 修复了下载并发数限制的逻辑
- 修复了预置 pHash 排除列表的禁用逻辑
- 修复了直播模式下第一次打开会缓冲失败的问题
- 修复了录播模式下,如果先调整播放速度再开始提取幻灯片,检查间隔忘记自动调整的问题
- 修复了视频停止播放后,本地代理服务器仍持续刷新视频 Token 的问题
- 修复了播放界面的错误重试逻辑可能出错的问题
- 修复了关键词搜索时的翻页逻辑,现在输入新关键词搜索会正确从第一页开始搜索
- 输入关键词后,现在可以按回车键进行搜索了
- 新增了
No Input的哈希值进入排除列表 - 优化了 API 错误处理,现在能够处理延河课堂服务器短暂崩溃的 99151011 错误
- 将高级设置窗口改为了按标签页分组
- 优化了任务队列的 UI 界面,增加了后处理进度条
- 更新了各主要依赖
- 修复了 TS 类型问题,现在 CI 终于能过了
- 优化了 Mac 构建;全新的更美观且压缩率更高的 DMG 安装包
- 更换 Windows 安装程序为 NSIS;更方便地覆盖安装;增加删除程序
- 新增了检查更新功能,虽然因为没有签名还是不能实现自动更新;还是请手动检查更新及下载安装吧
- 重构了渲染进程的结构;优化 UI 界面
- 修复了一些我已经忘记修复了什么的 Bug
相关项目
| 项目 / 类别 | GitHub 仓库 | 描述 |
|---|---|---|
| 网页版 👈 | bit‑admin/Yanhe-Web | 观看全校直播课程,在移动设备上运行幻灯片提取;记录笔记并导出为文档1。 |
| 提取器工具 | bit‑admin/AutoSlides-Extractor |
从下载的屏幕录制中提取幻灯片;处理一节课的视频用时快至10秒2;支持 GPU 加速;使用 C++ 构建;使用与 AutoSlides 相同的图像处理算法及基于 MobileNetV4 的机器学习模型3。
|
1 网页版提供笔记记录及导出 Word 及 Markdown 文档功能。
2 两个工具组合使用速度更快:使用 AutoSlides 下载一节95分钟课程的屏幕录制视频在校园网内用时约10秒;使用 AutoSlides Extractor 处理该视频(I-frame 间隔2秒)在 M4 Mac mini 上用时约10秒。
3 新版本尚在打磨中,还请再稍等一段时间吧~
It's been a long journey, thanks to everyone
这个个人项目是从一次难过的期末考试经历开始的。当时我就想,能不能 vibe code 一个东西,帮我把延河课堂上的幻灯片扒下来?于是它就出现了。
很高兴有同学愿意使用我这个自娱自乐的产物!在此分享一下我自己是如何使用它(以及它的两个姊妹项目)的:
- 首先,网页版 👈 是因为我观察到很多同学上课会使用 iPad 做笔记,因此为了很方便地帮助我上课——我把浏览器窗口放在左侧、Goodnotes窗口放在右侧——这样就能非常方便地直接拖动图片了;我还在网页版上加入了独占的笔记功能,能够随着幻灯片做一些文字笔记并导出为 Word 和 Markdown 文档。
- 对于录播课程的整理,自然日常使用的是
AutoSlides。AI 的识别准确率蛮高的,我只需要把一个学期的课程幻灯片图片都放在一起(我的一个技巧是在访达中使用缩率图视角快速看一下有没有不需要的图像),然后使用 Adobe Acrobat 把它们塞进一个PDF中就好了! - 有同学想问为什么
AutoSlides一次只处理一个视频,而不并发处理呢?其实我觉得也不是不行,虽然 AI 有速率限制,但是同时处理 2 -3 个视频还是可以的,但是我觉得大家如果是临近考试周想要快速地获取一整个学期的幻灯片,不如下载下来使用AutoSlides Extractor处理。 - 我有时还会帮其它同学整理,这个时候就适合使用
AutoSlides Extractor进行快速整理了(C++ 还是要快一些的);AutoSlides Extractor还需要一些打磨,比如我认为还可以进行并发处理,训练更好的机器学习模型等等;特别是我有计划加入替代 Adobe Acrobat 的功能,能够更方便地把我们提取课程幻灯片图像塞入一个PDF中。
其实我一直有在很缓慢地希望能把 AutoSlides 和 AutoSlides Extractor 这两个项目打磨得更好一些,我还有一些想法(有些已经放弃的):
- 我原先打算加入 OCR、AI 总结之类的功能,但是我感觉效果不是很好,而且也没什么必要——我们的目的是复习不是吗,把幻灯片上的概念整理清楚、习题再温习一遍要更重要一些吧?
- 因为
AutoSlides Extractor的新版本有点难产,而我想着在考试周前先发一个比较稳定的版本,所以AutoSlides v4.1.0就先出来了;不过应该还会有一个v4.1.1版本(可能还有一段时间?)至少会加入两个项目的协作功能~ - 还计划加入一个协助整理为文档的功能!
虽然我不是信科的同学,更多地是在自娱自乐(应该能从非常混乱的 commit 记录看出来),但是如果你有什么想法,非常非常欢迎给我一些反馈!Issues 或给我发一封邮件吧:info@ruc.edu.kg
再次非常非常感谢!能够哪怕只帮助到一位同学,都让我觉得非常非常高兴! 祝你考试周顺利~
Copyright © 2025 bit-admin.