Releases: zhuzhangxue/wechat-chat-export
Release list
v1.3.3
v1.3.3
这次主要修复聊天记录较多时可能出现的发送者身份错误映射问题。
修复
- 修复跨多个
message_*.db数据库分片导出时,发送者可能被错误映射到其他联系人的问题 - 发送者 ID 现在按消息所属分片的
Name2Id解析,不再把不同数据库中的数字 ID 当作全局身份 ID - 不再通过固定数字 ID 或昵称猜测“我”
- 私聊身份无法可靠确认时,会明确显示为“未知发送者”,避免错误归属
- 群聊发送者及正文前缀处理更加严格
诊断信息
JSON 现在额外保留:
source_dbreal_sender_idserver_idsender_usernameis_selfsender_statussender_resolution_counts
方便遇到身份解析异常时进一步检查。
旧版本用户
如果你曾使用 v1.3.2 或更早版本导出大量历史聊天记录,建议使用 v1.3.3 重新导出。
旧版本导出的文件不会自动修正。
致谢
感谢 @EnTaroYan 提交 Issue #2 和 PR #4,定位问题、完成修复并补充回归测试。
v1.3.2
v1.3.2
这次主要补充了聊天预览入口,并改善了源码运行时的语音解码体验。
更新内容
-
新增「预览已有聊天」
- 程序启动后始终可用
- 可以直接选择以前导出的聊天文件夹重新预览
- 不需要重新导出聊天记录
-
保留原来的「打开聊天预览」
- 本次聊天成功导出后可用
- 点击后直接预览刚刚导出的聊天
-
改进源码运行时的
rust-silk安装- 第一次使用语音功能且本机没有
rust-silk时,会询问是否自动安装 - 从官方 GitHub Release 下载固定的
rust-silk v0.1.3 - 下载后校验 SHA-256
- 安装完成后自动继续导出
- 命令行新增
python cli.py --install-rust-silk
- 第一次使用语音功能且本机没有
其他
- Windows EXE 仍然已经内置
rust-silk,普通用户无需额外安装 - 聊天记录和语音转写均在本机处理,不上传聊天内容
- 支持 Windows 微信 4.1.12+
如果 Windows 第一次运行提示 SmartScreen,这是因为目前没有商业代码签名证书。
v1.3.1
v1.3.1
这次主要改进了微信数据目录的识别和选择。
之前程序主要依赖自动探测微信数据目录。如果电脑上存在旧数据、迁移过微信数据位置,或者有多份微信数据,可能会读到错误的目录。
v1.3.1 增加了手动指定和候选目录选择,遇到这类情况时可以直接切换到正确的数据。
更新内容
- 支持在 GUI 中手动指定微信数据目录
- 点击「微信数据目录 → 选择」后,会自动列出本机发现的候选目录
- 候选目录会显示账号数量、数据库最近修改时间和发现来源,并优先显示较新的数据
- 找不到需要的目录时,仍可以手动浏览选择
- CLI 新增
--db-dir - 兼容
D:\WeChatData、D:\WeChatData\xwechat_files等常见目录形式 - 修复扫描
WpSystem、WindowsApps等 Windows 受保护目录时可能中断的问题 - 不指定数据目录时,仍保持原来的自动探测方式
- GitHub Actions 现在也会在 Pull Request 时运行语法检查和测试
感谢 @wzh4464 提交 PR #1,为项目加入手动指定微信数据目录的支持,并完善相关路径兼容和异常处理。
Windows 微信 4.1.12+。
聊天记录和本地语音识别仍然在本机处理;媒体文件只能导出本机仍有缓存的部分。
Windows EXE 目前没有商业代码签名,第一次运行时可能出现 SmartScreen 提示。
v1.3.0
v1.3.0
本次主要补上了媒体导出、聊天预览和本地语音转文字。
新增
- 支持导出本机仍有缓存的图片、文件、语音和视频
- 微信语音可自动从 SILK 转为 WAV
- 新增「语音转文字(本地)」选项
- 使用 SenseVoice Small Int8
- 默认关闭,需要时手动勾选
- 识别过程在本机完成,不上传聊天语音
- 首次使用需要下载约 230 MB 的模型
- 已识别过的语音会缓存结果,重复导出时可直接复用
- 新增聊天预览
- 可直接查看文字和图片
- 文件使用 Windows 默认程序打开
- 语音和视频可直接播放
- 支持分批加载更早的聊天记录
- 新增 Markdown 导出
改进
- 改进微信 4.x 图片导出,增加对 wxgf 图片的处理
- Markdown 图片显示尺寸更合适
- 优化长聊天预览性能,加载数百条消息时滚动更流畅
- 修复聊天预览中部分情况下出现黑色背景条的问题
- 恢复消息之间的单实线分隔样式
- WAV 转换成功后不再保留多余的 SILK 中间文件
- 语音转写缓存改为保存在用户应用数据目录,不再混入
exports - 补充 Windows 发布包中的 LICENSE 和第三方许可说明
本地语音识别
SenseVoice 模型默认保存在:
%LOCALAPPDATA%\WeChat-Chat-Export-for-LLM\models\sensevoice
语音转写缓存默认保存在:
%LOCALAPPDATA%\WeChat-Chat-Export-for-LLM\cache\voice_asr_cache.json
模型只需要下载一次。删除转写缓存不会影响聊天记录,只会让对应语音在下次导出时重新识别。
说明
- 当前面向 Windows 微信 4.1.12+
- 媒体文件只能导出微信本机当前仍有缓存的内容
- 本地语音转文字默认关闭,不使用时不会进行额外识别
- 项目不会上传聊天记录或语音内容
- Windows EXE 目前没有商业代码签名,首次运行时可能出现 SmartScreen 提示
本项目与腾讯、微信无关联。请仅处理你有权访问和导出的聊天数据。
v1.1.2
v1.1.2
首个公开测试版本。
- 支持 Windows 微信 4.x 私聊、群聊导出
- 输出适合大模型读取的 TXT / JSON
- 支持长文本、引用回复、撤回及部分系统消息解析
- 群聊尝试还原成员昵称
- 新增 GUI 和微信运行状态检测
- 新增应用图标
使用前请先登录 Windows 微信并保持微信在后台运行。
当前 EXE 尚未进行可信代码签名,Windows SmartScreen 可能显示安全提示。