v0.2.0
本次更新集中在移动端芯片适配、推理性能与内存管理。
相比 v0.1.0,小米 10 英→中默认单 worker 实测:首次翻译 7.21 → 4.74 秒(−34%),峰值 RSS 323 → 182 MiB(−44%)。同模型、200 句语料、相同参数,三轮独立进程中位数。
- 计算提速:新增 i8mm SMMLA 内核、复用权重打包缓存,并优化 attention 小矩阵乘;不支持 i8mm 的设备自动回退 ruy。
- 内存降低:embedding 保持 int8,输入按行反量化,输出层复用同一张表。
- 释放修复:模型与线程缓存可真正释放,并修复多 worker 加载时模型字节被提前释放的问题。
- 回归验证:覆盖小米 10 / 12 / 14;基准测试集扩充至 200 句。
完整基准与复现方法。上述数据为原生引擎测试,首次翻译含模型加载,不是 app PSS。
升级注意:releaseAllModels() 现返回 Future<Boolean>,可确认释放是否完成;升级 AAR 后需重新编译调用方,不要在主线程等待结果。
构件:bergamot-v0.2.0.aar(arm64-v8a,Android 9+)。
