v0.3.0 update
憋了一周的大更新,新增改动了几万行代码,由于项目第一版存在许多架构问题,所以这版改动了很多架构问题,速度较慢,后续我会保持快速更新节奏!以下是更新说明:
本版本为源码发布版本,不附带预编译安装包,推荐使用 Docker 自行构建部署。
WAOOWAOO v0.3.0
这是过去一周主线迭代后的集中版本更新。相较 2026-02-28 的公开快照版本,当前主线已经完成 45 次提交,累计影响 634 个文件,覆盖工作流稳定性、模型生态扩展、语音视频能力、资产生成链路、配置中心体验和运行时可靠性等多个核心模块,建议所有人立即升级
注:由于目前项目处在测试版,为保持代码整洁,所以版本更新不会兼容旧版本数据,造成的不便感谢理解。
版本概览
本次版本不是零散修补,而是一次面向实际生产可用性的系统性升级。重点集中在以下几个方向:
- 强化 StoryToScript 与 ScriptToStoryboard 的执行稳定性
- 增强视频生成链路,支持首尾帧串联与单镜头首尾帧同时配置
- 升级语音生成与口型同步能力,补强项目级 TTS 配置
- 扩展模型与 Provider 生态,提升多模型接入能力
- 重构默认模型配置与 Provider 管理体验
- 增强错误处理、超时反馈与显式失败机制
- 补充登录限流、密码强度提示等基础安全能力
核心更新
1. 工作流稳定性升级
- 强化 StoryToScript 与 ScriptToStoryboard 流程的原子化能力
- 增加严格执行顺序校验,减少流程串扰与状态错乱
- 增强长链路任务的可重试能力
- 优化分析顺序展示与执行状态反馈,便于理解当前流程进度
2. 视频生成能力升级
- 新增首尾帧串联能力
- 支持单个镜头同时配置首帧与尾帧
- 提升镜头连续性与视频结果可控性
- 进一步完善视频阶段运行时交互和状态处理
3. 语音与口型同步能力升级
- 新增项目级 TTS 模型选择能力
- 支持调整生成声音方案数量
- 项目资产库与资产中心的音色设计卡片系统完成统一
- 增强阿里云百炼口型同步能力
- 增加口型同步统一前处理逻辑,包括过短音频补齐与过长音频裁切
4. 模型与 Provider 生态扩展
- 增强阿里云百炼 Provider 能力
- 新增 Minimax 文本模型支持
- 新增 qwen3vdtts
- 将 qwendesign 合并至百炼链路
- 增加更多官方最新模型
- 增强 OpenAI Compatible 与 Response API 相关兼容能力
5. 配置中心与交互体验优化
- 默认模型配置界面重构
- Provider 支持拖拽排序与隐藏
- 增强配置页测试按钮和连通性反馈
- 优化多个弹窗、下拉框、工作区操作区和交互细节
- 改善配置中心整体可维护性与可理解性
6. 稳定性与显式失败机制增强
- run events 拉取失败不再静默吞掉,改为显式报错
- 统一超时语义与失败提示文案
- 增强 JSON 解析与修复能力
- 修复分析流程失败后前端未及时停止、窗口未关闭、跳转异常等问题
- 加强提示词约束,降低异常输出对下游流程的影响
7. 安全与运行控制补强
- 增加登录限流,降低暴力破解风险
- 增加密码强度提示
- 增加图像与视频并发设置限制
- 持续推进存储路径统一与部署侧能力收口
问题修复
本次版本修复了多项实际使用中的关键问题,包括但不限于:
- 修复新增角色、新增场景时风格丢失的问题
- 修复资产中心生成图片后确认与删除失效的问题
- 修复 Ark 相关字段处理异常
- 修复分析流程失败后前端状态未同步终止的问题
- 修复语言切换与浏览器语言冲突问题
- 修复流式台词分析显示异常问题
- 修复默认模型配置后项目模型仍需重复选择的问题
- 修复 OpenAI Compatible 被误判为原生 OpenAI 推理的问题
- 修复多个 UI 可见性、布局和交互细节问题
部署方式
本版本采用源码发布,不提供预编译安装包,推荐通过readme的Docker教程 自行构建部署。