Skip to content

v0.3.0 update

Choose a tag to compare

@saturndec saturndec released this 07 Mar 21:21

憋了一周的大更新,新增改动了几万行代码,由于项目第一版存在许多架构问题,所以这版改动了很多架构问题,速度较慢,后续我会保持快速更新节奏!以下是更新说明:
本版本为源码发布版本,不附带预编译安装包,推荐使用 Docker 自行构建部署。

WAOOWAOO v0.3.0

这是过去一周主线迭代后的集中版本更新。相较 2026-02-28 的公开快照版本,当前主线已经完成 45 次提交,累计影响 634 个文件,覆盖工作流稳定性、模型生态扩展、语音视频能力、资产生成链路、配置中心体验和运行时可靠性等多个核心模块,建议所有人立即升级
注:由于目前项目处在测试版,为保持代码整洁,所以版本更新不会兼容旧版本数据,造成的不便感谢理解。

版本概览

本次版本不是零散修补,而是一次面向实际生产可用性的系统性升级。重点集中在以下几个方向:

  • 强化 StoryToScript 与 ScriptToStoryboard 的执行稳定性
  • 增强视频生成链路,支持首尾帧串联与单镜头首尾帧同时配置
  • 升级语音生成与口型同步能力,补强项目级 TTS 配置
  • 扩展模型与 Provider 生态,提升多模型接入能力
  • 重构默认模型配置与 Provider 管理体验
  • 增强错误处理、超时反馈与显式失败机制
  • 补充登录限流、密码强度提示等基础安全能力

核心更新

1. 工作流稳定性升级

  • 强化 StoryToScript 与 ScriptToStoryboard 流程的原子化能力
  • 增加严格执行顺序校验,减少流程串扰与状态错乱
  • 增强长链路任务的可重试能力
  • 优化分析顺序展示与执行状态反馈,便于理解当前流程进度

2. 视频生成能力升级

  • 新增首尾帧串联能力
  • 支持单个镜头同时配置首帧与尾帧
  • 提升镜头连续性与视频结果可控性
  • 进一步完善视频阶段运行时交互和状态处理

3. 语音与口型同步能力升级

  • 新增项目级 TTS 模型选择能力
  • 支持调整生成声音方案数量
  • 项目资产库与资产中心的音色设计卡片系统完成统一
  • 增强阿里云百炼口型同步能力
  • 增加口型同步统一前处理逻辑,包括过短音频补齐与过长音频裁切

4. 模型与 Provider 生态扩展

  • 增强阿里云百炼 Provider 能力
  • 新增 Minimax 文本模型支持
  • 新增 qwen3vdtts
  • 将 qwendesign 合并至百炼链路
  • 增加更多官方最新模型
  • 增强 OpenAI Compatible 与 Response API 相关兼容能力

5. 配置中心与交互体验优化

  • 默认模型配置界面重构
  • Provider 支持拖拽排序与隐藏
  • 增强配置页测试按钮和连通性反馈
  • 优化多个弹窗、下拉框、工作区操作区和交互细节
  • 改善配置中心整体可维护性与可理解性

6. 稳定性与显式失败机制增强

  • run events 拉取失败不再静默吞掉,改为显式报错
  • 统一超时语义与失败提示文案
  • 增强 JSON 解析与修复能力
  • 修复分析流程失败后前端未及时停止、窗口未关闭、跳转异常等问题
  • 加强提示词约束,降低异常输出对下游流程的影响

7. 安全与运行控制补强

  • 增加登录限流,降低暴力破解风险
  • 增加密码强度提示
  • 增加图像与视频并发设置限制
  • 持续推进存储路径统一与部署侧能力收口

问题修复

本次版本修复了多项实际使用中的关键问题,包括但不限于:

  • 修复新增角色、新增场景时风格丢失的问题
  • 修复资产中心生成图片后确认与删除失效的问题
  • 修复 Ark 相关字段处理异常
  • 修复分析流程失败后前端状态未同步终止的问题
  • 修复语言切换与浏览器语言冲突问题
  • 修复流式台词分析显示异常问题
  • 修复默认模型配置后项目模型仍需重复选择的问题
  • 修复 OpenAI Compatible 被误判为原生 OpenAI 推理的问题
  • 修复多个 UI 可见性、布局和交互细节问题

部署方式

本版本采用源码发布,不提供预编译安装包,推荐通过readme的Docker教程 自行构建部署。