Skip to content

Sub2API Plus 0.2.4-9

Choose a tag to compare

@github-actions github-actions released this 29 Sep 23:48
· 937 commits to main since this release

AI API Gateway Platform - 将 AI 订阅配额分发和管理

官方出站(Codex 仿真)大请求正文的内存放大从约 13 倍降到约 5~6 倍:一次转发全链共享终态正文字节;Finalizer 解码不再复制长字符串,并按顶层成员交接给编译器;正文索引一次构建、各使用方共享;转发主干不再整程持有对象树与重编码正文,上游 attempt 结束后也不再无条件恢复整段正文;推理内容回放、Lite 能力判定与请求视图提取不再整段复制 input;zstd 压缩改用单并发度编码器,输出缓冲按最坏长度的 81% 一次预留。出站字节与改造前逐字节一致。ARM64 实测:16.8MiB 请求的容器内存峰值约 270→135MiB,两个并发约 500→190MiB。部署时请求内存准入(GATEWAY_REQUEST_MEMORY_*)建议按新实测配置:放大 6.11、固定预留 25MiB,预算 256MiB 时单请求上限 37MiB。

OpenAI WebSocket:Codex 在工具执行中途断线重连并重发整段对话时,若续接判定不明确而工具调用完整覆盖全部输出,改为按新链放行(记录 ingress_ws_tool_continuation_ambiguous_fallback),不再以 1008 拒绝导致重连全部失败。

升级工具链:新增 VC-0 预跑目标平台门禁(driver/vc0-gate-target.sh),VC-0 阶段预算按首次实测调为 165 分钟;修复轮以本机全量门禁通过为部署前提,CI 与续跑并行,CI 失败按部署收据回滚。