Releases: uf-hy/cpa-plugin-codexcomp
Release list
v0.1.7
修复账号池无可用账号时返回 HTTP 200 的问题。
插件接管流式请求时,现在会正确返回 HTTP 502,不再将错误包装为 response.failed SSE 事件。(issue #7,感谢 @fangzhengjin 报告)
v0.1.6
v0.1.5
CodexComp 现已进入 CLIProxyAPI 官方插件商店,并补齐 CPA 所有支持动态插件的平台。
相比 v0.1.4,本版本新增 macOS amd64/arm64、Windows arm64 和 FreeBSD amd64 发布资产。插件行为、配置和 ABI 没有变化,现有用户可以直接升级。
- Linux amd64 / arm64
- macOS amd64 / arm64
- Windows amd64 / arm64
- FreeBSD amd64
FreeBSD arm64 的 CPA 官方成品是 no-plugin 构建,因此不提供对应插件资产。
README 和 SETUP 已同步完整平台列表、安装方式、源码编译要求及卸载说明。
v0.1.4
新增 Windows amd64 原生构建与发布支持。
感谢 @yueziji 通过 PR #4 提交 Windows amd64 构建与发布支持。我们补充了 DLL 导出、运行时依赖和加载验证,相关功能随 v0.1.4 发布。
Windows 支持
- GitHub Release 现在提供
codexcomp_0.1.4_windows_amd64.zip。 - 原生 Windows CPA 进程使用
.dll;Windows 上运行 Linux 容器时仍应使用 Linux.so。 - README 和 SETUP 文档新增 Windows 下载、校验、安装及源码编译说明。
发布验证
- Windows CI 使用 UCRT64 CGO 工具链执行
go test ./...和 c-shared 构建。 - 检查
cliproxy_plugin_init导出符号及未打包的 MSYS2/MinGW 运行时依赖。 - 从最终 zip 解压后通过
LoadLibraryW和GetProcAddress验证 DLL 可以实际加载。
其他改进
- 修复 annotated tag 发布说明读取流程,确保 GitHub Release 使用完整 tag message。
v0.1.3
新增接管模型 gpt-5.6-luna
观测到 Luna 依旧存在 516 截断现象,而 Terra 和 Sol 暂未发现相同问题,因此将 gpt-5.6-luna 加入默认接管模型,Terra 和 Sol 暂不添加。如果后续在其他模型上发现截断现象,可使用下方新增的自定义功能自行添加。
支持自定义插件接管模型
本版本新增 models 配置项,可以使用精确模型标识符指定 CodexComp 要接管的模型。
未配置时默认接管 gpt-5.5 和 gpt-5.6-luna。现有用户无需修改配置,使用 gpt-5.6-luna 时也可自动获得截断续写。
plugins:
configs:
codexcomp:
models:
- gpt-5.5
- gpt-5.6-luna
- gpt-5.6-terra
- gpt-5.6-sol实验性 min_reasoning_tokens 配置
该功能会在指定模型的累计推理 token 低于阈值时尝试续写,但实际效果非常有限,不建议在生产环境中依赖,也不能保证最终达到配置阈值。
该功能没有默认值,未配置时完全禁用。续写仍受 encrypted_content 和 max_continue 限制。
再次提醒:除非你知道自己在做什么,否则不建议使用。
min_reasoning_tokens:
gpt-5.6-luna: 1200增强诊断信息
metadata.proxy_rounds[].continue_reason会标记truncation或low_reasoning_tokensdebug_log会记录模型、当前轮次、累计推理 token、阈值、触发原因和 encrypted content 状态
验证
go test ./...通过- amd64 c-shared 插件编译和加载通过
- 在 CPA v7.2.58 上验证自定义模型路由、截断续写和低推理阈值触发
v0.1.2 - Stable prompt cache across plugin callbacks
修复插件在部分协议下无法保持稳定提示缓存的问题。(issue #3,感谢 @haowang02 提出)
TL;DR : 让 Anthropic Messages 以及 OpenAI-compatible 能正确的缓存了
建议所有使用以上两个协议的用户更新到最新版
此前 codexcomp 接管请求后,会以 codex 入口协议回调 CPA。这个路径下 CPA 不会自动从原始请求恢复稳定的上游 Session_id 和 prompt_cache_key,导致 Anthropic Messages 以及 OpenAI-compatible Chat Completions 经插件接管后,多轮会话里的提示缓存命中明显下降。
OpenAI Responses 路径本身已有自己的 prompt_cache_key 行为,在0.1.1版本中不被影响
本版本会从会话标识生成稳定 prompt_cache_key,并在需要时使用 openai-response 入口协议回调 CPA,让 CPA 正确设置上游 Session_id。
经过测试验证:/v1/messages 8/8 成功、7/8 缓存命中;/v1/chat/completions 8/8 成功、7/8 缓存命中;其中第一轮需创建缓存所以未命中, 由于环境不同, 可能存在其他的情况或场景依旧触发未命中缓存, 敬请发 issue 反馈.
另,近期(26年7月9日左右)上游返回的可见思考片段格式有所变化,可能出现多段英文状态文本并夹带 这类 HTML 注释分隔符。这个变化来自上游输出格式,不是本插件修改 reasoning 内容导致的, 根据测试来看并不影响
v0.1.1
新功能
- 更多协议支持(issue #1, 感谢 @haowang02 提出)感谢:除 Openai Responses API 外,现在同时支持 OpenAI Chat Completions 和 Anthropic Messages 等等协议。
- 插件新增可配置参数:新增 marker_text、max_continue、max_tier_n、debug_log 四个配置项,通过 config.yaml 热重载。
- 插件商店支持:新增 registry.json,CI 产出 zip + checksums.txt,支持在WebUI 中使用 CPA 插件商店安装。
- 多协议测试脚本:新增 scripts/candy_eval.py,支持三种协议测试并支持并发
改进
- 版本号注入:CI 通过 ldflags 注入版本号,registry.json 不再硬编码版本
- Docker 挂载:安装文档去掉 :ro 只读挂载,它不被需要了
- readme新增 HUMAN 安装指南:太好了现在人类也可以主动安装啦
已知限制
- metadata.proxy_rounds 等诊断字段仅在 openai-response 协议下可见
- issue #2(偶发 reasoning_tokens=0)目前暂未找到合适的高效复现方案
v0.1.0
Full Changelog: https://github.com/uf-hy/cpa-plugin-codexcomp/commits/v0.1.0