Skip to content

Releases: uf-hy/cpa-plugin-codexcomp

v0.1.7

Choose a tag to compare

@github-actions github-actions released this 19 Jul 19:40
25c139b

修复账号池无可用账号时返回 HTTP 200 的问题。

插件接管流式请求时,现在会正确返回 HTTP 502,不再将错误包装为 response.failed SSE 事件。(issue #7,感谢 @fangzhengjin 报告)

v0.1.6

Choose a tag to compare

@github-actions github-actions released this 11 Jul 12:29

新增接管模型 gpt-5.6-terra

观测到 Terra 在 max/xhigh 推理强度下存在 516 截断现象(issue #6,感谢 @dovela 报告),将 gpt-5.6-terra 加入默认接管模型。Sol 未观测到相同问题,暂不加入。

现有用户无需修改配置,升级后自动获得 Terra 截断续写。

Terra 除标准 516 截断外,偶发其他非 518n-2 序列的截断(如 342、428、477 等),无规律且部分属正常低思考行为,暂不特殊处理。

v0.1.5

Choose a tag to compare

@github-actions github-actions released this 10 Jul 17:12
edfc5dd

CodexComp 现已进入 CLIProxyAPI 官方插件商店,并补齐 CPA 所有支持动态插件的平台。

相比 v0.1.4,本版本新增 macOS amd64/arm64、Windows arm64 和 FreeBSD amd64 发布资产。插件行为、配置和 ABI 没有变化,现有用户可以直接升级。

  • Linux amd64 / arm64
  • macOS amd64 / arm64
  • Windows amd64 / arm64
  • FreeBSD amd64

FreeBSD arm64 的 CPA 官方成品是 no-plugin 构建,因此不提供对应插件资产。

README 和 SETUP 已同步完整平台列表、安装方式、源码编译要求及卸载说明。

v0.1.4

Choose a tag to compare

@github-actions github-actions released this 10 Jul 09:19
ab55821

新增 Windows amd64 原生构建与发布支持。

感谢 @yueziji 通过 PR #4 提交 Windows amd64 构建与发布支持。我们补充了 DLL 导出、运行时依赖和加载验证,相关功能随 v0.1.4 发布。

Windows 支持

  • GitHub Release 现在提供 codexcomp_0.1.4_windows_amd64.zip
  • 原生 Windows CPA 进程使用 .dll;Windows 上运行 Linux 容器时仍应使用 Linux .so
  • README 和 SETUP 文档新增 Windows 下载、校验、安装及源码编译说明。

发布验证

  • Windows CI 使用 UCRT64 CGO 工具链执行 go test ./... 和 c-shared 构建。
  • 检查 cliproxy_plugin_init 导出符号及未打包的 MSYS2/MinGW 运行时依赖。
  • 从最终 zip 解压后通过 LoadLibraryWGetProcAddress 验证 DLL 可以实际加载。

其他改进

  • 修复 annotated tag 发布说明读取流程,确保 GitHub Release 使用完整 tag message。

v0.1.3

Choose a tag to compare

@github-actions github-actions released this 10 Jul 07:39

新增接管模型 gpt-5.6-luna

观测到 Luna 依旧存在 516 截断现象,而 Terra 和 Sol 暂未发现相同问题,因此将 gpt-5.6-luna 加入默认接管模型,Terra 和 Sol 暂不添加。如果后续在其他模型上发现截断现象,可使用下方新增的自定义功能自行添加。

支持自定义插件接管模型

本版本新增 models 配置项,可以使用精确模型标识符指定 CodexComp 要接管的模型。

未配置时默认接管 gpt-5.5gpt-5.6-luna。现有用户无需修改配置,使用 gpt-5.6-luna 时也可自动获得截断续写。

plugins:
  configs:
    codexcomp:
      models:
        - gpt-5.5
        - gpt-5.6-luna
        - gpt-5.6-terra
        - gpt-5.6-sol

实验性 min_reasoning_tokens 配置

该功能会在指定模型的累计推理 token 低于阈值时尝试续写,但实际效果非常有限,不建议在生产环境中依赖,也不能保证最终达到配置阈值。

该功能没有默认值,未配置时完全禁用。续写仍受 encrypted_contentmax_continue 限制。

再次提醒:除非你知道自己在做什么,否则不建议使用。

min_reasoning_tokens:
  gpt-5.6-luna: 1200

增强诊断信息

  • metadata.proxy_rounds[].continue_reason 会标记 truncationlow_reasoning_tokens
  • debug_log 会记录模型、当前轮次、累计推理 token、阈值、触发原因和 encrypted content 状态

验证

  • go test ./... 通过
  • amd64 c-shared 插件编译和加载通过
  • 在 CPA v7.2.58 上验证自定义模型路由、截断续写和低推理阈值触发

v0.1.2 - Stable prompt cache across plugin callbacks

Choose a tag to compare

@uf-hy uf-hy released this 09 Jul 04:54

修复插件在部分协议下无法保持稳定提示缓存的问题。(issue #3,感谢 @haowang02 提出)

TL;DR : 让 Anthropic Messages 以及 OpenAI-compatible 能正确的缓存了
建议所有使用以上两个协议的用户更新到最新版

此前 codexcomp 接管请求后,会以 codex 入口协议回调 CPA。这个路径下 CPA 不会自动从原始请求恢复稳定的上游 Session_id 和 prompt_cache_key,导致 Anthropic Messages 以及 OpenAI-compatible Chat Completions 经插件接管后,多轮会话里的提示缓存命中明显下降。

OpenAI Responses 路径本身已有自己的 prompt_cache_key 行为,在0.1.1版本中不被影响

本版本会从会话标识生成稳定 prompt_cache_key,并在需要时使用 openai-response 入口协议回调 CPA,让 CPA 正确设置上游 Session_id。

经过测试验证:/v1/messages 8/8 成功、7/8 缓存命中;/v1/chat/completions 8/8 成功、7/8 缓存命中;其中第一轮需创建缓存所以未命中, 由于环境不同, 可能存在其他的情况或场景依旧触发未命中缓存, 敬请发 issue 反馈.

另,近期(26年7月9日左右)上游返回的可见思考片段格式有所变化,可能出现多段英文状态文本并夹带 这类 HTML 注释分隔符。这个变化来自上游输出格式,不是本插件修改 reasoning 内容导致的, 根据测试来看并不影响

v0.1.1

Choose a tag to compare

@github-actions github-actions released this 08 Jul 13:44

新功能

  • 更多协议支持(issue #1, 感谢 @haowang02 提出)感谢:除 Openai Responses API 外,现在同时支持 OpenAI Chat Completions 和 Anthropic Messages 等等协议。
  • 插件新增可配置参数:新增 marker_text、max_continue、max_tier_n、debug_log 四个配置项,通过 config.yaml 热重载。
  • 插件商店支持:新增 registry.json,CI 产出 zip + checksums.txt,支持在WebUI 中使用 CPA 插件商店安装。
  • 多协议测试脚本:新增 scripts/candy_eval.py,支持三种协议测试并支持并发

改进

  • 版本号注入:CI 通过 ldflags 注入版本号,registry.json 不再硬编码版本
  • Docker 挂载:安装文档去掉 :ro 只读挂载,它不被需要了
  • readme新增 HUMAN 安装指南:太好了现在人类也可以主动安装啦

已知限制

  • metadata.proxy_rounds 等诊断字段仅在 openai-response 协议下可见
  • issue #2(偶发 reasoning_tokens=0)目前暂未找到合适的高效复现方案

v0.1.0

Choose a tag to compare

@github-actions github-actions released this 07 Jul 04:16