Releases: chen-006/meow-llm-detector
Release list
meow LLM Detector v4.5.0
下载与启动 / Download and start
- Windows 10 / 11,Intel / AMD 64 位:推荐便携包
windows-x64-portable-zh-CN.zip(中文)或windows-x64-portable-en.zip(English)。内置 Python 3.13.15 和依赖,完整解压到新文件夹后双击start.bat;无需另装 Python 或首次安装依赖。调用模型 API 仍需联网。 - 源码包 / macOS / Linux: 选原来的
v4.5.0-zh-CN.zip或v4.5.0-en.zip,需 Python 3.11+;Windows 运行start.bat,macOS / Linux 运行sh start.sh。 - 浏览器未打开时访问
http://127.0.0.1:8765/。数据在meow_runs;迁移前关闭旧后台。Key 保存在系统凭据库,不随文件夹迁移到另一台电脑。 - 使用详情见包内 README;下载校验见
SHA256SUMS.txt。
English: On Windows 10/11 x64, choose a windows-x64-portable ZIP, extract everything and double-click start.bat. Python and dependencies are included; API calls still need a network connection. Original source ZIPs require Python 3.11+. See the included README for details.
包含 GPT rc4、Claude rc3 基准与双语文档。便携包与普通 v4.5.0 的检测核心、基准和校准绑定相同,无需重新采样或校准。模拟为同池有效答案条件统计,不是独立真实准确率。
Includes GPT rc4 and Claude rc3 benchmarks and bilingual documentation. The portable edition retains the same detection core and calibration bindings. Same-pool simulations are not independent real-world accuracy.
v4.1.1
GPT-5.6 混用检测器 v4.1.1 更新说明
默认档位
- 单次低/中/高改为19/49/158条。
- 低档正式加入固定随机国家、固定随机鸟和b80。
- 持续低/中/高使用批准的概率、窗口和150–210/240–360/480–720秒随机间隔。
- 单次与持续共用一套强指向线:低54/58/77,中82/84/97,高98/97/99。
评分
- 冻结可信答案分布保持字节不变。
- 新增独立
fingerprint_runtime_policy_v4_1_1.json,保存六个官方运行契约和阈值。 - 正式资格不再依赖基础指纹中的历史runtime_contracts。
- 低、中、高走同一评分路径;自定义档仍只显示参考匹配度。
- 保留alpha=0.5、T=1、90%格门禁和一次w加权;不引入tau、margin、混合比例或OOD回放门禁。
模型字段
- 拆分“申报模型”和“实际请求模型”。
- HTTP payload使用实际请求模型;Juice和最终一致性使用申报模型。
- 指纹强烈指向与申报不同,报告显示红色警告。
- SQLite升级schema 3,报告升级schema 4;旧会话缺request_model时回退claimed_model。
网络
- 普通请求默认UA从Native原始模板读取Codex Desktop UA。
GPT56_USER_AGENT继续只覆盖普通请求。- Python统一解析环境代理、NO_PROXY和Windows手动代理,只向Node传一个最终代理决策。
- Native结构化stderr转换为脱敏中文错误。
- PAC-only和SOCKS-only明确提示改用HTTP/mixed代理端口或TUN。
操作体验
- 检测结束后不再自动清空当前页面和session中的API key;关闭session/后台时清除。
- 启动时恢复最近一次已经运行的完整配置和自定义探针。
- 后端先规范化最近配置并校验自定义探针;损坏配置回退单次低档并显示中文提示。
- “新检测”保留方案,“恢复本档默认参数”才重置。
- 计划预览增加普通短请求、Native基础、固定32K和总输入Token粗估。
- 报告的验证参考改为Stage C真实模拟数据,并明确匹配度不是路由概率。
持续监控
- 概率按探针每周期抽一次,命中后向适用profiles展开。
- 行为指纹按cell滚动;Juice按effort滚动。
- 输出完整性和覆盖检测当前摘要实际使用window;历史硬异常继续保留首次证据。
- 指纹结果不粘住。
删除
- 删除低档“不运行行为指纹”的特殊分支和文案。
- 删除Python内置强指向阈值常量,阈值只由运行策略提供。
- 删除六个运行契约中的阈值副本;契约只保存判定档位,正式评分从策略顶层唯一阈值表取值。
- 删除正式评分对冻结基线历史runtime_contracts的依赖。
- 新生成的自定义探针不再包含废弃的runtime_contracts/formal_eligible字段。
- 不保留v4.1.0隐藏预设或第二套持续阈值。
兼容与升级
- API地址缺路径时自动补
/v1。 - 外部集成应提交
claimed_model和request_model;缺少request_model时安全回退claimed_model。 - 旧报告可查看,但旧配置不冒充4.1.1官方档。
- 最近配置只有实际开始检测后才保存;未运行草稿、API key和留存目录不会恢复。
- 完整Native请求仍建议使用系统级TUN;只换UA不等于完整Codex请求。
许可
- 新增 PolyForm Noncommercial License 1.0.0。
- 明确项目为源码开放、非商业许可;基于本项目的公开检测站必须保持免费、公益和非商业。
- 分发和衍生版本必须保留许可证、Required Notice 和原项目链接。
验收
- 48项本地测试通过;一次低概率已关闭socket析构警告定位到既有取消测试清理路径,停止场景均通过,作为非阻断残余风险记录。
- Python编译、detector.js、generator.js和Native Node入口语法通过。
- 桌面与390px窄屏浏览器验收通过,无控制台错误。
- 可信基础指纹SHA-256保持
B637FCF4D959389B14779A32C6B40DD8346501D84AD7B873C928A8783E421FE5。
GPT-5.6 detector v4.1.0
GPT-5.6 混用检测器 4.1.0 更新说明
发布日期:2026-08-11
升级来源:4.0.1
兼容性:报告与行为评分存在不兼容变更
新增
- 新增七种互斥报告结论,将 Juice 三状态与行为指纹两状态分别表达,并保留“可能非GPT”覆盖结果。
- 新增
trusted-fingerprint-v3行为评分与冻结基线。 - 新增中档/高档独立强指向线:
- 中档:Sol >70%、Terra >75%、Luna >90%。
- 高档:Sol >95%、Terra >90%、Luna >90%。
- 新增每个行为探针格至少完成90%的正式门禁。
- 新增完整的普通流与 Native 子进程会话级取消控制器。
- 新增 Native SSE 在收到 completed/failed/incomplete 终态后立即结束,不再等待 HTTP EOF。
- 新增 Web 停止接口的接受状态、停止时间和实际取消数量。
- 新增低档专用说明:低档不运行行为指纹,因此“指纹证据不明确”是预期的主动弃权。
- 新增探针生成器对 S、D、w、JSD、答案分布、采样完整性和单窗稳定性限制的中文解释。
- 新增本文件进入公开与内部发行包。
修改
- “模型概率与误差”改名为“指纹匹配度”。数值保留三位小数。
- 行为数学固定使用
T=1softmax,不再搜索温度或放大分数。 - 保留
alpha=0.5的类别平滑,防止零概率导致单条答案无限否决。 - 同一题面的多个请求格式/上下文先合并为探针家族,避免四个 profile 被当作四个完全独立探针重复放大。
- 网络完整性门禁由“出现一次最终错误就弃权”改为逐格90%完成率。
- 32/48 输出完整性只在返回
40或 40 前缀纯数字时触发改写硬异常;其他无效内容只记证据无效。 - 报告页面顺序改为:七状态结论、指纹匹配度、Juice、确定性检查、线路质量、未完成项目、行为明细、技术摘要。
- 前端内部原因全部映射为中文;上游原始错误正文保留原文并附中文解释。
- 持续指纹只按当前滚动窗口重新计算,不再粘住历史概率结果。
- 自定义探针可以单时间窗生成和导入,但明确标注未验证跨时间稳定性。
- Native Codex 选项增加系统级 TUN VPN 说明。
- API 地址只填写站点根路径时自动补全
/v1;已有明确路径时保持原样。 - 行为评分删除可信分布向三模型共同分布的二次
w收缩,直接使用平滑后的可信分布;w只在探针家族合并时使用一次。
删除
4.1.0 已从正式评分路径、报告和生成器导出中删除:
- 温度 T 搜索。
- tau 与 tau 搜索。
pass_margin。alert_margin。- 混合模型拟合与混合比例。
- mixture gain 与门槛。
- 600次模拟回放的 Wilson 指标。
- 回放总体/最差窗覆盖率门禁。
- OOD 第1百分位线。
- 行为概率粘性报警。
- 旧“五状态”结论。
- 报告页“证据总览”块。
- 旧 schema 2 自定义探针回退评分路径。
- 旧 v4.0.1 测试对当前正式测试发现的干扰;历史测试已原样归档。
修复
- 修复断网或上游不关闭连接时,运行停在最后一条并且停止按钮无法终止的问题。
- 修复 Native 子进程不可取消、
executor.shutdown(wait=True)长时间等待的问题。 - 修复 Windows
socket.makefile()延迟关闭底层句柄导致普通流仍阻塞的问题。 - 修复
response.failed、response.incomplete和无终止事件断流可能进入正常答案评分的问题。 - 修复 401/403 后仍继续派发大量请求的问题。
- 修复重启后 HTTP 尝试预算被重新获得、崩溃遗留在途尝试未对账的问题。
- 修复 Web 服务重启后检测/生成器会话不能自动恢复的问题。
- 修复 B80、国家、鸟的运行归一化与冻结基线类别不一致的问题。
- 修复发行 staging 中基线路径、Native 资源与32K历史资源缺失的问题。
- 修复自定义探针导入后的内容哈希/运行目录资源错误。
- 修复探针请求数变化后页面总计划数不同步的问题。
- 修复生成器分析页无反馈、探针表原始 JSON 难以阅读的问题。
- 修复窄屏表格字符被逐字挤压和整页横向溢出的问题。
- 修复 Juice 数据不足时仍被命名为“Juice通过”的语义错误。
- 修复停止调度器仍可能等待未完成 Future、关闭线程池时阻塞,以及停止前重试任务被误记为最终错误的问题。
- 修复 HTTP 错误正文读取不能被停止按钮中断的问题。
- 修复确定性历史报警丢失原始探针、触发类型和证据,只能以笼统输出异常维持报警的问题。
- 修复低档报告把“未启用行为指纹”与网络错误、模型未过线混在同一组常见原因里的问题。
- 修复探针生成器仍使用阻塞式旧调度器、无法停止普通流或Native子进程的问题。
- 修复生成器在401/403后继续发送完整批次,并把零成功批次误报为“采集完成”的问题。
- 修复旧会话中的英文内部错误代码直接显示在报告页的问题。
- 探针明细新增“贡献方向”,直接说明本格更支持哪个冻结型号指纹。
- 删除正式报告路径中的旧粘性事件迁移兼容分支。
报告兼容性
新报告 schema 为 3。主要新增/替代字段:
combined_summary.outcome_code
combined_summary.title_cn
combined_summary.subtitle_cn
fingerprint_summary
reference_fingerprint_results
fingerprint_window_states
以下旧字段不再属于4.1.0正式报告:
probability_summary
mixture_summary
data_completeness
temperature / T search results
tau
pass_margin
alert_margin
mixture_ratio
mixture_gain
mixture_threshold
replay_wilson_*
replay_coverage_*
ood_threshold
依赖旧 JSON 字段名、旧五状态标题或混合比例的脚本必须适配。不要把缺失旧字段解释为检测失败。
自定义探针兼容性
- 4.1.0 只正式使用 schema 3 fingerprint-v3 文档。
- 生成器导出的自定义探针仍可导入、发请求和显示参考匹配度。
- 自定义探针不会参与正式强指向,也不会改变七状态结论。
- 单时间窗不再被硬性拒绝,但会标记
time_stability_verified=false。 - 旧 schema 2 探针应使用4.1.0生成器重新采集或转换,不能继续冒用正式评分。
升级注意事项
- 不要把旧运行目录中的 SQLite 直接复制进4.1.0发行目录作为新会话。
- 使用新包中的
Windows一键启动.bat或start_detector.sh启动。 - 第一次先运行低档,确认端点、模型和流式协议可用。
- 低档显示“指纹证据不明确”是正常行为;需要正式指纹请运行中档或高档。
- 高档固定32K历史会消耗大量输入 token;开始前检查页面估算。
- Native Codex 模式如需相似网络路径,建议先开启系统级 TUN VPN。
- 开启完整留存前,使用受控的绝对目录;留存含完整题面与模型输出。
- 外部报告解析器应先检查
report_schema_version == 3。
验证摘要
- 当前28项4.1.0回归测试通过。
- 完整测试压力连续10轮通过。
- 正式全量测试连续3轮通过。
- 普通阻塞流取消连续30次通过。
- Python编译、JavaScript和Node语法检查通过。
- 桌面与390px手机浏览器布局通过。
- 公开 staging 14 条低档本地模拟检测通过。
- 公开发行扫描未发现私有 Juice 模板、凭据、个人绝对路径、运行报告、SQLite或旧检测入口。
仍然存在的边界
- 加密状态层不能区分所有 Sol/Terra/Luna 情况。
- Juice 可以被针对性伪造。
- 指纹匹配度是冻结参考集合内的相对相似度,不是真实身份概率或混用比例。
- 综合通过不能排除透明代理、探针识别或普通请求差异化路由。
GPT-5.6 detector v4.0.1
修复内容
- 修复 Responses 流式响应中终态
output为空时的假空回:终态正文为空会从完整response.output_text.delta重建;终态与 delta 冲突时按协议异常处理。 - 修正 32/48 输出完整性判定:只有被改写为
40或以40开头的纯数字时才硬报警;其他非精确输出仅记为无效证据,不再误报 Juice 混用。 - 报告增加固定输出无效证据计数,并同步 README、界面说明和技术报告。
公开包 SHA-256:0681ed13e149064766cdd5408556046ff9ad9660baf1047a073fb6d71ebadd5c
GPT-5.6 API Detector v4.0.0
GPT-5.6 API Detector v4.0.0 正式版。
- 全新 vNext 检测核心与本地 Web UI
- Juice 确定性混用检测与输出完整性检查
- Sol / Terra / Luna 概率指纹层
- 普通、Native Codex 与固定 32K 上下文请求模式
- SQLite WAL 持久化、断点恢复和可选完整证据留存
- 34 项本地回归、100 次正常低档冒烟 0 误报;映射对照实验中所有可判定会话均检出混用