v1.3.0
修复:📄 代码草稿误分类(普通思考频繁被判为 📄)
根因:英文代码关键词用子串匹配且无词边界,普通英文推理里高频误命中——import(important)、var(vary)、function(functions)、class(classification)、return(returns)、\bfor\b(英文句子几乎都带 for)。
修复:
- 全部英文关键词改为词边界
\b…\b;删除散文高频的for/while。 - 下调泛化词权重:
API/JSON/接口/调用。 - 移除散文常见符号(
:-"'/x.y形式)对 📄 的参与,保留纯代码符号(;([{=+…各 0.01)。
验证:新增回归样本集,important/vary/classification/functions return等正常思考均正确回退到 🧠/🤨 等,真实代码草稿仍判 📄。
新功能:可调分界点(全权重后缀长度)
- 位置权重从「全局 0
1 线性」改为:思维链尾部 N 个字符按满权重计分(默认 300,可调 50500),更早内容在 0~1 线性衰减。 - 意义:防止最末尾一小段内容单独主导分类;值越小,末尾干扰(一次格式化/一句话)越不可能独占胜出。
- 设置页「检测参数 → 全权重长度」滑杆/数字输入可调。
其他
- 默认匹配表升级 v4(
tableVersion=4,未自定义用户自动升级)。 - ✅ 条目新增
没有问题消除「没有问题」误触发 🔍。