V1.4.0 — Model-led GPU optimization
V1.4.0 将优化决策收回 ChatGPT,随 skill 安装的工具只执行一次明确操作并记录可复核事实。
- 删除自动规划、全局流程状态和重复执行入口,不保留旧流程兼容层。
- 生产代码收敛为 17 个模块,以 Target、Variant、Experiment、Invocation 和 Champion 作为唯一持久模型。
- 候选不会自动晋级;正确性、短版初筛、profiler 和正式比较由 ChatGPT 根据当前证据显式启动。
- NCU、Nsys、PyTorch Profiler、编译产物和 SASS 只返回身份绑定的事实;未知版本、关键字段和单位 fail closed。
- 离线知识保持 advisory;没有匹配不会阻断源码分析、profiling 或新的优化假设。
- 补齐长任务心跳、启动期限、本机进程组清理和安装后公开请求格式。
本次发布在 Python 3.10 与 3.12 上各通过 225 项自动化测试;RTX 5090 物理验收通过 5 项检查。完整验证范围见 docs/validation.md。
这是不向后兼容的架构收敛版本。旧 Controller、自动投资控制和旧 schema 不再提供入口。