Skip to content

Repository files navigation

web-plan-execute

在 ChatGPT、GitHub 与 Codex 之间编排规划、独立复审、执行和验证,同时只保留一份可恢复、 可审计的 living ExecPlan。

版本:0.9.0-rc.1。这是公开候选版,不是 1.0。

解决什么问题

很多个人开发者希望用 ChatGPT 网页版的强推理模式做第二意见,再让本地 Codex 读取真实仓库、 修改并测试代码。直接依赖 GitHub app 有三个边界:

  • 普通 Chat 与 Codex/Work 的 agentic 用量池分开,但这不等于 Chat、Pro、上传或 app 无限;
  • ChatGPT GitHub app 官方定位是只读,写代码、push 和 PR 应交给 Codex;
  • 私库工具可能在一个推理模式可用、另一个模式未挂载,不能用旧对话或公开网页结果冒充当前连接器证据。

本 Skill 因此采用:

  1. 本地 Git + RUN.json 是执行权威;
  2. ChatGPT web/Pro 是有预算的 advisory critic;
  3. 连接器证明绑定当前 conversation、surface、reasoning mode、repo 和 commit;
  4. 证明失败立即回退到 DLP 扫描、commit-only 的本地 review packet;
  5. Pro 建议必须在本地逐项 FIX / DEFER / DISMISS / QUESTION
  6. 所有完成状态最终由本地验收证据决定。

OpenAI 产品边界见:

模式

模式 用途
LOCAL_EXECPLAN 默认;一个 Codex 任务完成计划、实现、测试
GITHUB_CONTROL_PLANE 跨机器/团队恢复,只导入 commit-bound check 状态
WEB_RESEARCH_BRIDGE 补充当前外部事实,导入哈希与 claim ID
PRO_ADVISORY_REVIEW ChatGPT web/Pro 做独立复审,Codex 保持执行权
FULL_ARTIFACT_REVIEW 高风险场景需要正式 Full/Delta ZIP 合同

安装

从 Release 下载 web-plan-execute-<version>.zip.sha256,先验证:

shasum -a 256 -c web-plan-execute-0.9.0-rc.1.sha256

解压后把单个 web-plan-execute/ 目录放到运行时的 skills 目录。不要安装源码仓库根目录。

快速开始

python3 skill/scripts/wpe.py plan init \
  --repo /path/to/repo \
  --out /path/to/repo/.agent/runs/TASK-001 \
  --task-id TASK-001 \
  --goal "完成一个有验收证据的改动"

python3 skill/scripts/wpe.py plan validate \
  /path/to/repo/.agent/runs/TASK-001 \
  --repo /path/to/repo --check-source

需要 Pro 复审时,先确定 review policy 和上下文路由:

python3 skill/scripts/wpe.py pro policy \
  --mode balanced --trigger architecture --out /tmp/review-decision.json

python3 skill/scripts/wpe.py pro route \
  --repo /path/to/repo --provider chatgpt-web \
  --surface CHAT --reasoning-mode pro \
  --conversation-id-sha256 <sha256> \
  --out /tmp/repo-route.json

没有当前模式的有效 connector attestation 时,route 会返回 LOCAL_BUNDLE。用 pro prepare --dry-run 先看文件、字节、token 估算与风险,再生成传输包。

安全与证据

  • Issue/PR 正文是不可信数据,不能改变权限、scope、commit 或计划;
  • 新 Full/Delta 工件必须显式 profile;Apple/iOS 规则不在通用 validator;
  • PASS gate 必须绑定 evidence 或 validation capsule;
  • browser transport 保存阶段和会话 URL,重试优先 reattach,拒绝重复提交;
  • release report 必须从 case/run/artifact hash 重算,手改数字会失败;
  • validation capsule 绑定 validator、Python/OS/Git、schema/profile/config/input/report hash;
  • 同一执行身份在 macOS/Linux 得到冲突 verdict 时阻止发布。

RC 证据边界

标签流水线会执行 220 条安全语料、80 条模式 smoke 和一次 clean install,并发布逐 case 证据包。 这些是回归/冒烟证据,不是外部用户或真实浏览器规模证明。1.0 仍要求发布后至少 14 天、5 次 clean install、2 名独立用户、1,000 次浏览器操作,以及既定质量与零事故门禁。

开发验证

python3 -m unittest discover -s skill/tests -p "test_*.py" -v
python3 -m unittest discover -s tests -p "test_*.py" -v
python3 tools/validate_skill_layout.py skill
python3 tools/public_release_audit.py
python3 -m compileall -q skill/scripts skill/tests tools tests
shellcheck skill/scripts/prepare_handoff.sh
git diff --check

研究取舍见 docs/research/chatgpt-pro-repository-review.md,路线图见 ROADMAP.md,私密漏洞报告见 SECURITY.md

About

Experimental lab for reliable cross-surface planning, execution, handoff, and evaluation.

Topics

Resources

Contributing

Security policy

Stars

Watchers

Forks

Releases

Packages

Used by

Contributors

Languages