Repository navigation
Releases: 54shitaimzf/context-native-agent
Release list
v1.9.1 —— 附录1 开篇那个观察补一条出处等级
v1.9 删掉了序言里对具名模型「被质疑为刷分」那句无出处的断言。但只删不够。
留下的那句,同样是本文说了、却没有角标的断言
v1.9 之后,附录1 开篇是这样:
序言里说的「神鬼二象性」,具体就落在接口面上:Deepseek V4 Pro-0813 在实际发布后饱受诟病,在除了极简模式 + 类 linux 之外的环境下,均难以产生较好的结果。……同一个模型,只换一层交互面,成绩就换了一次。
这句是附录1 整条「接口面是自变量」论证的起点——承重,但没有出处。它的来源是发布后的社区反馈与作者自己的试用,不是受控对照。
A3.7 第一条正好是判例:正文那句「Deepseek 甚至将这个理念写入到了他们的招聘要求中」至今在文里,而 A3.7 用一条把它标成「只见于媒体转述」。也就是说——这篇文章的规矩是保留主张、标出处等级,不是删掉主张。
两处新增(都在附录3)
| 位置 | 加了什么 |
|---|---|
| A3.7 新增一条 | 附录1 开篇那个观察来自发布后的社区反馈与作者自己的试用,不是受控对照;本文拿它当动机、不当证据——拿它当实证来引就越界了 |
| A3.5 第六条 | 补半句:「同一个模型、只换一层交互面」这个对照也还没有人做过,与第一条那个四臂对照是同一族 |
为什么记这条比记「删了刷分」有用:前者护住的是读者别把动机当实证;后者只护住作者自己的记录,而那份记录 REVISION.md 第一节已经兜住了。删除动作本身也不该进 A3.7——A3.7 记的是「本文说了但出处不够」的说法,而一句从未在任何版本里发布过的话,没有条目可记。
顺手把工具补齐
normalize-cjk-space.mjs 收进仓库,与既有的 normalize-punctuation.mjs 同一体例(默认干跑、--write 落盘、认 DOC_DIR / DOC_MD),package.json 加了 space:dry。
v1.9 那次全篇空格统一是拿仓库外的一次性脚本做的——作者下次再改字,同样的不一致会重来。而渲染层不会替我们补这个间距(text-spacing:normal 在 Chromium 上不被支持,CSS.supports 返回 false),所以这条规范得有一个可复算的入口。
核验
- 逐行核对 526 行、未命中 0(v1.9 是 525 行,多的那行就是 A3.7 新增的一条)。
- 角标 126 未变、条目 52、双向 52/52;134 个不同目标,悬空 0;表格 25 块列数一致;图 6 张、页边注 3 条、专名 2 处;溢出正文框 0、残留占位符 0、正文可见星号 0。
- 目录页码 vs 链接目标:30 条,不一致 0 条(A3.8 一句话随内容后移到第 45 页)。
- 胶囊仍 36 处(整句 20 / 短语 16)——两处新增都落在附录,而附录的加粗不套胶囊。
- 页面几何与内嵌字体集合与 v1.9 完全相同。
成品
45 页 · 211 链接 · 6 张图 · 页脚戳 08fd792
底部留白 739.8 → 693.8mm(超 30mm 的页 5 → 6):末页从 210.6mm 收到 142.8mm,是新加的行把末页填了一些。目录页、末页与 p27 那处(图 6 放不下被推走)都是已解释的,不是缺陷。
v1.9 —— Harness 耦合的思考写进附录1;全篇中英空格统一
作者把这篇文章背后的那一路思考,自己写成了附录1 的正文——它从一页扩到约 80 行,成为全文最长的一节。正文一个字没改,只有两处格式改动(末尾加一个指向附录1 的指针;推论 3/3′ 的冒号移入加粗,与推论 1/2 归一)。
附录1 说的是什么
现象是耦合:同一个模型,只换一层交互面,成绩就换了一次。
而模型对这套接口是不自知的——问它「你的读取工具返回什么形状」,它不转述自己的上下文,反而绕出去把那个工具调了一遍、再从代码里推断出一个形状。答案本来就在它眼前,它却绕到外面去取。
根子在:权重就是它的状态,但部署那一刻它冻成了一个静态切面——缺的是状态的动态。于是「外赋的状态永远扩展的是广度,而没有对自己的指涉」,而判断只属于人。
落点句是文章自己的:我们把模型为了框架做的妥协,通过框架所能管理的状态外包了出去。 也正因为如此,那四件代价里没有一件是判断,它们全是表达——所以它们能分别被环境、契约、前缀与按需读回接走。顺着这条线,「单工具」是方向,而不是偏好。
一处实质性口径新增:19% / 66% 的前提
A3.6 增了一行。 那两个差是在基线仍在累积、仍在压缩的前提下做出来的;而附录1 主张的单工具/代码化调用会改这个前提——中间结果前置地不进上下文,基线的堆积变慢、压缩变稀,差要对着一个更小的基准重估。
本文没有测过这一档,所以不给幅度。 方向是确定的:本文也吃到往返数下降的收益(落在少写、少背),基线吃到的是少压缩,两边同时变化,差只会变小;而代码化压的是取数往返、压不掉判断往返。
写这一行不只是尽诚实义务:文章一边主张单工具方向、一边不提它对 A2.4 那个差的影响,本身不自洽。
还缺的两条量级对照
A3.5 新增第六条:附录1 的两条推断定性成立、但没有量级对照——返回值作为「结论」是否足以支撑下一步(省在哪一档、省多少没量过),以及为工具形状做拟合训练所需的数据量是否真的大于只训练通用代码能力。
全篇中英空格统一
这是本轮最大的一处机械改动:65 行、净增 271 个空格,只增删空白。
动手之前先量了渲染器:build-html.mjs 里那句 text-spacing:normal 在 Edge 153 上不被支持,所以 PDF 里的中西文间距完全来自源文件里的字面空格——源文件混着「有空格」与「没空格」两种写法,PDF 就跟着一起不一致。方向定为「一律加」而不是「一律不加」:.md 本身也是发布物,而 GitHub 不认 text-autospace,不加空格在那边会挤在一起。规则只在中文字与拉丁字母/数字(含 % 与上标 ²³)相邻处插一个空格,不碰全角标点与拉丁的邻接、不碰 汉[12] 角标、不碰行内代码与数学。
这一改连带暴露并修掉了构建脚本的一处静默失效:页边注与两张架构图是按文字前缀挂在 Markdown 上的,空格一加,图 3 与两条边注会静默消失,而页面照样生成。现在锚点比对改为先去掉全部空白再比,并在构建末尾加了硬自检——图必须 6 张且编号 1–6 齐全、边注 3 条、专名 2 处,不符即以非零码退出。
链接、页码、索引的核验
- 211 个链接不变:角标仍是 126 个 → 52 条,双向 52/52;134 个不同目标,悬空 0。
- 目录页码 30/30 与链接目标一致,两轮收敛。
- 表格 25 块列数一致 0 块、横向溢出 0/25;图内文字越界 0;溢出正文框 0。
- 逐行核对 525 行、未命中 0;残留占位符 0;引号 288/288 平衡、ASCII 直引号 0、直角引号 0。
- 页面几何与字体与 v1.8 完全一致:MediaBox 594.96 × 841.92、内嵌字体集合逐字相同(
NSimSun在 v1.8 里就有,不是本版引入的回退)。 - 正文文字横向 22–173.8mm,超出的 1.8mm 是行末标点悬挂,中文排版的正常行为,不是溢出。
成品
45 页 · 211 链接 · 6 张图 · 1506 KB · 页脚戳 774789c
底部留白全 45 页合计 739.8mm,超 30mm 的 5 页:目录页与末页(结构固有),以及 p26 与 p27——其中 p27 那 69.9mm 是图 6 放不下、被推到下一页(.fig{break-inside:avoid} 的既定行为),已逐页核过,不是渲染缺陷。
v1.8 —— 对话原文在这套架构里的位置(附录三处新增),正文一字未动
在附录补上一件事的位置:对话原文。正文一字未动。
起因是一个真空
正文说上下文随时能从「环境 + 协议」重建。但「用户说过什么、我说过什么」重建不出来——代码是那个状态,不是那段对话的函数。所以对话原文必然落在环境那一侧,这是既有主张成立的前提,文章原来没写出来。
讨论之后定成一条主命题的推论,而不是新增好处:原文零有损冷存在环境侧 + 按需回查 + 不建索引。三条理由:
- 既然触发者是用户,检索的键由用户免费提供——他说得出那个概念,模型手上就有词了。所以不需要 embedding、不需要语义索引,也不必预先判断"什么值得记"。这同时绕开了序言里记录过的那个坑(embedding 区分度极低,RAG 因此搁置)。
- 不建索引还避免引入第二个不可靠环节:让模型申报"我刚才断言了什么"必然漏、必然错,会与 A3.6 已承认的"意图映射无机械校验"相乘。
- 累积式的活法里对话本身就是上下文,窗口一满就得摘要;本架构里对话不是上下文,所以留档能做到无损——不是因为我们更小心,而是因为对话已经不在窗口里了。
三处新增(都在附录)
| 位置 | 加了什么 |
|---|---|
| A2.6 第(10)条 | 对话原文不必再当上下文,因此可以无损留着。含必要性、收益、机制(按需回查)、防误读(反对的是"把日志当上下文",不是"有日志"),以及兜底:正文那条「写对提示词的重要性下降」成立的前提,正是「说漏了还能回头查」——查不到,人就会退回一次说全 |
| A3.6 新增一行 | 适用范围:这是体验层的保证,不是正确性保证;词法检索只在用户喊出当时那个词时有效;查不到时不编;不进 A2.4 的账;留存策略与访问控制属工程细节,本文不规定 |
| A3.5 新增第五条 | 体验这一侧,本文没有给出判据,也没有任何对照——成本侧有三个可复算的数、不确定的部分有四条例外与待测项,体验侧至今只有零散的好处条目。列出三个只能靠用户实验回答、本文一个都没测的问题(说漏了能不能低成本收回/用户能不能预期"过了这一步它还记不记得"/能不能不描述、直接指着说"照那个来") |
体验侧那三个问题故意只写问句、不造术语:若给它们起名,就是给一篇已经自造了意图映射、契约、段序、有效前缀组装、有效残留、四个台阶的长文再加三个名词。
正文不动是有意的:正文那六条是「相对主流的优势」,收尾两条落在模型那一侧(适配性、能力);再插一条"不省 token、只兜住体验"的条目会让它变成好处罗列。而文章已立好规矩——未计账的东西进 A2.6。
链接、页码、索引的核验
- 211 个链接不变:新增三处不含任何引用,角标仍是 126 个 → 52 条,双向 52/52;134 个不同目标,悬空 0、解析不到页码 0。
- 目录页码 30/30 三方一致(页码表、目录印刷页、PDF 每页实际文字)。两个标题后移一位:A3.1 条目 31 → 32、A3.8 一句话 41 → 42。
- 表格 25 块列数一致 0 块、横向溢出 0/25(新增长行没有撑破版心);图内文字越界 0;溢出正文框 0。
- 逐行核对 508 行未命中 0;残留占位符 0;引号 272/272 平衡、ASCII 直引号 0。
- 一个意外的好处:新增的加粗没有变成胶囊——阅读增强只作用于序言与正文,附录里的加粗按普通加粗渲染,所以不必迁就胶囊长度(胶囊仍 36 处)。
成品
42 页 · 211 链接 · 6 张图 · 1468 KB · 页脚戳 b780794
v1.7.1 —— 交付核验:目录页码归位,正文新增「在需求表达层面」
一次交付核验的补丁版。以 PDF 为主要交付(context-native-agent-v1.7.1.pdf),HTML 与 Markdown 源文件在仓库里。
这一版修了什么
一、目录里「具体实现」的页码错了:印 6,实际在 7。(v1.7 的成品也有这个错。)
根因在构建脚本 build-pdf.mjs:它按「标题文字在正文里第一次出现的页」定页码,而「具体实现」这个词在第 6 页的行文里先出现了一次(“Git 只是一个具体实现”),标题本身在第 7 页。长标题踩不到这个坑,短而通用的标题会。现在改为以锚点自己的链接目标页为准——那既是读者点下去会到的那一页,也正是目录该印的页码;文本反查降为兜底。重建后 30 条页码全部由锚点给出。
二、A2.6 的条数过期。 v1.7 给 A2.6 加了第(9)条,A2.8 里「在能力上表现为 A2.6 那八条」没跟上,改为「那九条」。
三、A2.7 收尾一处口径自相矛盾。 原文写「三条……它们的证明不在账上,在 A2.6」,而 A2.6 自己的开头明写「它是未计账的收益清单,其中多数是方向性证据,它不构成『我们能在 20% 的水位上正常工作』的证明」。改为「它们成不成立不在账上,要看 A2.6 那批方向性证据(完整证明还没有做)」。
四、正文新增一条优势(这一条在 v1.7 发布之后才加进来的,所以它首次出现在这一版):「相对主流的优势」增加「在需求表达层面」——写对提示词的重要性下降,因为它从用户的手艺变成了架构里的一个部件。降的是修辞那一层(人设、格式模板、咒语),升的是结构那一层(什么进前缀、段序、给哪些工具);省下的是表达,不是判断。
链接与页码的核验结果
- 211 个链接全是内部命名目标(目录 30 + 角标 126 + 回链 52 + 页边注 3),没有外链——引用条目本身不带 URL,与源文件一致。
- 134 个不同目标:悬空 0、解析不到页码 0。
- 目录页码 30/30 三方一致:页码表、目录印刷页、PDF 每页实际文字。
- 正文与附录里 40 余处
见 A2.x/A3.x/附录N、3 条页边注、图注里的「数据源」,逐条打开目标节核对,除上面两处外全部准确。 - 这一类核对已固化为每次构建自动跑:
verify.mjs新增「目录页码 vs 链接目标」一节,不一致就报出来。
成品
41 页 · 211 链接 · 6 张图 · 逐行核对 505 行未命中 0 · 溢出正文框 0 · 表格横向溢出 0/25 · 残留占位符 0 · 页脚戳 b4278f7
账里的数字、公式与四条例外一个没动。
v1.7 — 可读性收口(定稿)
正文九处最小改动(一处口径扩写、四处当场夹注、两处改名、一处指针、一个多余的「的」),附录二十处口径与定义;账里的数字、公式与四条例外一个没动。
要点:
- 那句模型口径写全了——对单模型串行、对「贵模型规划、便宜模型执行」都更优;而主与子同模型时更优(同一份缓存前缀在两边命中),模型不一致也不影响结构成立,丢掉的只是这一层折扣。
- 附录2 六处读者会算出不一致的地方改齐:E_b 公式第二项按重读段 C_r(9.2k)计而不是残留 C_c(15.2k);「低估约 28%」改为 22%;「重置频率约 1/N」改为「约一半」;63k 那条线补上前提(保守档只有 34k);「1.33 倍」换成可复算的 2.4 倍;A2.0 里那个没有出处的「重置 2%」去掉。
- A2.7 唯一一处「按指引进去找不到答案」改齐:能力证明尚未做,A2.6 只给方向。
- 新增 A2.6 第(9)条:跨模型的那条分工不靠把计划再发一遍。
41 页 · 211 链接 · 6 张图 · 逐行核对 504 行未命中 0 · 页脚戳 eb3a628
v1.6.1 — 模型一致性从「要求」降为「更好」
正文一处口径改动:主 Agent 与子 Agent 模型一致时更优,模型不一致也没问题。配套:附录3 A3.6 新增一行口径(前缀单元按模型分家,摊薄与命中价只在同模型下成立),图 4 论点行末尾标注「(同模型;见 A3.6)」。
同时修掉视觉复核量到的图 4 两处瑕疵:箭尖离目标框 1.2mm 悬空,现已贴到框上。数字与公式一个没动。
40 页 · 211 链接 · 6 张图 · 逐行核对 496 行未命中 0 · 页脚戳 0bb521d
v1.6:整套图重做(正文三张 + 附录2 三张)
v1.6 — 整套图重做:正文三张、附录2 三张
起因是你问「图有没有过时或者需要更新?我觉得目前的图没有完整体现我们架构真正好的设计点」。我先做了一轮图审计,结论是:图 1(四个台阶)不过时;图 2(三种活法)图内标签过时(@8% 那档还写着「不可达」,而表格与图注早已改成「纸面点」);图 3(一轮的动作)有四处与现行口径不符——环境框写「环境共享」、前缀只画三段漏了「项目结构说明」、合并栏只写"重写意图映射"、完全没有段序。
更要紧的是:图 3 是一张流程图。它回答"一轮里发生什么",不回答"为什么这样就好"。我请一个只拿图、不看文章的读者描述它,他记住的是"一份共享前缀+四个并行分支+一次合并"这个形状,却答不出「P 是什么」「意图映射对应哪一块」「回环线送回什么」。而全篇最硬的三个机制点——低水位是拆分出来的、共享的摊薄形状、两个尺度的重启——一张图都没有。
新图集(编号按阅读顺序)
| # | 位置 | 论点(图顶那行字) |
|---|---|---|
| 图 1 | 正文·「被换掉的是解空间」末 | 理解与干活分成两层,上下文才可能一直短 |
| 图 2 | 正文·「具体实现」首 | 一轮里变的是尾部那一段,不变的是整片前缀 |
| 图 3 | 正文·「具体实现」尾 | 重启有两个尺度:目标与轮;一轮之内不换前缀版本 |
| 图 4 | 附录2·A2.1 本架构成本表后 | 未命中按前缀版本数计,不按分支数计 |
| 图 5 | 附录2·A2.2 台阶表后 | 一份内容的四种价钱(原图 1) |
| 图 6 | 附录2·A2.5 活法表后 | 三种活法与本架构(原图 2,图内改一个字) |
图 2 现在把四段前缀按序画出来(前两段整轮逐字节不变、后两段每版更新,各带一条括线),环境画成底层内容一份+每分支一份虚拟工作区(写时才占空间),主 Agent 与分支之间有委派与信号两条箭头,回环箭头指向"整片前缀"的括线而不是最后一格。图 3 把**目标级(一次任务边界)与轮级(轮末归并、前缀换代)**分成两层,并标出"一轮之内不换前缀版本""未命中按版本数计"。图 4 用"一版前缀 → 四个分支各命中"与"换代 → 一次未命中"把摊薄的形状画出来。
四轮视觉复核逐张修掉的真缺陷(节选)
- 图 1:论点行原用了「低水位」,而这个词在正文里从未出现(首次出现在附录2)→ 改成白话,图注里给"水位"下定义;我用空心方块当"纸面点"标记,而同一个符号在图 5 里表示"0(不付)"→ 去掉方块;右面板"两层"没画出来 → 加"理解层/干活层"标签与分隔线。
- 图 2:环境那行说明骑在虚线容器边框上、左端露在框外;合并条两行只隔 4px;回环箭头指在最后一格上;从横条向下四支箭头扎进容器 6px;两段分组只靠 12 级底色差(灰度打印会消失)→ 逐条改,并加两条带钩括线。
- 图 3:面板中央那支竖箭头正压在"分支 3"的左边框上,而"哪一支在写回"全靠它表达 → 改成四支箭头分别落在每个分支框中心;分支行右端比上下通栏框短 11px → 重排对齐;两句注解没有引线 → 加引线/移进面板。
- 图 4:起点处横轴与两条折线挤成一条(5–6px)、基线右端以悬空竖线断头、起点三个小圆点相切粘成一串、图注写"计费次数"而图上写"累计重读次数" → 拉开层级、末级平收、去掉圆点并把第三条线(若按分支数计)改成文字对照,不再塞进同一个小坐标区。
排版规矩也写进了 REVISION.md 第五节:一图一论点行、一张图不超过六个主体块、图注只写图上没有的信息、图内自足(正文一处"见图 x"都不加)。
校验
40 页、210 个可点击链接、图 6 张;逐行核对 495 行未命中 0(这一版正文一字未动,图与图注都长在渲染层);角标 125、条目 52、双向 52/52;内部链接 134 无悬空;溢出正文框 0、图内文字越界 0、表格横向溢出 0/25;目录 30/30。
代价与意外:页数 39 → 40 页,但底部留白反而从 618mm 降到 607mm(均 15.6mm)——新图吃掉的正是原先空着的地方。内容优先于页数这一条不变;末两页的留白(47mm 与 145mm)留着,要收觉得动附录3 尾部或挪图,属于另一轮。
v1.5.6:正文四处措辞收窄
v1.5.6 — 正文四处措辞收窄(第二轮术语对齐)
这一版来自作者对我提的十个「不明白」的逐条作答。口径整体落进 UNDERSTANDING.md(读错清单 12 → 17 条),其中四处需要动正文,逐条批准,都是半句到一处词,不改文风、不动结构。
这一轮对齐上的是什么
- 重启点=任务边界=用户目标;归并是实现途径。任务太大就被拆成多轮「分支并行 + 归并」(主 Agent 的活)。于是重启有两个尺度:目标级(用户给新目标)与轮级(一轮末归并=对代码库、功能与意图状态的一次大更新,前缀随之换代)。"不必等全部完成再归并"说的是不必等整个目标完成——一轮一收,一轮之内不换前缀版本(附录2 那条"未命中按前缀版本数计、不按分支数计"就架在这上面)。
- 并发是响应式的:用户与子 Agent 都是输入信号,主 Agent 的契约是一份声明,系统像前端框架的响应式+声明式 UI 那样重新求值。
- "最大前缀组装"有两个"最大":共享字节最大、尽量前置;保住文件本身的结构性,装出来的形状要对齐模型训练时反复见到的 tools/文件格式。
- 段序:易变段(意图映射、系统状态)固定在前缀尾部,稳定段在前——"变动的只落在尾部、没变的部分逐字节相同"才成立(正文不展开,但它是账的前提)。
- 环境:底层内容一份,每个分支一份虚拟工作区(写时才占空间,以内存换效率);难点是虚拟文件的编译与测试。
- 模型一致性=主 Agent 与子 Agent 用同一个模型,为的是同一主子模型下缓存对齐最大化;跨模型时仍优于"大模型规划、小模型落地"。"理解/执行解耦"解耦的是职责,不是模型实例。
- 不变量:对齐理解必须在主 Agent,具体落地必须委派——哪怕不分支也要委派。 不易解耦时分支变少、缓存共享的摊薄变差,这就是"轻微额外成本"的落点;线性结构是分支循环重启结构的特例。
- 冲突由主分支依它制定契约时的那份上下文审查、择优采纳;解耦了探索与落地、又事先有契约,巨大冲突是小概率事件。
正文四处
| 位置 | 改了什么 |
|---|---|
| L105(我上一轮插的那半句) | 补上轮级重启:「重启点由任务边界给定**(一个目标之内,每完成一轮归并又是一次)**,到点重建一次,边界内按需存取」 |
| L157 | 「理解/执行模型解耦」→「理解与执行解耦」(删"模型"二字,免得读成两个模型) |
| L153 | 「代码映射」→「意图映射」(一个东西两个名字,统一) |
| L187 | 「回退到主Agent/少分支结构上」→「回退到少分支、乃至单分支的结构上,落地仍然是委派」 |
校验
39 页、210 个可点击链接;逐行核对 495 行未命中 0;角标 125、条目 52、双向 52/52;内部链接 134 无悬空;溢出正文框 0、图内文字越界 0、表格横向溢出 0/25;目录 30/30;胶囊 35 处(整句 19 / 短语 16)。
视觉复核第 6、8 页:无孤字底块(那个 33 字整句胶囊这次折出 17 字续行)。第 8 页末行只有「样。」两个字——查明不是本轮改出来的:v1.5.5 里同一段的同一处折行本来就是这个两字末行,当时落在页面中部;本轮内容把后面各推下两三行,它才落到页底,而 p{orphans:2;widows:2} 让下一段整体移到第 9 页(p8 只剩 12.7mm,不足两行)。控制规则在正常工作,不是排版错误;能解它的是 text-wrap:pretty,但那会重排全部 39 页,属于版式约定,等你定。
留白
618mm(均 16.3mm/页),比 v1.5.5 的 645mm 反而少了 27mm——四处措辞把那几页原先的余量填掉了(第 14 页 46mm → 7.9mm)。页数仍是 39 页。
v1.5.5:正文六处定性收口
v1.5.5 — 正文六处定性收口,理解文档三处实质改正
这一版是作者与我的第二轮对齐:作者要求「根据理解文档继续对齐,还有什么内容是你质疑的,聚焦正文,关注定性」。我提出十二条质疑,作者逐条回答,其中六条落成正文改动——全部是半句到一句,不改文风、不动结构。
正文六处
| 位置 | 改了什么 | 为什么 |
|---|---|---|
| 推论3(普适) | 「上下文照样要重建、切分、合并、重载,只是没有需要维护的环境实体」→「上下文那时就是全部环境,状态同样要以一个个可指认的单元保存下来、像文件一样被管理」 | 原句字面把「没有环境实体」写成唯一差别;作者的原意是四步的形态:纯 chat 里状态仍要以单元形式、像文件一样被管理 |
| 「投影」那一段 | 补一句:新上下文里住着两种东西——环境里已有的(代码、状态、依赖)离开随时能取出;环境里没有的(意图映射)离开就得重新读懂,所以它不离开,读懂之后写下来、靠每步复用摊薄 | 前缀里最贵、最必须每步被读的那一段没有原像,它不是投影回来的,是写下来的 |
| 「构建可被规划」 | 加限定:「重启点由任务边界给定,到边界重建一次,边界内按需存取」 | 主 Agent 的循环重启本身就是重建,只是以任务边界为粒度 |
| 「错的代价不是损失」 | 「猜错了」→「猜偏了,也只是多背进来一点为真却用不上的背景信息」;并加括注收窄定义域 | 原文的保证只在多带了为真但无用的内容时成立;把错的地图装进去,代价是做错决策 |
| 「环境 + 协议」 | 补括注:协议即每个模型自己的上下文与工具拟合形状(见附录1) | 「协议」全篇只出现这一次,指的是解耦 Context 之后那层模型上下文耦合兼容层 |
| 能力口径两处 | 「确保模型能力发挥稳定」→「让同一个模型发挥得更充分」;「能力下降被有效控制」→「中段迷失与能力衰减被压住,而更短、更聚焦的上下文本身就让同一个模型发挥得更好」 | 与附录 A2.6 已纠正过的口径拉平(正文并非整体保守,L105 本来就写了「干净上下文本身的能力增益」) |
文档与理解
UNDERSTANDING.md三处实质改正:§3「构建可被规划」两侧都成立(原写成只适用子 Agent);§2 补「投影只覆盖一半」;新增「协议」的定义、「错」的定义域,读错清单由八条增到十二条。REVISION.md记 v1.5.5,并修掉两处陈旧数字(正文表格 26 → 25 张、胶囊 17+12 → 19+16)。- 顺手修掉附录2 里两处遗留的 ASCII 直引号(0 直引号是硬不变量)。
校验
39 页、210 个可点击链接;逐行核对 495 行未命中 0;角标 125、条目 52、双向 52/52;内部链接 134 无悬空;溢出正文框 0、图内文字越界 0、表格横向溢出 0/25;目录 30/30;胶囊 35 处(整句 19 / 短语 16)。
如实报一笔
底部留白 624 → 645mm(均 16.0 → 17.0mm),页数仍是 39 页。正文六处收口加了约 400 字,先填掉第 6 页原先的 53mm 余量,再逐页把后面各推下一两行。视觉复核还抓出一处真瑕疵:我插在段首的那句限定把同一个 33 字整句胶囊的折行点推出一格,第二行行首只剩一个带深色底块的「分」字——把插入句「边界之内」紧成「边界内」,折行点退回一格,残片归零,复核确认消失(整句胶囊必须允许折行,故不能用 v1.5.4 那种 nowrap 的解法)。
v1.5.4:正文精准修复、附录口径纠正、理解落盘
正文只动三处,都是 v1.5.2 我引入的问题(作者指出后按"不改文风结构"修复)
- 合并那一步的括注:恢复被我删掉的「写的量小一个量级」这一点(原句节奏不变),不再与十六行后的 L169 说同一句话。
- 同一句的主体:主 Agent → 主 Agent/委派 Agent;加粗从通用动词「更新」移到机制术语「分别装配」。
- L169(作者原话,一处换词):每轮整体重写 → 每轮都要更新一版,消掉"模型把前缀整篇重写一遍"的误读。
附录按作者两处纠正改齐口径(数字与公式一个没动)
- A2.6 第 1 条:撤掉「本架构不是让模型更强,而是让同一个模型少受长上下文拖累」——更短、更干净、更聚焦的上下文本身就是能力上的更强。
- A2.7 第二条:基线那一侧的 8% 连假设都不是——它只有一层上下文,理解与干活挤在一起,串行又不拆分,就不可能不带着足量的信息工作;压到 8% 省下的正是它干活所必需的那部分理解。同时补上正面机制:低水位不是设计出来的,是拆分出来的;而拆分的前提是先有一次全量理解。"两边都按在 31% 时贵 12%"降为算法核对。
- A2.4 / A2.5 / A2.8 / A3.4 与图 2 图注同口径对齐。
新增 UNDERSTANDING.md:把理解落盘
三层称呼、命题、机制(前缀是什么/谁产出谁装配/更新时机/"回读"不是禁忌/主 Agent 与子 Agent 的差别/低水位从哪来)、成本口径、为什么比现状优的九条、边界与缺口、已经读错过并被作者纠正的八条、文件地图。它明写"不替代正文,口径冲突以正文与附录为准"。
排版
窄胶囊加 white-space:nowrap,修掉 span.em 右溢 2px(一个短语胶囊折在行尾只剩一个字,底色带顶出版心);自检诊断补上问题元素的文字与行内片段数。
代价如实记:成品 38 → 39 页,底部留白 471 → 624mm(均 12.4 → 16.0mm/页)。主体是附录2 那段口径纠正净增约半页,把原先排满的第 38 页顶出一个新页。内容优先于页数。
校验:Markdown 与 HTML 逐行比对 495 行未命中 0;125 处角标 / 52 条双向可达;25 张表列数一致;134 个内部链接无悬空;溢出正文框 0、图内文字越界 0、表格横向溢出 0;A4 39 页、210 个链接。