
术语纪律本文沿用《你拼命消除的正是智能》的用法——「幻觉」事实误差/错误与「注意力」概率权重均加引号皆为借来未厘清的词。“癌症不是我加的修辞是书里的原词§5.4.3 边栏点名两类工程癌症”——上下文污染与循环推理——并给出了唯一根因。本文做的事是把这颗癌从第一个细胞讲到全身转移。〇、为什么偏偏是癌不是bugbug 的隐喻是外伤哪坏了修哪修完就好。癌不一样。癌有三个定义性特征不是外来感染是自身机制被劫持——癌细胞用的是机体自己的复制机制不报错——它不触发告警形状上是合法组织自我喂养——它会为自己接通血供越长越壮。上下文污染恰好三条全占错误来自模型自身的生成机制不是外部注入每一步都通过格式校验schema 合法、字段齐全而系统的记忆机制亲手给它供血。这就是为什么书不叫它 bug叫它癌——你没法修掉它只能切断它的形成通路。下面按病理四期看它怎么长。一、第一期突变——那个必然产生的错细胞癌的起点是一次复制错误。大模型的复制错误书在 §3.1.5b 给了三层根因根因 AΣ1无弃权桶输出层 Softmax 必须把概率压到某个 token 上架构级没有我不知道、先去核验的原生槽位根因 B自回归强制吐字每步必吐一个 token 才能继续且一旦提交永久成为后续上下文、无法回改根因 CMLE 无真值损失函数里根本没有事实准确性这一项流畅的假话与流畅的真话被等同对待。Kalai 等arXiv:2509.04664严格证明了生成错误率存在非零下界——即便语料零污染「幻觉」事实误差/错误率也不会归零。翻译成病理语言突变率不为零这是当下训练配方的数学必然。第一个错细胞一定会出现问题只在它接下来能长多大。注意这一期不是癌——人也会记错一个名字那是单点事实误差有界、静态、错就错在那一个点。二、第二期原位生长——雪崩但有界错 token 被提交后事情开始变化。自回归架构没有修订路径这个低相关 token 进入上下文抬高了下一步更多低相关 token 的概率沿链累积——“越写越离谱”。这是书里的雪崩机制单点误差在强制补全下滚成系统性离谱输出。但请注意机体的天然边界雪崩绑定在单条自回归轨迹内。结束符EOS一停下一条轨迹重新 Σ1放大链断开L0 架构层。也就是说在单体时代这颗瘤是原位的——它再离谱也死在一轮回复的边界里。你重开一个会话它就没了。单体大模型的病到这一期为止。癌变发生在下一期——而下一期的通道是多智能体系统自己修出来的。三、第三期突破基底膜——两条转移通道多智能体把生成串成了流程上一个节点的输出是下一个节点的输入上一轮的对话被塞进下一轮的上下文。原位肿瘤由此获得两条转移通道。必须钉死这两条通道与雪崩是不同机制——雪崩是单轨迹内的放大转移是跨边界的携毒GIGO二者互补、不可混为一谈§3.3.3 边栏原文的区分。通道一跨节点——格式闸门挡形状不挡错误。刚性 DAG 里节点衔接由脚本负责脚本只校验字段齐全、类型对、schema 通过——即格式不碰语义。一个形状合法、内容却错的前提会被原封不动喂给下一节点。举个例子Agent A 断言接口返回的是毫秒时间戳实际是秒这句话字段齐全、类型正确闸门放行Agent B 据此写转换代码Agent C 据此写测试用例——测试还通过了因为测试和代码错得一致。癌细胞过了免疫检查点不是因为没有检查而是因为检查的是形状不是恶性。通道二跨轮——原始上下文被当成记忆回灌。这是书给出的唯一根因§5.4.3 边栏原话“根因只有一个原始上下文被当成记忆回灌”。行业追求通用记忆把对话每句话无差别塞回上下文美其名曰记忆——于是本该死在本轮边界的推理链含它的错误与循环拿到了跨轮通行证。上面那个时间戳断言第三轮之后已经不是某个 Agent 说过的话而是上下文里的既定事实——没人记得它需要核实因为它看起来一直都在那里。四、第四期定植与免疫逃逸——癌变完成错误一旦落进记忆性质就变了它从推理过程中的一步固化成了系统的前提。污染的不再是过程是地基。此时两个恶化条件接管战场恶化条件一弱分化 → 低质量共识盖章。系统里明明有多个复检角色为什么没人揪出毒因为角色只换了人设标签看问题的决策轴没有显著可分——视角重叠面大。复检者与肇事者从同一个角度打量同一句断言谁也照不见对方的盲区。于是他们达成一致——注意书的纪律共识没有真假只有质量高低。这份共识的问题不是假而是放到统一标准下校验、放进结果导向情景错误率高——共识质量差。N 份相同偏见收敛到同一个自信的错误§3.1.5a。这是最标准的免疫逃逸不是免疫系统缺席是免疫细胞和癌细胞长着同一张脸。而且它比报错危险得多——报错会叫低质量共识不叫它还给肿瘤盖了健康组织的章。恶化条件二循环推理 → 无限增殖。推理链无终止错误沿回灌跨轮退化成 step repetition / 死循环MAST FM-1.3。书对停止有精确定义收敛是动态过程共识是它的涌现退出条件——最后一个有依据的意外被裁决、被消化后系统自然不再转§5.1.2/§5.1.3。而在被污染的系统里这道涌现门坏了没有真实冲突可裁决大家共享盲区也没有新信息进入回灌的都是旧毒循环失去了自然停下的理由只能靠预设步数或超时被硬截——那不是收敛是耗竭。至此癌变完成突变必然的错 token→ 原位单轨迹雪崩本有界→ 转移格式闸门放行 记忆回灌供血→ 定植固化为前提 免疫逃逸低质量共识确认 无限增殖循环失去涌现出口。每一期单看都不致命连起来就是绝症。五、根治不是化疗是断血供对着形成通路逐期拆就是书 §5.4.3 的答案。注意它不是杀死已有的错误种子错永远会有突变率非零而是让错误长不成癌1. 每轮重置原始上下文——斩断转移通道二。本轮推理链含其循环与污染死在本轮边界循环无法跨轮。这是把 L0雪崩封顶于单轨迹的思想从生成内推到轮次间。重置斩断的是原始回灌不是记忆。2. 结构化、经仲裁的项目日志——只给健康组织发通行证。日志由多角色共建冲突上报、双审、规则更新是体外器官L485而非收据。书的原话它只跨轮存活结构化且验真过的内容癌症无法迁入。这一步补上了格式闸门缺的那半边格式闸门查形状仲裁查语义。有人立刻问重置不丢信息吗书的回答很干脆——看似丢实则未丢。每轮所需上下文由两处持久源重组各角色的角色定义 结构化项目日志N 个角色各带聚焦视角集体重建的是经仲裁的高保真记忆优于原始 dumps。CoordClaw 实测里长任务目标始终稳定正因为目标活在角色定义与结构化日志里、每轮重读不押在会被重置的临时推理链上。3. 抬高分化程度——让免疫细胞换张脸。治免疫逃逸的不是加更多复检员N 份相同偏见还是那个错而是让角色的决策轴显著可分不同的优先级、不同的盲点、不同的判断框架。分化只有程度之分分化程度越高那句毫秒时间戳越可能撞上一个从数据一致性角度打量它的角色。分化治不了共享先验盲区的残余——那是更深一层的边界交给下一条。4. 按需调用真值锚——对可核实断言拉核实杠杆。接口返回什么单位是可以拿真值锚核掉的发个请求看返回值一秒见分晓。注意书的纪律真值锚是按需调用的核实杠杆不是每句话过闸的门槛——不是所有断言都要验、也不是验过才准入库而是当断言可核实且分量重时有人负责去拉这一杆。它治的正是分化够不着的种子错。四条合起来就是四重纪律纵向防回灌重置、横向防混用项目隔离不通用、结构化 仲裁后日志才是记忆、通用只在元层组织设计分工不在执行层一套记忆通吃。六、尾声记忆无罪执念有罪最后把两句诚实的话说完。第一靶子从来不是记忆本身。记忆是体外器官是正解靶子是无结构、无仲裁、全量回灌的那种伪记忆。行业把通用长记忆当圣杯去追恰恰是把癌症的血供当成了营养液——这背后是那个更深的执念以为记住一切、消除一切不确定系统就完美了。书把这个执念列为笼子的第三态也是最深的误区。第二结构只能抑制不能消除§5.3.2 边栏的诚实边界。角色锚定 重置 仲裁 真值锚是提高稳定性、抑制漂移与污染的工程约束不是免疫承诺。突变率非零是数学下界共享先验盲区是路径依赖的代价——智慧的前件同时是它的阿喀琉斯之踵。协作的目标是收敛到更低错的共识不是杜绝问题共识错误率的地板由先验种子决定。所以这篇病理报告的结论只有一行癌不是长出来的是喂出来的。错细胞必然出现不可消除但转移通道是工程自己修的可以拆除。你拼命给系统灌完整记忆、拼命消除每一处不确定的时候喂的正是那颗癌而斩断回灌、让不确定性在结构里显形、冲突、被仲裁——癌细胞还会产生但它永远停在第一期。