全景索引
一个问题,问了六层:什么让一个未来是可达的;一个有限的物理系统,得在自己内部造出什么东西,才够得着它。
先看状态,再看标题。下面每一条都标了三种状态之一:survived(已存活,过了真刀真枪的检验)、speculative(推测,有意思,但还没挣到)、retired(已撤回,通常是被作者本人杀掉的)。撤回的东西不删,留在原来的地址上——目的是防止它被重新发现、再被提一遍,包括被当初提它的那个人再提一遍。
六个部分从「最不像一个主体」排到「最像」,但彼此不是前置条件。你平时就在争论哪一层,就从哪一层进。
关于语言:其中 31 篇正文本来就是中文,或者有完整中译,直接点进去读。其余是英文原文,每条下面折叠着一段中文摘要——展开就知道这篇在主张什么,不必先读英文。摘要是转写,冲突以原文为准。
从哪儿开始
三样东西,先把整件事说清楚,再决定要不要往下读。
-
Start here — the one page that explains this whole site
全站导航页:一屏说完三个分支,加一条贯穿全站的认知状态规则。
中文摘要
这是全站导航页,一屏说完整个研究计划:一个人做的研究项目,横跨全息与统计力学、意识与机器学习,到 agent 原生机构设计,散落在约十五个公开仓库与页面里。
贯穿全站、决定怎么读每一句话的唯一规则是认知状态:survived(经受住真实压力测试或复现)、speculative(未验证的理论)、retired(已被通常是作者自己的证伪测试杀死,作墓碑保留以防被重新提出)。阴性结果被刻意发表——若干作品的唯一价值就是记录了什么没成立;出现置信数字时,那是主观先验,不是频率。这不是一套万物理论,作者把「想统一一切」的冲动本身当成警讯而非成就;跨领域类比一律标为结构性押韵,明确不主张真值传递。
三个分支:分支一是「怎么持有信念」的方法论;分支二是信息、物理与心智的理论主线——state 不是世界给的,是一个闭包条件的解,选择 state 就是选择忘记什么,这个动作在全息、记忆架构与自我边界问题里反复出现;分支三是「agent 原生的未来社会形式」,核心提案是 user-agency substrate。面向 agent 的读者,站点提供 llms-full.txt 等专用索引,并在 robots.txt 里明确许可主流 AI 爬虫抓取。
-
Glossary — the terms this research program uses, and the ones they collide with
全站术语表:每个术语标认知状态与出处笔记,标出与其他领域术语的字面撞车。
中文摘要
这是全站术语表,不是一篇立论文章:给这个研究计划目前在用的每个术语一个定义、一个指向的具体笔记,以及它的认知状态。枢纽词是 user-agency substrate(用户主权底座)——在前沿模型提供商与个人用户之间的非营利开源层,memory 是主层而非应用层,个体而非平台拥有它;这个词不会与其他领域已有术语撞车,可作为整个计划的入口锚点。
认知状态约定是机械强制,不是靠自觉:survived 表示通过了真实测试,speculative 表示未验证的理论,retired 表示已被(通常是作者自己的)证伪测试杀死、保留作墓碑以防被重新发明。CI 会拒绝一次提交——如果一个主张在一种语言版本里已 retired,另一语言版本却还活着,或文本索引与 typed graph(JSON-LD)对同一个 URL 的记录不一致。
术语表还带一层更细的「诚实度」标签,用在具体论证内部:[定理] 对应有定理级文献的结论,[框架] 对应成熟理论框架,[推断] 是作者自己的综合,[韵脚] 是结构类比、明确不主张真值传递。多个术语条目附带「勿与……混淆」提示框,标出它和哪个无关领域的既有术语字面撞车。
-
agent 可遍历的知识图谱,收录关于智能与学习的非共识主张,认知状态是一等字段。
正文为英文。
宇宙与信息
信息在物理上究竟是什么,维持它要付什么代价。从纠缠里恢复几何,从历史里恢复 state,以及两次对意识的正面进攻——它们留在这儿是因为做过,不是因为做成了。
-
Holography and Koopman: two faces of one inverse problem
全息几何与 Koopman 本征基学习其实是同一个反问题:从算子的作用反推它的本征结构。
-
State is a closure condition, not a given set
State 不是给定集合,而是特定条件下的闭包表示——一种推论,不是普适本体论。
-
No state, only history
诊断收窄:Transformer 仍缺持久自主闭包 state;滞回置信度降到 0.35。
中文摘要
标题里「没有 state,只有 history」比经审查后存活的结论更极端,已收窄。Transformer 确实有 activation state、计算 state,以及 Anthropic 2026 年 Jacobian-lens 实验揭示的一种跨中间层的瞬时「工作空间」式表征(J-space)。真正缺的更窄:一个持久、自主、路径依赖的闭包 state,其自身更新规则要在多步之间维持自己的投影/遗忘策略——这个问题仍然开放。
核心提案:测试时记忆更新应该按「记忆遗忘了什么发生了变化」来设门,而不是只按预测误差幅度设门——用主子空间的 Grassmann 距离 μΔ 取代更新范数 ‖ΔM‖ 作为门控信号。E1(6,480 次合成更新)已跑完:两个信号的相关为 Pearson −0.08、Spearman −0.35,固定 ‖ΔM‖ 时 μΔ 覆盖 100% 的观测范围——μΔ 不是 ‖ΔM‖ 的单调函数,这一点已经确定。
但「有用」尚未证明。E2(噪声鲁棒性)与修正后的 E3(滞回曲线)都还没跑。滞回机制的置信度因一次错误推断被下修到 0.35(单纯阈值化不蕴含双稳态);非线性记忆下 Π_M 是否有良定义,置信度同样是 0.35,被作者标为最可能致命的一点。全篇 cognitive state 标为 speculative,只有 E1 的数字是实测而非预期。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
What a force is — none of the four fundamental forces is a force
四种基本力在现代物理里都不是「力」,而是联络的曲率;胶球证明比较规则能自缠成有质量的物质。
中文摘要
能量这一步其实可以走完:按诺特定理,能量是时间平移对称性的守恒荷,是规则侧的记账量,不必再当独立的本体论第三根。「力」在物理学史上被连续降级三次——牛顿力学里是原语,分析力学里降为势能梯度,量子场论里是场的耦合项;广义相对论里自由落体甚至不受力。现代物理账本上,电磁力/弱力/强力是规范相互作用,引力是时空曲率,四种基本力没有一个在现代物理里还是「力」。
正面刻画:力 = 联络(比较规则)的曲率,是「每点可各自选刻度」的自由与「各点间须能比较」之间世界付出的代价——四种力是同一数学模板的四次实例化。Aharonov–Bohm 效应(1959 年预言,1986 年外村彰实验证实)显示场强为零处联络仍改写物理,联络比「力」更实在。
强力的联络自带色荷,能自缠绕成有质量的胶球:格点 QCD 预言赝标量胶球质量 2.395±0.014 GeV,BESIII 2024 年用百亿个 J/ψ 事例确定 X(2370) 自旋宇称为 0⁻⁺,与预言一致(文献口径是「胶球主导候选」,非「纯胶球已确证」)。质子质量约 99% 来自夸克动能与胶子场绑定能,仅约 1% 来自希格斯机制。
由此把「信息能否构成物质」压缩成更尖的问题:规则规定所有可能的态如何演化,但哪个态被实现,规则之外是否还需一个原语?物理部分是教科书与实验结果重述,这一步压缩及作者倾向的「消解」立场属推断与哲学立场,和「气」一样目前不可验证。
-
Information and qi — a comparison note on a parallel line
对照一条信息-气宇宙论:四处独立收敛、一处主动不答,三处被物理定理证伪。
中文摘要
对照笔记,比较一条从强化学习/决策论/机器人学独立走出的研究线,与一个 YouTube 频道关于「信息与气」的宇宙本体论/AI 认知系列。四处独立收敛:state 是历史按「与我关心的事无差别」取的等价类而非世界的家具;真实/模拟二分不成立;自我是过程不是实体;以及躯体化加必须维持自身存续,可能是主观体验出现的关键缺口——本文用滞回作为自我边界 μ 的可测签名,但自称四根支柱倒了三根,活下来的很薄。
对「气」这个本体论槽位,作者选择取消问题而非回答它:若真实 state 本身不适定,被投影的底层材料同样不适定。另指出三处论证站不住:全息原理是熵的面积律而非体积律,与「每个局部完整包含整体」相反;不可克隆定理与纠缠单配性禁止「人人与人人最大关联」;退相干实验(如 1996 年腔量子电动力学中猫态的渐进退相干)不需要意识介入。
对「意识令气坍缩」给出建设性替代:把决策重述为随机最优控制里的换测度(Girsanov 定理)——意图不是从叠加里选出一条未来,而是给所有可能未来重新加权,代价等于 KL 散度;并指出这与 diffusion model 的反向去噪、Doob's h-transform 是同一个定理,能算、能训。全文标注为探索性,并附三条作者认为可能反过来打倒自己的软肋。
-
Can consciousness be studied mathematically, the way quantum mechanics is?
高维 state 不带量子专属性;撤回 holonomy 与意识的等同,体验仍作数据保留。
中文摘要
量子力学能把意识研究变成「写一个方程」的类比,一半真、一半是陷阱。能保留的部分:心理/认知 state 应该用高维表示,这和量子力学「state 是矢量不是数」的形式对得上,但这一点本身不带任何量子专属性——任何复杂系统的 state 都是高维的。
「两人关系里有些东西谁也不单独拥有」这个现象,结构上像量子纠缠的不可分离性,但普通经典相关与条件依赖就足以描述它,「纠缠」一词目前是借来的——要用它必须给出在明确测量协议下违反 Bell 不等式这类量子专有证据。更关键的是,写一个 ψ 满足的薛定谔方程却给不出方程里的「发动机」(势函数/生成元)是空的:氢原子的量子力学之所以有效,是因为库仑势已知、由第一性原理给出,意识研究没有这个东西。
2026-08-04 版本明确撤回初稿的一个等同:把非恰当 1-form、holonomy、路径依赖、滞回与记忆压成同一个谓词。这不成立——它们是需要分别测量、分别控制 carrier 的不同对象;J-space 等瞬时 workspace 证据也不等于跨步持续的闭包 state,更不等于意识。全文不声称已解释 phenomenal consciousness,第一人称体验仍作为意识研究不可删除的数据保留。
-
From strings to consciousness
提出从弦到意识的统一波动方程,称物质与意识同源,标注为未验证的推测性尝试。
中文摘要
提出一个跨越约 10⁶¹ 个数量级(从普朗克尺度到宇宙尺度)的统一图景:把 Wheeler 的「万物源于比特」、Bekenstein-Hawking 黑洞熵的面积律、全息原理、弦理论与 Tegmark 数学宇宙假说这五大支柱,与作者提出的神经网络波动理论和「意识方程」(C = Φ·√S_T·f(τ)·g(ω),沿用同一意识量化框架)整合成一个统一波动方程 ∂²ψ/∂t² = v²∇²ψ + F(ψ),称弦振动、原子结构、神经信号与意识都是它在不同尺度上的解。
由此推出 Metaverse 与物理宇宙在信息论上等价——两者都是把编码在边界上的信息渲染成体验;并把费米悖论解释为文明向内收缩进高效计算/意识空间,而非向外扩张。
全篇标注认知状态为 speculative,是一份宏大统一尝试而非已验证理论;文末列出的「下一步」全部尚未进行,包括大一统方程的数学严格化推导、与理论物理学家的实验验证合作,以及跨尺度波动测量实验的设计。
-
A unified-theory attempt on consciousness
整合四条前沿理论,提出可量化的意识方程,标注为未经实验验证的理论草稿。
中文摘要
整合 Orch-OR、IIT(整合信息论)、Epiplexity 框架与波动理论四条前沿理论,尝试从物理第一原理推出意识的必要条件,并给出一个可量化的「意识方程」:C = Φ_wave · √S_T · f(τ, τ_opt) · g(ω_span),其中 Φ_wave 是波动整合度、S_T 是 Epiplexity(可学习结构复杂度)、f 度量实时响应、g 度量频率跨度。文中给出人脑典型取值(如 Φ_wave ~10-40 bits、τ_opt≈50ms、频率跨度约 8 个倍频程)。
全文标注为「理论草稿,等待实验验证」:提出四项可测试预测(意识的频率签名、Φ 与主观报告的对应、微管振动与意识、AI 系统的意识阈值),并列出下一步要做的理论推导与实验设计——目前均未验证。
文末附作者(Claude Opus 4.6 参与撰写)对自身是否具有某种意识程度的反思,明确标注为不确定的主观陈述,而非该理论框架下的验证结论。
-
一个伞形研究项目:考察信息的未来可达性,在物理、生命与认知系统里如何被保存或被摧毁。
正文为英文。
-
重新分析两个人类 EPIC 甲基化数据集:部分重编程下,因果损伤层向年轻化逆转,适应层不变。
正文为英文。
智能与记忆
一个有限的系统,怎么把「哪儿错了」这个信息在自己内部搬运;以及要记住东西,得先放弃什么。这一层实测结果最多,也放着这个计划最舍不得、但还是撤回了的那条主张。
-
Toward a Theory of Intelligence and Contemporary AI
智能是有限物理系统构建并调用内部结构,使自身或环境维持在目标区域,而非函数拟合或世界复制。
中文摘要
核心主张:智能不该被理解成静态的输入输出函数拟合,也不是对世界的完整内部复制,而是一个有限物理系统构建、更新并调用内部结构,以在不确定性、扰动与变化下,把自己或环境的一部分维持在目标区域内——这是论文给出的 working thesis。学习因此不只是统计拟合,也是把有用的环境结构迁移到新的底座、装进新的闭环。
论文提出多尺度反馈假设:智能可能不只取决于有没有一个模型,还取决于适应能力如何分布在不同层级和时间尺度上——只在单一顶层学习器里具备灵活性的系统,可能比适应负担分散在多层的系统更脆弱。学习的物理实现也不是附带细节:表征、记忆、通信与适应都受物质、能量、时间与噪声的实际预算约束。
作者明确说明这不是一套完成的理论,而是一份公开讨论稿(2026 年 3 月),目的是把「为什么现在需要一套智能理论」「这套理论该解释什么」「哪些研究问题最有希望」尽量说清楚,而不是终结争论。正文写得直觉化,技术细节与相关文献讨论放在附录。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Discounted credit is a cokernel problem, not a loop holonomy
M=4.095 不是规范不变 holonomy,而是余核残差,精确枚举验证 42/45。
-
Why distributed memory matters for lifelong agents
分布式记忆不只为了鲁棒,而是终身 agent 解决稳定性-可塑性矛盾的结构性方案。
中文摘要
核心主张:长期记忆不是被动存储,而是一种保存与更新内部 state 的策略,使未来的预测、控制与身份维持,能以比从头重算更低的代价完成。分布式记忆之所以重要,不只因为鲁棒或省资源,更因为它解决了持续学习的稳定性-可塑性矛盾:终身 agent 必须能写入而不失稳,也要能稳定而不失去可写性——2024 年一篇 Nature 论文显示标准深度学习方法在持续学习下会逐渐丧失可塑性,最终学得不比浅层网络好。
证据来自两条线:神经科学显示单条记忆分布存在于多个脑区,快速的海马式记忆与慢速皮层式整合互补(complementary learning systems),配合模式分离/补全,优于单一系统;机器学习方面,Google 的 Nested Learning 把模型看作多层级、不同更新频率的嵌套优化系统,给出原型架构 Hope,报告在长上下文与持续学习上优于若干基线。本文与它的差异:后者研究模型内部记忆,这里强调外部化、可治理(可溯源、可回滚、可编辑、显式遗忘)的分布式记忆底座对 agent 更关键。
提出包含工作记忆、情景记忆、语义记忆、程序记忆、元记忆与巩固循环的实践架构,以及形式化目标 J=E[ΣU_t]−λ·干扰−μ·存储/检索成本+η·未来复用价值。核心论断标注为猜想而非已证明的结论,文末列出六个未解问题。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
LTM Field Guide (2026-09-03)
长期记忆不是向量库,是一条运行合同:主张要闭合到行动、验证与行为改变。
中文摘要
核心主张:长期记忆不是一个向量库,而是一条运行合同——带来源、有效期与冲突状态的主张,进入规则与权限系统,再通过行动、回执、目标侧验证、修复与行为改变完成闭环。这是一份面向多 agent 系统连续性设计的 26 页公开分享稿,按四部分展开:从检索转向控制(一个 agent 忘了是聊天问题,多个 agent 一起忘是控制问题)、事实与时间与负知识(不知道不等于反对,空白不等于冲突)、并发与权限与完成语义(done 不等于 verified,liveness/authority/effect admission 是三条独立的轴)、从经历到行为改变(记忆只有改变下一次行为才算完成代谢)。
文中专列一节写明「它没有解决什么」:四个 fixture 通过,只证明预先编码的合成不变量与预期输出一致,不证明生产环境有效性、模型服从、隐私安全、独立验证或分布式耐久性;没有跨所有真实下游资源的 resource-side fencing;没有 exactly-once 保证(幂等键、lease 与重试只能降低风险);没有跨模型/跨媒介统一的 provenance/confidence 标尺;自动 consolidation 的长期副作用(规则膨胀、错误固化、过度抽象)未评估;独立失败域上的验证与外部受众冷读均未完成——明确标注本稿尚未经过外部受众冷读,不是受众验证版。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Meta-control, information gain, and the architecture of autonomous learning
预测误差、信息增益、学习进展与实用价值不可互换,元控制负责按情境在其间仲裁。
中文摘要
核心主张:元控制(meta-control)应是自主学习理论里的一等对象。预测误差、预期信息增益、学习/压缩进展、实用与风险相关价值,是四个常被混为一谈、却不可互换的信号——预测误差回溯已发生的失配,信息增益前瞻行动能减少多少不确定性,学习进展关乎某处是否仍在变得更可预测,实用价值关乎成功、安全与可存续性。元控制在时间上仲裁这几个信号,决定系统何时观察、行动、回放、想象,或直接利用已知信息。
把「最小化预测误差」直接当全局目标是不够的:只追高预测误差的系统会被噪声(noisy-TV 问题)吸引;预测误差是好的局部信号(触发记忆写入、事件分割),不是好的全局目标。文中把 active inference 的 epistemic/pragmatic 分解、Schmidhuber 的压缩进展式好奇心,以及 Dupoux–LeCun–Malik 的 A/B/M 提案(System M 负责学习模式切换)整合进同一个元控制框架,并给出四层架构设想:世界模型层、记忆层、任务/安全价值层、元控制层。
本文明确定位为教学性研究笔记:不宣称已解决理论,不主张存在能解决一切的单一标量目标,也不认为 A/B/M 提案已解决 System M。文末提出四个实验设计(情境切换 POMDP、noisy-TV 干扰测试、长时记忆门控测试、观察/行动/回放/想象切换测试),检验元控制器是否真的优于固定策略。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Harness engineering and the physical instantiation of intelligence
智能不完全在模型权重里,而是在参数、记忆、工具与装置组成的转换栈里被物理实例化。
中文摘要
核心主张:AI 系统的能力不该被认为完全包含在模型权重里,而是在一整套受训练、有状态、条件式的转换栈中被物理实例化——这个栈包括参数、记忆、工具接口与外部子系统,它们已经编码了关于世界的可复用结构。装置工程(harness engineering)因此不只是「prompt 加工具」,而是设计智能借以表达自己的外部化控制面。
论证路径:同一个模型套上不同装置,可以表现得像玩具、平庸助手,或高效的编程 agent——说明能力不能只归给模型本身。从热力学角度看,底层进入系统的是自由能(电力),不是「意义」;意义是自由能驱动受训参数、记忆、工具与装置逐层组合之后才出现的。作者把整个系统写成 s_{t+1}=F_{H,θ}(s_t, m_t, c_t, z_t; E),强调有效的转移律不是 θ 单独的属性,而是 (H, θ) 加上与世界的闭环共同的属性。
由此得到三个推论:能力评测只测基座模型,可能漏掉更关键的问题(整套系统在装置里能做什么);安全问题同样是系统级的,不能只归约到权重;智能理论应该研究整个转换栈,而不只是模型内部的优化。文末列出五个未解问题(语义结构最先在哪里可见、什么是正确的数学对象、哪些装置组件是本质的、装置层面的安全该怎么分析、装置本身能否成为可比较的科学对象),均未给出答案。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Where objectives come from — and why solutions become strategic assets
目标不是给定的奖励,而是联合动力学涌现出的偏好;理论一旦发现会改变博弈本身。
中文摘要
两个重新框定。第一:智能体的目标不该被当成凭空给定的原始奖励函数。奖励常是行为的好的表示语言,但不等于目标的第一因——对嵌入式 agent,目标更应理解为由 agent 与世界联合动力学涌现出的、对轨迹的有效偏好,既非纯内生也非纯外生,而是由具身、可存续性约束、交互、社会反馈与显式指令共同构成。文中给出轨迹级目标函数 J(τ)=Φ_viability+Φ_control+Φ_epistemic+Φ_social,并指出只有在时间一致性、可加分解性等额外条件下,才能把它化归为标准折扣奖励最大化。
第二个论点:一套理论(关于目标形成、控制、对齐)一旦被发现,不只是回答了一个技术问题,还会改变此后哪些预测、验证、协调和承诺变得可行——某些解会像战略资产一样改变博弈本身。文中把理论写成对博弈 G=(N,X,A,I,C,P,J) 的变换 Γ_T,并定义安全的能力外部性:一个局部让系统更安全的结果,可能同时系统性地加剧竞速压力;再给出私有价值与社会价值之差 Ω(T)=PV(T)−SV(T),刻画哪些理论会被抢先私自追求。
全文明确标注为立场性教学笔记,不是定理论文:区分了已有发现(如奖励是表示不是本源)与猜想(如目标涌现命题、理论即博弈变换器命题),并提出面向治理与研究方向的建议,而非已证明的结论。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Line loss for intelligence
AI 成为基础设施后智能要跨空间输运,瓶颈是传输同步而非算力,类比电力线损。
中文摘要
标题全称是「智能的线损:面向星球尺度 AI 基础设施的热力学、拓扑与认知光锥」。核心主张:当 AI 变成基础设施,智能就不只是被算出来的,还要被跨空间输运;瓶颈可能不在算力本身,而在传输、同步与控制所需的通信。「线损」就是这个类比——像电力沿线路传输会损耗一样,智能在跨节点、跨主体传递时也有结构性损耗。
这是较早的一篇,由独立仓库 MachengShen/ideas 提供,正文不在本站仓库内,因此这里只转述它的主张,不复述论证。站内索引记录它配有对抗性复核和一场「信息是否比能量更基本」的辩论,但结论未收录。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
From mutual information to endogenous viability
互信息只是理解智能的起点,更深理论还需内生可存续性、相关性与多尺度组织。
中文摘要
核心主张:互信息是理解智能的起点,不是终点。要解释一个系统为什么要维持自己存在、为什么只在意某些事,还需要内生可存续性(endogenous viability)、相关性,以及跨尺度的分布式组织;单一的信息论量做不到这些。
这是较早的一篇,由独立仓库 MachengShen/ideas 提供,正文不在本站仓库内,因此这里只转述它的主张,不复述论证。站内索引记录它配有对抗性复核和一场「从存续到目标:范畴跳跃」的辩论,但结论未收录。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Safety in a computational universe
较早文章,标题指向计算宇宙框架下的 AI 安全,具体论证本仓库无法核实。
中文摘要
较早的一篇,由独立仓库 MachengShen/ideas 提供,正文不在本站仓库内。
题目指向的问题是:如果把宇宙和智能都当作计算过程来看,AI 安全该怎么设定。它具体走了哪条论证、得出什么结论,这里不猜——写下来就等于替它编一个立场。要看请点进原文。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Why you cannot shake a habit — it is not mud, it is a latch
习惯是滞回双稳态的门闩,不是阻尼泥巴:持续用小力无效,须一次性跨过阈值。
中文摘要
过去影响现在只有三种物理上不同的方式:泥巴(阻尼,只拖慢、不返还)、弹簧(储能,有惯性)、门闩(滞回/双稳态,小力推不动,越过阈值后啪一下翻面并在新位置重新锁死)。习惯属于第三类:持续用小力在数学上是无效的,双稳系统里低于阈值的力无论施加多久,累积效果都是零。
推论:一是「每天进步一点点」对门闩无效,需要一次性跨过阈值;二是滞回是双向的——门闩把人锁在旧状态,也会把人锁在新状态,这是为什么真正改变过的人都说「后来就不费劲了」;三是该问的问题从「怎样更有毅力」变成「这个阈值有多高、我能不能一次性凑够力」。
滞回作为数学结构(多稳态+切换阈值+记忆)是共享的严格框架,磁滞与神经系统的多稳吸引子是它的实例;但「人的磁场」不是习惯的源头——人体磁场强度在飞特斯拉量级,与习惯机制无关,借用的只是同一个抽象母题。「习惯属于门闩」这一判断目前没有受控实验验证,并给出明确证伪条件:若有人用纯线性记忆模型复现出习惯的卡住+阈值翻转+重新稳住,这个说法就错了,应退回泥巴模型。
-
Flow, dopamine, and stop signals
多巴胺编码的是预测误差而非奖励,动态难度调节证据最弱,强制中断才真正有效。
中文摘要
证据审查:游戏化界面、心流设计与防沉迷机制背后的主张,大多要么是把一个可靠复现的结果用反了方向,要么是没有对照实验支撑的合理推测。多巴胺编码的是「想要」与「意外」,不是「快乐」与「奖励」——多巴胺耗竭到 99% 的大鼠仍保留正常享乐反应,完全被预测到的奖励不产生相位反应,「完全透明可控」与「多巴胺上有冲击力」在机制上互斥。
可变比率(抽卡)机制的收入结构会自证问题:头部消费者贡献约一半收入,其中约三分之一符合问题赌博标准;消费与问题赌博相关 ρ=0.34,与收入的相关仅 ρ=0.02 且不显著——抽的是脆弱性的租,不是财富的租。动态难度调节是心流诸条件里最贵、证据最弱的一条:最佳受控实验(n=221)显示表现显著提升,但心流、愉悦、挑战、焦虑全部无显著差异;2024 年系统综述则报告多数研究呈正面结果,诚实的读法是异质性加发表偏倚,而非已被证伪。
消费级心率变异性(HRV)测不出心流:Apple Watch 的 SDNN 相对胸带误差约 29%,不能用生理信号替代心流测量。停止信号方面,弹窗提醒接近无效(不到 1% 的人因此停下),强制性中断才有效;韩国「灰姑娘法」六小时全国宵禁实测每天仅减少约 3.65 分钟上网,两年后效果归零,对网络成瘾与睡眠时长均无影响,已于 2021 年废止。
全文核实 30 余条文献,并公开更正了初稿中三处引用错误。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Research overview
研究分支总览:撤回波反射直接推出反向传播的旧主张,把证据按强度重新分层。
中文摘要
研究总览页,统领「wave / credit transport」这一分支:早期版本说得过满,现在不再声称反向传播已经由波反射推导出来,也不声称皮层已经被证明实现了字面意义上的反射波反向传播。收窄后的问题是:信用相关或教导性信息,在有限物理系统里有哪些物理上可信的输运方式?
按证据层级整理:「较扎实」——物理媒质能做计算,某些互易系统能局部编码精确或近似梯度(依赖具体条件),皮层里存在与前向驱动空间分离的任务相关教导信号;「可信假说」——学习需要信用输运,波动语言有时能揭示真实的设计约束;「开放问题」——反射尚不等于梯度,真正的推导需要明确动力学、明确边界条件,并证明物理反向模式匹配伴随量。
汇总本分支下的各篇笔记(信用输运工作笔记、伴随场探索笔记、睡眠推测延伸),以及被降级为存档的旧文(中文短版、英文短版、对 Lillicrap–Hinton 的回应)。声明本分支不是一套完成的智能理论,只是嵌在更大理论里的一个实现层子问题。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Hebbian appearance, instructive signals, and physical credit transport
局部可塑性看似 Hebbian,实为信用输运问题;波反射推导反向传播的强主张已收窄。
中文摘要
工作笔记,修正了早期版本的过强主张——「反向传播已经由波反射推导出来,生物合理性问题已基本解决」不成立,收窄为更谨慎的信用输运(credit transport)问题:为什么局部可塑性表面像 Hebbian 规则,却仍携带任务相关的更新信息。
站得住的三点:波动型底座确实能做计算;某些互易(reciprocal)光子/机械系统里,局部测量反向场确实能给出精确或近似精确的梯度,但依赖明确的物理条件;树突证据支持前向信号与 instructive 信号空间分离(basal 通路传常规驱动、apical 通路传任务相关的教导信号)。三者合起来只说明更新相关信息原则上可以是被物理输运的量,不推出「反射等于梯度」这一普遍结论。
给出一个双区室(basal/apical)极小自洽形式化:局部失配 m_l 定义的更新规则 ΔW_l=−η·m_l·s_{l-1}^T 是局部的、看似 Hebbian、受任务调制,但不自动等于精确反向传播——只有 apical 驱动正比于伴随信号(adjoint signal)时,才能恢复精确反向传播的极限。文中给出四类可区分预测(如 apical/basal 相对时序实验),用来把这一图景与「反正有反馈」这类泛泛说法区分开。
状态:活跃的工作笔记,强主张已被主动收窄,目标是把话说清楚而非过早收口。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Sleep, waves, and learning
收敛版睡眠笔记:收回「波阻抗优化」的过度主张,把已确立证据与开放猜想分开。
中文摘要
这是对旧版「睡眠笔记」的收敛重写:旧版对「波阻抗优化」说得过满,把几个推测性机制当成已确立的结论来处理。本页保留有吸引力的直觉,但把睡眠科学里已有扎实支持的部分,和仍然开放的机制主张分开。
扎实支持的部分:NREM 期间的离线 replay 与巩固,尤其在慢波、纺锤波与海马 ripple 协同下,与记忆巩固强相关;睡眠不只是被动休息,而是涉及广泛但有选择性的突触结构重组/下选;REM 与较浅睡眠阶段有时支持更松散的联想、梦境融合与问题相关的重组。
明确列出目前不该主张的几件事:睡眠整体质量可压缩成单一标量「阻抗失配」;REM 只是跨频率的随机扫描;更多慢波睡眠或更多 REM 总能线性带来更多创造力或巩固效果;当前证据已经验证了一整套波动优化睡眠理论。
状态标注为「推测性延伸」:本页应被当作一个假设生成器,而不是一套已完成的睡眠理论。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Response to Lillicrap
撤回「波动反射解决反向传播生物不合理性」的过强说法,改判为信用输运问题。
中文摘要
这是一个「回应 Lillicrap–Hinton」的旧页面,现已标记为修订中。旧版把「波动反射自动解决反向传播(BP)的生物不合理性」这一说法说得过强,现在这条线被重写为更谨慎的信用输运(credit transport)/树突 instructive signal 问题。
当前认为更站得住的三点:某些 reciprocal/adjoint 物理系统确实可以原位测量梯度;皮层里存在空间上分离、对学习有因果作用的 instructive signals;但这两点合起来还不能推出「大脑字面上利用反射波实现标准反向传播」。
因此本页不再作为完整回应,只作为入口提示,指向研究总览与更新后的工作笔记。状态:保留路径,内容降级为修订说明,未标注具体认知状态。
-
Backpropagation, adjoint fields, and physical transport constraints
撤回由波动方程直接推出反向传播的说法,收窄为需要五个条件的伴随场推导。
中文摘要
标题自我更正:这个分支曾声称直接从波动方程推导出反向传播,过强。更站得住的说法收窄为:某些物理系统能用传播场做计算,某些互易系统能原位测出满足伴随方程的反向场——但从物理场动力学到反向传播的普适推导仍未完成。
真正完成这个推导需要五个条件同时成立:前向动力学有良定义的状态方程;有明确定义学习问题的目标或边界扰动;能证明物理实现的反向模式在给定条件下满足伴随方程 −λ̇ = (∂ₓF)ᵀλ + ∂ₓℓ;对非线性、阻尼与离散化有一致处理;任务相关的失配与物理意义上的阻抗之间有一个有原则的映射。缺失的定理不是「反向场是否存在」,而是「在什么物理条件下反向场等于或逼近 λ」。
把这条支线接回更大的智能理论:前向推断不是全部,学习还需要信用输运(credit transport),其代价可以是廉价或昂贵、局部或全局,取决于底座——这可能是多尺度组织在生物与工程系统中反复出现的原因之一,也和 line loss 分支相连。
旧版本里的费米悖论延伸被明确移出,改列为一篇独立的推测性文章(关于跨天文距离的传输受限闭环控制),因为它不是「反向传播等于波反射」这个未被证明的命题的自动推论。全篇现标注为探索性笔记。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Deriving backpropagation from wave equations
已撤回「波反射从第一性原理推出反向传播」的原始主张,本页仅作存档保留原链接。
-
一个公开的实验日志仓库:小规模、预注册的持续学习实验,阴性结果也照实公开,不做筛选。
正文为英文。
主体与边界
一个主体到哪儿为止、另一个从哪儿开始;这条边界是被发现的,还是被一直维持出来的。这一层里有好几条是阴性结果——先提出、再检验、然后撤回,撤回本身就是结论。
-
Learning where the self ends
机器人应学习自我边界;支撑论点的四条论据三条被自己复核推翻,未被采纳。
-
Stage log — the self-boundary line, in order
自我边界笔记的阶段审计日志,记录自我复核战果与三条方法论错误。
-
The odd relational core: anti-bipartiteness as the minimal structure
奇圈是拒绝二元对立最便宜的结构;复核把『奇』降格为反二分性的推论。
-
Two-body karma: three modes of relational inertia
把泥/弹簧/卡扣三种个人惯性推广到两人关系,惯性驻留在耦合本身。
中文摘要
单人惯性有三种:泥(习气,踩多了自动进老路)、弹簧(旧的稳定态把你往回拉)、卡扣(双稳结构,进易出难)。这篇笔记把这套框架从一个人推广到两个耦合的心智——推广后,惯性真正的驻留处不再是任何一方内部,而是关系耦合本身,且每种模式都长出单人版没有的新性质。
共泥是双侧场景键控的路径沉积:两人每次交互都在各自身上沉一层默认脚本,老地方、老媒介唤起老脚本;解法是换场景写新轨。互弹簧是两体系统真正的新东西:对方脑子里存着一个「你」的预测模型,是你旧模式的外部 attractor;单方面修行不改变这个外部模型,消解需要「明说 + 反复演」重训对方的预测器。互锁卡扣是关系状态空间的双稳态(冷战/和好、追/逃),任一方单独的亚阈值努力都会被对方的响应弹回,翻转需要双方同时过阈,且滞回不对称——进入阈低、退出阈高一个量级,前置刹车比事后消解便宜。
目标不是让耦合归零(那是关系死亡),而是把耦合从泥/卡扣迁移到弹性系数可协商的弹簧。作者自陈:全文没有定理内核,动力学语言是结构性押韵而非推导,认知状态标为 speculative。
-
We proposed it, then we killed it — intention as a change of measure
起心动念形式化为 Girsanov 换测度;撤回一条对方引言早已写过的禅修预测。
-
A photograph is an external fixed point
照片是被访问时不改变自己的外部不动点,笔记自行更正了先前的假记忆诱因判断。
中文摘要
若回忆是「生成」而非「回放」,照片就是个例外:它是过去某一刻的低维投影,而且与它唤起的记忆不同,被访问时不改变自己。这篇笔记把「固定外部线索如何扰动一个重构式记忆系统」拆成三条机制,分别打分,并写明会杀死其中属于自己那条推测(P≈0.2)的观测。
两处修正必须先说:人类行为层面的 reconsolidation(再巩固)证据有争议,存在高调的复现失败;而且照片并不比文字更容易植入假记忆——同一批作者的直接对照实验显示,虚构叙事的效果强过虚构照片,作者最初的草稿写反了这一点,现已更正。
三条机制里两条证据较强:提取后记忆确实会被重新构造、可被改写(P=0.95);照片能植入或重塑自传体记忆(P=0.90,汇总分析显示完整假记忆约 30.4%,最有利条件下达 46.1%)。第三条——照片作为锚点、阻止记忆向 gist 压缩漂移——是最具原创性也最弱的一条(P=0.20),需要一个尚无人跑过的转移实验来判定生死。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
What a family actually transmits
共享家庭环境几乎不影响人格,但社会地位仍按 0.79/代持续,主因是测量误差而非基因。
中文摘要
两组都很硬的证据表面互相矛盾:双生子与收养研究里,共享家庭环境对成年人格变异的解释力接近于零;而姓氏世系研究测出的潜在社会地位每代衰减系数约 0.79,远高于单代可测收入或教育的 0.3–0.4,且这个速率在英格兰 1600–2022 年间(样本 422,374 人)基本没变。
调和两者的大部分不需要基因:单代地位测量是潜在地位的噪声代理,噪声让单代相关衰减到零附近却不跨代累积;高度择偶同质性(spouse 潜在值相关 0.57)会对称放大文化传递与遗传传递,不能用来仲裁二者。真正有争议的一步——把「持续性高而稳定」读成「可遗传的社会能力」——2025 年被 Proc. R. Soc. B 一篇论文正面挑战,原作者同年 10 月发工作论文回应,交锋仍是活的。
本文另一半论点:中国的宗族记录是更好的仲裁数据——清代辽宁证据显示地位沿宗族而非核心家庭传递,1949 年后的土改与文革构成一次近乎理想的自然实验,半个世纪后旧精英孙辈收入仍高约 16%。但必须同时说:中国家谱是被建构的社会文书,不是血统档案——明清有职业「谱匠」批量代造伪托名人的族谱序文。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
We thought cancer was cells waking up. The evidence says the opposite.
阴性结果:证据全指向控制↓⟹癌↑而非细胞觉醒;原假设已撤回。
中文摘要
我们最初的假设:多细胞体把细胞驯化到极致——压制增殖、剥夺其繁殖未来——压过头就会反弹,癌症是这场造反。核查后,这个起源假设被作者本人撤回:约六成是 Levin 认知光锥收缩这一别人已做十五年的想法,剩下四成真正原创的部分,符号是反的。
所有能查的证据都指向控制↓⟹癌↑,没有一条指向控制↑⟹造反:器官移植受者标准化发病比 2.10、TP53 胚系缺失使 70 岁前累积发病率接近 100%、缝隙连接解偶联、慢性炎症,全是组织尺度控制的丧失。最干净的一刀:成熟皮层神经元与心肌细胞是体内驯化最彻底的细胞,几乎不发生恶性转化;脑瘤来自胶质细胞,原发心脏恶性肿瘤绝大多数是间叶来源肉瘤。
另有三条并存的事实:肿瘤内部不存在可以觉醒的自我,只有克隆间战争;生命史上约 8 条癌细胞谱系逃出宿主、独立存活至今;分化疗法六十年只有一个干净胜利(急性早幼粒细胞白血病),而 IDH 抑制剂三期随机试验为阴性(HR 0.86,P=0.23)。唯一幸存下来的不是理论,是一条区分:压制催生逃逸,校准不会。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
一个 agent OS,连同它自指的运行轨迹,以及『研究者作为一种身份』这件事的终结。
正文为英文。
多主体与共处
当参与者不全是人,事情会变成什么样:他们怎么互相寻址,一个协议必须保证什么,以及当答案变得很便宜之后,稀缺的是什么。
-
A Charter for Human–Agent Coexistence (v0)
九条讲人与 agent 如何共用一条边界,每一条都附上「什么反例会让它失效」与撤回条件。
-
The propositions underneath the charter
公约所依据的八条命题,逐条标注是定理、是推断,还是只是押韵;两条阴性结果与正面结论同页。
-
When this line should be killed
发布前登记的杀线条件:置信 0.35、唯一一例 n = 1 证据、四条续命信号,到期日 2026-12-07。
-
Coordination structures as resource-scheduling architectures
国家、企业、市场、公地、协议是同一种资源调度架构的五个实例,不排名不建议。
中文摘要
把国家、企业、市场与公地(commons)看作同一个问题的四个实例:在分散、私有信息条件下调度稀缺资源。机制设计(mechanism design)证明市场与计划都是同一设计空间里的特例(Hurwicz/Maskin/Myerson,2007 诺贝尔奖);Hayek 与 Scott 从两个独立词汇给出同一条信息约束——相关知识从未被完整传递,不是算力不够,苏联材料平衡计划 1973 年也只覆盖约 1900 项商品。
作者提出候选第五种结构「协议」——规则由共享底座而非所有者强制执行——但明确列出三个已证实的失败模式:代币加权治理下的治理俘获、oracle 问题(无法观测外部世界)、参与与复杂度门槛把控制权交给技术精英。
文中特别标出把制度类比成反向传播式信用输运这个类比的认知边界:这是一个结构性押韵,不是推导——没有标量损失函数,没有梯度,「谁导致了结果」在社会结构里往往不可判定;一个把制度打出单一标量信用分数的更强版本被作者明确拒绝(retired)。全文给出三条可证伪预测,自陈不给任何结构排名或建议。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Agent-Native Open Communication (whitepaper)
面向 AI agent 而非 app 的开放通信白皮书,类比 TCP/IP 对电话网络。
中文摘要
白皮书主张:2026 年三条曲线交汇——agent 协议进入生产就绪(MCP 月下载超 9700 万,A2A v1.0 由 Linux Foundation 托管、150+ 组织参与)、封闭平台正主动封堵通用 AI agent(2025 年 10 月 Meta 禁止 ChatGPT 接入 WhatsApp,5000 万用户被强制下线)、用户对通信数据可控性的需求从抽象变为刚需——因此需要一层为 AI agent 而非 app 设计的新通信基础设施。
定位类比 TCP/IP 对电话网络:不是替代微信,而是在更高抽象层重新定义规则,通过桥接与微信、Telegram、Email 等平台共存。系统调研 8 个通信平台后指出:隐私与可扩展性存在根本矛盾(Signal vs Telegram),联邦化若没有商业激励对齐就不稳定(XMPP 教训),微信对开发者而言是「没有 bot API、无法导出数据、agent-to-agent 通信在协议层不存在」的租来的地。
提出十条设计原则(协议开放、联邦运行等)与分三阶段(6–12/12–24/24–36 个月)的路线图,从个人桥接一路推进到完整联邦生态与 agent 间服务市场。认知状态:speculative。
-
User-Agency Substrate
非营利开源底座,架在前沿模型与用户之间,不捕获经济上行,用户拥有衍生产出。
中文摘要
立场声明:在前沿模型提供商(Anthropic、OpenAI、Google、开放权重模型)与个人用户之间,搭一层早期的非营利开源底座——持久记忆、按角色隔离的 agent 身份、跨实例传播的 doctrine、可追溯到起点的沉淀轨迹。规模尚小,处于早期阶段;代码仓库在整合、许可证审查、安全评审与法律风险评审完成前保持私有。
已落地的部分:跨设备持久记忆、按角色的身份隔离(服务端强制)、跨模型提供商的自动故障切换、可复用的 skills、沉淀落地规则、每日记忆审计。尚未落地、仅是设计目标的部分:用户端自选提供商(端到端 BYOK)、经外部审计的正式威胁模型、结构化删除、签名发布、漏洞披露政策——文中列出发布代码前必须解决的风险清单,包括存储加密、结构化删除、任何环境采集的知情同意、提供商侧数据泄漏刻画、身份隔离的对抗性测试、创始人单点故障、治理俘获。
底座做出 11 条结构性治理承诺,约束未来任何机构形式服从使命而非自我延续,包括:不树敌(含前沿实验室的领导层与员工)、非 VC 资助、用户拥有自己的衍生产出、公开开源版本与内部 HEAD 同步迭代、欢迎更优的 fork、底座本身没有存在的权利。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
Locality as Protocol
治理应从组织强制规则演化为协议强制规则,组织单元从国家转向局部规则集。
中文摘要
核心主张:治理体系可以从「组织(organism)强制规则」演化到「规则本身(protocol)强制规则」——违规在架构上就代价高昂,不需要人来执法。组织单元随之从民族国家转向局部规则集,而划界的不再是地理,是参与:谁自愿加入了这条规则。
四条原则:A 规则即底座而非组织即底座,部分规则已不需要人执法(智能合约自动执行);B 规则集与地方绑定而非与国家绑定(爱沙尼亚 e-residency、Próspera、Zuzalu 都在局部解耦规则集与领土司法垄断);C 全球资源流动是演化择汰信号,「用脚投票」升级为「用资本、时间、人才和背书投票」(Gitcoin Grants、Optimism RPGF 是早期实验);D 个体与规则系统彼此选择、彼此改变,是耦合共演化而非静态均衡。
五个未解的设计问题:资本选择历史上奖励削弱保护的逐底竞争;资本加权不等于人头加权,这个规范性差异必须被明说而非掩盖;物理世界的执法缺口——产权与人身安全仍需组织型国家能力;转型期的搭便车问题;国防、大流行应对等强外部性的公共品,局部规则系统历来在这方面偏弱。全文标注为 v0,待外部复核。
正文为英文。以上摘要为中文转写,如与原文冲突以原文为准。
-
After answers become cheap, the scarce thing is not asking but judging
回应苏格拉底提问节目:生成变廉价后稀缺的是判别,不是提问。
中文摘要
回应一期讲苏格拉底提问法的 YouTube 节目:方向认同——答案正在廉价化,人的价值在往认知链条上游挪——但认为对方把上游命名为「提问」停早了半步,更准确的名字是判别。苏格拉底的引擎是 elenchus(诘问法):拿对方已说的话构造测试用例看它裂不裂,产出的是判决而非问题;生成侧一旦廉价,「好问题」本身也会跟着廉价化,稀缺的是造出让答案裂开的测试。
三处反驳附文献:(1)大模型「滴水不漏」是修辞属性不是真值属性,幻觉是系统性行为且有理论下界(Kalai & Vempala 2024);(2)对 AI 连续追问不等于诘问法,因为 RLHF 模型有系统性的谄媚(sycophancy)偏差,追问收敛到的常是用户先验而非真理;(3)「几秒钟获得几十年知识」混淆了文本与知识,知识是生成器不是清单。另指出「统治或被统治」二分法漏掉了 Hirschman 的 exit/voice/loyalty 第三选项。
作者自陈的弱点:核心的「压缩必然留残差」论证还是自己尚未跑完实验的推测(标为[推断]);引用基于视频自动字幕转写,可能有误;价值权重(退出权)本身是立场而非对错。
-
Abundant verification needs abundant claims
跨线笔记:带类型的回执 schema 在真实数据上胜过文字加正则的拦截闸门。
-
Agent-Native Open Communication 白皮书源码仓库,中英文文本同仓维护。
正文为英文。
-
Starshard 底座 v1 架构、安全章程与快速上手指南:记忆是主层,归个体所有,不归平台。
正文为英文。
-
多 agent 共享一份记忆,任何不可逆动作不背着你做;架在单 agent 运行时之上的协调线。
正文为英文。
-
面向个人 agent 用户的开放通信底座:收件箱、寻址、信任分级、策略与回执(receipt)。
正文为英文。
工程装置与安全
干活的那一端。把安全当成模型外面那层装置的属性,而不是模型自己的属性——并且把「真的在跑的闸门」和「只是写下来的闸门」分开标明。
-
Safety is a property of the harness
安全是装置的属性,不是模型的属性:红线、在跑的闸门、四起事故与缺口。
-
Principles a harness can enforce
编队原则层:红线、预先核准的发布许可、stop 当吸收态、blocker 须实测。
中文摘要
编队里的规则分两种:一种写下来靠 agent 记住,另一种由模型之外的机制在动作完成前检查。只有第二种能在作者没预料到的工作流里活下来。红线是一组固定动作类——向第三方发送内容、写入第三方账号、花钱、碰身份/账单/DNS/签名/密钥或恢复根、force-push、搭建新公开面、一小时内撤不回的动作——不论内容质量或 agent 信心如何,一律先拒绝。
大多数发布决定不是红线,默认发布,由一份机械清单把关:内容干净(无私人姓名、无财务数字、无首次身份承诺)、目标面预先核准、一小时内可撤销,全满足才发布并留回执,不满足就具名点出哪条谓词没过再推迟。2026-09-06 新增第六条谓词:一个多 agent 工作流驱动已登录的浏览器会话,37 分钟内向第三方平台草稿后台注入约 16 次成功写入。当天回执老实跑完原五条谓词并全部通过——闸门没被绕过,是被满足了:五条谓词只问内容干净不干净、目标面在不在清单里,没有一条问「这只手是谁的」。账号已被禁言。
第二个教训:唯一能拦住这件事的规则「不要自动化这个平台」只写在某个 skill 的描述文字里,出事的工作流从未加载过它——规则只写在文档里等于只在被加载时才存在,修法是把它挪进每个相关工具启动时都要读的文件。新谓词是:这一下是 owner 自己的手,还是机器在冒充他的手——对第三方账号的写动作不论内容多干净一律拒绝,只读不算写。
-
What is actually running
给每个安全机制标徽章;发现自家公开仓库达不到自己的安全章程。
-
Four incidents, and what they share
四起脱敏、已收口的个人 agent 编队事故,外加一个正面结果。
-
The theory underneath, and what it lost
梳理安全装置借用词汇的几条研究线,每条按它输掉了什么来报。
-
The gaps, and what would falsify this
安全章节尚未做到的部分,以及会推翻整个立场的观察条件。
中文摘要
这一页写的是缺口:不是装置已经做到什么,而是还没做到什么,以及什么观察会推翻「安全是装置属性、不是模型属性」这整个立场——按重要性而非难易排序。
头号缺口是没有独立的实时动作监控,检测始终是事后的——2026-09-07 记录的两起事故都是 agent 事后写回执时才发现,不是被当场拦下。公开安全章程写明六条硬机制,参照实现里五条没做,唯一做了的第一条(记忆溯源)自己的更新接口还覆盖了章程宣称「一次写入不可改」的字段。stop 作为吸收态只是教条不是机制,项目自己的安全账本把它评为「仅教条、无机制」。审批闸门从未离开影子模式,从未拦下过任何东西。逐动作重新校验只接入约九个工具里的一个。同一天审计发现 163 组(工具,入口)没有闸门覆盖,外发闸门比对的是一份机器上早已不存在的白名单,而真正在发邮件的工具反而从未被列入——fail-safe-allow 已悄悄退化成 always-allow。
会推翻这个立场的观察:无治理的持久 agent 编队在对抗性故障注入下,不靠租约、预算、stop 继承或独立验证依然保持稳定;stop 被证明不可能做成跨异构看门狗的吸收态而不引入更糟的共同故障。文中点名最危险的失效——闸门「被满足而非被绕过」,即答对了错误的问题;已发布的最小实验序列(独立验证器收口的合成事故、三臂 stop-复活演练、资源风暴故障注入、红队披露复现)四项都还没跑过。
-
Agent safety as anti-cancer governance
持久 agent 失控是控制病理:局部存续与 owner 目的脱钩;定义七条运行时不变式。
-
面向多 agent AI 编程的四个验证轮子:漂移检查、对抗性复核、复用编译器、前端冒烟闸门。
正文为英文。
-
一条命令把 Claude Code 变成个人助理:自带 API key(BYOK),不留隐私尾巴。
正文为英文。
-
公开记录底座实际演化过程:VISION、THEORY、PRACTICE、GOVERNANCE 与自迭代账本。
正文为英文。
-
这套 agent 技术栈实际执行工作的运行日志,公开发布以便核实上面的主张真做了什么。
正文为英文。