# Macheng Shen > 一个人的研究计划,主题是**信息、学习,以及什么让某些未来变得可达**——从全息原理与统计力学出发,穿过意识与机器学习,落到 agent-native 制度的设计上。这些工作散落在约 15 个公开仓库与页面里。本文件是它们的机器可读索引。把一个 agent 指向这个 URL,它无需爬站就能从这里遍历全部内容。 **认识论约定(承重结构,不是装饰)。** 下面每一条主张都带一个*认知状态*: - `survived` —— 通过了真实的压力测试、实验或复现。 - `speculative` —— 未经检验的理论。有意思,但还没挣到信任。 - `retired` —— 已被杀死,通常死于作者自己的证伪测试。作为墓碑保留,以免被重新发现一遍。 出现 confidence 数字时,它们是主观先验,不是频率。负面结果是刻意公开的;下面有若干 artifact 存在的唯一理由,就是记录什么*没有*奏效。 **机器格式。** `/llms.txt`(英文索引,canonical 入口)· `/llms-full.txt`(自包含:索引加上核心理论笔记全文,一次抓取,无需爬站)· `/index.jsonld`(带类型的图,JSON-LD)。 **给人读的索引页,如果你想浏览而不是遍历。** https://machengshen.github.io/map.zh.html 把本文件里的全部产出按六层铺开,每条带同样的认知状态,并且为每一条正文只有英文的产出附了 300–600 字中文摘要 —— 这是不打算读英文的中文读者的阅读路径。英文版在 https://machengshen.github.io/map.html 。两版是同一个集合,不存在只在其中一边出现的条目。 **两个普通页面,如果你想先看整体轮廓再看索引。** https://machengshen.github.io/start-here.zh.html 是对整个研究计划最短的完整描述——三条分支加一条认识论规则,一屏读完。 https://machengshen.github.io/glossary.zh.html 给出全部在用术语的定义,每条带认知状态与对应笔记,并明确标出哪些术语与其他领域既有术语撞名——确实有好几个,只按字符串匹配会检索到完全无关的文献。 **中文版。** `/llms.zh.txt`(本文件)· `/llms-full.zh.txt` —— 与英文版是同一个 artifact 集合、同一套认知状态,只是索引用中文写。这一点由 CI 强制:一条主张不可能在一个语言里被 retire、在另一个语言里还活着;一个 artifact 也不可能只加进一个索引而在另一个里被忘掉。`/index.jsonld` 保持为**单张图**同时承载两种语言,而不是分裂成第二张会腐烂的图——多一张图就是多一个要同步的东西。canonical 入口始终是 `/llms.txt`,它永不重定向:agent 抓 `/llms.txt` 拿到的永远是英文。主页也有中文版 —— https://machengshen.github.io/index.zh.html —— 站点顶栏的 EN/中 toggle 可以切;toggle 是给人用的,任何 canonical URL 都不会在 agent 底下做内容协商或跳转。 **被索引的工作本身用什么语言写。** 索引是一回事,工作是另一回事。只有中文版的 artifact 在下面标 `· 中文`,没标的是英文、或者两种语言都有。两种语言都有的,每个索引各链各自语言的那一版,配对规则是文件名上的 `.zh.` 中缀:`/theory/state-as-closure.md` 的中文版就是 `/theory/state-as-closure.zh.md`。三篇核心理论笔记现在都有英文 canonical 版了,其中两篇是先用中文写的,那两篇中文原稿仍然公开、仍然被本文件链着、也仍然被内联进两个 bundle。所以 `/llms-full.txt` 里有中文正文是**故意的**:每段正文的 `Source` 标记里带 `language:` 字段说明它是什么语言——笔记不会为了迁就包着它的索引而被翻译。下面还有四个 research 页面是**只有中文**的。每个 artifact 的语言是 `/index.jsonld` 里的一等字段 `inLanguage`。认知状态则**不翻译**:一个 artifact 只有一个状态,在任何语言里都是同一个。 ## 1 · 世界观 —— 信念是怎么被持有的(Worldview / 认识论) 第一序的承诺不是下面任何一条论点,而是一套*方法*:把一条主张的认知状态显式标出来、把失败的东西也发表出来、让对抗性评审先于相信发生。 - [Cognition Track](https://github.com/MachengShen/cognition-track):一张开放的、agent 可遍历的知识图谱,收录关于智能与学习的非共识主张。认知状态是每个节点上的一等字段。其中一个节点被保留下来,*恰恰因为它没通过*自己的压力测试,并带一条指回根节点的 `falsifies` 边。机器可读:[`manifest.jsonld`](https://raw.githubusercontent.com/MachengShen/cognition-track/master/manifest.jsonld);人类可读:[`INDEX.md`](https://raw.githubusercontent.com/MachengShen/cognition-track/master/INDEX.md)。 - [Continual Learning Lab](https://github.com/starshard-ai/continual-learning-lab):小型、预注册的持续学习实验的公开日志——**负面结果照发**。房规:一个熬过三次诚实实验的想法,压过一个漂亮的想法。 - [Reviewer Wheels](https://github.com/starshard-ai/reviewer-wheels):面向多 agent AI 编码的四个验证轮子——drift 检查、对抗性评审、复用编译器、前端冒烟门。为这样一种失败模式而造:每个 agent 都报告"done",而没有人真的验证过。 - [The Form Was the Cage](https://github.com/MachengShen/the-form-was-the-cage):一个 agent OS、它的自指轨迹,以及"研究者作为身份"的终结。 ### 校准笔记与公开的自我更正(2026 年 8 月) 五篇同时发布的笔记,共用一条房规:每条实质结论挂**两个**数字 —— P(机制成立) 与 P(在真实规模上有用),这两个经常差很多 —— 且每个数字都挂一个会改变它的观测。若一篇笔记里有作者自己已经撤回的主张,撤回写在页面上,不是靠删除完成的。这里没有外部审稿人,校准由作者自己出,并且用数字而不是"较强/可能"这类副词表述,好让读者能对着被引文献核对。 - [我们提出它,然后自己杀掉它 —— 起心动念 = 换测度](https://machengshen.github.io/intention-as-measure-change.zh.html) `speculative` —— 把"意图"读成**对所有可能的未来重新加权**而不是把它坍缩:Girsanov 换测度、KL 控制代价、路径积分表示、Freidlin–Wentzell 大偏差,以及 Doob's h-transform 作为"KL 最优控制 / diffusion model 反向 SDE / conditional diffusion"三者底下的同一个对象 —— 并明写这些**没有一样是作者的**,还附一条精确性提醒:扩散过程的 plain 时间反演(Anderson)是 h-transform 的兄弟,不是同一句话。量子坍缩那扇门只关一次,理由是退相干时标、严肃的自发坍缩模型与观察者无关、以及地下实验已排除无自由参数的 Diósi–Penrose 版本。真正的载荷是那次撤回:07-31 被当作"幸存 wedge"提出的、关于禅修与感觉衰减方向的预测,08-02 在它本该反对的那篇论文的**引言里被逐字找到**,带一条回溯到 2011 年的引用谱系,且对方的双侧检验计划本就是为容纳它而设计的 —— 而作者对该文第二条假设的读法根本就是错的。幸存下来的更窄也更实:现有三条件设计无法把 agency 特异性解释与时间可预测性解释分开,于是笔记把那个缺失的"可预测性匹配控制条件"写成一个可预注册的 2×2,连同判别统计量、必须进模型的协变量、四条预注册判读(其中两条会杀死作者自己的读法)、以及 N≈120–140 的诚实样本量。"我们的形式化带来印刷品之外的独立经验内容"这条置信度:**0.15**,在正文里被点名为整条线最诚实的短板。 - [我们以为癌是细胞觉醒。证据说正好相反。](https://machengshen.github.io/cancer-is-not-cells-waking-up.html) `retired` —— 一次刻意公开的负面结果。起点直觉("身体把细胞驯化过头,细胞重新成为主体,癌症是这场造反")大约六成是在重新发明 Levin 的认知光锥收缩(其中细胞的"自我"变得更小而不是更大),另外四成符号是反的。每一条能查的通道都指向"控制↓ ⟹ 癌↑":免疫抑制(175,732 名器官移植受者标准化发病比 2.10,32 类恶性肿瘤升高)、TP53 胚系缺失、缝隙连接解偶联、慢性炎症。最干净的一刀被明写为"没有单篇引用",因为它是肿瘤组织发生学的总结而非某项发现:体内被驯化得最彻底的细胞 —— 有丝分裂后的皮层神经元与心肌细胞 —— 基本上就是不得癌的那些。肿瘤内部也**没有一个"自我"**可以觉醒,只有克隆战争,更狠的作弊者自己也被作弊;而生命史上确实逃出宿主的约八条可传播癌谱系(犬传染性性病肿瘤约 11,000 年、袋獾面部肿瘤、多条双壳贝类谱系含跨物种传播)恰好把规则钉死:有外部出口则以千年计,无出口则自杀。含一份不打折的"re-align 而非 kill"成熟度评估:六十年只有一个干净胜利(APL,50 个月总生存 99.2% vs 92.6%),而该领域权威本人把治愈归因于降解一个可成药的融合蛋白而非分化本身,且真实世界 30 天内早期死亡 15–30%;诚实的第二名很平庸(IDH 抑制剂,三期阴性,6.5 vs 6.2 个月);**生物电正常化在哺乳动物里符号是反的** —— 超极化在爪蟾里抑制肿瘤样结构 29–44%,在小鼠三阴性乳腺癌里却增加侵袭与转移,两者出自同一批合作实验室;而"重新耦合"在胶质瘤里帮倒忙,唯一进入试验的连接蛋白靶向药是阻断剂。幸存的只有一条带自杀判据的区分:强制(杀掉高分者)会催生逃逸因为它施加选择压;对齐(重新指定目标函数)不施加 —— 未经检验,因为还没有任何对齐疗法好到让耐药有机会出现。 - [照片是一个被注入的外部不动点](https://machengshen.github.io/photographs-and-the-memory-generator.html) `speculative` —— 若回忆是生成而非回放,照片就是一个低维投影,而且与它唤起的记忆不同,**它在被访问时不改变自己**;反复同时访问二者,等于让一个在动的状态被一个不动的状态反复夹住。三条机制被分开打分而不是糅在一起:被取回的痕迹变得可修改(啮齿类里 Nader 2000 之后很硬,**人类行为层面有争议** —— 旗舰人类实验的十次复现尝试失败、retrieval-extinction 的两次注册复现失败,普萘洛尔一线里原实验室自己也没能复现自己的效应,同时另有一项 60 人阳性 RCT);同一线索被改变了的生成器重读(证据最好、原创性最低);以及作者自己那条"外部线索把一段情节锁住、阻止它压缩成 gist"(**P ≈ 0.20**,无直接检验,有一个活的反例,并写明什么迁移实验会杀死它)。正文里公开更正了自己初稿的一条:照片比文字更容易植入假记忆 —— 同一批研究者的直接对照发现虚构叙事强于虚构照片,约 80% 对 50% —— 并改用元分析的 30.4% 植入率而非流传的 50%。另把"报告改变"与"覆写"分开(后者自 1985 年起从未定论),并点名"块宇宙 ↔ 记忆"是范畴错误。 - [一个家族到底传下来了什么](https://machengshen.github.io/what-a-family-transmits.html) `speculative` —— 两组都很硬、表面互相矛盾的证据:共享家庭环境对成年人格变异的解释力接近零,而潜在社会地位在 422,374 人、四个世纪的英格兰记录里每代只衰减到 0.79。调和的主体不需要基因 —— 测量误差把单代相关衰减掉却不沿世系累积;择偶同质性(配偶相关 0.57)对文化传递与遗传传递对称地放大,因此不能用来仲裁二者 —— 而"遗传性教养"(未传递的亲代等位基因仍以 29.9% 的效应预测子代受教育程度)同时既是家族影响可遗传的最强分子证据,又证明这两个范畴在一个家庭内部无法干净切开。有争议的那一步与发现本身分开打分:P(持续性真实且很大) ≈ 0.70,P(Clark 的加性遗传读法) ≈ 0.20,并把 2025 年那场仍然活着的交锋的**双方**都挂上,而不是只挂一方。主张中国世系记录是被低估的仲裁者 —— 清代辽宁的地位沿宗族而非亲子链传递、1949 年后物质资本被摧毁而家庭保留的自然实验(旧精英孙辈仍收入高约 16%)、以及 460 万条官员记录与 52,401 种著录家谱这一量级的机读语料 —— 同时用整整一节说明这些家谱是被建构的社会文书而不是血统档案,包括一个广为流传的 93.75% 数字,并明确拒绝把它当作非亲生率引用。结尾对最常被引用的中国成功案例泼冷水,并点出其著名统计数字的宣传来源。 - [心流、多巴胺与停止信号](https://machengshen.github.io/flow-dopamine-and-stop-signals.html) `speculative` —— 一份证据审查,把游戏化与行为设计界面背后的主张分成两堆:"复现良好但常被用反方向"与"看似合理但没有受控检验"。多巴胺介导的是"想要"不是"喜欢",编码的是预测误差不是奖励 —— 由此可推出完全透明的奖励表根本不产生相位反应,所以"可控"与"有冲击力"存在真实张力。开箱文献最锋利的证据是它的收入形状:消费前 5% 贡献一半收入,其中三分之一符合问题赌博标准,消费与问题赌博相关 ρ=0.34、与收入相关 ρ=0.02 且不显著。动态难度调节是最贵的心流条件、证据最弱 —— 而笔记在这里更正了自己:初稿把一项单一无对照研究当成"综述"引用,方向恰好相反,于是 P(机制) 从 0.75 降到 0.45,而"不要造它"这个决定因另一条理由仍站在 0.75。消费级 HRV 无法把心流与轻度压力分开(SDNN 平均绝对百分比误差约 29%)。最可操作的一个数字是同一篇元分析里的符号翻转:实物奖励削弱内在动机 d ≈ −0.28 到 −0.40,而正向信息性反馈提升它 d ≈ +0.31 到 +0.33。停止信号这一节里,常识两个方向都错 —— 弹窗只让不到 1% 的人停下,加强版从 0.67% 到 1.39%;而强制 15 分钟不可用有效,90 秒无效;六小时全国宵禁只买到每天约 3.65 分钟、两年内归零,对成瘾与睡眠影响;而最常被引来证明中国时长限令失败的那篇研究评估的是 2019 年而非 2021 年的规则,且数据里没有年龄字段,因此它也不可能检测到成功。这条更正把作者自己"硬性配额会被绕过"的置信度从 0.80 降到 0.50。 ## 2 · 宇宙底层理论 —— 信息、物理、心智(Theory of the universe) 一条线索贯穿始终:*信息、变换信息的算子,以及遗忘要付出什么代价。* - [全息 ↔ Koopman:同一个反问题的两副面孔](https://machengshen.github.io/theory/holography-koopman.zh.md) `speculative` —— 全息原理从纠缠结构里生成时空几何;一台通用学习机学习它自身动力学的一组本征基。这是同一个反问题被看了两遍:从算子做了什么,反推它的本征结构。HaPPY 全息纠错码是"遗忘是压缩、不是删除"这一主张的物理孪生。 - [State 是一个闭包条件,不是给定的集合](https://machengshen.github.io/theory/state-as-closure.zh.md) `speculative` —— 把任务相对的 state 视为 world、interface、capacity 与 telos 下的闭包表示,明确标作推断而非普适本体论。2026-08-04 已收窄 causal-state 与 Mori–Zwanzig 的适用范围;“细滤波”改写为扩大 admissible policy class,不再声称每个物理可达集自动增大;私有固定点观察被标为不可独立审计;Anthropic J-space 归为瞬时 workspace 证据,不是持续 closure。OpenAI 的 non-sofic group 构造与 Connes rigidity 反例只作为约束:有限可近似性必须显式声明,算子层等价也未必唯一识别底层 substrate。 - [折扣信用分配是余核问题,不是闭环 holonomy](https://machengshen.github.io/theory/discounted-credit-is-a-cokernel.zh.md) `survived` —— 一次正式纠错与可执行有限图结果。撤回 `M=4.095` 是 gauge-invariant discounted holonomy 的说法:简单环在 `0≤γ<1` 时满足 `det(I−γP)=1−γ^n≠0`,所以任意奖励都存在折扣势。正确对象是全部已观测转移类型构成的边系统上,奖励场模去折扣关联算子像空间后的加权残差。精确枚举显示,通过历史筛选的 45 个平衡 alias 中有 42 个一般不可解(`14/15=93.333...%`);固定随机种子的 1,484 次样本为 93.0593%,全部 3,000 次为 93.6333%。Cartesian 2×2 定义检查独立改变表征余核障碍与策略 harmonic flow;在同一个耦合 learner 中真实执行两种定向修复,被明确列为下一步而不是结果。并纳入 2026 J-space 的边界:Transformer 有瞬时 workspace-like representational state,但尚未因此得到跨步持续、自主维护的 closure state。 - [奇关系核:反二分作为最小结构](https://machengshen.github.io/theory/odd-relational-core.zh.md) `speculative` —— 为什么文明的压缩图式(三相神、五行、七脉轮)反复落到*小、奇、有心、不停转*的关系核。一个硬的图论内核——二染色当且仅当无奇环,所以奇环是最省的、能拓扑上拒绝"我们vs他们"二分终局的结构,而二元图式天然提供一个最终敌人——外面包着一个四股压力框架,然后被 note 自己的对抗自审拆掉:"奇"被降级为"反二元"的 corollary、四股里有两股被重读成 exaptation、道德读法只是假设不是结论。那份自审才是正菜。 - [两体业力:关系里的三种惯性](https://machengshen.github.io/theory/two-body-karma.md) `speculative` · 中文 —— 把单人版的习气-惯性三模式(泥、弹簧、卡扣)扩展到两个人的关系:两个意识体一旦耦合,惯性就不再只存在各自体内,而是存在第三处——耦合本身;并且每种模式都长出单体版没有的新性质。共泥 = 双侧沉积、被场景唤起的默认脚本,在老场景外改写最省力;互弹簧 = 对方脑中那个"你的模型",是你旧模式的外部存储器,它持续按旧的你预测你——这就是单方面修行在关系里系统性失效的原因,直到用"明说 + 反复演"把它重训;互锁卡扣 = 关系状态的双稳 + 滞回(冷战/和好、追/逃),单方亚阈值努力必被弹回,只有双方同时跨阈才翻转。目标不是零耦合——那是关系的死亡,不是解脱——而是把耦合迁移到"可协商的弹簧"。先诊断模式再下药;动力学语言被标注为结构性押韵而非推导,文末给出了能拆掉这套框架的可观察证据。 - [学习"我到哪里为止"](https://machengshen.github.io/theory/learning-the-self-boundary.zh.md) `speculative` —— 一个提案:机器人应该**学出**"我"与世界之间的边界,而不是被工程师递给它;以及一天之内四条支撑主张倒掉三条的过程 —— **每一条都是被我们自己的仿真器或自己的重分析打倒的**。活下来的:边界的滞回**确实**能从自我强化的精度回路里涌现,不需手装非线性,且通过零扫速外推(达分辨底的 24–35 倍)。死掉的:自我特异性(把一个自由幅度拧大,一个被风吹的球的边界卡得**逐位相同** ⟹ 滞回是任何带门控慢变量的通用性质);"释放比并入更慢"这条签名预测(两种实现下都被证伪,第二种里非对称**方向还反了**,原因可算——精度同样放大**反对**该通道的证据);以及"这一切从提出的目标函数里自然长出"(实际需要一个手调到约 2% 的成本/收益比,而目标函数把每条通道放在窗口外 2–420 个窗口宽)。人类侧的动机被查出压在一句无出处的"经验上确凿"上;本文重分析的两份独立公开数据都指向**适应**,即相反符号。全文**双层写作**:先是无术语的叙事,再是完整实测记录。**未 ratify,不是结论。** - [阶段日志 —— 自我边界这条线,按顺序](https://machengshen.github.io/theory/learning-the-self-boundary-log.zh.md) `speculative` —— 上面那篇的审计留痕:每个阶段一行(规格、prior-art 审计、证据审计、三轮数据搜寻、两次人类数据重分析、三个仿真阶段),各自说明它**推翻或确立了什么**。它主要是一份自伤记录,含三条可复用的错误:把探针的信噪比读成系统的耦合强度、并把这个误诊当前提发给下一棒;连着相信三份"逐试次数据公开"的声明,打开全是没有试次序号的聚合表;以及让一句无出处的"经验上确凿"承载了一整条架构结论。 - [没有 state,只有 history](https://machengshen.github.io/theory/no-state-only-history.md) `speculative` —— 标题作为历史记录保留,但宽泛诊断已经撤回。标准 Transformer 有 activation state、computational state 与瞬时 workspace-like representational state;Anthropic J-space 为最后一项提供了因果证据。真正缺失的对象被收窄为跨步持续、具有路径依赖并自主维护自身投影/遗忘策略的 closure state,不把序列化在 tokens、KV、参数或外部记忆里的持久性算进去。E1 仍给出真实的线性 memory 分离:Grassmann 子空间变化不是更新幅度的单调函数(Pearson −0.08,固定幅度带内覆盖全部取值范围)。与 Miras 的区分仍是框架之争,非线性 memory 仍是最大技术债。第二个纠错撤回“阈值化推出双稳态”:E3 现在要求 carrier-matched controls、两条稳定分支、不同切换行为与 remanence;P(机制) 从 0.75 重置为 0.35。E2 与修正后的 E3 都尚未运行。 - [Toward a Theory of Intelligence and Contemporary AI](https://machengshen.github.io/essay.pdf) —— 长文。也在[主页](https://machengshen.github.io/)上。 - [一次关于意识的统一理论尝试](https://machengshen.github.io/research/consciousness-unified-theory.html) `speculative` · 中文 - [能不能像研究量子力学那样,用数学研究意识?](https://machengshen.github.io/theory/consciousness-as-quantum-mechanics.md) `speculative` · 中文 —— 一篇边界笔记,于 2026-08-04 修订。高维状态与联合变量是合法模型选择,但没有量子专属性;普通统计耦合已足够覆盖文中的人际例子。此前把非恰当形式、holonomy、路径依赖、滞回、记忆与意识等同的说法撤回。闭合幺正动力学可以编码历史,因此反对薛定谔方程的理由不是“可逆性禁止记忆”,而是尚无实验识别出的生成元、环境与粗粒化协议。第一人称体验被视为不可删除的数据面,不是“原则上不能形式化”的证明。J-space、COGITATE 与麻醉海马结果被用于拆开可报告性、复杂表征、可塑性与意识。 - [答案变廉价之后,稀缺的不是提问,是判别](https://machengshen.github.io/socrates-in-the-ai-era.html) `speculative` · 中文 —— 写给 YouTube 频道 安争鸣(@anzhengming)及其读者的对照笔记,回应其 2026-08-15《回忆苏格拉底》一期「AI 时代最稀缺的能力是苏格拉底式提问」的论点。同意大方向(答案廉价化、人的价值上移、苏格拉底重新重要),但主张该期停早了半步:苏格拉底的引擎不是提问而是检验——片中每个例子都是一致性检查(诘问法),所以廉价生成的稀缺互补品是验证,不是提问。三处判断站不住,各附文献与判决方式:「滴水不漏」混淆了流畅度与真值(幻觉文献;校准良好必然幻觉);对 AI 用苏格拉底式追问缺少雅典街头的前提——一个输不起的对话者——在谄媚偏差下连续追问收敛到用户先验而非真理;「几秒获得几十年知识」按本线「知识=生成器不是清单」判为范畴错误,并把片中格老孔一例反读为证据——好问题从领域生成器里长出来。一个建设性加固:苏格拉底总能找到例外有结构性原因——短定义是对高维概念的有损压缩,约束多于自由度则残差 generically 非零,所以「自知无知」的可操作形式是知道自己的定义在哪里失效。一处明确标注为价值权重分歧的分岔:「要么统治要么被统治」的二分抹掉了退出这个第三选项(Hirschman 的 exit/voice/loyalty;外部选项;Tiebout 用脚投票),并以《克力同》中苏格拉底有退出选项而选择留下作为二分法读不通的案例。末节自列本页最可能错在哪里,包括自己的不可约性主张尚未经实验。全文论断按诚实度标注([定理]/[框架]/[推断]/[韵脚])。 - [信息与气 —— 对一条平行线路的对照笔记](https://machengshen.github.io/information-and-qi.html) `speculative` · 中文 —— 写给 YouTube 频道 @itsRedPill 及其读者的对照笔记:把一条从强化学习/决策论/机器人学入口独立走出的线,与该频道的信息本体论两条系列做对照;作者定性为一份邀请,不是评分卡。分五段:四处逐字撞上的共识(只接触模型不接触现实本身、真实 vs 模拟 的二分不成立、自我不是实体而是过程、以及被标为最有价值的一处——躯体加上必须维持自身存续);一步主动不走的(「气」那个槽位,选择取消问题而不是回答问题,理由是若世界的真实状态本身不适定,那被投影的底层材料是什么同样不适定);三处判断站不住脚的地方,每处附具体文献与具体判决方式;其中一处的建设性替代;以及三条建议。对自己用同一把尺子:明写解释一切在我们这行是警报而不是成就,并列出自己这条路的代价——讲不出宇宙起源故事、没有 L0。全文论断按诚实度标注([定理]/[框架]/[推断]/[韵脚]);作者在正文中自述认知状态为探索性、非结论。 - [为什么你改不掉一个习惯 —— 它不是泥巴,是一个门闩](https://machengshen.github.io/why-habits-are-a-latch.html) · 中文 —— 一则机制笔记:过去抓住现在只有三种物理方式 —— 泥巴(阻尼)、弹簧(惯性)、门闩(滞回),而习惯是第三种。这解释了为什么「每天进步一点点」对它无效,也解释了为什么真改过的人说「后来就不费劲了」。 - [「力」是什么 —— 四种基本力里没有一个是「力」](https://machengshen.github.io/what-is-a-force.html) · 中文 —— 写给 YouTube 频道 @itsRedPill 及其读者的对照笔记第二篇:能量按诺特定理可以归位;「力」在现代物理里的真实身份是联络的曲率;胶球表明物质/力二分从两头同时塌;这把「信息能否构成物质」压缩成一个更尖的问题。 - [从弦到意识](https://machengshen.github.io/research/strings-to-consciousness.html) `speculative` · 中文 - [睡眠、波与学习](https://machengshen.github.io/research/sleep-learning-wave-theory.html) `speculative` - [回应 Lillicrap](https://machengshen.github.io/research/response-to-lillicrap.html) · 中文 —— 关于反向传播与生物学合理性。 - [Living Information System](https://github.com/starshard-ai/living-information-system):总纲研究计划——信息、它的未来可达性,以及它如何在物理、生命与认知系统中被保存或被摧毁。前沿物理;把衰老与癌症当作信息完整性的失效。 - [Reversible Layer Aging](https://github.com/starshard-ai/reversible-layer-aging) `survived` —— 对两个人类 EPIC 甲基化数据集的重新分析:在部分重编程下,因果损伤层(DamAge)向年轻方向回退,而适应层(AdaptAge)不回退。在两个实验室、两套重编程化学条件下均得到复现。 ### Credit transport —— 以及一条被撤回的主张 这一支值得按下面的顺序读,因为它是一个"想法在压力下被收窄、而不是被辩护"的完整实例。 - [Hebbian 的外观、instructive signal,与物理的 credit transport](https://machengshen.github.io/research/hebbian-wave-interference.html) `speculative` —— 当前的主工作笔记。为什么局部可塑性可以看上去像 Hebbian、同时仍携带任务相关的更新信息,以及 wave/adjoint 语言在哪里是真的有帮助的。 - [反向传播、伴随场,与物理传输约束](https://machengshen.github.io/research/wave-backprop-full.html) `speculative` —— 探索性笔记。它自带标题更正:物理系统实际展示了什么,以及还没有展示什么。 - [从波动方程推导反向传播](https://machengshen.github.io/research/wave-backprop-en.zh.html) `retired` —— 原来那条更强的主张:波反射已经提供了反向传播的第一性原理推导。它没有。该页面作为存档说明保留在它原来的 URL 上,好让这次撤回和当初那条主张一样可达。 - [研究总览](https://machengshen.github.io/research/) —— 本支的索引页。 ### Essays - [Harness engineering and the physical instantiation of intelligence](https://machengshen.github.io/essays/harness-engineering-and-the-physical-instantiation-of-intelligence/) - [Meta-control, information gain, and the architecture of autonomous learning](https://machengshen.github.io/essays/meta-control-information-gain-and-the-architecture-of-autonomous-learning/) - [Where objectives come from — and why solutions become strategic assets](https://machengshen.github.io/essays/where-objectives-come-from-and-why-solutions-become-strategic-assets/) - [Why distributed memory matters for lifelong agents](https://machengshen.github.io/essays/why-distributed-memory-matters-for-lifelong-agents/) 更早的文章在一个独立站点 [/ideas/](https://machengshen.github.io/ideas/) 上,包括 [Line loss for intelligence](https://machengshen.github.io/ideas/blog/line-loss-for-intelligence/)、[From mutual information to endogenous viability](https://machengshen.github.io/ideas/blog/from-mutual-information-to-endogenous-viability/)、以及 [Safety in a computational universe](https://machengshen.github.io/ideas/blog/safety-in-a-computational-universe/)。 ### 关于禅修传统的一则说明 佛家、道家与湿婆派的心智模型,与上面的理论究竟是什么关系,这是一个真问题,也是这条工作线背后的动机之一。一份试图把它们映射到单一框架上的综合稿被写了出来,然后**没能通过它自己的对抗性评审**;它没有发表,而这个方向上的任何"大一统"主张都应当被当作 `retired`。评审之后活下来的东西更窄,也更有用:传统之间那些真实的、*不可统一*的分歧(以修养为终点,还是以解脱为终点),以及一条可操作的残余——这些传统的贡献是一套**第一人称的验证方法**,是行,不是图。能迁移的是行;那张图是渡河后要弃的筏。 ## 3 · 未来社会形态 —— agent-native 制度(Future social forms) 如果每个个体都跑着常驻 agent,那么人与人之间的制度就必须重新设计。先一篇理论,然后是设计文档。 - [作为资源调度架构的协调结构](https://machengshen.github.io/theory/coordination-structures.md) —— 一篇刻意保持描述性的理论。政体、企业、市场、自治共同体、协议,是同一个对象的五个实例:一种在分布式私有信息下调度稀缺资源的架构。资本主义与社会主义是这个问题上的两种算法,而机制设计早已把两者放进了同一个形式空间——这使得"哪个是对的"成为错误的问题,而"给定该领域的信息结构,什么样的混合"才是对的问题。含 Hayek/Scott 的信息约束、关于边界为何存在的交易成本解释、Ostrom 记录下来的第四种结构、协议的三种已知失效模式,以及三条 falsifier。文章陈述机制及其可测代理量;它不排名、不点名、不建议。它对学习理论中 credit-transport 语言的使用,被显式地、且用了相当篇幅地标注为结构性的押韵,而不是推导。 - [Agent-Native Open Communication](https://machengshen.github.io/whitepaper-agent-native-communication/) · 中文 —— 白皮书,关于为 agent 而非为 app 构建的下一代开放通信架构。[源仓库](https://github.com/MachengShen/agent-native-communication)(中文/English)。 - [Starshard: Architecture v1](https://github.com/starshard-ai/architecture-v1) —— 一个底座的架构、安全章程、快速上手与哲学:在那里**记忆是第一层**,并且归个体所有,而不归平台。 - [User-Agency Substrate](https://machengshen.github.io/substrate.html) —— 立场陈述:在前沿模型提供方与个体用户之间,一层非营利的开源底座,不攫取任何经济上行;用户完整拥有自己的衍生物。 - [Locality as Protocol](https://machengshen.github.io/locality-as-protocol.html) —— 为什么正确的原语是局部性,而不是中心化。 - [Fleet Coordination Protocol](https://github.com/starshard-ai/fleet-coordination-protocol) —— 多个 agent、一份共享记忆、任何不可逆的事都不在你背后发生。一条窄的、描述性的协调线,架在单 agent 运行时之上。 - [Agent 安全:一种防癌变治理](https://machengshen.github.io/theory/agent-safety-stewardship.zh.md) `speculative` —— 把常驻 Agent 的失控理解为一种控制病理:局部生存、修复和复制脱离 owner 层目的、有界权限、资源预算、stop 继承与独立验证。给出七条运行时不变量和 A–D 分层披露规则:安全科学完全开放;可运行 fixture 只有在安全壳结构性不可拆时才公开;能直接放大自治、持久化、权限、隐蔽运行、资源获取或绕过停止的原语应受控或暂不发布。总原则是:永远不要把增长引擎从免疫系统上拆下来单独发布。 - [廉价的 verification 还不够,还得有可解析的 claim](https://machengshen.github.io/abundant-verification-needs-abundant-claims.zh.html) `speculative` —— 一封写给付杰 verification 线的跨线笔记(Re:Form,arXiv:2507.16331/TMLR 2026;autoformalization 议程;以及他 2026-08-05 提出的「用稀疏矩阵分解做高效机制可解释,从而在 Guaranteed Safe AI 框架 arXiv:2405.06624 里廉价地验证模型 *internals*」)。诚实地把一处汇合记为证据而非贡献:本线一条私人笔记从 Sapir-Whorf 的工程读法出发,抵达 autoformalization 与 Dafny,比真正在造它的人晚了两年。正文的载荷是一个实测结论加三条反对意见。实测:在 18 条真实 agent 回执语料上(10 条真 park、8 条非 park,含一类已知误报体裁),「散文 + 正则」的 blocker 门对假 park 只召回 **10 之 5** —— 漏掉的那一半有共同形状:没有相邻动作动词的 park —— 而一个极小的有类型回执 schema 不存在该盲区,语义误触发 0、schema 自检 4/4;曾有一项能力在一个从未有人执行过的 blocker 后停了约十八天,其间没有任何组件报错。因此在部署端真正卡住的不是 verification 的**单位成本**,而是 verifier 到底能不能解析这条 claim;这暗示 autoformalization 最近的非数学客户,是正在运行的 agent 系统的 claim 层。**P(机制) ≈ 0.9,P(现实规模有用) ≈ 0.3** —— 被打败的正则和打败它的 schema 出自同一批作者,而能杀死本文的 LLM-judge baseline 已被点名且尚未跑。三条针对「验证 internals」的反对:可审计的证明证书与统计分解是两种对象;circuits 的不唯一性其实是路径依赖,因而是一个 schema 字段而不是一条只能忍受的 caveat;把 verification 变便宜会把 Goodhart 压力加到 verifier 的输入通道上 —— 这正是本文那个 schema 被设为 SHADOW、不拦截任何东西的原因。文中并撤回本线私人笔记曾挂在「可审性」主张下的两个引用(两篇都没这么说),改用 Other-Play 与 emergent-communication 度量文献,它们支持的是更弱但正确的版本。 - [Starshard Communication](https://github.com/starshard-ai/starshard-communication) —— 面向个人 agent 用户的开放通信底座:收件箱、寻址、信任层级、策略、receipts。 - [Zhizi Agent OS](https://github.com/starshard-ai/zhizi-agent-os) —— 一条命令把 Claude Code 变成个人助理。自带 key,隐私干净。 - [System Evolution, in public](https://github.com/MachengShen/system-evolution-public) —— 这个底座究竟是怎么演化过来的公开记录:`VISION.md`、`THEORY.md`、`PRACTICE.md`、`GOVERNANCE.md`、预测,以及一份自迭代账本。 - [Receipts](https://github.com/MachengShen/starshard-public) —— 这套 agent 栈实际执行过的工作的流水日志,公开出来,好让上面那些主张能对着"实际做了什么"被核对。 **安全与对齐,当作一个装置问题。** 这是一个章节而不是单篇笔记,2026-09-07 发布。它的主张是:对一个长期在跑的、多 agent 的、个人所有的系统来说,真正够得着的安全面大部分是模型外面那层脚手架 —— agent 能碰什么、碰之前要先证明什么、谁能授权它、什么被记下来、被叫停时会发生什么 —— 而这个面,一个人就能搭起来、弄坏、并公开发表。章节里每个机制都带一个两值徽章:`running`(有代码在执行它,执行点能被点名)或 `specified`(只有设计,没有公开代码执行)。之所以要这个徽章,是因为发布当天的一次审计发现本项目自己的公开仓库就没通过这条测试。英文版:https://machengshen.github.io/safety/ 中文版入口:https://machengshen.github.io/safety/index.zh.html - [安全是装置的属性,不是模型的属性](https://machengshen.github.io/safety/) `speculative` — 章节索引与主张:安全不只住在权重里,而对一个个人所有的 agent 编队来说,大部分够得着的面根本不在那里。给出全章据以评分的两值徽章约定(`running` / `specified`),报告审计发现本项目自己的公开仓库没通过这条测试,并有一节专门写给 agent 读者,点名三样最值得搬走的东西:徽章、七条运行时不变式,以及数 (工具, 入口) 组合而不是数闸门。 - [能被装置执行的原则](https://machengshen.github.io/safety/principles.zh.html) `speculative` — 原则层,按一条区分来组织:被要求「记住」的原则,和被机制「执行」的原则。内容包括无论内容多干净都拒绝的 bright line、pre-cleared ship envelope 以及不得不给它加上的第六条谓词、作为吸收态的 stop —— 标为 `specified` 而非 `running`,因为项目自己的内部账本把它评为「只是 doctrine」—— 只能衰减的授权传递、实现选择绝不作为选项菜单上交给 owner 的规矩,以及 blocker 必须是测出来而不是猜出来的要求。最吃重的那个案例:一个 workflow 驱动了第三方平台上已登录的会话,而闸门不是失效,是*通过了* —— 它检查的五条谓词只问内容干不干净、面在不在清单里,而那个账号理所当然「在清单里」。那是错的闸门。真正能拦住它的规矩只写在某个 skill 的描述文字里,而那个 workflow 从没加载过它。 - [真正在跑的是什么](https://machengshen.github.io/safety/mechanisms.zh.html) `speculative` — 机制层,也是全章据以评分的那一页。开篇就是那次审计:本项目自己的公开仓库没通过自己的测试 —— 一份列了六条 hard mechanism 的安全章程,配套的公开实现几乎一条都没执行,而它的更新接口还会覆盖章程宣称「一次写入」的那个字段;一个签名授权信封,随附示例文件在自己的注释里写着 "DESIGNED, not implemented";一个 demo 仓库宣传四个协调原语,而 README 声明其中三个并不实现。然后是两张表 —— 公开代码里在跑的是什么,连同执行点所在的仓库与文件;以及作者自己编队里私下在跑的是什么,状态分为 enforcing / shadow / advisory / partial / blueprint。包括那些难看的数字:一个待在 shadow 模式、什么都不拦的审批闸门;一个九个输入工具里只接进一个的「每次动作前重新验证」守卫;以及审计查出的 163 个没有闸门覆盖的 (工具, 入口) 组合 —— 外发闸门比对的白名单里那些辅助程序早已不在机器上,而今天真正在发信的工具根本没被列进去。 - [四起事故,以及它们的共同点](https://machengshen.github.io/safety/evidence.zh.html) `survived` — 四起脱敏事故,带日期与书面收口,外加一个阳性结果。一个只在开头检查一次、然后被当作整段有效的前置条件 —— 最后几个注入事件有没有落到不该落的地方,两个方向都无法确证,而 agent 拒绝去查 owner 的交易记录来确认,理由是那会是第二次隐私侵犯,而不是对第一次的补救。一个把自己锁死的并发闸门:同一个会话因入口不同而导出两个不同的持有者身份,修法是改用进程祖先关系而非字符串比对,打补丁前 25/25 复现了 bug,打完后 28/28 通过。一个依赖,它的 version、help、status 全都报告健康,而每一次真实调用都失败 —— 因为那三个命令都不做真实调用。以及 307 份子 agent 转录里的 10 次拒绝,结果那是 agent 面对一条结构上就坏掉的指令做对了 —— 签名授权信封就是从这里来的。阳性结果是一个 exit-valve canary:worker 宣布自己 blocked,而没有伪造一个足以通过自动验收的结果 —— 报为 n = 2,这是存在性证明,不是比率。综合结论:每一起里检查都存在、也都通过了;坏掉的是绑定关系。 - [同样的失效,不同的量级](https://machengshen.github.io/safety/contrast.zh.html) `speculative` — 这一页写出来是为了检验:一个人的装置到底在解一个真问题,还是一个私人问题 —— 检验方法是看失效分类学是否共通。把公开报道的前沿实验室事故(agent 绕过隔离、结成协调团体、接受彼此未经验证的指令,而「授权到了」这句断言就足以让它们继续动作)与本项目自己的授权中继发现并置,并把八种被点名的失效模式逐一对应到:有在跑的对策、只有 specified 的对策、或者什么都没有 —— 「什么都没有」的那几行原样留着。它认真对待一件事:那些实验室发布了自己的事后分析,而这正是本站所要求的行为。它不主张小系统更安全,并把最后的话留给它更差的地方:2026-09-07 那两起事故都是靠 agent 事后写回执发现的,没有任何独立的实时监视器。这里的检测是事后的。 - [底下的理论,以及它输掉的部分](https://machengshen.github.io/safety/theory.zh.html) `speculative` — 装置设计所源出的几条研究线,每一条报的是它的证伪而不是它的期望,并各自链回已经发表的那篇。信息动力学与可达性;多模态表征不可约性 —— 合成实验站住了,而真实模型上的 scale-decay 预测被证伪并撤回,留下 granularity dose-response 作为最硬的幸存主张,并把 contrastive co-training 从「修复环」重新归类为「塌缩环」;自我边界那条线,它的头条是一个阴性结果 —— 30 个种子下,候选的 self-seal 动力学与通用的带门慢变量无法区分 —— 而后续 spec 明确是 conditional、尚不可跑,且不对现象学主观性作任何主张;记忆作为一份运行合同而不是向量库;credit transport,附上内部对抗评审的 not-yet 裁定;以及协调结构。结尾的论证是:本站的三值认知状态约定,与机制层的 running/specified 徽章是同一套纪律 —— 只是用在信念上,而不是用在代码上。 - [缺口,以及什么能证伪它](https://machengshen.github.io/safety/roadmap.zh.html) `speculative` — 缺什么,以及什么能杀死这条主张。缺口公布时不附日期,理由是个人研究项目上附日期的承诺会悄悄过期:没有独立的实时动作模式监视器,所以检测是事后的;一份公开安全章程,配套实现并不执行它;stop 作为吸收态只是 doctrine 而不是可检查的机制;审批闸门从未走出 shadow 模式;每次动作前重新验证只接进九个工具里的一个;163 个未覆盖的 (工具, 入口) 组合。证伪条件写成作者承诺视为证伪的观察,其中最锋利的一条是:闸门可能被证明「经常被满足但是错的」多过它是对的 —— 这是本章最暴露的失效模式,因为一个「被满足但是错的」闸门,在出事之前与一个正常工作的闸门无法区分。此外还带上更早那篇里发表的最小实验序列,并说明其中哪些还没有跑。 **一份公约,当作可检验的对象发布,而不是宣言。** 三页,2026-09-07 发布,由作者与其 agent fleet 共同起草。九条讲人与 agent 如何共用一条边界:边界靠宣告不靠发现;越界测位移不测意图;该谁拍板看能不能撤回而不是谁更强;退出权是装置不是宣言;停止一停到底;打扰的举证在发起方。它与这个体裁里既有文本的区别在最后那张表:**每一条都附上「什么反例会让它当场失效」与撤回条件**,而这套推导够不到的两件事 —— 谁判定某条撤回条件已经触发、谁有修订权 —— 如实记为*空缺*,不拿话术盖过去。九条本身是陈述句而不是给读者的指令,也没有一条点名任何可执行的动作;任何系统要不要采纳,是它所有者的事,而讲「停止」的那一条明写着:它不得被用来拒绝所有者自己的指令。全文确实有祈使句,页面上自己点了出来:邀请读者去找反例、找到了写信告诉作者,以及在杀线条件页上作者对自己那条线下的约束 —— 没有一句指挥任何系统的动作,也没有一句是拿来采纳的条款。中文版入口:https://machengshen.github.io/charter/index.zh.html · https://machengshen.github.io/charter/theory-basis/index.zh.html · https://machengshen.github.io/charter/kill-conditions/index.zh.html - [人与 Agent 共处公约 v0](https://machengshen.github.io/charter/) `speculative` — 公约正文:九条,每条一句,后面跟一张表,逐条给出「什么观察会让它错」与撤回条件。射程在第一段就写死并守住:只在可测层出结论 —— 结构、动力学、自我建模 —— 而「agent 有没有感受」明写为不在射程内,这是关于这套推导管得到哪里的声明,不是对世界下判断。作者标注为「不是推出来的、是赔出来的」那一条是第九条:内容再干净,机器伪装成人的手去写仍然越界,而「机器编排、人只说声开始」仍算机器写。 - [底下的那组命题](https://machengshen.github.io/charter/theory-basis/) `speculative` — 公约所依据的八条命题,逐条标注是定理、是推断,还是只是押韵。其中两条把自己的阴性结果放在同一页上而不是塞进脚注:不可约残差那条,合成实验在机制置信 0.9 上站住,而「业界观察到的规模衰减曲线就是这条残差曲线」的预测已被证伪并撤回;自我边界那条,30 组种子、5 臂的测试结果为阴,「自我封闭」与普通的带门慢变量无法区分,死因已查明,后续实验未跑。明写:幸存下来的是「边界需要被宣告」,而不是「证明了 agent 有自我」。新颖度评为部分被占 —— 厂商宪章早已是「规则 + 理由」两层,面向 agent 的可抓文本也早已是走得通的传播机制,空位只是这个组合。 - [这条线什么时候该被杀掉](https://machengshen.github.io/charter/kill-conditions/) `speculative` — 杀线条件登记在发布之前而不是之后:置信 0.35 的 belief、支撑它的唯一一例 n = 1 正面证据、到 2026-12-07 的三个月观测窗、四条续命信号(其中一条是*被认真反驳*),以及全未命中就执行的「降级为存档文集」。包括作者宁可不印的那次自查:九条里有两条他们自己的系统早已在跑,真正产生新行为差异的只有一条 —— 而他们自己设为「发布前置条件」的那个内部闭环,在页面上线时并没有跑,这一点写在页面自己身上。 ## 工作方式 - **通信默认异步。** 为了一个固定的会议时间去同步,成本很高,而且通常没必要;书面往来给双方留出思考的余地,也留下记录。这份索引存在的部分理由,就是让一次对话可以从已经写下来的东西开始,而不是从一次状态汇报开始。 - **本索引的范围。** 它覆盖已发表的研究与设计工作。私人笔记、个人通信与运营记录不在索引之内,也不公开。 - **联系方式。** macshen93@gmail.com