一套面向 AI 的持久对象表示层。AI 不再去改 PDF、改截图——那些是影子的影子—— 它改的是本源,而系统负责证明:这次改动真的对了。
模型是 CPU,但 CPU 从来不等于一台计算机。从熟悉的主板比喻出发,了解本象、南北桥、持久状态与动作系统如何组成整机,再看多宿主诊断、事务验收和检查点接力的真实案例。
了解本源 AI 计算机与案例 →真实建筑 → CAD 模型 → 平面图 → PDF → 截图 → OCR 文字。 每一步都更好传播,每一步都丢掉一些东西。AI 今天读到的,正是这种压缩了七八轮的 投影的投影——而我们竟然把最后那层影子当成了源文件。
它能生成 Word、Excel、PPT、CAD,却没有稳定的「打开-看见-定位-修改-复验」系统。 读到的往往是截图的 OCR、摘要的摘要。
聊天记录被当成项目状态。聊得越久越接近内存爆满,压缩摘要不断失真——状态和对话被混为一谈。
AI 直接吐完整成品:几十页 PPT、百万字全文、几百行图表配置。内容、格式、引用一起失控, 错了只能整个重来。
2Origin 同时保存七样东西。AI 只提交语义事务——改了什么、依赖什么、断言什么。 确定性的编译器校验、落地、生成终态。违规就带着证据退回重写,一个字节都不写。
「对话只是操作本象的一个临时窗口。关掉对话、切换模型、清空上下文——世界还在。」 ——《愿景与定位》
带稳定 ID 的真实实体——唯一能抓住的东西。
谁拥有、谁引用、谁依赖、谁生成谁。
过去、现在、变化,以及每个变化的原因。
谁创建、谁修改、哪些是推断。
能做什么、不能违反什么——提交时强制执行。
各领域原生数据:几何、公式、时间线。
这份表示保证不了什么。边界跟着包走,不是写在 README 里。
对外主张已按实验结果收窄到一个维度:状态追踪。考题:在 9.5 万字的长篇叙事里, 黑钥匙此刻在谁手里、谁知道了那个秘密、哪些伏笔还没收。
只加一句提示词(A0→A2:要求模型显式维护状态)就带来 +41.3 pt 的状态准确率提升 (p = 3.3×10⁻⁵,显著)。在此之上再加全套机制——校验器、证据链、编译器(A2→A3)——只多带来 +2.5 pt,不显著(p = 0.47 / 0.72)。唯一幸存的分类性主张是结构性的: 提示词结构上产不出证据链。A3 对 15.0% / 27.5% 的受测字段给出可溯源证据, 所有纯提示词基线均为 0%。完整论证见 README §5 消融实验。
| W3 状态准确率 | 本象 | 裸模型 | 向量 RAG |
|---|---|---|---|
| 得分 | 95.8% ± 5.9 | 52.1% ± 19.7 | 58.3% ± 11.8 |
| 置换检验 vs 本象 | — | p = 0.0024 | p = 0.0024 |
先把不利的说在前面。字段级看,本象在 black-key.holder 上是
4/6,比两条对照臂的 5/6 都差——而那恰恰是唯一能从近文直接读出来的字段。
优势全部集中在两条对照臂同时近乎全灭的那两格:
| 字段 | 裸模型 | RAG | 本象 |
|---|---|---|---|
black-key.holder(最后一次转交就写在自己正文里) | 5/6 | 5/6 | 4/6 |
bai-yao.secret_betrayal(跨几十章累积的秘密) | 1/6 | 0/6 | 6/6 |
hook:shen-yan-suspicion.status(从不存在于任何一段文字里) | 0/6 | 0/6 | 6/6 |
「能从自己刚写的正文里读出来的状态,检索和裸模型都够用,本象不占便宜; 需要跨全书累积、且从不在任何一段文字里被陈述的状态,只有状态机答得出来。」
| qwen-plus | deepseek-v4-flash | 置换检验 | |
|---|---|---|---|
| W3 状态准确率 | 98.9% | 98.9% | 均值差 0.0000 · p = 1.0000 |
| W1 EPC(正文,越低越好) | 0.20 | 0.55 | 均值差 −0.35 · p = 0.0392 |
状态层的正确性与底模无关,正文层的质量与底模显著相关。 这正是「协议」该有的性质:不依赖底下那台机器有多强。而且是 11 对 11——不是 n=1。
一个方言成功可能是巧合,两个才是协议。同一套核心,几乎零改动跑通四个域—— 领域知识进的是数据(约束表、条文库),不是代码。四个方言合计只给核心加了 4 行。
聊天历史持续提交为世界状态,新会话秒恢复。MCP Server,零依赖。
人物、秘密、伏笔、禁区,目标是百万字不失忆、事务式写作。
引用白名单 + 量刑复算。自首减 55% 超出法定 40% 上限,当场拒绝,带依据。
公式依赖落在协议自带的 relations 上。「这个数由哪 10 个人工录入决定」——Excel 自己答不了。
四个方言在 AgentTeams 上共用同一条发证闸门——教材、CAD、小说换领域只换检查器,协议一行没改 →
| 向量 | |
|---|---|
| 语言无关的测试向量(数据,不是代码) | 68 / 68 |
| JavaScript 参考实现 | 68 / 68 |
| Python 第二实现(约 250 行,零依赖) | 60 / 60 core |
| 参考实现第三方依赖 | 0 |
任何实现只要写一个几十行的适配器就能当场自证合规—— 标准是那 68 条向量,不是「本象」这两个字。
一份实现自己跑通自己的测试,证明不了协议存在。变异检查故意打坏每一条协议承诺, 看谁抓得到——只被自测抓到的就是覆盖缺口。协议只保证向量钉住的部分。
人类最长的长篇小说叫 Venmurasu(泰米尔语「白鼓」)——26 卷,约 22,400 页, 一个人,写了六年半。现在 AI 要挑战这个纪录,但我们给自己加了一个人类作者不需要面对的难度: 每一章的世界状态,都必须可验证。
正在读取 stats.json…
第一个公开里程碑
百万字不失忆
超越人类纪录,且全程可验证
drift-rate(模型记错前值率):上次实测 8.3%(2026-08-06;Run 编号未留存),非实时指标。 每章:正文 + 世界状态 + git 证据链。 看挑战规则 →
如果这条路走通,AI 时代的「文件」不该再是 .docx 或 .pdf,
而应该是一个本象包——能被打开、被看见、被定位、被修改、被复验。
人看投影,AI 改本象,系统证明改对了。