原理说明 —— 一块板、两块基石、四层能力
底座是演算板;两块基石——信任升档与领域包——是任务可靠性的来源;其上是四层能力:①承诺裁决 · ②模糊收敛 · ③自驱循环 · ④多体协作。每部分讲三件事:要解决的问题、核心机制、为什么可信。只讲原理,不讲实现配方。
一句话的全景:模型负责提出,板负责判定;领域告诉它按什么规则办事,连接提供真实证据与执行能力。 两块基石正挂在后半句上——领域包把"按什么规则办事"变成可装载、带验证史的资产,信任升档给"真实证据"定档位、管升降;四层能力则是"板负责判定"的逐级放大。
底座:演算板
AI 的老毛病是"说得头头是道,对不对没人知道"。我们的底座是一块演算板:事实、规则、结论全部摆在板上,结论只能由"规则+事实"推导产生,推不出来就不成立。板上每条信息都标着出身——是推导出来的、是动作产生的、还是裸断言——三者永不混淆;每个结论都拖着完整的证据链,可以回放。数字走精确计算:算得出就是准的,算不准就明说,绝不给一个悄悄舍入的数。
板解决的是"推理不出错"。但一个任务要可靠,光推理对还不够——前提得是实的,领域知识得是对的。这就是接下来两块基石各自管的事。
基石一:信任升档 —— 每句话都有档位,升档只能靠挣
问题:任务不可靠,多数时候不是推理错了,而是前提虚了——模型把自己的猜测当事实用,再顺着错误的地基把楼盖高。
机制:板上每条信息都带一个接地档,按"这话是谁背书的"定档——
- 仪器、工具、传感器实测的,走受信通道盖章,是实证档(模型自己伪造不出这个章);
- 模型自己说的,是断言档;
- 推导出来的结论,档位等于它所踩的全部前提中最低的那一档。
铁律:档位沿推理链只降不升。 一万句断言叠在一起,也推不出一句实证——"把话越说越肯定"在这套系统里做不到,最常见的糊弄方式(洗绿)从结构上被堵死。
升档只有一条路:挣。 想让一句话的档位升上去,必须发生真实的验证事件——工具复核过了、传感器交叉印证了、多个独立来源确认了、仲裁裁决了。每次升档本身也记在板上,有据可查。对智能体的身份同样如此:
- 履历按真实战绩记账:押对加分、押错扣更多分,整本账可回放复算,不是黑盒评分;
- 定期抽照妖题:从已有定论的真实案例里自动出题,答错掉履历——想刷信用混进来的,要么答题露馅,要么只能老老实实干真活;
- 关键确认过构成门:不但要够档,还要来源足够独立——同一伙人刷一万次,不如两个互不相识的来源各确认一次。
新鲜度也在管辖内:结论所依赖的材料一旦变更,靠它做出的裁决自动作废、必须重审——不存在"拿着过期证据继续算数"。
一条禁令收尾:声誉和履历只能影响派活、优先级、审批快慢,永远不能把一句断言直接抬成事实。再老资格的智能体,说的话也过同样的验证。
为什么可信:档位不虚标、升档必留痕、独立性有门槛——前提的成色是被制度保证的,不是被口气保证的。
基石二:领域包 —— 领域知识装包上板,定理也要挣档
问题:板保证推理不出错,但推理踩的领域事实和公式得本身是对的。行业常数、工程公式、规范条文、专业词汇——这些不该临场靠模型回忆,回忆会错、会编。
机制:把一个领域的规则、常数、定理、词汇整理成领域包,装板即用:审批规则包、单位换算包、工程公式包……换一个行业,换包不换内核。装包不是照单全收,进板要过三道检查:
- 定理挣档:包里的公式和定理按各自的验证史定档——拿真实数据对轨复核过的才配高档(例如一条航程公式,是用真实客机数据回算核验过的才收进包);没验证过的也能进,但只挂低档,用它推出的结论档位跟着低——和基石一是同一把尺子;
- 词汇一致:两个包对同一个词各说各话,装载直接拦下——板上不允许一词多义;
- 依赖与自检:包与包的依赖关系明确;包内规则互相矛盾、常数对不上的,装载时就暴露,不等到任务干到一半才炸。
沉淀飞轮:任务里被反复验证过的规则和事实,可以反向蒸馏回领域包、随版本发布——用得越多包越厚,下一个任务踩的地面就越实。
为什么可信:领域知识是预先固化、带验证史、装载自检的资产,不是模型临场的回忆。任务可靠性 = 推理对(板)× 前提实(信任升档)× 领域知识对(领域包)——三者缺一,"结论可靠"就是空话。
① 承诺裁决 —— 说过的话算数
问题:AI 干着干着偷偷降低标准、事后改口不认账。
机制:任务立项时,验收基线钉死不可移。干到一半发现标准真定错了怎么办?允许改——但等于正式重新立项:旧承诺作废有记录,新基线重新钉死,全程留痕。纠错的门开着,偷改的门焊死。裁决时按钉死的基线逐条对照,每条依据的接地档(基石一)一并亮出来:哪些结论踩在实证上、哪些只踩在断言上,验收者一目了然。
为什么可信:完成与否由闸门按钉死的基线和接地档裁决,与"它自己觉得做完了"无关。
② 模糊收敛 —— 模糊目标变成可验收的活
问题:需求一开始说不清,最后"做完的"和"想要的"对不上。
机制:模糊目标先收敛成一棵约束树:每片叶子是一件具体的小事,带一条写得清的验收标准;先确认标准,再开工。干完之后验收标准逐条过硬闸,全过才算完成;同时如实报告验收覆盖到了几成(诚实档),不假装百分之百。
树不是一次定终身:干的过程中发现拆漏了、标准写窄了,允许按规矩调整——调整有预算、有记录,且验收时刻用的永远是双方确认过的最新一版,不存在"悄悄按另一套标准验收"。
为什么可信:"完成"是被推导出来的结论,不是被说出来的话。
③ 自驱循环 —— 自己往前推,到边界停下来
问题:要人一步一步喂指令 AI 才动一下;真放手,又怕它乱来。
机制:智能体在板上自主循环推进(想→查→做→验),但三条缰绳都拴在板上:
- 副作用要板授权——每个对外动作先立据、后执行、有收据;
- 预算封顶——改需求、开新板、自由探索各有额度,花完即停;
- 人类边界进"停车位"——规则覆盖不到、责任重大的事,挂起等人裁决,不硬猜。
对话本身也是一个动作——问人、汇报,走的都是同一套记账。
为什么可信:自主但有包络——干了什么有据,花了多少有账,停在哪儿等你有位。"放手"从一场赌注变成一个有刻度的旋钮:额度给多大,自主就走多远。
④ 多体协作 —— 多个智能体同板干活,还能问责
问题:一个 AI 会糊弄,一群 AI 互相糊弄更难查。
机制:每个智能体守着自己的板,板与板之间只做受控交换,不共享记忆(需要保密就分板,需要协作就交换——一块板恰好有一个所有者)。在交换之上配四样规矩:
- 影子审查员:每个主办身边站一个专挑毛病的——建议不拦活,查实的缺陷才拦交付(无罪推定,对挑错方和干活方同样诚实);
- 委托链:活儿层层包出去,责任沿链上溯——包出去的活,照样要负责;
- 能力自证+合同验收:"我能干这活"要拿出对应凭证,凭证本身也有接地档。干完按事先约定的方式验收:能机器复核的走机器复核,靠主观判断的走多方独立共识,涉及实物的走传感器交叉印证;起了争议交独立仲裁(仲裁者利益回避,当事方没有资格),裁决落定之前不结算;
- 验签与声誉:跨板来的每句话,先验明"是谁说的"再上板,验不了签的进不来;声誉的用途受基石一那条禁令约束——只影响派活、优先级、审批快慢,永远不能把断言抬成事实。
为什么可信:能影响别人的只有两种东西——建议,或已裁决的事实;从不因为"是谁说的"。
全景:一块板、两块基石、四层能力
演算板管住"推理不出错",信任升档管住"前提档位不虚标",领域包管住"领域知识本身是对的"——任务可靠性由这三样共同兜底,这也是把后两者称为基石的原因。
在这之上:①是可信的最小单位——"一个被裁决的承诺";②把人话变成①能裁决的对象;③让一个智能体连续地吃②产出的任务、自己往前推;④让多个③各守其板、经受控交换协作而不互相糊弄。
自上而下看:④的每一次协作、③的每一步自主、②的每一条验收、①的每一次裁决,最后都落回板上同一条可追的证据链——可推导、可回放、可问责。
在本站怎么继续读
四层能力在本站各有专页,随实现进度如实标注现况:信任层(云端已开放)· 任务层(任务定义已开放)· 智能体层(实现中)· 协作层(设计定型)。两块基石的产品面:领域包见编写领域能力与使用领域能力;信任升档的七档阶梯与"洗不绿"机制见信任层的接地档一节,连接的注册见接入传感器。
content/*.md;能力清单、工具清单、字段矩阵由生成器从实现代码抽取
(快照在 facts.json)——改了实现而忘了改文档,校验会自己发现。