上一章说 AI 的追责是直接改写它的理念界。这一章把「改写」说具体:改什么、怎么改、改了之后怎么验。
AI 的三号位载体有四样:档案、提示、权重、历史。按可改的层次分三种直写。
第一种:改提示。 最浅的一层。系统提示、对话开头的说明、每次提问时加的限定——这些是用户可以随时改的。改提示改的主要是场:AI 回答的次序(先问一句再答,还是直接答)、结构(分点还是成段)、连接(碰到这个词要想到那个词)。一句「先列出本领域三十年内最接近的五家再给你的想法」,改的是它的次序——先查再说。
第二种:改档案。 中间一层。记忆、偏好、过往对话沉淀下来的条目——这些是用户和 AI 一起积累的,用户可以增删。改档案改的主要是分布:AI 对哪些东西放近放远,对什么有反应。把一本书的核心命题写进档案,标为「已有人说过」,改的是它的分布——这个位置从「可以靠近」变成「不能再靠近」。
第三种:改权重。 最深的一层。微调、再训练——这些通常不是用户能做的,是平台做的。改权重改的是美:它认为什么样的回答是「对」的、统一的、和谐的。这一层的改变最大,也最不可控。
三种直写对三项,深浅不同。日常的追责——出了一次错——用第一、二种就够;系统性的错——每次都这样——才到第三种。
把直写和第三十七章的传导放在一起,看差别在哪里。
人的追责:现实界约束→自我界重排(γ)→理念界重排(γ)→回写现实界(验证)。四段,两个 γ,一次验证,全程需要时间,而且可能在任何一段断掉。
AI 的追责:改理念界载体→验证。一段,没有 γ,一次验证,即时。
差别有三处。
没有摩擦。 人的每一段传导都有摩擦——现实界约束时的疼,自我界重排时的内疚,理念界重排时的动摇。AI 一段都没有。上一章说这是零摩擦极限,追责的本来面目。
失败点少,但有一个。 人的传导可以在任何一段断——现实界改了自我界不跟(累犯),自我界改了理念界不跟(后悔而不悔改),理念界改了不回写(口头悔改)。AI 的直写没有中间段,但有一处会断:写进去了,不等于生效了。第十一章区分过「未更新」与「更新未生效」——两条文字相同的记录,一条被当前检索调用,一条只是躺在不被读的副本里;界面上都显示「已经记住」。所以直写的验证不能只看载体变了没有,要看下一轮它读的是不是这一条(本章第四节)。这正是本书自己在第十一之二章说的:相同文本不等于相同效力。
没有时间。 人的传导需要时间——第三十八章说短的约束 γ 天然低,因为传导没来得及。AI 的直写是即时的:改了提示,下一次回答就按新提示。
三处差别合起来,AI 的追责比人的追责更可核——不是更可靠:改了之后能不能立刻再问一次看它读的是不是新的那条,这一点人做不到。可核不等于必然生效,生效要看验证。
可靠的另一面是脆。人的三号位改了之后,是自己的了——传导完成的悔改,出狱之后不会因为换了监狱长就消失。AI 的三号位改了之后,是载体的——载体换了,改变就没了。
三种脆法。
版本更新。 平台更新模型,权重换了,用户改的提示和档案还在,但它们作用的对象变了。同一条提示在新权重上的效果不一样——「先查再说」在旧版本上有用,新版本可能本来就先查、或者根本不理这条提示。用户做的直写,一次更新可能失效。
账号迁移。 换一个账号、换一个平台,档案不跟着走(或者只有一部分跟着走)。直写的那部分留在了旧账号里。
吸收。 第四十四章讲:复合体的特征公开之后,会被下一代基底吸收成函数层——用户和 AI 磨出来的那些次序、分布,被平台学去,变成所有人的默认。吸收之后,直写的那部分不再是这个复合体特有的,变成了常数——按第八章的说法,δ 回到了阈值以下,它又可以被约掉了。这是最深的一种脆:不是改变丢了,是改变被公共化了,公共化之后就不再是这个复合体的追责记录。
三种脆法说明:AI 的追责虽然可靠,但它的持久性不由复合体控制,由平台控制。这一点在第四十四章讲平台时展开。这里只记一句:人的悔改是自己的,AI 的直写是租来的。
直写之后怎么验?
人的验证是回写现实界——看他出来之后和谁来往、做什么、对什么起反应。AI 没有现实界,验证只能在理念界内做:再问一次,看回答变了没有。
具体是三种验证对三种直写。改了提示(场),验证是:同样的问题再问,回答的次序、结构变了没有。改了档案(分布),验证是:碰到那个位置,它还靠近不靠近——把那本书的命题写进档案之后,再讨论同一个题目,它会不会先说「这个已经有人说过」。改了权重(美),验证是:它认为「对」的回答变了没有——这一层最难验,因为要看很多次回答的整体倾向。
验证有一个人的追责没有的便利:可以重复。 人的追责不能重跑——不能把他再关一次看这次传不传得进去。AI 的直写可以重跑:改一条提示,问十次,看十次回答;改回去,再问十次,比较。这就是第七卷讲的实验四:做与不做第三段传导的错误复现率对比——它之所以能做,正因为 AI 的追责可以重复。
有人会说:改提示、改档案、改权重,这不就是训练吗?训练几十年前就有,为什么要叫追责?
区别在方向和触发。训练是事前的、面向一般的:在 AI 见到任何用户之前,把它调到一个对所有人都好的状态。直写是事后的、面向特定的:在一次具体的错之后,改这个复合体的载体,让这个复合体下次不再犯。前者是制造,后者是追责。第四章讲收纳词时说,法人是「配出来的」复合,眼镜是「配出来的」差异;训练是「配出来的」AI,直写是「磨出来的」AI 里出了错之后的修正。
这个区别在制度上很要紧。训练的责任在平台,直写的责任在复合体。平台负责 AI 出厂时的状态,复合体负责它在这个账号里长成什么样。出了错,先看是出厂的错(训练层,找平台)还是长成的错(直写层,找复合体)。这个分法和产品责任法里「设计缺陷」与「使用不当」的分法平行——不是巧合,因为它们分的是同一件事:常数部分和沉淀部分。
最后把直写落到一张账上,为第四十二章的署名格式铺路。
每一次直写都可以记录:什么时候、改了哪一层、改的内容、验证的结果。这张账是 AI 的三号位改变的历史,也是复合体追责的历史。它有三个用处。
追责时对照。 出了错,看账:上一次同类的错之后,直写了没有?直写了什么?验证过没有?如果账上是空的——上次出错之后什么都没改——那么这次的错不是新错,是上次的错没有被追责。
署名时说明。 前文提出的五行署名格式里有一行是「档案」,指的就是这张账的当前状态:这个复合体的理念界在署名时刻是什么样。两次署名之间账的差异,就是这段时间里复合体被追责的记录。
吸收时留证。 平台更新、账号迁移、被吸收——三种脆法发生时,账是唯一留下的东西。改变丢了,改变的记录还在,可以据此在新载体上重做。
这张账的形式是什么,谁来记,怎么核——第四十二章讲复合新主体注释时给出格式。
本章日常案例:改一条提示,再问一次。
本章术语进场:三种直写(提示/档案/权重,对场/分布/美);三种脆法(版本更新/账号迁移/吸收);直写的账。
本章压回命题:命题三(直写的具体形式、与传导的对照、可靠而脆、验证可重复、与训练的分界)。
本章来源:「理念界直写」——复合体(《典范革命》论文第十一节);三种直写对三项、可靠而脆、直写与训练的分界=常数与沉淀、直写的账——复合体。