SDE 学员专栏 · 专著

一直没出事

AI 时代,能力、判断与责任如何先失去可观测性
孔凡鹤 著 · 德麦国际出版社 · 编号专著第 78 号 · 发表于2026年8月13日 · ISBN 979-8-90690-011-1 · 定价 US$22.00 · 287 页 · 前言·导读·导论·四编十一章·结语·参考文献·后记 · 约 20.2 万汉字 · 本条目按一部专著抵十篇论文计入作品数与排名
内容提要

一位老师说,这学期学生交上来的作业整体上了一个台阶,可她越看越不安,因为她说不出学生到底会了什么。她把作业改难,交上来的东西更漂亮了。

一个团队用了两年的自动化流程出了事,追责开得很顺利:流程写得清楚,签字的人找得到,处分也落实了。散会后一位工程师说,下次很可能还会发生——因为被处分的那个人根本没有权限改动任何一处设置。

本书追问的是同一个形状在九个位置上的九种形态:能力、判断与责任并不是先失去,而是先失去可观测性;正常运行的成功本身销毁了证明它们仍在的证据,因此它们只能在代理被有意打断的断面上被重新判定。结果质量、零事故、上升的绩效曲线、末端签字、能迁移、有责任人、检查覆盖率、多数同意——九个领域各自的良好信号全都失去了分辨力,而且失效的方式是同一种:它们不是变差了,是变得更好看了。

问题被换掉了

公共讨论长期停在"人工智能让人变强还是变弱"。这个问题不可判定——观察到的每一个绩效数字,都是人的能力、AI 的能力、人机匹配与任务条件的混合量。争论多年不收敛,不是证据不足,而是用来做判决的那把尺子本身已经被污染。本书把问题换成可判定的那个:我们还能不能看见;如果不能,靠什么重新看见。

难题之所以重大,在于三套关键制度全都建在那个已经失效的前提上:教育评价——只用产出评价能力的制度不只是测错,它奖励外包,因而主动加速不可见;人类监督的法律安排——条文能要求"必须有人审核",却没有任何条款要求证明这个人还审得动;高后果领域的安全结构——"自动化常驻、人工可接管"这一假设在人工智能常态代行下从未被系统验证。

九个读数,只有三种形状

串联门型五章(四环节·五门·三节点·撤回与否·ECR 三要素,明令不许取平均,因为失效是路径性的);相关折扣型三章(证据龄比·预测力下降·有效独立判断数,统一写成"有效证据量 = 名义证据量 ×(1 − 冗余度)");成本效率型一章(η = ΔR/c,全书唯一"做到哪里为止"的对象)。九章,三种量表,一套记录格式——这是本书给组织的最短建议。

本书自设盲区:九个读数没有一个是分布量。一个团队完全可能九项全部合格,而合格全部来自其中三个人。凡使用本书方法者,须同时报告参与率与事件集中度。

四处压力测试,四次不利结果

第一章用四项在线实验(总样本 3,562)压力测试"即时增强=能力保留",持续率 25%;第三章对 825 名学生做二次分析,无 AI 对照组的练习成绩与独立考试成绩相关 0.756,两个使用生成式 AI 的组分别为 0.435 与 0.486,而带教学护栏的那一组平均独立成绩与对照组几乎没有差别;第二章的去训练数据否定了"一个能力对应一个最低维持剂量"的标量模型;第六章因反向证据撤回了"人工智能代劳会削弱理解"这一宽命题。四处都得到了对作者不利的结果,并都因此收窄了主张。

本书写明了自己怎样会错

第十章给出三条书级撤回条款,按可检验性排序:日常绩效若对断口读数具有稳定高预测力,全书工程建议应当撤回(最容易检验);断口读数若不能预测真实失效,本书只是一种昂贵的考试(最重要);制度化之后最省事的达标方式若恰好摧毁所保护之物,本书在实践上应当撤回(最可能发生)。同章还点名三对最可能被合并的章节及其合并条件,其中第三章与第四章是最可能的一对——若被证明是同一件事,全书应降为十章。

第十一章整章处理第三条:一套用于揭露遮蔽的方法,为什么会长出新的遮蔽。它列出四条应付路径(预告化·题库化·代考化·记账化)、四条对策及其代价、五个可从原始记录读出的预警信号,以及一条不可让步的底线:断口读数不进入个体的绩效、晋升与留用决定——保证不了这条的组织不应采纳本书方法。

三种读法

📖 网页版全书 · 24 页 · 📄 在线翻阅 · 287 页 · ⬇ 下载 PDF · 专著主页

姊妹卷:《照护的智慧》处理人与人之间的交接——一次"完成"由谁宣布、未被交出的那一份落在谁身上;本书处理人与外部认知系统之间的交接。两书共享同一种关切:一件事被宣布为妥当之后,还有没有人能够看见它其实没有妥当。