关于人工智能的坏消息,通常长着一副坏消息的样子:某个岗位消失了,某项技能贬值了。它们发生的时候,有人知道。本书要谈的那件事没有这些。
它发生的时候,所有能看的指标都在变好:投递量上升、答复周期缩短、录取者资历提高、交付吞吐上升、通过率上升。而在这一片全绿的读数下面,一样东西正在停止被生产——那样东西是判断。本书的母题是:判断力无人生产、无账可记,只由低效活动顺带养成;它消失时不发生任何事件。
被颠倒的那一端
做出一份看上去合格的东西,边际成本已经接近于零;而认出它算不算数的成本,一分钱没有降。在人工智能之前,「看一眼」不是瓶颈,因为难的是把东西做出来。两端的关系颠倒之后,全部压力转移到了从未被单独生产、从未被记账的那一端。
面对这个颠倒,最有资格说话的三个领域给出三条互相取消的解释:经济学说这是竞赛问题(奖品固定、成本坍塌,投入涨到把奖品吃光);艺术学说这是认定问题(名录容量是硬的,产量再大也只是在名录之外堆积);工程学说这是瓶颈问题(吞吐由最窄一段决定,写得快只是把拥堵从写挪到看)。三条各有真实证据,也各有真实失败——期刊过去五年三条都试过,桌拒率仍从百分之十三涨到百分之四十。本书判断:三条都不管用,不是各自有缺陷,而是它们共同漏掉了同一样东西。
十章,十个从未被单独生产的量
| 章 | 被当作「判断已经作出」的证据 | 本章指认的那个量 |
|---|---|---|
| 一 | 有一次否决记录在案 | 未阅否决:作出它时没有任何人打开过那份东西 |
| 二 | 判定依据写在细则里 | 暗基线:标准由被丢弃、不入账的产出合成 |
| 三 | 关口还在、流程照走 | 饱和关:一百次判定里一次也没拦下过谁,且无人有权撤销 |
| 四 | 产出交付了、归属清楚 | 认领物:为证明「是你做的」而追加、只有成本位的那一层 |
| 五 | 评价方完成了核实 | 同形劳动:辨认负担整体转嫁,与产出同形而不可分离计量 |
| 六 | 周期缩短、效率提高 | 首读时距:落在效率读数的分母内、分子外的那段时间 |
| 七 | 件数上升=投入上升 | 并项:计数单位失去下界之后,「一件」不再是证据 |
| 八 | 评分一致、争议减少 | 种类数:分辨力是一项产出,而没有人在生产它 |
| 九 | 培养过程有交付物、进度可控 | 无验收期:验收能力恰恰在不产出可验收之物的时间里生成 |
| 十 | 能力一直都在,没听说谁不行了 | 无供给品:不由任何一方生产,消失时不产生任何事件 |
枢纽章:两个读数被一条式子锁住
编一的三章有一处正面矛盾:第三章说门槛整体饱和、通过率趋近于一,第一章说绝大多数被否决且无人过目。同一个系统不可能两者都是。枢纽章处理的正是这处矛盾——两章说的不是同一个站,而是同一条链上的上下游两类站。
设投递量 N、各关通过率之积 ∏p、下游可过目产能 K,则未阅率 u = max(0, 1 − K/(N·∏p)),而结果确实取决于内容的概率 r = 1 − (∏p)·u。两侧的失效在 r 上相乘。
由此得到两章各自都写不出的三个结果:撤掉最饱和的那道关,r 只从 0.21 降到 0.20(一道谁也拦不下的关本就不为下游减载);产能翻倍后投递量跟着涨,r 精确回到 0.21(扩产能被投递量吃掉);因此两边的第一步互不相干、必须同做——只做一半的一方会在自己的读数上看到改善,而投递者的处境不动。
这条形式贯穿后三编:代价按加法由一方承担,回报按乘法衰减,而承担代价的那一方不是这条链的所有者。
合章:十项读数被锁进一个关系网
十个并排的读数有一个致命弱点——它们无法互相否证。任何一项测出异常都可以被解释成"这一项的定义有问题",任何一项测出正常也不约束其余九项。合章用五条从定义直接推出的关系把它们联立,不引入任何新的经验材料。
最干净的一条来自队列:设拥堵参数 ρ = N·∏p / K,则未阅率 u = 1 − 1/ρ,而首读时距 w̄ = ρ − 1 = u/(1−u)。首读时距与未阅率不是两件事,是同一个拥堵参数的两种读法——未阅率 0.8 时平均等四轮,0.95 时等十九轮。第二条:辨认转嫁比 τ = a·(h/c)/(1−u),于是认领占比与辨认转嫁比只差一个拥堵参数,且未阅率会发散式地放大它——在高未阅率的通道里,认领物的绝大部分是为没有人看的那一眼准备的。第三条:并项率使拥堵参数被系统性高估(ρ_真 = ρ(1−m)),因此在算出并项率之前,未阅率的任何跨期比较都不成立。第四条:有效判定率 r_eff = [1 − (∏p)·u]·k,把种类留存率接进来。第五条是编四的接口:J(t+1) = J(t)(1−σ) + G(e)——停养率有无数个生产者而 G 没有一个,因此在没有任何人做错事的情况下,判断力存量单调下降。
合章因此给出比前四编任何一章都更直接的推翻方式,其中最根本的一条是关于这本书自身结构的:若停养率上升多年之后前八项读数并未随之恶化,则编四与前三编之间没有那个接口,本书的四编不构成一本书,正确的编法是把编四拆出去另立一册。
三处「换一组学科再问一遍」
本书十章有九章用的是同一组三学科(经济学、艺术学、工程学),这在书一级上是明确的短板——书里的纠缠是同一次碰撞重复了十遍。第四、第七、第八章各附一节换组重问,三次换组各自都改动了原章的处方或读数,而不是加了三个新的参考文献。
| 章 | 换上的三家 | 改动了什么 |
|---|---|---|
| 四 | 证据法 × 演化生物学 × 密码学 | 把认领物拆成签名式与代价式:前者的边际成本已被数字签名证明可趋近于零,正确目标值是零;后者按累赘原理,成本正是它可信的原因,目标值不是零。原章"降低认领占比"的处方在后一半上是错的 |
| 七 | 计量学 × 图书馆学 × 会计学 | 把并项率改为著作层并项率:判据来自"是否服务于同一个可明确区分的承诺",单期即可算,不依赖会漂移的历史计数约定——而合章正要拿它去校正跨期比较 |
| 八 | 生态学 × 语言学 × 统计学 | 把种类留存率改为有效种类留存率(按使用频次分布计算,读得出"类别还在表上但没人用了");给出最小对立对配对抽样这一操作程序;并削弱原章一处主张——若两个类别在观测设计下本来就不可识别,其合并是清理而非退化 |
第八章那一组还带来本书最有分量的一处旁证:音位对立的消失与本章判断逐字重合——一个对立之所以还是对立,靠的是共同体仍在用它区分意义;停止使用它就消失,而消失时没有人宣布过任何东西作废。这来自一门与经济学、艺术学、工程学都无关的学科。
为什么现行读数一定看不见它
现行读数分三类,三类的盲区正好合成本书的对象。产出类(吞吐、录用数、发表数)只计通过的那些,未被接受的产出贡献为零——不是小,是没有位置去记。效率类(周期、单位工时)计的是投入到产出的距离,凡是暂时不产出的环节一律表现为待优化的损耗——于是第六、第九章描述的东西不但看不见,方向还是反的:它们越被消灭,读数越好看。质量类(通过率、录取者资历、满意度)默认判定装置可靠,因而读不出装置的失效——第三、第五、第八章描述的东西在这里表现为改善。
三类读数把同一件事分别读成了零、损耗和改善。这不是测量精度问题,是记账口径问题:没有一类读数是为「判断这件工作本身」设计的,因为在生成成本坍塌之前,它从来不是稀缺的那一样。
体检表:十个可以从既有日志算出的读数
本书唯一的兑现物。每一项都满足四条:既有日志可算、不需新建采集系统、无量纲因而可跨行业比较、与该行业现行主要指标正交。
| 读数 | 正交实例(主要指标全绿而它很难看) |
|---|---|
| 未阅率 | 答复时限压到 48 小时、积压清零、满意度最高的招聘流程,可以有接近 1 的未阅率 |
| 暗基线抬升度 | 录用数最多、到岗时间最短的机构,可以有最高的抬升度 |
| 饱和关占比 | 一条从来没有红过的持续集成流水线,这个比率等于一 |
| 认领占比 | 准时率最高、缺陷率最低、覆盖率满分的团队,可以有最高的认领占比 |
| 辨认转嫁比 | 引入自动核验而不撤旧要求时,它可以暴涨,而两侧账面效率同时改善 |
| 无量期占比 | 把首读时距压到最短的评审系统,可以同时是最不可能发现新东西的系统 |
| 并项率 | 人均件数翻倍的团队,并项率可以接近一 |
| 种类留存率 | 评分一致性最高、争议最少的评审体系,种类留存率可以最低 |
| 无验收期占比 | 交付物最密集、进度最可控的培养方案,这个比例最接近零 |
| 停养率 | 举不出正交实例——目前没有任何机构在测它。这本身就是第十章那条判断的一个读数。 |
用法三条:先算第一、三、六这三项(数据最全、成本最低、且分处链上三个不同位置);这些数指的是位置不是人,不可用于考核个人;这张表进考核的那一天它就开始失效——每一项都有一条最省事的达标路径,而每一条都会摧毁它要保护的那样东西(未阅率的最省事达标法是让系统自动「打开」每一份;暗基线抬升度的最省事达标法是删掉落判池)。这一条没有出路,本书只能把它写在明处。
怎么读这本书
| 二十分钟 | 导论 → 结论的体检表。全书的判断与索引都在这两处。 |
| 管理者 约三万字 | 导论 → 第三章(饱和关)→ 枢纽章 → 结论「这张表怎么用」。在把这套读数接上考核之前,先读结论第四节第三条。 |
| 教育工作者 | 导论 → 第九章(验收能力在哪里被生产)→ 第十章 → 结论。这条路径回答「培养方案该不该把每一段都做出交付物」。 |
| 研究者 | 枢纽章 → 各章的划界节与证伪条款 → 结论第五节。这是最快判断本书哪里可能是错的一条路。 |
这本书不主张什么
它不主张回到从前。低效活动被优化掉,绝大多数时候是好事。本书不为浪费辩护,也不认为「慢」本身有价值。它主张的是一件更窄也更难的事:有一类能力是那些低效活动的副产品,而在优化掉它们的时候,没有人清点过这份副产品。清点,不等于不优化。
它不主张人比机器强。全书没有一处依赖「人有某种机器没有的东西」这类命题。它依赖的是账目:某一类工作没有栏位,因而没有人负责生产它。这是制度问题,不是本体问题。
如果这本书错了
四条,任何一条被证实,本书应当被修正或放弃,而四条都可以在两三年内用既有数据做出来。其一,控制投递量与判定者人时之后,若上述读数与合格线漂移之间不存在剂量—反应关系,则门槛上升只是绝对负荷问题,处方回到扩容。其二,若有机构成功把这类能力做成可直接生产、采购、培训的东西,且盲测不劣于顺带养成的那一种,则第十章错。其三,若判断力的下降确实触发了某个既有指标的当期报警(不是事后追认),则本书副题所依赖的那条判断错了。其四,若在纯定标制通道(资质考试、安全认证、药品审评)里同样测到这些读数显著异常,则本书最重要的一处区分错了。
成书与评分声明
本书由「学科通融」专栏之四十四至之五十三共十篇连续研究编成,另新写导论、枢纽章与结论。十篇原刊于本站,作者王德生+Claude;编入本书时篇名改为章名、篇际互引改为章际互引,正文未作删节。
本书的导论、枢纽章的书内导入与推广、结论及体检表由编者写作,因此按本栏规程,编者不得为本书出具认证分;全书盲评待未参与写作的一方独立完成后公布。
本书由人与机器共同完成,本身即生成成本坍塌的产物之一。按其自身的判断,它作为一件交出去的东西若未被接受,仍会抬高一点点线,而这一点在原理上无法被证实——因为没有任何人记录未被接受的稿子。本书处在一个结构性的位置:它主张存在一类不被记账的东西,而它自己一旦成为那一类,同样不会被记账。这一处境无法由本书自己解决,只能写在明处。
三种读法
姊妹卷:《一直没出事》处理的是能力如何先失去可观测性;本书处理的是判断这件工作本身如何从未被生产、从未被记账。两书共享同一种关切:一件事被宣布为妥当之后,还有没有人能够看见它其实没有妥当。
出版信息
著者 王德生 + Claude · 出版发行 德麦国际出版社 Demai International Press · ISBN 979-8-90690-013-5 · 定价 US$22.00 · 2026 年 8 月第 1 版第 1 次印刷 · 16 开 170mm × 240mm · 338 页 · 约 22.8 万汉字 · 分类:人工智能 / 制度经济 / 科学社会学 / 教育评价 · 版权所有 侵权必究
