← 专著首页目录📄 在线 PDF⬇ 下载德麦国际专著第 81 号

十二种读法 · 推荐与读后感

这一辑是什么,不是什么

下面十二段,是十二个领域的读者读完本书之后会说的话。它们不是征集来的推荐语。没有任何一位真实人物读过本书并写下这些文字;十二位署名者是虚构的,由 Claude 写作,王德生审定。

之所以仍把它放在这里,有一个本书内部的理由。第四章说,学会一件事是把清晰度从相邻区域搬过来;一本书写完之后,作者与它之间恰好没有相邻区域可搬——他看不见自己的坑在哪里。通行的解法是请人来读。而在本书成稿的这个时点上没有人读过它,于是这一辑是替代品,且是一件典型的替代品:它省下了「等真人读」那一段,代价是它给出的十二处质疑,全部由熟悉本书的一方写出,因而系统性地偏软——它不会指出作者自己没有想到的那一类问题。

这正是第五章所说的借道,而按第五章,借道对读数恒为零:这十二段读起来与真评审没有区别。所以本页开头那句声明不是礼节,它是这一辑唯一能与真评审区分开的东西。真的评审仍然欠着。

每一段都被要求做两件事:指出本书哪一处最值得读,以及指出它在本领域内最站不住的一处。第二件是这一辑存在的主要理由。

一 教育测量与评价 | 沈允之

我读的是枢纽章第七节。它说的是一件我们这一行每天在做、而从未这样表述过的事:覆盖型量表把每一格封顶,于是深度在总分上没有位置,而深度必然伴随的近邻缺陷照常扣分。作者把它写成 C(深) − C(均浅) ≤ 0,并指出格数越多、坑被格子接住的概率越大——这条推论把「提高覆盖面」这个我们默认为纯粹改进的动作,变成了一个有方向的取舍。我一时想不出反驳,而这让我不舒服。

不舒服的地方在这里:本书的封顶假设太强。真实量表极少是二值及格,多数是四档或五档评分量规,峰在高档位上仍能得分。作者需要证明的其实是一个弱得多、也难得多的命题——加权后的边际收益是否随格数上升而下降得比坑的边际损失更快。这个他没做。以我们手上的题库数据,这件事一个学期内可以算出来,我打算算一算。如果算出来的是本书要的方向,那我们这一行过去二十年在效度上的努力,恐怕要重读一遍;如果不是,本书第三编与枢纽章第七节一起作废——作者自己在合章第七节第三条把这条判错条件写在了那里,写得比我想的还干净。

二 学习科学 | 余舲

第一章是我近年读到的关于「学会了没有」最不敷衍的一次处理。它撤掉的那个前提——存在一条被存放在某处、可以在两个时点之间取出来比对的规则——是我们这一行几乎全部前后测设计的地基。撤掉它之后剩下的东西很朴素:换一个表面不同、结构相同的情境,他会不会推出同一条,而且至少测两次。我在自己的课上试了三轮,最直接的收获不是数据,是它让我停止把「能把规则说清楚」当成证据。

我的保留在于判据本身。「结构相同而表面不同」是迁移研究吵了四十年的老问题:结构由谁认定?在多数学科里,能判定两个情境结构相同的人,本身已经是这个领域的行家——于是复推率的测量者必须比被测者更懂,这把它的可规模化程度压得很低。本书第十章其实给出了同一个形状(鉴别不独立),但没有把这把刀转过来砍第一章。这是全书内部一处应当发生而没有发生的碰撞。另外,作者用 ρ = ρ_max(1−λ) 把复推率与借道率接起来,而 ρ_max 是不可观测的——它在形式上很漂亮,在实测上要小心。

三 医学教育 | 韩崎

第五章应当被每一个带教医生读一遍。术后单腿跳远那组数字——距离比百分之九十七、膝关节做功比百分之六十九——在我们这里是常识,而作者把它从运动医学里抽出来,变成一条关于一切以结果验收的培养体系的判断:结果读数对路径替换恒为零。住院医培训的全部里程碑,几乎都是结果读数。我们看得见谁做完了那台手术,看不见他是靠自己的判断做完的,还是靠上级站在旁边、靠术前规划软件、靠一份已经被别人做过的方案。

问题在于本书给的唯一读法:剥夺落差,临时封掉替代路径,看结果跌多少。在临床上这条路走不通,而且不是成本问题,是伦理问题——我不能为了测一位住院医的真实水平,在真实病人身上把他的支援撤掉。作者在推论二里说这项测量的价格随可及性上升,他说的是钱;在我们这里价格是别的东西。可行的替代只有高仿真模拟,而模拟环境本身就是一次可及性下调,测出来的是不是同一个量,本书没有回答。这是我最想追问的一句。

四 软件工程 | 罗序

第三章我一口气读完了。「危险既不来自份数,也不来自不一致,只来自系统预期它们一致却没有任何人负责让它们一致」——这句话把我们组吵了两年的一场架直接结掉了。第十五节那套半小时查法我当天就在自己组里跑了一遍:分头问四五个人「这几份应该一样吗」「如果不一样,哪一份算数」,记原话不要归纳。结果是格Ⅱ,而且答案的分歧比我预想的严重得多。作者提醒不要当众问,这一条是对的——当众问会收敛到一个答案,而分歧本身才是读数。

我不同意的是枢纽章那条 λ 单调升至一。在有强制代码评审、且评审人轮换的团队里,替代路径每一轮都会被外部强行封掉一次,这在形式上就是 R1 里缺的那个把 λ 往回拉的力。作者说现行记录方式里这个力一项也没有——不对,评审就是。当然他可以反驳说评审本身正在被自动化吃掉,那我承认;但这样一来命题就从「不存在这个力」变成了「这个力正在消失」,后者弱得多,也诚实得多。顺带一提:第七章那条「合格率与返工率同向上升」的预言,用开源生态的数据一个月能跑完,我有兴趣跑。

五 民航安全管理 | 邵砚

第八章那一段是全书我唯一一处读到「有人真的解决过」的地方,而且写得准确:我们没有去给「发现」记功,我们给「报告」记了账——因为报告有一个可确定的时点与一份可比对的内容,而发现没有。这件事在我们这一行做了几十年,从来没有人把它抽象成这样一句可以搬到别处去的话。合章把它翻译成「不要记录他做了一次选择,去记录他提交了一次不采纳」,这一步翻译的价值大概超过本书任何一章。

第九章那份座舱实测也用对了:自动化提高之后,手上的技能保持完好,退化的恰是自动化替他做了、因而整段航程无人要求他做的那部分。

我的保留是成本。本书把不追责的自愿报告制度当成一个可复制的解,而它在我们这里之所以能成立,靠的是几十年、几代人、以及若干次极其昂贵的事故换来的一整套法律豁免与文化。把它搬到一个没有这些条件的行业里,最可能的结果不是记零位被补上,而是报告数量上升、内容全部无害化——这正是本书自己在结语第五节警告的那种表演版本。作者知道这一点,但他把这条警告放在了结语,没有放在第八章那条处方的旁边。

六 组织行为与人力资源 | 程知白

第六章的处理让我改了一个说法。我们过去把工作自主性的下降解释为管理风格问题,而本书指出被删除的是岔路不是步骤,且删除的顺序由可结算性而非后果重要性决定——可结算的先被删,因为它便宜、干净、可以写进方案。于是最先消失的恰好是最容易被安排掉的,而不是最不重要的。这句话我打算原样引用。

但那组数字我要打折。O\*NET 的决策自由度是职业层面的自陈与分析师评定,不是行为观测;自动化程度与它的相关是 −0.199,在 n = 879 上确实显著,可解释方差不到百分之四。本书把这一对系数称为「步骤留下、岔路删除」的字面读数,这个「字面」用得太满。更麻烦的是横断面数据不能支持任何关于过程的主张——本书要的是「自动化之后岔路减少」,而这里只能读出「自动化程度高的职业岔路较少」,两者差着一整个因果距离。作者提到一次纵向检验失败并把原因写在正文里,这一点我敬重;但既然纵向那条失败了,横断面这条就该降级为线索,不该被写进导论当开场证据。

七 法律实务 | 贺兰筠

第十章那一问,我读完之后在自己身上试了一次,结果不太好受:我凭什么认为这位同行在这件事上靠得住——而这个理由,一个完全不具备法律判断力的人能不能用?我给出的理由几乎全部落在作者所说的第二层:他在这个圈子里公认厉害。作者说这一层最危险,因为它在形式上模仿了第一层,而它实际上把鉴别推给了一群仍然需要我判断的人。这一段值得放进每一个新人培训的第一周。

我要挑的是分类。本书的粗筛问的是:这个领域里有没有人因为判断错了而承担过可被外人读出的后果。法律行业其实有——执业过失责任、纪律处分、判决被上级法院推翻,全部公开可查。按粗筛,我们应当被判为鉴别独立,而按我自己的经验完全不是。问题出在粗筛把「有这类事件」与「这类事件覆盖了主要判断」混为一谈:被追责的是程序错误与利益冲突,而不是策略判断——一个把案子打输的律师几乎从不因此承担可读出的后果。作者需要的不是粗筛,是「哪一类判断被追责」这个更细的分层。这一处我认为是本书一个真实的漏洞,不是措辞问题。

八 科学哲学与知识论 | 闻其昭

第二章是我这一行的活儿,而它做得比我预期的干净。三个领域面对同一个够不着的原物,给出三种互相排斥的处置,而每一种处置都生产出一个此前不存在的新对象,随后由它占据原物的位置——并被表述为一项关于对象本性的发现。第七节那四问是可以直接教的:这个立场的相反面在实务上是否可行;它是什么时候被提出的;内外表述是否一致;下游需求变了它会不会跟着变。第四问是唯一一个可以事前预测的,这一点作者自己标了出来。

合章第五处锁把这把刀转向了本书的书名:「知识就是可检索、可复述、可即时调用的东西」若在可及性低的年代不成立、在高的年代成立,则它是一次追认。这一步做得漂亮。但作者随后停住了——他在合章第八节承认本书自己的核心表述恰好为一种由人定题、由机器成文的写作方式提供了位置,然后说本书没有办法自己回答,只能把四问原样留在第二章。承认不等于处理。 追认论一旦成立,它的自反性不是一个可以搁置的附注,而是一个必须给出解决程序的问题:至少要说明在什么条件下一个表述可以既是追认、又为真。这一节是全书最诚实的地方,也是最未完成的地方。

九 统计与计量 | 冉序清

我最欣赏的是合章第八节那句话:锁得越紧越像一个自洽的系统,而自洽是最容易被误认为正确的性质。七条关系里只有三条有实测支持,且都是别人为别的目的做的测量,其余四条是从定义推出来的——作者把这件事写在了正文里,没有藏在脚注。这在近年我读到的跨学科著作里不多见。

技术上我有两点。其一,R1 中的可塑性系数 k 与初始借道率 λ₀ 无法从任何单次观测中分开识别:同一条上升曲线可以由大 k、小 a 生成,也可以由小 k、大 a 生成,除非有至少两个不同 a 水平下的面板数据。本书用这条推出「a 只决定快慢不决定终点」,这个结论其实不依赖识别,成立;但附录二那个算例给了具体的三十轮与九十八轮,那两个数字是拿假定的 k = 0.1 算出来的,读者极容易把它读成估计值。建议在算例上加一句「k 未被估计」。其二,第一处锁给出 Δ/y₀ = 1 − ρ/ρ_max,说两者应当负相关——这是本书最容易执行的一次检验,但它需要 ρ_max,而 ρ_max 只能由封路条件下的表现反推,于是这个检验在结构上依赖它要检验的那个量。这不是致命的,是需要一个工具变量。

十 图书馆学与信息科学 | 姚颂平

第三章里那个「所有人心里都有一份算数的,只是每个人心里的不是同一份——它有全部的效力,没有任何的位置」,是我读过的对影子正本最好的一句描述。我们这一行的权威控制、版本管理与来源标注,处理的都是它的邻居,而从来没有人把「预期」与「机制」拆成两条独立的轴。拆开之后那张四格表立刻有用:我们大量的元数据治理工作实际上只在修机制那一侧,而预期那一侧从来没有被表述过,因而连撤销的对象都找不到。

我的意见是划界不足。本书第十三节列了几个容易被当成同一件事的说法,但没有列权威控制与来源溯源这两项——它们是这个问题在图书馆学里已有的、成熟的、且部分失败过的处理,而失败的方式恰恰是本书预言的那种:只补机制不动预期。把这两项请进第十三节,本书的主张会更硬,因为它能指出一个几十年的实践为什么在特定一格上无效。作为一本谈知识的书,漏掉这一行是个不该有的空缺——尤其是第三章的三家里已经有了数字保存,那是我们的近邻。

十一 艺术教育(舞蹈与音乐) | 卓明河

第五章写外开那一段,我是当事人。强迫外开、把差额从下面补上、以及「举重若轻」这个审美要求恰好把借道最强的信号定义成了美——这三句话连起来,说清了我教了二十年而始终说不清的一件事。我们不是不知道学生在借道,我们是没有一个词把它与「他还没练到」分开。剥夺落差给了这个词。

我不同意的是均浅那个形状。作者说自己重推的人有一个峰和一个近旁的坑,而随时取用的人是一片平地。在艺术训练里,这个图像不成立:一个练到有峰的人,他的坑不是在近邻,是遍布——高强度的专门化会牺牲掉大量看起来毫不相干的能力,而且那些坑经常出现在别人认为的基本功上。峰坑相邻这一条来自第四章,而第四章的三个来源都是表征系统(模型、免疫、知觉),它们有明确的邻域结构;身体训练没有。作者把它推广到整个知识分布,推得太远了。我建议把均浅的适用范围限制在有明确邻域度量的领域,否则锐度这个读数在我们这里根本无法定义——而这与作者所说的「均浅者无定义」是两回事。

十二 公共政策与监管 | 郑燧

第六章末尾那句应当被写进每一份自动化决策的监管评估:现行法规要求人能够不采纳系统输出,却既不要求记录否决率,也不分配否决的责任。我们这一行花了五年时间写「人的监督」条款,而本书指出那些条款所要的接管能力只能由带责分叉生产,自动化设计的标准实现方式恰好把它降到零。这不是一个执行问题,是一个条款与设计之间的结构性矛盾,而目前没有任何一份评估表有它的字段。

合章那条处方——不要记录「他做了一次选择」,去记录「他提交了一次不采纳」——是可立法的形式,我会带回去讨论。我的保留也在这里:本书自己在结语第五节说过,任何把没有发生的事变成考核指标的做法都会制造出它的表演版本。否决率一旦入法,最省事的合规就是制造无害否决——退回一批本来就要退的、在系统给出低置信度时按一下不采纳。作者建议这张表只用于自查、不用于考核别人,这在个人层面成立,在监管层面等于放弃:监管的全部动作就是考核别人。本书对个人给了办法,对制度只给了警告。这一处不是错,是缺口,而它恰好落在最需要办法的那一侧。

十二段读完,作者要认的一件事

上面十二处质疑里,有九处是本书正文已经预留了退路的(三、五、九、十二处最明显),只有三处是它没有预留的:第二段那把「鉴别不独立」转回来砍第一章复推率的刀、第七段关于「被追责的是哪一类判断」的分层、第十一段关于峰坑相邻是否需要邻域度量的限制。

按第四章的说法,这个比例本身就是一个读数:一份由熟悉本书的一方写出的评审,能搬走的清晰度有限,因为它与本书没有足够的距离。真的评审仍然欠着,而且现在知道大概欠在哪三个位置。

© 德麦国际出版社 · 王德生 + Claude《答案随时可得之后》