〔章首〕本章给可读条件立第四条,也是取证层的独章:他择时刻。三个此前二三十年各自撞上"产物可被外力制造"的行业——反兴奋剂、民航、消费信贷——共同默认"存在一处不能被制造的参照物",又各自被自己的数据推翻;推翻之后剩下的不是第四处参照物,而是三条从未被当作对象的归属:取样时刻归谁定、取样之手归谁、记录归谁持有。三条张成八格,三家与毕业生占了七格,有一格四方皆空:他人之手、非本人所选时刻、无异常、记入本人可携账本——本章以那格空位为承重物,读数是他择率与归己率。本章的三次预注册审计里,第二次的读后改判(承重物由一条属性改到那格空位)连同改判理由原样照登。本章欠的账:他择读数与入职绩效的剂量-反应机制检验——设计已备,最便宜的版本只需一家愿意回看自己招聘档案的机构;另欠医学教育工作场评估一族(受训者自选时机与观察者,恰落空格上方一行)一段点名分界,本书第十五章代为补记。
一家餐馆自己请了美食评委,选了个食材最好、人手最齐、老板亲自坐镇的日子,评委来了,吃得很满意,给了个好评。
另一家餐馆,某个普通的周二晚上,来了一位没打招呼的密探,吃完走了,没挑出毛病。
哪一条记录更值钱?
答案很明显,但它背后的道理值得说清:两条记录的差别不在评委的水平,不在餐馆的水平,甚至不在那顿饭本身——差别在于日子是谁挑的。
《他手无事账》讲的就是这一条:取样的时刻由谁决定,决定了这份证据还有没有信息。
为什么今天要紧?
因为"准备"这件事已经可以外包了。
以前,一份精心准备的作品集,本身还能说明一点东西——至少说明这人肯下功夫、有一定水平。现在,准备可以被大规模代做,于是"我准备好了给你看"这类证据整体失效。凡是你自己选好时刻交出来的东西,都在这个失效名单上:简历、作品集、项目复盘、事先约定的答辩、你挑好日子请人来看的一切。
剩下唯一还带信息的,是你没准备的那些时刻。
这一章有个特别的地方:它发现了一个空格。
书里把这件事拆成三条归属:取样的时刻归谁定、取样的手归谁、记录归谁持有。三条各有两种可能,张成八个格子。
反兴奋剂查了三十年,民航查了几十年,消费信贷也查了几十年——三个行业各自摸索出了自己的那一格,加上毕业生现在的处境,八个格子里占了七个。剩下一格是空的,四方都没有:他人之手、非本人所选的时刻、无异常也照样入账、并且记在本人可以带走的账本上。
这一格为什么重要?前三个条件保证这份记录可信;最后一个条件——归己——保证它是一个人的资产,而不是一次单方面的监视。少了最后一条,这套东西就变成了对人的管控;有了它,它才是一份可以跟着人走的信用。
读数是什么?
两个:他择率(你的证据里,取样时刻不由你决定的占多少)和归己率(这些记录里,有多少记在你自己可携带的账本上)。
判据可以直接拿去问任何一份简历:这个人的能力证据里,有几份的取样时刻不是他自己定的?
大多数人的答案是零。这不是他们的错——现在几乎没有制度在生产这种记录。而这正是它稀缺的原因:一份就够,因为几乎没有人有。
一个小场景。
面试官问:"能不能给我一个例子,是别人在你没准备的时候看到你工作的?"
一个候选人说:不好意思,没有——我的项目都是提前准备的汇报。另一个说:有,去年我们组临时被叫去救一个别人的项目,客户方的技术负责人全程在场,事后他写了一段评价发在群里,我截图留着。
第二个人的那张截图,不是因为内容多好,而是因为时刻不是他挑的。
再看两个身边的例子。
突击检查。所有人都知道,通知过的检查和不通知的检查,看到的是两个不同的世界。这件事人人都懂,但很少有人把它反过来用在自己身上——你的能力证据里,有几份是"不通知"的那一类?
朋友眼中的你。为什么熟人的评价比自我介绍可信?不是因为熟人更客观,而是因为熟人看到的那些时刻不是你挑的:你排队时的样子、你累的时候怎么说话、你计划落空时的第一反应。自我介绍是自择时刻的,朋友的印象是他择时刻的——两者的信息量根本不在一个量级。
三种常见的误读。
第一种:以为这是在鼓励监控。这一章明确反对无对价、全覆盖的观察。它的三个条件里,最要紧的第三个是归己:记录必须记在被读者本人可以带走的账本上。没有归己的那一格,它就是监控;有了归己,它才是一份跟着人走的信用。这一格的空缺,正是这一章的核心发现。
第二种:以为"没被发现问题"不算成绩。恰恰相反,这一章最反直觉的一条就是:无异常也要入账。现行所有检查制度只记录问题、不记录"没问题",于是一个从没出过事的人和一个从没被检查过的人,在账面上完全一样。把"无事"变成可累积的资产,是这一格与前七格的关键差别。
第三种:以为可以事后补。补不了。一份事后追认的"当时我表现不错",它的时刻仍然是你自己挑的。他择记录必须在当时、由对方留下。这就是为什么它稀缺,也是为什么一份就够。
给自己做个小检查。你手上所有能拿出来的能力证据里,有几份的时刻不是你自己定的?如果答案是零,这不是你的失败——现在几乎没有制度在生产这种记录。但它意味着,你今天开始留的第一份,就是罕见的。
它和旁边几个概念的区别。
和《脱稿步》的两轴正交,上面已经讲过:一个管从哪儿出发,一个管时刻谁定。
和《峰兑》的关系是包含而非等同:峰时事件天然他择,但他择不必是峰时——一次普通周二的无预告抽查,也是完整的他择记录,而且比事件常见得多。这一点很实用:等事件可能要等好几年,而他择记录今年就可以开始积累。
和《零判份》互不相干却常被混为一谈:ρ 说的是产出本身的判别力,他择率说的是这份读数可不可信。一份 ρ 很高的作品集,如果全部是自择时刻交出来的,它的可信度问题一点没解决;反过来,一次他择读数也不会提高你产出的未见率。产出轴与取证轴是两码事。
和《入账之前的技能》在"归己"这一格上咬合:他择记录如果只记在机构账上(像飞行数据那样),那么这一章的第三个条件不满足,八格里的那个空格仍然是空的。
一句话记住它:这一章管的是凭什么信——而唯一的答案是,那个时刻不是你挑的。
个人层面。
第一,主动进入不由你择时的场合:临时顶上的活、别人挑时间的评审、突发状况下的支援、无预告的现场答疑。
第二,把这类记录留下来并归己:请对方留一句话、留一份可查证的痕迹,自己保存一份。这件事必须当时做,事后补的都带着自择的味道。
第三,分清两种自愿:进入检查库应当是你自愿的、有对价的(换来机会、优先权、可携带的记录)。无对价、被强加的观察不是这一章的处方,是它明确反对的东西。
大学发生学教育:建一个自愿的"检查库",并把记录还给学生。
这一条是发生学教育里制度性最强的一条,也最需要学校层面的设计,但它的成本比想象的低——它主要是记账方式的改变,不是新增环节。
教师与教务的动作。
第一,编码规则公开:什么算无预告、什么算无异常、谁来记,全部写在明处,并留一条学生可以申诉与要求撤出的通道。第二,抵抗把它变成抽查纪律的诱惑——它记的是能力证据,不是考勤,两者一旦混同,学生会立刻把它当成敌意的东西并开始规避。
最容易做坏的地方。
假他择:说是无预告,实际上内部提前通气。它会以最快的速度掏空这套制度的全部价值,而且很难查。唯一的防线是编码规则公开+抽样的时间由不参与教学的第三方决定。
王德生 德麦国际 Demai International Pte. Ltd.,新加坡
The Other-Hand Clean Ledger: Where the Evidence of Graduate Competitiveness Goes in the Age of Generative AI — An Analysis Based on Three Reference Cases from Anti-Doping, Cockpit Automation and Consumer Credit
Wang Desheng, Demai International Pte. Ltd., Singapore
目的:回答一道被生成式人工智能改写了前提的问题——大学毕业生的核心竞争力将是什么。既有回答大多给出能力清单,而清单默认能力可以从毕业生交出的产物上读出;生成式 AI 使产物与能力之间的推断关系归零,问题因此变为”当产物不再是证据,能力的证据在哪里”。方法:本文选取三个此前二三十年间各自撞上同一问题、且互不引用的领域作为参照案例——反兴奋剂的运动员生物护照、民航驾驶舱自动化后的手动飞行小时、消费信贷中的”信用隐形人”——把三家的回答写成同一句争论,找出三家共同默认而未说出的前提,并用其中一家自己的实证材料(微剂量促红素在护照标记下不被标出)将其推翻;随后给出承重命题、辨别装置与可跨领域通约的读数,并对两组公开文件做预注册的字段审计。发现:三家共同默认”存在一处不能被制造的参照物,证据搬到那里就安全”;该前提在三家各自的实证材料里均已被推翻。推翻之后剩下的不是第四处参照物,而是三条三家都用过却无一家当作对象的归属:取样时刻归谁定、取样之手归谁、记录归谁持有。三条归属张成八格,三家与毕业生分别占了七格,有一格四方都空着:由他人之手、在被读者不选择的时刻取得、结果为无异常、且记入被读者可持有账本的记录。本文把这一格命名为他手无事账,并提出:毕业生的核心竞争力不是产物质量、不是自动化之外的残余技能、也不是被记录的厚度,而是他手无事账的存量。两次审计:六所公布”双车道评估”的大学全部以监考与定时定义安全车道,无一以无预告定义,与本文的次序预测一致;美国联邦航空局 2022 年《飞行路径管理》咨询通告的三条预注册预测全部命中,而一条预注册之外的发现——民航早已持有逐次航班的他择读数却以政策不归于个人——正是把本文的承重物从”时刻归属”这一条属性推到”三条归属张成的那一格空位”的材料。第三次审计按预注册去四个职业场域找那一格的反例(会计师事务所同行检查、医师执业再认证、照护机构无预告检查、反兴奋剂机构公开的运动员检测次数):无一同时满足三个条件,最近的一个差半个条件。结论:生成式 AI 没有消灭能力,它使自择时刻的证据归零;四个场域各自持有那一格的两个条件而无一持有第三个,这一格空位就是竞争力将要落进的地方。
关键词:他手无事账;他择存量;他择率;自择证据;取样之手;记录归属;运动员生物护照;手动飞行小时;信用隐形人;双车道评估;毕业生就业能力
Purpose. This paper addresses a question whose premise has been rewritten by generative AI: what will be the core competitiveness of university graduates? Existing answers list competencies, and lists presuppose that ability can be read off what graduates submit; generative AI reduces the inferential link between product and ability to zero, so the question becomes where the evidence of ability goes once products cease to be evidence. Method. Three fields that met the same problem two to three decades earlier and do not cite one another are taken as reference cases: the Athlete Biological Passport in anti-doping, manual-flying hours after cockpit automation, and “credit invisibles” in consumer finance. Their answers are written as one dispute, the premise all three share but never state is identified, and it is refuted with one field’s own empirical material (micro-dose EPO is not flagged by passport markers). A load-bearing proposition, a discriminating grid and a cross-field commensurable ratio are then given, and two sets of public documents are audited under pre-registration. Findings. All three fields assume that a reference point exists which cannot be manufactured, so that evidence is safe once relocated there; each field’s own data refute this. What remains is not a fourth reference point but three attributions all three fields used and none treated as objects: *who chooses the sampling moment, whose hand takes the sample, and who holds the record*. The three attributions span eight cells; the three fields and the graduate occupy seven, and one cell is empty for all four: a reading taken by another’s hand, at a moment the person did not choose, showing no anomaly, and entered into a ledger the person holds. We name this cell the other-hand clean ledger and propose that graduate competitiveness is not product quality, not residual un-automated skill, not record thickness, but the stock of that ledger. Two audits: all six universities with published two-lane assessment frameworks define the secure lane by supervision and scheduling, none by no-notice sampling, as the ordering prediction requires; three pre-registered predictions on the FAA’s 2022 Flightpath Management Advisory Circular are all met, while one unregistered finding—aviation already holds flight-by-flight other-timed readings but by policy keeps them de-identified—is precisely what pushed the load-bearing object from one attribute (timing) to the empty cell spanned by three attributions. A third pre-registered audit searched four professional domains for a counter-example to the empty cell (CPA firm peer review, physician revalidation, unannounced care-home inspection, publicly posted athlete test counts): none satisfies all three conditions; the nearest misses by half a condition. Conclusion. Generative AI did not abolish ability; it zeroed self-timed evidence. Each of the four domains holds two of the cell’s three conditions and none holds the third; that empty cell is where competitiveness will land.
Keywords: other-hand clean ledger; other-timed stock; other-timed ratio; self-timed evidence; Athlete Biological Passport; manual flying hours; credit invisibles; two-lane assessment; graduate employability
“大学毕业生的核心竞争力是什么”在 2023 年之前是一道常规问题,标准答案是一张能力清单:批判性思维、沟通、协作、终身学习,再加一门专业(World Economic Forum, 2020;OECD, 2019)。清单的问题不在内容,而在它默认了一件事——这些能力可以从毕业生交出来的东西上读出。简历、作品集、成绩单、面试作答、试用期报告,每一项都是毕业生在自己选定的时刻、准备完毕之后交付的产物;用人单位读产物,推断能力。
这条推断链在 2023 年之后失效。一份结构完整的报告、一段可运行的代码、一份获奖水准的作品集,任何会使用生成式工具的人都能在一小时内交出。产物与能力之间的推断关系不是变弱,而是趋于零;用人单位不是变得更难判断,而是他们习惯读取的整类证据同时失效(Kofinas et al., 2025)。
于是问题不再是”毕业生应当具备什么能力”,而是”当产物不再是证据,能力的证据在哪里”。这个问题教育学不是第一次遇到,也不是最早遇到。至少三个行业在此前二三十年各自撞上同一堵墙:竞技体育的成绩可由药物制造,反兴奋剂机构被迫重新决定证据放在哪里;民航飞行可由自动驾驶完成,监管者被迫重新决定”飞行员会飞”的证据放在哪里;消费信贷要求在放款之前读出偿付能力,而年轻人手上没有任何可读的产物。三家各自给出了答案,三个答案互不引用,且后来各自出现了同一种失效。
本文不把三家当作三个类比,而当作三个参照案例:把它们的答案写成同一句争论,找出三家共同默认而从未说出的前提,用其中一家自己的实证材料将其推翻,然后看剩下什么。贡献有四:
(1)指出三家共享的一条前提——“存在一处不能被制造的参照物”——并证明它在三家各自的实证材料里均已被推翻; (2)提出三条此前被三家各自使用却无一家当作对象的归属——取样时刻归谁定、取样之手归谁、记录归谁持有——并证明三条归属张成的八格里有一格四方皆空,据此给出承重命题”他手无事账”; (3)给出时刻轴的 2×3 辨别格、三归属的八格表、以及可跨领域通约的比率”他择率”与”归己率”,并说明它们与既有主要指标正交; (4)做三次预注册审计:两组公开文件的字段审计,以及对承重物”那一格是空的”这一主张的反例搜索;报告一条改变了承重物的发现,并把最近的反例写进正文。
第 2 节回顾相邻文献;第 3 节陈述三个参照案例;第 4 节分析三家的争论、共有前提与推翻材料;第 5 节给出命题、辨别装置与读数;第 6 节报告两处来自参照案例的反向约束;第 7 节给出证伪条件与三次预注册审计;第 8 节与最近的既有说法划界;第 9 节讨论伦理与适用边界;第 10 节是局限与自反;第 11 节给出结论与写死日期的可检验预测。
自择证据:取样时刻可由被读者推迟或提前的能力证据。他择证据:取样时刻由读者决定的能力证据;按告知期分为他择·定时与他择·无预告两档。他择率:他择证据份数占全部证据份数的比率。他择存量:他择证据中记录为”未见异常”者的累积份数。自手/他手:证据由被读者自己提交或记录(自手),还是由第三方执行取样并记录(他手)。归己/不归己:记录是否落到被读者名下并可由其持有携带。他手无事账:他择·他手·归己、且记录无异常的证据账目;本文的承重物。归己率:他手读数中记入被读者可持有账本的比率。参照物:在产物之外被选作证据落脚点的位置(基线、残余操作、第三方记录)。读者/被读者:读取证据的一方与被读取的一方;本文用这对词而不用”评价者/被评价者”,因为后者预设了评价关系,而他择读数的读者可以是检查官、观察员、数据记录器,不一定在评价。
学历为什么有价值?信号理论(Spence, 1973)与筛选理论(Arrow, 1973)的回答是:取得学历的成本对能力低者更高,因此学历能分开人。生物学中的残障原理(Zahavi, 1975)给出同一形状:可信的信号必须昂贵到造假者负担不起。这一支文献的前提是信号的制造成本与能力负相关;它从不问信号是在谁选定的时刻发出的。Caplan(2018)把学历价值的大部分归于信号而非人力资本,但同样不区分信号的时刻归属。
教育领域对生成式 AI 的回应集中在三支。其一,Dawson(2021)把”学术诚信”(学生该不该)与”评估安全”(能不能作弊)分开,主张后者是设计问题,手段包括身份认证、监考与工具限制。其二,“双车道”评估(Bridgeman & Liu, 2024;Corbin, Dawson & Liu, 2025)把评估分为受监考的”安全车道”与允许 AI 的”开放车道”,已被悉尼、奥克兰、巴斯等校写入政策;批评者认为它过于二分(Curtis, 2025)。其三,口试与”同步核验层”(Joughin, 2010;Sotiriadou et al., 2020)主张在作品之外由评估者当场提问,近两年的框架给出了三段式口试规程(Frontiers in AI, 2026)。三支的共同点是把注意力放在取样的条件(谁控制环境、工具、身份)上,本文将说明取样的时刻是另一根轴。
Bainbridge(1983)指出自动化把操作者变为监视者,而技能在最需要时已退化。Casner 等(2014)在模拟机上发现,长期依赖自动化的航线飞行员手动操纵技能基本保留,退化的是自动化断开时的认知技能。这一支文献是本文第二个参照案例的正主,第 4 节将说明它同时提供了推翻自己参照物的材料。
博弈论早已把不预告检查形式化(Dresher, 1962;Avenhaus, von Stengel & Zamir, 2002):检查者与被检查者在时刻选择上博弈,最优检查策略是随机化。软件可靠性中的混沌工程(Basiri et al., 2016)在生产系统里不预告注入故障。餐饮卫生等级牌(Jin & Leslie, 2003)把不预告检查的结果累积并公开,使食源性疾病住院下降约五分之一。这一支把不预告当作检查者的策略或场所的属性,无一把它当作被检查者可持有的证据属性。社会学中的前台/后台(Goffman, 1959)把被观察与否当作空间的属性而非时刻的归属。
用人单位并非没有他择读数。试用期是一段由用人单位定时、被雇者不能推迟的观察;实习评价也常包含主管对临时任务的记录。这一支实务没有进入评估文献,原因是它的结果不可携带:试用期通过与否只对该单位有效,实习评价通常是一份自由文本,没有任何字段记录”哪一次是临时的”。它们是他择读数,但不累积、不流通——落在表 2 的右列。本文与它们的关系在 8 节与 9.5 节给出。
上述六支各自触到”取样时刻由谁定”“取样由谁执行”“记录归谁”三条归属中的一条或两条,但无一把三条并排、无一问过三条同时成立时会出现什么;它们也没有一支把”参照物本身可被制造”当作问题。本文补的正是这两处。
三个案例按四条标准选出。其一,互不引用:反兴奋剂文献、人因工程文献与消费信贷文献之间没有交叉引用网,三家对同一问题的回答因此是独立形成的,而不是相互抄的。其二,各自撞过同一堵墙:三家都经历了”产物可被外力制造”这一事件,且都在事件之后重新选择了证据的落点。其三,各有可清点的对象:护照样本、航段、账期,三者都可数,使第 5 节的读数有取数场。其四,各有厚的判据体系:国际体育仲裁法庭十余年的护照判例、民航事故调查与咨询通告体系、信用评分的监管与诉讼史,使”对立的答案”不是主张而是有判据的做法。三家分别从三个位置回答——被显露出来的形状、一段不可替代的路径、证据得以成立的场——这一点在表 1 最后一栏标出;同一位置上的两家只能靠判谁对来化解冲突,那是辩论而不是本文要的并排。
竞技体育最早的证据是成绩本身。药物出现后,证据被搬进尿样。到 2000 年代中期尿检失效:促红素的检测窗口只有几十小时,运动员在窗口之外用药,比赛时的样本干净。
2009 年,世界反兴奋剂机构把证据再搬一次,搬进一个此前不存在的位置:运动员自己的历史。运动员生物护照不再问”这份样本里有没有药”,而问”这份样本与此人过去十几份样本的分布是否一致”。网织红细胞百分比、血红蛋白浓度被逐次记录成纵向轨迹,判定依据是偏离自身基线的程度(WADA, 2009 及后续版本)。国际体育仲裁法庭自 2010 年起确认仅凭纵向轮廓、未检出任何药物的处罚成立。护照的判定不是自动的:软件先按贝叶斯模型给出该样本落在此人预期范围之外的概率,超过阈值的”非典型护照结果”交由三名独立专家匿名评审,专家须排除海拔训练、疾病、脱水等生理解释,三人一致认为”极可能是禁用方法所致”才立案。也就是说,护照把”证据”重新定义为一个人与他自己的偏差,而不是一个人与某个外部标准的偏差;一名血红蛋白偏高但一向如此的运动员不会被标出,一名数值在群体正常范围内但相对自己突然变化的运动员会被标出。这个设计的前提是自己的历史无法被自己改写。
护照还带来一个此前不存在的读数方向:进步本身成为可疑对象。在产物型证据时代,成绩提高是能力的证明;在护照时代,一段没有生理来路的提高是立案的触发。这一点与本文第 5 节的判据有直接关系——当产物可造,“越来越好”不再是无条件的正面信号,“在谁选的时刻被读到”才是。
这一步的含义是:证据从产物(成绩、样本中的药)搬到了参照物(此人自己的历史),并默认该参照物不能被制造——生理基线是自己的,药物只能使人偏离它。与此同时出现的”行踪规则”要求注册检查库中的运动员每天报出一个 60 分钟时间窗,检查官可在窗内不预告地取样;一年三次错过等同一次阳性。行踪规则不是护照的附件,而是护照运转的条件:纵向轨迹要成立,取样时刻就不能由运动员决定。
1980 年代以后驾驶舱自动化逐年上升,到 2000 年代,一段典型航线飞行中飞行员手动操纵的时间只有起降前后的几分钟。问题出在自动化失效的时刻:法航 447(2009)皮托管结冰、自动驾驶断开,机组四分钟内未能改出可恢复的失速(BEA, 2012);韩亚 214(2013)自动油门处于机组未察觉的模式,进近速度持续衰减(NTSB, 2014)。两份调查指向同一点:飞行员会不会飞,不再能从他飞过的航段读出——那些航段是自动驾驶飞的。
监管者把证据搬到新位置:未被自动化替代的那段操作。美国联邦航空局 2013 年发布安全警示 SAFO 13002《手动飞行操作》,要求航空公司鼓励飞行员在适当条件下手动飞行,理由是持续使用自动驾驶可能导致手动技能退化;2017 年 SAFO 17007 再次重申。手动飞行小时、模拟机中不带自动化的科目、航线检查中的手动进近,成为”此人还会飞”的证据。搬动的形状与第一家相同,且同样默认参照物不能被制造——手动飞过的小时就是手动飞过的。
值得记下的是监管者在 2013 年前后拿到的那份行业报告。联邦航空局的绩效评审委员会与商业航空安全团队 2013 年联合发布《飞行路径管理系统的运行使用》,汇总了二十六起事故与重大事件、九千余份自愿报告与航线观察数据,结论之一是:机组对自动化的依赖不只是技能问题,而是知道飞机现在在做什么的问题——飞行员在自动化模式切换时常常不知道飞机处于哪个模式。这份报告已经把问题从”手会不会动”移到了”脑子知不知道”,但监管文件的处方仍然落在”多手动飞”上。这是第 4 节要用到的一处错位:参照物记的是手,缺的是脑。
一个人能否按时还款,放款人须在放款前判断。收入证明是产物型证据——可伪造,也可在借款后消失。1950 年代起,美国消费信贷业逐步把证据搬进第三方记录:信用档案。每一笔账户的开立、每一期还款的准时与逾期,由三家征信机构逐月记录,评分模型从记录中读出一个数。搬动逻辑仍然相同:产物可造,记录不能——它是别人替你记的。
这一家暴露出另外两家未正面遇到的问题:没有记录的人。美国消费者金融保护局 2015 年的统计:约 2600 万成年人在三大征信机构没有任何档案,另有约 1900 万因记录太少或太旧而无法评分,两类合计约占成年人口五分之一,且高度集中在 25 岁以下(CFPB, 2015)。这些人不是信用差,而是信用不可见。一名应届毕业生在这套系统中的位置正是”薄档案”。
这一家还出现了另外两家未出现的事:既然证据是记录厚度,市场上出现了制造厚度的产品——信用建设贷款(按月向锁定账户存钱,每期被报送为准时还款)、授权用户(挂到他人老账户上,其历史立刻出现在自己档案里)、以及曾公开交易的”交易线出租”。评分公司在 2008 年模型中专门加入过滤以对付最后一种(FICO, 2008)。
信贷这一家还有一处另外两家没有的制度特征:正向记录。反兴奋剂只记异常样本,民航只记事故与偏差;信贷从 1970 年代起同时记录准时还款——一次”没出事”也进档案,并且越多越好。正因为如此,信贷是三家里唯一把”无事”累积成资产的一家,也是三家里唯一出现了制造”无事”的市场的一家。这两件事不是巧合:一旦无事被累积成资产,无事就可以被制造。这一点在第 5.5 节与第 9.3 节都会回来。
三家的争论可写成同一句:当产物可以被外力制造,能力的证据该放在哪里。 三个答案见表 1。
表 1 三个参照案例的证据落点
| 参照案例 | 证据搬到了哪里 | 该位置被认为不能被制造的理由 | 回答的维度 |
|---|---|---|---|
| 反兴奋剂 | 此人自己的纵向基线 | 生理基线是自己的,药只能使你偏离它 | 被显露出来的形状 |
| 民航 | 自动化之外的残余操作 | 手动飞过的小时就是手动飞过的 | 一段不可替代的路径 |
| 消费信贷 | 第三方逐月记的档案 | 别人替你记的,你改不了 | 证据得以成立的场 |
三家从三个位置回答;它们的冲突不能靠”判谁对”化解,因为各自的问题结构使另外两家的答案对自己不可见:反兴奋剂不关心你有没有手动飞过,民航不关心你有没有基线,信贷不关心你偏没偏离自己。三家的答案在各自领域都是标准做法。把它们并排放好之后要问的不是哪一个更好,而是它们底下共同站着什么。
三家的答案有一个共同形状:证据从产物搬到某个参照物,并默认该参照物不能被制造。这不是三家各自的立场——三家都没把它当立场说出,它是三家动手之前已经站在上面的地面。念给三家听,三家都会说:这还用说吗。
写实到本题:
存在一处不能被制造的参照物;把能力证据搬到那里,产物的可制造性就被绕开了。
它有一个更靠上的结构层形式:能力可以从某一个位置单独读出——只要位置选对,一处读数就够。三家争的是哪一处,没有争的是”有这么一处”。
这条前提放到毕业生身上,正是 2023 年以来全部对策的地面:把考试搬回考场(参照物:监考下的作答),把评价搬进过程(参照物:草稿、版本、思考记录),把证据搬进实习与推荐信(参照物:第三方记录)。三种对策各对应三家的一种,各自默认自己搬去的地方不能被制造。
推翻该前提的材料不必外求,第一家自己早已持有,只是它在自己的领域里回答的是另一个问题。Ashenden 等(2011)给十名受试者按微剂量方案注射促红素——每周两次、剂量只有常规方案的几分之一,持续十二周——然后用护照的判定模型逐份读取血样。结果:护照的现行标记未标出任何一名受试者,而其血红蛋白总量确实上升。该文在自己的领域里回答的是”护照灵敏度够不够”,结论是不够、需要更多标记与更密取样。没有人把它当作关于那条前提的证据。
而它说的正是:参照物也是可以被制造的。 微剂量方案做的不是使运动员偏离基线,而是使基线本身在判定阈值之内缓慢上移——一条被制造出来的基线。这件材料是一个观察结果而非主张,是反兴奋剂自己的实验数据;它推翻的是反兴奋剂自己站的那块地。
第一家的参照物被证明可造,另外两家的参照物立刻露出同一条裂缝,证据同样来自它们自己:
三处裂缝的形状相同:每一处被选作证据落脚点的参照物,一旦成为落脚点,就成为下一轮制造的目标。 这不是三家做得不够好,而是”搬到一处不能被制造的地方”本身不成立。到这里,三家都不能退回自己的阵地:反兴奋剂不能说”把基线记得更密”——它自己的数据说更密也标不出微剂量;民航不能说”多记手动小时”——它自己的研究说手动小时记的不是缺的那部分;信贷不能说”把档案记得更厚”——它自己的市场在卖厚度。
前提推翻之后,最省事的反应是找第四处地方;这条路走不通,理由已在 4.4。要看的是三家在参照物失效之后各自实际又做了什么。
反兴奋剂在护照失灵后没有再搬地方,它做的是把取样时刻从运动员手中拿走——行踪规则、无预告检查、2010 年代后期从定期取样转向情报驱动的靶向取样(Lauritzen, 2023)。判定依据仍是那条轨迹,变的是轨迹上每一个点由谁决定何时取。民航在手动小时之外真正保留的证据是航线检查:检查员不预告地坐进驾驶舱,在这一段真实航线上看此人怎么飞。信贷评分中真正抗制造的部分,行业称为”经历过周期的档案”:一个账户在 2008 年下行期的表现比其扩张期十年准时还款更值钱,因为下行期不是借款人选的。
三家各自走到的地方从外面看是三件不相干的事——行踪规则、航线检查、周期表现——但它们是同一件事:证据的价值不由它落在哪个位置决定,而由取样时刻是否由读者、而非被读者选定决定。 一份运动员自己选好时间提交的血样、一段飞行员自己选好科目练出的手动飞行、一条借款人在自己选好的宽松年份建立的档案,三者都是自择证据;一份 60 分钟窗口内被敲门取走的血样、一段检查员不预告坐进来看的进近、一段谁也没选的下行期里的还款,三者是他择证据。
这条维度此前不是没被用过,而是从未被当作一样东西。三家各自用了它,各自用自己领域的名字称呼它,各自把它当程序细节。它落在三家账本的缝里:护照记数值不记时刻由谁定,航线检查记通过不通过不记是否预告,档案记准时不记那一年好不好过。
必须排除一种更省事的读法:三家走到的地方不就是”第三方”吗?不是。信贷的档案从一开始就是第三方记的,它照样被制造——因为借款人虽然不能改记录,却能决定什么时候开一个账户、什么时候还一笔款;第三方记的是时刻由本人定的事件。模拟机训练也是第三方执行的,飞行员照样能选科目、选时段。第三方决定了谁记,没有决定何时取;而三家在参照物失效后各自抓住的,恰恰是何时取。把”他择”压缩成”第三方”,会把信贷档案与行踪检查放进同一格,而它们在三家的实际历史里正是被分开的两样东西。
还须排除另一种读法:他择不就是”随机”吗?也不是。行踪规则下的取样常常不是随机的,而是情报驱动的靶向取样——检查官专挑赛前几周、专挑训练营;航线检查也常常安排在困难机场。他择的定义只要求时刻不由被读者决定,不要求读者的选择无规律。随机是他择的一种实现,不是它的定义。
三家从产物到参照物、再到时刻归属,走的是同一条次序,且各自用了大约一代人的时间(表 1a)。
表 1a 三个参照案例的证据迁移次序
| 阶段 | 反兴奋剂 | 民航 | 消费信贷 |
|---|---|---|---|
| 产物即证据 | 成绩(—1960s) | 完成的飞行(—1980s) | 收入证明(—1950s) |
| 产物中的痕迹 | 尿检阳性(1968—) | 事故调查(持续) | 抵押物(持续) |
| 参照物 | 纵向基线/护照(2009) | 手动飞行小时(2013) | 第三方档案(1970s—) |
| 参照物被制造 | 微剂量方案(2011 实证) | 模拟机小时;手记脑不记(2014 实证) | 信用建设产品、交易线出租(2000s) |
| 时刻归属 | 行踪规则(2009,与护照同时)、靶向取样(2010s 后期) | 航线检查(一直存在,被重新倚重) | 周期表现(2008 后) |
| 存量是否归人 | 归人,只记异常 | 持有而不归人(7.5) | 归人,正向记录 |
次序相同不是巧合,而是同一条逻辑的三次执行:证据落到哪里,制造就跟到哪里;能被制造的位置终究都是被读者可以选时刻的位置;剩下的只有读者选时刻的那些点。三家花了一代人各自走到这一步,并且都没有把这一步命名——这正是教育侧可以省下的那一代人。
4.5 抓住的是时刻归谁定。但三家在参照物失效之后的实际做法里,还藏着另外两条归属,同样各自用了、各自没当成对象。
第一条是取样之手归谁。护照的样本由检查官取,不由运动员交;航线检查由检查员坐进来看,飞行数据由记录器记,不由飞行员填;信贷档案由放款机构报送,不由借款人自述。三家在这一点上一致:证据落脚点失效之后,它们都把取样从被读者手里拿走了。信贷早就这样做,但它的问题在时刻(4.5);反兴奋剂与民航后来也这样做,把时刻也拿走了。
第二条是记录归谁持有。这一条三家分开了。信贷把记录归到借款人名下,借款人可以调阅、争议、携带,且正向记录——“无事”入账。反兴奋剂把护照归到运动员名下,但只记非典型结果,一次清白的敲门不留痕。民航的飞行数据是每一次航班都记的、不由飞行员选时刻的、不由飞行员之手的——它同时满足前两条归属——但以明文政策去除身份、不得用于对个人的判定(7.5)。
把三条归属并排,得到八格(表 1b)。三家与毕业生各自占了哪些格,是可以逐一查出的事实,不是构造。
表 1b 三条归属张成的八格及其占据者
| 时刻 | 手 | 账 | 占据者 |
|---|---|---|---|
| 自择 | 自手 | 归己 | 作品集、简历、自选项目——毕业生的目标格 |
| 自择 | 自手 | 不归己 | 一次性自评问卷、无记录的练习 |
| 自择 | 他手 | 归己 | 信贷档案(准时还款入账,事件时刻由借款人定);可预约的考试与面试 |
| 自择 | 他手 | 不归己 | 不进档案的实习汇报、内部测评 |
| 他择 | 自手 | 归己 | 应临时要求自报的材料(限时自述) |
| 他择 | 自手 | 不归己 | 临时口头问答无记录 |
| 他择 | 他手 | 不归己 | 民航飞行数据(去身份);卫生等级牌(归场所不归人);闭卷考试成绩单归己,但只记分数不记”无事” |
| 他择 | 他手 | 归己且记无事 | 空——反兴奋剂在此格只记异常;民航在此格不归人;信贷在此格时刻自择;毕业生账本无此字段 |
最后一行是本文的承重物。它不是一个读数、不是一条属性,而是一类四方账本上都不存在的记录:由他人之手、在被读者不选择的时刻取得、结果为无异常、且记入被读者可持有的账本。四个场域各自持有它的两个条件,无一持有第三个——反兴奋剂有他择与他手,无”无事归己”;民航有他择与他手,无归己;信贷有他手与无事归己,无他择;毕业生三者皆无。删掉这一格,四家的账各自都记得平——这正是它此前从未被当作一样东西的原因。本文把它命名为他手无事账。
4.5 的”他择”仍然成立,它是这一格的三个条件之一,也是三家最后才各自抓住的那一个;但以它为承重物会把信贷档案(自择·他手·归己)与行踪检查(他择·他手·只记异常)当作同一件事的两个程度,而它们在表 1b 里隔着两格。承重物必须落在那一格空位上,不能落在通向它的某一条轴上。
生成式 AI 时代,大学毕业生的核心竞争力不是他交出来的产物的质量(第一家的划界:产物可造),不是自动化之外的残余技能(第二家:残余可造,且残余不是缺的那部分),也不是被第三方记录的厚度(第三家:厚度可造),而是他手无事账的存量——由他人之手、在本人不选择的时刻取得、结果为无异常、且记入本人可持有账本的记录,累积起来的那个量。
三重否定各对应一家;三家的证据合起来只能得出它,而三家单独都到不了它。原因不在三家的疏忽,而在它们各自的核心问题使表 1b 最后一行的第三个条件对自己成为不必要:反兴奋剂的核心问题是抓人,抓不到的读数不记,故不会给一次清白的敲门入账;民航的核心问题是安全,而安全文化要求飞行数据不得归人,否则无人再报告;信贷的核心问题是定价违约,它记的是借款人自己发起的账户,不会把”这一期是不是他选的”记成字段。三家各缺一个条件,缺的是三个不同的条件。
表 1b 给的是三条归属的八格;本节把其中最难判的一条——时刻归属——展开成三档,与”是否累积”交叉,用于逐项编码。第一根轴分三档:取样时刻由本人定(自择);由他人定但时刻公布(他择·定时);由他人定且不预告(他择·无预告)。第二根轴:读数是否被累积成存量。
表 2 能力证据的 2×3 辨别格
| 读数被累积成存量 | 读数不被累积(只在异常时记一笔) | |
|---|---|---|
| 自择 | 目标格:作品集、成绩单、简历、准备好的面试作答、自选题的比赛。全部形式审查都能通过;AI 使它短期看起来更好,且制度已开始把它移出证据栏(7.4);一份 AI 造的作品集第一次失效时不产生信号;评价越正规化,这一格越厚 | 自选时段的一次性认证考试。过了是一张证,没过不留痕 |
| 他择·定时 | 学期闭卷考试、定期考核、标准化工作样本测验。确实累积,但候选人可为公布的时刻准备,AI 可代练可准备的部分。双车道”安全车道”与民航”定期检查”现在所在的格 | 比赛时的反兴奋剂检查:预告的、只记阳性 |
| 他择·无预告 | 本文答案所在:无预告的现场任务、检查员坐进来的那一段、不由本人选的困难期表现——当它们被累积并记为”无异常”时。这一格在毕业生账本上目前不存在;民航持有它(每次航班的飞行数据)但以政策不归于个人(7.5) | 三家实际所在的格:行踪检查、航线检查、周期表现——存在,但只在出事时记一笔 |
目标格的三条签名齐全:短期指标改善(AI 使自择产物更漂亮);失效不产生信号(自择产物失效时不知道是它);自我加固(评价越正规,对自择产物要求越高,自择产物越厚)。这一格不是一眼能看出的坏,它是所有人都在投入的那一格——正因为它通过全部形式审查。
在这个人的能力证据里,有几份的取样时刻不是他自己定的?
再配一句问表 1b 最后一行的:这些取样时刻不由他定的读数里,有几份是别人的手取的、记的是无事、又记在他可以带走的账本上? 两句合起来就是他手无事账的清点法。第一句可以拿去问一份简历、一套招聘流程、一本成绩单、一份实习评价表,不涉及任何人的判断。它之所以不含「应当」「真正」「充分」这类词,是因为含了这些词的判据只能问人,而问人得到的是一个判断;本文要的是一句可以拿去问流程文件与表格字段的话——答案是一个数,且两个人去问会得到同一个数。它在五个场景中的答案互不相同:(1)典型应届简历:零,每项都是自己选了时间做完再写上;(2)带有”航线检查”式实习评价的简历:一到两份——若实习单位有不预告抽查制度且写进评价;(3)注册检查库中的运动员:一年十几到几十份,且每份时刻都不由本人定——此数不是从命题推出,而是从行踪规则的实际执行频率查出;(4)经历过 2020 或 2022 年下行期的信贷档案:那几个月的每一期是他择的,行业评分实践确实给予更高权重——亦是查出的;(5)“双车道”大学的学生:安全车道考试由校方定时,但时刻公布——落在他择·定时格。
他择率 = 取样时刻不由本人决定的读数份数 ÷ 该人全部能力读数份数。
三个领域量纲不同、比率相同:反兴奋剂里分子是无预告取样份数,分母是全部样本;民航里分子是航线检查与无预告评估的航段,分母是全部记录为该人操纵的航段;信贷里分子是落在非本人选择的困难期内的账期,分母是全部账期。毕业生身上,分子是不预告的现场任务、他人出题的即时作答、非自选时段的真实工作片段;分母是全部被拿来评价的证据项。分子按 5.2 第一根轴的后两档分栏记录,不合并。
四条性质:无量纲;可事后清点(每份证据的取样时刻由谁定是一个可从流程文件核对的事实);把一个印象变成一个数;与既有主要指标正交。最后一条最要紧:一名成绩全优、作品集获奖、面试作答无懈可击的毕业生,他择率可以为零;一名成绩中等、但在实习单位三次不预告的现场事故处理中都在场且无异常的毕业生,他择率不为零。两数互不推出。
归己率 = 他手读数中记入被读者可持有账本的份数 ÷ 全部他手读数份数。它是表 1b 第三条归属的读数:民航的归己率按政策为零,反兴奋剂的归己率对异常为一、对无事为零,信贷的归己率接近一。他择率与归己率相乘,得到落进最后一行那一格的份额。
他择率与归己率是比率,他手无事账是那一格里记录本身的累积。四个场域现在都不累积它:护照不记一次清白的敲门,飞行数据不落到飞行员名下,档案记无事却只记自择时刻的无事,毕业生的表格里连”取样时刻由谁定”的字段都没有。删掉这一格,它不是变得难测,而是不存在——四家的账各自照样记平。这是本文认为自己在指出一类新记录而非给旧栏目一种新算法的依据。离它最近的两个反例已在表 1b 里标出:卫生等级牌与民航飞行数据都落在它上面一行(他择·他手·不归己),差的是同一个条件。
要使他择率可事后清点,须有一套判定”这一份证据的取样时刻由谁定”的编码规则。本文给出三条:
(1)时刻可由被读者推迟或提前 → 自择。提交截止日之前的任何作业、可预约时段的考试、可选日期的面试,均属此列;截止日是上限不是时刻。 (2)时刻由读者定且事先告知,告知期长于被读者可用工具准备所需的最短时间 → 他择·定时。一次提前两周通知的闭卷考试属此列;告知期与准备时间的比较须写在机构规则里,本文不给通用阈值。 (3)时刻由读者定且告知期短于准备所需最短时间,或不告知 → 他择·无预告。行踪窗内的取样、当场追问、临时叫上去处理一个真问题属此列。
一个算例。某应届生的评价材料共 12 项:成绩单上 8 门课(其中 5 门以课程作业结课、3 门闭卷考试,考试日期开学即公布);一份作品集;一次实习,实习评价由主管填写,评价中记有两次”临时被叫去处理客户投诉”的表现;一次结构化面试(面试题固定、时间可约)。按上述规则:5 门作业、作品集、面试为自择(7 项);3 门闭卷考试为他择·定时(3 项);实习评价中的两次临时处理为他择·无预告(2 项)。他择率=5/12≈0.42,其中无预告档 2/12≈0.17。若同一人成绩单全优而实习评价中没有那两次临时处理,他择率降到 3/12=0.25、无预告档为零——成绩单没有变,这个数变了。这就是 5.4 所说的正交。
算例还暴露一处编码难点:实习评价那两次”临时处理”之所以能被计入,是因为主管碰巧写了下来;多数实习评价表没有这个字段。他手无事账之所以在毕业生账本上不存在,直接原因就是表格里没有这一栏——不是没发生,是没处记;而那两次临时处理即使被写下,也只是他择·他手,主管写的是评语不是”无事”,评价表归单位不归学生——三个条件仍只占两个。
表 3 他择率在四个场域的取数
| 场域 | 分子(他择读数) | 其中无预告档 | 分母(全部读数) | 取样之手 | 记录是否归己且记无事 | 缺的条件 |
|---|---|---|---|---|---|---|
| 反兴奋剂 | 赛内检查+赛外检查样本 | 行踪窗内取样、靶向取样 | 该运动员全部样本 | 他手 | 归己,只记异常 | 无事不入账 |
| 民航 | 定期检查、航线检查航段 | 不预告的航线检查;每次航班的飞行数据 | 记录为该人操纵的全部航段 | 他手 | 不归己(去身份) | 归己 |
| 消费信贷 | 落在非本人选择的困难期内的账期 | 下行期的每一期 | 全部账期 | 他手 | 归己,记无事 | 他择 |
| 毕业生 | 闭卷考试、临时现场任务、他人出题的即时作答 | 临时现场任务、当场追问 | 全部被用于评价的证据项 | 多为自手 | 无此字段 | 三者皆无 |
表 3 最后一栏是本文全部论证的落点:四个场域各缺一个条件,且缺的互不相同。这也解释了 3.3 末尾那件事:只有信贷把”无事”记成资产,也只有信贷出现了制造”无事”的市场——因为信贷缺的是他择,而自择的无事最容易造。他手无事账一旦设立,它的反噬(9.3)不会是造无事,而是造”他择”——把预告的时刻申报成无预告。
须防一种误读:本文没有说”他手无事账就是能力”,也没有说”能力已经不重要”。命题的对象是能力的证据落在哪里。能力仍然存在于人身上,仍然由学习、训练与经验形成;变的是能力被读出的位置。一个用生成式工具写出报告的毕业生可能确实理解报告的内容,也可能完全不理解——产物对这两种情形不再有分辨力,这是全部问题所在。他择读数之所以有分辨力,不是因为它更接近”真实能力”这样的形而上对象,而是因为它排除了被读者为该时刻准备的可能。当准备本身可以外包,未准备的时刻是唯一还带信息的时刻。
由此也可以看出本文与能力清单派的关系:清单派说的每一项能力都可能是对的,本文只是指出,无论清单上写的是什么,它的证据若来自自择时刻,在 2023 年之后都读不出来了。清单没有错,清单的证据栏空了。
两家反过来削掉了本文原本要主张的东西;两处都动了命题的适用范围或价值排序。
6.1 来自反兴奋剂:行踪规则的代价。 本文原本要写:“他手无事账应当成为所有毕业生评价的主读数。” 第一家不允许。行踪规则运行十余年,代价清楚:注册检查库中的运动员每天交出一小时行踪,该规则在欧洲人权法院被挑战,在运动员工会被反复反对;它之所以被容忍,是因为进入检查库是自愿的、有对价的(参赛资格)、且范围受限(精英层)。把这套东西不加限制地推到毕业生身上,得到的是无对价、全覆盖的被不预告观察的义务。削后的命题:他手无事账只对自愿进入某个”检查库”的人成立——报名参加带无预告成分的项目、接受带抽查条款的实习、加入自己知道会被不预告叫上去的岗位。范围从”所有毕业生”缩到”自愿进入检查库的毕业生”。
6.2 来自信贷:薄档案的结构。 本文原本要写:“他手无事账衡量一个人真实的能力。” 第三家不允许。信用不可见的五分之一人口不是能力差,而是没有机会被记。他择读数同样只在有人愿意不预告地读你的地方产生;大公司实习生一年可攒下多次,无抽查制度的小单位或自己家里的学生一次也攒不下。削后的命题:他手无事账衡量的不是能力,而是曝露——一个人被允许在别人选的时刻被读了多少次。它与能力相关,但首先记录的是机会的分布。本文不能把它读成”谁更强”,只能读成”谁被在他择时刻读过”。
两条的后果具体:第一条使本文的处方只能是”建检查库”而非”改评价标准”;第二条使读数在用于任何分配前都必须先问”此人有没有被读的机会”。
两条约束合起来,把他手无事账从”一个人的属性”改成了”一段关系的属性”:它需要一个自愿进入的位置(6.1),也需要一个愿意在那个位置不预告地读你的读者(6.2)。没有位置,读数不合法;没有读者,读数不产生。这使它在分配上与学历不同:学历可以由个人独自积累,他手无事账只能在关系中积累——它的三个条件里有两个(他择、他手)在读者手里,只有第三个(归己)是给被读者的。若命题成立,毕业生之间新的不平等将不在学校排名上,而在谁能进入有读者的位置——这条推论本文不喜欢,但它是从两条约束里直接掉出来的,不能删。
其实不就是把考试搬回考场吗。 监考下的作答也是他择时刻,双车道的安全车道正是此。若该解释成立,本文只是给”回到闭卷”起了新名字。分离点在 5.2 的第一根轴:考场是他择·定时,本文的核心是他择·无预告。竞争解释预测安全车道足够、效度稳定;本文预测安全车道的效度将被可穿戴设备、微型耳机、代考侵蚀,教育侧会被逼向第三档,次序与反兴奋剂相同——先定时他择,失效后才无预告他择。
三次审计均遵循同一纪律:假设、样本规则、判负条款、不利结果处置与停止规则在读取材料之前写死(附录 A 为预注册原文);材料为公开文件,可复算;结果无论有利不利照抄进正文;代理变量明写。
该审计逼出两件本文原本没有的东西:其一,贝尔法斯特那一页自述可穿戴设备与微型耳机使监考”越来越困难”,其作者估计现有评估的多数可被中等技术水平的新手用 AI 满意完成——本文预测的侵蚀已被安全车道的推行者自己写下,教育侧已站在反兴奋剂 2000 年代中期的位置。其二,悉尼把开放车道默认值从”禁止 AI”改为”允许 AI,除非教师退出”,并要求每个学位在 2025 年底前提交评估计划——自择产物那一格被制度性地放弃了作为学习证据的地位,比本文的目标格判断走得更远;本文据此把目标格第一条签名改写为”AI 使自择产物短期更好,且制度已开始把它移出证据栏”。
代理变量与限制:以”安全车道定义”代理”教育侧证据落点”;六所均为英语世界大学,不含中国高校;一次检索前六位有排序偏差。该审计证明的只是次序命题在这一小片样本上未被推翻。
######## 7.4.1 三种对策的对应读法
审计一还允许把 2023 年以来教育侧的三种对策逐一放进表 2。回考场(安全车道)落在他择·定时·累积格:时刻由校方定但公布,候选人可为之准备,其可准备部分可由生成工具代练;贝尔法斯特那一页自述的侵蚀说明这一格正在重演反兴奋剂赛内检查的失效。进过程(草稿、版本、反思日志)落在自择·累积格:学生决定何时保存一个版本,过程本身可被生成——该支文献自己承认过程材料不能免于伪造。进实习与推荐信(第三方记录)落在自择·累积格的另一侧:实习的时段、项目、汇报由学生与单位协商而定,推荐信在学生请求的时刻写出;它是第三方记的,但记的是时刻由本人定的事件,与 4.5 排除的”第三方”读法同形。三种对策分别对应三家的三种搬动,且分别落在三家已被证明可造的那三处;没有一种落在他择·无预告格。这不是三种对策的设计者疏忽,而是他们与三家站在同一块地面上。
一条预注册之外的发现,照记,并说明它改了什么:文件把 FOQA 与 LOSA 只当作训练大纲与运营政策的反馈数据,从未当作个人的能力证据——这不是疏漏,而是民航行业几十年的明文安排:飞行数据监控按协议去除个人身份、由工会与公司共管、不得用于对个人的惩戒。也就是说,民航早已持有不由飞行员选时刻、不由飞行员之手的逐次航班记录,并且有意不把它归于人名下。这条发现对本文最初的承重物(以时刻归属为唯一维度的”他择存量”)是不利的——按那个版本,民航应当已经拥有毕业生所缺的东西,而它拥有却不用。本文据此把承重物改到表 1b 最后一行:民航持有那一格的两个条件而缺第三个(归己),与反兴奋剂缺”无事入账”、信贷缺”他择”并列。这是一次读取结果之后的改判,按预注册纪律须明写:审计二的三条预测在改判前后都成立,改的不是预测,是预测所服务的命题;改判之后的命题在 7.2 加了第 7 条证伪条件,并在 11.3 加了第三条预测。
代理变量与限制:一份咨询通告是监管者的建议性文件,不等于航空公司实际做法;P1 的”定期评估”是定时他择,与本文核心那一格仍差一档。
教育侧与民航侧停在同一格(他择·定时),两侧的推行者都已自述该格在失效(贝尔法斯特的可穿戴设备;FAA 引用的事故报告);两侧都没有进入无预告档。差别在:民航持有无预告档的存量而不归人,教育侧连存量也没有。这使 7.2 第 2 条的次序命题得到两侧一致的支持,同时把第 6 条存量条件的难点从”有没有”改成了”归不归”。
7.2 第 1 条是本文最贵的一条,两次审计都没有碰它。一个可执行的设计如下,供后续研究或愿意开放数据的机构使用。
这个设计的最便宜版本只需要一家愿意回看自己招聘档案的机构。本文作者未取得这样的数据,故把它写成设计而不是结果。
表 4 四个职业场域的反例搜索
| 场域 | 时刻 | 手 | 记录归谁、记什么 | 是否填满那一格 |
|---|---|---|---|---|
| 会计师事务所同行检查(AICPA) | 他择·定时(三年一轮,日期事先安排) | 他手(外部检查员) | 归事务所而非个人;记”通过/有缺陷/未通过” | 否:差他择·无预告与归人两项 |
| 医师执业再认证(GMC revalidation) | 自择(五年一轮,年度考评材料由医师自行收集) | 自手(支持材料由本人整理) | 归己 | 否:这是表 1b 第一行的职业版 |
| 照护机构无预告检查(CQC) | 他择·无预告 | 他手 | 归机构,公开评级;不归任何个人 | 否:与卫生等级牌同格 |
| 运动员检测历史(USADA 公开页) | 他择(含无预告) | 他手 | 按运动员姓名公开每季度检测次数;不记”结果无异常”,只在有处罚时另列;由机构持有,本人不能携带 | 否,但最近:三个条件占了两个半——差”记无事”与”本人持有”各半 |
判负条款未触发。但第四行必须单独写:美国反兴奋剂机构从 2010 年代起按姓名公开每名运动员每季度被检测的次数,运动员在争议中常引用”我被测过几十次”作为清白证据——这是四个场域里唯一把他择·他手的次数归到个人名下并公开的做法。它没有记”无事”(次数不等于结果),也不由本人持有(页面归机构,不能带到另一个联合会),所以那一格仍是空的;但它说明这一格的填法已经有一半在实践里,且第一个走到这里的,仍然是三家里最早拿走时刻的那一家。7.2 第 7 条继续有效,11.3 预测三的”不算命中”清单据此加一句:仅公开次数不记结果的,不算。
限制:四个场域是作者按”有公开制度文本”选的,不是穷举;每类只读制度文本与公开页面,未查个案。
本节对 2 节回顾的各支逐一给出分界与判定形式;每一位都要说清它在自己领域回答的是哪个问题、为什么它没有吸收本文命题、若它成立而本文不成立会看到什么。
信号理论与筛选理论。 它们要求信号的制造成本与能力负相关,而生成式 AI 使自择产物的制造成本对所有人趋于零。判定形式:若信号理论成立而本文不成立,招聘方应转向更贵的自择产物;若本文成立,应转向不由候选人选时刻的读数,哪怕很便宜。两条预测相反。残障原理同此,其昂贵落在信号本身,本文的可信落在时刻归属。Caplan(2018)不区分信号的时刻归属;若其成立而本文不成立,AI 之后学历的信号价值应不变(成本未变);若本文成立,学历应随其他自择产物一起下跌。
前台与后台(Goffman, 1959)。 后台是空间,且一旦被观察即成前台;本文的他择是时刻归属,不要求看后台——航线检查在前台做,检查员就坐在旁边,它之所以他择,只因这段航线不是飞行员选的。判定形式:若 Goffman 成立,无预告但公开在场的观察应与预告的观察等值;若本文成立,两者不等值,差别可从随后失效率读出。
自动化的反讽(Bainbridge, 1983)。 其结论落在保留技能;本文说残余可造、且残余记的不是缺的那部分,结论落在从哪些时刻读。Casner 等(2014)站在本文一侧。
工作样本测验(Schmidt & Hunter, 1998)。 效度最高的预测指标之一,但它是定时、预告、标准化的——他择·定时档,候选人会为它准备。本文预测 AI 之后标准化工作样本效度下跌而无预告成分不跌;可在下一轮元分析中证伪。
检查博弈。 把不预告当检查者的策略;本文把它当证据的属性并主张累积为被检查者的存量——检查博弈中不存在”被检查者从被检查而无事中获得资产”这一步。判定形式:检查博弈预测检查频率与违规率的关系;本文预测他手无事账与随后被信任程度的关系,后者在检查博弈中没有变量。混沌工程读的是系统,本文读的是人。
卫生等级牌(Jin & Leslie, 2003)。 离本文最近的正面占位者:它已把无预告检查结果累积并公开展示,且证明该存量改变行为。本文未被吸收之处在表 1b 里是一行之差:等级牌落在他择·他手·不归己,本文的承重物在它下面一行。它证明了那一格的三个条件中两个可以同时成立并改变行为;本文说的是第三个条件成立时会出现一类新记录。若第三个条件在任何场域被证明不可成立,本文退化为等级牌制度在人身上的推广建议——7.2 第 7 条正是为此设的。
评估安全(Dawson, 2021)。 它管取样的条件归谁(环境、工具、身份),本文管取样的时刻归谁;两者在”预告的监考”格分开——条件全归校方而时刻公布,按评估安全已安全,按本文仍是他择·定时、可准备。判定形式:若 Dawson 成立,条件受控的预告考试效度在可穿戴设备普及后应不变;若本文成立,它应下跌而无预告成分不跌。
口试与同步核验层(Joughin, 2010;Sotiriadou et al., 2020)。 已在做评估者当场定内容。本文未被吸收之处两处:它把口试当核验作品作者身份的手段(作品仍是证据,口试验真),本文把作品移出证据栏、口试本身成为证据;它不累积——口试无事不留痕,落在表 2 右列。判定形式:若口试支成立,口试成绩应与作品成绩高度相关;若本文成立,两者应在 AI 之后逐年脱钩,幅度可从同一门课的两个分数序列读出。
双车道评估。 分界已在 7.4:它定义的是他择·定时格,本文的核心在第三档。
试用期。 它是用人单位持有的他择·定时读数:时刻由单位定、被雇者不能推迟、期限公布。本文未被它吸收之处在于两点:试用期的结果不可携带(只对该单位有效,不进入任何被雇者可持有的记录),且它以”通过/不通过”记账,无事不累积。判定形式:若试用期已足够,用人单位在 AI 之后应延长试用期而非改招聘环节;若本文成立,用人单位应把可准备的招聘环节替换为现场环节,并开始把现场环节的结果写进候选人可持有的记录。
过程性证据。 AI 时代评估文献的另一支主张以草稿、版本记录、反思日志等”过程性证据”替代终稿(Boud & Molloy, 2013 的延伸;Frontiers in AI, 2026)。这一支与本文同样不把证据落在产物上,但过程记录仍是自择的——学生决定何时保存一个版本、写一条反思;该支文献自己也承认过程材料”不能免于伪造”。按表 2,过程性证据落在自择·累积那一格,与作品集同格,只是更厚。判定形式:若过程性证据支成立,要求提交版本记录应当足以恢复评估效度;若本文成立,版本记录的效度将随生成工具对”生成过程”本身的模拟能力而下跌。
同批相邻研究(本站)。《能力证据债》把债记在证据的数量上,本文记在时刻归属上——补更多自择证据不减此债。《收方工序》答的是怎样给产物打折,本文答的是不折产物、换读数,两者可并存。《终稿之前》把风险记在路径上,本文记在时刻上——手写草稿仍是自择证据。《空签》《弃项》找的是被删除的分支,本文找的是被读取的时刻的归属,无正面重叠。《快,是因为那里已经判过了》解释自择产物为何变快变好,是本文目标格的成因。
他择率、归己率与他手无事账几乎必然会被拿去考核人,故自带三条不可删的条款:(1)它们指的是证据的位置,不是人的价值——他择率为零的人只是没被在他择时刻读过;(2)不得为了把这个数做好看而在任何安全关键岗位安排无预告取样——反兴奋剂的行踪规则有对价、有自愿、有范围,医院、机场、电网里的不预告干扰不是取样而是事故;(3)已按此读数做出不利安排的机构,必须公开其判定”取样时刻由谁定”的编码规则并给出复核通道——一次预告三天的考核算哪一档必须写在规则里。
不得执行:未成年人;任何未自愿进入”检查库”的人;被读者无法拒绝进入的关系(雇佣中的下级对上级)。执行后的补偿:每一次他择读数,无论结果,都应写进被读者可持有的记录——否则它只是监视。
本命题一旦被制度采用,最省事的实现方式有两条,两条都会摧毁它要保护的东西。其一,把”无预告”做成一个可申报的项目——机构宣布自己有无预告制度,而实际时刻通过内部渠道被提前知道;行踪规则的运行史中这正是被反复揭出的漏洞。其二,把他手无事账做成一张证书——一旦它成为可放进简历的纸,被评价者选择何时去考取它,第一个条件(他择)就被第三个条件(归己)吃掉了:归己是这一格最后一个条件,也是最容易反过来毁掉前两个条件的一个。信贷的历史已经演过一次——它最早把无事归己,也最早出现制造无事的市场。作者看不到出口。
没有任何第三方愿意或能够不预告地读你的领域——纯个体创作、自由职业早期、以及 6.1 所说的所有未进检查库的人;成果本身不可能被外力制造的领域——若有一种产物 AI 造不出,那里自择证据仍有效,本文不需要,作者未找到这样的领域但不排除其存在。
他择读数在多数法域都触到两条法律边界。其一,对劳动者的不预告观察受劳动法与个人信息保护法约束:欧盟一般数据保护条例与中国《个人信息保护法》都要求对个人的监测有明确目的、告知与最小必要;行踪规则之所以能运行,靠的是运动员签署的进入检查库协议,这一协议在教育与雇佣场景没有现成对应物。其二,把他择读数写入被读者可持有的记录,涉及记录的归属与更正权:信贷档案有《公平信用报告法》式的争议与更正程序,学业记录有学生隐私法的调阅限制,而”他择存量”作为一种新记录,其争议程序尚不存在。9.1 第三条条款(公开编码规则并给出复核通道)是对第二条边界的最低回应,不是充分回应。本文把这两条边界当作命题的适用前提,而不是待克服的障碍:没有协议与更正程序的他择读数,按 9.2 不得执行。
本文不给处方,但命题若成立,三类行动者各有一件事会变。
大学。成绩单上现有的信息是课程名、学分、等第;按本文,它缺一个字段——每一项评估的取样时刻归属。双车道大学已经在内部区分安全与开放两种评估,把这个区分印到成绩单上是 11.3 预测一押的那一步——它给的是第三个条件(归己)。做了这一步,成绩单就从一份自择证据的清单变成一份混合清单,用人单位第一次能从成绩单上读出他择率。但成绩单只记分数不记”无事”,且安全车道是定时的:即使做了这一步,大学仍停在表 1b 倒数第二行;要进最后一行,还差无预告成分与无事入账,那是预测二与预测三押的。
用人单位。校园招聘流程里可准备的环节(简历、作品集、可预约的面试、公布题型的笔试)在本文命题下效度趋零;能替代它们的不是更难的同类环节,而是候选人不能选时刻的环节——当场给一个真问题、给一段真材料、给一次真的打断。这类环节便宜,但要成为证据必须被记录并留给候选人:一次现场任务无论结果如何都写进候选人可持有的记录,它才是他择存量而不只是一次筛选。
毕业生。自择证据仍然需要——它决定你能否进门;但进门之后能积累的东西只有一种:主动进入有人会不预告地读你的位置。6.2 已说明这首先是机会的分布问题;对个体而言,可做的选择是在同等条件下优先选择带抽查制度的岗位与项目,并要求把那些时刻写进自己的记录。这不是一条励志建议,而是一条会计建议:他手无事账只在三个条件同时被记下的地方存在,而三个条件里毕业生自己能争取的只有最后一个。
三个参照案例是作者选的,选源本身可能带有偏向;三次审计样本极小(六页、一份文件、四类制度文本),只能证明”未被推翻”,不能证明成立;审计一限于英语世界;机制条件(7.2 第 1 条)所需数据本文未取得。5.4 的他择率尚无任何一批真实毕业生样本被计算过。
其一,为什么反兴奋剂在护照失灵后没有像信贷那样出现公开的”制造他择读数”市场?是因为取样由第三方执行吗?若是,教育侧的他择读数一旦由校方执行,会不会立刻出现替考市场?审计二把这个洞挖开了一半:民航与反兴奋剂的差别被写进了表 1b 的第三条归属。没有挖开的另一半是:为什么归己在民航被明令禁止——安全文化的理由是归人会杀死报告;若这个理由对教育与雇佣同样成立(学生与雇员一旦知道无事也入账,会不会为了账而改变在他择时刻的行为),那么他手无事账在设立之日就会开始改变它要读的东西。9.3 把这写成反噬,但本文没有答案。其二,他择存量与”未见异常”的关系:一次他择读数出了异常,应从存量扣除还是另立一栏?三家做法不同(反兴奋剂只记异常,信贷两者都记),本文未裁定。
有一件事实与本文的方向相抵,必须写下:他择取样本身的抓获率极低。世界反兴奋剂机构 2012 年的工作组报告承认,尽管检测数量大幅增加,自 1985 年以来阳性率没有统计学上的改善;挪威反兴奋剂机构 2003–2019 年近五万份样本的违规检出率为 0.44%(Lauritzen, 2023),而以随机应答法估计的用药流行率远高于此。也就是说,即使证据落到了他择时刻,读出来的东西仍然很少。这对本文有两种读法。不利的读法:他择读数并不比自择读数更能分辨,本文的命题只是把一种低效换成另一种。有利的读法:抓获率低说明的是只记异常这一记法的失效——三家里唯一累积无事的信贷,恰恰是唯一不靠抓获率运转的一家;他择存量的价值在累积无事,不在抓到异常。本文倾向第二种读法,但承认第一种没有被排除;7.7 的设计可以分开两者——若无预告档的份数与绩效相关,而无预告档中的异常次数与绩效不相关,则第二种读法成立。
用本文自己的判据给本文定位:这篇论文是一份自择证据。写作时刻是作者选的,提交时是准备好的,他择率为零。它能获得的唯一他择读数是同行评审——评审者在作者不选择的时刻、用作者不选择的标准读它。按本文命题,这份稿子的价值不在它自己写得怎样,而在它经不经得起那一次它不能自己安排的读取;它不能靠再修改一遍提高可信度——修改是自择的。这使本文自己落在表 2 的目标格里,与它批评的作品集同格。再进一步:本文用来推翻共有前提的材料(微剂量促红素不被护照标出)是一份他择读数——那个实验的受试者不选择取样时刻。本文最承重的一步靠的正是它主张的那类证据的两个条件(他择、他手);这不是自封,它意味着若他择·他手的读数不比自择读数更可信,4.3 也就不比三家的立场更可信。而第三个条件本文自己不满足:这篇稿子若通过评审,评审记录归期刊持有,不归作者——本文自己也落在表 1b 倒数第二行。
生成式 AI 时代,大学毕业生的核心竞争力不是他交出来的东西的质量,不是机器替不了的那一小段技能,也不是他被记录得有多厚——三处都可被制造,三家各自的实证材料已经证明。剩下的是三条此前无人当作对象的归属——时刻归谁定、取样之手归谁、记录归谁持有——以及它们张成的八格里那一格四方皆空的位置。竞争力将是落进那一格的记录累积起来的量:由他人之手、在本人不选择的时刻取得、结果为无异常、且记在本人可以带走的账上。四个场域各自持有它的两个条件而无一持有第三个;三家各花了一代人走到自己那两个条件,教育侧可以不必再花一代人。
若 7.2 第 1 条判负——无预告读数与绩效无关——本文会因此学到一件具体的事:分辨力不来自时刻归属,而来自别处,最可能的候选是任务的真实性(真问题与练习题的差别)而非时刻。届时应当检验的是”真任务”轴而非”他择”轴,而三家的参照案例仍然有效,只是它们各自抓住的东西须重新命名。若 7.2 第 2 条判负——有大学一开始就以无预告取样定义安全车道——本文会学到教育侧不必重走反兴奋剂的一代人,次序可以跳,那时应当研究的是为什么这一家能跳而另三家不能。若 11.3 预测三到期未命中,本文学到的是:那一格的第三个条件(归己)在人身上不可成立,民航的去身份与反兴奋剂的只记异常是常态而非例外——那正是 10.2 第二个半个洞的答案,届时本文的承重物退回表 1b 倒数第二行。
预测一:到 2028 年 12 月 31 日,澳大利亚八大集团与英国罗素集团合计三十二所大学中,至少三所公开说明学生的正式成绩记录或成绩单上区分”安全车道”与”开放车道”的评估项目。不算命中:仅在校内学习管理系统用图标标注、不进正式记录的;仅在政策文件承诺而未在记录上实施的;由第三方平台而非校方出具的。若到期未命中,5.5”这一栏将出现”的预测为伪,本文退化为一条评估设计建议。
预测二:到 2029 年 12 月 31 日,上述三十二所大学中,至少五所在校级安全车道定义里加入一项由评估者当场决定内容或时刻的成分(现场追问、即时口试、随机抽取已提交作品的一段要求当场重做)。不算命中:预告题库的口试;由学生选时段的在线监考;单门课程或单个院系已在做的口试(8 节已说明其存在)——必须写进校级安全车道定义。若命中,教育侧正在走反兴奋剂走过的路;若到期不命中而安全车道仍被宣布有效,7.1 的侵蚀预测为伪。
预测三(改判后新增):到 2029 年 12 月 31 日,在任一公开可查的场域出现一类记录,同时满足:取样时刻不由被读者定、由第三方执行、结果为无异常时也入账、且被读者可以调阅并携带到另一机构。不算命中:仅机构内部持有的;只记异常的;被读者可以选择时段的;仅公开检测次数而不记结果的(7.8)。若命中,表 1b 最后一行从此不空,本文的命题得到第一个实例;若到期未命中,7.2 第 7 条不触发,但 5.5”这一格将被填上”的判断降为未决。
0a. American Institute of CPAs (AICPA). *Peer Review Program Standards*(现行版). 0b. Care Quality Commission (CQC). *How we inspect and regulate*(现行版). 0c. General Medical Council (GMC). *Guidance on supporting information for appraisal and revalidation*(现行版). 0d. U.S. Anti-Doping Agency (USADA). *Athlete Test History*(公开数据库,按季度更新). 1. Arrow, K. J. (1973). Higher education as a filter. *Journal of Public Economics*, 2(3), 193–216. 2. Ashenden, M., Gough, C. E., Garnham, A., Gore, C. J., & Sharpe, K. (2011). Current markers of the Athlete Blood Passport do not flag microdose EPO doping. *European Journal of Applied Physiology*, 111, 2307–2314. 3. Avenhaus, R., von Stengel, B., & Zamir, S. (2002). Inspection games. In *Handbook of Game Theory with Economic Applications* (Vol. 3, pp. 1947–1987). Elsevier. 4. Bainbridge, L. (1983). Ironies of automation. *Automatica*, 19(6), 775–779. 5. Basiri, A., Behnam, N., de Rooij, R., Hochstein, L., Kosewski, L., Reynolds, J., & Rosenthal, C. (2016). Chaos engineering. *IEEE Software*, 33(3), 35–41. 5a. Boud, D., & Molloy, E. (2013). Rethinking models of feedback for learning. *Assessment & Evaluation in Higher Education*, 38(6), 698–712. 6. Bureau d’Enquêtes et d’Analyses (BEA). (2012). *Final Report on the accident on 1st June 2009 to the Airbus A330-203, flight AF 447*. Paris. 7. Bridgeman, A., & Liu, D. (2024, July 2). Frequently asked questions about the two-lane approach to assessment in the age of AI. *Teaching@Sydney*. 8. Caplan, B. (2018). *The Case Against Education*. Princeton University Press. 9. Casner, S. M., Geven, R. W., Recker, M. P., & Schooler, J. W. (2014). The retention of manual flying skills in the automated cockpit. *Human Factors*, 56(8), 1506–1516. 10. Consumer Financial Protection Bureau (CFPB). (2015). *Data Point: Credit Invisibles*. Washington, DC. 11. Corbin, T., Dawson, P., & Liu, D. (2025). Talk is cheap: Why structural assessment changes are needed for a time of GenAI. *Assessment & Evaluation in Higher Education*, 1–11. 12. Curtis, G. J. (2025). The two-lane road to hell is paved with good intentions. *Higher Education Research & Development*, 44(8), 2151–2158. 13. Dawson, P. (2021). *Defending Assessment Security in a Digital World*. Routledge. 14. Dresher, M. (1962). *A Sampling Inspection Problem in Arms Control Agreements: A Game-Theoretic Analysis* (RM-2972). RAND. 14a. FAA Performance-based operations Aviation Rulemaking Committee / Commercial Aviation Safety Team (PARC/CAST). (2013). *Operational Use of Flight Path Management Systems*. Washington, DC. 15. Federal Aviation Administration (FAA). (2013). *SAFO 13002: Manual Flight Operations*;(2017). *SAFO 17007: Manual Flight Operations Proficiency*;(2022). *Advisory Circular 120-123: Flightpath Management*. 16. Goffman, E. (1959). *The Presentation of Self in Everyday Life*. Doubleday. 17. Jin, G. Z., & Leslie, P. (2003). The effect of information on product quality: Evidence from restaurant hygiene grade cards. *Quarterly Journal of Economics*, 118(2), 409–451. 18. Joughin, G. (2010). *A Short Guide to Oral Assessment*. Leeds Metropolitan University / University of Wollongong. 19. Kofinas, A., et al. (2025). Can graders distinguish AI-generated from student-authored work in authentic assessment? *Assessment & Evaluation in Higher Education*(在线先发). 20. Lauritzen, F. (2023). Intelligence-based doping control planning improves testing effectiveness. *Drug Testing and Analysis*, 15(4). 21. National Transportation Safety Board (NTSB). (2014). *Descent Below Visual Glidepath and Impact With Seawall, Asiana Airlines Flight 214* (AAR-14/01). Washington, DC. 22. OECD. (2019). *OECD Future of Education and Skills 2030*. Paris. 23. Schmidt, F. L., & Hunter, J. E. (1998). The validity and utility of selection methods in personnel psychology. *Psychological Bulletin*, 124(2), 262–274. 24. Sotiriadou, P., Logan, D., Daly, A., & Guest, R. (2020). The role of authentic assessment to preserve academic integrity and promote skill development and employability. *Studies in Higher Education*, 45(11), 2132–2148. 25. Spence, M. (1973). Job market signaling. *Quarterly Journal of Economics*, 87(3), 355–374. 26. World Anti-Doping Agency (WADA). (2009 及后续版本). *Athlete Biological Passport Operating Guidelines*;*International Standard for Testing and Investigations*. 27. World Economic Forum. (2020). *The Future of Jobs Report 2020*. Geneva. 28. Zahavi, A. (1975). Mate selection—a selection for a handicap. *Journal of Theoretical Biology*, 53(1), 205–214. 29. 站内相邻研究:孔凡鹤《能力证据债》(AI 时代九篇);王德生《收方工序》(2026-08-29);《终稿之前》(2026-09-01);《空签》(2026-08-20);《弃项》(2026-09-01);《快,是因为那里已经判过了》。均见 sdeuniverses.com。
审计一(写于 2026-09-02,读取页面之前):检索词 “two-lane approach assessment secured lane open lane universities”;取前六个大学官方或准官方页面;字段 (a) 监考/到场、(b) 校方定时、(c) 无预告取样;判负:≥2 所以 (c) 定义安全车道 → 次序命题撤回;不利结果照抄;六所读完即停。
审计二(写于 2026-09-02,打开 AC 120-123 之前):P1 出现”定期评估手动飞行熟练度”或同义表述(预期出现);P2 FOQA/LOSA 被列为数据源(预期出现);P3 出现 “unannounced” 或 “no notice”(预期不出现);判负:P1 不出现 → 民航侧命题为伪;P3 出现 → 次序命题为伪;一份文件读完即停。
审计三(写于 2026-09-02,搜索之前):四类记录——AICPA 事务所同行检查、GMC 医师再认证、CQC 无预告检查、USADA 运动员检测历史;每类按时刻/手/账三条件判;判负:任一类三条件同时满足且可携带 → 7.2 第 7 条触发;四类判完即停。
| 页面 | (a) 监考/到场 | (b) 校方定时 | (c) 无预告 | 备注 |
|---|---|---|---|---|
| 悉尼大学(转述页) | 是 | 是 | 否 | 仅允许能通过监考控制 AI 的评估类型;开放车道默认允许 AI |
| 澳大利亚天主教大学 | 是 | 是 | 否 | 安全/开放两车道 |
| 奥克兰大学 | 是 | 是 | 否 | AI 仅在”受控评估”可被限制;2025-11 修订程序 |
| 巴斯大学(两页) | 是 | 是 | 否 | 2026/27 起以封闭/开放取代三色分级 |
| 贝尔法斯特女王大学 | 是 | 是 | 否 | 自述可穿戴设备使监考越来越困难 |
| 检索项 | 命中次数 | 读法 |
|---|---|---|
| “manual flight” | 24 | 手动飞行仍是主题之一 |
| “proficiency” | 38 | 熟练度被反复要求 |
| “evaluat*” | 23 | 含”应被定期评估其手动飞行熟练度” |
| “instructor” | 20 | 教员/检查员考虑事项五处单列 |
| “LOSA” / “FOQA” | 3 / 3 | 均作为训练与政策反馈数据源,无一处作为个人证据 |
| “line check” | 0 | 航线检查未以此名出现 |
| “unannounced” / “no notice” | 0 / 0 | P3 不出现 |
计数由 pdftotext 转换后不区分大小写检索得出;全文 2,112 行。
利益冲突:作者声明无利益冲突。
资助:本研究未获得任何资助。
数据可得性:两次审计所用材料均为公开网页与公开 PDF,检索词、日期与字段规则见附录 A–C,可复算。
伦理:本研究不涉及人类受试者或个人数据。
人工智能使用声明:题目、题型与研究要求由作者给出;三个参照案例的选取、共有前提的提出与推翻、命题、辨别装置、读数、证伪条件、两次预注册审计的设计与执行、以及全文写作,由作者与大语言模型 Claude(Anthropic)协作完成;审计数据取自公开网页,检索词与样本规则在读取结果之前写死。作者对全文内容负责。
版本:第 3.0 版(终稿),2026 年 9 月 2 日。正文约 2.2 万汉字。沿革:1.0(1.34 万字)→1.1(补两位应用领域正主、辨别格改 2×3、增民航侧审计)→2.0(论文体、编码规则、检验设计、相抵事实)→2.1(承重物由”他择存量”改为”他手无事账”,改判来由见 7.5)→3.0(增审计三反例搜索,统稿)。
前五部把发生差从本体一路押送到可信的读数,最后一步是所有制度问题的最后一步:记在谁的账上。《入账之前的技能》守着这一层,材料是一百余年的商业秘密判例——法院是社会中唯一被制度化地要求回答"这项技能属于谁"的机构。
它带来两条其余九章都不供给的东西。第一,入账的本体论:把技能写入任何第三方可复读的载体,不是记录,是触发一次不可回复的归类判定,且结果不由持有者控制——发生差的单向门在记录侧的镜像。第二,载体的二分:账本有记"如何做"的文件载体与记"为谁做"的名单载体,归属规则不同;AI 能吞下全部前者,进不了后者——它不是任何一份在场者名单上的一方。于是全书的制度落点收束在一句话上:技能保值的争夺,已从"能否编码"整体转移到"名单记在谁的账上"。
这一层同时是全书处方最锋利也最危险的地方:先于他人入账、只入重复项、让名单首记于自己账上——三条都可执行,三条也都有反噬。反噬的合流留给第十七章。