专著第 71 号 · 胡志英

第十二章 一份共同的课堂

九章各自写了一份研究设计。分开发表时,那是九份互不相干的方案;装订成册以后,它们暴露出一个事实:九份设计其实都在同一间教室里进行同一件事,只是各自只测自己的那一项。

本章把九份合成一份。合成不是为了省事,是因为九章的合并风险(第十章)只有在同一份数据上才可能被裁决。九份数据分别收集,永远无法回答「七个保真型读数是不是同一个读数」。

一、为什么不做九臂

先排除最直觉的方案。

九臂设计在统计上不可行:要在九个干预臂之间检出中等效应,每臂至少需要三十个班级单元,总量二百七十个班——这不是一个个人研究者能执行的规模,也不是本书的读数所值得的代价。

更重要的是,九臂问错了问题。九臂检验的是「九个机制各自是否存在」;而本书真正需要回答的是「九个读数是否可分」。后者不需要九个干预,它需要同一份数据上九个读数全部被计算,然后看它们的相关结构。

因此本章的设计是:少数几个干预臂,九个读数全算。

二、四臂设计

依据第十一章第六节的三层划分设臂。三层是本书对九格的实质假设,四臂检验的正是这个假设。

A 臂:知识丰富对照。 教师提供更完整的知识讲解、更多例题、更充分的答疑。总时长、反馈次数与教师接触量与其余三臂相等。这一臂的作用是排除「效果只是因为讲得更多」。

B 臂:记录层干预。 要求行动前留下可检验主张、行动中留下过程签名、结果按目标/副作用/条件变化分层记录、证据包附换算规则与不确定度。不改换算规范,不改权限。

C 臂:换算层干预。 在 B 的基础上,加入五类边界的分别登记、载体变形时的删除实验、跨表示时的换算校验。不改权限。

D 臂:位置层干预。 在 C 的基础上,加入权限程序:学生可以正式提出「本题的成立域设错了」;异议进入下一轮的方案集合有明确通道;上一轮被否决的方案与理由必须归档并对后来者开放。

四臂之间是嵌套的(B⊂C⊂D),这是有意的:三层若真如第十一章所说顺序不可颠倒,则 D 优于 C 优于 B 的差距应主要出现在位置层敏感的三个读数(R5 发起权转移、R6 选项集重排、R3 理由继承)上,而记录层敏感的三个读数(R1 双写耦合、R7 共制中介、R8 证据迁移保真)在 B 处即应接近饱和。

这是一条可以落空的预测,也是本设计的主要看点:若三层的读数在四臂上同涨同落,第十一章的三层划分就是错的。

三、九读数如何在同一份数据上全算

同一批盲态编码者,同一份材料,九个读数全部计算。编码时读数只以 R1–R9 出现,不出现构念名(附录二的编码手册为此写成脱离正文可用的形式)。

材料清单八类,四臂完全一致:

1. 行动前的主张与备选记录(含权限与资源,用于判定可达性)

2. 行动中的过程签名(关键判断点、分叉、停止条件)

3. 结果的三层分记(目标结果/路径副作用/条件变化)

4. 修订记录(认知账与行动账,共享证据编号)

5. 载体变形记录(同一任务换材料、换形式、换成员时的对照)

6. 发起位置记录(每轮最先改变问题结构的事件属 K/A/E 哪一源)

7. 传递记录(换人接手时提供了什么:只给步骤/步骤加结果/步骤加理由/理由加失败史)

8. 缺席审计(未观察/未记录/被删除/无法转换/制度性不允许记录,五类分开)

时间安排:第 0 天即时表现;第 3 天无提示重做;第 14 天更换材料、尺度与干扰因素测异境迁移;第 8 周由未参与原任务的第三方只凭证据包复建事件。

四、看数据前写死的三种处置

与第十章的合并规则配套,本章在执行前写死三种结果的处置:

结果甲:四臂在九读数上同涨同落。 判定为「效应只是干预强度」,三层划分被否。不得以「实施不到位」解释。 本书的三层结构撤回,第十一章第六节的顺序建议一并撤回。

结果乙:三层敏感性如预测出现(B 提升记录型读数,C 追加提升换算型,D 追加提升位置型)。 三层划分获得支持,但本书仍须报告七个保真型读数的相关结构——三层成立不等于九章成立,第十章的合并规则独立生效。

结果丙:出现与预测不同的分层(例如 R6 在 B 处即饱和,或 R1 只在 D 处提升)。 按数据重编三层,本书第十一章第六节改写;不得把不合预测的读数归为「测量误差」而剔除。

五、最小可行版

上述四臂需要至少二十四个班级单元与一名全时协调者。对多数实践者不可行。因此给出最小可行版:

只跑 A 与 D 两臂,只算 R5、R6、R3 三个读数,两个班一学期。

选 D 不选 B 的理由已在第十一章第六节:位置层未动时,记录层的改进只会生产更精美的档案。若资源只够做一件事,应当做那件其余两层都依赖的事。

选这三个读数的理由是:它们是三层中位置层最敏感的三个,而且它们是九个读数里唯二不属于保真型的那一类之外、最不容易与其他读数混同的三个——R5 有置换基线,R6 有前后分布距离,R3 有不看原答案的重建测试,三者的编码程序彼此没有共用步骤。

最小可行版无法裁决第十章的合并规则。这一点必须写明:它能检验三层,不能检验九章。

六、三处已知风险

风险一:操纵不纯。 D 臂同时改了权限与程序,而权限的改变会顺带改变课堂气氛、师生关系与学生动机。若 D 优于 C,无法排除「学生更被尊重因而更投入」这一解释。缓解办法是在 C 臂加入一个形式上的异议渠道(可以提,但异议不进入下一轮方案集),使两臂在「被听见」上尽量相当,而只在「异议是否改变下一轮」上不同。这个缓解并不彻底。

风险二:编码者被构念名污染。 九个读数由同一批编码者在同一份材料上计算,编码者极易形成整体印象,使九个读数人为地相关——这恰恰会伪造出第十章的「结果甲」。缓解办法有三:读数只以 R1–R9 出现;九个读数分九轮编码,每轮只编一个,轮次之间间隔不少于三天;每轮材料重新随机排序。即便如此,同一批编码者带来的相关无法完全消除,这是本设计最难处理的一处。

风险三:教师效应。 四臂若由不同教师执行,教师差异会与臂完全混同。可行的处理是每位教师执行两个臂(交叉),但这又引入教师从一个臂学到东西带进另一个臂的问题。本书倾向于交叉设计并报告顺序效应,同时承认这不是一个干净的解决。

七、这份设计尚未执行

本章必须以一句话结束:上述设计一次也没有执行过。

本书的九个新对象、九个读数、九条撤回条件,目前全部处在纸面上。第十章的合并规则、第十一章的三层划分、本章的四臂预测,都还没有接触过一份真实数据。

按本书自己的判据,这意味着本书还不是一个已经完成的知行事件——它只完成了主张与设计,尚未承担后果,因而两本账都还没有被任何真实结果改写过。第十四章会再回到这一点。

← 第十一章 九种认不出来的样子第十三章 这套理论共同的对手 →