本附录可脱离正文单独使用。编码时九个读数改称 R1–R9,隐去构念名,以避免编码者被理论名称提示。
| 代号 | 一句话问法 | 分母的单位 | 必需的条件对照 |
|---|---|---|---|
| R1 | 撤掉那个一直在的东西之后,还能重新说出来吗 | 一次预先定义的扰动事件 | 撤源 vs 不撤源;且撤除特定源 vs 撤除同类条件 |
| R2 | 这次成功,少了那条中间路还成立吗 | 一个基线成功且局部控制合格的跨层试次 | 中介扰动 vs 中介恢复;A/B 端局部能力控制 |
| R3 | 这两样分别都会,合起来还成立吗 | 一对已独立达标的能力 | 联合任务 vs 负荷匹配对照任务 |
| R4 | 当时没用上的那种切法,后来还调得出来吗 | 一个“材料片段 × 备选单位化”探针 | 当前处理 vs 后置线索;且严格无再暴露 |
| R5 | 变成这样以后,还算同一件事吗 | 一条预注册的变形边 | 守恒边 vs 越界边 |
| R6 | 什么都没出现,这算不算一条证据 | 一对同零匹配的配对探针 | 高资格 vs 低资格(仅改一项资格闸) |
| R7 | 这条知识,赶在决定之前到了吗 | 一次知识已独立确认、边界可判的语言事件 | 承诺边界前 vs 边界后;目标线索操纵有效 |
| R8 | 这次改变,写进哪一层了 | 一对来源翻转的偏差事件 | 来源证据 a₁ vs a₂;至少两个候选层的延迟探针 |
| R9 | 这次输入,该改的地方改了、不该改的没动吗 | 一次输入事件的目标域与排除域 | 目标域 vs 至少一个预注册排除域;延迟测试 |
通用编码纪律(九项共同,任一违反则该事件不可用):
1. 判据、边界与配对类型必须在收集数据之前冻结,冻结内容包括语言学理由;
2. 不可判事件单列,不得折算为零,也不得从报告中消失;
3. 分母必须包含失败、拒答、无法分类与设备故障,分别记账;
4. 同一研究中一个读数只能有一个定义,正文、证伪部分与撤回条件必须用同一口径;
5. 每个读数必须与至少一个强近邻指标并列报告(一般水平、总反应时、离线正确率任选其一以上);
6. 结果必须报告二维分布,不得只报平均值——两名学习者可以得到同一个数值而处于完全不同的格;
7. 必须同时报告参与率(多少比例的学习者至少进入过一次分母)与事件集中度;参与率低于预注册水平时,班级层面的读数不得解释为班级能力;
8. 任何教育使用都必须把读数解释为任务位置,不是人的等级。
阈值说明: 各章给出的探索性门槛(R1 0.60、R6 0.70、R7 0.65、R8 目标层 0.10/排除层 0.05、R9 0.10)均为首轮可复算协议,不是自然常数。研究者可在看数据前另行预注册,但揭盲后不得改动,且同一研究内部不得移动。