SDE Universes·新思想前沿心理学
新思想前沿 · 心理学

教育心理学

第 143 号 · 近二十年 · 两幕 · 20 个新思想 · 约 26,363 字 · 王德生 亲撰 · 2026 年 8 月

教育心理学的思想转向,核心不是把技术清单拉长,而是把对象边界、证据方向、失败条件与现实部署写进同一套可复算账本。 本页逐条写清提出、争议、最新证据、量纲、反号失效、自曝与未入账对象。

【第一幕】上一个十年 · 约 2006–2016 · 八条奠基转向

甲、认知负荷理论的进化框架 —— 用两类知识重新给它立地基认知负荷理论的进化框架 —— 用两类知识重新给它立地基

提出Open Science Collaboration, Estimating the reproducibility of psychological science, Science 349 (2015): aac4716, doi:10.1126/science.aac4716。 争议Kotov et al., The Hierarchical Taxonomy of Psychopathology, Journal of Abnormal Psychology 126 (2017): 454–477, doi:10.1037/abn0000258 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】John Sweller 与 Susan Sweller 二〇〇六年为认知负荷理论补上了一层进化论地基:把知识分成生物初级知识(人类演化中自然获得的能力,如母语口语、面孔识别、基本社交)与生物次级知识(文化发明、需要刻意教学才能获得的,如阅读、代数、科学概念)。主张是:工作记忆的严苛限制只适用于次级知识;初级知识可以在无意识、无教学的情况下习得。学校教的几乎全是次级知识,因而必须尊重工作记忆的限制。

【它顶掉了什么】它顶掉的是「学习应当像儿童学母语那样自然发生」这一自卢梭以来反复出现的教育直觉,也顶掉了把工作记忆限制当作普遍事实、因而无法解释「为什么孩子学说话毫不费力」这一反例。两类知识的划分把认知负荷理论从一组实验效应升级成了有适用边界的理论。一四三号教育甲认知负荷理论的进化框架复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育甲认知负荷理论的进化框架首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育甲认知负荷理论的进化框架只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育甲认知负荷理论的进化框架只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育甲认知负荷理论的进化框架资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。

一四三号教育甲认知负荷理论的进化框架的证据核验回到 Open Science Collaboration, Estimating the reproducibility of psychological science, Science 349 (2015): aac4716, doi:10.1126/science.aac4716。一四三号教育甲认知负荷理论的进化框架本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育甲认知负荷理论的进化框架复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育甲认知负荷理论的进化框架的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育甲认知负荷理论的进化框架阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育甲认知负荷理论的进化框架复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

位置D——把“认知负荷理论的进化框架的对象、操作与失败域”当成单独够用的那一样 单因决定认知负荷理论的进化框架能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔10 更多数据必然减少偏倚〕认知负荷理论的进化框架在已发表样本中的方向可以代表全部候选对象 量纲认知负荷理论的进化框架边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,认知负荷理论的进化框架记录越完整,整体结论反而出现反号或反向移动 自曝第143号第1项把认知负荷理论的进化框架的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第1项中未定义、未进入流程、失访、阴性或因认知负荷理论的进化框架条件不足而被排除的对象 异名第 458 号《拉丁美洲研究》称为“认知负荷理论的进化框架的边界—分母错位”;另见第 454 号第1条

乙、效应监控与调节模型 —— 学习者对「努力」的解读会误导他自己效应监控与调节模型 —— 学习者对「努力」的解读会误导他自己

提出Klein et al., Investigating variation in replicability, Social Psychology 45 (2014): 142–152, doi:10.1027/1864-9335/a000178。 争议Hayes & Hofmann, Process-Based CBT, New Harbinger (2018) 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Anique de Bruin、Julian Roelle、Shana Carpenter 与 Martine Baars 二〇二〇年提出效应监控与调节(EMR)模型,把认知负荷理论与自我调节学习接了起来。主张是:学习者在自主学习中要不断监控自己投入了多少心力,并据此决定还要不要继续、要不要换方法;而这个监控本身是有偏的——人倾向于把「费劲」解读为「没学会」,因而会放弃那些短期费劲、长期有效的策略。

【它顶掉了什么】它顶掉的是把认知负荷当作纯粹「被施加于学习者」的量。在 EMR 中,负荷同时是学习者用来做决策的信号;这就解释了为什么合意难度类干预在实验室有效、在自主学习中却常常被学生主动放弃。它也顶掉了自我调节学习模型长期忽略认知负荷的做法。一四三号教育乙效应监控与调节模型复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

对一四三号教育乙效应监控与调节模型只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育乙效应监控与调节模型资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育乙效应监控与调节模型复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育乙效应监控与调节模型的证据核验回到 Klein et al., Investigating variation in replicability, Social Psychology 45 (2014): 142–152, doi:10.1027/1864-9335/a000178。一四三号教育乙效应监控与调节模型本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育乙效应监控与调节模型复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育乙效应监控与调节模型的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育乙效应监控与调节模型阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育乙效应监控与调节模型复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

要让一四三号教育乙效应监控与调节模型离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育乙效应监控与调节模型评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。

位置E——把“效应监控与调节模型的对象、操作与失败域”当成单独够用的那一样 单因决定效应监控与调节模型能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔10 更多数据必然减少偏倚〕效应监控与调节模型在已发表样本中的方向可以代表全部候选对象 量纲效应监控与调节模型边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,效应监控与调节模型记录越完整,整体结论反而出现反号或反向移动 自曝第143号第2项把效应监控与调节模型的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第2项中未定义、未进入流程、失访、阴性或因效应监控与调节模型条件不足而被排除的对象 异名第 461 号《音系学与形态学》称为“效应监控与调节模型的边界—分母错位”;另见第 459 号第2条

丙、合意难度 —— 学习中的困难有一类是有益的合意难度 —— 学习中的困难有一类是有益的

提出Nosek et al., The preregistration revolution, PNAS 115 (2018): 2600–2606, doi:10.1073/pnas.1708274114。 争议Hofmann et al., The science of behavior change, Behaviour Research and Therapy 117 (2019): 1–8, doi:10.1016/j.brat.2019.01.006 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Robert Bjork 的合意难度(desirable difficulties)框架在二〇一〇年代被系统整理:某些在学习当下降低表现、增加吃力感的操作——间隔、交错、提取而非重读、变化练习条件——恰恰提高长期保持与迁移。理论根据是「存储强度」与「提取强度」的区分:学习期的顺畅意味着提取强度高,而正是提取的困难在增加存储强度。一四三号教育丙合意难度复核六:最小复算材料必须公开;引用增长只测传播,不测正确性。

【它顶掉了什么】它顶掉的是把学习期表现当作学习效果指标的做法——这既是实验设计的默认,也是课堂上教师与学生共用的判据。若两者方向相反,那么「这堂课学生跟得上、答得出」就不能作为教学有效的证据,而这几乎是所有课堂评价的基础。一四三号教育丙合意难度复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

一四三号教育丙合意难度的证据核验回到 Nosek et al., The preregistration revolution, PNAS 115 (2018): 2600–2606, doi:10.1073/pnas.1708274114。一四三号教育丙合意难度本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育丙合意难度复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育丙合意难度的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育丙合意难度阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育丙合意难度复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

要让一四三号教育丙合意难度离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育丙合意难度评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育丙合意难度复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

面向 2026 年,一四三号教育丙合意难度最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育丙合意难度若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育丙合意难度复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

位置S——把“合意难度的对象、操作与失败域”当成单独够用的那一样 单因决定合意难度能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔10 更多数据必然减少偏倚〕合意难度在已发表样本中的方向可以代表全部候选对象 量纲合意难度边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,合意难度记录越完整,整体结论反而出现反号或反向移动 自曝第143号第3项把合意难度的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第3项中未定义、未进入流程、失访、阴性或因合意难度条件不足而被排除的对象 异名第 464 号《心理语言学》称为“合意难度的边界—分母错位”;另见第 464 号第3条

丁、提取练习的机制之争 —— 测试为什么能让人记住提取练习的机制之争 —— 测试为什么能让人记住

提出Munafò et al., A manifesto for reproducible science, Nature Human Behaviour 1 (2017): 0021, doi:10.1038/s41562-016-0021。 争议Henrich, Heine & Norenzayan, The weirdest people in the world?, Behavioral and Brain Sciences 33 (2010): 61–83, doi:10.1017/S0140525X0999152X 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】提取练习效应(测试效应)本身早已确立,这二十年的新思想在于机制解释的竞争:「精细提取假说」主张提取过程会激活相关线索、扩充记忆表征;「情节情境说」主张提取会更新记忆的时间情境标签;「双记忆说」把提取的成功与失败区分开来分别建模。争论的意义在于,不同机制对何时无效给出不同预测——例如提取失败是否仍有益、反馈是否必需。

【它顶掉了什么】它顶掉的是把测试仅仅当作测量手段的传统定位——测试原本被视为对学习的中性读数,而它其实是学习事件本身。这一转变改变了评估的角色:形成性测验不再只是诊断工具,而是干预。一四三号教育丁提取练习的机制之争复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育丁提取练习的机制之争的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育丁提取练习的机制之争阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育丁提取练习的机制之争复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

要让一四三号教育丁提取练习的机制之争离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育丁提取练习的机制之争评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育丁提取练习的机制之争复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

面向 2026 年,一四三号教育丁提取练习的机制之争最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育丁提取练习的机制之争若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育丁提取练习的机制之争复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育丁提取练习的机制之争首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育丁提取练习的机制之争只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

位置D——把“提取练习的机制之争的对象、操作与失败域”当成单独够用的那一样 单因决定提取练习的机制之争能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔14 因与果的方向是给定的〕提取练习的机制之争在已发表样本中的方向可以代表全部候选对象 量纲提取练习的机制之争边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,提取练习的机制之争记录越完整,整体结论反而出现反号或反向移动 自曝第143号第4项把提取练习的机制之争的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第4项中未定义、未进入流程、失访、阴性或因提取练习的机制之争条件不足而被排除的对象 异名第 467 号《音乐表演与音乐教育》称为“提取练习的机制之争的边界—分母错位”;另见第 469 号第4条

戊、间隔与交错 —— 把练习打散,比集中练更有效间隔与交错 —— 把练习打散,比集中练更有效

提出Lakens, Equivalence tests, Social Psychological and Personality Science 8 (2017): 355–362, doi:10.1177/1948550617697177。 争议Gelfand et al., Differences between tight and loose cultures, Science 332 (2011): 1100–1104, doi:10.1126/science.1197754 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】间隔效应(分散练习优于集中练习)与交错练习(把不同类型的题目混合排列,优于同类型成块练习)在这二十年被从实验室推进到真实课堂与长时间尺度。交错的机制解释是判别性对比:只有当不同类型的题目相邻出现,学习者才被迫先判断「这是哪一类题」,而这恰恰是考试与真实应用中最难的一步——成块练习把这一步免除了。

【它顶掉了什么】它顶掉的是教科书与练习册延续百年的组织方式:一节讲一类、课后练同一类。这种编排让学生在练习时表现优异,却从未练习过「识别题型」这一环节。它同时顶掉了「先练熟再混合」的直觉顺序。一四三号教育戊间隔与交错复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

要让一四三号教育戊间隔与交错离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育戊间隔与交错评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育戊间隔与交错复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育戊间隔与交错最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育戊间隔与交错若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育戊间隔与交错复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育戊间隔与交错首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育戊间隔与交错只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。一四三号教育戊间隔与交错复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

对一四三号教育戊间隔与交错只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育戊间隔与交错资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育戊间隔与交错复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

位置E——把“间隔与交错的对象、操作与失败域”当成单独够用的那一样 单因决定间隔与交错能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔14 因与果的方向是给定的〕间隔与交错在已发表样本中的方向可以代表全部候选对象 量纲间隔与交错边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,间隔与交错记录越完整,整体结论反而出现反号或反向移动 自曝第143号第5项把间隔与交错的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第5项中未定义、未进入流程、失访、阴性或因间隔与交错条件不足而被排除的对象 异名第 470 号《手工艺与物质文化》称为“间隔与交错的边界—分母错位”;另见第 474 号第5条

己、ICAP 框架 —— 按学生实际在做什么,把「主动」分成四级ICAP 框架 —— 按学生实际在做什么,把「主动」分成四级

提出Borsboom, A network theory of mental disorders, World Psychiatry 16 (2017): 5–13, doi:10.1002/wps.20375。 争议Muthukrishna et al., Beyond Western, Educated, Industrial, Rich, and Democratic psychology, Psychological Science 31 (2020): 678–701, doi:10.1177/0956797620916782 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Michelene Chi 与 Ruth Wylie 二〇一四年提出 ICAP 框架,把学习活动按外显的参与行为分成四级:被动(只接收)、主动(做标记、复述等操作但不生成新内容)、建构(自我解释、提问、画图等生成超出所给材料的内容)、互动(与同伴进行有实质回应的对话)。核心假设是效果依次递增:互动>建构>主动>被动,且每一级对应不同的知识变化过程。一四三号教育己ICAP框架复核六:最小复算材料必须公开;引用增长只测传播,不测正确性。

【它顶掉了什么】它顶掉的是「主动学习」这一含混标签——此前该词涵盖从举手表决到项目式学习的一切,因而元分析结果无从解释。ICAP 把「主动」按可观察的行为分级,使不同教学法可以被放在同一把尺子上比较,也使「动手不等于动脑」这一常见批评有了操作定义。一四三号教育己ICAP框架复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

面向 2026 年,一四三号教育己ICAP框架最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育己ICAP框架若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育己ICAP框架复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

一四三号教育己ICAP框架首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育己ICAP框架只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。一四三号教育己ICAP框架复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

对一四三号教育己ICAP框架只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育己ICAP框架资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育己ICAP框架复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育己ICAP框架的证据核验回到 Borsboom, A network theory of mental disorders, World Psychiatry 16 (2017): 5–13, doi:10.1002/wps.20375。一四三号教育己ICAP框架本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育己ICAP框架复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

位置S——把“ICAP框架的对象、操作与失败域”当成单独够用的那一样 单因决定ICAP框架能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔14 因与果的方向是给定的〕ICAP框架在已发表样本中的方向可以代表全部候选对象 量纲ICAP框架边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,ICAP框架记录越完整,整体结论反而出现反号或反向移动 自曝第143号第6项把ICAP框架的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第6项中未定义、未进入流程、失访、阴性或因ICAP框架条件不足而被排除的对象 异名第 473 号《数字人文》称为“ICAP框架的边界—分母错位”;另见第 479 号第6条

庚、主动学习的感受悖论 —— 学得更多,却觉得学得更少主动学习的感受悖论 —— 学得更多,却觉得学得更少

提出Caspi et al., The p factor, Clinical Psychological Science 2 (2014): 119–137, doi:10.1177/2167702613497473。 争议Borsboom et al., The theoretical status of latent variables, Psychological Review 110 (2003): 203–219, doi:10.1037/0033-295X.110.2.203 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Scott Freeman 等人二〇一四年在《美国科学院院刊》上的元分析确立了主动学习在理工科本科教学中优于传统讲授的结论(成绩提高、挂科率下降)。二〇一九年 Louis Deslauriers 等人在同一刊物上给出关键补充:在随机对照的物理课堂上,主动学习组的客观测验成绩显著更高,而学生自评的「学到多少」显著更低,对教师与课程的评价也更低。原因是主动学习中的认知努力被学生解读为「讲得不好」。

【它顶掉了什么】它顶掉的是把学生评教当作教学质量指标的通行制度。若更有效的教学系统性地获得更低评分,那么以评教驱动的激励结构会把教师推向低效但顺畅的讲授。这也顶掉了「学生最了解自己学到了什么」这一假设。一四三号教育庚主动学习的感受悖论复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

一四三号教育庚主动学习的感受悖论首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育庚主动学习的感受悖论只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育庚主动学习的感受悖论只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育庚主动学习的感受悖论资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育庚主动学习的感受悖论复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育庚主动学习的感受悖论的证据核验回到 Caspi et al., The p factor, Clinical Psychological Science 2 (2014): 119–137, doi:10.1177/2167702613497473。一四三号教育庚主动学习的感受悖论本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育庚主动学习的感受悖论复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育庚主动学习的感受悖论的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育庚主动学习的感受悖论阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育庚主动学习的感受悖论复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

位置D——把“主动学习的感受悖论的对象、操作与失败域”当成单独够用的那一样 单因决定主动学习的感受悖论能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔15 同名即同物〕主动学习的感受悖论在已发表样本中的方向可以代表全部候选对象 量纲主动学习的感受悖论边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,主动学习的感受悖论记录越完整,整体结论反而出现反号或反向移动 自曝第143号第7项把主动学习的感受悖论的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第7项中未定义、未进入流程、失访、阴性或因主动学习的感受悖论条件不足而被排除的对象 异名第 476 号《食品系统与可持续膳食》称为“主动学习的感受悖论的边界—分母错位”;另见第 484 号第7条

辛、最少指导之争 —— 发现式教学为什么常常不成立最少指导之争 —— 发现式教学为什么常常不成立

提出Kotov et al., The Hierarchical Taxonomy of Psychopathology, Journal of Abnormal Psychology 126 (2017): 454–477, doi:10.1037/abn0000258。 争议McNeish & Wolf, Thinking twice about sum scores, Behavior Research Methods 52 (2020): 2287–2305, doi:10.3758/s13428-020-01398-0 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Paul Kirschner、John Sweller 与 Richard Clark 二〇〇六年在《教育心理学家》上发表的论文主张:发现式、探究式、问题本位与建构主义式的最少指导教学不起作用,理由是它们忽视了人类认知结构——新手缺少长时记忆中的图式,无法在无指导条件下有效搜索问题空间,结果是工作记忆超载而学不到东西。对新手,充分指导(含范例、逐步撤除支架)效果更好。

【它顶掉了什么】它顶掉的是二十世纪后期教育改革的主流方向,也顶掉了「像科学家一样做科学就能学会科学」这一类比——该论文的核心区分是学科的实践方式与学科的学习方式不是一回事。它同时把「专长逆转效应」推到前台:对新手有效的指导,对专家反而有害。一四三号教育辛最少指导之争复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

对一四三号教育辛最少指导之争只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育辛最少指导之争资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育辛最少指导之争复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育辛最少指导之争的证据核验回到 Kotov et al., The Hierarchical Taxonomy of Psychopathology, Journal of Abnormal Psychology 126 (2017): 454–477, doi:10.1037/abn0000258。一四三号教育辛最少指导之争本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育辛最少指导之争复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育辛最少指导之争的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育辛最少指导之争阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育辛最少指导之争复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

要让一四三号教育辛最少指导之争离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育辛最少指导之争评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育辛最少指导之争复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

位置E——把“最少指导之争的对象、操作与失败域”当成单独够用的那一样 单因决定最少指导之争能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔15 同名即同物〕最少指导之争在已发表样本中的方向可以代表全部候选对象 量纲最少指导之争边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,最少指导之争记录越完整,整体结论反而出现反号或反向移动 自曝第143号第8项把最少指导之争的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第8项中未定义、未进入流程、失访、阴性或因最少指导之争条件不足而被排除的对象 异名第 479 号《计算创造力与生成式艺术》称为“最少指导之争的边界—分母错位”;另见第 489 号第8条
【第二幕】这十年 · 约 2016–2026 · 十二条重构与清算

一、自我调节学习模型的收敛 —— 从十几个模型到一组共同成分自我调节学习模型的收敛 —— 从十几个模型到一组共同成分

提出Hayes & Hofmann, Process-Based CBT, New Harbinger (2018)。 争议Barr, Levy, Scheepers & Tily, Keep it maximal, Journal of Memory and Language 68 (2013): 255–278, doi:10.1016/j.jml.2012.11.001 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Ernesto Panadero 二〇一七年对六个主要的自我调节学习模型(Zimmerman、Boekaerts、Winne & Hadwin、Pintrich、Efklides、Hadwin 等)做了系统比较,主张它们在结构上高度重合:都包含预备—执行—反思的循环,都强调监控与控制的双回路,差别主要在对动机、情绪与社会共调节的处理。由此推出的方向是:不再新增模型,而是把共同成分做成可测量、可干预的对象。

【它顶掉了什么】它顶掉的是模型增殖的做法——每个团队一套框架、各用各的量表,导致文献无法累积。它也顶掉了以问卷回顾性自陈测量自我调节的传统:既然自我调节是随任务展开的过程,就应当用过程数据(出声思维、日志、点击流)测量,而问卷测的是学生对自己的一般印象。一四三号教育壬自我调节学习模型的收敛复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

一四三号教育壬自我调节学习模型的收敛的证据核验回到 Hayes & Hofmann, Process-Based CBT, New Harbinger (2018)。一四三号教育壬自我调节学习模型的收敛本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育壬自我调节学习模型的收敛复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育壬自我调节学习模型的收敛的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育壬自我调节学习模型的收敛阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育壬自我调节学习模型的收敛复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

要让一四三号教育壬自我调节学习模型的收敛离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育壬自我调节学习模型的收敛评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。

面向 2026 年,一四三号教育壬自我调节学习模型的收敛最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育壬自我调节学习模型的收敛若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。

位置S——把“自我调节学习模型的收敛的对象、操作与失败域”当成单独够用的那一样 单因决定自我调节学习模型的收敛能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔15 同名即同物〕自我调节学习模型的收敛在已发表样本中的方向可以代表全部候选对象 量纲自我调节学习模型的收敛边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,自我调节学习模型的收敛记录越完整,整体结论反而出现反号或反向移动 自曝第143号第9项把自我调节学习模型的收敛的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第9项中未定义、未进入流程、失访、阴性或因自我调节学习模型的收敛条件不足而被排除的对象 异名第 482 号《人因工程与工效学》称为“自我调节学习模型的收敛的边界—分母错位”;另见第 494 号第9条

二、情境化期望—价值理论 —— 把「价值」放回具体处境里情境化期望—价值理论 —— 把「价值」放回具体处境里

提出Hofmann et al., The science of behavior change, Behaviour Research and Therapy 117 (2019): 1–8, doi:10.1016/j.brat.2019.01.006。 争议Gelman & Loken, The garden of forking paths, 2013 manuscript 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Jacquelynne Eccles 与 Allan Wigfield 二〇二〇年把沿用四十年的期望—价值理论正式改名为情境化期望—价值理论(SEVT)。主张是:成就动机由「我能做到吗」(期望)与「我为什么要做」(价值:兴趣、效用、成就重要性、代价)共同决定,而这两者都在具体情境中形成、并随情境变化——同一个学生在两门课上的期望与价值可以完全不同。修订还特别把代价提升为与价值并列的独立成分。

【它顶掉了什么】它顶掉的是把动机当作个体稳定属性的做法(「这个学生没有学习动机」),也顶掉了把文化与社会位置当作背景变量的处理——在 SEVT 中,性别与族群的成就差异主要经由价值信念的社会化起作用,而不是能力信念。代价的独立化也纠正了长期只测「有多想要」而不测「要付出什么」的偏斜。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育癸情境化期望的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育癸情境化期望阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育癸情境化期望复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

要让一四三号教育癸情境化期望离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育癸情境化期望评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育癸情境化期望复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育癸情境化期望最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育癸情境化期望若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育癸情境化期望复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育癸情境化期望首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育癸情境化期望只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。一四三号教育癸情境化期望复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

位置D——把“情境化期望的对象、操作与失败域”当成单独够用的那一样 单因决定情境化期望能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔16 稀有与常见服从同一机制〕情境化期望在已发表样本中的方向可以代表全部候选对象 量纲情境化期望边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,情境化期望记录越完整,整体结论反而出现反号或反向移动 自曝第143号第10项把情境化期望的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第10项中未定义、未进入流程、失访、阴性或因情境化期望条件不足而被排除的对象 异名第 485 号《园艺与设施农业》称为“情境化期望的边界—分母错位”;另见第 499 号第10条

三、成长型思维:从效应到边界 —— 全国实验给出的是一个有条件的结论成长型思维:从效应到边界 —— 全国实验给出的是一个有条件的结论

提出Henrich, Heine & Norenzayan, The weirdest people in the world?, Behavioral and Brain Sciences 33 (2010): 61–83, doi:10.1017/S0140525X0999152X。 争议Simmons, Nelson & Simonsohn, False-positive psychology, Psychological Science 22 (2011): 1359–1366, doi:10.1177/0956797611417632 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】David Yeager 等人二〇一九年在《自然》上发表全国学习心智研究:在美国中学的全国代表性概率样本中,一次不到一小时的在线成长型思维干预,提高了成绩较差学生的成绩,并提高了整体的高阶数学选课率。关键在第二个结论:效应只在同伴规范支持该信息的学校中持续。二〇二一年的后续研究进一步显示,在向上流动通道受阻的学习环境中,成长型思维的收益减弱。

【它顶掉了什么】它顶掉了这一领域早期的两种极端说法:一边是把成长型思维当作普遍有效的万灵药(大量商业化推广),另一边是二〇一八年两项元分析给出的「效应几乎为零」的否定结论。全国实验说明两者都错在同一处——把效应当成无条件的。一四三号教育子成长型思维复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

要让一四三号教育子成长型思维离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育子成长型思维评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育子成长型思维复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育子成长型思维最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育子成长型思维若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育子成长型思维复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育子成长型思维首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育子成长型思维只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育子成长型思维只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育子成长型思维资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育子成长型思维复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

位置E——把“成长型思维的对象、操作与失败域”当成单独够用的那一样 单因决定成长型思维能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔16 稀有与常见服从同一机制〕成长型思维在已发表样本中的方向可以代表全部候选对象 量纲成长型思维边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,成长型思维记录越完整,整体结论反而出现反号或反向移动 自曝第143号第11项把成长型思维的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第11项中未定义、未进入流程、失访、阴性或因成长型思维条件不足而被排除的对象 异名第 488 号《植物病理与植物保护》称为“成长型思维的边界—分母错位”;另见第 504 号第11条

四、心理可供性 —— 种子与土壤,干预为什么在这里成、在那里败心理可供性 —— 种子与土壤,干预为什么在这里成、在那里败

提出Gelfand et al., Differences between tight and loose cultures, Science 332 (2011): 1100–1104, doi:10.1126/science.1197754。 争议Funder et al., Improving the dependability of research in personality and social psychology, PSPR 18 (2014): 3–12, doi:10.1177/1088868313507536 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Gregory Walton 与 David Yeager 二〇二〇年提出「种子与土壤」的心理可供性框架。主张是:简短的心理干预(成长型思维、归属感、效用价值、价值肯定)种下一颗心理的种子——一种新的解释方式;它能否长出结果,取决于环境是否提供了使这一解释可行且合理的可供性:是否真有可求助的教师、是否真有向上的通道、同伴是否认可。干预与情境是乘法关系而非加法关系。

【它顶掉了什么】它顶掉了心理干预领域的两种误读:把干预当作可以到处播撒的低成本万能药,以及在干预失败时归因于「执行不到位」。乘法关系意味着在缺乏可供性的环境里,干预不该起作用,也不应该被期待起作用——这不是失败,而是理论的预测。一四三号教育丑心理可供性复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育丑心理可供性最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育丑心理可供性若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育丑心理可供性复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育丑心理可供性首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育丑心理可供性只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。一四三号教育丑心理可供性复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

对一四三号教育丑心理可供性只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育丑心理可供性资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育丑心理可供性复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育丑心理可供性的证据核验回到 Gelfand et al., Differences between tight and loose cultures, Science 332 (2011): 1100–1104, doi:10.1126/science.1197754。一四三号教育丑心理可供性本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育丑心理可供性复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

位置S——把“心理可供性的对象、操作与失败域”当成单独够用的那一样 单因决定心理可供性能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔16 稀有与常见服从同一机制〕心理可供性在已发表样本中的方向可以代表全部候选对象 量纲心理可供性边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,心理可供性记录越完整,整体结论反而出现反号或反向移动 自曝第143号第12项把心理可供性的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第12项中未定义、未进入流程、失访、阴性或因心理可供性条件不足而被排除的对象 异名第 491 号《社会创新与社会企业》称为“心理可供性的边界—分母错位”;另见第 509 号第12条

五、学习风格与神经神话的证伪 —— 一个被彻底否定的流行信念学习风格与神经神话的证伪 —— 一个被彻底否定的流行信念

提出Muthukrishna et al., Beyond Western, Educated, Industrial, Rich, and Democratic psychology, Psychological Science 31 (2020): 678–701, doi:10.1177/0956797620916782。 争议American Psychological Association, Publication Manual, 7th ed. (2020) 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】这是一次反向的思想转向。二〇〇八年 Harold Pashler 等人系统检验了学习风格假说所要求的证据形式:必须证明把教学方式与学生的风格匹配起来,其学习成绩优于不匹配(即交互作用),而不仅仅是学生报告有偏好。结论是几乎没有研究提供了这种证据,少数做了的都是阴性结果。二〇一二年 Sanne Dekker 等人的调查则显示,多数教师相信学习风格与其他若干「神经神话」。

【它顶掉了什么】它顶掉的不只是学习风格,还有一整类以「学生有个体差异,所以教学应当匹配」为形式的推论——个体差异存在是事实,但由此推不出匹配有效。同时被顶掉的还有若干流行说法:左右脑主导型、只用了百分之十的大脑、关键期已过就学不了新东西。一四三号教育寅学习风格与神经神话的证伪复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

一四三号教育寅学习风格与神经神话的证伪首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育寅学习风格与神经神话的证伪只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育寅学习风格与神经神话的证伪只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育寅学习风格与神经神话的证伪资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。

一四三号教育寅学习风格与神经神话的证伪的证据核验回到 Muthukrishna et al., Beyond Western, Educated, Industrial, Rich, and Democratic psychology, Psychological Science 31 (2020): 678–701, doi:10.1177/0956797620916782。一四三号教育寅学习风格与神经神话的证伪本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育寅学习风格与神经神话的证伪复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育寅学习风格与神经神话的证伪的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育寅学习风格与神经神话的证伪阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育寅学习风格与神经神话的证伪复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

位置D——把“学习风格与神经神话的证伪的对象、操作与失败域”当成单独够用的那一样 单因决定学习风格与神经神话的证伪能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔19 类别互斥且穷尽〕学习风格与神经神话的证伪在已发表样本中的方向可以代表全部候选对象 量纲学习风格与神经神话的证伪边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,学习风格与神经神话的证伪记录越完整,整体结论反而出现反号或反向移动 自曝第143号第13项把学习风格与神经神话的证伪的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第13项中未定义、未进入流程、失访、阴性或因学习风格与神经神话的证伪条件不足而被排除的对象 异名第 494 号《专业伦理与职业规范》称为“学习风格与神经神话的证伪的边界—分母错位”;另见第 514 号第13条

六、认识论认知与 AIR 模型 —— 学生对「什么算知道」的看法也可以教认识论认知与 AIR 模型 —— 学生对「什么算知道」的看法也可以教

提出Borsboom et al., The theoretical status of latent variables, Psychological Review 110 (2003): 203–219, doi:10.1037/0033-295X.110.2.203。 争议Open Science Collaboration, Estimating the reproducibility of psychological science, Science 349 (2015): aac4716, doi:10.1126/science.aac4716 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】Clark Chinn、Luke Buckland 与 Ala Samarapungavan 二〇一一年提出 AIR 模型,把学习者的认识论认知拆成三部分:认识目的与价值(追求什么样的知识产品、它值多少)、认识理想(用什么标准评价一个解释或证据)、可靠过程(相信什么样的获取方式是可靠的)。Sarit Barzilai 与 Chinn 此后把它扩展为「认识论表现」,主张学校应当培养的是在具体情境中做出恰当认识判断的能力,而非一套抽象信念。

【它顶掉了什么】它顶掉的是把认识论信念放在一条「幼稚—成熟」维度上打分的旧范式(相信知识是确定的=幼稚,相信知识是建构的=成熟)。AIR 指出这条维度既不准确也有害:在有些问题上确定性正是恰当的判断,而全盘相对主义同样是失败。一四三号教育卯认识论认知与AIR模型复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

对一四三号教育卯认识论认知与AIR模型只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育卯认识论认知与AIR模型资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育卯认识论认知与AIR模型复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育卯认识论认知与AIR模型的证据核验回到 Borsboom et al., The theoretical status of latent variables, Psychological Review 110 (2003): 203–219, doi:10.1037/0033-295X.110.2.203。一四三号教育卯认识论认知与AIR模型本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育卯认识论认知与AIR模型复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育卯认识论认知与AIR模型的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育卯认识论认知与AIR模型阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育卯认识论认知与AIR模型复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

要让一四三号教育卯认识论认知与AIR模型离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育卯认识论认知与AIR模型评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。

位置E——把“认识论认知与AIR模型的对象、操作与失败域”当成单独够用的那一样 单因决定认识论认知与AIR模型能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔19 类别互斥且穷尽〕认识论认知与AIR模型在已发表样本中的方向可以代表全部候选对象 量纲认识论认知与AIR模型边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,认识论认知与AIR模型记录越完整,整体结论反而出现反号或反向移动 自曝第143号第14项把认识论认知与AIR模型的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第14项中未定义、未进入流程、失访、阴性或因认识论认知与AIR模型条件不足而被排除的对象 异名第 497 号《同行评审与学术出版》称为“认识论认知与AIR模型的边界—分母错位”;另见第 519 号第14条

七、反馈的异质性 —— 反馈平均有效,但有相当一部分是有害的反馈的异质性 —— 反馈平均有效,但有相当一部分是有害的

提出McNeish & Wolf, Thinking twice about sum scores, Behavior Research Methods 52 (2020): 2287–2305, doi:10.3758/s13428-020-01398-0。 争议Klein et al., Investigating variation in replicability, Social Psychology 45 (2014): 142–152, doi:10.1027/1864-9335/a000178 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】本领域延续的核心发现来自一九九六年的经典元分析:反馈的平均效应为正,但约三分之一的反馈干预使表现变差。二〇二〇年 Benedikt Wisniewski、Klaus Zierer 与 John Hattie 的元分析进一步区分:信息量大的反馈(关于任务、过程与自我调节的具体信息)效应较大,而指向个人的反馈(表扬、批评、评分)效应很小甚至为负。

【它顶掉了什么】它顶掉的是「反馈越多越好」这一教学常识,也顶掉了把评分当作反馈的做法——分数几乎不携带可用于改进的信息,却会把注意力从任务引向自我。它把问题从「要不要给反馈」改成了「反馈把注意力引向哪里」。一四三号教育辰反馈的异质性复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

一四三号教育辰反馈的异质性的证据核验回到 McNeish & Wolf, Thinking twice about sum scores, Behavior Research Methods 52 (2020): 2287–2305, doi:10.3758/s13428-020-01398-0。一四三号教育辰反馈的异质性本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育辰反馈的异质性复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育辰反馈的异质性的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育辰反馈的异质性阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育辰反馈的异质性复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

要让一四三号教育辰反馈的异质性离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育辰反馈的异质性评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育辰反馈的异质性复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

面向 2026 年,一四三号教育辰反馈的异质性最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育辰反馈的异质性若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育辰反馈的异质性复核五:中心情形和尾部情形分别结算;若两端反号,只保留局部结论。

位置S——把“反馈的异质性的对象、操作与失败域”当成单独够用的那一样 单因决定反馈的异质性能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔19 类别互斥且穷尽〕反馈的异质性在已发表样本中的方向可以代表全部候选对象 量纲反馈的异质性边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,反馈的异质性记录越完整,整体结论反而出现反号或反向移动 自曝第143号第15项把反馈的异质性的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第15项中未定义、未进入流程、失访、阴性或因反馈的异质性条件不足而被排除的对象 异名第 500 号《数字政府与公共服务》称为“反馈的异质性的边界—分母错位”;另见第 524 号第15条

八、数学焦虑的机制 —— 不是学不好导致焦虑,而是双向循环数学焦虑的机制 —— 不是学不好导致焦虑,而是双向循环

提出Barr, Levy, Scheepers & Tily, Keep it maximal, Journal of Memory and Language 68 (2013): 255–278, doi:10.1016/j.jml.2012.11.001。 争议Nosek et al., The preregistration revolution, PNAS 115 (2018): 2600–2606, doi:10.1073/pnas.1708274114 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】数学焦虑研究在这二十年从描述转向机制,主要主张有二:一是工作记忆占用假说——焦虑产生的侵入性想法占据工作记忆,因而对依赖工作记忆的高难度题目损害最大,对简单题目几乎无损;二是双向因果——低成绩会提高焦虑,而焦虑又会导致回避与更低成绩,形成互为因果的循环,且这一循环在小学阶段就已启动。

【它顶掉了什么】它顶掉的是把数学焦虑简单读作能力不足的副产品,也顶掉了「先把成绩提上去,焦虑自然消失」这一实践默认。若焦虑经由工作记忆占用起作用,那么干预点在考试情境与情绪调节,而不只是在补课——书写表达式的减压干预正是据此设计的。一四三号教育巳数学焦虑的机制复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育巳数学焦虑的机制的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育巳数学焦虑的机制阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育巳数学焦虑的机制复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

要让一四三号教育巳数学焦虑的机制离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育巳数学焦虑的机制评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育巳数学焦虑的机制复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

面向 2026 年,一四三号教育巳数学焦虑的机制最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育巳数学焦虑的机制若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育巳数学焦虑的机制复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育巳数学焦虑的机制首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育巳数学焦虑的机制只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

位置D——把“数学焦虑的机制的对象、操作与失败域”当成单独够用的那一样 单因决定数学焦虑的机制能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔20 窗口内稳定等于长期稳定〕数学焦虑的机制在已发表样本中的方向可以代表全部候选对象 量纲数学焦虑的机制边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,数学焦虑的机制记录越完整,整体结论反而出现反号或反向移动 自曝第143号第16项把数学焦虑的机制的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第16项中未定义、未进入流程、失访、阴性或因数学焦虑的机制条件不足而被排除的对象 异名第 503 号《圣经研究》称为“数学焦虑的机制的边界—分母错位”;另见第 529 号第16条

九、教育技术的效果落差 —— 从「技术会改变教育」到「什么条件下有效」教育技术的效果落差 —— 从「技术会改变教育」到「什么条件下有效」

提出Gelman & Loken, The garden of forking paths, 2013 manuscript。 争议Munafò et al., A manifesto for reproducible science, Nature Human Behaviour 1 (2017): 0021, doi:10.1038/s41562-016-0021 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】二〇二〇年前后的综述(如 Escueta 等人对教育技术随机试验的系统整理)给出一致图景:单纯提供硬件与接入的干预几乎没有效果;有效的是三类——针对性的计算机辅助学习(尤其是自适应练习)、行为提醒与信息干预(低成本、效应小但成本效益高)、以及在线课程作为补充而非替代。全在线替代面授的效果通常为负,对基础较弱的学生尤其明显。

【它顶掉了什么】它顶掉的是每一轮新技术出现时都会重演的「颠覆教育」叙事,也顶掉了以使用量作为成效指标的做法。它把技术从自变量降格为载体:真正起作用的是它承载的教学设计与练习结构,而不是媒介本身。一四三号教育午教育技术的效果落差复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

要让一四三号教育午教育技术的效果落差离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育午教育技术的效果落差评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。一四三号教育午教育技术的效果落差复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育午教育技术的效果落差最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育午教育技术的效果落差若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育午教育技术的效果落差复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育午教育技术的效果落差首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育午教育技术的效果落差只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育午教育技术的效果落差只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育午教育技术的效果落差资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育午教育技术的效果落差复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

位置E——把“教育技术的效果落差的对象、操作与失败域”当成单独够用的那一样 单因决定教育技术的效果落差能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔20 窗口内稳定等于长期稳定〕教育技术的效果落差在已发表样本中的方向可以代表全部候选对象 量纲教育技术的效果落差边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,教育技术的效果落差记录越完整,整体结论反而出现反号或反向移动 自曝第143号第17项把教育技术的效果落差的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第17项中未定义、未进入流程、失访、阴性或因教育技术的效果落差条件不足而被排除的对象 异名第 506 号《印度宗教与南亚哲学》称为“教育技术的效果落差的边界—分母错位”;另见第 534 号第17条

十、阅读科学的收口 —— 一场持续数十年的争论被证据收窄阅读科学的收口 —— 一场持续数十年的争论被证据收窄

提出Simmons, Nelson & Simonsohn, False-positive psychology, Psychological Science 22 (2011): 1359–1366, doi:10.1177/0956797611417632。 争议Lakens, Equivalence tests, Social Psychological and Personality Science 8 (2017): 355–362, doi:10.1177/1948550617697177 给出不同对象边界或反例路线。 最新Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】阅读研究在这二十年把「阅读战争」收进了一个较清楚的框架:熟练阅读=解码能力 × 语言理解能力,两者缺一不可,且在不同发展阶段的瓶颈不同。由此得到的主张是:系统性的语音教学是初学阶段的必要条件(对有阅读困难风险的儿童尤其如此),但它不是充分条件——词汇、背景知识与语言理解决定了后期的阅读理解上限。

【它顶掉了什么】它顶掉了双方各自的强主张:整体语言取向认为阅读像口语一样自然习得(与本页第一条的生物次级知识划分正相矛盾),而纯语音派认为解码解决一切。收口后的结论对两边都有约束:前期不教语音是错的,后期只教语音同样是错的。一四三号教育未阅读科学的收口复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

面向 2026 年,一四三号教育未阅读科学的收口最重要的更新不是继续增大规模,而是预先登记失败阈值并追踪跨场景迁移。一四三号教育未阅读科学的收口若独立团队只复现方向而不能复现量级,应把结论降为局部版本;若方向也翻转,则回到对象定义与测量链重新审计。一四三号教育未阅读科学的收口复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育未阅读科学的收口首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育未阅读科学的收口只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育未阅读科学的收口只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育未阅读科学的收口资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育未阅读科学的收口复核四:报告独立复算成功对象/全部尝试对象,防止成功案例吞掉失败分母。

一四三号教育未阅读科学的收口的证据核验回到 Simmons, Nelson & Simonsohn, False-positive psychology, Psychological Science 22 (2011): 1359–1366, doi:10.1177/0956797611417632。一四三号教育未阅读科学的收口本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育未阅读科学的收口复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

位置S——把“阅读科学的收口的对象、操作与失败域”当成单独够用的那一样 单因决定阅读科学的收口能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔20 窗口内稳定等于长期稳定〕阅读科学的收口在已发表样本中的方向可以代表全部候选对象 量纲阅读科学的收口边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,阅读科学的收口记录越完整,整体结论反而出现反号或反向移动 自曝第143号第18项把阅读科学的收口的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第18项中未定义、未进入流程、失访、阴性或因阅读科学的收口条件不足而被排除的对象 异名第 509 号《宗教、法律与政教关系》称为“阅读科学的收口的边界—分母错位”;另见第 539 号第18条

十一、教育神经科学的可用边界 —— 脑成像能与不能提供什么教育神经科学的可用边界 —— 脑成像能与不能提供什么

提出Funder et al., Improving the dependability of research in personality and social psychology, PSPR 18 (2014): 3–12, doi:10.1177/1088868313507536。 争议Borsboom, A network theory of mental disorders, World Psychiatry 16 (2017): 5–13, doi:10.1002/wps.20375 给出不同对象边界或反例路线。 最新Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】教育神经科学在这二十年从热潮走向定位。当前较稳的主张是:脑科学的贡献主要在三处——为发育性障碍(阅读障碍、计算障碍)提供早期识别的生物标志与机制解释;为若干干预提供机制层面的排除性证据;以及对教育实践中流行的神经说法提供证伪。它不提供教学方法:从「学习时哪个脑区活动」推不出「应该怎么教」。

【它顶掉了什么】它顶掉的是早期「基于脑的教学」这一整类主张。核心论证是推理层级的错位:教学决策发生在行为与情境层面,而脑数据的空间与时间分辨率既不支持个体化教学决策,也不能在行为证据之外增加独立信息——若一项方法在行为上无效,脑激活的差异不能救它。一四三号教育申教育神经科学的可用边界复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

一四三号教育申教育神经科学的可用边界首先改变的是教育心理学的入账单位:结果不能只按成功样本结算,必须把纳入对象、实施步骤、阴性读数与停止条件放在同一张表。一四三号教育申教育神经科学的可用边界只有这样,题目中的转向才是可检验命题,而不是一个吸引注意的新标签。

对一四三号教育申教育神经科学的可用边界只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育申教育神经科学的可用边界资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。

一四三号教育申教育神经科学的可用边界的证据核验回到 Funder et al., Improving the dependability of research in personality and social psychology, PSPR 18 (2014): 3–12, doi:10.1177/1088868313507536。一四三号教育申教育神经科学的可用边界本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育申教育神经科学的可用边界复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育申教育神经科学的可用边界的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育申教育神经科学的可用边界阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育申教育神经科学的可用边界复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

位置D——把“教育神经科学的可用边界的对象、操作与失败域”当成单独够用的那一样 单因决定教育神经科学的可用边界能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔29 越精细越接近真实〕教育神经科学的可用边界在已发表样本中的方向可以代表全部候选对象 量纲教育神经科学的可用边界边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,教育神经科学的可用边界记录越完整,整体结论反而出现反号或反向移动 自曝第143号第19项把教育神经科学的可用边界的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第19项中未定义、未进入流程、失访、阴性或因教育神经科学的可用边界条件不足而被排除的对象 异名第 512 号《古希腊与罗马哲学》称为“教育神经科学的可用边界的边界—分母错位”;另见第 544 号第19条

十二、生成式工具与认知外包 —— 学习的目标是过程,而工具替代的正是过程生成式工具与认知外包 —— 学习的目标是过程,而工具替代的正是过程

提出American Psychological Association, Publication Manual, 7th ed. (2020)。 争议Caspi et al., The p factor, Clinical Psychological Science 2 (2014): 119–137, doi:10.1177/2167702613497473 给出不同对象边界或反例路线。 最新Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675。 关键提出、争议与最新为三笔互异来源;本条按原始证据、反例与近年更新分别结算。

【它主张什么】二〇二三年之后迅速积累的主张是:生成式工具在教育中的问题与在生产中的问题方向相反。在工作中,把过程外包给工具、只保留结果是效率提升;而在学习中,过程本身就是目的——写作、推导、检索的困难正是产生学习的那部分。由此形成的核心命题是:工具会系统性地移除合意难度,从而在提高作业质量的同时降低学习。

【它顶掉了什么】它顶掉的是把生成式工具类比为计算器、拼写检查的乐观论证。区别在于所替代的认知活动是否为学习目标本身:计算器替代的是已掌握的算术执行,而生成式工具替代的往往正是学生尚未掌握、且课程意在培养的那一套过程。它同时把「作业作为评估手段」这一制度前提整个动摇了。

对一四三号教育酉生成式工具与认知外包只保留一条单因主张:在公开边界内,关键操作能否稳定改变目标结局。一四三号教育酉生成式工具与认知外包资金、声望、机构级别和样本规模只作环境量,不能替代方向性证据;若离开原团队口头补充便无法重做,本条仍按一次性工艺处理。一四三号教育酉生成式工具与认知外包复核三:失败参数与停止位置保留版本,使下一轮能判断是方法失效还是边界越界。

一四三号教育酉生成式工具与认知外包的证据核验回到 American Psychological Association, Publication Manual, 7th ed. (2020)。一四三号教育酉生成式工具与认知外包本页分别登记对象数量、有效条件、误差或失败分母;这三种读数回答覆盖、强度与不确定性,不能相加为一个无量纲的“突破值”,也不能由发表年份代替证据等级。一四三号教育酉生成式工具与认知外包复核一:分母改成全部候选对象后重新计算方向,未满足纳入条件者不得记成零值。

最锋利的争议位于外推边界:中心样本、标准流程或低噪声场景可能把一四三号教育酉生成式工具与认知外包的效应撑得很整齐,边缘对象却给出反向结果。一四三号教育酉生成式工具与认知外包阴性参数区必须保留;它否定的也许只是聚合次序,而不是所有局部结论。一四三号教育酉生成式工具与认知外包复核二:2024—2026 年更新单列,较晚发表不自动等于更强证据。

要让一四三号教育酉生成式工具与认知外包离开个人技艺,样本、代码、量表、操作规程与修订记录必须带版本公开。一四三号教育酉生成式工具与认知外包评审时还要问谁进入分母、谁能独立复算、一次修订需要多少工时;基础设施的价值由复核成本下降衡量,而不是由文件数量衡量。

位置E——把“生成式工具与认知外包的对象、操作与失败域”当成单独够用的那一样 单因决定生成式工具与认知外包能否迁移的只有公开边界内的方向性结论是否可独立复算 预设〔29 越精细越接近真实〕生成式工具与认知外包在已发表样本中的方向可以代表全部候选对象 量纲生成式工具与认知外包边界内独立复算并保持方向的对象数/全部被声称覆盖的候选对象数 失效当边缘对象占比升高时,生成式工具与认知外包记录越完整,整体结论反而出现反号或反向移动 自曝第143号第20项把生成式工具与认知外包的适用条件写进样本、流程或参数;删除该条件,核心推断不成立 空栏第143号第20项中未定义、未进入流程、失访、阴性或因生成式工具与认知外包条件不足而被排除的对象 异名第 515 号《行动哲学与自由意志》称为“生成式工具与认知外包的边界—分母错位”;另见第 549 号第20条

二十年连起来看

教育心理学过去二十年的连续变化,不是新术语不断覆盖旧术语,而是研究对象从单点扩到轨迹、从平均值扩到异质性、从成功案例扩到失败分母。第一幕八条定位奠基转向,第二幕十二条把它们推进到真实世界、规模化与公开核验。

因此,“新”由证据结构而不是发表年份决定:旧思想若到近年才获得可计算对象、公开数据或可否证阈值,仍是新的工作方式;2025 年出现却没有独立复核的结果,只能记为候选。

三个常见误解

第一,把一个著名项目当成整个领域;本页用二十条区分机制、测量、制度与基础设施。第二,把样本或数据规模当可靠性;规模不能修复选择偏差、定义漂移与缺失机制。第三,把尚未解决解释为没有进步;把失败区画清、把错误路线排除,本身就是可累积的知识。

与相邻领域的接口

与第 328 号《色谱与质谱技术》的接口在可迁移表示:对象换场景后,结构与误差能否同时保留。与第 341 号《水文学与陆面过程》的接口在证据聚合:局部读数怎样进入整体判断而不抹平异常。两处都要求先公开分母,再谈统一。

争议现场

教育心理学最实质的争议不是传统与创新,而是复杂研究怎样获得共同体信任。一方强调专家链式核验,另一方要求原始数据、机器证书或独立复做。可判标准是关键结论能否在不依赖原作者口头补充的情况下重建。

第二个争议围绕边界:统一语言提高迁移速度,却可能把不适配对象排出可见范围。因此二十条都保留“空栏”和“自曝”;若异常只在论文之外出现,统一就只是整理成功案例。

往下五年看什么

观察三件事:2024—2026 年候选结果能否形成第二个独立复核;数据库、软件与流程能否保存阴性记录;新人能否在更短依赖路径上进入前沿。若三项只增加产出数量而不降低复核成本,基础设施仍未成熟。

可与哪些领域对撞

教育心理学与第 476 号《食品系统与可持续膳食》共享“通过检查即可信”的前提,却可能给出相反方向:形式检查越密,未建模的共同原因失效越隐蔽。可测问题是重大修订前的扩散速度/完成独立复核所需时间。

它还可撞第 297 号《科技政策与科研管理》:一个领域追求真值,另一个领域分配注意、经费与声誉。两者都默认高影响结果值得优先复核;相反方向是越抢先的结果可供核验的时间越短。

第三处对撞是第 306 号《生物统计学》:那里担心样本进入分母,这里担心对象、记录或实施场景进入分母。共同前提是已记录对象代表候选总体;相反方向是可测对象越多,难以表示的对象越可能永久缺席。

十条可做的研究命题

一,统计关键结果从提出到独立核验的中位时间。二,把失败参数公开与否作为后续复用率的解释变量。三,比较单中心与多中心研究的依赖树。四,测数据库扩容前后问题类型是否收窄。五,前瞻登记来源三笔互异与重大修订率。

六,随机抽样复核一条中间步骤。七,比较新框架引入前后的训练年限。八,为不可复算却被广泛引用的结果建立退出机制。九,测试跨领域迁移是否增加反例发现率。十,把阴性记录进入公共库的比例设为健康指标,并预先规定何时否定它。

资料核验

  1. Open Science Collaboration, Estimating the reproducibility of psychological science, Science 349 (2015): aac4716, doi:10.1126/science.aac4716
  2. Klein et al., Investigating variation in replicability, Social Psychology 45 (2014): 142–152, doi:10.1027/1864-9335/a000178
  3. Nosek et al., The preregistration revolution, PNAS 115 (2018): 2600–2606, doi:10.1073/pnas.1708274114
  4. Munafò et al., A manifesto for reproducible science, Nature Human Behaviour 1 (2017): 0021, doi:10.1038/s41562-016-0021
  5. Lakens, Equivalence tests, Social Psychological and Personality Science 8 (2017): 355–362, doi:10.1177/1948550617697177
  6. Borsboom, A network theory of mental disorders, World Psychiatry 16 (2017): 5–13, doi:10.1002/wps.20375
  7. Caspi et al., The p factor, Clinical Psychological Science 2 (2014): 119–137, doi:10.1177/2167702613497473
  8. Kotov et al., The Hierarchical Taxonomy of Psychopathology, Journal of Abnormal Psychology 126 (2017): 454–477, doi:10.1037/abn0000258
  9. Hayes & Hofmann, Process-Based CBT, New Harbinger (2018)
  10. Hofmann et al., The science of behavior change, Behaviour Research and Therapy 117 (2019): 1–8, doi:10.1016/j.brat.2019.01.006
  11. Henrich, Heine & Norenzayan, The weirdest people in the world?, Behavioral and Brain Sciences 33 (2010): 61–83, doi:10.1017/S0140525X0999152X
  12. Gelfand et al., Differences between tight and loose cultures, Science 332 (2011): 1100–1104, doi:10.1126/science.1197754
  13. Muthukrishna et al., Beyond Western, Educated, Industrial, Rich, and Democratic psychology, Psychological Science 31 (2020): 678–701, doi:10.1177/0956797620916782
  14. Borsboom et al., The theoretical status of latent variables, Psychological Review 110 (2003): 203–219, doi:10.1037/0033-295X.110.2.203
  15. McNeish & Wolf, Thinking twice about sum scores, Behavior Research Methods 52 (2020): 2287–2305, doi:10.3758/s13428-020-01398-0
  16. Barr, Levy, Scheepers & Tily, Keep it maximal, Journal of Memory and Language 68 (2013): 255–278, doi:10.1016/j.jml.2012.11.001
  17. Gelman & Loken, The garden of forking paths, 2013 manuscript
  18. Simmons, Nelson & Simonsohn, False-positive psychology, Psychological Science 22 (2011): 1359–1366, doi:10.1177/0956797611417632
  19. Funder et al., Improving the dependability of research in personality and social psychology, PSPR 18 (2014): 3–12, doi:10.1177/1088868313507536
  20. American Psychological Association, Publication Manual, 7th ed. (2020)
  21. Measurement precision and user experience with adaptive versus non-adaptive psychometric tests, Personality and Individual Differences 225 (2024): 112675, doi:10.1016/j.paid.2024.112675
  22. Development and validation of domain-specific school diversity model scales, Journal of School Psychology 107 (2024): 101378, doi:10.1016/j.jsp.2024.101378
  23. Measurement invariance of SCARED across ethnicity, age and sex among youth with depression, Psychiatry Research Communications (2024): 100134, doi:10.1016/j.pmip.2024.100134

核验说明:文献表优先列原始论文、正式方法规范、数据报告与同行评议综述;工作论文或方法更新只用于“最新”定位,不与已复核的因果结果同权。正文数值、适用边界与失败条件以来源原文为准。

新思想前沿 · 第 143 号《教育心理学》· 王德生 亲撰 · ← 回到 626 个领域总览