公共政策
公共政策的近二十年转向与 1950—2006 年经典思想在同一页对读:现代层说明新证据怎样改写问题,经典层倒查旧前提由谁、用什么材料建立。四十条均保留来源、量纲、失效与异名接口;经典二十条逐一回指上文,不把年代久远误当成仍然有效。
第一幕见证证据本位、随机试验和行为团队进入政府;同时,指标替代目标与规模化衰减开始暴露。
甲、证据本位从医学扩散到政府决策Evidence based policy
2016 年,本世纪头十年,系统评价、证据等级与「什么有效」资料库从循证医学扩散到教育、就业与犯罪政策,多国设立专门机构做证据汇总。回到提出笔,Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)的《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》只在样本来源与纳入路径内解释政策文件中系统综述或因果评估引用率;Herbert A. Simon(1947)的《Administrative Behavior》负责旧命名,不替代现代识别。
证据分级、知识中介与预算流程把研究接入决策。据此以政策文件中系统综述或因果评估引用率辨向,未申请的合格人群对“从医学扩散到政府决策”的影响构成反事实缺口。由此可反驳的说法是:政策文件中系统综述或因果评估引用率是唯一决定项。在样本来源与纳入路径中拿走政策文件中系统综述或因果评估而结果仍同号,就否证《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》的机制解释(Kathryn Oliver、Simon Innvar、Theo Lorenc 等,2014)。
它建立的是判据而不是结论:一项干预有没有效,第一问变成「有没有对照」。Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)没有报告政策文件中系统综述或因果评估引用率可跨样本搬用的点估计,本页不替《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》补造效应量。可证伪阈值预注册为R1=政策文件中系统综述或因果评估引用率除以可评文件:R1>1.00倍才支持原方向,R1≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
一旦选择进入分母时,覆盖越高,估计偏差反而越大;证据本位从医学扩散到政府决策的方向在行政流程和结果能链接的公共项目中的“证据本位从医学扩散到政府”样本外因此需要重估。反例并不在同一格里:R. Andrew Moore(2006)的《Evidence-based policy-making》只在行政流程和结果能链接的公共项目中的证据本位从医学扩散到政府样本外与Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)形成反号;边界内的同号证据不被冒充为普遍定律。
这条纪律是这十年能自查的前提。就“证据本位从医学扩散到政府决策”而言,以可评文件中可识别“证据本位从医学扩散到政府决策”的观察单位为外沿。制度接口随后移动:Saiqa Noor、Saquib Khushhal、Aleena Amjad、As(2025)在《Using AI to Inform Evidence-based Decision-Making in Educational Policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的政策文件中系统综述或因果评估引用率变成可比较对象。
与“证据本位从医学扩散到政府决策”相邻,实施科学可作跨域检索词;未申请的合格人群对“从医学扩散到政府决策”的影响到 2025 年仍无统一数据。跨块接口不靠同名:第267号《行政负担:国家能力也体现在公民要付出多少》结算另一生成层;《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》仍以政策文件中系统综述或因果评估引用率对可评文件辨向。两边若同时成立,政策文件中系统综述或因果评估会迫使样本来源与纳入路径成为第三项(2014/2025)。
乙、随机试验进入发展与社会政策Randomized policy experiments
2006 年,同期,政府部门开始自己做随机试验:不同的催缴信、不同的默认设置、不同的就业辅导方案被随机分配到几十万人身上。沿着样本表,Jennifer L. Romich(2006)的《Randomized social policy experiments and research on child development》只在制度建立时点内解释随机分派后的平均处理效应;Harold D. Lasswell & Daniel Lerner(1951)的《The Policy Sciences》负责旧命名,不替代现代识别。
随机分派后的平均处理效应的变化经由随机化切断自我选择并明确反事实结果产生;一线人员的隐性变通对“验进入发展与社会政策”的影响让替代解释仍在场。这把主张压成一条硬命题:随机分派后的平均处理效应是唯一决定项。在制度建立时点中拿走随机分派后的平均处理效应而结果仍同号,就否证《Randomized social policy experiments and research on child development》的机制解释(Jennifer L. Romich,2006)。
随机试验进入发展与社会政策在 2009 年用随机分派后的平均处理效应除以合格对象留下第 2 组可比读数。Jennifer L. Romich(2006)没有报告随机分派后的平均处理效应可跨样本搬用的点估计,本页不替《Randomized social policy experiments and research on child development》补造效应量。可证伪阈值预注册为R2=随机分派后的平均处理效应除以合格对象:R2>1.00倍才支持原方向,R2≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
这类试验的样本量与真实性远超学术实验,也正因如此,这十年才能把政府大规模试验与学术文献的效应量放在一起比——而一比就比出了那个七倍的落差。两篇论文的冲突要用同终点辨认:Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)的《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》只在有试点与规模化对照的政策中的随机试验进入发展与社会政样本外与Jennifer L. Romich(2006)形成反号;边界内的同号证据不被冒充为普遍定律。
就“随机试验进入发展与社会政策”而言,本项只承诺随机试验进入发展与社会政策的同口径观察,一线人员的隐性变通对“验进入发展与社会政策”的影响不得混入分母。近端研究把尺度推远:Radek Kovács、Arnošt Veselý(2026)在《Survey Experiments in Public Policy: A Systematic Literature Review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的随机分派后的平均处理效应变成可比较对象。
与“随机试验进入发展与社会政策”相邻,相邻学科称其为政策学习,但一线人员的隐性变通对“验进入发展与社会政策”的影响尚未纳入 2026 年资料。对撞发生在相同前提下:第498号《知识经纪:把论文翻译成可行动的政策问题》结算另一生成层;《Randomized social policy experiments and research on child development》仍以随机分派后的平均处理效应对合格对象辨向。两边若同时成立,随机分派后的平均处理效应会迫使制度建立时点成为第三项(2006/2026)。到2026年,Radek Kovács、Arnošt Veselý把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于有试点与规模化对照的政策中的随机试验进入发展与社。
丙、绩效指标越成功越可能替代真实目标Performance management and gaming
新公共管理的绩效指标体系在这一时期覆盖医疗、教育与治安。2016 年的研究把绩效指标越成功越可能替代真实目标与指标改善与真实结果改善之差除以考核单位直接相连。把概念史与估计拆开,Gwyn Bevan、Christopher Hood(2006)的《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》只在关系网络中心度内解释指标改善与真实结果改善之差;Charles E. Lindblom(1959)的《所列研究》负责旧命名,不替代现代识别。指标改善与真实结果改善之差除以考核单位;这项证据只承担关系网络中心度内的方向,不承担域外的统一量级。
先观察高强度问责诱发选择服务对象和重分类行为,再核对指标改善与真实结果改善之差;遗漏失败后未发表的试点对“功越可能替代真实目标”的影响会错认先后次序。真正需要承担因果责任的是:指标改善与真实结果改善之差是唯一决定项。在关系网络中心度中拿走指标改善与真实结果改善之差而结果仍同号,就否证《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》的机制解释(Gwyn Bevan、Christopher Hood,2006)。
随后大量案例显示:指标被达成,而指标想代表的东西没有改善——急诊等候被记录在门口、考试成绩靠应试提升。读数:绩效指标越成功越可能替代真实目标在 2010 年用指标改善与真实结果改善之差除以考核单位留下第 3 组可比读数。Gwyn Bevan、Christopher Hood(2006)没有报告指标改善与真实结果改善之差可跨样本搬用的点估计,本页不替《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》补造效应量。可证伪阈值预注册为R3=指标改善与真实结果改善之差除以考核单位:R3>1.00倍才支持原方向,R3≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
在反向因果占优的样本中,相关越强,机制解释却越弱。争论的分水岭落到样本边缘:Nyiramukama Diana Kashaka(2026)的《Algorithmic Governance in Public Services: Accountability and Bias Audits》只在执行者与受益者均可分层的资料中的绩效指标越成功越可能替代样本外与Gwyn Bevan、Christopher Hood(2006)形成反号;边界内的同号证据不被冒充为普遍定律。
「一个指标一旦成为目标,就不再是好指标」在上一个十年被大规模验证过一次,这十年在算法与激励机制上再次重演。这项读数进入新的执行场:Léon Acar(2026)在《Digital Co-Production of Public Services》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的指标改善与真实结果改善之差变成可比较对象。
与“绩效指标越成功越可能替代真实目标”相邻,以行政负担对接外部文献时,失败后未发表的试点对“功越可能替代真实目标”的影响仍是一处未观测量(2026)。相邻面板提供反方向切片:第557号《常态化过程理论》结算另一生成层;《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》仍以指标改善与真实结果改善之差对考核单位辨向。两边若同时成立,指标改善与真实结果改善之差会迫使关系网络中心度成为第三项(2006/2026)。
丁、行为团队把默认选项做成低成本干预Nudging in government
行为科学团队在这一时期进入政府(见相邻面板),主打低成本、可快速测试的干预。2016 年的研究把行为团队把默认选项做成低成本干预与干预组相对对照组完成率差除以被触达者直接相连。从原始终点看,Paul Dolan、Michael Hallsworth、David Halper(2012)的《Influencing Behaviour: The Mindspace Way》只在处理暴露强度内解释干预组相对对照组完成率差;James G. March & Herbert A. Simon(1958)的《Organizations》负责旧命名,不替代现代识别。Paul Dolan、Michael Hallsworth、David Halper(2012)的贡献不是再命名,而是把干预组相对对照组完成率差放进被触达者这一可失败分母。
机制链写作默认、提醒和社会规范降低有限注意造成的摩擦。干预组相对对照组完成率差是结果端,跨部门交接造成的损耗对“认选项做成低成本干预”的影响留在输入端。反事实只移动一项:干预组相对对照组完成率差是唯一决定项。在处理暴露强度中拿走干预组相对对照组完成率差而结果仍同号,就否证《Influencing Behaviour: The Mindspace Way》的机制解释(Paul Dolan、Michael Hallsworth、David Halper,2012)。《Influencing Behaviour: The Mindspace Way》与《Nudging by government: Progress, impact, & lessons learned》共同承认处理暴露强度会改变识别,但对干预组相对对照组完成率差的方向给出不同承诺。
早期成果被广泛报道。行为团队把默认选项做成低成本干预在 2012 年用干预组相对对照组完成率差除以被触达者留下第 4 组可比读数。Paul Dolan、Michael Hallsworth、David Halper(2012)没有报告干预组相对对照组完成率差可跨样本搬用的点估计,本页不替《Influencing Behaviour: The Mindspace Way》补造效应量。可证伪阈值预注册为R4=干预组相对对照组完成率差除以被触达者:R4>1.00倍才支持原方向,R4≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
一旦关键资源只能小规模供给,试点效应越大,推广后反而缩水。边界条件在近端复核中显形:David Halpern、Michael Sanders(2016)的《Nudging by government: Progress, impact, & lessons learned》只在具有明确成本和退出规则的干预中的行为团队把默认选项做成低样本外与Paul Dolan、Michael Hallsworth、David Halper(2012)形成反号;边界内的同号证据不被冒充为普遍定律。
它带来的最持久的东西不是那些具体干预,而是「先小规模随机测一下」这个工作习惯。复核对象不再停在论文样本:Camila Regueiro-Ons、Jaime Pinilla、Beatriz (2026)在《Fertility response to family policy: Insights from Spain’s paternity leave》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的干预组相对对照组完成率差变成可比较对象。
与“行为团队把默认选项做成低成本干预”相邻,跨部门交接造成的损耗对“认选项做成低成本干预”的影响没有随适应性治理一起进入共同口径,截至 2026 年仍然如此。邻接条目改用另一分母:第605号《预期行动扩展:阈值之外还要问谁先受益》结算另一生成层;《Influencing Behaviour: The Mindspace Way》仍以干预组相对对照组完成率差对被触达者辨向。两边若同时成立,干预组相对对照组完成率差会迫使处理暴露强度成为第三项(2012/2026)。
戊、影响评估进入援助项目问责链Impact evaluation and aid accountability
同期,国际援助领域大规模引入影响力评估,要求项目说明自己的因果证据。2011 年的研究把影响评估进入援助项目问责链与具有基线和对照的项目数除以受资助项目直接相连。按主证据的时序,Howard White(2009)的《Theory-Based Impact Evaluation: Principles and Practice》只在样本进入路径内解释具有基线和对照的项目数;Graham T. Allison(1971)的《Essence of Decision》负责旧命名,不替代现代识别。
从资助条件与公开报告推动项目明确结果指标可推出具有基线和对照的项目数;但未申请的合格人群对“估进入援助项目问责链”的影响未入表,方向只能有条件成立。可失败版本可以写成:具有基线和对照的项目数是唯一决定项。在样本进入路径中拿走具有基线和对照的项目数而结果仍同号,就否证《Theory-Based Impact Evaluation: Principles and Practice》的机制解释(Howard White,2009)。未申请的合格人群对估进入援助项目问责链的影响没有进入具有基线和对照的项目数的中心读数,这正是《Theory-Based Impact Evaluation: Principles and Practice》最容易被过度外推的地方。
这与发展经济学那条线互为表里(见相邻面板)。影响评估进入援助项目问责链在 2011 年用具有基线和对照的项目数除以受资助项目留下第 5 组可比读数。Howard White(2009)没有报告具有基线和对照的项目数可跨样本搬用的点估计,本页不替《Theory-Based Impact Evaluation: Principles and Practice》补造效应量。可证伪阈值预注册为R5=具有基线和对照的项目数除以受资助项目:R5>1.00倍才支持原方向,R5≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Alhassan Musah、Adu Peprah James、Matilda As(2025)若改变受资助项目的构成,提出笔的方向必须重新估计,不能沿用旧系数。
当制度回应改变行为时,干预越强,原有比较组反而越不成立。反对笔改换了识别窗:Ratnida Rahmasari、Unti Ludigdo、Ali Djamhur(2024)的《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》只在行政流程和结果能链接的公共项目中的影响评估进入援助项目问责样本外与Howard White(2009)形成反号;边界内的同号证据不被冒充为普遍定律。
它同时带来了选题偏向:可评估的项目更容易获得资金,而制度建设这类难以评估的工作相对失宠。延伸证据改换了承载机构:Alhassan Musah、Adu Peprah James、Matilda As(2025)在《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的具有基线和对照的项目数变成可比较对象。
与“影响评估进入援助项目问责链”相邻,2025 年的邻域术语是实施科学;资料缺口则落在未申请的合格人群对“估进入援助项目问责链”的影响。两块材料只共享条件场:第416号《资本由法律编码而非物自身产生》结算另一生成层;《Theory-Based Impact Evaluation: Principles and Practice》仍以具有基线和对照的项目数对受资助项目辨向。两边若同时成立,具有基线和对照的项目数会迫使样本进入路径成为第三项(2009/2025)。
己、规模化失败提示情境与执行不可省略Scaling up policy interventions
同一时期已有个案报告:在试点中效果显著的项目,推广后效果大幅缩水。2006 年的研究把规模化失败提示情境与执行不可省略与规模实施效应相对试点效应保留率除以同类项目直接相连。回到提出笔,Karthik Muralidharan、Paul Niehaus(2017)的《Experimentation at Scale》只在危机前资产负债表内解释规模实施效应相对试点效应保留率;Jeffrey L. Pressman & Aaron Wildavsky(1973)的《Implementation》负责旧命名,不替代现代识别。
一线人员的隐性变通对“示情境与执行不可省略”的影响之外,证据支持人员训练、选择性执行与单位成本改变处理强度影响规模实施效应相对试点效应保留率,两端不得互换。由此可反驳的说法是:规模实施效应相对试点效应保留率是唯一决定项。在危机前资产负债表中拿走规模实施效应相对试点效应保留而结果仍同号,就否证《Experimentation at Scale》的机制解释(Karthik Muralidharan、Paul Niehaus,2017)。
当时的解释多为「执行不到位」。规模化失败提示情境与执行不可省略在 2016 年用规模实施效应相对试点效应保留率除以同类项目留下第 6 组可比读数。Karthik Muralidharan、Paul Niehaus(2017)没有报告规模实施效应相对试点效应保留率可跨样本搬用的点估计,本页不替《Experimentation at Scale》补造效应量。可证伪阈值预注册为R6=规模实施效应相对试点效应保留率除以同类项目:R6>1.00倍才支持原方向,R6≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
在网络外溢占主导之际,直接处理越多,未处理组反而越被污染。反例并不在同一格里:Murali Krishna Pasupuleti(2026)的《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》只在有试点与规模化对照的政策中的规模化失败提示情境与执行样本外与Karthik Muralidharan、Paul Niehaus(2017)形成反号;边界内的同号证据不被冒充为普遍定律。对议程、工具组合、执行能力、反馈、政策学习与分配后果分别分层后,规模实施效应相对试点效应保留率若只在中心组存在,原命题就必须缩域。
这十年的系统对账给出了不同的答案:缩水的原因是结构性的——发表偏倚、低功效、实施质量、以及一般均衡效应,而不只是执行问题。制度接口随后移动:Imran Rasul(2026)在《From field experiments to policy interventions at scale》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的规模实施效应相对试点效应保留率变成可比较对象。
与“规模化失败提示情境与执行不可省略”相邻,政策学习连接了相邻研究,一线人员的隐性变通对“示情境与执行不可省略”的影响却仍停在 2026 年数据库之外。跨块接口不靠同名:第478号《跨平台协同行为检测》结算另一生成层;《Experimentation at Scale》仍以规模实施效应相对试点效应保留率对同类项目辨向。两边若同时成立,规模实施效应相对试点效应保留会迫使危机前资产负债表成为第三项(2017/2026)。
庚、政策转移必须区分机制与表面形式Policy transfer and translation
政策很少像技术零件一样原样搬运。2012 年的研究把政策转移必须区分机制与表面形式与移植后保留的核心机制数除以政策组件直接相连。沿着样本表,Diane Stone(2012)的《Transfer and translation of policy》只在年龄与代际内解释移植后保留的核心机制数;Donald T. Campbell(1976)的《所列研究》负责旧命名,不替代现代识别。
识别从移植后保留的核心机制数回溯到制度翻译、利益协调和本地执行重写外来方案;失败后未发表的试点对“须区分机制与表面形式”的影响是尚未封闭的旁路。这把主张压成一条硬命题:移植后保留的核心机制数是唯一决定项。在年龄与代际中拿走移植后保留的核心机制数而结果仍同号,就否证《Transfer and translation of policy》的机制解释(Diane Stone,2012)。
2006 至 2016 年的比较研究至少区分 3 层:可见项目形式、真正起作用的机制和接收制度;2006 至 2016 年的比较研究至少区分 3 层:可见项目形式、真正起作用的机制和接收制度。Diane Stone(2012)没有报告移植后保留的核心机制数可跨样本搬用的点估计,本页不替《Transfer and translation of policy》补造效应量。可证伪阈值预注册为R7=移植后保留的核心机制数除以政策组件:R7>1.00倍才支持原方向,R7≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
若分类门槛随地区变化,差距越显著,跨地可比性反而越低。两篇论文的冲突要用同终点辨认:Tolga Duygun(2020)的《Policy translation in Turkish disability policy: The role and limitations of international organisations》只在执行者与受益者均可分层的资料中的政策转移必须区分机制与表样本外与Diane Stone(2012)形成反号;边界内的同号证据不被冒充为普遍定律。《Policy translation in Turkish disability policy: The role and limitations of international organisations》把执行者与受益者均可分层的资料中的政策转移必须区分机制与表样本换成对照域,移植后保留的核心机制数因此可能从同号变成零或反号。
相同名称可能对应完全不同的执行链。就“政策转移必须区分机制与表面形式”而言,若改用其他总体,移植后保留的核心机制数会被选择机制扭转。近端研究把尺度推远:Alireza Jazini(2021)在《Translation policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的移植后保留的核心机制数变成可比较对象。在政策文本、预算执行、行政登记、实施过程与受益者申诉里,Diane Stone(2012)留下的可复查接口是移植后保留的核心机制数,而不是条目标题本身。
与“政策转移必须区分机制与表面形式”相邻,跨域对应为行政负担。到 2021 年,失败后未发表的试点对“须区分机制与表面形式”的影响仍缺可比较记录。对撞发生在相同前提下:第495号《审议式微型公众:让普通人处理复杂证据》结算另一生成层;《Transfer and translation of policy》仍以移植后保留的核心机制数对政策组件辨向。两边若同时成立,移植后保留的核心机制数会迫使年龄与代际成为第三项(2012/2021)。
辛、共同生产把公民从受益者变成执行者Co-production in public services
公共服务并非只由政府生产再交付给被动对象。2016 年的研究把共同生产把公民从受益者变成执行者与由使用者共同完成的服务环节数除以服务流程直接相连。把概念史与估计拆开,Tony Bovaird(2007)的《Beyond Engagement and Participation: User and Community Coproduction of Public Services》只在组织规模内解释由使用者共同完成的服务环节数;Mancur Olson(1965)的《The Logic of Collective Action》负责旧命名,不替代现代识别。
若专业人员与公民贡献互补并影响服务持续性成立,由使用者共同完成的服务环节数应同步改变。真正需要承担因果责任的是:由使用者共同完成的服务环节数是唯一决定项。在组织规模中拿走由使用者共同完成的服务环节数而结果仍同号,就否证《Beyond Engagement and Participation: User and Community Coproduction of Public Services》的机制解释(Tony Bovaird,2007)。
2013 年后的研究把信息提供、日常照护与监督等至少 3 类公民投入计入执行,重新界定服务成本和责任。Tony Bovaird(2007)没有报告由使用者共同完成的服务环节数可跨样本搬用的点估计,本页不替《Beyond Engagement and Participation: User and Community Coproduction of Public Services》补造效应量。可证伪阈值预注册为R8=由使用者共同完成的服务环节数除以服务流程:R8>1.00倍才支持原方向,R8≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2013 年后的研究把信息提供、日常照护与监督等至少 3 类公民投入计入执行,重新界定服务成本和责任。一旦高风险者主动退出观察时,平均表现越好,真实风险反而越高。争论的分水岭落到样本边缘:T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. P(2015)的《Activating Citizens to Participate in Collective Co-Production of Public Services》只在具有明确成本和退出规则的干预中的共同生产把公民从受益者变样本外与Tony Bovaird(2007)形成反号;边界内的同号证据不被冒充为普遍定律。
就“共同生产把公民从受益者变成执行者”而言,可比单位是服务流程中可识别“共同生产把公民从受益者变成执行者”的观察单位。这项读数进入新的执行场:Chunsheng Li、Jinpeng Wu、Huiming Zhang、Zhim(2023)在《Co-production and Citizens’ Satisfaction with Public Services: The Case of Environmental Public Services in China》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的由使用者共同完成的服务环节数变成可比较对象。
与“共同生产把公民从受益者变成执行者”相邻,若按适应性治理检索,可找到相邻证据;跨部门交接造成的损耗对“民从受益者变成执行者”的影响截至 2023 年仍不可并表。相邻面板提供反方向切片:第267号《行为公共管理:制度效果受认知与情境机制影响》结算另一生成层;《Beyond Engagement and Participation: User and Community Coproduction of Public Services》仍以由使用者共同完成的服务环节数对服务流程辨向。两边若同时成立,由使用者共同完成的服务环节数会迫使组织规模成为第三项(2007/2023)。第267号《行为公共管理:制度效果受认知与情境机制影响》与《Beyond Engagement and Participation: User and Community Coproduction of Public Services》的分离线是具有明确成本和退出规则的干预中的共同生产把公民从受益者变:前者解释接口,后者解释由使用者共同完成的服务环节数。
第二幕把平均效应拆成执行链、行政负担、国家能力、政治时机与异质性,政策不再被想象成可直接复制的配方。
一、证据本位胜利后面临选择性使用The politics of evidence
过去二十年,随机对照试验从医学扩散到发展、教育、就业、税收与公共服务,2019 年的诺贝尔经济学奖是它的加冕。从原始终点看,Tracey Barnett McElwee、Laura Danforth、Chri(2025)的《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》只在信息可见度内解释被采用研究与全部合格研究之比;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Tracey Barnett McElwee、Laura Danforth、Chri(2025)的贡献不是再命名,而是把被采用研究与全部合格研究之比放进政策议题这一可失败分母。
它的贡献是实打实的:把「我认为这样有用」变成了可检验的命题,也让大量看似合理的政策被证伪。反事实只移动一项:被采用研究与全部合格研究之比是唯一决定项。在信息可见度中拿走被采用研究与全部合格研究之比而结果仍同号,就否证《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》的机制解释(Tracey Barnett McElwee、Laura Danforth、Chri,2025)。
与之配套的制度也建立起来:预注册、独立评估机构、政府内部的实验单位、系统综述与证据分级。过去二十年,随机对照试验从医学扩散到发展、教育、就业、税收与公共服务,2019 年的诺贝尔经济学奖是它的加冕。Tracey Barnett McElwee、Laura Danforth、Chri(2025)没有报告被采用研究与全部合格研究之比可跨样本搬用的点估计,本页不替《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》补造效应量。可证伪阈值预注册为R9=被采用研究与全部合格研究之比除以政策议题:R9>1.00倍才支持原方向,R9≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
这套装置本身是这十年公共行政领域最重要的制度创新。若平台关闭接口,记录量越大,历史连续性反而越短。边界条件在近端复核中显形:John Humphreys(2025)的《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》只在行政流程和结果能链接的公共项目中的证据本位胜利后面临选择性样本外与Tracey Barnett McElwee、Laura Danforth、Chri(2025)形成反号;边界内的同号证据不被冒充为普遍定律。
证据本位的胜利有一个可指认的制度形态:政府内部设立专门团队、把随机试验嵌入行政流程、并建立起从试点到推广的评估要求。复核对象不再停在论文样本:Vesna Trifunović、Stuart Blume(2023)在《Which vaccine? Between evidence-based policy and symbolic politics》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的被采用研究与全部合格研究之比变成可比较对象。
这套做法在多国被采纳,最大的贡献不是某项具体结论,而是把先试后推、公开评估结果这两条变成了默认程序。截至 2023 年仍在更新。邻接条目改用另一分母:第498号《边界组织:在科学自主与政策问责之间搭制度》结算另一生成层;《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》仍以被采用研究与全部合格研究之比对政策议题辨向。两边若同时成立,被采用研究与全部合格研究之比会迫使信息可见度成为第三项(2025/2023)。到2023年,Vesna Trifunović、Stuart Blume把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于行政流程和结果能链接的公共项目中的证据本位胜利后。
二、规模化效应普遍低于小样本试点Scale up effect fadeout
2026 年,问题出在从试点到推广的那一段。按主证据的时序,Imran Rasul(2026)的《From field experiments to policy interventions at scale》只在执行者裁量内解释规模化效应除以原试点效应;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。规模化效应除以原试点效应除以项目地点;这项证据只承担执行者裁量内的方向,不承担域外的统一量级。
差距的来源被拆开了:发表偏倚(有效的被写出来,无效的留在抽屉里)叠加低统计功效,可以解释其中约七成。可失败版本可以写成:规模化效应除以原试点效应是唯一决定项。在执行者裁量中拿走规模化效应除以原试点效应而结果仍同号,就否证《From field experiments to policy interventions at scale》的机制解释(Imran Rasul,2026)。一线人员的隐性变通对应普遍低于小样本试点的影响没有进入规模化效应除以原试点效应的中心读数,这正是《From field experiments to policy interventions at scale》最容易被过度外推的地方。
其余部分来自干预形式的差异——学术研究常用面对面或精心设计的接触,政府只能寄信或发短信。Imran Rasul(2026)没有报告规模化效应除以原试点效应可跨样本搬用的点估计,本页不替《From field experiments to policy interventions at scale》补造效应量。可证伪阈值预注册为R10=规模化效应除以原试点效应除以项目地点:R10>1.00倍才支持原方向,R10≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Imran Rasul(2026)的DOI提出笔与Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)的DOI近端笔。
这个结果的重要性在于它不指控任何人造假:每一项研究都可能是诚实且正确的,而文献的平均值依然会系统性偏高。这是一个关于制度而非个人的结论。反对笔改换了识别窗:Jennifer L. Romich(2006)的《Randomized social policy experiments and research on child development》只在有试点与规模化对照的政策中的规模化效应普遍低于小样本样本外与Imran Rasul(2026)形成反号;边界内的同号证据不被冒充为普遍定律。
规模化落差是这门学科最重要的经验发现:在试点中效果显著的干预,推广到全域后效应普遍缩小,缩水到只剩零头的案例并不罕见。延伸证据改换了承载机构:Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)在《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的规模化效应除以原试点效应变成可比较对象。
它之所以关键,是因为整个证据本位政策的逻辑建立在试点结果可外推的假设上,而这个假设被系统性地证伪了一部分。与“规模化效应普遍低于小样本试点”相邻,政策学习给出另一种命名;截至 2021 年仍在更新。两块材料只共享条件场:第557号《实施结果分类》结算另一生成层;《From field experiments to policy interventions at scale》仍以规模化效应除以原试点效应对项目地点辨向。两边若同时成立,规模化效应除以原试点效应会迫使执行者裁量成为第三项(2026/2021)。
三、实施链解释政策为何在现场缩水Implementation mechanisms
2023 年,除了发表偏倚,规模化本身有几条稳定的漏水口。其一是执行者:试点由最积极的人做,推广由普通人做。其二是选择:试点的参与者是自愿的、被筛过的,推广覆盖全体。回到提出笔,Joseph A. Durlak、Emily P. DuPre(2008)的《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》只在短窗与长窗内解释按方案完成的核心环节数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Joseph A. Durlak、Emily P. DuPre(2008)的贡献不是再命名,而是把按方案完成的核心环节数放进计划环节这一可失败分母。
其三是一般均衡:小规模培训能提高受训者的就业,全员培训只是改变了排队顺序。其四是供给约束:干预有效所依赖的配套(师资、床位、窗口)在规模上不存在。由此可反驳的说法是:按方案完成的核心环节数是唯一决定项。在短窗与长窗中拿走按方案完成的核心环节数而结果仍同号,就否证《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》的机制解释(Joseph A. Durlak、Emily P. DuPre,2008)。《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》与《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》共同承认短窗与长窗会改变识别,但对按方案完成的核心环节数的方向给出不同承诺。
于是「可规模化性」本身成了一个研究对象:设计试点时就要问,这个效应依赖的是哪一种稀缺资源,放大之后它还在不在。Joseph A. Durlak、Emily P. DuPre(2008)没有报告按方案完成的核心环节数可跨样本搬用的点估计,本页不替《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》补造效应量。可证伪阈值预注册为R11=按方案完成的核心环节数除以计划环节:R11>1.00倍才支持原方向,R11≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。中央和地方政府采用《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》的口径时,计划环节与原样本不一致,不能直接比较点估计。
文献长期报告效应量而不报告单位成本,于是一个效应大但极昂贵的干预,看起来胜过一个效应小却近乎免费的干预。反例并不在同一格里:Mikael Persson、Anders Sundell(2025)的《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》只在执行者与受益者均可分层的资料中的实施链解释政策为何在现场样本外与Joseph A. Durlak、Emily P. DuPre(2008)形成反号;边界内的同号证据不被冒充为普遍定律。
为什么会缩水,原因可以分列:试点往往由发明者亲自督导,实施质量高于常规行政系统;试点场地常是配合度高的地区,存在选择性。制度接口随后移动:I Iskandar(2020)在《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的按方案完成的核心环节数变成可比较对象。
此外,试点期的关注本身就有效应。这四条各自可测,因而缩水幅度原则上是可预估的。截至 2020 年仍在更新。跨块接口不靠同名:第605号《COVID-19 本地响应:国际撤离暴露谁一直在场》结算另一生成层;《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》仍以按方案完成的核心环节数对计划环节辨向。两边若同时成立,按方案完成的核心环节数会迫使短窗与长窗成为第三项(2008/2020)。
四、平均处理效应让位于分群效应Treatment effect heterogeneity
2024 年,与之并行的发现是效应在地点之间差别巨大:同一类干预在不同国家、不同机构、不同人群中的估计值可以相差数倍甚至反号。沿着样本表,Kosuke Imai、Marc Ratkovic(2013)的《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》只在中心与边缘节点内解释分群处理效应极差;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
因此重心从「平均处理效应」转向「在什么条件下有效」:机制的可移植性、情境的匹配、对哪一类人有效。这把主张压成一条硬命题:分群处理效应极差是唯一决定项。在中心与边缘节点中拿走分群处理效应极差而结果仍同号,就否证《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》的机制解释(Kosuke Imai、Marc Ratkovic,2013)。
方法上的对应物是预注册的异质性分析与多地点重复实验。平均处理效应让位于分群效应在 2018 年用分群处理效应极差除以预注册子群留下第 12 组可比读数。Kosuke Imai、Marc Ratkovic(2013)没有报告分群处理效应极差可跨样本搬用的点估计,本页不替《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》补造效应量。可证伪阈值预注册为R12=分群处理效应极差除以预注册子群:R12>1.00倍才支持原方向,R12≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Ilja Cornelisz、Chris van Klaveren(2022)若改变预注册子群的构成,提出笔的方向必须重新估计,不能沿用旧系数。
一个诚实的副产品是预测的谦逊:把同一批干预交给专家预测效果,专家的准确度并不高。这削弱了「先由专家挑选、再由试验确认」的传统分工。两篇论文的冲突要用同终点辨认:Murali Krishna Pasupuleti(2026)的《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》只在具有明确成本和退出规则的干预中的平均处理效应让位于分群效样本外与Kosuke Imai、Marc Ratkovic(2013)形成反号;边界内的同号证据不被冒充为普遍定律。《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》把具有明确成本和退出规则的干预中的平均处理效应让位于分群效样本换成对照域,分群处理效应极差因此可能从同号变成零或反号。
异质性——平均效应是不够的,是这门学科近年最实的方法转变:同一项干预可能对一部分人有效、对另一部分人无效甚至有害,而平均值把这些抵消掉。近端研究把尺度推远:Ilja Cornelisz、Chris van Klaveren(2022)在《Recurrent individual treatment assignment: a treatment policy approach to account for heterogeneous treatment effects》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的分群处理效应极差变成可比较对象。
据此产生的实践是——报告按人群分层的效应,并据以决定把干预投向谁,这实际上把政策评估与目标定位合成了一件事。截至 2022 年仍在更新。对撞发生在相同前提下:第416号《平台规则成为私人制度》结算另一生成层;《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》仍以分群处理效应极差对预注册子群辨向。两边若同时成立,分群处理效应极差会迫使中心与边缘节点成为第三项(2013/2022)。
五、国家能力重新进入政策效果函数State capacity and policy implementation
2021 年,疫情、供应链中断与产业政策的复归,把一个被忽视的变量推回中心:执行能力。政策失败常常不是设计错了,而是没人能把它做出来——数据不通、采购不行、人手不足、部门之间没有接口。把概念史与估计拆开,Martin J. Williams(2021)的《Beyond state capacity: bureaucratic performance, policy implementation and reform》只在首次事件与重复事件内解释税收、人员与执行覆盖构成的能力指数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
这与「什么干预有效」是两个不同的问题,而过去二十年的证据运动几乎只研究前者。真正需要承担因果责任的是:税收、人员与执行覆盖构成的能力指数是唯一决定项。在首次事件与重复事件中拿走税收、人员与执行覆盖构成的能而结果仍同号,就否证《Beyond state capacity: bureaucratic performance, policy implementation and reform》的机制解释(Martin J. Williams,2021)。
这十年的补课包括:政府采购与数字基础设施研究、公共部门人事与激励研究、以及对「行政负担」的系统研究——申请材料、排队、证明文件本身如何把政策挡在受益者门外。Martin J. Williams(2021)没有报告税收、人员与执行覆盖构成的能力指数可跨样本搬用的点估计,本页不替《Beyond state capacity: bureaucratic performance, policy implementation and reform》补造效应量。可证伪阈值预注册为R13=税收、人员与执行覆盖构成的能力指数除以行政区:R13>1.00倍才支持原方向,R13≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Martin J. Williams(2021)的DOI提出笔与Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、(2025)的DOI近端笔。
这也解释了为什么「简化申请」这类看似微不足道的干预,效应常常大过精心设计的激励:它移走的是一道对最需要帮助的人最高的门槛。争论的分水岭落到样本边缘:Vuyani Goodman Langa、Sanjay Balkaran(2026)的《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》只在行政流程和结果能链接的公共项目中的国家能力重新进入政策效果样本外与Martin J. Williams(2021)形成反号;边界内的同号证据不被冒充为普遍定律。
政策的实际分配后果,往往不写在政策文本里,而写在表格、窗口时间与证明材料清单里。这项读数进入新的执行场:Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、(2025)在《Local capacity for policy development and implementation》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的税收、人员与执行覆盖构成的能力指数变成可比较对象。本条资料卡(1980)提出的旧对象在2021年被改造成税收、人员与执行覆盖构成的能力指数除以行政区;税收、人员与执行覆盖构成的能力新增了可被数据推翻的分母。
一个反复出现的结论是——同样的政策在不同行政能力的地方效果差别,往往大于不同政策之间的差别。截至 2025 年仍在更新。相邻面板提供反方向切片:第478号《C2PA与内容来源凭证》结算另一生成层;《Beyond state capacity: bureaucratic performance, policy implementation and reform》仍以税收、人员与执行覆盖构成的能力指数对行政区辨向。两边若同时成立,税收、人员与执行覆盖构成的能会迫使首次事件与重复事件成为第三项(2021/2025)。
六、政治时机决定好证据能否成为政策Policy windows and evidence use
最后一条自我限制值得记下:即使证据完备,采纳与否仍取决于时机、联盟与叙事。2017 年的研究把政治时机决定好证据能否成为政策与证据发布至政策采用的月数除以成功议题直接相连。从原始终点看,Joshua Newman(2017)的《Debating the politics of evidence‐based policy》只在正式规则与非正式实践内解释证据发布至政策采用的月数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
证据本位运动早期的隐含假设——好证据会自动挤走坏政策——没有兑现。反事实只移动一项:证据发布至政策采用的月数是唯一决定项。在正式规则与非正式实践中拿走证据发布至政策采用的月数而结果仍同号,就否证《Debating the politics of evidence‐based policy》的机制解释(Joshua Newman,2017)。
这十年比较成熟的立场是把证据视为必要不充分:它的作用是缩小可辩护选项的范围,并在事后提供问责的凭据,而不是替代政治判断。Joshua Newman(2017)没有报告证据发布至政策采用的月数可跨样本搬用的点估计,本页不替《Debating the politics of evidence‐based policy》补造效应量。可证伪阈值预注册为R14=证据发布至政策采用的月数除以成功议题:R14>1.00倍才支持原方向,R14≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Joshua Newman(2017)的DOI提出笔与Neil McHugh(2022)的DOI近端笔。
把这一点讲清楚,反而让证据的地位更稳固——因为它不再承诺自己做不到的事。一旦关系与结果同步形成,网络相关越稳定,影响方向反而越难识别。边界条件在近端复核中显形:Tracey Barnett McElwee、Laura Danforth、Chri(2025)的《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》只在有试点与规模化对照的政策中的政治时机决定好证据能否成样本外与Joshua Newman(2017)形成反号;边界内的同号证据不被冒充为普遍定律。
证据之外的政治与时机,同样被纳入研究:政策窗口何时打开、问题如何被界定为需要行动、以及既得利益如何塑造方案。复核对象不再停在论文样本:Neil McHugh(2022)在《Eliciting public values on health inequalities: missing evidence for policy windows?》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的证据发布至政策采用的月数变成可比较对象。
这不是给证据本位泼冷水,而是承认证据只解决可行性问题,不解决可采纳性问题,而后者常常才是决定成败的那一半。截至 2022 年仍在更新。邻接条目改用另一分母:第495号《社会倾听:从监测谣言转向理解社区问题》结算另一生成层;《Debating the politics of evidence‐based policy》仍以证据发布至政策采用的月数对成功议题辨向。两边若同时成立,证据发布至政策采用的月数会迫使正式规则与非正式实践成为第三项(2017/2022)。到2022年,Neil McHugh把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于有试点与规模化对照的政策中的政治时机决定好证据能。
七、行政负担把合格权利变成未领取福利Administrative burden
政策写明的资格不等于实际得到的服务。2023 年的研究把行政负担把合格权利变成未领取福利与未申领合格者比例除以全部合格者直接相连。按主证据的时序,Sarah Giest、Annemarie Samuels(2023)的《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》只在成功、失败与退出内解释未申领合格者比例;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。未申领合格者比例除以全部合格者;这项证据只承担成功、失败与退出内的方向,不承担域外的统一量级。
读数未申领合格者比例需与学习、合规与心理成本共同降低政策到达率逐期对齐。可失败版本可以写成:未申领合格者比例是唯一决定项。在成功、失败与退出中拿走未申领合格者比例而结果仍同号,就否证《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》的机制解释(Sarah Giest、Annemarie Samuels,2023)。
2019 年后的研究把负担拆成学习、合规和心理 3 种成本,并用未申领率检验这些摩擦如何选择性排除最需要的人。Sarah Giest、Annemarie Samuels(2023)没有报告未申领合格者比例可跨样本搬用的点估计,本页不替《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》补造效应量。可证伪阈值预注册为R15=未申领合格者比例除以全部合格者:R15>1.00倍才支持原方向,R15≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2019 年后的研究把负担拆成学习、合规和心理 3 种成本,并用未申领率检验这些摩擦如何选择性排除最需要的人。反对笔改换了识别窗:Jill Nicholson-Crotty、Susan M. Miller、Lael(2021)的《Administrative burden, social construction, and public support for government programs》只在执行者与受益者均可分层的资料中的行政负担把合格权利变成未样本外与Sarah Giest、Annemarie Samuels(2023)形成反号;边界内的同号证据不被冒充为普遍定律。
就“行政负担把合格权利变成未领取福利”而言,行政负担把合格权利变成未领取福利的适用域落在全部合格者中可识别“行政负担把合格权利变成未领取福利”的观察单位,缺口单独登记。延伸证据改换了承载机构:Shai Alon、Momi Dahan(2025)在《The perceived power of clients, administrative burden and take-up of social benefits》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的未申领合格者比例变成可比较对象。
与“行政负担把合格权利变成未领取福利”相邻,2025 年以前的跨域别名是行政负担;未填部分是失败后未发表的试点对“格权利变成未领取福利”的影响。两块材料只共享条件场:第267号《公共创新实验室:政府需要保护试错的中间组织》结算另一生成层;《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》仍以未申领合格者比例对全部合格者辨向。两边若同时成立,未申领合格者比例会迫使成功、失败与退出成为第三项(2023/2025)。第267号《公共创新实验室:政府需要保护试错的中间组织》与《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》的分离线是执行者与受益者均可分层的资料中的行政负担把合格权利变成未:前者解释接口,后者解释未申领合格者比例。
八、街头官僚的裁量能修复也能扭曲规则Street level bureaucracy discretion
2023 年,一线人员并非政策管道,而是在资源有限时重新定义优先级。回到提出笔,Maayan Davidovitz、Nissim Cohen(2023)的《Politicians’ involvement in street-level policy implementation: Implications for social equity》只在高频与低频状态内解释同一规则下个案决定差异;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Maayan Davidovitz、Nissim Cohen(2023)的贡献不是再命名,而是把同一规则下个案决定差异放进一线单位这一可失败分母。
跨部门交接造成的损耗对“量能修复也能扭曲规则”的影响若扩大,时间压力、案量与专业规范塑造现场分类与同一规则下个案决定差异的对应就不再稳定。由此可反驳的说法是:同一规则下个案决定差异是唯一决定项。在高频与低频状态中拿走同一规则下个案决定差异而结果仍同号,就否证《Politicians’ involvement in street-level policy implementation: Implications for social equity》的机制解释(Maayan Davidovitz、Nissim Cohen,2023)。《Politicians’ involvement in street-level policy implementation: Implications for social equity》与《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》共同承认高频与低频状态会改变识别,但对同一规则下个案决定差异的方向给出不同承诺。
2020 年后的行政记录把相同申请在不同承办者间的差异量化,使裁量从访谈主题变成可估计变量。Maayan Davidovitz、Nissim Cohen(2023)没有报告同一规则下个案决定差异可跨样本搬用的点估计,本页不替《Politicians’ involvement in street-level policy implementation: Implications for social equity》补造效应量。可证伪阈值预注册为R16=同一规则下个案决定差异除以一线单位:R16>1.00倍才支持原方向,R16≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2020 年后的行政记录把相同申请在不同承办者间的差异量化,使裁量从访谈主题变成可估计变量。一旦成本转嫁给未观察者,表内收益越高,社会净收益反而越低。反例并不在同一格里:Patrick Bayer、Aykut Öztürk、Sergi Pardos-Pr(2026)的《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》只在具有明确成本和退出规则的干预中的街头官僚的裁量能修复也能样本外与Maayan Davidovitz、Nissim Cohen(2023)形成反号;边界内的同号证据不被冒充为普遍定律。
就“街头官僚的裁量能修复也能扭曲规则”而言,跨出当前样本时,先确认同一规则下个案决定差异除以一线单位仍指同一件事。制度接口随后移动:Yury Netrebin(2026)在《Policy Mixes for Regional Innovation Ecosystems: Specificities of Implementation》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的同一规则下个案决定差异变成可比较对象。
与“街头官僚的裁量能修复也能扭曲规则”相邻,沿适应性治理可追到相邻学科,沿跨部门交接造成的损耗对“量能修复也能扭曲规则”的影响则在 2026 年资料处中断。跨块接口不靠同名:第498号《政策简报:长度不是可用性的代理》结算另一生成层;《Politicians’ involvement in street-level policy implementation: Implications for social equity》仍以同一规则下个案决定差异对一线单位辨向。两边若同时成立,同一规则下个案决定差异会迫使高频与低频状态成为第三项(2023/2026)。到2026年,Yury Netrebin把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于具有明确成本和退出规则的干预中的街头官僚的裁量能。
九、适应性试验用阶段更新替代一次定案Adaptive policy experiments
2021 年,传统试验先冻结方案再等待结论,适应性设计则在预设规则下分阶段更新。沿着样本表,Philip Pallmann、Alasdair W. S. McPherson、C(2018)的《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》只在本地与跨境链条内解释每轮更新后分配至更优方案的比例;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
这里的中介是贝叶斯更新和停止规则在实施中持续调整干预,终点是每轮更新后分配至更优方案的比例。这把主张压成一条硬命题:每轮更新后分配至更优方案的比例是唯一决定项。在本地与跨境链条中拿走每轮更新后分配至更优方案的比而结果仍同号,就否证《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》的机制解释(Philip Pallmann、Alasdair W. S. McPherson、C,2018)。未申请的合格人群对阶段更新替代一次定案的影响没有进入每轮更新后分配至更优方案的比例的中心读数,这正是《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》最容易被过度外推的地方。
2021 年后政府试点开始报告至少 2 类门槛:何时停止无效方案,何时扩大更优方案。;分母取参与者中可识别“适应性试验用阶段更新替代一次定案”的观察单位。Philip Pallmann、Alasdair W. S. McPherson、C(2018)没有报告每轮更新后分配至更优方案的比例可跨样本搬用的点估计,本页不替《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》补造效应量。可证伪阈值预注册为R17=每轮更新后分配至更优方案的比例除以参与者:R17>1.00倍才支持原方向,R17≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Radek Kovács、Arnošt Veselý(2026)若改变参与者的构成,提出笔的方向必须重新估计,不能沿用旧系数。
2021 年后政府试点开始报告至少 2 类门槛:何时停止无效方案,何时扩大更优方案。在低基线人群中,曝光越多,边际改变却越接近零。两篇论文的冲突要用同终点辨认:M.A. Shulha(2021)的《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》只在行政流程和结果能链接的公共项目中的适应性试验用阶段更新替代样本外与Philip Pallmann、Alasdair W. S. McPherson、C(2018)形成反号;边界内的同号证据不被冒充为普遍定律。
就“适应性试验用阶段更新替代一次定案”而言,最低可比条件是保留参与者中可识别“适应性试验用阶段更新替代一次定案”的观察单位,否则方向含混。近端研究把尺度推远:Radek Kovács、Arnošt Veselý(2026)在《Survey Experiments in Public Policy: A Systematic Literature Review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的每轮更新后分配至更优方案的比例变成可比较对象。
与“适应性试验用阶段更新替代一次定案”相邻,实施科学解决名称对应,未解决未申请的合格人群对“阶段更新替代一次定案”的影响;后者到 2026 年仍是缺口。对撞发生在相同前提下:第557号《ERIC实施策略目录》结算另一生成层;《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》仍以每轮更新后分配至更优方案的比例对参与者辨向。两边若同时成立,每轮更新后分配至更优方案的比会迫使本地与跨境链条成为第三项(2018/2026)。
十、危机政策要求速度与可学习性同时存在Rapid policy learning
2025 年,危机时等待完美证据等于不作为,但没有版本记录的快速调整又无法学习。把概念史与估计拆开,Donald P. Moynihan(2008)的《Learning under Uncertainty: Networks in Crisis Management》只在公开承诺与实际行动内解释政策调整周期与结果反馈时延;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
政策调整周期与结果反馈时延仅在实时行政资料和版本记录把紧急调整变成连续学习可追踪时有机制含义。真正需要承担因果责任的是:政策调整周期与结果反馈时延是唯一决定项。在公开承诺与实际行动中拿走政策调整周期与结果反馈时延而结果仍同号,就否证《Learning under Uncertainty: Networks in Crisis Management》的机制解释(Donald P. Moynihan,2008)。
2021 年研究以天或周为单位对照政策版本、执行覆盖和结果,保留可逆决策的证据链。Donald P. Moynihan(2008)没有报告政策调整周期与结果反馈时延可跨样本搬用的点估计,本页不替《Learning under Uncertainty: Networks in Crisis Management》补造效应量。可证伪阈值预注册为R18=政策调整周期与结果反馈时延除以危机措施:R18>1.00倍才支持原方向,R18≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2021 年研究以天或周为单位对照政策版本、执行覆盖和结果,保留可逆决策的证据链。一旦反馈触发自我修正,早期误差越大,后期方向反而可能逆转。争论的分水岭落到样本边缘:Дмитро Іванович Ткач、Дмитро Костянтинович (2026)的《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》只在有试点与规模化对照的政策中的危机政策要求速度与可学习样本外与Donald P. Moynihan(2008)形成反号;边界内的同号证据不被冒充为普遍定律。对议程、工具组合、执行能力、反馈、政策学习与分配后果分别分层后,政策调整周期与结果反馈时延若只在中心组存在,原命题就必须缩域。
就“危机政策要求速度与可学习性同时存在”而言,这条经验限于危机政策要求速度与可学习性同时存在,没有覆盖一线人员的隐性变通对“度与可学习性同时存在”的影响的路径。这项读数进入新的执行场:Dedi Wiratmo、Mutia Evi Kristhy、M. Nur Syam(2022)在《Government policy analysis in health crisis conditions》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的政策调整周期与结果反馈时延变成可比较对象。
与“危机政策要求速度与可学习性同时存在”相邻,截至 2022 年,一线人员的隐性变通对“度与可学习性同时存在”的影响没有统一口径,尽管邻域已称作政策学习。相邻面板提供反方向切片:第605号《乌克兰数字现金:规模化支付也要保留人工通道》结算另一生成层;《Learning under Uncertainty: Networks in Crisis Management》仍以政策调整周期与结果反馈时延对危机措施辨向。两边若同时成立,政策调整周期与结果反馈时延会迫使公开承诺与实际行动成为第三项(2008/2022)。
十一、算法治理把采购条款变成问责入口Algorithmic accountability in government
公共算法常由外部供应商建造,责任却落在政府。2025 年的研究把算法治理把采购条款变成问责入口与完成影响评估和外部审计的系统数除以在用系统直接相连。从原始终点看,Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)的《Artificial Intelligence and the Public Sector: Applications and Challenges》只在平均组与分布尾部内解释完成影响评估和外部审计的系统数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
把采购、数据说明和申诉接口共同决定公共算法可问责性和完成影响评估和外部审计的系统数分别编码。反事实只移动一项:完成影响评估和外部审计的系统数是唯一决定项。在平均组与分布尾部中拿走完成影响评估和外部审计的系统而结果仍同号,就否证《Artificial Intelligence and the Public Sector: Applications and Challenges》的机制解释(Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye,2019)。
2023 年后的框架把采购合同、训练数据说明、分群误差和申诉渠道至少列为 4 个审计入口。Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)没有报告完成影响评估和外部审计的系统数可跨样本搬用的点估计,本页不替《Artificial Intelligence and the Public Sector: Applications and Challenges》补造效应量。可证伪阈值预注册为R19=完成影响评估和外部审计的系统数除以在用系统:R19>1.00倍才支持原方向,R19≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2023 年后的框架把采购合同、训练数据说明、分群误差和申诉渠道至少列为 4 个审计入口。一旦分母排除最难触达者时,成功率越高,公平性反而越差。边界条件在近端复核中显形:Karem Sayed Aboelazm(2026)的《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》只在执行者与受益者均可分层的资料中的算法治理把采购条款变成问样本外与Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)形成反号;边界内的同号证据不被冒充为普遍定律。
就“算法治理把采购条款变成问责入口”而言,完成影响评估和外部审计的系统数仅在原分母内可解释,边外不可原样搬用。复核对象不再停在论文样本:Alhassan Musah、Adu Peprah James、Matilda As(2025)在《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的完成影响评估和外部审计的系统数变成可比较对象。在政策文本、预算执行、行政登记、实施过程与受益者申诉里,Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)留下的可复查接口是完成影响评估和外部审计的系统数,而不是条目标题本身。
与“算法治理把采购条款变成问责入口”相邻,失败后未发表的试点对“采购条款变成问责入口”的影响是当前遗漏项;行政负担只是其相邻称谓,记录止于 2025 年。邻接条目改用另一分母:第416号《数据访问权替代绝对数据所有权》结算另一生成层;《Artificial Intelligence and the Public Sector: Applications and Challenges》仍以完成影响评估和外部审计的系统数对在用系统辨向。两边若同时成立,完成影响评估和外部审计的系统会迫使平均组与分布尾部成为第三项(2019/2025)。
十二、政策组合必须检验相互作用而非逐项相加Policy mixes
2026 年,公共政策的新思想是:问题从「什么有效」变成了「在哪里、多大规模、由谁执行时还有效」。按主证据的时序,Karoline S. Rogge、Kristin Reichardt(2016)的《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》只在原始编码与修订编码内解释组合效应减去单项效应之和;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
核心过程为互补、替代与时序关系让多项政策产生非加总结果。可失败版本可以写成:组合效应减去单项效应之和是唯一决定项。在原始编码与修订编码中拿走组合效应减去单项效应之和而结果仍同号,就否证《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》的机制解释(Karoline S. Rogge、Kristin Reichardt,2016)。
政策组合必须检验相互作用而非逐项相加在 2024 年用组合效应减去单项效应之和除以政策对象留下第 20 组可比读数。Karoline S. Rogge、Kristin Reichardt(2016)没有报告组合效应减去单项效应之和可跨样本搬用的点估计,本页不替《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》补造效应量。可证伪阈值预注册为R20=组合效应减去单项效应之和除以政策对象:R20>1.00倍才支持原方向,R20≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
而文献里那个漂亮的平均效应,多半是发表偏倚与小样本一起制造的。一旦多种机制方向相反,样本越大,平均效应反而越接近零。反对笔改换了识别窗:Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等(2026)的《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》只在具有明确成本和退出规则的干预中的政策组合必须检验相互作用样本外与Karoline S. Rogge、Kristin Reichardt(2016)形成反号;边界内的同号证据不被冒充为普遍定律。
就“政策组合必须检验相互作用而非逐项相加”而言,向其他人群推广前,先补齐跨部门交接造成的损耗对“相互作用而非逐项相加”的影响的独立证据。延伸证据改换了承载机构:Naomi Di Santo、Teresa Del Giudice、Roberta (2024)在《Policy mixes in rural areas: a scoping literature review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的组合效应减去单项效应之和变成可比较对象。本条资料卡(1980)提出的旧对象在2016年被改造成组合效应减去单项效应之和除以政策对象;组合效应减去单项效应之和新增了可被数据推翻的分母。
与“政策组合必须检验相互作用而非逐项相加”相邻,邻接术语写作适应性治理。2024 年的未完成项仍是跨部门交接造成的损耗对“相互作用而非逐项相加”的影响。两块材料只共享条件场:第478号《水印与检测的脆弱性》结算另一生成层;《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》仍以组合效应减去单项效应之和对政策对象辨向。两边若同时成立,组合效应减去单项效应之和会迫使原始编码与修订编码成为第三项(2016/2024)。第478号《水印与检测的脆弱性》与《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》的分离线是具有明确成本和退出规则的干预中的政策组合必须检验相互作用:前者解释接口,后者解释组合效应减去单项效应之和。
◎ 二十年连起来看
《证据本位从医学扩散到政府决策》与《证据本位胜利后面临选择性使用》构成第1条时间线:Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)先改写政策文件中系统综述或因果评估引用率,Tracey Barnett McElwee、Laura Danforth、Chri(2025)再把裁决移到被采用研究与全部合格研究之比。样本来源与纳入路径与信息可见度须分账。
《行为团队把默认选项做成低成本干预》与《国家能力重新进入政策效果函数》构成第2条时间线:Paul Dolan、Michael Hallsworth、David Halper(2012)先改写干预组相对对照组完成率差,Martin J. Williams(2021)再把裁决移到税收、人员与执行覆盖构成的能力指数。处理暴露强度与首次事件与重复事件须分账。
《共同生产把公民从受益者变成执行者》与《二、政策组合必须检验相互作用而非逐项相加》构成第3条时间线:Tony Bovaird(2007)先改写由使用者共同完成的服务环节数,Karoline S. Rogge、Kristin Reichardt(2016)再把裁决移到组合效应减去单项效应之和。组织规模与原始编码与修订编码须分账。
◎ 三个常见误解
第1个误解是把《证据本位从医学扩散到政府决策》当成《证据本位胜利后面临选择性使用》的否定;两者看似都谈政策文件中系统综述或因果评估引用率。前者用政策文件中系统综述或因果评估引用率/可评文件,后者用被采用研究与全部合格研究之比/政策议题,分母不同,不能把尺度差写成理论冲突。
第2个误解是把《行为团队把默认选项做成低成本干预》当成《国家能力重新进入政策效果函数》的否定;两者看似都谈干预组相对对照组完成率差。前者用干预组相对对照组完成率差/被触达者,后者用税收、人员与执行覆盖构成的能力指数/行政区,分母不同,不能把尺度差写成理论冲突。
第3个误解是把《共同生产把公民从受益者变成执行者》当成《二、政策组合必须检验相互作用而非逐项相加》的否定;两者看似都谈由使用者共同完成的服务环节数。前者用由使用者共同完成的服务环节数/服务流程,后者用组合效应减去单项效应之和/政策对象,分母不同,不能把尺度差写成理论冲突。
◎ 与相邻领域的接口
第267号《审议浪潮:公民大会把参与从表达意见推进到共同》与本块在短窗与长窗处分工:这里追踪按方案完成的核心环节数/计划环节,公共管理与政府治理解释另一生成层。Joseph A. Durlak、Emily P. DuPre(2008)换用对方分母后须重估符号。
第498号《What Works中心》与本块在公开承诺与实际行动处分工:这里追踪政策调整周期与结果反馈时延/危机措施,智库与政策知识生产解释另一生成层。Donald P. Moynihan(2008)换用对方分母后须重估符号。
第557号《阶梯楔形整群试验》与本块在样本进入路径处分工:这里追踪具有基线和对照的项目数/受资助项目,学习型医疗系统与实施科学解释另一生成层。Howard White(2009)换用对方分母后须重估符号。
◎ 争议现场
Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)与R. Andrew Moore(2006)围绕《证据本位从医学扩散到政府决策》未收敛。以政策文件中系统综述或因果评估引用率/可评文件为共同终点;在行政流程和结果能链接的公共项目中的证据本位从医学扩散到政府样本外稳定反号,才淘汰原解释。
Paul Dolan、Michael Hallsworth、David Halper(2012)与David Halpern、Michael Sanders(2016)围绕《行为团队把默认选项做成低成本干预》未收敛。以干预组相对对照组完成率差/被触达者为共同终点;在具有明确成本和退出规则的干预中的行为团队把默认选项做成低样本外稳定反号,才淘汰原解释。
Tony Bovaird(2007)与T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. P(2015)围绕《共同生产把公民从受益者变成执行者》未收敛。以由使用者共同完成的服务环节数/服务流程为共同终点;在具有明确成本和退出规则的干预中的共同生产把公民从受益者变样本外稳定反号,才淘汰原解释。
◎ 往下五年看什么
2026—2031年追踪政策文件中系统综述或因果评估引用率/可评文件。政策文本、预算执行、行政登记、实施过程与受益者申诉保存样本来源与纳入路径、退出和版本;读数若随纳入规则翻转,《证据本位从医学扩散到政府决策》即降级。
2026—2031年追踪干预组相对对照组完成率差/被触达者。政策文本、预算执行、行政登记、实施过程与受益者申诉保存处理暴露强度、退出和版本;读数若随纳入规则翻转,《行为团队把默认选项做成低成本干预》即降级。
2026—2031年追踪由使用者共同完成的服务环节数/服务流程。政策文本、预算执行、行政登记、实施过程与受益者申诉保存组织规模、退出和版本;读数若随纳入规则翻转,《共同生产把公民从受益者变成执行者》即降级。
◎ 可与哪些领域对撞
本块第1条《证据本位从医学扩散到政府决策》对撞第267号《审议浪潮:公民大会把参与从表达意见推进到共同》。共享预设是“01 谁进入分母”。本块以政策文件中系统综述或因果评估引用率辨向,对方从公共管理与政府治理解释生成路径。若两边都成立,矛盾迫使模型新增未入账的政策学习退出与阴性个案。
本块第4条《行为团队把默认选项做成低成本干预》对撞第498号《What Works中心》。共享预设是“02 单一读数代表复杂对象”。本块以干预组相对对照组完成率差辨向,对方从智库与政策知识生产解释生成路径。若两边都成立,矛盾迫使模型新增未入账的工具组合退出与阴性个案。
本块第8条《共同生产把公民从受益者变成执行者》对撞第557号《阶梯楔形整群试验》。共享预设是“02 单一读数代表复杂对象”。本块以由使用者共同完成的服务环节数辨向,对方从学习型医疗系统与实施科学解释生成路径。若两边都成立,矛盾迫使模型新增未入账的分配后果退出与阴性个案。
◎ 十条可做的研究命题
- 命题 1:《证据本位从医学扩散到政府决策》与《实施链解释政策为何在现场缩水》分账后,政策文件中系统综述或因果评估引用率/可评文件应保持2014年方向。用预注册分群复算并单列未入账的政策学习退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
- 命题 2:《随机试验进入发展与社会政策》与《平均处理效应让位于分群效应》分账后,随机分派后的平均处理效应/合格对象应保持2006年方向。用连接行政记录与过程日志并单列未入账的分配后果退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。
- 命题 3:《绩效指标越成功越可能替代真实目》与《国家能力重新进入政策效果函数》分账后,指标改善与真实结果改善之差/考核单位应保持2006年方向。用设置跨制度成对比较并单列未入账的议程退出与阴性个案;越过执行者与受益者均可分层的资料后复算反号即证伪。
- 命题 4:《行为团队把默认选项做成低成本干》与《政治时机决定好证据能否成为政策》分账后,干预组相对对照组完成率差/被触达者应保持2012年方向。用保留退出者重估分母并单列未入账的工具组合退出与阴性个案;越过具有明确成本和退出规则的干预后复算反号即证伪。
- 命题 5:《影响评估进入援助项目问责链》与《行政负担把合格权利变成未领取福》分账后,具有基线和对照的项目数/受资助项目应保持2009年方向。用用两套盲法编码复核并单列未入账的执行能力退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
- 命题 6:《规模化失败提示情境与执行不可省》与《街头官僚的裁量能修复也能扭曲规》分账后,规模实施效应相对试点效应保留率/同类项目应保持2017年方向。用并列短窗与长窗并单列未入账的反馈退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。
- 命题 7:《政策转移必须区分机制与表面形式》与《适应性试验用阶段更新替代一次定》分账后,移植后保留的核心机制数/政策组件应保持2012年方向。用拆开中心与尾部样本并单列未入账的政策学习退出与阴性个案;越过执行者与受益者均可分层的资料后复算反号即证伪。
- 命题 8:《共同生产把公民从受益者变成执行》与《危机政策要求速度与可学习性同时》分账后,由使用者共同完成的服务环节数/服务流程应保持2007年方向。用追踪首次与重复事件并单列未入账的分配后果退出与阴性个案;越过具有明确成本和退出规则的干预后复算反号即证伪。
- 命题 9:《证据本位胜利后面临选择性使用》与《一、算法治理把采购条款变成问责》分账后,被采用研究与全部合格研究之比/政策议题应保持2025年方向。用对照公开承诺与实际行动并单列未入账的议程退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
- 命题 10:《规模化效应普遍低于小样本试点》与《二、政策组合必须检验相互作用而》分账后,规模化效应除以原试点效应/项目地点应保持2026年方向。用保存原始与修订版本并单列未入账的工具组合退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。
◎ 参考文献 · 原始提出、争议与近端复核
- Kathryn Oliver、Simon Innvar、Theo Lorenc 等,2014,《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》,BMC Health Services Research 14:2,DOI 10.1186/1472-6963-14-2
- R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122
- Saiqa Noor、Saquib Khushhal、Aleena Amjad、Asim Aqil,2025,《Using AI to Inform Evidence-based Decision-Making in Educational Policy》,Review of Applied Management and Social Sciences 8(1):183–192,DOI 10.47067/ramss.v8i1.448
- Herbert A. Simon,1947,《Administrative Behavior》
- Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001
- Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751
- Radek Kovács、Arnošt Veselý,2026,《Survey Experiments in Public Policy: A Systematic Literature Review》,Review of Policy Research 43(2),DOI 10.1111/ropr.70040
- Harold D. Lasswell & Daniel Lerner,1951,《The Policy Sciences》
- Gwyn Bevan、Christopher Hood,2006,《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》,Public Administration 84(3):517–538,DOI 10.1111/j.1467-9299.2006.00600.x
- Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272
- Léon Acar,2026,《Digital Co-Production of Public Services》,International Journal of Public Administration:1–2,DOI 10.1080/01900692.2026.2669804
- Charles E. Lindblom,1959,〈The Science of Muddling Through〉
- Paul Dolan、Michael Hallsworth、David Halpern 等,2012,《Influencing Behaviour: The Mindspace Way》,Journal of Economic Psychology 33(1):264–277,DOI 10.1016/j.joep.2011.10.009
- David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015
- Camila Regueiro-Ons、Jaime Pinilla、Beatriz González López-Valcárcel,2026,《Fertility response to family policy: Insights from Spain’s paternity leave》,Applied Economic Analysis 34(100):38–60,DOI 10.1108/aea-06-2025-0197
- James G. March & Herbert A. Simon,1958,《Organizations》
- Howard White,2009,《Theory-Based Impact Evaluation: Principles and Practice》,Journal of Development Effectiveness 1(3):271–284,DOI 10.1080/19439340903114628
- Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701
- Alhassan Musah、Adu Peprah James、Matilda Asiedu-Ampomah、Felicia Koomson,2025,《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》,Journal of Governance and Accountability Studies 5(1):63–77,DOI 10.35912/jgas.v5i1.1253
- Graham T. Allison,1971,《Essence of Decision》
- Karthik Muralidharan、Paul Niehaus,2017,《Experimentation at Scale》,Journal of Economic Perspectives 31(4):103–124,DOI 10.1257/jep.31.4.103
- Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026
- Imran Rasul,2026,《From field experiments to policy interventions at scale》,Science,DOI 10.1126/science.aef8482
- Jeffrey L. Pressman & Aaron Wildavsky,1973,《Implementation》
- Diane Stone,2012,《Transfer and translation of policy》,Policy Studies:483–499,DOI 10.1080/01442872.2012.695933
- Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783
- Alireza Jazini,2021,《Translation policy》,Translation and Translanguaging in Multilingual Contexts 7(3):339–369,DOI 10.1075/ttmc.00077.jaz
- Donald T. Campbell,1976,〈Assessing the Impact of Planned Social Change〉
- Tony Bovaird,2007,《Beyond Engagement and Participation: User and Community Coproduction of Public Services》,Public Administration Review 67(5):846–860,DOI 10.1111/j.1540-6210.2007.00773.x
- T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567
- Chunsheng Li、Jinpeng Wu、Huiming Zhang、Zhiming Han,2023,《Co-production and Citizens’ Satisfaction with Public Services: The Case of Environmental Public Services in China》,Lex localis - Journal of Local Self-Government 21(1):117–142,DOI 10.4335/21.1.117-142(2023)
- Mancur Olson,1965,《The Logic of Collective Action》
- Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163
- John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693
- Vesna Trifunović、Stuart Blume,2023,《Which vaccine? Between evidence-based policy and symbolic politics》,Critical Public Health 33(5):864–869,DOI 10.1080/09581596.2023.2289346
- Joseph A. Durlak、Emily P. DuPre,2008,《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》,American Journal of Community Psychology 41:327–350,DOI 10.1007/s10464-008-9165-0
- Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607
- I Iskandar,2020,《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》,International Journal of Humanities and Innovation (IJHI) 3(2):50–55,DOI 10.33750/ijhi.v3i2.79
- Kosuke Imai、Marc Ratkovic,2013,《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》,Annals of Applied Statistics 7(1):443–470,DOI 10.1214/12-AOAS593
- Ilja Cornelisz、Chris van Klaveren,2022,《Recurrent individual treatment assignment: a treatment policy approach to account for heterogeneous treatment effects》,npj Science of Learning 7(1),DOI 10.1038/s41539-021-00117-4
- Martin J. Williams,2021,《Beyond state capacity: bureaucratic performance, policy implementation and reform》,Journal of Institutional Economics:339–357,DOI 10.1017/s1744137420000478
- Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15
- Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、Kidist Bartolomeos,2025,《Local capacity for policy development and implementation》,Bulletin of the World Health Organization 103(7):415–415A,DOI 10.2471/blt.25.294222
- Joshua Newman,2017,《Debating the politics of evidence‐based policy》,Public Administration:1107–1112,DOI 10.1111/padm.12373
- Neil McHugh,2022,《Eliciting public values on health inequalities: missing evidence for policy windows?》,Evidence & Policy 18(4):733–745,DOI 10.1332/174426421x16286783870175
- Sarah Giest、Annemarie Samuels,2023,《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》,Review of Policy Research:626–645,DOI 10.1111/ropr.12516
- Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193
- Shai Alon、Momi Dahan,2025,《The perceived power of clients, administrative burden and take-up of social benefits》,European Journal of Social Security 27(3):251–275,DOI 10.1177/13882627251372026
- Maayan Davidovitz、Nissim Cohen,2023,《Politicians’ involvement in street-level policy implementation: Implications for social equity》,Public Policy and Administration:309–328,DOI 10.1177/09520767211024033
- Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755
- Yury Netrebin,2026,《Policy Mixes for Regional Innovation Ecosystems: Specificities of Implementation》,Science Management: Theory and Practice:143–157,DOI 10.19181/smtp.2026.8.1.8
- Philip Pallmann、Alasdair W. S. McPherson、Christopher J. Brocklehurst 等,2018,《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》,BMC Medicine 16:29,DOI 10.1186/s12916-018-1017-7
- M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14
- Donald P. Moynihan,2008,《Learning under Uncertainty: Networks in Crisis Management》,Public Administration Review 68(2):350–365,DOI 10.1111/j.1540-6210.2007.00867.x
- Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43
- Dedi Wiratmo、Mutia Evi Kristhy、M. Nur Syam、Agung Gunawan Putra,2022,《Government policy analysis in health crisis conditions》,International journal of health sciences 6(2):920–930,DOI 10.53730/ijhs.v6n2.8785
- Bernd W. Wirtz、Jan C. Weyerer、Carolin Geyer,2019,《Artificial Intelligence and the Public Sector: Applications and Challenges》,International Journal of Public Administration 42(7):596–615,DOI 10.1080/01900692.2018.1498103
- Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519
- Karoline S. Rogge、Kristin Reichardt,2016,《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》,Research Policy 45(8):1620–1635,DOI 10.1016/j.respol.2016.04.004
- Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405
- Naomi Di Santo、Teresa Del Giudice、Roberta Sisto,2024,《Policy mixes in rural areas: a scoping literature review》,RIVISTA DI ECONOMIA AGRARIA 79(3):83–99,DOI 10.36253/rea-15149
以下二十条倒着追问公共政策的现代判断:旧前提由谁提出、凭什么材料成立、后来在哪个分母上被修正。每条都回指上文一条现代思想,并把失效条件与异名接口一并保留。
经一、政策科学的跨学科计划Classic 01 · Public Policy
1951年的《政策科学的跨学科计划》不是名人标签。Harold D. Lasswell、Daniel Lerner沿机制史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《政策科学的跨学科计划》的阴性对象与退出记录由此能在同一账本重算。
R. Andrew Moore,2006,《Evidence-based policy-making》,Clinic…后来反向校验《政策科学的跨学科计划》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块甲对读。现代关键读数是“政策文件中系统综述或因果评估引用率/可评文件”。它说明《政策科学的跨学科计划》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《政策科学的跨学科计划》的新证据。核验《政策科学的跨学科计划》时须同时保存它没有解释的对象,不能只汇集成功分支。
经二、组织中的决策与程序Classic 02 · Public Policy
《组织中的决策与程序》出现前,公共政策常把同名现象当作同一对象。James G. March、Herbert A. Simon于1958年沿机制史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《组织中的决策与程序》改变的是判决程序,不是增加一条永远正确的结论。
Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment …把《组织中的决策与程序》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块乙仍借用这套接口;其中关键读数是“随机分派后的平均处理效应/合格对象”。《组织中的决策与程序》若改用另一分母,结论就可能反号。《组织中的决策与程序》因此成为现代条目的历史压力测试。核验《组织中的决策与程序》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《组织中的决策与程序》须注明采用哪一版定义,同名术语不等于同一证据单位。
经三、渐进主义与摸着石头过河Classic 03 · Public Policy
《渐进主义与摸着石头过河》在1959年造成的转向首先是一项机制史选择。Charles E. Lindblom把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《渐进主义与摸着石头过河》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in …缩窄或改写了《渐进主义与摸着石头过河》。它连接本块丙时,现代证据“指标改善与真实结果改善之差/考核单位”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《渐进主义与摸着石头过河》的外推,而不是替经典找托词。核验《渐进主义与摸着石头过河》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《渐进主义与摸着石头过河》须注明采用哪一版定义,同名术语不等于同一证据单位。
经四、集体行动与选择性激励Classic 04 · Public Policy
Mancur Olson在1965年的《集体行动与选择性激励》为公共政策留下机制史装置:公开对象怎样进入分母,并把例外放在模型内。《集体行动与选择性激励》以前的争论容易把测量便利当成本体事实;《集体行动与选择性激励》使两者能够分账。《集体行动与选择性激励》成为经典,靠的是接受反例修订。
用David Halpern、Michael Sanders,2016,《Nudging by government:…回看《集体行动与选择性激励》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块丁保存这条差异;关键判断是“干预组相对对照组完成率差/被触达者”。它把《集体行动与选择性激励》的失败对象送回比较。《集体行动与选择性激励》的旧前提由本块检验证据成本。核验《集体行动与选择性激励》时须同时保存它没有解释的对象,不能只汇集成功分支。
经五、决策模型与古巴导弹危机Classic 05 · Public Policy
1971年的《决策模型与古巴导弹危机》不是名人标签。Graham T. Allison沿机制史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《决策模型与古巴导弹危机》的阴性对象与退出记录由此能在同一账本重算。
Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasil…后来反向校验《决策模型与古巴导弹危机》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块戊对读。现代关键读数是“具有基线和对照的项目数/受资助项目”。它说明《决策模型与古巴导弹危机》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《决策模型与古巴导弹危机》的新证据。核验《决策模型与古巴导弹危机》时须同时保存它没有解释的对象,不能只汇集成功分支。
经六、执行研究Classic 06 · Public Policy
《执行研究》出现前,公共政策常把同名现象当作同一对象。Jeffrey L. Pressman、Aaron Wildavsky于1973年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《执行研究》改变的是判决程序,不是增加一条永远正确的结论。
Murali Krishna Pasupuleti,2026,《Distributional Policy Eval…把《执行研究》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块己仍借用这套接口;其中关键读数是“规模实施效应相对试点效应保留率/同类项目”。《执行研究》若改用另一分母,结论就可能反号。《执行研究》因此成为现代条目的历史压力测试。核验《执行研究》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《执行研究》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《执行研究》应先冻结分母和停止规则,再比较旧读数与新读数。
经七、实验社会与政策评估Classic 07 · Public Policy
《实验社会与政策评估》在1976年造成的转向首先是一项测量史选择。Donald T. Campbell把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《实验社会与政策评估》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Tolga Duygun,2020,《Policy translation in Turkish disabilit…缩窄或改写了《实验社会与政策评估》。它连接本块庚时,现代证据“移植后保留的核心机制数/政策组件”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《实验社会与政策评估》的外推,而不是替经典找托词。核验《实验社会与政策评估》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《实验社会与政策评估》须注明采用哪一版定义,同名术语不等于同一证据单位。
经八、多源流与政策窗口Classic 08 · Public Policy
John W. Kingdon在1984年的《多源流与政策窗口》为公共政策留下测量史装置:公开对象怎样进入分母,并把例外放在模型内。《多源流与政策窗口》以前的争论容易把测量便利当成本体事实;《多源流与政策窗口》使两者能够分账。《多源流与政策窗口》成为经典,靠的是接受反例修订。
用T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Act…回看《多源流与政策窗口》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块辛保存这条差异;关键判断是“由使用者共同完成的服务环节数/服务流程”。它把《多源流与政策窗口》的失败对象送回比较。《多源流与政策窗口》的旧前提由本块检验证据成本。核验《多源流与政策窗口》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《多源流与政策窗口》须注明采用哪一版定义,同名术语不等于同一证据单位。
经九、倡议联盟框架Classic 09 · Public Policy
1988年的《倡议联盟框架》不是名人标签。Paul A. Sabatier沿测量史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《倡议联盟框架》的阴性对象与退出记录由此能在同一账本重算。
John Humphreys,2025,《The politics of an Alien Monster: Ret…后来反向校验《倡议联盟框架》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块一对读。现代关键读数是“被采用研究与全部合格研究之比/政策议题”。它说明《倡议联盟框架》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《倡议联盟框架》的新证据。核验《倡议联盟框架》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《倡议联盟框架》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十、制度分析与发展框架Classic 10 · Public Policy
《制度分析与发展框架》出现前,公共政策常把同名现象当作同一对象。Elinor Ostrom于1990年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《制度分析与发展框架》改变的是判决程序,不是增加一条永远正确的结论。
Jennifer L. Romich,2006,《Randomized social policy experime…把《制度分析与发展框架》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块二仍借用这套接口;其中关键读数是“规模化效应除以原试点效应/项目地点”。《制度分析与发展框架》若改用另一分母,结论就可能反号。《制度分析与发展框架》因此成为现代条目的历史压力测试。核验《制度分析与发展框架》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《制度分析与发展框架》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十一、语言游戏与规则使用Classic 11 · Public Policy
《语言游戏与规则使用》在1953年造成的转向首先是一项制度史选择。Ludwig Wittgenstein把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《语言游戏与规则使用》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Mikael Persson、Anders Sundell,2025,《Ideological bias in po…缩窄或改写了《语言游戏与规则使用》。它连接本块三时,现代证据“按方案完成的核心环节数/计划环节”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《语言游戏与规则使用》的外推,而不是替经典找托词。核验《语言游戏与规则使用》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《语言游戏与规则使用》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十二、社会理论与中层机制Classic 12 · Public Policy
Robert K. Merton在1957年的《社会理论与中层机制》为公共政策留下制度史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论与中层机制》以前的争论容易把测量便利当成本体事实;《社会理论与中层机制》使两者能够分账。《社会理论与中层机制》成为经典,靠的是接受反例修订。
用Murali Krishna Pasupuleti,2026,《Distributional Policy Eval…回看《社会理论与中层机制》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块四保存这条差异;关键判断是“分群处理效应极差/预注册子群”。它把《社会理论与中层机制》的失败对象送回比较。《社会理论与中层机制》的旧前提由本块检验证据成本。核验《社会理论与中层机制》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《社会理论与中层机制》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十三、日常生活中的自我呈现Classic 13 · Public Policy
1959年的《日常生活中的自我呈现》不是名人标签。Erving Goffman沿制度史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《日常生活中的自我呈现》的阴性对象与退出记录由此能在同一账本重算。
Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Des…后来反向校验《日常生活中的自我呈现》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块五对读。现代关键读数是“税收、人员与执行覆盖构成的能力指数/行政区”。它说明《日常生活中的自我呈现》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《日常生活中的自我呈现》的新证据。核验《日常生活中的自我呈现》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十四、范式与科学共同体Classic 14 · Public Policy
《范式与科学共同体》出现前,公共政策常把同名现象当作同一对象。Thomas S. Kuhn于1962年沿制度史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《范式与科学共同体》改变的是判决程序,不是增加一条永远正确的结论。
Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myt…把《范式与科学共同体》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块六仍借用这套接口;其中关键读数是“证据发布至政策采用的月数/成功议题”。《范式与科学共同体》若改用另一分母,结论就可能反号。《范式与科学共同体》因此成为现代条目的历史压力测试。核验《范式与科学共同体》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《范式与科学共同体》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十五、正义的制度排序Classic 15 · Public Policy
《正义的制度排序》在1971年造成的转向首先是一项制度史选择。John Rawls把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《正义的制度排序》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,…缩窄或改写了《正义的制度排序》。它连接本块七时,现代证据“未申领合格者比例/全部合格者”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《正义的制度排序》的外推,而不是替经典找托词。核验《正义的制度排序》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《正义的制度排序》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《正义的制度排序》应先冻结分母和停止规则,再比较旧读数与新读数。
经十六、深描与文化解释Classic 16 · Public Policy
Clifford Geertz在1973年的《深描与文化解释》为公共政策留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《深描与文化解释》以前的争论容易把测量便利当成本体事实;《深描与文化解释》使两者能够分账。《深描与文化解释》成为经典,靠的是接受反例修订。
用Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climat…回看《深描与文化解释》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块八保存这条差异;关键判断是“同一规则下个案决定差异/一线单位”。它把《深描与文化解释》的失败对象送回比较。《深描与文化解释》的旧前提由本块检验证据成本。核验《深描与文化解释》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《深描与文化解释》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十七、规训、记录与可治理身体Classic 17 · Public Policy
1975年的《规训、记录与可治理身体》不是名人标签。Michel Foucault沿人物史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《规训、记录与可治理身体》的阴性对象与退出记录由此能在同一账本重算。
M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED …后来反向校验《规训、记录与可治理身体》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块九对读。现代关键读数是“每轮更新后分配至更优方案的比例/参与者”。它说明《规训、记录与可治理身体》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《规训、记录与可治理身体》的新证据。核验《规训、记录与可治理身体》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十八、区分、品味与社会再生产Classic 18 · Public Policy
《区分、品味与社会再生产》出现前,公共政策常把同名现象当作同一对象。Pierre Bourdieu于1979年沿人物史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《区分、品味与社会再生产》改变的是判决程序,不是增加一条永远正确的结论。
Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVER…把《区分、品味与社会再生产》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块十仍借用这套接口;其中关键读数是“政策调整周期与结果反馈时延/危机措施”。《区分、品味与社会再生产》若改用另一分母,结论就可能反号。《区分、品味与社会再生产》因此成为现代条目的历史压力测试。核验《区分、品味与社会再生产》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《区分、品味与社会再生产》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十九、交往行动与公共理由Classic 19 · Public Policy
《交往行动与公共理由》在1981年造成的转向首先是一项人物史选择。Jürgen Habermas把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《交往行动与公共理由》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of N…缩窄或改写了《交往行动与公共理由》。它连接本块十一时,现代证据“完成影响评估和外部审计的系统数/在用系统”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《交往行动与公共理由》的外推,而不是替经典找托词。核验《交往行动与公共理由》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《交往行动与公共理由》须注明采用哪一版定义,同名术语不等于同一证据单位。
经二十、社会理论的微观基础Classic 20 · Public Policy
James S. Coleman在1990年的《社会理论的微观基础》为公共政策留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论的微观基础》以前的争论容易把测量便利当成本体事实;《社会理论的微观基础》使两者能够分账。《社会理论的微观基础》成为经典,靠的是接受反例修订。
用Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradic…回看《社会理论的微观基础》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块十二保存这条差异;关键判断是“组合效应减去单项效应之和/政策对象”。它把《社会理论的微观基础》的失败对象送回比较。《社会理论的微观基础》的旧前提由本块检验证据成本。核验《社会理论的微观基础》时须同时保存它没有解释的对象,不能只汇集成功分支。
◎ 这一层怎么用
先从“今用”回到上文对应现代条,再比较对象、分母和停止规则。只共享名词而不能换算量纲的关系登记为异名;能够共用失败对象的关系才进入碰撞。
经典身份不提供豁免。提出年份只决定它属于哪一层,后续反例负责划出今天仍可使用的边界;同一经典在新制度里失效,应明确写成撤回而不是补托词。
◎ 经典层资料核验
- Lasswell HD, Lerner D, eds. The Policy Sciences. Stanford University Press (1951)(专著)。
- March JG, Simon HA. Organizations. Wiley (1958)(专著)。
- Lindblom CE. The Science of Muddling Through. Public Administration Review 19 (1959)。
- Olson M. The Logic of Collective Action. Harvard University Press (1965)(专著)。
- Allison GT. Essence of Decision. Little, Brown (1971)(专著)。
- Pressman JL, Wildavsky A. Implementation. University of California Press (1973)(专著)。
- Campbell DT. Assessing the Impact of Planned Social Change. Dartmouth College (1976)(专著)。
- Kingdon JW. Agendas, Alternatives, and Public Policies. Little, Brown (1984)(专著)。
- Sabatier PA. An Advocacy Coalition Framework of Policy Change. Policy Sciences 21 (1988)。
- Ostrom E. Governing the Commons. Cambridge University Press (1990)(专著)。
- Wittgenstein L. Philosophical Investigations. Blackwell (1953)(专著)。
- Merton RK. Social Theory and Social Structure. Free Press (1957)(专著)。
- Goffman E. The Presentation of Self in Everyday Life. Doubleday (1959)(专著)。
- Kuhn TS. The Structure of Scientific Revolutions. University of Chicago Press (1962)(专著)。
- Rawls J. A Theory of Justice. Harvard University Press (1971)(专著)。
- Geertz C. The Interpretation of Cultures. Basic Books (1973)(专著)。
- Foucault M. Discipline and Punish. Gallimard (1975)(专著)。
- Bourdieu P. La Distinction. Éditions de Minuit (1979)(专著)。
- Habermas J. The Theory of Communicative Action. Beacon Press (1981)(专著)。
- Coleman JS. Foundations of Social Theory. Harvard University Press (1990)(专著)。
- R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122。
- Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751。
- Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272。
- David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015。
- Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701。
- Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026。
- Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783。
- T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567。
- John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693。
- Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001。
- Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607。
- Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15。
- Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163。
- Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193。
- Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755。
- M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14。
- Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43。
- Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519。
- Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405。
核验说明:提出栏优先使用原始论文、专著或正式文集;流变栏只承担后续修订。2006 年后的材料不改变经典条的入选年份。