SDE Universes·新思想前沿社会·政治·法律
新思想前沿 · 社会·政治·法律 · 第 085 号

公共政策

近二十年与经典层 · 两幕 20 个新思想 + 20 个经典思想 · 约 36,520 字 · 王德生 亲撰 · 2026 年 8 月

公共政策的近二十年转向与 1950—2006 年经典思想在同一页对读:现代层说明新证据怎样改写问题,经典层倒查旧前提由谁、用什么材料建立。四十条均保留来源、量纲、失效与异名接口;经典二十条逐一回指上文,不把年代久远误当成仍然有效。

【第一幕】上一个十年 · 主证据 2006–2016

第一幕见证证据本位、随机试验和行为团队进入政府;同时,指标替代目标与规模化衰减开始暴露。

甲、证据本位从医学扩散到政府决策Evidence based policy

提出Kathryn Oliver、Simon Innvar、Theo Lorenc 等,2014,《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》,BMC Health Services Research 14:2,DOI 10.1186/1472-6963-14-2 争议R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122 最新Saiqa Noor、Saquib Khushhal、Aleena Amjad、Asim Aqil,2025,《Using AI to Inform Evidence-based Decision-Making in Educational Policy》,Review of Applied Management and Social Sciences 8(1):183–192,DOI 10.47067/ramss.v8i1.448 奠基Herbert A. Simon,1947,《Administrative Behavior》 关键政策文件中系统综述或因果评估引用率/可评文件

2016 年,本世纪头十年,系统评价、证据等级与「什么有效」资料库从循证医学扩散到教育、就业与犯罪政策,多国设立专门机构做证据汇总。回到提出笔,Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)的《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》只在样本来源与纳入路径内解释政策文件中系统综述或因果评估引用率;Herbert A. Simon(1947)的《Administrative Behavior》负责旧命名,不替代现代识别。

证据分级、知识中介与预算流程把研究接入决策。据此以政策文件中系统综述或因果评估引用率辨向,未申请的合格人群对“从医学扩散到政府决策”的影响构成反事实缺口。由此可反驳的说法是:政策文件中系统综述或因果评估引用率是唯一决定项。在样本来源与纳入路径中拿走政策文件中系统综述或因果评估而结果仍同号,就否证《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》的机制解释(Kathryn Oliver、Simon Innvar、Theo Lorenc 等,2014)。

它建立的是判据而不是结论:一项干预有没有效,第一问变成「有没有对照」。Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)没有报告政策文件中系统综述或因果评估引用率可跨样本搬用的点估计,本页不替《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》补造效应量。可证伪阈值预注册为R1=政策文件中系统综述或因果评估引用率除以可评文件:R1>1.00倍才支持原方向,R1≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

一旦选择进入分母时,覆盖越高,估计偏差反而越大;证据本位从医学扩散到政府决策的方向在行政流程和结果能链接的公共项目中的“证据本位从医学扩散到政府”样本外因此需要重估。反例并不在同一格里:R. Andrew Moore(2006)的《Evidence-based policy-making》只在行政流程和结果能链接的公共项目中的证据本位从医学扩散到政府样本外与Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)形成反号;边界内的同号证据不被冒充为普遍定律。

这条纪律是这十年能自查的前提。就“证据本位从医学扩散到政府决策”而言,以可评文件中可识别“证据本位从医学扩散到政府决策”的观察单位为外沿。制度接口随后移动:Saiqa Noor、Saquib Khushhal、Aleena Amjad、As(2025)在《Using AI to Inform Evidence-based Decision-Making in Educational Policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的政策文件中系统综述或因果评估引用率变成可比较对象。

与“证据本位从医学扩散到政府决策”相邻,实施科学可作跨域检索词;未申请的合格人群对“从医学扩散到政府决策”的影响到 2025 年仍无统一数据。跨块接口不靠同名:第267号《行政负担:国家能力也体现在公民要付出多少》结算另一生成层;《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》仍以政策文件中系统综述或因果评估引用率对可评文件辨向。两边若同时成立,政策文件中系统综述或因果评估会迫使样本来源与纳入路径成为第三项(2014/2025)。

位置D|生成次序:政策文件中系统综 单因只承认政策文件中系统综为决定项 预设〔01 谁进入分母〕默认可评文件没有漏计 量纲政策文件中系统综述或因果评估引用率/可评文件 失效当选择进入分母时,覆盖越高,估计偏差反而越大 自曝纳入界线:Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)只识别行政流程和结果能链接的公共项目中的证,未覆盖未入账的政策学习退出与阴性个 空栏被筛掉者:未入账的政策学习退出与阴性个案 异名另见第 267 号第8条《行政负担:国家能力也体现在公民要付出多少》

乙、随机试验进入发展与社会政策Randomized policy experiments

提出Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001 争议Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751 最新Radek Kovács、Arnošt Veselý,2026,《Survey Experiments in Public Policy: A Systematic Literature Review》,Review of Policy Research 43(2),DOI 10.1111/ropr.70040 奠基Harold D. Lasswell & Daniel Lerner,1951,《The Policy Sciences》 关键随机分派后的平均处理效应/合格对象

2006 年,同期,政府部门开始自己做随机试验:不同的催缴信、不同的默认设置、不同的就业辅导方案被随机分配到几十万人身上。沿着样本表,Jennifer L. Romich(2006)的《Randomized social policy experiments and research on child development》只在制度建立时点内解释随机分派后的平均处理效应;Harold D. Lasswell & Daniel Lerner(1951)的《The Policy Sciences》负责旧命名,不替代现代识别。

随机分派后的平均处理效应的变化经由随机化切断自我选择并明确反事实结果产生;一线人员的隐性变通对“验进入发展与社会政策”的影响让替代解释仍在场。这把主张压成一条硬命题:随机分派后的平均处理效应是唯一决定项。在制度建立时点中拿走随机分派后的平均处理效应而结果仍同号,就否证《Randomized social policy experiments and research on child development》的机制解释(Jennifer L. Romich,2006)。

随机试验进入发展与社会政策在 2009 年用随机分派后的平均处理效应除以合格对象留下第 2 组可比读数。Jennifer L. Romich(2006)没有报告随机分派后的平均处理效应可跨样本搬用的点估计,本页不替《Randomized social policy experiments and research on child development》补造效应量。可证伪阈值预注册为R2=随机分派后的平均处理效应除以合格对象:R2>1.00倍才支持原方向,R2≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

这类试验的样本量与真实性远超学术实验,也正因如此,这十年才能把政府大规模试验与学术文献的效应量放在一起比——而一比就比出了那个七倍的落差。两篇论文的冲突要用同终点辨认:Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)的《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》只在有试点与规模化对照的政策中的随机试验进入发展与社会政样本外与Jennifer L. Romich(2006)形成反号;边界内的同号证据不被冒充为普遍定律。

就“随机试验进入发展与社会政策”而言,本项只承诺随机试验进入发展与社会政策的同口径观察,一线人员的隐性变通对“验进入发展与社会政策”的影响不得混入分母。近端研究把尺度推远:Radek Kovács、Arnošt Veselý(2026)在《Survey Experiments in Public Policy: A Systematic Literature Review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的随机分派后的平均处理效应变成可比较对象。

与“随机试验进入发展与社会政策”相邻,相邻学科称其为政策学习,但一线人员的隐性变通对“验进入发展与社会政策”的影响尚未纳入 2026 年资料。对撞发生在相同前提下:第498号《知识经纪:把论文翻译成可行动的政策问题》结算另一生成层;《Randomized social policy experiments and research on child development》仍以随机分派后的平均处理效应对合格对象辨向。两边若同时成立,随机分派后的平均处理效应会迫使制度建立时点成为第三项(2006/2026)。到2026年,Radek Kovács、Arnošt Veselý把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于有试点与规模化对照的政策中的随机试验进入发展与社。

位置S|可见形态:随机分派后的平均 单因只承认随机分派后的平均为决定项 预设〔01 谁进入分母〕默认合格对象没有漏计 量纲随机分派后的平均处理效应/合格对象 失效若测量成为考核目标,记录越完整,真实行为反而越不可见 自曝估计器自限:2006年样本止于有试点与规模化对照的政策中的随机试验;未入账的分配后果退出与阴性个未进主分母 空栏未进入者:未入账的分配后果退出与阴性个案 异名另见第 498 号第2条《知识经纪:把论文翻译成可行动的政策问题》

丙、绩效指标越成功越可能替代真实目标Performance management and gaming

提出Gwyn Bevan、Christopher Hood,2006,《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》,Public Administration 84(3):517–538,DOI 10.1111/j.1467-9299.2006.00600.x 争议Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272 最新Léon Acar,2026,《Digital Co-Production of Public Services》,International Journal of Public Administration:1–2,DOI 10.1080/01900692.2026.2669804 奠基Charles E. Lindblom,1959,〈The Science of Muddling Through〉 关键指标改善与真实结果改善之差/考核单位

新公共管理的绩效指标体系在这一时期覆盖医疗、教育与治安。2016 年的研究把绩效指标越成功越可能替代真实目标与指标改善与真实结果改善之差除以考核单位直接相连。把概念史与估计拆开,Gwyn Bevan、Christopher Hood(2006)的《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》只在关系网络中心度内解释指标改善与真实结果改善之差;Charles E. Lindblom(1959)的《所列研究》负责旧命名,不替代现代识别。指标改善与真实结果改善之差除以考核单位;这项证据只承担关系网络中心度内的方向,不承担域外的统一量级。

先观察高强度问责诱发选择服务对象和重分类行为,再核对指标改善与真实结果改善之差;遗漏失败后未发表的试点对“功越可能替代真实目标”的影响会错认先后次序。真正需要承担因果责任的是:指标改善与真实结果改善之差是唯一决定项。在关系网络中心度中拿走指标改善与真实结果改善之差而结果仍同号,就否证《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》的机制解释(Gwyn Bevan、Christopher Hood,2006)。

随后大量案例显示:指标被达成,而指标想代表的东西没有改善——急诊等候被记录在门口、考试成绩靠应试提升。读数:绩效指标越成功越可能替代真实目标在 2010 年用指标改善与真实结果改善之差除以考核单位留下第 3 组可比读数。Gwyn Bevan、Christopher Hood(2006)没有报告指标改善与真实结果改善之差可跨样本搬用的点估计,本页不替《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》补造效应量。可证伪阈值预注册为R3=指标改善与真实结果改善之差除以考核单位:R3>1.00倍才支持原方向,R3≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

在反向因果占优的样本中,相关越强,机制解释却越弱。争论的分水岭落到样本边缘:Nyiramukama Diana Kashaka(2026)的《Algorithmic Governance in Public Services: Accountability and Bias Audits》只在执行者与受益者均可分层的资料中的绩效指标越成功越可能替代样本外与Gwyn Bevan、Christopher Hood(2006)形成反号;边界内的同号证据不被冒充为普遍定律。

「一个指标一旦成为目标,就不再是好指标」在上一个十年被大规模验证过一次,这十年在算法与激励机制上再次重演。这项读数进入新的执行场:Léon Acar(2026)在《Digital Co-Production of Public Services》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的指标改善与真实结果改善之差变成可比较对象。

与“绩效指标越成功越可能替代真实目标”相邻,以行政负担对接外部文献时,失败后未发表的试点对“功越可能替代真实目标”的影响仍是一处未观测量(2026)。相邻面板提供反方向切片:第557号《常态化过程理论》结算另一生成层;《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》仍以指标改善与真实结果改善之差对考核单位辨向。两边若同时成立,指标改善与真实结果改善之差会迫使关系网络中心度成为第三项(2006/2026)。

位置E|适用条件:执行者与受益者均可分层 单因只承认指标改善与真实结为决定项 预设〔01 谁进入分母〕默认考核单位没有漏计 量纲指标改善与真实结果改善之差/考核单位 失效在反向因果占优的样本中,相关越强,机制解释反而越弱 自曝附录反号:提出笔把执行者与受益者均可分层的资料中的绩效设为外推边界,未合并未入账的议程退出与阴性个案 空栏残差对象:未入账的议程退出与阴性个案 异名另见第 557 号第4条《常态化过程理论》

丁、行为团队把默认选项做成低成本干预Nudging in government

提出Paul Dolan、Michael Hallsworth、David Halpern 等,2012,《Influencing Behaviour: The Mindspace Way》,Journal of Economic Psychology 33(1):264–277,DOI 10.1016/j.joep.2011.10.009 争议David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015 最新Camila Regueiro-Ons、Jaime Pinilla、Beatriz González López-Valcárcel,2026,《Fertility response to family policy: Insights from Spain’s paternity leave》,Applied Economic Analysis 34(100):38–60,DOI 10.1108/aea-06-2025-0197 奠基James G. March & Herbert A. Simon,1958,《Organizations》 关键干预组相对对照组完成率差/被触达者

行为科学团队在这一时期进入政府(见相邻面板),主打低成本、可快速测试的干预。2016 年的研究把行为团队把默认选项做成低成本干预与干预组相对对照组完成率差除以被触达者直接相连。从原始终点看,Paul Dolan、Michael Hallsworth、David Halper(2012)的《Influencing Behaviour: The Mindspace Way》只在处理暴露强度内解释干预组相对对照组完成率差;James G. March & Herbert A. Simon(1958)的《Organizations》负责旧命名,不替代现代识别。Paul Dolan、Michael Hallsworth、David Halper(2012)的贡献不是再命名,而是把干预组相对对照组完成率差放进被触达者这一可失败分母。

机制链写作默认、提醒和社会规范降低有限注意造成的摩擦。干预组相对对照组完成率差是结果端,跨部门交接造成的损耗对“认选项做成低成本干预”的影响留在输入端。反事实只移动一项:干预组相对对照组完成率差是唯一决定项。在处理暴露强度中拿走干预组相对对照组完成率差而结果仍同号,就否证《Influencing Behaviour: The Mindspace Way》的机制解释(Paul Dolan、Michael Hallsworth、David Halper,2012)。《Influencing Behaviour: The Mindspace Way》与《Nudging by government: Progress, impact, & lessons learned》共同承认处理暴露强度会改变识别,但对干预组相对对照组完成率差的方向给出不同承诺。

早期成果被广泛报道。行为团队把默认选项做成低成本干预在 2012 年用干预组相对对照组完成率差除以被触达者留下第 4 组可比读数。Paul Dolan、Michael Hallsworth、David Halper(2012)没有报告干预组相对对照组完成率差可跨样本搬用的点估计,本页不替《Influencing Behaviour: The Mindspace Way》补造效应量。可证伪阈值预注册为R4=干预组相对对照组完成率差除以被触达者:R4>1.00倍才支持原方向,R4≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

一旦关键资源只能小规模供给,试点效应越大,推广后反而缩水。边界条件在近端复核中显形:David Halpern、Michael Sanders(2016)的《Nudging by government: Progress, impact, & lessons learned》只在具有明确成本和退出规则的干预中的行为团队把默认选项做成低样本外与Paul Dolan、Michael Hallsworth、David Halper(2012)形成反号;边界内的同号证据不被冒充为普遍定律。

它带来的最持久的东西不是那些具体干预,而是「先小规模随机测一下」这个工作习惯。复核对象不再停在论文样本:Camila Regueiro-Ons、Jaime Pinilla、Beatriz (2026)在《Fertility response to family policy: Insights from Spain’s paternity leave》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的干预组相对对照组完成率差变成可比较对象。

与“行为团队把默认选项做成低成本干预”相邻,跨部门交接造成的损耗对“认选项做成低成本干预”的影响没有随适应性治理一起进入共同口径,截至 2026 年仍然如此。邻接条目改用另一分母:第605号《预期行动扩展:阈值之外还要问谁先受益》结算另一生成层;《Influencing Behaviour: The Mindspace Way》仍以干预组相对对照组完成率差对被触达者辨向。两边若同时成立,干预组相对对照组完成率差会迫使处理暴露强度成为第三项(2012/2026)。

位置D|生成次序:干预组相对对照组 单因只承认干预组相对对照组为决定项 预设〔02 单一读数代表复杂对象〕以干预组相对对照组完成代表多层对象 量纲干预组相对对照组完成率差/被触达者 失效若关键资源只能小规模供给,试点效应越大,推广后反而缩水 自曝预注册缺口:Paul Dolan、Michael Hallsworth、David Halper承认具有明确成本和退出规则的干预中的行为之外无同号保证 空栏版本漂移:未入账的工具组合退出与阴性个案 异名另见第 605 号第15条《预期行动扩展:阈值之外还要问谁先受益》

戊、影响评估进入援助项目问责链Impact evaluation and aid accountability

提出Howard White,2009,《Theory-Based Impact Evaluation: Principles and Practice》,Journal of Development Effectiveness 1(3):271–284,DOI 10.1080/19439340903114628 争议Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701 最新Alhassan Musah、Adu Peprah James、Matilda Asiedu-Ampomah、Felicia Koomson,2025,《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》,Journal of Governance and Accountability Studies 5(1):63–77,DOI 10.35912/jgas.v5i1.1253 奠基Graham T. Allison,1971,《Essence of Decision》 关键具有基线和对照的项目数/受资助项目

同期,国际援助领域大规模引入影响力评估,要求项目说明自己的因果证据。2011 年的研究把影响评估进入援助项目问责链与具有基线和对照的项目数除以受资助项目直接相连。按主证据的时序,Howard White(2009)的《Theory-Based Impact Evaluation: Principles and Practice》只在样本进入路径内解释具有基线和对照的项目数;Graham T. Allison(1971)的《Essence of Decision》负责旧命名,不替代现代识别。

从资助条件与公开报告推动项目明确结果指标可推出具有基线和对照的项目数;但未申请的合格人群对“估进入援助项目问责链”的影响未入表,方向只能有条件成立。可失败版本可以写成:具有基线和对照的项目数是唯一决定项。在样本进入路径中拿走具有基线和对照的项目数而结果仍同号,就否证《Theory-Based Impact Evaluation: Principles and Practice》的机制解释(Howard White,2009)。未申请的合格人群对估进入援助项目问责链的影响没有进入具有基线和对照的项目数的中心读数,这正是《Theory-Based Impact Evaluation: Principles and Practice》最容易被过度外推的地方。

这与发展经济学那条线互为表里(见相邻面板)。影响评估进入援助项目问责链在 2011 年用具有基线和对照的项目数除以受资助项目留下第 5 组可比读数。Howard White(2009)没有报告具有基线和对照的项目数可跨样本搬用的点估计,本页不替《Theory-Based Impact Evaluation: Principles and Practice》补造效应量。可证伪阈值预注册为R5=具有基线和对照的项目数除以受资助项目:R5>1.00倍才支持原方向,R5≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Alhassan Musah、Adu Peprah James、Matilda As(2025)若改变受资助项目的构成,提出笔的方向必须重新估计,不能沿用旧系数。

当制度回应改变行为时,干预越强,原有比较组反而越不成立。反对笔改换了识别窗:Ratnida Rahmasari、Unti Ludigdo、Ali Djamhur(2024)的《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》只在行政流程和结果能链接的公共项目中的影响评估进入援助项目问责样本外与Howard White(2009)形成反号;边界内的同号证据不被冒充为普遍定律。

它同时带来了选题偏向:可评估的项目更容易获得资金,而制度建设这类难以评估的工作相对失宠。延伸证据改换了承载机构:Alhassan Musah、Adu Peprah James、Matilda As(2025)在《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的具有基线和对照的项目数变成可比较对象。

与“影响评估进入援助项目问责链”相邻,2025 年的邻域术语是实施科学;资料缺口则落在未申请的合格人群对“估进入援助项目问责链”的影响。两块材料只共享条件场:第416号《资本由法律编码而非物自身产生》结算另一生成层;《Theory-Based Impact Evaluation: Principles and Practice》仍以具有基线和对照的项目数对受资助项目辨向。两边若同时成立,具有基线和对照的项目数会迫使样本进入路径成为第三项(2009/2025)。

位置D|生成次序:具有基线和对照 单因只承认具有基线和对照为决定项 预设〔04 测量不改变被测对象〕记录具有基线和对照的项目不改写策略 量纲具有基线和对照的项目数/受资助项目 失效当行政流程和结果能链接的公共项目中不成立时,具有基线和对照的项目数不能外推 自曝样本流失:2009年模型固定行政流程和结果能链接的公共项目中的影,没有估计未入账的执行能力退出与阴性个 空栏阴性事件:未入账的执行能力退出与阴性个案 异名另见第 416 号第9条《资本由法律编码而非物自身产生》

己、规模化失败提示情境与执行不可省略Scaling up policy interventions

提出Karthik Muralidharan、Paul Niehaus,2017,《Experimentation at Scale》,Journal of Economic Perspectives 31(4):103–124,DOI 10.1257/jep.31.4.103 争议Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026 最新Imran Rasul,2026,《From field experiments to policy interventions at scale》,Science,DOI 10.1126/science.aef8482 奠基Jeffrey L. Pressman & Aaron Wildavsky,1973,《Implementation》 关键规模实施效应相对试点效应保留率/同类项目

同一时期已有个案报告:在试点中效果显著的项目,推广后效果大幅缩水。2006 年的研究把规模化失败提示情境与执行不可省略与规模实施效应相对试点效应保留率除以同类项目直接相连。回到提出笔,Karthik Muralidharan、Paul Niehaus(2017)的《Experimentation at Scale》只在危机前资产负债表内解释规模实施效应相对试点效应保留率;Jeffrey L. Pressman & Aaron Wildavsky(1973)的《Implementation》负责旧命名,不替代现代识别。

一线人员的隐性变通对“示情境与执行不可省略”的影响之外,证据支持人员训练、选择性执行与单位成本改变处理强度影响规模实施效应相对试点效应保留率,两端不得互换。由此可反驳的说法是:规模实施效应相对试点效应保留率是唯一决定项。在危机前资产负债表中拿走规模实施效应相对试点效应保留而结果仍同号,就否证《Experimentation at Scale》的机制解释(Karthik Muralidharan、Paul Niehaus,2017)。

当时的解释多为「执行不到位」。规模化失败提示情境与执行不可省略在 2016 年用规模实施效应相对试点效应保留率除以同类项目留下第 6 组可比读数。Karthik Muralidharan、Paul Niehaus(2017)没有报告规模实施效应相对试点效应保留率可跨样本搬用的点估计,本页不替《Experimentation at Scale》补造效应量。可证伪阈值预注册为R6=规模实施效应相对试点效应保留率除以同类项目:R6>1.00倍才支持原方向,R6≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

在网络外溢占主导之际,直接处理越多,未处理组反而越被污染。反例并不在同一格里:Murali Krishna Pasupuleti(2026)的《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》只在有试点与规模化对照的政策中的规模化失败提示情境与执行样本外与Karthik Muralidharan、Paul Niehaus(2017)形成反号;边界内的同号证据不被冒充为普遍定律。对议程、工具组合、执行能力、反馈、政策学习与分配后果分别分层后,规模实施效应相对试点效应保留率若只在中心组存在,原命题就必须缩域。

这十年的系统对账给出了不同的答案:缩水的原因是结构性的——发表偏倚、低功效、实施质量、以及一般均衡效应,而不只是执行问题。制度接口随后移动:Imran Rasul(2026)在《From field experiments to policy interventions at scale》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的规模实施效应相对试点效应保留率变成可比较对象。

与“规模化失败提示情境与执行不可省略”相邻,政策学习连接了相邻研究,一线人员的隐性变通对“示情境与执行不可省略”的影响却仍停在 2026 年数据库之外。跨块接口不靠同名:第478号《跨平台协同行为检测》结算另一生成层;《Experimentation at Scale》仍以规模实施效应相对试点效应保留率对同类项目辨向。两边若同时成立,规模实施效应相对试点效应保留会迫使危机前资产负债表成为第三项(2017/2026)。

位置S|可见形态:规模实施效应相对 单因只承认规模实施效应相对为决定项 预设〔02 单一读数代表复杂对象〕以规模实施效应相对试点代表多层对象 量纲规模实施效应相对试点效应保留率/同类项目 失效在网络外溢占主导时,直接处理越多,未处理组反而越被污染 自曝识别窗口:附录的敏感性检验止于有试点与规模化对照的政策中的规模化失,未触及未入账的反馈退出与阴性个案 空栏否决理由:未入账的反馈退出与阴性个案 异名另见第 478 号第14条《跨平台协同行为检测》

庚、政策转移必须区分机制与表面形式Policy transfer and translation

提出Diane Stone,2012,《Transfer and translation of policy》,Policy Studies:483–499,DOI 10.1080/01442872.2012.695933 争议Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783 最新Alireza Jazini,2021,《Translation policy》,Translation and Translanguaging in Multilingual Contexts 7(3):339–369,DOI 10.1075/ttmc.00077.jaz 奠基Donald T. Campbell,1976,〈Assessing the Impact of Planned Social Change〉 关键移植后保留的核心机制数/政策组件

政策很少像技术零件一样原样搬运。2012 年的研究把政策转移必须区分机制与表面形式与移植后保留的核心机制数除以政策组件直接相连。沿着样本表,Diane Stone(2012)的《Transfer and translation of policy》只在年龄与代际内解释移植后保留的核心机制数;Donald T. Campbell(1976)的《所列研究》负责旧命名,不替代现代识别。

识别从移植后保留的核心机制数回溯到制度翻译、利益协调和本地执行重写外来方案;失败后未发表的试点对“须区分机制与表面形式”的影响是尚未封闭的旁路。这把主张压成一条硬命题:移植后保留的核心机制数是唯一决定项。在年龄与代际中拿走移植后保留的核心机制数而结果仍同号,就否证《Transfer and translation of policy》的机制解释(Diane Stone,2012)。

2006 至 2016 年的比较研究至少区分 3 层:可见项目形式、真正起作用的机制和接收制度;2006 至 2016 年的比较研究至少区分 3 层:可见项目形式、真正起作用的机制和接收制度。Diane Stone(2012)没有报告移植后保留的核心机制数可跨样本搬用的点估计,本页不替《Transfer and translation of policy》补造效应量。可证伪阈值预注册为R7=移植后保留的核心机制数除以政策组件:R7>1.00倍才支持原方向,R7≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

若分类门槛随地区变化,差距越显著,跨地可比性反而越低。两篇论文的冲突要用同终点辨认:Tolga Duygun(2020)的《Policy translation in Turkish disability policy: The role and limitations of international organisations》只在执行者与受益者均可分层的资料中的政策转移必须区分机制与表样本外与Diane Stone(2012)形成反号;边界内的同号证据不被冒充为普遍定律。《Policy translation in Turkish disability policy: The role and limitations of international organisations》把执行者与受益者均可分层的资料中的政策转移必须区分机制与表样本换成对照域,移植后保留的核心机制数因此可能从同号变成零或反号。

相同名称可能对应完全不同的执行链。就“政策转移必须区分机制与表面形式”而言,若改用其他总体,移植后保留的核心机制数会被选择机制扭转。近端研究把尺度推远:Alireza Jazini(2021)在《Translation policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的移植后保留的核心机制数变成可比较对象。在政策文本、预算执行、行政登记、实施过程与受益者申诉里,Diane Stone(2012)留下的可复查接口是移植后保留的核心机制数,而不是条目标题本身。

与“政策转移必须区分机制与表面形式”相邻,跨域对应为行政负担。到 2021 年,失败后未发表的试点对“须区分机制与表面形式”的影响仍缺可比较记录。对撞发生在相同前提下:第495号《审议式微型公众:让普通人处理复杂证据》结算另一生成层;《Transfer and translation of policy》仍以移植后保留的核心机制数对政策组件辨向。两边若同时成立,移植后保留的核心机制数会迫使年龄与代际成为第三项(2012/2021)。

位置S|可见形态:移植后保留的核心 单因只承认移植后保留的核心为决定项 预设〔04 测量不改变被测对象〕记录移植后保留的核心机制不改写策略 量纲移植后保留的核心机制数/政策组件 失效当执行者与受益者均可分层的资料中不成立时,移植后保留的核心机制数不能外推 自曝变量定义:原文只给执行者与受益者均可分层的资料中的政策内结果;未入账的政策学习退出与阴性个仍是未识别项 空栏替代路径:未入账的政策学习退出与阴性个案 异名另见第 495 号第14条《审议式微型公众:让普通人处理复杂证据》

辛、共同生产把公民从受益者变成执行者Co-production in public services

提出Tony Bovaird,2007,《Beyond Engagement and Participation: User and Community Coproduction of Public Services》,Public Administration Review 67(5):846–860,DOI 10.1111/j.1540-6210.2007.00773.x 争议T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567 最新Chunsheng Li、Jinpeng Wu、Huiming Zhang、Zhiming Han,2023,《Co-production and Citizens’ Satisfaction with Public Services: The Case of Environmental Public Services in China》,Lex localis - Journal of Local Self-Government 21(1):117–142,DOI 10.4335/21.1.117-142(2023) 奠基Mancur Olson,1965,《The Logic of Collective Action》 关键由使用者共同完成的服务环节数/服务流程

公共服务并非只由政府生产再交付给被动对象。2016 年的研究把共同生产把公民从受益者变成执行者与由使用者共同完成的服务环节数除以服务流程直接相连。把概念史与估计拆开,Tony Bovaird(2007)的《Beyond Engagement and Participation: User and Community Coproduction of Public Services》只在组织规模内解释由使用者共同完成的服务环节数;Mancur Olson(1965)的《The Logic of Collective Action》负责旧命名,不替代现代识别。

若专业人员与公民贡献互补并影响服务持续性成立,由使用者共同完成的服务环节数应同步改变。真正需要承担因果责任的是:由使用者共同完成的服务环节数是唯一决定项。在组织规模中拿走由使用者共同完成的服务环节数而结果仍同号,就否证《Beyond Engagement and Participation: User and Community Coproduction of Public Services》的机制解释(Tony Bovaird,2007)。

2013 年后的研究把信息提供、日常照护与监督等至少 3 类公民投入计入执行,重新界定服务成本和责任。Tony Bovaird(2007)没有报告由使用者共同完成的服务环节数可跨样本搬用的点估计,本页不替《Beyond Engagement and Participation: User and Community Coproduction of Public Services》补造效应量。可证伪阈值预注册为R8=由使用者共同完成的服务环节数除以服务流程:R8>1.00倍才支持原方向,R8≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

2013 年后的研究把信息提供、日常照护与监督等至少 3 类公民投入计入执行,重新界定服务成本和责任。一旦高风险者主动退出观察时,平均表现越好,真实风险反而越高。争论的分水岭落到样本边缘:T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. P(2015)的《Activating Citizens to Participate in Collective Co-Production of Public Services》只在具有明确成本和退出规则的干预中的共同生产把公民从受益者变样本外与Tony Bovaird(2007)形成反号;边界内的同号证据不被冒充为普遍定律。

就“共同生产把公民从受益者变成执行者”而言,可比单位是服务流程中可识别“共同生产把公民从受益者变成执行者”的观察单位。这项读数进入新的执行场:Chunsheng Li、Jinpeng Wu、Huiming Zhang、Zhim(2023)在《Co-production and Citizens’ Satisfaction with Public Services: The Case of Environmental Public Services in China》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的由使用者共同完成的服务环节数变成可比较对象。

与“共同生产把公民从受益者变成执行者”相邻,若按适应性治理检索,可找到相邻证据;跨部门交接造成的损耗对“民从受益者变成执行者”的影响截至 2023 年仍不可并表。相邻面板提供反方向切片:第267号《行为公共管理:制度效果受认知与情境机制影响》结算另一生成层;《Beyond Engagement and Participation: User and Community Coproduction of Public Services》仍以由使用者共同完成的服务环节数对服务流程辨向。两边若同时成立,由使用者共同完成的服务环节数会迫使组织规模成为第三项(2007/2023)。第267号《行为公共管理:制度效果受认知与情境机制影响》与《Beyond Engagement and Participation: User and Community Coproduction of Public Services》的分离线是具有明确成本和退出规则的干预中的共同生产把公民从受益者变:前者解释接口,后者解释由使用者共同完成的服务环节数。

位置E|适用条件:具有明确成本和退出规则 单因只承认由使用者共同完成为决定项 预设〔02 单一读数代表复杂对象〕以由使用者共同完成的服代表多层对象 量纲由使用者共同完成的服务环节数/服务流程 失效当高风险者主动退出观察时,平均表现越好,真实风险反而越高 自曝对照构造:Tony Bovaird把未入账的分配后果退出与阴性个留在稳健性表之外 空栏转移成本:未入账的分配后果退出与阴性个案 异名另见第 267 号第9条《行为公共管理:制度效果受认知与情境机制影响》
【第二幕】这一个十年 · 主证据 2016–2026

第二幕把平均效应拆成执行链、行政负担、国家能力、政治时机与异质性,政策不再被想象成可直接复制的配方。

一、证据本位胜利后面临选择性使用The politics of evidence

提出Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163 争议John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693 最新Vesna Trifunović、Stuart Blume,2023,《Which vaccine? Between evidence-based policy and symbolic politics》,Critical Public Health 33(5):864–869,DOI 10.1080/09581596.2023.2289346 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键被采用研究与全部合格研究之比/政策议题

过去二十年,随机对照试验从医学扩散到发展、教育、就业、税收与公共服务,2019 年的诺贝尔经济学奖是它的加冕。从原始终点看,Tracey Barnett McElwee、Laura Danforth、Chri(2025)的《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》只在信息可见度内解释被采用研究与全部合格研究之比;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Tracey Barnett McElwee、Laura Danforth、Chri(2025)的贡献不是再命名,而是把被采用研究与全部合格研究之比放进政策议题这一可失败分母。

它的贡献是实打实的:把「我认为这样有用」变成了可检验的命题,也让大量看似合理的政策被证伪。反事实只移动一项:被采用研究与全部合格研究之比是唯一决定项。在信息可见度中拿走被采用研究与全部合格研究之比而结果仍同号,就否证《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》的机制解释(Tracey Barnett McElwee、Laura Danforth、Chri,2025)。

与之配套的制度也建立起来:预注册、独立评估机构、政府内部的实验单位、系统综述与证据分级。过去二十年,随机对照试验从医学扩散到发展、教育、就业、税收与公共服务,2019 年的诺贝尔经济学奖是它的加冕。Tracey Barnett McElwee、Laura Danforth、Chri(2025)没有报告被采用研究与全部合格研究之比可跨样本搬用的点估计,本页不替《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》补造效应量。可证伪阈值预注册为R9=被采用研究与全部合格研究之比除以政策议题:R9>1.00倍才支持原方向,R9≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

这套装置本身是这十年公共行政领域最重要的制度创新。若平台关闭接口,记录量越大,历史连续性反而越短。边界条件在近端复核中显形:John Humphreys(2025)的《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》只在行政流程和结果能链接的公共项目中的证据本位胜利后面临选择性样本外与Tracey Barnett McElwee、Laura Danforth、Chri(2025)形成反号;边界内的同号证据不被冒充为普遍定律。

证据本位的胜利有一个可指认的制度形态:政府内部设立专门团队、把随机试验嵌入行政流程、并建立起从试点到推广的评估要求。复核对象不再停在论文样本:Vesna Trifunović、Stuart Blume(2023)在《Which vaccine? Between evidence-based policy and symbolic politics》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的被采用研究与全部合格研究之比变成可比较对象。

这套做法在多国被采纳,最大的贡献不是某项具体结论,而是把先试后推、公开评估结果这两条变成了默认程序。截至 2023 年仍在更新。邻接条目改用另一分母:第498号《边界组织:在科学自主与政策问责之间搭制度》结算另一生成层;《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》仍以被采用研究与全部合格研究之比对政策议题辨向。两边若同时成立,被采用研究与全部合格研究之比会迫使信息可见度成为第三项(2025/2023)。到2023年,Vesna Trifunović、Stuart Blume把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于行政流程和结果能链接的公共项目中的证据本位胜利后。

位置D|生成次序:被采用研究与全部 单因只承认被采用研究与全部为决定项 预设〔08 观察顺序等于因果顺序〕把2025年前后的次序当作因果次序 量纲被采用研究与全部合格研究之比/政策议题 失效当行政流程和结果能链接的公共项目中不成立时,被采用研究与全部合格研究不能外推 自曝均衡条件:提出笔的缺失机制未容纳未入账的议程退出与阴性个案,适用域仅到行政流程和结果能链接的公共项目中的证 空栏尾部个案:未入账的议程退出与阴性个案 异名另见第 498 号第3条《边界组织:在科学自主与政策问责之间搭制度》

二、规模化效应普遍低于小样本试点Scale up effect fadeout

提出Imran Rasul,2026,《From field experiments to policy interventions at scale》,Science,DOI 10.1126/science.aef8482 争议Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001 最新Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键规模化效应除以原试点效应/项目地点

2026 年,问题出在从试点到推广的那一段。按主证据的时序,Imran Rasul(2026)的《From field experiments to policy interventions at scale》只在执行者裁量内解释规模化效应除以原试点效应;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。规模化效应除以原试点效应除以项目地点;这项证据只承担执行者裁量内的方向,不承担域外的统一量级。

差距的来源被拆开了:发表偏倚(有效的被写出来,无效的留在抽屉里)叠加低统计功效,可以解释其中约七成。可失败版本可以写成:规模化效应除以原试点效应是唯一决定项。在执行者裁量中拿走规模化效应除以原试点效应而结果仍同号,就否证《From field experiments to policy interventions at scale》的机制解释(Imran Rasul,2026)。一线人员的隐性变通对应普遍低于小样本试点的影响没有进入规模化效应除以原试点效应的中心读数,这正是《From field experiments to policy interventions at scale》最容易被过度外推的地方。

其余部分来自干预形式的差异——学术研究常用面对面或精心设计的接触,政府只能寄信或发短信。Imran Rasul(2026)没有报告规模化效应除以原试点效应可跨样本搬用的点估计,本页不替《From field experiments to policy interventions at scale》补造效应量。可证伪阈值预注册为R10=规模化效应除以原试点效应除以项目地点:R10>1.00倍才支持原方向,R10≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Imran Rasul(2026)的DOI提出笔与Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)的DOI近端笔。

这个结果的重要性在于它不指控任何人造假:每一项研究都可能是诚实且正确的,而文献的平均值依然会系统性偏高。这是一个关于制度而非个人的结论。反对笔改换了识别窗:Jennifer L. Romich(2006)的《Randomized social policy experiments and research on child development》只在有试点与规模化对照的政策中的规模化效应普遍低于小样本样本外与Imran Rasul(2026)形成反号;边界内的同号证据不被冒充为普遍定律。

规模化落差是这门学科最重要的经验发现:在试点中效果显著的干预,推广到全域后效应普遍缩小,缩水到只剩零头的案例并不罕见。延伸证据改换了承载机构:Yixing Chen、Shrihari Sridhar、Vikas Mittal(2021)在《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的规模化效应除以原试点效应变成可比较对象。

它之所以关键,是因为整个证据本位政策的逻辑建立在试点结果可外推的假设上,而这个假设被系统性地证伪了一部分。与“规模化效应普遍低于小样本试点”相邻,政策学习给出另一种命名;截至 2021 年仍在更新。两块材料只共享条件场:第557号《实施结果分类》结算另一生成层;《From field experiments to policy interventions at scale》仍以规模化效应除以原试点效应对项目地点辨向。两边若同时成立,规模化效应除以原试点效应会迫使执行者裁量成为第三项(2026/2021)。

位置E|适用条件:有试点与规模化对照的政策 单因只承认规模化效应除以原为决定项 预设〔04 测量不改变被测对象〕记录规模化效应除以原试点不改写策略 量纲规模化效应除以原试点效应/项目地点 失效在规范快速变化阶段,历史窗口越长,当前预测反而越迟钝 自曝清洗规则:2026年估计依赖有试点与规模化对照的政策中的规模化效,换入未入账的工具组合退出与阴性个需重算 空栏未分类者:未入账的工具组合退出与阴性个案 异名另见第 557 号第5条《实施结果分类》

三、实施链解释政策为何在现场缩水Implementation mechanisms

提出Joseph A. Durlak、Emily P. DuPre,2008,《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》,American Journal of Community Psychology 41:327–350,DOI 10.1007/s10464-008-9165-0 争议Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607 最新I Iskandar,2020,《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》,International Journal of Humanities and Innovation (IJHI) 3(2):50–55,DOI 10.33750/ijhi.v3i2.79 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键按方案完成的核心环节数/计划环节

2023 年,除了发表偏倚,规模化本身有几条稳定的漏水口。其一是执行者:试点由最积极的人做,推广由普通人做。其二是选择:试点的参与者是自愿的、被筛过的,推广覆盖全体。回到提出笔,Joseph A. Durlak、Emily P. DuPre(2008)的《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》只在短窗与长窗内解释按方案完成的核心环节数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Joseph A. Durlak、Emily P. DuPre(2008)的贡献不是再命名,而是把按方案完成的核心环节数放进计划环节这一可失败分母。

其三是一般均衡:小规模培训能提高受训者的就业,全员培训只是改变了排队顺序。其四是供给约束:干预有效所依赖的配套(师资、床位、窗口)在规模上不存在。由此可反驳的说法是:按方案完成的核心环节数是唯一决定项。在短窗与长窗中拿走按方案完成的核心环节数而结果仍同号,就否证《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》的机制解释(Joseph A. Durlak、Emily P. DuPre,2008)。《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》与《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》共同承认短窗与长窗会改变识别,但对按方案完成的核心环节数的方向给出不同承诺。

于是「可规模化性」本身成了一个研究对象:设计试点时就要问,这个效应依赖的是哪一种稀缺资源,放大之后它还在不在。Joseph A. Durlak、Emily P. DuPre(2008)没有报告按方案完成的核心环节数可跨样本搬用的点估计,本页不替《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》补造效应量。可证伪阈值预注册为R11=按方案完成的核心环节数除以计划环节:R11>1.00倍才支持原方向,R11≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。中央和地方政府采用《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》的口径时,计划环节与原样本不一致,不能直接比较点估计。

文献长期报告效应量而不报告单位成本,于是一个效应大但极昂贵的干预,看起来胜过一个效应小却近乎免费的干预。反例并不在同一格里:Mikael Persson、Anders Sundell(2025)的《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》只在执行者与受益者均可分层的资料中的实施链解释政策为何在现场样本外与Joseph A. Durlak、Emily P. DuPre(2008)形成反号;边界内的同号证据不被冒充为普遍定律。

为什么会缩水,原因可以分列:试点往往由发明者亲自督导,实施质量高于常规行政系统;试点场地常是配合度高的地区,存在选择性。制度接口随后移动:I Iskandar(2020)在《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的按方案完成的核心环节数变成可比较对象。

此外,试点期的关注本身就有效应。这四条各自可测,因而缩水幅度原则上是可预估的。截至 2020 年仍在更新。跨块接口不靠同名:第605号《COVID-19 本地响应:国际撤离暴露谁一直在场》结算另一生成层;《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》仍以按方案完成的核心环节数对计划环节辨向。两边若同时成立,按方案完成的核心环节数会迫使短窗与长窗成为第三项(2008/2020)。

位置D|生成次序:按方案完成的核心 单因只承认按方案完成的核心为决定项 预设〔13 时间尺度可自由压缩〕把当前观察窗直接外推到长期 量纲按方案完成的核心环节数/计划环节 失效当执行者与受益者均可分层的资料中不成立时,按方案完成的核心环节数不能外推 自曝外生性检查:作者报告中心样本,却未替未入账的执行能力退出与阴性个给出区间 空栏未执行项:未入账的执行能力退出与阴性个案 异名另见第 605 号第16条《COVID-19 本地响应:国际撤离暴露谁一直在场》

四、平均处理效应让位于分群效应Treatment effect heterogeneity

提出Kosuke Imai、Marc Ratkovic,2013,《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》,Annals of Applied Statistics 7(1):443–470,DOI 10.1214/12-AOAS593 争议Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026 最新Ilja Cornelisz、Chris van Klaveren,2022,《Recurrent individual treatment assignment: a treatment policy approach to account for heterogeneous treatment effects》,npj Science of Learning 7(1),DOI 10.1038/s41539-021-00117-4 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键分群处理效应极差/预注册子群

2024 年,与之并行的发现是效应在地点之间差别巨大:同一类干预在不同国家、不同机构、不同人群中的估计值可以相差数倍甚至反号。沿着样本表,Kosuke Imai、Marc Ratkovic(2013)的《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》只在中心与边缘节点内解释分群处理效应极差;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

因此重心从「平均处理效应」转向「在什么条件下有效」:机制的可移植性、情境的匹配、对哪一类人有效。这把主张压成一条硬命题:分群处理效应极差是唯一决定项。在中心与边缘节点中拿走分群处理效应极差而结果仍同号,就否证《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》的机制解释(Kosuke Imai、Marc Ratkovic,2013)。

方法上的对应物是预注册的异质性分析与多地点重复实验。平均处理效应让位于分群效应在 2018 年用分群处理效应极差除以预注册子群留下第 12 组可比读数。Kosuke Imai、Marc Ratkovic(2013)没有报告分群处理效应极差可跨样本搬用的点估计,本页不替《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》补造效应量。可证伪阈值预注册为R12=分群处理效应极差除以预注册子群:R12>1.00倍才支持原方向,R12≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Ilja Cornelisz、Chris van Klaveren(2022)若改变预注册子群的构成,提出笔的方向必须重新估计,不能沿用旧系数。

一个诚实的副产品是预测的谦逊:把同一批干预交给专家预测效果,专家的准确度并不高。这削弱了「先由专家挑选、再由试验确认」的传统分工。两篇论文的冲突要用同终点辨认:Murali Krishna Pasupuleti(2026)的《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》只在具有明确成本和退出规则的干预中的平均处理效应让位于分群效样本外与Kosuke Imai、Marc Ratkovic(2013)形成反号;边界内的同号证据不被冒充为普遍定律。《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》把具有明确成本和退出规则的干预中的平均处理效应让位于分群效样本换成对照域,分群处理效应极差因此可能从同号变成零或反号。

异质性——平均效应是不够的,是这门学科近年最实的方法转变:同一项干预可能对一部分人有效、对另一部分人无效甚至有害,而平均值把这些抵消掉。近端研究把尺度推远:Ilja Cornelisz、Chris van Klaveren(2022)在《Recurrent individual treatment assignment: a treatment policy approach to account for heterogeneous treatment effects》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的分群处理效应极差变成可比较对象。

据此产生的实践是——报告按人群分层的效应,并据以决定把干预投向谁,这实际上把政策评估与目标定位合成了一件事。截至 2022 年仍在更新。对撞发生在相同前提下:第416号《平台规则成为私人制度》结算另一生成层;《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》仍以分群处理效应极差对预注册子群辨向。两边若同时成立,分群处理效应极差会迫使中心与边缘节点成为第三项(2013/2022)。

位置S|可见形态:分群处理效应极差 单因只承认分群处理效应极差为决定项 预设〔08 观察顺序等于因果顺序〕把2013年前后的次序当作因果次序 量纲分群处理效应极差/预注册子群 失效当代理变量被策略性优化时,模型精度越高,目标效度反而越低 自曝分类版本:具有明确成本和退出规则的干预中的平均是原文的样本门槛,未入账的反馈退出与阴性个案没有单列 空栏窗外慢变量:未入账的反馈退出与阴性个案 异名另见第 416 号第10条《平台规则成为私人制度》

五、国家能力重新进入政策效果函数State capacity and policy implementation

提出Martin J. Williams,2021,《Beyond state capacity: bureaucratic performance, policy implementation and reform》,Journal of Institutional Economics:339–357,DOI 10.1017/s1744137420000478 争议Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15 最新Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、Kidist Bartolomeos,2025,《Local capacity for policy development and implementation》,Bulletin of the World Health Organization 103(7):415–415A,DOI 10.2471/blt.25.294222 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键税收、人员与执行覆盖构成的能力指数/行政区

2021 年,疫情、供应链中断与产业政策的复归,把一个被忽视的变量推回中心:执行能力。政策失败常常不是设计错了,而是没人能把它做出来——数据不通、采购不行、人手不足、部门之间没有接口。把概念史与估计拆开,Martin J. Williams(2021)的《Beyond state capacity: bureaucratic performance, policy implementation and reform》只在首次事件与重复事件内解释税收、人员与执行覆盖构成的能力指数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

这与「什么干预有效」是两个不同的问题,而过去二十年的证据运动几乎只研究前者。真正需要承担因果责任的是:税收、人员与执行覆盖构成的能力指数是唯一决定项。在首次事件与重复事件中拿走税收、人员与执行覆盖构成的能而结果仍同号,就否证《Beyond state capacity: bureaucratic performance, policy implementation and reform》的机制解释(Martin J. Williams,2021)。

这十年的补课包括:政府采购与数字基础设施研究、公共部门人事与激励研究、以及对「行政负担」的系统研究——申请材料、排队、证明文件本身如何把政策挡在受益者门外。Martin J. Williams(2021)没有报告税收、人员与执行覆盖构成的能力指数可跨样本搬用的点估计,本页不替《Beyond state capacity: bureaucratic performance, policy implementation and reform》补造效应量。可证伪阈值预注册为R13=税收、人员与执行覆盖构成的能力指数除以行政区:R13>1.00倍才支持原方向,R13≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Martin J. Williams(2021)的DOI提出笔与Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、(2025)的DOI近端笔。

这也解释了为什么「简化申请」这类看似微不足道的干预,效应常常大过精心设计的激励:它移走的是一道对最需要帮助的人最高的门槛。争论的分水岭落到样本边缘:Vuyani Goodman Langa、Sanjay Balkaran(2026)的《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》只在行政流程和结果能链接的公共项目中的国家能力重新进入政策效果样本外与Martin J. Williams(2021)形成反号;边界内的同号证据不被冒充为普遍定律。

政策的实际分配后果,往往不写在政策文本里,而写在表格、窗口时间与证明材料清单里。这项读数进入新的执行场:Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、(2025)在《Local capacity for policy development and implementation》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的税收、人员与执行覆盖构成的能力指数变成可比较对象。本条资料卡(1980)提出的旧对象在2021年被改造成税收、人员与执行覆盖构成的能力指数除以行政区;税收、人员与执行覆盖构成的能力新增了可被数据推翻的分母。

一个反复出现的结论是——同样的政策在不同行政能力的地方效果差别,往往大于不同政策之间的差别。截至 2025 年仍在更新。相邻面板提供反方向切片:第478号《C2PA与内容来源凭证》结算另一生成层;《Beyond state capacity: bureaucratic performance, policy implementation and reform》仍以税收、人员与执行覆盖构成的能力指数对行政区辨向。两边若同时成立,税收、人员与执行覆盖构成的能会迫使首次事件与重复事件成为第三项(2021/2025)。

位置S|可见形态:税收、人员与执行 单因只承认税收、人员与执行为决定项 预设〔13 时间尺度可自由压缩〕把当前观察窗直接外推到长期 量纲税收、人员与执行覆盖构成的能力指数/行政区 失效当行政流程和结果能链接的公共项目中不成立时,税收、人员与执行覆盖构成不能外推 自曝处理后网络:提出笔能裁决平均方向,不能裁决未入账的政策学习退出与阴性个的尾部 空栏网络重连:未入账的政策学习退出与阴性个案 异名另见第 478 号第15条《C2PA与内容来源凭证》

六、政治时机决定好证据能否成为政策Policy windows and evidence use

提出Joshua Newman,2017,《Debating the politics of evidence‐based policy》,Public Administration:1107–1112,DOI 10.1111/padm.12373 争议Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163 最新Neil McHugh,2022,《Eliciting public values on health inequalities: missing evidence for policy windows?》,Evidence & Policy 18(4):733–745,DOI 10.1332/174426421x16286783870175 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键证据发布至政策采用的月数/成功议题

最后一条自我限制值得记下:即使证据完备,采纳与否仍取决于时机、联盟与叙事。2017 年的研究把政治时机决定好证据能否成为政策与证据发布至政策采用的月数除以成功议题直接相连。从原始终点看,Joshua Newman(2017)的《Debating the politics of evidence‐based policy》只在正式规则与非正式实践内解释证据发布至政策采用的月数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

证据本位运动早期的隐含假设——好证据会自动挤走坏政策——没有兑现。反事实只移动一项:证据发布至政策采用的月数是唯一决定项。在正式规则与非正式实践中拿走证据发布至政策采用的月数而结果仍同号,就否证《Debating the politics of evidence‐based policy》的机制解释(Joshua Newman,2017)。

这十年比较成熟的立场是把证据视为必要不充分:它的作用是缩小可辩护选项的范围,并在事后提供问责的凭据,而不是替代政治判断。Joshua Newman(2017)没有报告证据发布至政策采用的月数可跨样本搬用的点估计,本页不替《Debating the politics of evidence‐based policy》补造效应量。可证伪阈值预注册为R14=证据发布至政策采用的月数除以成功议题:R14>1.00倍才支持原方向,R14≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Joshua Newman(2017)的DOI提出笔与Neil McHugh(2022)的DOI近端笔。

把这一点讲清楚,反而让证据的地位更稳固——因为它不再承诺自己做不到的事。一旦关系与结果同步形成,网络相关越稳定,影响方向反而越难识别。边界条件在近端复核中显形:Tracey Barnett McElwee、Laura Danforth、Chri(2025)的《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》只在有试点与规模化对照的政策中的政治时机决定好证据能否成样本外与Joshua Newman(2017)形成反号;边界内的同号证据不被冒充为普遍定律。

证据之外的政治与时机,同样被纳入研究:政策窗口何时打开、问题如何被界定为需要行动、以及既得利益如何塑造方案。复核对象不再停在论文样本:Neil McHugh(2022)在《Eliciting public values on health inequalities: missing evidence for policy windows?》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的证据发布至政策采用的月数变成可比较对象。

这不是给证据本位泼冷水,而是承认证据只解决可行性问题,不解决可采纳性问题,而后者常常才是决定成败的那一半。截至 2022 年仍在更新。邻接条目改用另一分母:第495号《社会倾听:从监测谣言转向理解社区问题》结算另一生成层;《Debating the politics of evidence‐based policy》仍以证据发布至政策采用的月数对成功议题辨向。两边若同时成立,证据发布至政策采用的月数会迫使正式规则与非正式实践成为第三项(2017/2022)。到2022年,Neil McHugh把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于有试点与规模化对照的政策中的政治时机决定好证据能。

位置E|适用条件:有试点与规模化对照的政策 单因只承认证据发布至政策采为决定项 预设〔08 观察顺序等于因果顺序〕把2017年前后的次序当作因果次序 量纲证据发布至政策采用的月数/成功议题 失效若关系与结果同步形成,网络相关越稳定,影响方向反而越难识别 自曝分群表:Joshua Newman只观察有试点与规模化对照的政策中的政治时机,退出过程没有独立参数 空栏未申诉者:未入账的分配后果退出与阴性个案 异名另见第 495 号第15条《社会倾听:从监测谣言转向理解社区问题》

七、行政负担把合格权利变成未领取福利Administrative burden

提出Sarah Giest、Annemarie Samuels,2023,《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》,Review of Policy Research:626–645,DOI 10.1111/ropr.12516 争议Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193 最新Shai Alon、Momi Dahan,2025,《The perceived power of clients, administrative burden and take-up of social benefits》,European Journal of Social Security 27(3):251–275,DOI 10.1177/13882627251372026 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键未申领合格者比例/全部合格者

政策写明的资格不等于实际得到的服务。2023 年的研究把行政负担把合格权利变成未领取福利与未申领合格者比例除以全部合格者直接相连。按主证据的时序,Sarah Giest、Annemarie Samuels(2023)的《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》只在成功、失败与退出内解释未申领合格者比例;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。未申领合格者比例除以全部合格者;这项证据只承担成功、失败与退出内的方向,不承担域外的统一量级。

读数未申领合格者比例需与学习、合规与心理成本共同降低政策到达率逐期对齐。可失败版本可以写成:未申领合格者比例是唯一决定项。在成功、失败与退出中拿走未申领合格者比例而结果仍同号,就否证《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》的机制解释(Sarah Giest、Annemarie Samuels,2023)。

2019 年后的研究把负担拆成学习、合规和心理 3 种成本,并用未申领率检验这些摩擦如何选择性排除最需要的人。Sarah Giest、Annemarie Samuels(2023)没有报告未申领合格者比例可跨样本搬用的点估计,本页不替《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》补造效应量。可证伪阈值预注册为R15=未申领合格者比例除以全部合格者:R15>1.00倍才支持原方向,R15≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

2019 年后的研究把负担拆成学习、合规和心理 3 种成本,并用未申领率检验这些摩擦如何选择性排除最需要的人。反对笔改换了识别窗:Jill Nicholson-Crotty、Susan M. Miller、Lael(2021)的《Administrative burden, social construction, and public support for government programs》只在执行者与受益者均可分层的资料中的行政负担把合格权利变成未样本外与Sarah Giest、Annemarie Samuels(2023)形成反号;边界内的同号证据不被冒充为普遍定律。

就“行政负担把合格权利变成未领取福利”而言,行政负担把合格权利变成未领取福利的适用域落在全部合格者中可识别“行政负担把合格权利变成未领取福利”的观察单位,缺口单独登记。延伸证据改换了承载机构:Shai Alon、Momi Dahan(2025)在《The perceived power of clients, administrative burden and take-up of social benefits》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的未申领合格者比例变成可比较对象。

与“行政负担把合格权利变成未领取福利”相邻,2025 年以前的跨域别名是行政负担;未填部分是失败后未发表的试点对“格权利变成未领取福利”的影响。两块材料只共享条件场:第267号《公共创新实验室:政府需要保护试错的中间组织》结算另一生成层;《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》仍以未申领合格者比例对全部合格者辨向。两边若同时成立,未申领合格者比例会迫使成功、失败与退出成为第三项(2023/2025)。第267号《公共创新实验室:政府需要保护试错的中间组织》与《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》的分离线是执行者与受益者均可分层的资料中的行政负担把合格权利变成未:前者解释接口,后者解释未申领合格者比例。

位置D|生成次序:未申领合格者比例 单因只承认未申领合格者比例为决定项 预设〔17 局部最优可加总为整体最优〕把分组改善直接加总为系统净效应 量纲未申领合格者比例/全部合格者 失效当执行者与受益者均可分层的资料中不成立时,未申领合格者比例不能外推 自曝阴性终点:原资料记录成功路径,未入账的议程退出与阴性个案的失败时点未编码 空栏修复劳动:未入账的议程退出与阴性个案 异名另见第 267 号第10条《公共创新实验室:政府需要保护试错的中间组织》

八、街头官僚的裁量能修复也能扭曲规则Street level bureaucracy discretion

提出Maayan Davidovitz、Nissim Cohen,2023,《Politicians’ involvement in street-level policy implementation: Implications for social equity》,Public Policy and Administration:309–328,DOI 10.1177/09520767211024033 争议Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755 最新Yury Netrebin,2026,《Policy Mixes for Regional Innovation Ecosystems: Specificities of Implementation》,Science Management: Theory and Practice:143–157,DOI 10.19181/smtp.2026.8.1.8 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键同一规则下个案决定差异/一线单位

2023 年,一线人员并非政策管道,而是在资源有限时重新定义优先级。回到提出笔,Maayan Davidovitz、Nissim Cohen(2023)的《Politicians’ involvement in street-level policy implementation: Implications for social equity》只在高频与低频状态内解释同一规则下个案决定差异;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。Maayan Davidovitz、Nissim Cohen(2023)的贡献不是再命名,而是把同一规则下个案决定差异放进一线单位这一可失败分母。

跨部门交接造成的损耗对“量能修复也能扭曲规则”的影响若扩大,时间压力、案量与专业规范塑造现场分类与同一规则下个案决定差异的对应就不再稳定。由此可反驳的说法是:同一规则下个案决定差异是唯一决定项。在高频与低频状态中拿走同一规则下个案决定差异而结果仍同号,就否证《Politicians’ involvement in street-level policy implementation: Implications for social equity》的机制解释(Maayan Davidovitz、Nissim Cohen,2023)。《Politicians’ involvement in street-level policy implementation: Implications for social equity》与《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》共同承认高频与低频状态会改变识别,但对同一规则下个案决定差异的方向给出不同承诺。

2020 年后的行政记录把相同申请在不同承办者间的差异量化,使裁量从访谈主题变成可估计变量。Maayan Davidovitz、Nissim Cohen(2023)没有报告同一规则下个案决定差异可跨样本搬用的点估计,本页不替《Politicians’ involvement in street-level policy implementation: Implications for social equity》补造效应量。可证伪阈值预注册为R16=同一规则下个案决定差异除以一线单位:R16>1.00倍才支持原方向,R16≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

2020 年后的行政记录把相同申请在不同承办者间的差异量化,使裁量从访谈主题变成可估计变量。一旦成本转嫁给未观察者,表内收益越高,社会净收益反而越低。反例并不在同一格里:Patrick Bayer、Aykut Öztürk、Sergi Pardos-Pr(2026)的《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》只在具有明确成本和退出规则的干预中的街头官僚的裁量能修复也能样本外与Maayan Davidovitz、Nissim Cohen(2023)形成反号;边界内的同号证据不被冒充为普遍定律。

就“街头官僚的裁量能修复也能扭曲规则”而言,跨出当前样本时,先确认同一规则下个案决定差异除以一线单位仍指同一件事。制度接口随后移动:Yury Netrebin(2026)在《Policy Mixes for Regional Innovation Ecosystems: Specificities of Implementation》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的同一规则下个案决定差异变成可比较对象。

与“街头官僚的裁量能修复也能扭曲规则”相邻,沿适应性治理可追到相邻学科,沿跨部门交接造成的损耗对“量能修复也能扭曲规则”的影响则在 2026 年资料处中断。跨块接口不靠同名:第498号《政策简报:长度不是可用性的代理》结算另一生成层;《Politicians’ involvement in street-level policy implementation: Implications for social equity》仍以同一规则下个案决定差异对一线单位辨向。两边若同时成立,同一规则下个案决定差异会迫使高频与低频状态成为第三项(2023/2026)。到2026年,Yury Netrebin把相同对象移入中央和地方政府、监管机构、公共服务部门与审计机关;外部效度因而取决于具有明确成本和退出规则的干预中的街头官僚的裁量能。

位置E|适用条件:具有明确成本和退出规则 单因只承认同一规则下个案决为决定项 预设〔13 时间尺度可自由压缩〕把当前观察窗直接外推到长期 量纲同一规则下个案决定差异/一线单位 失效若成本转嫁给未观察者,表内收益越高,社会净收益反而越低 自曝代理变量:2023年结果依赖既定分类,未入账的工具组合退出与阴性个会改变类别边界 空栏非正式协调:未入账的工具组合退出与阴性个案 异名另见第 498 号第4条《政策简报:长度不是可用性的代理》

九、适应性试验用阶段更新替代一次定案Adaptive policy experiments

提出Philip Pallmann、Alasdair W. S. McPherson、Christopher J. Brocklehurst 等,2018,《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》,BMC Medicine 16:29,DOI 10.1186/s12916-018-1017-7 争议M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14 最新Radek Kovács、Arnošt Veselý,2026,《Survey Experiments in Public Policy: A Systematic Literature Review》,Review of Policy Research 43(2),DOI 10.1111/ropr.70040 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键每轮更新后分配至更优方案的比例/参与者

2021 年,传统试验先冻结方案再等待结论,适应性设计则在预设规则下分阶段更新。沿着样本表,Philip Pallmann、Alasdair W. S. McPherson、C(2018)的《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》只在本地与跨境链条内解释每轮更新后分配至更优方案的比例;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

这里的中介是贝叶斯更新和停止规则在实施中持续调整干预,终点是每轮更新后分配至更优方案的比例。这把主张压成一条硬命题:每轮更新后分配至更优方案的比例是唯一决定项。在本地与跨境链条中拿走每轮更新后分配至更优方案的比而结果仍同号,就否证《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》的机制解释(Philip Pallmann、Alasdair W. S. McPherson、C,2018)。未申请的合格人群对阶段更新替代一次定案的影响没有进入每轮更新后分配至更优方案的比例的中心读数,这正是《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》最容易被过度外推的地方。

2021 年后政府试点开始报告至少 2 类门槛:何时停止无效方案,何时扩大更优方案。;分母取参与者中可识别“适应性试验用阶段更新替代一次定案”的观察单位。Philip Pallmann、Alasdair W. S. McPherson、C(2018)没有报告每轮更新后分配至更优方案的比例可跨样本搬用的点估计,本页不替《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》补造效应量。可证伪阈值预注册为R17=每轮更新后分配至更优方案的比例除以参与者:R17>1.00倍才支持原方向,R17≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Radek Kovács、Arnošt Veselý(2026)若改变参与者的构成,提出笔的方向必须重新估计,不能沿用旧系数。

2021 年后政府试点开始报告至少 2 类门槛:何时停止无效方案,何时扩大更优方案。在低基线人群中,曝光越多,边际改变却越接近零。两篇论文的冲突要用同终点辨认:M.A. Shulha(2021)的《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》只在行政流程和结果能链接的公共项目中的适应性试验用阶段更新替代样本外与Philip Pallmann、Alasdair W. S. McPherson、C(2018)形成反号;边界内的同号证据不被冒充为普遍定律。

就“适应性试验用阶段更新替代一次定案”而言,最低可比条件是保留参与者中可识别“适应性试验用阶段更新替代一次定案”的观察单位,否则方向含混。近端研究把尺度推远:Radek Kovács、Arnošt Veselý(2026)在《Survey Experiments in Public Policy: A Systematic Literature Review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的每轮更新后分配至更优方案的比例变成可比较对象。

与“适应性试验用阶段更新替代一次定案”相邻,实施科学解决名称对应,未解决未申请的合格人群对“阶段更新替代一次定案”的影响;后者到 2026 年仍是缺口。对撞发生在相同前提下:第557号《ERIC实施策略目录》结算另一生成层;《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》仍以每轮更新后分配至更优方案的比例对参与者辨向。两边若同时成立,每轮更新后分配至更优方案的比会迫使本地与跨境链条成为第三项(2018/2026)。

位置S|可见形态:每轮更新后分配至 单因只承认每轮更新后分配至为决定项 预设〔17 局部最优可加总为整体最优〕把分组改善直接加总为系统净效应 量纲每轮更新后分配至更优方案的比例/参与者 失效在低基线人群中,曝光越多,边际改变反而越接近零 自曝一般均衡:作者没有把未入账的执行能力退出与阴性个与中心样本同权结算 空栏冲突目标:未入账的执行能力退出与阴性个案 异名另见第 557 号第6条《ERIC实施策略目录》

十、危机政策要求速度与可学习性同时存在Rapid policy learning

提出Donald P. Moynihan,2008,《Learning under Uncertainty: Networks in Crisis Management》,Public Administration Review 68(2):350–365,DOI 10.1111/j.1540-6210.2007.00867.x 争议Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43 最新Dedi Wiratmo、Mutia Evi Kristhy、M. Nur Syam、Agung Gunawan Putra,2022,《Government policy analysis in health crisis conditions》,International journal of health sciences 6(2):920–930,DOI 10.53730/ijhs.v6n2.8785 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键政策调整周期与结果反馈时延/危机措施

2025 年,危机时等待完美证据等于不作为,但没有版本记录的快速调整又无法学习。把概念史与估计拆开,Donald P. Moynihan(2008)的《Learning under Uncertainty: Networks in Crisis Management》只在公开承诺与实际行动内解释政策调整周期与结果反馈时延;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

政策调整周期与结果反馈时延仅在实时行政资料和版本记录把紧急调整变成连续学习可追踪时有机制含义。真正需要承担因果责任的是:政策调整周期与结果反馈时延是唯一决定项。在公开承诺与实际行动中拿走政策调整周期与结果反馈时延而结果仍同号,就否证《Learning under Uncertainty: Networks in Crisis Management》的机制解释(Donald P. Moynihan,2008)。

2021 年研究以天或周为单位对照政策版本、执行覆盖和结果,保留可逆决策的证据链。Donald P. Moynihan(2008)没有报告政策调整周期与结果反馈时延可跨样本搬用的点估计,本页不替《Learning under Uncertainty: Networks in Crisis Management》补造效应量。可证伪阈值预注册为R18=政策调整周期与结果反馈时延除以危机措施:R18>1.00倍才支持原方向,R18≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

2021 年研究以天或周为单位对照政策版本、执行覆盖和结果,保留可逆决策的证据链。一旦反馈触发自我修正,早期误差越大,后期方向反而可能逆转。争论的分水岭落到样本边缘:Дмитро Іванович Ткач、Дмитро Костянтинович (2026)的《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》只在有试点与规模化对照的政策中的危机政策要求速度与可学习样本外与Donald P. Moynihan(2008)形成反号;边界内的同号证据不被冒充为普遍定律。对议程、工具组合、执行能力、反馈、政策学习与分配后果分别分层后,政策调整周期与结果反馈时延若只在中心组存在,原命题就必须缩域。

就“危机政策要求速度与可学习性同时存在”而言,这条经验限于危机政策要求速度与可学习性同时存在,没有覆盖一线人员的隐性变通对“度与可学习性同时存在”的影响的路径。这项读数进入新的执行场:Dedi Wiratmo、Mutia Evi Kristhy、M. Nur Syam(2022)在《Government policy analysis in health crisis conditions》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的政策调整周期与结果反馈时延变成可比较对象。

与“危机政策要求速度与可学习性同时存在”相邻,截至 2022 年,一线人员的隐性变通对“度与可学习性同时存在”的影响没有统一口径,尽管邻域已称作政策学习。相邻面板提供反方向切片:第605号《乌克兰数字现金:规模化支付也要保留人工通道》结算另一生成层;《Learning under Uncertainty: Networks in Crisis Management》仍以政策调整周期与结果反馈时延对危机措施辨向。两边若同时成立,政策调整周期与结果反馈时延会迫使公开承诺与实际行动成为第三项(2008/2022)。

位置E|适用条件:有试点与规模化对照的政策 单因只承认政策调整周期与结为决定项 预设〔17 局部最优可加总为整体最优〕把分组改善直接加总为系统净效应 量纲政策调整周期与结果反馈时延/危机措施 失效若反馈触发自我修正,早期误差越大,后期方向反而可能逆转 自曝跨地区复算:提出笔承认制度窗仅为有试点与规模化对照的政策中的危机政策,域外效应未定 空栏二次效应:未入账的反馈退出与阴性个案 异名另见第 605 号第17条《乌克兰数字现金:规模化支付也要保留人工通道》

十一、算法治理把采购条款变成问责入口Algorithmic accountability in government

提出Bernd W. Wirtz、Jan C. Weyerer、Carolin Geyer,2019,《Artificial Intelligence and the Public Sector: Applications and Challenges》,International Journal of Public Administration 42(7):596–615,DOI 10.1080/01900692.2018.1498103 争议Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519 最新Alhassan Musah、Adu Peprah James、Matilda Asiedu-Ampomah、Felicia Koomson,2025,《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》,Journal of Governance and Accountability Studies 5(1):63–77,DOI 10.35912/jgas.v5i1.1253 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键完成影响评估和外部审计的系统数/在用系统

公共算法常由外部供应商建造,责任却落在政府。2025 年的研究把算法治理把采购条款变成问责入口与完成影响评估和外部审计的系统数除以在用系统直接相连。从原始终点看,Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)的《Artificial Intelligence and the Public Sector: Applications and Challenges》只在平均组与分布尾部内解释完成影响评估和外部审计的系统数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

把采购、数据说明和申诉接口共同决定公共算法可问责性和完成影响评估和外部审计的系统数分别编码。反事实只移动一项:完成影响评估和外部审计的系统数是唯一决定项。在平均组与分布尾部中拿走完成影响评估和外部审计的系统而结果仍同号,就否证《Artificial Intelligence and the Public Sector: Applications and Challenges》的机制解释(Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye,2019)。

2023 年后的框架把采购合同、训练数据说明、分群误差和申诉渠道至少列为 4 个审计入口。Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)没有报告完成影响评估和外部审计的系统数可跨样本搬用的点估计,本页不替《Artificial Intelligence and the Public Sector: Applications and Challenges》补造效应量。可证伪阈值预注册为R19=完成影响评估和外部审计的系统数除以在用系统:R19>1.00倍才支持原方向,R19≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

2023 年后的框架把采购合同、训练数据说明、分群误差和申诉渠道至少列为 4 个审计入口。一旦分母排除最难触达者时,成功率越高,公平性反而越差。边界条件在近端复核中显形:Karem Sayed Aboelazm(2026)的《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》只在执行者与受益者均可分层的资料中的算法治理把采购条款变成问样本外与Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)形成反号;边界内的同号证据不被冒充为普遍定律。

就“算法治理把采购条款变成问责入口”而言,完成影响评估和外部审计的系统数仅在原分母内可解释,边外不可原样搬用。复核对象不再停在论文样本:Alhassan Musah、Adu Peprah James、Matilda As(2025)在《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的完成影响评估和外部审计的系统数变成可比较对象。在政策文本、预算执行、行政登记、实施过程与受益者申诉里,Bernd W. Wirtz、Jan C. Weyerer、Carolin Geye(2019)留下的可复查接口是完成影响评估和外部审计的系统数,而不是条目标题本身。

与“算法治理把采购条款变成问责入口”相邻,失败后未发表的试点对“采购条款变成问责入口”的影响是当前遗漏项;行政负担只是其相邻称谓,记录止于 2025 年。邻接条目改用另一分母:第416号《数据访问权替代绝对数据所有权》结算另一生成层;《Artificial Intelligence and the Public Sector: Applications and Challenges》仍以完成影响评估和外部审计的系统数对在用系统辨向。两边若同时成立,完成影响评估和外部审计的系统会迫使平均组与分布尾部成为第三项(2019/2025)。

位置S|可见形态:完成影响评估和外 单因只承认完成影响评估和外为决定项 预设〔23 中位个案代表分布〕以中位个案代表分布尾部 量纲完成影响评估和外部审计的系统数/在用系统 失效当分母排除最难触达者时,成功率越高,公平性反而越差 自曝未决问题:原文的共同支持限于执行者与受益者均可分层的资料中的算法,反例分母仍缺未入账的政策学习退出与阴性个 空栏无反事实项:未入账的政策学习退出与阴性个案 异名另见第 416 号第11条《数据访问权替代绝对数据所有权》

十二、政策组合必须检验相互作用而非逐项相加Policy mixes

提出Karoline S. Rogge、Kristin Reichardt,2016,《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》,Research Policy 45(8):1620–1635,DOI 10.1016/j.respol.2016.04.004 争议Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405 最新Naomi Di Santo、Teresa Del Giudice、Roberta Sisto,2024,《Policy mixes in rural areas: a scoping literature review》,RIVISTA DI ECONOMIA AGRARIA 79(3):83–99,DOI 10.36253/rea-15149 奠基未检得 1980 前同指命名;该结构依赖近二十年才出现的数据或制度对象 关键组合效应减去单项效应之和/政策对象

2026 年,公共政策的新思想是:问题从「什么有效」变成了「在哪里、多大规模、由谁执行时还有效」。按主证据的时序,Karoline S. Rogge、Kristin Reichardt(2016)的《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》只在原始编码与修订编码内解释组合效应减去单项效应之和;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。

核心过程为互补、替代与时序关系让多项政策产生非加总结果。可失败版本可以写成:组合效应减去单项效应之和是唯一决定项。在原始编码与修订编码中拿走组合效应减去单项效应之和而结果仍同号,就否证《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》的机制解释(Karoline S. Rogge、Kristin Reichardt,2016)。

政策组合必须检验相互作用而非逐项相加在 2024 年用组合效应减去单项效应之和除以政策对象留下第 20 组可比读数。Karoline S. Rogge、Kristin Reichardt(2016)没有报告组合效应减去单项效应之和可跨样本搬用的点估计,本页不替《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》补造效应量。可证伪阈值预注册为R20=组合效应减去单项效应之和除以政策对象:R20>1.00倍才支持原方向,R20≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。

而文献里那个漂亮的平均效应,多半是发表偏倚与小样本一起制造的。一旦多种机制方向相反,样本越大,平均效应反而越接近零。反对笔改换了识别窗:Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等(2026)的《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》只在具有明确成本和退出规则的干预中的政策组合必须检验相互作用样本外与Karoline S. Rogge、Kristin Reichardt(2016)形成反号;边界内的同号证据不被冒充为普遍定律。

就“政策组合必须检验相互作用而非逐项相加”而言,向其他人群推广前,先补齐跨部门交接造成的损耗对“相互作用而非逐项相加”的影响的独立证据。延伸证据改换了承载机构:Naomi Di Santo、Teresa Del Giudice、Roberta (2024)在《Policy mixes in rural areas: a scoping literature review》中连接中央和地方政府、监管机构、公共服务部门与审计机关,并把议程、工具组合、执行能力、反馈、政策学习与分配后果中的组合效应减去单项效应之和变成可比较对象。本条资料卡(1980)提出的旧对象在2016年被改造成组合效应减去单项效应之和除以政策对象;组合效应减去单项效应之和新增了可被数据推翻的分母。

与“政策组合必须检验相互作用而非逐项相加”相邻,邻接术语写作适应性治理。2024 年的未完成项仍是跨部门交接造成的损耗对“相互作用而非逐项相加”的影响。两块材料只共享条件场:第478号《水印与检测的脆弱性》结算另一生成层;《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》仍以组合效应减去单项效应之和对政策对象辨向。两边若同时成立,组合效应减去单项效应之和会迫使原始编码与修订编码成为第三项(2016/2024)。第478号《水印与检测的脆弱性》与《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》的分离线是具有明确成本和退出规则的干预中的政策组合必须检验相互作用:前者解释接口,后者解释组合效应减去单项效应之和。

位置D|生成次序:组合效应减去单项 单因只承认组合效应减去单项为决定项 预设〔05 缺失即不存在〕把政策对象外的缺失按零处理 量纲组合效应减去单项效应之和/政策对象 失效若多种机制方向相反,样本越大,平均效应反而越接近零 自曝编码一致性:Karoline S. Rogge、Kristin Reichardt留下的未决项是未入账的分配后果退出与阴性个而非中心点估计 空栏编码疑项:未入账的分配后果退出与阴性个案 异名另见第 478 号第16条《水印与检测的脆弱性》

◎ 二十年连起来看

《证据本位从医学扩散到政府决策》与《证据本位胜利后面临选择性使用》构成第1条时间线:Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)先改写政策文件中系统综述或因果评估引用率,Tracey Barnett McElwee、Laura Danforth、Chri(2025)再把裁决移到被采用研究与全部合格研究之比。样本来源与纳入路径与信息可见度须分账。

《行为团队把默认选项做成低成本干预》与《国家能力重新进入政策效果函数》构成第2条时间线:Paul Dolan、Michael Hallsworth、David Halper(2012)先改写干预组相对对照组完成率差,Martin J. Williams(2021)再把裁决移到税收、人员与执行覆盖构成的能力指数。处理暴露强度与首次事件与重复事件须分账。

《共同生产把公民从受益者变成执行者》与《二、政策组合必须检验相互作用而非逐项相加》构成第3条时间线:Tony Bovaird(2007)先改写由使用者共同完成的服务环节数,Karoline S. Rogge、Kristin Reichardt(2016)再把裁决移到组合效应减去单项效应之和。组织规模与原始编码与修订编码须分账。

◎ 三个常见误解

第1个误解是把《证据本位从医学扩散到政府决策》当成《证据本位胜利后面临选择性使用》的否定;两者看似都谈政策文件中系统综述或因果评估引用率。前者用政策文件中系统综述或因果评估引用率/可评文件,后者用被采用研究与全部合格研究之比/政策议题,分母不同,不能把尺度差写成理论冲突。

第2个误解是把《行为团队把默认选项做成低成本干预》当成《国家能力重新进入政策效果函数》的否定;两者看似都谈干预组相对对照组完成率差。前者用干预组相对对照组完成率差/被触达者,后者用税收、人员与执行覆盖构成的能力指数/行政区,分母不同,不能把尺度差写成理论冲突。

第3个误解是把《共同生产把公民从受益者变成执行者》当成《二、政策组合必须检验相互作用而非逐项相加》的否定;两者看似都谈由使用者共同完成的服务环节数。前者用由使用者共同完成的服务环节数/服务流程,后者用组合效应减去单项效应之和/政策对象,分母不同,不能把尺度差写成理论冲突。

◎ 与相邻领域的接口

第267号《审议浪潮:公民大会把参与从表达意见推进到共同》与本块在短窗与长窗处分工:这里追踪按方案完成的核心环节数/计划环节,公共管理与政府治理解释另一生成层。Joseph A. Durlak、Emily P. DuPre(2008)换用对方分母后须重估符号。

第498号《What Works中心》与本块在公开承诺与实际行动处分工:这里追踪政策调整周期与结果反馈时延/危机措施,智库与政策知识生产解释另一生成层。Donald P. Moynihan(2008)换用对方分母后须重估符号。

第557号《阶梯楔形整群试验》与本块在样本进入路径处分工:这里追踪具有基线和对照的项目数/受资助项目,学习型医疗系统与实施科学解释另一生成层。Howard White(2009)换用对方分母后须重估符号。

◎ 争议现场

Kathryn Oliver、Simon Innvar、Theo Lorenc 等(2014)与R. Andrew Moore(2006)围绕《证据本位从医学扩散到政府决策》未收敛。以政策文件中系统综述或因果评估引用率/可评文件为共同终点;在行政流程和结果能链接的公共项目中的证据本位从医学扩散到政府样本外稳定反号,才淘汰原解释。

Paul Dolan、Michael Hallsworth、David Halper(2012)与David Halpern、Michael Sanders(2016)围绕《行为团队把默认选项做成低成本干预》未收敛。以干预组相对对照组完成率差/被触达者为共同终点;在具有明确成本和退出规则的干预中的行为团队把默认选项做成低样本外稳定反号,才淘汰原解释。

Tony Bovaird(2007)与T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. P(2015)围绕《共同生产把公民从受益者变成执行者》未收敛。以由使用者共同完成的服务环节数/服务流程为共同终点;在具有明确成本和退出规则的干预中的共同生产把公民从受益者变样本外稳定反号,才淘汰原解释。

◎ 往下五年看什么

2026—2031年追踪政策文件中系统综述或因果评估引用率/可评文件。政策文本、预算执行、行政登记、实施过程与受益者申诉保存样本来源与纳入路径、退出和版本;读数若随纳入规则翻转,《证据本位从医学扩散到政府决策》即降级。

2026—2031年追踪干预组相对对照组完成率差/被触达者。政策文本、预算执行、行政登记、实施过程与受益者申诉保存处理暴露强度、退出和版本;读数若随纳入规则翻转,《行为团队把默认选项做成低成本干预》即降级。

2026—2031年追踪由使用者共同完成的服务环节数/服务流程。政策文本、预算执行、行政登记、实施过程与受益者申诉保存组织规模、退出和版本;读数若随纳入规则翻转,《共同生产把公民从受益者变成执行者》即降级。

◎ 可与哪些领域对撞

本块第1条《证据本位从医学扩散到政府决策》对撞第267号《审议浪潮:公民大会把参与从表达意见推进到共同》。共享预设是“01 谁进入分母”。本块以政策文件中系统综述或因果评估引用率辨向,对方从公共管理与政府治理解释生成路径。若两边都成立,矛盾迫使模型新增未入账的政策学习退出与阴性个案。

本块第4条《行为团队把默认选项做成低成本干预》对撞第498号《What Works中心》。共享预设是“02 单一读数代表复杂对象”。本块以干预组相对对照组完成率差辨向,对方从智库与政策知识生产解释生成路径。若两边都成立,矛盾迫使模型新增未入账的工具组合退出与阴性个案。

本块第8条《共同生产把公民从受益者变成执行者》对撞第557号《阶梯楔形整群试验》。共享预设是“02 单一读数代表复杂对象”。本块以由使用者共同完成的服务环节数辨向,对方从学习型医疗系统与实施科学解释生成路径。若两边都成立,矛盾迫使模型新增未入账的分配后果退出与阴性个案。

◎ 十条可做的研究命题

  1. 命题 1:《证据本位从医学扩散到政府决策》与《实施链解释政策为何在现场缩水》分账后,政策文件中系统综述或因果评估引用率/可评文件应保持2014年方向。用预注册分群复算并单列未入账的政策学习退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
  2. 命题 2:《随机试验进入发展与社会政策》与《平均处理效应让位于分群效应》分账后,随机分派后的平均处理效应/合格对象应保持2006年方向。用连接行政记录与过程日志并单列未入账的分配后果退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。
  3. 命题 3:《绩效指标越成功越可能替代真实目》与《国家能力重新进入政策效果函数》分账后,指标改善与真实结果改善之差/考核单位应保持2006年方向。用设置跨制度成对比较并单列未入账的议程退出与阴性个案;越过执行者与受益者均可分层的资料后复算反号即证伪。
  4. 命题 4:《行为团队把默认选项做成低成本干》与《政治时机决定好证据能否成为政策》分账后,干预组相对对照组完成率差/被触达者应保持2012年方向。用保留退出者重估分母并单列未入账的工具组合退出与阴性个案;越过具有明确成本和退出规则的干预后复算反号即证伪。
  5. 命题 5:《影响评估进入援助项目问责链》与《行政负担把合格权利变成未领取福》分账后,具有基线和对照的项目数/受资助项目应保持2009年方向。用用两套盲法编码复核并单列未入账的执行能力退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
  6. 命题 6:《规模化失败提示情境与执行不可省》与《街头官僚的裁量能修复也能扭曲规》分账后,规模实施效应相对试点效应保留率/同类项目应保持2017年方向。用并列短窗与长窗并单列未入账的反馈退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。
  7. 命题 7:《政策转移必须区分机制与表面形式》与《适应性试验用阶段更新替代一次定》分账后,移植后保留的核心机制数/政策组件应保持2012年方向。用拆开中心与尾部样本并单列未入账的政策学习退出与阴性个案;越过执行者与受益者均可分层的资料后复算反号即证伪。
  8. 命题 8:《共同生产把公民从受益者变成执行》与《危机政策要求速度与可学习性同时》分账后,由使用者共同完成的服务环节数/服务流程应保持2007年方向。用追踪首次与重复事件并单列未入账的分配后果退出与阴性个案;越过具有明确成本和退出规则的干预后复算反号即证伪。
  9. 命题 9:《证据本位胜利后面临选择性使用》与《一、算法治理把采购条款变成问责》分账后,被采用研究与全部合格研究之比/政策议题应保持2025年方向。用对照公开承诺与实际行动并单列未入账的议程退出与阴性个案;越过行政流程和结果能链接的公共项后复算反号即证伪。
  10. 命题 10:《规模化效应普遍低于小样本试点》与《二、政策组合必须检验相互作用而》分账后,规模化效应除以原试点效应/项目地点应保持2026年方向。用保存原始与修订版本并单列未入账的工具组合退出与阴性个案;越过有试点与规模化对照的政策中后复算反号即证伪。

◎ 参考文献 · 原始提出、争议与近端复核

  1. Kathryn Oliver、Simon Innvar、Theo Lorenc 等,2014,《A Systematic Review of Barriers to and Facilitators of the Use of Evidence by Policymakers》,BMC Health Services Research 14:2,DOI 10.1186/1472-6963-14-2
  2. R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122
  3. Saiqa Noor、Saquib Khushhal、Aleena Amjad、Asim Aqil,2025,《Using AI to Inform Evidence-based Decision-Making in Educational Policy》,Review of Applied Management and Social Sciences 8(1):183–192,DOI 10.47067/ramss.v8i1.448
  4. Herbert A. Simon,1947,《Administrative Behavior》
  5. Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001
  6. Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751
  7. Radek Kovács、Arnošt Veselý,2026,《Survey Experiments in Public Policy: A Systematic Literature Review》,Review of Policy Research 43(2),DOI 10.1111/ropr.70040
  8. Harold D. Lasswell & Daniel Lerner,1951,《The Policy Sciences》
  9. Gwyn Bevan、Christopher Hood,2006,《What's Measured Is What Matters: Targets and Gaming in the English Public Health Care System》,Public Administration 84(3):517–538,DOI 10.1111/j.1467-9299.2006.00600.x
  10. Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272
  11. Léon Acar,2026,《Digital Co-Production of Public Services》,International Journal of Public Administration:1–2,DOI 10.1080/01900692.2026.2669804
  12. Charles E. Lindblom,1959,〈The Science of Muddling Through〉
  13. Paul Dolan、Michael Hallsworth、David Halpern 等,2012,《Influencing Behaviour: The Mindspace Way》,Journal of Economic Psychology 33(1):264–277,DOI 10.1016/j.joep.2011.10.009
  14. David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015
  15. Camila Regueiro-Ons、Jaime Pinilla、Beatriz González López-Valcárcel,2026,《Fertility response to family policy: Insights from Spain’s paternity leave》,Applied Economic Analysis 34(100):38–60,DOI 10.1108/aea-06-2025-0197
  16. James G. March & Herbert A. Simon,1958,《Organizations》
  17. Howard White,2009,《Theory-Based Impact Evaluation: Principles and Practice》,Journal of Development Effectiveness 1(3):271–284,DOI 10.1080/19439340903114628
  18. Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701
  19. Alhassan Musah、Adu Peprah James、Matilda Asiedu-Ampomah、Felicia Koomson,2025,《impact of electronic procurement (E-procurement) on public sector accountability in Ghana》,Journal of Governance and Accountability Studies 5(1):63–77,DOI 10.35912/jgas.v5i1.1253
  20. Graham T. Allison,1971,《Essence of Decision》
  21. Karthik Muralidharan、Paul Niehaus,2017,《Experimentation at Scale》,Journal of Economic Perspectives 31(4):103–124,DOI 10.1257/jep.31.4.103
  22. Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026
  23. Imran Rasul,2026,《From field experiments to policy interventions at scale》,Science,DOI 10.1126/science.aef8482
  24. Jeffrey L. Pressman & Aaron Wildavsky,1973,《Implementation》
  25. Diane Stone,2012,《Transfer and translation of policy》,Policy Studies:483–499,DOI 10.1080/01442872.2012.695933
  26. Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783
  27. Alireza Jazini,2021,《Translation policy》,Translation and Translanguaging in Multilingual Contexts 7(3):339–369,DOI 10.1075/ttmc.00077.jaz
  28. Donald T. Campbell,1976,〈Assessing the Impact of Planned Social Change〉
  29. Tony Bovaird,2007,《Beyond Engagement and Participation: User and Community Coproduction of Public Services》,Public Administration Review 67(5):846–860,DOI 10.1111/j.1540-6210.2007.00773.x
  30. T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567
  31. Chunsheng Li、Jinpeng Wu、Huiming Zhang、Zhiming Han,2023,《Co-production and Citizens’ Satisfaction with Public Services: The Case of Environmental Public Services in China》,Lex localis - Journal of Local Self-Government 21(1):117–142,DOI 10.4335/21.1.117-142(2023)
  32. Mancur Olson,1965,《The Logic of Collective Action》
  33. Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163
  34. John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693
  35. Vesna Trifunović、Stuart Blume,2023,《Which vaccine? Between evidence-based policy and symbolic politics》,Critical Public Health 33(5):864–869,DOI 10.1080/09581596.2023.2289346
  36. Joseph A. Durlak、Emily P. DuPre,2008,《Implementation Matters: A Review of Research on the Influence of Implementation on Program Outcomes》,American Journal of Community Psychology 41:327–350,DOI 10.1007/s10464-008-9165-0
  37. Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607
  38. I Iskandar,2020,《Teachers’ fidelity to curriculum: an insight from teachers’ implementation of the Indonesian EFL curriculum policy》,International Journal of Humanities and Innovation (IJHI) 3(2):50–55,DOI 10.33750/ijhi.v3i2.79
  39. Kosuke Imai、Marc Ratkovic,2013,《Estimating Treatment Effect Heterogeneity in Randomized Program Evaluation》,Annals of Applied Statistics 7(1):443–470,DOI 10.1214/12-AOAS593
  40. Ilja Cornelisz、Chris van Klaveren,2022,《Recurrent individual treatment assignment: a treatment policy approach to account for heterogeneous treatment effects》,npj Science of Learning 7(1),DOI 10.1038/s41539-021-00117-4
  41. Martin J. Williams,2021,《Beyond state capacity: bureaucratic performance, policy implementation and reform》,Journal of Institutional Economics:339–357,DOI 10.1017/s1744137420000478
  42. Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15
  43. Aklilu Azazh、Jacinta Nzinga、Joseph Ngonzi、Kidist Bartolomeos,2025,《Local capacity for policy development and implementation》,Bulletin of the World Health Organization 103(7):415–415A,DOI 10.2471/blt.25.294222
  44. Joshua Newman,2017,《Debating the politics of evidence‐based policy》,Public Administration:1107–1112,DOI 10.1111/padm.12373
  45. Neil McHugh,2022,《Eliciting public values on health inequalities: missing evidence for policy windows?》,Evidence & Policy 18(4):733–745,DOI 10.1332/174426421x16286783870175
  46. Sarah Giest、Annemarie Samuels,2023,《Administrative burden in digital public service delivery: The social infrastructure of library programs for e‐inclusion》,Review of Policy Research:626–645,DOI 10.1111/ropr.12516
  47. Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193
  48. Shai Alon、Momi Dahan,2025,《The perceived power of clients, administrative burden and take-up of social benefits》,European Journal of Social Security 27(3):251–275,DOI 10.1177/13882627251372026
  49. Maayan Davidovitz、Nissim Cohen,2023,《Politicians’ involvement in street-level policy implementation: Implications for social equity》,Public Policy and Administration:309–328,DOI 10.1177/09520767211024033
  50. Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755
  51. Yury Netrebin,2026,《Policy Mixes for Regional Innovation Ecosystems: Specificities of Implementation》,Science Management: Theory and Practice:143–157,DOI 10.19181/smtp.2026.8.1.8
  52. Philip Pallmann、Alasdair W. S. McPherson、Christopher J. Brocklehurst 等,2018,《Adaptive Designs in Clinical Trials: Why Use Them, and How to Run and Report Them》,BMC Medicine 16:29,DOI 10.1186/s12916-018-1017-7
  53. M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14
  54. Donald P. Moynihan,2008,《Learning under Uncertainty: Networks in Crisis Management》,Public Administration Review 68(2):350–365,DOI 10.1111/j.1540-6210.2007.00867.x
  55. Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43
  56. Dedi Wiratmo、Mutia Evi Kristhy、M. Nur Syam、Agung Gunawan Putra,2022,《Government policy analysis in health crisis conditions》,International journal of health sciences 6(2):920–930,DOI 10.53730/ijhs.v6n2.8785
  57. Bernd W. Wirtz、Jan C. Weyerer、Carolin Geyer,2019,《Artificial Intelligence and the Public Sector: Applications and Challenges》,International Journal of Public Administration 42(7):596–615,DOI 10.1080/01900692.2018.1498103
  58. Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519
  59. Karoline S. Rogge、Kristin Reichardt,2016,《Policy Mixes for Sustainability Transitions: An Extended Concept and Framework for Analysis》,Research Policy 45(8):1620–1635,DOI 10.1016/j.respol.2016.04.004
  60. Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405
  61. Naomi Di Santo、Teresa Del Giudice、Roberta Sisto,2024,《Policy mixes in rural areas: a scoping literature review》,RIVISTA DI ECONOMIA AGRARIA 79(3):83–99,DOI 10.36253/rea-15149
【学科经典思想汇集部分】1950–2006 · 二十条经典思想

以下二十条倒着追问公共政策的现代判断:旧前提由谁提出、凭什么材料成立、后来在哪个分母上被修正。每条都回指上文一条现代思想,并把失效条件与异名接口一并保留。

经一、政策科学的跨学科计划Classic 01 · Public Policy

提出Harold D. Lasswell、Daniel Lerner,1951 年,Lasswell HD, Lerner D, eds. The Policy Sciences. Stanford University Press (1951)。 流变R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122随后重检这条命题的对象、识别和外推边界。 今用本块甲“证据本位从医学扩散到政府决策”继续使用、修正或反对它建立的判断接口。 关键政策科学的跨学科计划把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

1951年的《政策科学的跨学科计划》不是名人标签。Harold D. Lasswell、Daniel Lerner沿机制史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《政策科学的跨学科计划》的阴性对象与退出记录由此能在同一账本重算。

R. Andrew Moore,2006,《Evidence-based policy-making》,Clinic…后来反向校验《政策科学的跨学科计划》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块甲对读。现代关键读数是“政策文件中系统综述或因果评估引用率/可评文件”。它说明《政策科学的跨学科计划》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《政策科学的跨学科计划》的新证据。核验《政策科学的跨学科计划》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置E——它把“《政策科学的跨学科计划》的机制史入口”视为单独足够 预设〔01 谁进入分母〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块甲的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“政策科学的跨学科计划”,机制史称“可撤回的旧接口”;另见本块甲

经二、组织中的决策与程序Classic 02 · Public Policy

提出James G. March、Herbert A. Simon,1958 年,March JG, Simon HA. Organizations. Wiley (1958)。 流变Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751随后重检这条命题的对象、识别和外推边界。 今用本块乙“随机试验进入发展与社会政策”继续使用、修正或反对它建立的判断接口。 关键组织中的决策与程序把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《组织中的决策与程序》出现前,公共政策常把同名现象当作同一对象。James G. March、Herbert A. Simon于1958年沿机制史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《组织中的决策与程序》改变的是判决程序,不是增加一条永远正确的结论。

Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment …把《组织中的决策与程序》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块乙仍借用这套接口;其中关键读数是“随机分派后的平均处理效应/合格对象”。《组织中的决策与程序》若改用另一分母,结论就可能反号。《组织中的决策与程序》因此成为现代条目的历史压力测试。核验《组织中的决策与程序》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《组织中的决策与程序》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置S——它把“《组织中的决策与程序》的机制史入口”视为单独足够 预设〔02 单一读数代表复杂对象〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块乙的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“组织中的决策与程序”,机制史称“可撤回的旧接口”;另见本块乙

经三、渐进主义与摸着石头过河Classic 03 · Public Policy

提出Charles E. Lindblom,1959 年,Lindblom CE. The Science of Muddling Through. Public Administration Review 19 (1959)。 流变Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272随后重检这条命题的对象、识别和外推边界。 今用本块丙“绩效指标越成功越可能替代真实目标”继续使用、修正或反对它建立的判断接口。 关键渐进主义与摸着石头过河把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《渐进主义与摸着石头过河》在1959年造成的转向首先是一项机制史选择。Charles E. Lindblom把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《渐进主义与摸着石头过河》原文本之外仍有空栏,教科书式扩写不能自动填平。

后续争论Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in …缩窄或改写了《渐进主义与摸着石头过河》。它连接本块丙时,现代证据“指标改善与真实结果改善之差/考核单位”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《渐进主义与摸着石头过河》的外推,而不是替经典找托词。核验《渐进主义与摸着石头过河》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《渐进主义与摸着石头过河》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置D——它把“《渐进主义与摸着石头过河》的机制史入口”视为单独足够 预设〔03 有限近似控制无限对象〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块丙的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“渐进主义与摸着石头过河”,机制史称“可撤回的旧接口”;另见本块丙

经四、集体行动与选择性激励Classic 04 · Public Policy

提出Mancur Olson,1965 年,Olson M. The Logic of Collective Action. Harvard University Press (1965)。 流变David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015随后重检这条命题的对象、识别和外推边界。 今用本块丁“行为团队把默认选项做成低成本干预”继续使用、修正或反对它建立的判断接口。 关键集体行动与选择性激励把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

Mancur Olson在1965年的《集体行动与选择性激励》为公共政策留下机制史装置:公开对象怎样进入分母,并把例外放在模型内。《集体行动与选择性激励》以前的争论容易把测量便利当成本体事实;《集体行动与选择性激励》使两者能够分账。《集体行动与选择性激励》成为经典,靠的是接受反例修订。

用David Halpern、Michael Sanders,2016,《Nudging by government:…回看《集体行动与选择性激励》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块丁保存这条差异;关键判断是“干预组相对对照组完成率差/被触达者”。它把《集体行动与选择性激励》的失败对象送回比较。《集体行动与选择性激励》的旧前提由本块检验证据成本。核验《集体行动与选择性激励》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置E——它把“《集体行动与选择性激励》的机制史入口”视为单独足够 预设〔04 测量不改变被测对象〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块丁的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“集体行动与选择性激励”,机制史称“可撤回的旧接口”;另见本块丁

经五、决策模型与古巴导弹危机Classic 05 · Public Policy

提出Graham T. Allison,1971 年,Allison GT. Essence of Decision. Little, Brown (1971)。 流变Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701随后重检这条命题的对象、识别和外推边界。 今用本块戊“影响评估进入援助项目问责链”继续使用、修正或反对它建立的判断接口。 关键决策模型与古巴导弹危机把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

1971年的《决策模型与古巴导弹危机》不是名人标签。Graham T. Allison沿机制史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《决策模型与古巴导弹危机》的阴性对象与退出记录由此能在同一账本重算。

Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasil…后来反向校验《决策模型与古巴导弹危机》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块戊对读。现代关键读数是“具有基线和对照的项目数/受资助项目”。它说明《决策模型与古巴导弹危机》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《决策模型与古巴导弹危机》的新证据。核验《决策模型与古巴导弹危机》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置S——它把“《决策模型与古巴导弹危机》的机制史入口”视为单独足够 预设〔05 平均值代表个体〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块戊的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“决策模型与古巴导弹危机”,机制史称“可撤回的旧接口”;另见本块戊

经六、执行研究Classic 06 · Public Policy

提出Jeffrey L. Pressman、Aaron Wildavsky,1973 年,Pressman JL, Wildavsky A. Implementation. University of California Press (1973)。 流变Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026随后重检这条命题的对象、识别和外推边界。 今用本块己“规模化失败提示情境与执行不可省略”继续使用、修正或反对它建立的判断接口。 关键执行研究把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《执行研究》出现前,公共政策常把同名现象当作同一对象。Jeffrey L. Pressman、Aaron Wildavsky于1973年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《执行研究》改变的是判决程序,不是增加一条永远正确的结论。

Murali Krishna Pasupuleti,2026,《Distributional Policy Eval…把《执行研究》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块己仍借用这套接口;其中关键读数是“规模实施效应相对试点效应保留率/同类项目”。《执行研究》若改用另一分母,结论就可能反号。《执行研究》因此成为现代条目的历史压力测试。核验《执行研究》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《执行研究》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《执行研究》应先冻结分母和停止规则,再比较旧读数与新读数。

位置D——它把“《执行研究》的测量史入口”视为单独足够 预设〔06 聚合次序不影响结论〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块己的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“执行研究”,测量史称“可撤回的旧接口”;另见本块己

经七、实验社会与政策评估Classic 07 · Public Policy

提出Donald T. Campbell,1976 年,Campbell DT. Assessing the Impact of Planned Social Change. Dartmouth College (1976)。 流变Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783随后重检这条命题的对象、识别和外推边界。 今用本块庚“政策转移必须区分机制与表面形式”继续使用、修正或反对它建立的判断接口。 关键实验社会与政策评估把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《实验社会与政策评估》在1976年造成的转向首先是一项测量史选择。Donald T. Campbell把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《实验社会与政策评估》原文本之外仍有空栏,教科书式扩写不能自动填平。

后续争论Tolga Duygun,2020,《Policy translation in Turkish disabilit…缩窄或改写了《实验社会与政策评估》。它连接本块庚时,现代证据“移植后保留的核心机制数/政策组件”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《实验社会与政策评估》的外推,而不是替经典找托词。核验《实验社会与政策评估》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《实验社会与政策评估》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置E——它把“《实验社会与政策评估》的测量史入口”视为单独足够 预设〔07 效果可由参与者自己评定〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块庚的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“实验社会与政策评估”,测量史称“可撤回的旧接口”;另见本块庚

经八、多源流与政策窗口Classic 08 · Public Policy

提出John W. Kingdon,1984 年,Kingdon JW. Agendas, Alternatives, and Public Policies. Little, Brown (1984)。 流变T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567随后重检这条命题的对象、识别和外推边界。 今用本块辛“共同生产把公民从受益者变成执行者”继续使用、修正或反对它建立的判断接口。 关键多源流与政策窗口把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

John W. Kingdon在1984年的《多源流与政策窗口》为公共政策留下测量史装置:公开对象怎样进入分母,并把例外放在模型内。《多源流与政策窗口》以前的争论容易把测量便利当成本体事实;《多源流与政策窗口》使两者能够分账。《多源流与政策窗口》成为经典,靠的是接受反例修订。

用T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Act…回看《多源流与政策窗口》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块辛保存这条差异;关键判断是“由使用者共同完成的服务环节数/服务流程”。它把《多源流与政策窗口》的失败对象送回比较。《多源流与政策窗口》的旧前提由本块检验证据成本。核验《多源流与政策窗口》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《多源流与政策窗口》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置S——它把“《多源流与政策窗口》的测量史入口”视为单独足够 预设〔08 缺失即不存在〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块辛的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“多源流与政策窗口”,测量史称“可撤回的旧接口”;另见本块辛

经九、倡议联盟框架Classic 09 · Public Policy

提出Paul A. Sabatier,1988 年,Sabatier PA. An Advocacy Coalition Framework of Policy Change. Policy Sciences 21 (1988)。 流变John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693随后重检这条命题的对象、识别和外推边界。 今用本块一“证据本位胜利后面临选择性使用”继续使用、修正或反对它建立的判断接口。 关键倡议联盟框架把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

1988年的《倡议联盟框架》不是名人标签。Paul A. Sabatier沿测量史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《倡议联盟框架》的阴性对象与退出记录由此能在同一账本重算。

John Humphreys,2025,《The politics of an Alien Monster: Ret…后来反向校验《倡议联盟框架》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块一对读。现代关键读数是“被采用研究与全部合格研究之比/政策议题”。它说明《倡议联盟框架》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《倡议联盟框架》的新证据。核验《倡议联盟框架》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《倡议联盟框架》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置D——它把“《倡议联盟框架》的测量史入口”视为单独足够 预设〔09 边界一次划定后保持稳定〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块一的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“倡议联盟框架”,测量史称“可撤回的旧接口”;另见本块一

经十、制度分析与发展框架Classic 10 · Public Policy

提出Elinor Ostrom,1990 年,Ostrom E. Governing the Commons. Cambridge University Press (1990)。 流变Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001随后重检这条命题的对象、识别和外推边界。 今用本块二“规模化效应普遍低于小样本试点”继续使用、修正或反对它建立的判断接口。 关键制度分析与发展框架把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《制度分析与发展框架》出现前,公共政策常把同名现象当作同一对象。Elinor Ostrom于1990年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《制度分析与发展框架》改变的是判决程序,不是增加一条永远正确的结论。

Jennifer L. Romich,2006,《Randomized social policy experime…把《制度分析与发展框架》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块二仍借用这套接口;其中关键读数是“规模化效应除以原试点效应/项目地点”。《制度分析与发展框架》若改用另一分母,结论就可能反号。《制度分析与发展框架》因此成为现代条目的历史压力测试。核验《制度分析与发展框架》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《制度分析与发展框架》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置E——它把“《制度分析与发展框架》的测量史入口”视为单独足够 预设〔10 更多数据必然减少偏倚〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块二的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“制度分析与发展框架”,测量史称“可撤回的旧接口”;另见本块二

经十一、语言游戏与规则使用Classic 11 · Public Policy

提出Ludwig Wittgenstein,1953 年,Wittgenstein L. Philosophical Investigations. Blackwell (1953)。 流变Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607随后重检这条命题的对象、识别和外推边界。 今用本块三“实施链解释政策为何在现场缩水”继续使用、修正或反对它建立的判断接口。 关键语言游戏与规则使用把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《语言游戏与规则使用》在1953年造成的转向首先是一项制度史选择。Ludwig Wittgenstein把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《语言游戏与规则使用》原文本之外仍有空栏,教科书式扩写不能自动填平。

后续争论Mikael Persson、Anders Sundell,2025,《Ideological bias in po…缩窄或改写了《语言游戏与规则使用》。它连接本块三时,现代证据“按方案完成的核心环节数/计划环节”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《语言游戏与规则使用》的外推,而不是替经典找托词。核验《语言游戏与规则使用》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《语言游戏与规则使用》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置S——它把“《语言游戏与规则使用》的制度史入口”视为单独足够 预设〔11 可复现=可重做〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块三的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“语言游戏与规则使用”,制度史称“可撤回的旧接口”;另见本块三

经十二、社会理论与中层机制Classic 12 · Public Policy

提出Robert K. Merton,1957 年,Merton RK. Social Theory and Social Structure. Free Press (1957)。 流变Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026随后重检这条命题的对象、识别和外推边界。 今用本块四“平均处理效应让位于分群效应”继续使用、修正或反对它建立的判断接口。 关键社会理论与中层机制把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

Robert K. Merton在1957年的《社会理论与中层机制》为公共政策留下制度史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论与中层机制》以前的争论容易把测量便利当成本体事实;《社会理论与中层机制》使两者能够分账。《社会理论与中层机制》成为经典,靠的是接受反例修订。

用Murali Krishna Pasupuleti,2026,《Distributional Policy Eval…回看《社会理论与中层机制》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块四保存这条差异;关键判断是“分群处理效应极差/预注册子群”。它把《社会理论与中层机制》的失败对象送回比较。《社会理论与中层机制》的旧前提由本块检验证据成本。核验《社会理论与中层机制》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《社会理论与中层机制》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置D——它把“《社会理论与中层机制》的制度史入口”视为单独足够 预设〔12 成本可外置而不改变结论〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块四的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“社会理论与中层机制”,制度史称“可撤回的旧接口”;另见本块四

经十三、日常生活中的自我呈现Classic 13 · Public Policy

提出Erving Goffman,1959 年,Goffman E. The Presentation of Self in Everyday Life. Doubleday (1959)。 流变Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15随后重检这条命题的对象、识别和外推边界。 今用本块五“国家能力重新进入政策效果函数”继续使用、修正或反对它建立的判断接口。 关键日常生活中的自我呈现把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

1959年的《日常生活中的自我呈现》不是名人标签。Erving Goffman沿制度史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《日常生活中的自我呈现》的阴性对象与退出记录由此能在同一账本重算。

Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Des…后来反向校验《日常生活中的自我呈现》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块五对读。现代关键读数是“税收、人员与执行覆盖构成的能力指数/行政区”。它说明《日常生活中的自我呈现》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《日常生活中的自我呈现》的新证据。核验《日常生活中的自我呈现》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置E——它把“《日常生活中的自我呈现》的制度史入口”视为单独足够 预设〔13 时间尺度可自由压缩〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块五的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“日常生活中的自我呈现”,制度史称“可撤回的旧接口”;另见本块五

经十四、范式与科学共同体Classic 14 · Public Policy

提出Thomas S. Kuhn,1962 年,Kuhn TS. The Structure of Scientific Revolutions. University of Chicago Press (1962)。 流变Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163随后重检这条命题的对象、识别和外推边界。 今用本块六“政治时机决定好证据能否成为政策”继续使用、修正或反对它建立的判断接口。 关键范式与科学共同体把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《范式与科学共同体》出现前,公共政策常把同名现象当作同一对象。Thomas S. Kuhn于1962年沿制度史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《范式与科学共同体》改变的是判决程序,不是增加一条永远正确的结论。

Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myt…把《范式与科学共同体》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块六仍借用这套接口;其中关键读数是“证据发布至政策采用的月数/成功议题”。《范式与科学共同体》若改用另一分母,结论就可能反号。《范式与科学共同体》因此成为现代条目的历史压力测试。核验《范式与科学共同体》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《范式与科学共同体》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置S——它把“《范式与科学共同体》的制度史入口”视为单独足够 预设〔14 因与果的方向是给定的〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块六的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“范式与科学共同体”,制度史称“可撤回的旧接口”;另见本块六

经十五、正义的制度排序Classic 15 · Public Policy

提出John Rawls,1971 年,Rawls J. A Theory of Justice. Harvard University Press (1971)。 流变Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193随后重检这条命题的对象、识别和外推边界。 今用本块七“行政负担把合格权利变成未领取福利”继续使用、修正或反对它建立的判断接口。 关键正义的制度排序把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《正义的制度排序》在1971年造成的转向首先是一项制度史选择。John Rawls把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《正义的制度排序》原文本之外仍有空栏,教科书式扩写不能自动填平。

后续争论Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,…缩窄或改写了《正义的制度排序》。它连接本块七时,现代证据“未申领合格者比例/全部合格者”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《正义的制度排序》的外推,而不是替经典找托词。核验《正义的制度排序》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《正义的制度排序》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《正义的制度排序》应先冻结分母和停止规则,再比较旧读数与新读数。

位置D——它把“《正义的制度排序》的制度史入口”视为单独足够 预设〔15 同名即同物〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块七的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“正义的制度排序”,制度史称“可撤回的旧接口”;另见本块七

经十六、深描与文化解释Classic 16 · Public Policy

提出Clifford Geertz,1973 年,Geertz C. The Interpretation of Cultures. Basic Books (1973)。 流变Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755随后重检这条命题的对象、识别和外推边界。 今用本块八“街头官僚的裁量能修复也能扭曲规则”继续使用、修正或反对它建立的判断接口。 关键深描与文化解释把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

Clifford Geertz在1973年的《深描与文化解释》为公共政策留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《深描与文化解释》以前的争论容易把测量便利当成本体事实;《深描与文化解释》使两者能够分账。《深描与文化解释》成为经典,靠的是接受反例修订。

用Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climat…回看《深描与文化解释》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块八保存这条差异;关键判断是“同一规则下个案决定差异/一线单位”。它把《深描与文化解释》的失败对象送回比较。《深描与文化解释》的旧前提由本块检验证据成本。核验《深描与文化解释》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《深描与文化解释》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置E——它把“《深描与文化解释》的人物史入口”视为单独足够 预设〔16 稀有与常见服从同一机制〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块八的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“深描与文化解释”,人物史称“可撤回的旧接口”;另见本块八

经十七、规训、记录与可治理身体Classic 17 · Public Policy

提出Michel Foucault,1975 年,Foucault M. Discipline and Punish. Gallimard (1975)。 流变M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14随后重检这条命题的对象、识别和外推边界。 今用本块九“适应性试验用阶段更新替代一次定案”继续使用、修正或反对它建立的判断接口。 关键规训、记录与可治理身体把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

1975年的《规训、记录与可治理身体》不是名人标签。Michel Foucault沿人物史把公共政策中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《规训、记录与可治理身体》的阴性对象与退出记录由此能在同一账本重算。

M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED …后来反向校验《规训、记录与可治理身体》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块九对读。现代关键读数是“每轮更新后分配至更优方案的比例/参与者”。它说明《规训、记录与可治理身体》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《规训、记录与可治理身体》的新证据。核验《规训、记录与可治理身体》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置S——它把“《规训、记录与可治理身体》的人物史入口”视为单独足够 预设〔17 局部最优可加总为整体最优〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块九的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“规训、记录与可治理身体”,人物史称“可撤回的旧接口”;另见本块九

经十八、区分、品味与社会再生产Classic 18 · Public Policy

提出Pierre Bourdieu,1979 年,Bourdieu P. La Distinction. Éditions de Minuit (1979)。 流变Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43随后重检这条命题的对象、识别和外推边界。 今用本块十“危机政策要求速度与可学习性同时存在”继续使用、修正或反对它建立的判断接口。 关键区分、品味与社会再生产把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《区分、品味与社会再生产》出现前,公共政策常把同名现象当作同一对象。Pierre Bourdieu于1979年沿人物史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《区分、品味与社会再生产》改变的是判决程序,不是增加一条永远正确的结论。

Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVER…把《区分、品味与社会再生产》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块十仍借用这套接口;其中关键读数是“政策调整周期与结果反馈时延/危机措施”。《区分、品味与社会再生产》若改用另一分母,结论就可能反号。《区分、品味与社会再生产》因此成为现代条目的历史压力测试。核验《区分、品味与社会再生产》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《区分、品味与社会再生产》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置D——它把“《区分、品味与社会再生产》的人物史入口”视为单独足够 预设〔18 干预不回写到被干预者〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块十的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“区分、品味与社会再生产”,人物史称“可撤回的旧接口”;另见本块十

经十九、交往行动与公共理由Classic 19 · Public Policy

提出Jürgen Habermas,1981 年,Habermas J. The Theory of Communicative Action. Beacon Press (1981)。 流变Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519随后重检这条命题的对象、识别和外推边界。 今用本块十一“算法治理把采购条款变成问责入口”继续使用、修正或反对它建立的判断接口。 关键交往行动与公共理由把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

《交往行动与公共理由》在1981年造成的转向首先是一项人物史选择。Jürgen Habermas把对象、操作和失败读数排成可质疑次序,没有把公共政策的复杂性缩成权威判断。《交往行动与公共理由》原文本之外仍有空栏,教科书式扩写不能自动填平。

后续争论Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of N…缩窄或改写了《交往行动与公共理由》。它连接本块十一时,现代证据“完成影响评估和外部审计的系统数/在用系统”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《交往行动与公共理由》的外推,而不是替经典找托词。核验《交往行动与公共理由》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《交往行动与公共理由》须注明采用哪一版定义,同名术语不等于同一证据单位。

位置E——它把“《交往行动与公共理由》的人物史入口”视为单独足够 预设〔19 类别互斥且穷尽〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块十一的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“交往行动与公共理由”,人物史称“可撤回的旧接口”;另见本块十一

经二十、社会理论的微观基础Classic 20 · Public Policy

提出James S. Coleman,1990 年,Coleman JS. Foundations of Social Theory. Harvard University Press (1990)。 流变Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405随后重检这条命题的对象、识别和外推边界。 今用本块十二“政策组合必须检验相互作用而非逐项相加”继续使用、修正或反对它建立的判断接口。 关键社会理论的微观基础把公共政策的一项旧判断压成可撤回命题;比较必须固定对象、分母和时间窗,补回反例后若方向改变,经典只保留原适用域。

James S. Coleman在1990年的《社会理论的微观基础》为公共政策留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论的微观基础》以前的争论容易把测量便利当成本体事实;《社会理论的微观基础》使两者能够分账。《社会理论的微观基础》成为经典,靠的是接受反例修订。

用Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradic…回看《社会理论的微观基础》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块十二保存这条差异;关键判断是“组合效应减去单项效应之和/政策对象”。它把《社会理论的微观基础》的失败对象送回比较。《社会理论的微观基础》的旧前提由本块检验证据成本。核验《社会理论的微观基础》时须同时保存它没有解释的对象,不能只汇集成功分支。

位置S——它把“《社会理论的微观基础》的人物史入口”视为单独足够 预设〔20 窗口内稳定=长期稳定〕默认本条比较的对象边界在迁移前后保持可换算 量纲支持本条方向的独立复核数∶全部纳入的正例、反例与退出记录数 失效当补回排除者或改用本块十二的分母后,支持率越高而真实覆盖反而越低,本条外推失效 异名本领域称“社会理论的微观基础”,人物史称“可撤回的旧接口”;另见本块十二

◎ 这一层怎么用

先从“今用”回到上文对应现代条,再比较对象、分母和停止规则。只共享名词而不能换算量纲的关系登记为异名;能够共用失败对象的关系才进入碰撞。

经典身份不提供豁免。提出年份只决定它属于哪一层,后续反例负责划出今天仍可使用的边界;同一经典在新制度里失效,应明确写成撤回而不是补托词。

◎ 经典层资料核验

  1. Lasswell HD, Lerner D, eds. The Policy Sciences. Stanford University Press (1951)(专著)。
  2. March JG, Simon HA. Organizations. Wiley (1958)(专著)。
  3. Lindblom CE. The Science of Muddling Through. Public Administration Review 19 (1959)。
  4. Olson M. The Logic of Collective Action. Harvard University Press (1965)(专著)。
  5. Allison GT. Essence of Decision. Little, Brown (1971)(专著)。
  6. Pressman JL, Wildavsky A. Implementation. University of California Press (1973)(专著)。
  7. Campbell DT. Assessing the Impact of Planned Social Change. Dartmouth College (1976)(专著)。
  8. Kingdon JW. Agendas, Alternatives, and Public Policies. Little, Brown (1984)(专著)。
  9. Sabatier PA. An Advocacy Coalition Framework of Policy Change. Policy Sciences 21 (1988)。
  10. Ostrom E. Governing the Commons. Cambridge University Press (1990)(专著)。
  11. Wittgenstein L. Philosophical Investigations. Blackwell (1953)(专著)。
  12. Merton RK. Social Theory and Social Structure. Free Press (1957)(专著)。
  13. Goffman E. The Presentation of Self in Everyday Life. Doubleday (1959)(专著)。
  14. Kuhn TS. The Structure of Scientific Revolutions. University of Chicago Press (1962)(专著)。
  15. Rawls J. A Theory of Justice. Harvard University Press (1971)(专著)。
  16. Geertz C. The Interpretation of Cultures. Basic Books (1973)(专著)。
  17. Foucault M. Discipline and Punish. Gallimard (1975)(专著)。
  18. Bourdieu P. La Distinction. Éditions de Minuit (1979)(专著)。
  19. Habermas J. The Theory of Communicative Action. Beacon Press (1981)(专著)。
  20. Coleman JS. Foundations of Social Theory. Harvard University Press (1990)(专著)。
  21. R. Andrew Moore,2006,《Evidence-based policy-making》,Clinical Chemistry and Laboratory Medicine (CCLM) 44(6),DOI 10.1515/cclm.2006.122。
  22. Yixing Chen、Shrihari Sridhar、Vikas Mittal,2021,《Treatment Effect Heterogeneity in Randomized Field Experiments: A Methodological Comparison and Public Policy Implications》,Journal of Public Policy & Marketing 40(4):457–462,DOI 10.1177/07439156211032751。
  23. Nyiramukama Diana Kashaka,2026,《Algorithmic Governance in Public Services: Accountability and Bias Audits》,NEWPORT INTERNATIONAL JOURNAL OF CURRENT ISSUES IN ARTS AND MANAGEMENT 7(1):62–72,DOI 10.59298/nijciam/2025/71.6272。
  24. David Halpern、Michael Sanders,2016,《Nudging by government: Progress, impact, & lessons learned》,Behavioral Science & Policy 2(2):52–65,DOI 10.1353/bsp.2016.0015。
  25. Ratnida Rahmasari、Unti Ludigdo、Ali Djamhuri,2024,《Pancasila Accountability As A Criticism of Public Accountability Constructions In Indonesia》,The International Journal of Accounting and Business Society 32(1):112–127,DOI 10.21776/ijabs.2024.32.1.701。
  26. Murali Krishna Pasupuleti,2026,《Distributional Policy Evaluation for Heterogeneous Treatment Effects, Social Equity and Climate-Transition Governance》,International Journal of Academic and Industrial Research Innovations(IJAIRI) 06(07):142–180,DOI 10.62311/nesx/rp4jy-30072026。
  27. Tolga Duygun,2020,《Policy translation in Turkish disability policy: The role and limitations of international organisations》,Global Social Policy 20(3):305–332,DOI 10.1177/1468018120928783。
  28. T. BOVAIRD、G.G. VAN RYZIN、E. LOEFFLER、S. PARRADO,2015,《Activating Citizens to Participate in Collective Co-Production of Public Services》,Journal of Social Policy 44(1):1–23,DOI 10.1017/s0047279414000567。
  29. John Humphreys,2025,《The politics of an Alien Monster: Retrospective analysis of the use of evidence at the science-policy interface》,Ocean & Coastal Management 266:107693,DOI 10.1016/j.ocecoaman.2025.107693。
  30. Jennifer L. Romich,2006,《Randomized social policy experiments and research on child development》,Journal of Applied Developmental Psychology:136–150,DOI 10.1016/j.appdev.2006.01.001。
  31. Mikael Persson、Anders Sundell,2025,《Ideological bias in policy implementation: public opinion and policy outcomes in 43 democracies》,West European Politics:1–15,DOI 10.1080/01402382.2025.2548607。
  32. Vuyani Goodman Langa、Sanjay Balkaran,2026,《From Policy Design to Implementation: Institutionalising Coordination and State Capacity in South Africa’s Developmental Trajectory》,African Journal of Development Studies (formerly AFFRIKA Journal of Politics Economics and Society) 16(1):341–360,DOI 10.31920/2634-3649/2026/v16n1a15。
  33. Tracey Barnett McElwee、Laura Danforth、Christine Bailey、Myton El 等,2025,《Filtering Evidence: Politics, Communication, and Resource Pressures in Policy Contexts》,Journal of Social Work and Social Welfare Policy,DOI 10.33790/jswwp1100163。
  34. Jill Nicholson-Crotty、Susan M. Miller、Lael R. Keiser,2021,《Administrative burden, social construction, and public support for government programs》,Journal of Behavioral Public Administration 4(1),DOI 10.30636/jbpa.41.193。
  35. Patrick Bayer、Aykut Öztürk、Sergi Pardos-Prado,2026,《Climate migration or climate immobility? Evidence from micro-level causal analysis of migration intentions in Nigeria》,Journal of Ethnic and Migration Studies:1–22,DOI 10.1080/1369183x.2026.2707755。
  36. M.A. Shulha,2021,《PUBLIC POLICY LIMITATIONS: AN ATTEMPTED GENERALIZATION》,Scientific Journal "Regional Studies":88–94,DOI 10.32782/2663-6170/2021.26.14。
  37. Дмитро Іванович Ткач、Дмитро Костянтинович Ткач,2026,《GOVERNMENT ECONOMIC POLICY OF ORBÁN: FROM REFORMIST PLANS TO CRISIS CONSEQUENCES》,"Scientific notes of the University"KROK":28–43,DOI 10.31732/2663-2209-2026-82-28-43。
  38. Karem Sayed Aboelazm,2026,《Beyond watchdogs: the role of NGOs in enhancing transparency and accountability in public sector procurement》,International Journal of Public Sector Performance Management 1(1),DOI 10.1504/ijpspm.2026.10075519。
  39. Ling Zhang、Yuan Feng、Qichao Zhu、Yong Hou 等,2026,《Contradictory instruments undermine the implementation of agricultural nutrient management policy mixes》,Agronomy Journal 118(3),DOI 10.1002/agj2.70405。

核验说明:提出栏优先使用原始论文、专著或正式文集;流变栏只承担后续修订。2006 年后的材料不改变经典条的入选年份。

新思想前沿 · 第 85 号《公共政策》· 20 条现代思想 + 20 条 1950–2006 经典思想 · 双层资料核验 · 王德生 亲撰 · ← 回到 626 个领域总览