官僚制与国家能力
官僚制与国家能力在过去二十年里经历的不是一条单线进步,而是解释单位的连续搬移:从薪酬、监控和税收,转向行政负担、算法决策、组织配置与未被服务的人。第404号官僚制与国家能力面板选取20个能够追到作者、年份、资料与争议的转向,既追问理论怎样改写旧默认,也核对官僚制与国家能力的测量、比较与制度实践怎样回写研究对象。全块以“国家组织把法律、信息与资源转化为实际服务的能力”为中心量纲,特别保留零效应、反向效应、退出者和未被记录者,让不同学科的同题异名能够进入同一张账。
2006—2016年的共同动作,是把官僚制与国家能力从静态类型学推进到可比较的机制研究。研究者开始用跨国数据、自然实验、网络资料或历史边界检验旧命题,并发现“国家组织把法律、信息与资源转化为实际服务的能力”的方向取决于分母、时间与制度层级;官僚制与国家能力第一幕的八条由此奠定了后来转向所使用的证据语言。
甲、高薪可以扩大公共服务人才池Pay and Public-Sector Selection
官僚制与国家能力在这一题上的旧起点是“提高公务薪酬会吸引逐利者并挤出公共服务动机”。2013年的Dal Bó、Finan 与 Rossi将“因申请成本高而从未报名的潜在高能力者不进录用质量”带回资料表,说明遗漏会改变全部新录用者,并非扩大样本即可消除的随机误差。
命题的锋刃在于把岗位相对工资置于第一因,并断言“决定招募质量的只有岗位相对工资能否改变高能力者的申请门槛”。若“高薪吸引谁取决于地区私营工资和晋升预期,短期申请质量不等于长期绩效”被触发后仍观察不到高能力录用者与全部新录用者的相对变化,高薪可以扩大公共服务人才池必须让位于替代机制。
Dal Bó、Finan与Rossi(2013)在墨西哥公共部门招募中随机改变工资,发现更高工资不仅增加申请人数,也提高申请者认知能力与公共服务动机,且没有降低亲社会倾向。就决定招募质量的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定招募质量的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定招募质量的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
从决定招募质量的判据的材料看,反对材料来自Finan、Olken 与 Pande(2017)而非另一个领域的泛泛批评,其核心是“高薪吸引谁取决于地区私营工资和晋升预期,短期申请质量不等于长期绩效”。 资料核验还要求把Dal Bó、Finan 与 Rossi(2013)、Finan、Olken 与 Pande(2017)和McDonnell(2025)的证据角色分开:前者承担主证据,中者承担反例或边界,后者只更新证据状态;三者不再互相替代。
基层招聘、偏远岗位补贴与公务员工资改革最明显,财政部与税务机关采用该思路时,需要为因申请成本高而从未报名的潜在高能力者不进录用质量设置字段,否则所谓改进只发生在被看见的人身上。核查决定招募质量的判据时,在文官委员会、社会政策机构和政府数字化部门中,验收表不应只列平均结果,还要列“因申请成本高而从未报名的潜在高能力者不进录用质量”的数量、占比和去向;这一比率随后按地区、群体或机构分层复算。
在决定招募质量的判据这条证据链上,统一分母后仍相反,才需要另立解释。把决定招募质量的判据放到另见第 354 号第 6 条『缓解不等于根治:随机化只提高攻击成本』旁核验:先对齐对象、时间窗和责任人,再检查决定招募质量的判据的核心判断在另一套分母中是否仍同向。
乙、监控能降低缺勤但会重写工作内容Monitoring Public Workers
核查决定出勤的判据时,围绕监控能降低缺勤但会重写工作内容,旧研究常把“公共部门缺勤主要源于低道德或低工资”当作比较前提。在决定出勤的判据这条证据链上,Duflo、Hanna 与 Ryan(2012)追问“出勤却未提供有效服务的时间不在考勤率中”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。这一步先限定可比较对象,不把缺失值折成零效应。
本条拒绝“许多因素都重要”的安全结论,把解释权押在可验证出勤上。对决定出勤的判据做反向检验,它预言“决定出勤的只有绩效是否被低成本、可验证地记录”;在“当可记录指标过窄时,工作人员可能出勤但减少备课、照护或难量化任务”的案例中若读数保持同向,监控能降低缺勤但会重写工作内容的单因排序便失去依据。对决定出勤的判据而言,可被推翻的责任只落在决定出勤的只有绩效是否被低成本、可验证地记录;如果替代机制同样预测结果,这项解释就应撤回。
Duflo、Hanna与Ryan(2012)在印度120所非正规学校用相机记录考勤;教师缺勤从约42%降至约21%,学生测试成绩提高约0.17个标准差。就决定出勤的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定出勤的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。
把决定出勤的判据放回原窗口,截至2025年的更新并没有消除Moynihan、Herd 与 Harvey(2015)提出的“当可记录指标过窄时,工作人员可能出勤但减少备课、照护或难量化任务”。研究应建立双重抽样框,补访未进入名册者,并公开进入概率,同时保留“出勤却未提供有效服务的时间不在考勤率中”;否则实际在岗天数/计划工作天数只在被选择样本内成立。
让这一比率进入常规审计,并把出勤却未提供有效服务的时间不在考勤率中作为结果的一部分,而不是数据清洗后的残余。就决定出勤的判据的外推边界看,实施监控能降低缺勤但会重写工作内容时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“出勤却未提供有效服务的时间不在考勤率中”、分母变更和失败路径,避免只优化可见成功。
围绕决定出勤的判据,其一接口以“该复核口径”为共同刻度,并明确“出勤却未提供有效服务的时间不在考勤率中”是否进入分母。把决定出勤的判据放到另见第 269 号第 3 条『政治和解与国家能力:制度功能由权力安排支撑』旁核验:先对齐对象、时间窗和责任人,再检查决定出勤的判据的核心判断在另一套分母中是否仍同向。
丙、税收能力与法治能力共同投资Fiscal and Legal Capacity
在税收能力法治能力这条证据链上,围绕税收能力与法治能力共同投资,旧研究常把“国家只要提高税率就能获得更多财政资源”当作比较前提。对税收能力法治能力做反向检验,Besley 与 Persson(2009)追问“被非正规收费、地方摊派和拖欠占用的资源不进中央税收账”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
税收能力与法治能力共同投资的理论赌注不是相关性大小,而是因果次序:先有征税与法治的互补投资,才有本条所描述的结果。只要“高税收也可能来自掠夺和资源租金,收入水平不能单独代表能力”出现后非资源税收相对可征税经济总量不变,主张就不能外推。
Besley与Persson(2009)将税收能力和法治能力写成共同投资问题,并用跨国历史资料说明战争、共同利益和政治稳定会同时推高两类能力。就税收能力法治能力的材料边界而言,进入、退出与未登记对象必须分开留痕。税收能力法治能力的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。税收能力法治能力的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
把税收能力法治能力放回原窗口,本条的可证伪设计是:在“高税收也可能来自掠夺和资源租金,收入水平不能单独代表能力”条件内外分别报告非资源税收/可征税经济总量,采用建立双重抽样框,补访未进入名册者,并公开进入概率;若方向不变,反号假说失败。
实践上的后果首先落在税务现代化、产权登记与财政契约,当税收能力与法治能力共同投资进入地方政府服务中心的评估流程后,政策人员不能只报中心值,还要追踪这一比率及其分母变化。 实施该转向时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“被非正规收费、地方摊派和拖欠占用的资源不进中央税收账”、分母变更和失败路径,避免只优化可见成功。就税收能力法治能力的遗漏记录而言,复核表还要标明退出日期、原始责任人和未纳入理由。
若其对象中“被非正规收费、地方摊派和拖欠占用的资源不进中央税收账”进入分母后,该复核口径不再同向,本项证据的外推边界即可被实证划出。就税收能力法治能力的外推边界看,其一接口以“这一比率”为共同刻度,并明确“被非正规收费、地方摊派和拖欠占用的资源不进中央税收账”是否进入分母。
丁、国家可读性是能力的资讯基础State Legibility
2017年的争论暴露了国家可读性是能力的资讯基础未说出的前提——行政边界与人口登记只是能力的被动结果。Lee 与 Zhang用“游动人口、无固定地址和多重身份者在可读性系统中无位置”说明,研究对象在进入目标人口以前已经被资格、边界或记录规则塑形。
国家可读性是能力的资讯基础不是因素清单,而是一项可以失败的主张:决定政策穿透的只有国家能否稳定识别人口、土地与组织。判决标准是可识别行政对象的比例能否稳定改变具有可核验行政身份者/目标人口;“登记可能把复杂身份压成僵硬类别,未登记者承担更高排除风险”下没有差异,就足以否定其决定性。
就决定政策穿透的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定政策穿透的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定政策穿透的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
对决定政策穿透的判据做反向检验,国家可读性是能力的资讯基础的边界由Hanson 与 Sigman(2021)所揭示的“登记可能把复杂身份压成僵硬类别,未登记者承担更高排除风险”限定。当前争论缺的不是更多概念,而是随机改变测量时点、公开度或评定者身份,估计观测回写:把“登记可能把复杂身份压成僵硬类别,未登记者承担更高排除风险”变成事前分层,并公布该层样本量、区间和分母变化。
另一处常被忽略的是人口登记、地址体系与土地确权,对国家审计机构而言,真正要改的不是宣传语言,而是把游动人口、无固定地址和多重身份者在可读性系统中无位置从附注移入正式记录。 实施上述机制时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“游动人口、无固定地址和多重身份者在可读性系统中无位置”、分母变更和失败路径,避免只优化可见成功。
把决定政策穿透的判据放回原窗口,其一接口以“上述分子—分母”为共同刻度,并明确“游动人口、无固定地址和多重身份者在可读性系统中无位置”是否进入分母。把决定政策穿透的判据放到另见第 621 号第 4 条『不确定性改变的不是穷不穷,而是能否对未来作不可逆承诺』旁核验:先对齐对象、时间窗和责任人,再检查决定政策穿透的判据的核心判断在另一套分母中是否仍同向。
戊、前线裁量不是规则失败Street-Level Discretion
2015年的争论暴露了前线裁量不是规则失败未说出的前提——统一规章可以消除一线执行差异。Moynihan、Herd 与 Harvey用“未提出申请、被口头劝退和无书面决定者不进裁量审计”说明,研究对象在进入全部同类案件以前已经被资格、边界或记录规则塑形。
本条拒绝“许多因素都重要”的安全结论,把解释权押在一线分类权上。把决定政策机制放回原窗口,它预言“决定政策实际含义的只有前线人员如何在资源不足中分类个案”;在“裁量既可能实现个案正义,也可能复制偏见;观察到的执行差异难区分必要调整与任意歧视”的案例中若读数保持同向,前线裁量不是规则失败的单因排序便失去依据。
Moynihan、Herd与Harvey(2015)把行政负担拆成学习、合规和心理三类成本;这三个成本可分别观察,不能用“是否领到福利”一个结果倒推。就决定政策机制的材料边界而言,进入、退出与未登记对象必须分开留痕。决定政策机制的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定政策机制的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
本条的可证伪设计是:在“裁量既可能实现个案正义,也可能复制偏见;观察到的执行差异难区分必要调整与任意歧视”条件内外分别报告被裁量调整的案件/全部同类案件,采用随机改变测量时点、公开度或评定者身份,估计观测回写;若方向不变,反号假说失败。
前线裁量不是规则失败还改变了服务标准、案例复核与一线培训的操作顺序:先定义分母和失效条件,再决定是否扩大项目,财政部与税务机关若倒过来做,规模会放大原有偏差。 对文官委员会、社会政策机构和政府数字化部门最直接的制度后果,是禁止把“未提出申请、被口头劝退和无书面决定者不进裁量审计”当作清洗残余,并把被裁量调整的案件、全部同类案件与实施成本放在同一张表中。
就决定政策机制的外推边界看,统一分母后仍相反,才需要另立解释。围绕决定政策机制,其一接口以“上述分子—分母”为共同刻度,并明确“未提出申请、被口头劝退和无书面决定者不进裁量审计”是否进入分母。把决定政策机制放到另见第 180 号第 7 条『宗教福利供给:补位国家也可能制造资格边界』旁核验:先对齐对象、时间窗和责任人,再检查决定政策机制的核心判断在另一套分母中是否仍同向。
己、行政负担是政策设计的一部分Administrative Burden
2015年的争论暴露了行政负担是政策设计的一部分未说出的前提——符合资格者会自动领取应得公共服务。Moynihan、Herd 与 Harvey用“不知道资格、未开始申请和中途放弃者不在审批绩效中”说明,研究对象在进入法律上符合资格者以前已经被资格、边界或记录规则塑形。
行政负担是政策设计的一部分不是因素清单,而是一项可以失败的主张:决定实际覆盖的只有学习、合规和心理成本是否可承受。判决标准是公民完成程序的总成本能否稳定改变最终领取者/法律上符合资格者;“负担测量多依赖完成流程者,数字化也可能把线下成本转成设备和识字成本”下没有差异,就足以否定其决定性。
同一框架指出负担并非执行噪声,而是政治选择:表格长度、证明材料、等待时间和污名都可把有资格者挡在项目之外。就决定实际覆盖的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定实际覆盖的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定实际覆盖的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
截至2025年的更新并没有消除Eubanks(2018)提出的“负担测量多依赖完成流程者,数字化也可能把线下成本转成设备和识字成本”。研究应随机改变测量时点、公开度或评定者身份,估计观测回写,同时保留“不知道资格、未开始申请和中途放弃者不在审批绩效中”;否则该复核口径只在被选择样本内成立。
方法上的延伸直指社会救助、税收抵免与移民服务,在公共服务委员会的现实场景中,上述分子—分母应与成本、覆盖和退出人数并列,而不能被一个总体平均替代。 对文官委员会、社会政策机构和政府数字化部门最直接的制度后果,是禁止把“不知道资格、未开始申请和中途放弃者不在审批绩效中”当作清洗残余,并把最终领取者、法律上符合资格者与实施成本放在同一张表中。
就决定实际覆盖的判据的外推边界看,其一接口以“这一比率”为共同刻度,并明确“不知道资格、未开始申请和中途放弃者不在审批绩效中”是否进入分母。把决定实际覆盖的判据放到另见第 182 号第 18 条『贫困中的行政负担:福利权利会被学习、合规与心理成本削弱』旁核验:先对齐对象、时间窗和责任人,再检查决定实际覆盖的判据的核心判断在另一套分母中是否仍同向。
庚、电子政务只有伴随开放流程才减腐E-Government and Transparency
围绕决定透明效果的判据,此前关于电子政务只有伴随开放流程才减腐的模型依赖“把服务搬到网上即可自动减少腐败”这一简化。Bertot、Jaeger 与 Grimes(2010)证明“线下补件、后台改写和系统外协调不进电子流程数据”并非边缘案例;它进入分母后,该转向原有的分类、排名或平均关系都需重算。
电子政务只有伴随开放流程才减腐不是因素清单,而是一项可以失败的主张:决定透明效果的只有流程、日志和问责是否同时开放。判决标准是可审计流程覆盖率能否稳定改变留有完整审计日志的交易/全部数字交易;“数字鸿沟、供应商锁定和不可审计代码会制造新型不透明”下没有差异,就足以否定其决定性。
Bertot、Jaeger与Grimes(2010)综述电子政务与反腐案例,结论是网站数量本身不足,信息公开、可追踪流程和公民反馈必须同时存在。就决定透明效果的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定透明效果的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定透明效果的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
沿决定透明效果的判据的责任链,电子政务只有伴随开放流程才减腐的边界由Veale 与 Brass(2019)所揭示的“数字鸿沟、供应商锁定和不可审计代码会制造新型不透明”限定。复算决定透明效果的判据之前,当前争论缺的不是更多概念,而是为缺失、退出与拒答建立生成模型并做追访:把“数字鸿沟、供应商锁定和不可审计代码会制造新型不透明”变成事前分层,并公布该层样本量、区间和分母变化。
政务门户、在线许可与数据开放最明显,地方政府服务中心采用该思路时,需要为线下补件、后台改写和系统外协调不进电子流程数据设置字段,否则所谓改进只发生在被看见的人身上。 本轮把这一延伸落实到文官委员会、社会政策机构和政府数字化部门:新增“线下补件、后台改写和系统外协调不进电子流程数据”字段,并同时保存留有完整审计日志的交易与全部数字交易的原始口径。按决定透明效果的判据的对象表,其样才能区分真实改善、选择退出和统计边界收窄。
把决定透明效果的判据放到另见第 355 号第 16 条『数据进入安全论证:模型文件不是普通代码附件』旁核验:先对齐对象、时间窗和责任人,再检查决定透明效果的判据的核心判断在另一套分母中是否仍同向。
辛、历史基层国家留下合作遗产Historical Local State Capacity
“当代地方治理差异主要来自当前财政和干部”曾使历史基层国家留下合作遗产看起来可以直接比较。Dell、Lane 与 Querubin在2018年改变了观察顺序:先记录“被战争毁村、迁移重组和边界更名的社区不进连续样本”,再计算全部可比村庄,把进入数据之前的制度选择纳入解释。
历史基层国家留下合作遗产不是因素清单,而是一项可以失败的主张:决定集体行动能力的只有历史上基层行政是否与社区组织形成互补。判决标准是历史行政—社区互补能否稳定改变历史行政覆盖村庄/全部可比村庄;“历史国家也可能选择更易治理地区,战争、迁移和土地改革会重写遗产”下没有差异,就足以否定其决定性。
Dell、Lane与Querubin(2018)利用越南历史国家边界和村级资料,发现早期强国家地区在现代地方合作、公共品和经济发展上留下可辨认差异。就决定集体机制的材料边界而言,进入、退出与未登记对象必须分开留痕。决定集体机制的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定集体机制的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
反对材料来自Lee 与 Zhang(2017)而非另一个领域的泛泛批评,其核心是“历史国家也可能选择更易治理地区,战争、迁移和土地改革会重写遗产”。本条的可证伪设计是:在“历史国家也可能选择更易治理地区,战争、迁移和土地改革会重写遗产”条件内外分别报告该复核口径,采用为缺失、退出与拒答建立生成模型并做追访;若方向不变,反号假说失败。
让上述分子—分母进入常规审计,并把被战争毁村、迁移重组和边界更名的社区不进连续样本作为结果的一部分,而不是数据清洗后的残余。沿决定集体机制的责任链,实施历史基层国家留下合作遗产时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“被战争毁村、迁移重组和边界更名的社区不进连续样本”、分母变更和失败路径,避免只优化可见成功。
双方先统一历史行政覆盖村庄与全部可比村庄,再检验“历史国家也可能选择更易治理地区,战争、迁移和土地改革会重写遗产”是否造成符号分叉;分叉稳定才构成新问题。把决定集体机制放到另见第 165 号第 14 条『国家能力的历史形成』旁核验:先对齐对象、时间窗和责任人,再检查决定集体机制的核心判断在另一套分母中是否仍同向。
2016年之后,危机、平台化与开放数据把官僚制与国家能力推入更高频也更脆弱的测量环境。研究一面获得更大样本和更细行为轨迹,另一面不得不处理算法选择、民主回退、组织回写与外部有效性。官僚制与国家能力第二幕的十二条因此把反号条件、治理后果与可复现边界置于中心。
一、国家能力必须拆成多维潜变量Multidimensional State Capacity
复算决定比较机制之前,此前关于国家能力必须拆成多维潜变量的模型依赖“税收占GDP一项即可代表国家能力”这一简化。Hanson 与 Sigman(2021)证明“没有统计机构因而没有数据的能力缺口被误当成缺失而非结果”并非边缘案例;它进入分母后,该转向原有的分类、排名或平均关系都需重算。
国家能力必须拆成多维潜变量不是因素清单,而是一项可以失败的主张:决定比较有效性的只有强制、财政与行政能力是否被分开测量。判决标准是能力维度的可分辨性能否稳定改变有独立指标支持的能力维度/全部理论维度;“潜变量仍依赖可得指标,弱国的数据缺失本身与能力相关”下没有差异,就足以否定其决定性。
Hanson与Sigman(2021)把国家能力分成提取、协调与合规等潜在维度,并用多项跨国指标估计;一个GDP或税收比不能替代全部能力。就决定比较机制的材料边界而言,进入、退出与未登记对象必须分开留痕。决定比较机制的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定比较机制的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
按决定比较机制的对象表,国家能力必须拆成多维潜变量的边界由Besley 与 Persson(2009)所揭示的“潜变量仍依赖可得指标,弱国的数据缺失本身与能力相关”限定。对照决定比较机制的主源,当前争论缺的不是更多概念,而是为缺失、退出与拒答建立生成模型并做追访:把“潜变量仍依赖可得指标,弱国的数据缺失本身与能力相关”变成事前分层,并公布该层样本量、区间和分母变化。
实践上的后果首先落在发展诊断、援助排序与风险评级,当上述机制进入财政部与税务机关的评估流程后,政策人员不能只报中心值,还要追踪这一比率及其分母变化。 在文官委员会、社会政策机构和政府数字化部门中,验收表不应只列平均结果,还要列“没有统计机构因而没有数据的能力缺口被误当成缺失而非结果”的数量、占比和去向;上述分子—分母随后按地区、群体或机构分层复算。
双方先统一有独立指标支持的能力维度与全部理论维度,再检验“潜变量仍依赖可得指标,弱国的数据缺失本身与能力相关”是否造成符号分叉;分叉稳定才构成新问题。把决定比较机制放到另见第 161 号第 7 条『国家财政能力』旁核验:先对齐对象、时间窗和责任人,再检查决定比较机制的核心判断在另一套分母中是否仍同向。
二、数字福利把资格判断变成数据治理Automated Welfare Eligibility
按数字福利研究的对象表,围绕数字福利把资格判断变成数据治理,旧研究常把“自动化资格审查只是提高行政效率”当作比较前提。Eubanks(2018)追问“未申诉、无网络或通知寄失的被停保者不进错误率”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
数字福利把资格判断变成数据治理的理论赌注不是相关性大小,而是因果次序:先有错误剥夺的可逆性,才有本条所描述的结果。只要“个案记录揭示严重后果,但跨系统误判率常因商业保密和申诉缺失不可得”出现后人工纠正的停保决定相对全部算法停保决定不变,主张就不能外推。
Eubanks(2018)比较印第安纳福利自动化、洛杉矶无家可归者评分和匹兹堡儿童保护算法三个系统,显示数字化可同时扩大分类、拒绝与申诉负担。就数字福利研究的材料边界而言,进入、退出与未登记对象必须分开留痕。数字福利研究的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。数字福利研究的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
对照数字福利研究的主源,截至2025年的更新并没有消除Moynihan、Herd 与 Harvey(2015)提出的“个案记录揭示严重后果,但跨系统误判率常因商业保密和申诉缺失不可得”。研究应建立收益方—负担方成本流向账户,同时保留“未申诉、无网络或通知寄失的被停保者不进错误率”;否则人工纠正的停保决定/全部算法停保决定只在被选择样本内成立。
另一处常被忽略的是福利算法、停保通知与人工复核,对公共服务委员会而言,真正要改的不是宣传语言,而是把未申诉、无网络或通知寄失的被停保者不进错误率从附注移入正式记录。 对文官委员会、社会政策机构和政府数字化部门最直接的制度后果,是禁止把“未申诉、无网络或通知寄失的被停保者不进错误率”当作清洗残余,并把人工纠正的停保决定、全部算法停保决定与实施成本放在同一张表中。
在数字福利研究的实施账本里,其一接口以“上述分子—分母”为共同刻度,并明确“未申诉、无网络或通知寄失的被停保者不进错误率”是否进入分母。把数字福利研究放到另见第 626 号第 15 条『家事算法从效率工具变成正当程序问题:风险分数不能替代理由』旁核验:先对齐对象、时间窗和责任人,再检查数字福利研究的核心判断在另一套分母中是否仍同向。
三、算法行政从街头转向屏幕与系统Administration by Algorithm
2019年的争论暴露了算法行政从街头转向屏幕与系统未说出的前提——自动化会消除一线裁量并实现一致规则。Veale 与 Brass用“模型未覆盖、被系统拒绝录入和人工绕过的案件不进性能表”说明,研究对象在进入全部算法建议以前已经被资格、边界或记录规则塑形。
对算法行政从街头转向屏幕与系统而言,阈值设定权被指定为唯一决定项,其余变量只解释幅度。对照算法行政从系统的主源,其个排他性可由可解释并可人工推翻的算法决定/全部算法建议检验;“模型输出可能被一线人员机械遵从,也可能被绕过;责任链在供应商与机构之间分散”若不改变符号,就构成反证。
Veale与Brass(2019)基于公共部门机器学习案例,把算法行政分成预测、排序和自动决定;每一类都涉及不同的解释、申诉与责任链。就算法行政从系统的材料边界而言,进入、退出与未登记对象必须分开留痕。算法行政从系统的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。算法行政从系统的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
算法行政从街头转向屏幕与系统的边界由Eubanks(2018)所揭示的“模型输出可能被一线人员机械遵从,也可能被绕过;责任链在供应商与机构之间分散”限定。当前争论缺的不是更多概念,而是建立收益方—负担方成本流向账户:把“模型输出可能被一线人员机械遵从,也可能被绕过;责任链在供应商与机构之间分散”变成事前分层,并公布该层样本量、区间和分母变化。
上述机制还改变了算法影响评估、采购合同与申诉界面的操作顺序:先定义分母和失效条件,再决定是否扩大项目,地方政府服务中心若倒过来做,规模会放大原有偏差。 本轮把这一延伸落实到文官委员会、社会政策机构和政府数字化部门:新增“模型未覆盖、被系统拒绝录入和人工绕过的案件不进性能表”字段,并同时保存可解释并可人工推翻的算法决定与全部算法建议的原始口径。在算法行政从系统的实施账本里,其样才能区分真实改善、选择退出和统计边界收窄。
若其对象中“模型未覆盖、被系统拒绝录入和人工绕过的案件不进性能表”进入分母后,上述分子—分母不再同向,这一制度安排的外推边界即可被实证划出。把算法行政从系统放到另见第 180 号第 7 条『宗教福利供给:补位国家也可能制造资格边界』旁核验:先对齐对象、时间窗和责任人,再检查算法行政从系统的核心判断在另一套分母中是否仍同向。
四、公开采购要比较法律与实践的距离Public Procurement in Law and Practice
2022年的争论暴露了公开采购要比较法律与实践的距离未说出的前提——采购法条越严格,腐败和成本越低。Bosio、Djankov、Glaeser 与 Shleifer用“流标、拆分合同和通过关联公司投标的交易不进表面竞争率”说明,研究对象在进入全部可竞争合同以前已经被资格、边界或记录规则塑形。
公开采购要比较法律与实践的距离采用明确的单因立场:决定采购绩效的只有实际流程是否形成竞争和可验证交付。决定方向的被限定为法定规则的实际执行率;若“严格程序也可能拖延紧急采购并提高小企业进入成本,低价不等于全生命周期价值”出现,而竞争性招标合同/全部可竞争合同仍不发生预期变化,这项命题就应撤回。
Bosio等(2022)结合187个经济体的采购法律资料与多国合同实践,显示纸面规则与实际采购时间、竞争和价格之间存在系统差距。就公开采购要实践的距的材料边界而言,进入、退出与未登记对象必须分开留痕。公开采购要实践的距的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。
Fernández-i-Marín、Knill、Steinbacher 与 Steinebach(2024)把争议落在“严格程序也可能拖延紧急采购并提高小企业进入成本,低价不等于全生命周期价值”。这不是一句例行局限:当“严格程序也可能拖延紧急采购并提高小企业进入成本,低价不等于全生命周期价值”出现时,法定规则的实际执行率可能从原因变成被选择结果。要使争论收敛,应建立收益方—负担方成本流向账户,并预先规定竞争性招标合同相对全部可竞争合同何种变化算支持、收缩或反号。
方法上的延伸直指电子采购、开放合同与供应商竞争,在国家审计机构的现实场景中,这一比率应与成本、覆盖和退出人数并列,而不能被一个总体平均替代。在公开采购要实践的距的实施账本里,实施公开采购要比较法律与实践的距离时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“流标、拆分合同和通过关联公司投标的交易不进表面竞争率”、分母变更和失败路径,避免只优化可见成功。
双方先统一竞争性招标合同与全部可竞争合同,再检验“严格程序也可能拖延紧急采购并提高小企业进入成本,低价不等于全生命周期价值”是否造成符号分叉;分叉稳定才构成新问题。把公开采购要实践的距放到另见第 180 号第 7 条『宗教福利供给:补位国家也可能制造资格边界』旁核验:先对齐对象、时间窗和责任人,再检查公开采购要实践的距的核心判断在另一套分母中是否仍同向。
五、危机能力取决于协调而非中央集权程度Crisis Capacity and Coordination
从决定危机绩效的判据的材料看,2020年前后,官僚制与国家能力仍普遍接受“危机时权力越集中,响应越有效”这一默认。Greer、King、Fonseca 与 Peralta-Santos把“未检测感染、院外死亡和被排除机构不进响应绩效”从清洗后的余数提升为解释对象;在危机能力取决于协调而非中央集权程度中,这一缺项决定了谁能进入危机严重度。
本条拒绝“许多因素都重要”的安全结论,把解释权押在跨层级协调速度上。核查决定危机绩效的判据时,它预言“决定危机绩效的只有跨层级信息、物资和责任能否快速协调”;在“死亡登记、检测政策和人口年龄结构使简单排名失真,早期成功也可能在后期逆转”的案例中若读数保持同向,危机能力取决于协调而非中央集权程度的单因排序便失去依据。
Greer等(2020)比较19个国家和地区的COVID-19治理,发现联邦与单一制、集中与分散均有成功和失败,既有卫生能力、协调与信任更接近结果。就决定危机绩效的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定危机绩效的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。
在决定危机绩效的判据这条证据链上,Hanson 与 Sigman(2021)把争议落在“死亡登记、检测政策和人口年龄结构使简单排名失真,早期成功也可能在后期逆转”。这不是一句例行局限:当“死亡登记、检测政策和人口年龄结构使简单排名失真,早期成功也可能在后期逆转”出现时,跨层级协调速度可能从原因变成被选择结果。要使争论收敛,应同时测量局部收益与系统外部性,并预先规定从预警到资源到位的时间相对危机严重度何种变化算支持、收缩或反号。
应急指挥、数据共享与物资储备最明显,财政部与税务机关采用该思路时,需要为未检测感染、院外死亡和被排除机构不进响应绩效设置字段,否则所谓改进只发生在被看见的人身上。 对文官委员会、社会政策机构和政府数字化部门最直接的制度后果,是禁止把“未检测感染、院外死亡和被排除机构不进响应绩效”当作清洗残余,并把从预警到资源到位的时间、危机严重度与实施成本放在同一张表中。
若其对象中“未检测感染、院外死亡和被排除机构不进响应绩效”进入分母后,从预警到资源到位的时间/危机严重度不再同向,危机能力取决于协调而非中央集权程度的外推边界即可被实证划出。对决定危机绩效的判据做反向检验,其一接口以“这一比率”为共同刻度,并明确“未检测感染、院外死亡和被排除机构不进响应绩效”是否进入分母。
六、灾害政治奖励救济而非预防Myopic Disaster Policy
核查决定政府机制时,2009年前后,官僚制与国家能力仍普遍接受“选民会奖励长期减灾投资与短期救济同样程度”这一默认。Healy 与 Malhotra把“未发生的灾害损失没有事件记录,预防成功因而没有可见案例”从清洗后的余数提升为解释对象;在灾害政治奖励救济而非预防中,这一缺项决定了谁能进入救济支出的选票回报。
灾害政治奖励救济而非预防不是因素清单,而是一项可以失败的主张:决定政府投入结构的只有选民能否看见并归因预防收益。判决标准是预防收益的可见性能否稳定改变预防投资获得的选票回报/救济支出的选票回报;“重大灾害会改变注意力,保险制度和媒体覆盖也影响归因”下没有差异,就足以否定其决定性。
Healy与Malhotra(2009)使用1988—2004年美国县级灾害和选举资料,发现选民奖励灾后救济,却很少奖励事前减灾支出。就决定政府机制的材料边界而言,进入、退出与未登记对象必须分开留痕。决定政府机制的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定政府机制的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
反对材料来自Greer、King、Fonseca 与 Peralta-Santos(2020)而非另一个领域的泛泛批评,其核心是“重大灾害会改变注意力,保险制度和媒体覆盖也影响归因”。本条的可证伪设计是:在“重大灾害会改变注意力,保险制度和媒体覆盖也影响归因”条件内外分别报告该复核口径,采用同时测量局部收益与系统外部性;若方向不变,反号假说失败。
让上述分子—分母进入常规审计,并把未发生的灾害损失没有事件记录,预防成功因而没有可见案例作为结果的一部分,而不是数据清洗后的残余。在决定政府机制这条证据链上,实施灾害政治奖励救济而非预防时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“未发生的灾害损失没有事件记录,预防成功因而没有可见案例”、分母变更和失败路径,避免只优化可见成功。
双方先统一预防投资获得的选票回报与救济支出的选票回报,再检验“重大灾害会改变注意力,保险制度和媒体覆盖也影响归因”是否造成符号分叉;分叉稳定才构成新问题。对决定政府机制做反向检验,其一接口以“这一比率”为共同刻度,并明确“未发生的灾害损失没有事件记录,预防成功因而没有可见案例”是否进入分母。
七、代表性官僚制需要从人口比例走向裁量结果Representative Bureaucracy
在决定代表效果的判据这条证据链上,围绕代表性官僚制需要从人口比例走向裁量结果,旧研究常把“公务员人口构成接近社会即可产生公平服务”当作比较前提。对决定代表效果的判据做反向检验,Finan、Olken 与 Pande(2017)追问“临时工、外包人员和无晋升通道岗位不进代表性高层统计”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
命题的锋刃在于把代表性进入实权岗位的程度置于第一因,并断言“决定代表效果的只有代表群体的官员是否处在有裁量和资源的位置”。若“同群身份不保证共同偏好,过度期待也可能给少数官员增加额外负担”被触发后仍观察不到拥有实质裁量的少数群体官员与全部少数群体官员的相对变化,代表性官僚制需要从人口比例走向裁量结果必须让位于替代机制。
Finan、Olken与Pande(2017)综述发展中国家公共人员研究,区分代表性、能力、工资、监督和裁量;人员构成与实际决策结果必须分别测量。就决定代表效果的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定代表效果的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定代表效果的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
本条的可证伪设计是:在“同群身份不保证共同偏好,过度期待也可能给少数官员增加额外负担”条件内外分别报告拥有实质裁量的少数群体官员/全部少数群体官员,采用同时测量局部收益与系统外部性;若方向不变,反号假说失败。
实践上的后果首先落在公务员多样性、晋升与服务公平审计,当代表性官僚制需要从人口比例走向裁量结果进入地方政府服务中心的评估流程后,政策人员不能只报中心值,还要追踪这一比率及其分母变化。把决定代表效果的判据放回原窗口,其样才能区分真实改善、选择退出和统计边界收窄。
双方先统一拥有实质裁量的少数群体官员与全部少数群体官员,再检验“同群身份不保证共同偏好,过度期待也可能给少数官员增加额外负担”是否造成符号分叉;分叉稳定才构成新问题。把决定代表效果的判据放到另见第 269 号第 3 条『政治和解与国家能力:制度功能由权力安排支撑』旁核验:先对齐对象、时间窗和责任人,再检查决定代表效果的判据的核心判断在另一套分母中是否仍同向。
八、社区警务的平均承诺遭遇多国零结果Community Policing at Scale
对决定社区机制做反向检验,围绕社区警务的平均承诺遭遇多国零结果,旧研究常把“增加警民接触即可普遍提高信任并减少犯罪”当作比较前提。Blair 等(2021)追问“害怕报案、转向私人安全和未参加会议者不进项目满意度”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
社区警务的平均承诺遭遇多国零结果不是因素清单,而是一项可以失败的主张:决定社区警务成败的只有接触是否伴随可回应的组织权限。判决标准是接触后的可回应能力能否稳定改变得到实质处理的社区问题/全部警民接触提出的问题;“短期项目、低剂量实施和既有暴力环境可能压低效果,不能推断所有地方实践无效”下没有差异,就足以否定其决定性。
Blair等(2021)在巴西、哥伦比亚、利比里亚、巴基斯坦、菲律宾和乌干达六国开展协调随机试验;社区警务平均未提高信任,也未稳定降低犯罪。就决定社区机制的材料边界而言,进入、退出与未登记对象必须分开留痕。决定社区机制的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定社区机制的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
社区警务的平均承诺遭遇多国零结果的边界由Finan、Olken 与 Pande(2017)所揭示的“短期项目、低剂量实施和既有暴力环境可能压低效果,不能推断所有地方实践无效”限定。当前争论缺的不是更多概念,而是把形式通过率与现场执行率并列审计:把“短期项目、低剂量实施和既有暴力环境可能压低效果,不能推断所有地方实践无效”变成事前分层,并公布该层样本量、区间和分母变化。
另一处常被忽略的是警务改革、社区会议与投诉处理,对国家审计机构而言,真正要改的不是宣传语言,而是把害怕报案、转向私人安全和未参加会议者不进项目满意度从附注移入正式记录。把决定社区机制放回原窗口,其样才能区分真实改善、选择退出和统计边界收窄。
若其对象中“害怕报案、转向私人安全和未参加会议者不进项目满意度”进入分母后,上述分子—分母不再同向,本项证据的外推边界即可被实证划出。把决定社区机制放到另见第 269 号第 3 条『政治和解与国家能力:制度功能由权力安排支撑』旁核验:先对齐对象、时间窗和责任人,再检查决定社区机制的核心判断在另一套分母中是否仍同向。
九、卫星与数字痕迹扩展脆弱国家测量Remote Measurement of State Reach
把卫星数字痕迹放回原窗口,围绕卫星与数字痕迹扩展脆弱国家测量,旧研究常把“没有可靠行政数据就无法比较国家能力”当作比较前提。就卫星数字痕迹的外推边界看,Hanson 与 Sigman(2021)追问“无信号、被云覆盖和因安全无法核验地区不进准确率”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
本条拒绝“许多因素都重要”的安全结论,把解释权押在远程代理的地面校准率上。围绕卫星数字痕迹,它预言“决定远程测量价值的只有卫星、手机和地理数据能否与地面事实校准”;在“代理会把无电但治理有效地区判弱,也可能把矿区或军事设施判强”的案例中若读数保持同向,卫星与数字痕迹扩展脆弱国家测量的单因排序便失去依据。
脆弱国家的遥感与数字痕迹研究将夜间灯光、道路、建筑和通信覆盖与传统行政指标交叉验证;未联网和低亮度地区仍可能系统缺失。就卫星数字痕迹的材料边界而言,进入、退出与未登记对象必须分开留痕。卫星数字痕迹的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。卫星数字痕迹的结构读数拆成3项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
截至2025年的更新并没有消除Lee 与 Zhang(2017)提出的“代理会把无电但治理有效地区判弱,也可能把矿区或军事设施判强”。研究应把形式通过率与现场执行率并列审计,同时保留“无信号、被云覆盖和因安全无法核验地区不进准确率”;否则通过地面核验的遥感判断/全部遥感判断只在被选择样本内成立。
卫星与数字痕迹扩展脆弱国家测量还改变了脆弱国家监测、灾害评估与援助定位的操作顺序:先定义分母和失效条件,再决定是否扩大项目,财政部与税务机关若倒过来做,规模会放大原有偏差。沿卫星数字痕迹的责任链,在文官委员会、社会政策机构和政府数字化部门中,验收表不应只列平均结果,还要列“无信号、被云覆盖和因安全无法核验地区不进准确率”的数量、占比和去向;这一比率随后按地区、群体或机构分层复算。卫星数字痕迹的复核表还保留退出日期、原记录者和未纳入理由,不用零值代替缺失。
把卫星数字痕迹放到另见第 269 号第 3 条『政治和解与国家能力:制度功能由权力安排支撑』旁核验:先对齐对象、时间窗和责任人,再检查卫星数字痕迹的核心判断在另一套分母中是否仍同向。
十、文官制度改革具有长期组织效应Civil Service Reform and Performance
就决定长期绩效的判据的外推边界看,2024年前后,官僚制与国家能力仍普遍接受“考试制改革只改变招募公平,不改变政府绩效”这一默认。Aneja 与 Xu把“外包、临时合同和影子顾问不进文官保护分母”从清洗后的余数提升为解释对象;在文官制度改革具有长期组织效应中,这一缺项决定了谁能进入全部常设公共岗位。
文官制度改革具有长期组织效应的理论赌注不是相关性大小,而是因果次序:先有职业化覆盖率,才有本条所描述的结果。只要“改革覆盖常先进入能力较强部门,考试也可能固化特定教育优势”出现后受功绩制保护岗位相对全部常设公共岗位不变,主张就不能外推。
Aneja与Xu(2024)利用美国邮政系统1875—1901年功绩制分期实施,发现改革减少邮政差错并提高生产率,长期效果来自组织而非一次考试。就决定长期绩效的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定长期绩效的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定长期绩效的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
反对材料来自Dal Bó、Finan 与 Rossi(2013)而非另一个领域的泛泛批评,其核心是“改革覆盖常先进入能力较强部门,考试也可能固化特定教育优势”。本条的可证伪设计是:在“改革覆盖常先进入能力较强部门,考试也可能固化特定教育优势”条件内外分别报告受功绩制保护岗位/全部常设公共岗位,采用把形式通过率与现场执行率并列审计;若方向不变,反号假说失败。
方法上的延伸直指文官考试、政治任命边界与职业发展,在公共服务委员会的现实场景中,这一比率应与成本、覆盖和退出人数并列,而不能被一个总体平均替代。 本轮把这一延伸落实到文官委员会、社会政策机构和政府数字化部门:新增“外包、临时合同和影子顾问不进文官保护分母”字段,并同时保存受功绩制保护岗位与全部常设公共岗位的原始口径。围绕决定长期绩效的判据,其样才能区分真实改善、选择退出和统计边界收窄。
双方先统一受功绩制保护岗位与全部常设公共岗位,再检验“改革覆盖常先进入能力较强部门,考试也可能固化特定教育优势”是否造成符号分叉;分叉稳定才构成新问题。沿决定长期绩效的判据的责任链,其一接口以“该复核口径”为共同刻度,并明确“外包、临时合同和影子顾问不进文官保护分母”是否进入分母。
十一、实施负担必须与行政能力共同测量Implementation Burden-Capacity Gap
围绕实施负担必行政能力,2024年前后,官僚制与国家能力仍普遍接受“政策任务越多只需增加法律授权即可完成”这一默认。Fernández-i-Marín、Knill、Steinbacher 与 Steinebach把“地方配套、非正式执行和被延期任务不进中央法规数量”从清洗后的余数提升为解释对象;在实施负担必须与行政能力共同测量中,这一缺项决定了谁能进入同时生效的实施任务。
命题的锋刃在于把实施负担—能力比置于第一因,并断言“决定执行差距的只有任务复杂度与组织能力之间的缺口”。若“官僚质量指标多为专家评价,任务数量也不等于技术难度”被触发后仍观察不到可用行政人员与预算与同时生效的实施任务的相对变化,实施负担必须与行政能力共同测量必须让位于替代机制。
Fernández-i-Marín等(2024)在跨国资料中同时测量实施任务和官僚质量,显示政策负担相近时,行政能力差异会系统扩大落实缺口。就实施负担必行政能力的材料边界而言,进入、退出与未登记对象必须分开留痕。实施负担必行政能力的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。实施负担必行政能力的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
沿实施负担必行政能力的责任链,Hanson 与 Sigman(2021)把争议落在“官僚质量指标多为专家评价,任务数量也不等于技术难度”。这不是一句例行局限:当“官僚质量指标多为专家评价,任务数量也不等于技术难度”出现时,实施负担—能力比可能从原因变成被选择结果。要使争论收敛,应同时扩大样本与抽样框,区分精度增加和偏差下降,并预先规定可用行政人员与预算相对同时生效的实施任务何种变化算支持、收缩或反号。
复算实施负担必行政能力之前,实施实施负担必须与行政能力共同测量时,应在文官委员会、社会政策机构和政府数字化部门建立版本化证据账本:记录“地方配套、非正式执行和被延期任务不进中央法规数量”、分母变更和失败路径,避免只优化可见成功。
若其对象中“地方配套、非正式执行和被延期任务不进中央法规数量”进入分母后,可用行政人员与预算/同时生效的实施任务不再同向,本项证据的外推边界即可被实证划出。按实施负担必行政能力的对象表,其一接口以“这一比率”为共同刻度,并明确“地方配套、非正式执行和被延期任务不进中央法规数量”是否进入分母。
十二、国家能力是组织配置问题State Capacity as an Organizational Problem
沿决定能力产出的判据的责任链,围绕国家能力是组织配置问题,旧研究常把“增加预算和人员就会线性提高国家能力”当作比较前提。Fernández-i-Marín、Knill、Steinbacher 与 Steinebach(2024)追问“跨部门协作、无正式归属任务和重复劳动不进单部门绩效”为何持续消失;若这种消失具有制度性,该转向的均值只是筛选后人群的均值。
对国家能力是组织配置问题而言,组织匹配度被指定为唯一决定项,其余变量只解释幅度。复算决定能力产出的判据之前,其个排他性可由完成核心任务的组织单元/承担该任务的全部单元检验;“组织结构常与任务难度共同决定,改革前后可比性和内部数据开放仍有限”若不改变符号,就构成反证。
Mastrorocco与Teso(2026)把国家能力建模为任务、人员、层级和信息配置问题;证据性质包括组织模型与行政微观资料,而不是一个跨国平均系数。就决定能力产出的判据的材料边界而言,进入、退出与未登记对象必须分开留痕。决定能力产出的判据的支持材料与边界材料分别编号,不让同一来源同时提出命题又替命题免责。决定能力产出的判据的结构读数拆成2项:主命题、替代机制、缺失对象与时间窗分别核对,任一项都不由总均值代填。
按决定能力产出的判据的对象表,反对材料来自McDonnell(2025)而非另一个领域的泛泛批评,其核心是“组织结构常与任务难度共同决定,改革前后可比性和内部数据开放仍有限”。本条的可证伪设计是:在“组织结构常与任务难度共同决定,改革前后可比性和内部数据开放仍有限”条件内外分别报告该复核口径,采用追踪人员流动后能力是否随记录迁移;若方向不变,反号假说失败。
让上述分子—分母进入常规审计,并把跨部门协作、无正式归属任务和重复劳动不进单部门绩效作为结果的一部分,而不是数据清洗后的残余。 本轮把这一延伸落实到文官委员会、社会政策机构和政府数字化部门:新增“跨部门协作、无正式归属任务和重复劳动不进单部门绩效”字段,并同时保存完成核心任务的组织单元与承担该任务的全部单元的原始口径。对照决定能力产出的判据的主源,其样才能区分真实改善、选择退出和统计边界收窄。
在决定能力产出的判据的实施账本里,统一分母后仍相反,才需要另立解释。把决定能力产出的判据放到另见第 267 号第 2 条『协作治理:公共问题由跨部门共同决定』旁核验:先对齐对象、时间窗和责任人,再检查决定能力产出的判据的核心判断在另一套分母中是否仍同向。
◎ 二十年连起来看
第一幕从“高薪可以扩大公共服务人才池”推进到“历史基层国家留下合作遗产”,第二幕又由“国家能力必须拆成多维潜变量”走向“国家能力是组织配置问题”。官僚制与国家能力二十年的核心变化,是解释单位从静态类别转向可观察的机制、条件与回写过程;Dal Bó、Finan 与 Rossi(2013)和Fernández-i-Marín、Knill、Steinbacher 与 Steinebach(2024)标出这一首尾迁移。
官僚制与国家能力的量纲也发生实质变化:第3条以“非资源税收/可征税经济总量”记录条件,第12条以“竞争性招标合同/全部可竞争合同”记录过程,第18条再以“受功绩制保护岗位/全部常设公共岗位”检验结果。官僚制与国家能力的问题由“有没有影响”转成“分子相对于哪个分母”。
另一条贯穿线索是官僚制与国家能力开始保存被排除者。第5条的“未提出申请、被口头劝退和无书面决定者不进裁量审计”与第14条的“未发生的灾害损失没有事件记录,预防成功因而没有可见案例”不再只是注脚,而是决定证据能否降级的对象。
◎ 三个常见误解
误解一是把“高薪可以扩大公共服务人才池”读成新的万能尺度。它之所以诱人,是“高能力录用者/全部新录用者”便于排序;正确表述却是:当“高薪吸引谁取决于地区私营工资和晋升预期,短期申请质量不等于长期绩效”出现时,官僚制与国家能力的方向可能改变,增加维度不能替代边界检验。
误解二是认为数据越多,官僚制与国家能力的偏倚就越小。第19条的“可用行政人员与预算/同时生效的实施任务”表明,更多文本、轨迹或样本若来自同一选择过程,只会更精确地描画已有覆盖,无法自动补回“地方配套、非正式执行和被延期任务不进中央法规数量”。
官僚制与国家能力的第三个误解,是把制度采纳等同于实质实施。第12条“公开采购要比较法律与实践的距离”与第20条“国家能力是组织配置问题”都显示,规则、平台或组织会围绕考核指标重新行动;官僚制与国家能力因此必须同时报告形式通过率、现场执行率和“完成核心任务的组织单元/承担该任务的全部单元”。
◎ 与相邻领域的接口
与第272号第1条的分工可由“高能力录用者/全部新录用者”判定:官僚制与国家能力第1条“高薪可以扩大公共服务人才池”解释岗位相对工资如何改变方向,邻块负责另一层级的结果。两边只有共享分母时才构成官僚制与国家能力的真实接口,单纯共享术语并不足够。
与第413号第6条的分工可由“最终领取者/法律上符合资格者”判定:官僚制与国家能力第6条“行政负担是政策设计的一部分”解释公民完成程序的总成本如何改变方向,邻块负责另一层级的结果。两边只有共享分母时才构成官僚制与国家能力的真实接口,单纯共享术语并不足够。
与第267号第11条的分工可由“可解释并可人工推翻的算法决定/全部算法建议”判定:官僚制与国家能力第11条“算法行政从街头转向屏幕与系统”解释阈值设定权如何改变方向,邻块负责另一层级的结果。两边只有共享分母时才构成官僚制与国家能力的真实接口,单纯共享术语并不足够。
与第85号第16条的分工可由“得到实质处理的社区问题/全部警民接触提出的问题”判定:官僚制与国家能力第16条“社区警务的平均承诺遭遇多国零结果”解释接触后的可回应能力如何改变方向,邻块负责另一层级的结果。接口是否成立,最终由“得到实质处理的社区问题/全部警民接触提出的问题”能否在两块中复算决定。
◎ 争议现场
围绕“税收能力与法治能力共同投资”的争论尚未收敛。Fernández-i-Marín、Knill、Steinbacher 与 Steinebach提出,“高税收也可能来自掠夺和资源租金,收入水平不能单独代表能力”会改变解释方向;要收敛,官僚制与国家能力需采用“建立双重抽样框并追踪未进入分母者”,并预先规定“非资源税收/可征税经济总量”何种变化算支持、收缩或反号。
围绕“数字福利把资格判断变成数据治理”的争论尚未收敛。Moynihan、Herd 与 Harvey提出,“个案记录揭示严重后果,但跨系统误判率常因商业保密和申诉缺失不可得”会改变解释方向;要收敛,官僚制与国家能力需采用“建立收益方—负担方的成本流向账户”,并预先规定“人工纠正的停保决定/全部算法停保决定”何种变化算支持、收缩或反号。
围绕“卫星与数字痕迹扩展脆弱国家测量”的争论尚未收敛。Lee 与 Zhang提出,“代理会把无电但治理有效地区判弱,也可能把矿区或军事设施判强”会改变解释方向;要收敛,官僚制与国家能力需采用“把形式通过率与现场执行率并列审计”,并预先规定“通过地面核验的遥感判断/全部遥感判断”何种变化算支持、收缩或反号。
◎ 往下五年看什么
未来五年,第9条“国家能力必须拆成多维潜变量”应连续发布“有独立指标支持的能力维度/全部理论维度”,并把“没有统计机构因而没有数据的能力缺口被误当成缺失而非结果”纳入分母。只有跨制度复制后符号稳定,“国家能力必须拆成多维潜变量”才可进入常规决策。
未来五年,第13条“危机能力取决于协调而非中央集权程度”应连续发布“从预警到资源到位的时间/危机严重度”,并把“未检测感染、院外死亡和被排除机构不进响应绩效”纳入分母。若到2031年区间仍覆盖正负两侧,“危机能力取决于协调而非中央集权程度”就仍是未决前沿。
未来五年,第17条“卫星与数字痕迹扩展脆弱国家测量”应连续发布“通过地面核验的遥感判断/全部遥感判断”,并把“无信号、被云覆盖和因安全无法核验地区不进准确率”纳入分母。若到2031年区间仍覆盖正负两侧,“卫星与数字痕迹扩展脆弱国家测量”就仍是未决前沿。
未来五年,第20条“国家能力是组织配置问题”应连续发布“完成核心任务的组织单元/承担该任务的全部单元”,并把“跨部门协作、无正式归属任务和重复劳动不进单部门绩效”纳入分母。若到2031年区间仍覆盖正负两侧,“国家能力是组织配置问题”就仍是未决前沿。
◎ 可与哪些领域对撞
本块第1条“高薪可以扩大公共服务人才池”可与第272号第1条对撞。双方共享“提高公务薪酬会吸引逐利者并挤出公共服务动机”,本条把岗位相对工资置于因果链首位,邻块则可能把同一要素视为结果;若用“高能力录用者/全部新录用者”复算后两边都成立,官僚制与国家能力就必须测量进入分母的选择机制。
本块第2条“监控能降低缺勤但会重写工作内容”可与第413号第6条对撞。双方共享“公共部门缺勤主要源于低道德或低工资”,本条把可验证出勤置于因果链首位,邻块则可能把同一要素视为结果;若用“实际在岗天数/计划工作天数”复算后两边都成立,官僚制与国家能力就必须测量进入分母的选择机制。
本块第3条“税收能力与法治能力共同投资”可与第267号第11条对撞。双方共享“国家只要提高税率就能获得更多财政资源”,本条把征税与法治的互补投资置于因果链首位,邻块则可能把同一要素视为结果;若用“非资源税收/可征税经济总量”复算后两边都成立,官僚制与国家能力就必须测量进入分母的选择机制。
本块第18条“文官制度改革具有长期组织效应”可与第413号第6条对撞。双方共享“考试制改革只改变招募公平,不改变政府绩效”,本条把职业化覆盖率置于因果链首位,邻块则可能把同一要素视为结果;若用“受功绩制保护岗位/全部常设公共岗位”复算后两边都成立,官僚制与国家能力就必须测量执行能力。
◎ 十条可做的研究命题
1. 命题:第1条“高薪可以扩大公共服务人才池”只在“高薪吸引谁取决于地区私营工资和晋升预期,短期申请质量不等于长期绩效”未出现时保持原方向。做法:建立双重抽样框并追踪未进入分母者,以“高能力录用者/全部新录用者”为主读数,并追踪“因申请成本高而从未报名的潜在高能力者不进录用质量”。若采用统一分母后不同制度中的符号完全一致,官僚制与国家能力无需引入该边界条件。
2. 命题:第3条“税收能力与法治能力共同投资”只在“高税收也可能来自掠夺和资源租金,收入水平不能单独代表能力”未出现时保持原方向。做法:建立双重抽样框并追踪未进入分母者,以“非资源税收/可征税经济总量”为主读数,并追踪“被非正规收费、地方摊派和拖欠占用的资源不进中央税收账”。若跨越“高税收也可能来自掠夺和资源租金,收入水平不能单独代表能力”后“非资源税收/可征税经济总量”没有结构变化,第3条的反号命题即被否定。
3. 命题:第5条“前线裁量不是规则失败”只在“裁量既可能实现个案正义,也可能复制偏见;观察到的执行差异难区分必要调整与任意歧视”未出现时保持原方向。做法:随机改变测量时点、公开程度或评定者身份,以“被裁量调整的案件/全部同类案件”为主读数,并追踪“未提出申请、被口头劝退和无书面决定者不进裁量审计”。若独立样本补入“未提出申请、被口头劝退和无书面决定者不进裁量审计”后方向、大小和区间均不变,本命题不成立。
4. 命题:第7条“电子政务只有伴随开放流程才减腐”只在“数字鸿沟、供应商锁定和不可审计代码会制造新型不透明”未出现时保持原方向。做法:对缺失、退出和拒答建立生成模型与追访样本,以“留有完整审计日志的交易/全部数字交易”为主读数,并追踪“线下补件、后台改写和系统外协调不进电子流程数据”。若跨越“数字鸿沟、供应商锁定和不可审计代码会制造新型不透明”后“留有完整审计日志的交易/全部数字交易”没有结构变化,第7条的反号命题即被否定。
5. 命题:第9条“国家能力必须拆成多维潜变量”只在“潜变量仍依赖可得指标,弱国的数据缺失本身与能力相关”未出现时保持原方向。
6. 命题:第11条“算法行政从街头转向屏幕与系统”只在“模型输出可能被一线人员机械遵从,也可能被绕过;责任链在供应商与机构之间分散”未出现时保持原方向。做法:建立收益方—负担方的成本流向账户,以“可解释并可人工推翻的算法决定/全部算法建议”为主读数,并追踪“模型未覆盖、被系统拒绝录入和人工绕过的案件不进性能表”。
7. 命题:第13条“危机能力取决于协调而非中央集权程度”只在“死亡登记、检测政策和人口年龄结构使简单排名失真,早期成功也可能在后期逆转”未出现时保持原方向。做法:同时测量局部收益与系统外部性,以“从预警到资源到位的时间/危机严重度”为主读数,并追踪“未检测感染、院外死亡和被排除机构不进响应绩效”。若采用统一分母后不同制度中的符号完全一致,官僚制与国家能力无需引入该边界条件。
8. 命题:第15条“代表性官僚制需要从人口比例走向裁量结果”只在“同群身份不保证共同偏好,过度期待也可能给少数官员增加额外负担”未出现时保持原方向。做法:同时测量局部收益与系统外部性,以“拥有实质裁量的少数群体官员/全部少数群体官员”为主读数,并追踪“临时工、外包人员和无晋升通道岗位不进代表性高层统计”。若独立样本补入“临时工、外包人员和无晋升通道岗位不进代表性高层统计”后方向、大小和区间均不变,本命题不成立。
9. 命题:第17条“卫星与数字痕迹扩展脆弱国家测量”只在“代理会把无电但治理有效地区判弱,也可能把矿区或军事设施判强”未出现时保持原方向。做法:把形式通过率与现场执行率并列审计,以“通过地面核验的遥感判断/全部遥感判断”为主读数,并追踪“无信号、被云覆盖和因安全无法核验地区不进准确率”。若采用统一分母后不同制度中的符号完全一致,官僚制与国家能力无需引入该边界条件。
10. 命题:第19条“实施负担必须与行政能力共同测量”只在“官僚质量指标多为专家评价,任务数量也不等于技术难度”未出现时保持原方向。做法:同时扩大样本与抽样框,比较偏差是否真正下降,以“可用行政人员与预算/同时生效的实施任务”为主读数,并追踪“地方配套、非正式执行和被延期任务不进中央法规数量”。若跨越“官僚质量指标多为专家评价,任务数量也不等于技术难度”后“可用行政人员与预算/同时生效的实施任务”没有结构变化,第19条的反号命题即被否定。
◎ 资料核验
本块共核对19笔互异来源。提出、争议和最新分别承担主证据、边界/反证与更新状态;同行评议论文优先写卷页或DOI,专著写出版社,报告写机构与年份,预印本保留身份。碰撞行量纲不计为原论文实测值。
- [原始证据|同行评议论文]Dal Bó、Finan 与 Rossi,2013年,《Strengthening State Capabilities: The Role of Financial Incentives in the Call to Public Service》,Quarterly Journal of Economics 128(3):1169–1218,DOI 10.1093/qje/qjt008。
- [争议/边界|同行评议综述]Finan、Olken 与 Pande,2017年,《The Personnel Economics of the Developing State》,Handbook of Economic Field Experiments 2:467–514,DOI 10.1016/bs.hefe.2016.08.001。
- [近年更新|同行评议综述]McDonnell,2025年,《Bureaucracy in Action: The Sociology of Public Administration》,Annual Review of Sociology 51:191–211,DOI 10.1146/annurev-soc-091324-053657。
- [原始证据|同行评议综述]Duflo、Hanna 与 Ryan,2012年,《Incentives Work: Getting Teachers to Come to School》,American Economic Review 102(4):1241–1278,DOI 10.1257/aer.102.4.1241。
- [争议/边界|同行评议论文]Moynihan、Herd 与 Harvey,2015年,《Administrative Burden: Learning, Psychological, and Compliance Costs in Citizen-State Interactions》,Journal of Public Administration Research and Theory 25(1):43–69,DOI 10.1093/jopart/muu009。
- [原始证据|同行评议综述]Besley 与 Persson,2009年,《The Origins of State Capacity: Property Rights, Taxation, and Politics》,American Economic Review 99(4):1218–1244,DOI 10.1257/aer.99.4.1218。
- [争议/边界|同行评议综述]Fernández-i-Marín、Knill、Steinbacher 与 Steinebach,2024年,《Bureaucratic Quality and the Gap between Implementation Burden and Administrative Capacities》,American Political Science Review 118(3):1240–1260,DOI 10.1017/S0003055423001090。
- [原始证据|同行评议论文]Lee 与 Zhang,2017年,《Legibility and the Informational Foundations of State Capacity》,Journal of Politics 79(1):118–132,DOI 10.1086/688053。
- [争议/边界|同行评议论文]Hanson 与 Sigman,2021年,《Leviathan’s Latent Dimensions: Measuring State Capacity for Comparative Political Research》,Journal of Politics 83(4):1495–1510,DOI 10.1086/715066。
- [争议/边界|学术专著]Eubanks,2018年,《Automating Inequality: How High-Tech Tools Profile, Police, and Punish the Poor》,St. Martin’s Press。
- [原始证据|同行评议论文]Bertot、Jaeger 与 Grimes,2010年,《Using ICTs to Create a Culture of Transparency》,Government Information Quarterly 27(3):264–271,DOI 10.1016/j.giq.2010.03.001。
- [争议/边界|同行评议综述]Veale 与 Brass,2019年,《Administration by Algorithm? Public Management Meets Public Sector Machine Learning》,Public Management Review 21(1):1–22,DOI 10.1080/14719037.2018.1551418。
- [原始证据|同行评议论文]Dell、Lane 与 Querubin,2018年,《The Historical State, Local Collective Action, and Economic Development in Vietnam》,Econometrica 86(6):2083–2121,DOI 10.3982/ECTA15122。
- [原始证据|同行评议综述]Bosio、Djankov、Glaeser 与 Shleifer,2022年,《Public Procurement in Law and Practice》,American Economic Review 112(4):1091–1117,DOI 10.1257/aer.20200738。
- [原始证据|同行评议论文]Greer、King、Fonseca 与 Peralta-Santos,2020年,《The Comparative Politics of COVID-19》,University of Michigan Press。
- [原始证据|同行评议综述]Healy 与 Malhotra,2009年,《Myopic Voters and Natural Disaster Policy》,American Political Science Review 103(3):387–406,DOI 10.1017/S0003055409990104。
- [原始证据|同行评议论文]Blair 等,2021年,《Community Policing Does Not Build Citizen Trust in Police or Reduce Crime in the Global South》,Science 374(6571):eabd3446,DOI 10.1126/science.abd3446。
- [原始证据|同行评议综述]Aneja 与 Xu,2024年,《Strengthening State Capacity: Civil Service Reform and Public Sector Performance during the Gilded Age》,American Economic Review 114(8):2352–2387,DOI 10.1257/aer.20230019。
- [原始证据|同行评议综述]Mastrorocco 与 Teso,2026年,《State Capacity as an Organizational Problem》,Review of Economic Studies,rdag061,DOI 10.1093/restud/rdag061。
- [补录|源行可核验材料]McDonnell,2025年,《Bureaucracy in Action: The Sociology of Public Administration》,Annual Review of Sociology 51:191–211,DOI 10.1146/annurev-soc-091324-053657。(用于更新边界或证据状态,不替代原始研究)