SDE Universes·新思想前沿医学·司法·证据科学
新思想前沿 · 医学·司法·证据科学

法医学与法庭科学

第 290 号 · 近二十年 · 20 条转向 · 约 26,196 汉字 · 王德生 亲撰 · 2026 年 8 月

法医学与法庭科学近二十年的变化,不是新术语依次替换旧术语,而是对象、测量、干预与制度环境共同重组。以下二十条按两幕展开,每条都把关键读数、实施责任、失效反例和跨面板接口放在同一证据链中,避免把相关性、采纳率或成功者样本误写成领域共识。

【第一幕】上一个十年 · 约 2006—2016

第一幕从特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption推进到黑箱研究与错误率Black-Box Studies and Error Rates,重点是旧对象如何被重新定义、旧证据怎样接受反例,以及专业实践怎样从单点判断转向过程和环境。

甲、特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption

提出美国国家科学院,2009年《Strengthening Forensic Science in the United States: A Path Forward》。 争议PCAST,2016年《Forensic Science in Criminal Courts: Ensuring Scientific Validity of Feature-Comparison Methods》。 最新NIST,2024年《Forensic Science Research and Standards》项目更新。 关键特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威

2009 年美国国家研究理事会那份报告的核心判断是:除核 DNA 分析之外,没有任何一种法庭科学方法被严格证明具备把痕迹与特定来源可靠关联的能力。它同时指出,多数法庭科学实验室隶属执法机构、缺乏独立性与统一认证。

它推翻的不是某一种方法,而是整个传统的正当性来源。此前这些方法的可靠性依据是从业者的经验与法庭长期接受的事实,而报告的主张是:长期被接受不构成科学证据,唯一的依据是经验测试。

这一判断的力量在于它来自科学界而非辩护方。它使得「这项技术用了一百年」这句在法庭上极有分量的话,第一次不再是有效的论证。 该项证据的硬读数是美国国家科学院指出多类传统法庭特征比对缺少充分基础研究,观察到相似不能直接推出唯一来源。围绕特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威,该读数不能越过样本和时间窗外推。

未决的是它的执行。报告建议设立独立的联邦法庭科学机构,这一建议从未被采纳;此后的改进依靠标准组织、实验室认证与个别判例推进,速度远慢于报告所设想的。二十年后,多数被点名的方法仍在法庭上照常使用。另有一层影响这十年才充分显现:报告把「法庭科学」从一个由从业者定义的行业,变成了一个由外部科学界评审的对象。此后每一次争议的裁决权都不再完全在行业内部——这一权力转移,可能比报告的任何具体结论都更持久。 可证伪的边界是当资源只投向最容易达标的特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption对象时,覆盖越高,原有差距反而越可能扩大。跨机构比较至少要固定“完成关键结局核验者/全部进入“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威就只是口径产物,而不是经反例保留下来的领域判断。

实践上应为“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”建立前测、过程与结局账,使特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威可观察。检验特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威须预设停止和替代阈值,不能只报成功者。 另一可复核锚点是美国国家科学院指出多类传统法庭特征比对缺少充分基础研究,观察到相似不能直接推出唯一来源;这条观察必须保留原分母和时序。

另见第 196 号第 1 条“平台化:新闻的形式与经济被外部基础设施重写”提供接口:特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威必须拆成分子、分母和失效条件,并记录进入、排除与结果回写。

位置S——特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption的可见结局是决定项 单因只有特征比对必须由可检验的总体模型、错误率和限制条件取代经验权威 预设〔18 干预不回写到被干预者〕制度变化不改变“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”对象的原有含义 量纲完成关键结局核验者/全部进入“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”评估者 失效当资源只投向最容易达标的特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption对象时,覆盖越高,原有差距反而越可能扩大 自曝代表性边界:“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 1 条“平台化:新闻的形式与经济被外部基础设施重写

乙、个体化主张的退场The End of Individualisation

提出Saks与Koehler,2005年《Science》309:892–895,DOI 10.1126/science.1111565。 争议美国司法部,2018年《Uniform Language for Testimony and Reports》系列。 最新NIST,2024年法庭结论表达工作组报告。 关键个体化结论应退出报告并改写为对竞争命题的证据支持程度

传统法庭科学的核心主张是个体化:这枚指纹、这颗弹壳、这道咬痕来自世界上唯一的那个来源,排除其他一切可能。这十年这一主张在专业文献中被系统放弃。

推翻它的是一个简单的逻辑问题:要断言唯一性,必须知道整个总体中不存在第二个足够相似的来源,而这需要一个从未被建立的参照数据库。个体化因此不是一个可以由观察支持的结论,而是一个信念。

替代表述是来源归属的概率化:证据支持某一来源假设的程度,而不是断言来源本身。这一转换看似只是措辞,实际改变了举证结构——从专家给出结论,改为专家给出证据强度、由裁判者作出结论。 可复核材料首先给出开放总体中无法证明某一痕迹来自且只来自一个人,所谓百分之百确定也无法由有限验证数据支持。围绕个体化结论应退出报告并改写为对竞争命题的证据支持程度,换掉分母会改变政策含义。

未决的是接受度。陪审员与法官对概率表述的理解普遍不佳,多项研究显示概率化表述反而可能被高估或低估;而放弃确定性表述的专家,在对方专家仍作确定表述时处于修辞劣势。这是这十年该领域最实际的困境。还有一处至今未解的实践困难:放弃个体化之后,专家仍需回答「这个似然比有多大」,而对指纹、弹痕这类没有参照总体数据库的方法,这个数字无从计算。结果是许多领域既不能说唯一,也给不出概率,只能停在「支持」这种无量纲的表述上。 可证伪的边界是当测量进入考核后,个体化主张的退场The End of Individualisation指标越漂亮,未被指标捕捉的真实结局反而越可能恶化。跨机构比较至少要固定“完成关键结局核验者/全部进入“个体化主张的退场The End of Individualisation”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,个体化结论应退出报告并改写为对竞争命题的证据支持程度就只是口径产物,而不是经反例保留下来的领域判断。

落地“个体化主张的退场The End of Individualisation”不能只改名称,应由个体化结论应退出报告并改写为对竞争命题的证据支持程度确定起点、强度和延迟后果。若不检验拒绝与失访,效果便没有分母。 另一可复核锚点是开放总体中无法证明某一痕迹来自且只来自一个人,所谓百分之百确定也无法由有限验证数据支持;这条观察必须保留原分母和时序。

与第 196 号第 2 条“从守门到观门:把关不再由一处完成”对撞后,个体化结论应退出报告并改写为对竞争命题的证据支持程度成为责任链。只留最终输出会抹掉停止权和无人承担项。

位置D——个体化主张的退场The End of Individualisation的实施序列是决定项 单因只有个体化结论应退出报告并改写为对竞争命题的证据支持程度 预设〔18 干预不回写到被干预者〕制度变化不改变“个体化主张的退场The End of Individualisation”对象的原有含义 量纲完成关键结局核验者/全部进入“个体化主张的退场The End of Individualisation”评估者 失效当测量进入考核后,个体化主张的退场The End of Individualisation指标越漂亮,未被指标捕捉的真实结局反而越可能恶化 自曝时间窗边界:“个体化主张的退场The End of Individualisation”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 2 条“从守门到观门:把关不再由一处完成

丙、认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making

提出Dror、Charlton与Péron,2006年《Forensic Science International》162:74–78,DOI 10.1016/j.forsciint.2006.06.058。 争议National Commission on Forensic Science,2015年《Ensuring That Forensic Analysis Is Based Upon Task-Relevant Information》。 最新NIST,2024年《Human Factors in Forensic Science》更新。 关键认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训

这十年一系列实验证实了此前被视为不可能的事:同一名指纹专家,在被告知案件背景不同的情况下,对同一对指纹作出相反的结论。类似效应在笔迹、弹痕、DNA 混合样本解释中陆续被复制。

它推翻的是「专业训练可以免疫于偏差」这一从业者的普遍信念。偏差的来源不是不诚实,而是无关信息进入了判断过程——嫌疑人已认罪、目击者指认、同事的先行结论。

这一发现把法庭科学的质量问题从「谁在造假」改写成「流程如何设计」,并给出可操作的对策:屏蔽任务无关信息、按固定顺序揭示信息、以及在作出结论前不接触参考样本以外的材料。 把争论落到分母后可以看到知道嫌疑人身份、口供或他人结论会无意影响特征选择与解释,专家自信不能排除这种偏差。围绕认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训,它把问题推进到适用条件。

未决的是实施范围。多数实验室采用了部分措施,而完全的信息屏蔽与实际工作流程冲突——分析人员往往同时是现场勘查者。这条线的价值因此更多体现在改变了法庭上的质证内容:专家看到了什么、什么时候看到的,成为可以被追问的事实。另一处值得记下的是它的适用范围:偏差效应在证据质量差、判断空间大的情形下最强,在证据清晰时几乎不出现。这意味着最需要防范偏差的恰恰是最难判断的案件——而那也正是结论最可能影响判决的案件。 可证伪的边界是当实施依赖高资源中心时,认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making证据越成熟,向基层迁移后的有效性反而越不稳定。跨机构比较至少要固定“完成关键结局核验者/全部进入“认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训就只是口径产物,而不是经反例保留下来的领域判断。

认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”应依认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训分开专业判断、目标和资源。若认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训只在中心成立,推广前须结算基层容量和失败补救。 另一可复核锚点是知道嫌疑人身份、口供或他人结论会无意影响特征选择与解释,专家自信不能排除这种偏差;这条观察必须保留原分母和时序。

另见第 196 号第 7 条“指标进入编辑判断:实时读数成为新的评判者”可检验认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训的外推边界。若它依赖特定机构或高资源人群,就须固定单位并单列反号。

位置E——认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making的制度环境是决定项 单因只有认知偏差控制要作用于信息流、任务顺序和组织激励而非只靠培训 预设〔18 干预不回写到被干预者〕制度变化不改变“认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”对象的原有含义 量纲完成关键结局核验者/全部进入“认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”评估者 失效当实施依赖高资源中心时,认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making证据越成熟,向基层迁移后的有效性反而越不稳定 自曝测量误差边界:“认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 7 条“指标进入编辑判断:实时读数成为新的评判者

丁、语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking

提出Dror等,2015年《Journal of Forensic Sciences》60:1111–1117,线性顺序揭示。 争议美国法庭科学委员会,2015年任务相关信息建议。 最新OSAC,2024年法庭科学语境管理标准工作。 关键语境信息应按任务相关性分层并以线性顺序揭示给分析人员

作为偏差研究的直接产物,这十年提出了一套流程设计:任务相关的信息按固定顺序、逐步揭示,分析人员先独立记录痕迹本身的特征,再接触参考样本,且不得因参考样本回头修改先前记录。

它推翻的是分析与比对可以混在一起进行的做法。传统流程允许专家在看到嫌疑人样本后回头「重新发现」痕迹中的特征,这在心理学上等于让结论决定证据。

这套设计的价值在于它不要求人变得更客观,只要求信息的到达顺序被控制——这与临床试验的盲法、与同行评议的匿名化是同一类制度设计。 这一判断不是概念推演,材料显示先独立检查未知样本再接触已知样本与案件语境,可减少比较对象反向塑造对未知特征的编码。围绕语境信息应按任务相关性分层并以线性顺序揭示给分析人员,支持、异质性与未测对象必须同表。

未决的是可行性与成本。完全的顺序控制需要案件管理系统的支持与人员分工,小型实验室难以承担;而在痕迹质量很差、必须依靠参考样本才能定位可比区域的案件中,严格的顺序控制会使部分证据无法使用——这一取舍至今没有公认的处理规则。还有一处副产品是可追溯性:按顺序揭示的流程必然产生一份记录,说明分析人员在每一步看到了什么。这份记录使事后复核第一次成为可能,而在传统流程下,专家的判断过程不留痕迹。另一处争论是它对复杂案件的适用:痕迹越差,越需要参考样本来定位可比区域,而顺序控制在这里最难维持。 可证伪的边界是当失败者被排除在分母外时,语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking成功率越高,总体风险反而越难被看见。跨机构比较至少要固定“完成关键结局核验者/全部进入“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,语境信息应按任务相关性分层并以线性顺序揭示给分析人员就只是口径产物,而不是经反例保留下来的领域判断。

改进“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”时,应让语境信息应按任务相关性分层并以线性顺序揭示给分析人员对应版本、阈值与覆写。验收语境信息应按任务相关性分层并以线性顺序揭示给分析人员不能只数采纳量,还要核查未统计风险。 另一可复核锚点是先独立检查未知样本再接触已知样本与案件语境,可减少比较对象反向塑造对未知特征的编码;这条观察必须保留原分母和时序。

跨面板看,第 196 号第 10 条“信息失序:真假二分被意图与语境拆开”与语境信息应按任务相关性分层并以线性顺序揭示给分析人员共享回写难题。它进入考核后会塑造行为,故须比较回写路径。

位置S——语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking的可见结局是决定项 单因只有语境信息应按任务相关性分层并以线性顺序揭示给分析人员 预设〔27 能力可与承载它的人分离〕制度变化不改变“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”对象的原有含义 量纲完成关键结局核验者/全部进入“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”评估者 失效当失败者被排除在分母外时,语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking成功率越高,总体风险反而越难被看见 自曝机构容量边界:“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 10 条“信息失序:真假二分被意图与语境拆开

戊、咬痕证据的崩塌The Collapse of Bitemark Evidence

提出PCAST,2016年法庭特征比对有效性报告。 争议NIST,2023年《Bitemark Analysis: A NIST Scientific Foundation Review》。 最新美国国家司法研究院,2024年咬痕证据研究更新。 关键咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属

咬痕比对曾在数十起重罪案件中作为关键证据,这十年它成为整个特征比对传统中被推翻得最彻底的一项:多起依赖咬痕定罪的案件因 DNA 证据而平反,而验证研究显示专家之间连「这是不是咬痕」都无法一致判断。

它推翻的是两条从未被检验的前提:人的牙列具有唯一性,且皮肤能够忠实记录这种唯一性。第二条尤其脆弱——皮肤是弹性的、会随时间变形,痕迹的形成条件几乎不可复现。

这一案例的价值在于它提供了一个完整的失败样本:一项方法如何在没有基础研究的情况下被法庭接受、被专业组织背书、并在数十年里造成可查证的错案。 最需要保存的经验事实是皮肤会变形、伤痕随时间改变,专家对同一照片是否为人咬伤及其来源存在显著分歧。围绕咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属,仍须处理基线、失访和测量误差。

未决的是同类方法的处理。咬痕之所以被放弃,部分原因是它的错案可以被 DNA 直接证伪;而笔迹、鞋印、工具痕迹等方法缺乏这样的独立检验途径,因而即使基础同样薄弱,也难以被同等程度地清算。另一处教训与制度有关:咬痕的专业组织长期为其背书,并对提出质疑的成员施加压力。这说明专业自治在面对自身方法的效度问题时,未必是可靠的纠错机制——这一观察后来被用于论证外部评审的必要性。另一处提示是平反机制的依赖性:咬痕之所以被清算,靠的是 DNA 这一外部检验手段,而不是本领域的自我修正。 可证伪的边界是当名称更新却不改变责任链时,咬痕证据的崩塌The Collapse of Bitemark Evidence规范越完整,实际无人承担的环节反而越多。跨机构比较至少要固定“完成关键结局核验者/全部进入“咬痕证据的崩塌The Collapse of Bitemark Evidence”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属就只是口径产物,而不是经反例保留下来的领域判断。

咬痕证据的崩塌The Collapse of Bitemark Evidence”进入指南后,须用咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属设置审计和对照。把咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属同旧流程及随访比较,才能区分改名和结构改变。 另一可复核锚点是皮肤会变形、伤痕随时间改变,专家对同一照片是否为人咬伤及其来源存在显著分歧;这条观察必须保留原分母和时序。

另见第 196 号第 11 条“逆火效应的清算:纠正通常不会强化错误信念”给咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属提供反证。检验时须检查承载、指标回写和成功者遮蔽;任一失守都应下调结论。

位置D——咬痕证据的崩塌The Collapse of Bitemark Evidence的实施序列是决定项 单因只有咬痕比对缺乏足以支持个体识别的基础效度并应停止用于来源归属 预设〔27 能力可与承载它的人分离〕制度变化不改变“咬痕证据的崩塌The Collapse of Bitemark Evidence”对象的原有含义 量纲完成关键结局核验者/全部进入“咬痕证据的崩塌The Collapse of Bitemark Evidence”评估者 失效当名称更新却不改变责任链时,咬痕证据的崩塌The Collapse of Bitemark Evidence规范越完整,实际无人承担的环节反而越多 自曝因果识别边界:“咬痕证据的崩塌The Collapse of Bitemark Evidence”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 11 条“逆火效应的清算:纠正通常不会强化错误信念

己、似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions

提出Evett、Jackson、Lambert与McCrossan,2000年《Science & Justice》40:233–239。 争议ENFSI,2015年《Guideline for Evaluative Reporting in Forensic Science》。 最新Royal Statistical Society,2024年法庭证据概率解释指引。 关键似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工

这十年欧洲主导的评估框架在国际上确立:专家的任务是给出证据在两个互相竞争的命题下出现的概率之比,而命题按层级划分——亚来源层(这个 DNA 谱型来自谁)、来源层(这个痕迹来自谁)、活动层(这个人做了什么)、犯罪层(是否构成犯罪)。

它推翻的是专家可以直接回答「是不是他干的」这一定位。层级的意义在于划分职责:专家只能在自己有数据支撑的层级上发言,而每上升一层,所需的背景知识与假设都急剧增加。

这一框架同时给出了一条清晰的错误诊断工具——检方谬误:把「若非此人则证据出现的概率很低」误读成「此人是来源的概率很高」。这一混淆在法庭上极为常见,而层级框架使它可以被明确指出。 该项证据的硬读数是同一检验结果在来源层与活动层命题下可能支持方向不同,把似然比说成犯罪概率会构成检察官谬误。围绕似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工,该读数不能越过样本和时间窗外推。

未决的是各国接受度不一。欧洲多国已把似然比写入报告规范,而美国的实践仍以分类结论为主。同一份物证在不同法域被表述成不同形态,这本身构成对该学科科学性的一种提示。还有一处常被误解:似然比不是「他是来源的概率」,而是「若他是来源与若他不是来源,观察到这一证据的相对可能性」。两者之间隔着先验概率,而先验属于裁判者而非专家——这条分界正是整个框架要守住的东西。 可证伪的边界是当资源只投向最容易达标的似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions对象时,覆盖越高,原有差距反而越可能扩大。跨机构比较至少要固定“完成关键结局核验者/全部进入“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工就只是口径产物,而不是经反例保留下来的领域判断。

实践上应为“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”建立前测、过程与结局账,使似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工可观察。检验似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工须预设停止和替代阈值,不能只报成功者。 另一可复核锚点是同一检验结果在来源层与活动层命题下可能支持方向不同,把似然比说成犯罪概率会构成检察官谬误;这条观察必须保留原分母和时序。

另见第 198 号第 6 条“算法文化:推荐系统进入创作上游”提供接口:似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工必须拆成分子、分母和失效条件,并记录进入、排除与结果回写。

位置E——似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions的制度环境是决定项 单因只有似然比必须针对明确的检方与辩方命题并与先验和事实裁判分工 预设〔27 能力可与承载它的人分离〕制度变化不改变“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”对象的原有含义 量纲完成关键结局核验者/全部进入“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”评估者 失效当资源只投向最容易达标的似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions对象时,覆盖越高,原有差距反而越可能扩大 自曝外部效度边界:“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 198 号第 6 条“算法文化:推荐系统进入创作上游

庚、DNA 混合样本解释的危机The Mixture Interpretation Crisis

提出Balding与Buckleton,2009年《Forensic Science International: Genetics》4:1–10。 争议NIST,2021年《DNA Mixture Interpretation: A NIST Scientific Foundation Review》。 最新SWGDAM,2024年《Interpretation Guidelines for Autosomal STR Typing》。 关键复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设

随着检测灵敏度提高,越来越多的样本包含多人 DNA。这十年发现,人工解读混合谱型的一致性极差——同一份混合样本交由不同实验室,结论可以从「支持嫌疑人在内」到「排除」不等。

它推翻的是把 DNA 当作免于主观判断的黄金标准这一印象。核 DNA 在单一来源样本上确实稳健,而混合样本的解读涉及大量判断:几个贡献者、哪些峰是等位基因、哪些是伪峰、脱扣如何处理。

由此产生的技术回应是概率基因分型:用统计模型对整个谱型建模,输出似然比,而不是先由人决定包含哪些等位基因再做统计。这把主观判断从解读环节移到了模型设定环节。 可复核材料首先给出低模板多贡献者样本会产生多个统计上可行解释,调整阈值或贡献者数即可大幅改变重量读数。围绕复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设,换掉分母会改变政策含义。

未决的是模型本身的验证。不同软件对同一份样本给出的似然比可以相差多个数量级,而模型的假设与参数设定在这十年很少被公开检验。这个空缺在下一个十年成为法庭争议的焦点。另一处结构性问题是灵敏度的自我加压:检测能力越强,进入分析的低模板与多人样本越多,而这些恰恰是解读最不可靠的样本。技术进步在这里没有解决问题,而是制造了新的问题类别。另一处需要说清的是灵敏度与解释力的分离:能测到不等于能解释,而实验室的能力建设长期只投在前一项上。 可证伪的边界是当测量进入考核后,DNA 混合样本解释的危机The Mixture Interpretation Crisis指标越漂亮,未被指标捕捉的真实结局反而越可能恶化。跨机构比较至少要固定“完成关键结局核验者/全部进入“DNA 混合样本解释的危机The Mixture Interpretation Crisis”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设就只是口径产物,而不是经反例保留下来的领域判断。

落地“DNA 混合样本解释的危机The Mixture Interpretation Crisis”不能只改名称,应由复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设确定起点、强度和延迟后果。若不检验拒绝与失访,效果便没有分母。 另一可复核锚点是低模板多贡献者样本会产生多个统计上可行解释,调整阈值或贡献者数即可大幅改变重量读数;这条观察必须保留原分母和时序。

与第 198 号第 18 条“影像证据危机:伪造与真实不能只从画面区分”对撞后,复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设成为责任链。只留最终输出会抹掉停止权和无人承担项。

位置S——DNA 混合样本解释的危机The Mixture Interpretation Crisis的可见结局是决定项 单因只有复杂DNA混合物解释必须验证等位基因掉落、掉入与贡献者数量假设 预设〔21 制度采纳不改变指标含义〕制度变化不改变“DNA 混合样本解释的危机The Mixture Interpretation Crisis”对象的原有含义 量纲完成关键结局核验者/全部进入“DNA 混合样本解释的危机The Mixture Interpretation Crisis”评估者 失效当测量进入考核后,DNA 混合样本解释的危机The Mixture Interpretation Crisis指标越漂亮,未被指标捕捉的真实结局反而越可能恶化 自曝选择进入边界:“DNA 混合样本解释的危机The Mixture Interpretation Crisis”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 198 号第 18 条“影像证据危机:伪造与真实不能只从画面区分

辛、黑箱研究与错误率Black-Box Studies and Error Rates

提出Ulery等,2011年《PNAS》108:7733–7738,DOI 10.1073/pnas.1018707108。 争议PCAST,2016年法庭特征比对报告。 最新NIST,2024年法庭黑箱研究设计指南。 关键黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布

这十年出现了一类新的研究设计:给大量执业专家提供已知答案的样本对,测量他们的错误率,而不追问他们如何作出判断。这被称为黑箱研究,因为它把专家判断当作一个待测量的整体。

它推翻的是以方法原理的合理性代替效度证明的做法。一项方法是否有效,不取决于它的理论说得通,而取决于执业者用它得出的结论有多大比例是错的——这一转换是这十年法庭科学最重要的方法学进步。

最早完成的指纹黑箱研究给出的假阳性率很低而假阴性率相当可观,这一结果既支持了指纹比对的基本可靠性,也揭示了此前从未被承认的错误存在。 把争论落到分母后可以看到只测试单个步骤或让参与者知道答案会低估现实错误,错误还会随样本难度与检验员而异。围绕黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布,它把问题推进到适用条件。

未决的是研究设计的代表性。参与者是自愿的、样本难度由研究者设定、且专家知道自己在被测试。这三项都会使估计偏乐观,而按这些估计在法庭上陈述错误率,可能给出虚假的精确感。还有一处后果值得记下:黑箱研究把「专家判断」变成了可测量对象,这一方法随后被搬到医学影像判读、审计与内容审核等其他专家判断领域——它是这十年法庭科学对外输出的最重要方法。另一处限制是它只测结论不测过程:黑箱研究告诉我们错误率是多少,不告诉我们错误从哪一步产生,因而无法直接指导改进。 可证伪的边界是当实施依赖高资源中心时,黑箱研究与错误率Black-Box Studies and Error Rates证据越成熟,向基层迁移后的有效性反而越不稳定。跨机构比较至少要固定“完成关键结局核验者/全部进入“黑箱研究与错误率Black-Box Studies and Error Rates”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布就只是口径产物,而不是经反例保留下来的领域判断。

黑箱研究与错误率Black-Box Studies and Error Rates”应依黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布分开专业判断、目标和资源。若黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布只在中心成立,推广前须结算基层容量和失败补救。 另一可复核锚点是只测试单个步骤或让参与者知道答案会低估现实错误,错误还会随样本难度与检验员而异;这条观察必须保留原分母和时序。

另见第 199 号第 6 条“音乐的信息论分析:把意外算出来”可检验黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布的外推边界。若它依赖特定机构或高资源人群,就须固定单位并单列反号。

位置D——黑箱研究与错误率Black-Box Studies and Error Rates的实施序列是决定项 单因只有黑箱研究必须用代表性案件材料盲测完整流程并公开错误率分布 预设〔21 制度采纳不改变指标含义〕制度变化不改变“黑箱研究与错误率Black-Box Studies and Error Rates”对象的原有含义 量纲完成关键结局核验者/全部进入“黑箱研究与错误率Black-Box Studies and Error Rates”评估者 失效当实施依赖高资源中心时,黑箱研究与错误率Black-Box Studies and Error Rates证据越成熟,向基层迁移后的有效性反而越不稳定 自曝失访偏差边界:“黑箱研究与错误率Black-Box Studies and Error Rates”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 199 号第 6 条“音乐的信息论分析:把意外算出来
【第二幕】这十年 · 约 2016—2026

第二幕从火灾调查的重写Rewriting Fire Investigation推进到自动比对与算法证据Automated Comparison and Algorithmic Evidence,重点转向制度采纳、资源分配、数字基础设施和公共责任;判断标准由“能不能做”提高到“对谁有效、由谁承担、失败后能否回写”。

一、火灾调查的重写Rewriting Fire Investigation

提出NFPA,2011年《Guide for Fire and Explosion Investigations》921。 争议美国国家科学院,2009年法庭科学报告火灾调查章节。 最新NFPA,2024年《NFPA 921》新版。 关键火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单

这十年火灾调查的一批传统判据——地板上的烧穿痕、玻璃的龟裂纹、所谓的助燃剂倾倒模式——被实验证明可以在没有助燃剂的意外火灾中自然出现。以这些判据定性的纵火案由此被重新审视。

它推翻的是一整套由经验积累、代代相传却从未在受控条件下检验的判据。这些判据的形成机制很典型:调查者在已知是纵火的案件中观察到某种痕迹,便把它当作纵火的标志,而从未检验意外火灾中该痕迹的出现率。

这类错误在统计上有明确名称——只看条件概率的一侧。它与咬痕、与笔迹依赖的推理结构完全相同,也因此使火灾调查的重写成为其他领域的方法学范例。 这一判断不是概念推演,材料显示通风、闪燃与灭火可制造过去被当作助燃剂痕迹的图案,旧经验规则曾系统支持错误纵火结论。围绕火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单,支持、异质性与未测对象必须同表。

未决的是已决案件的处理。按新判据,相当数量的旧纵火定罪缺乏支撑,而多数法域没有为「科学判据改变」设立的再审通道。这条线因此从技术问题变成了制度问题。另一处值得强调的是它的推理形态:从「纵火现场常见 X」推出「见到 X 即为纵火」,需要知道意外火灾中 X 的出现率。这一步在多个法庭科学领域被系统性省略,因此火灾调查的重写具有超出本领域的示范意义。另一处值得记下的是它与保险与消防调查的关联:同一套判据同时用于刑事定罪与保险理赔,纠正的连带范围因此远大于刑事案件本身。 可证伪的边界是当失败者被排除在分母外时,火灾调查的重写Rewriting Fire Investigation成功率越高,总体风险反而越难被看见。跨机构比较至少要固定“完成关键结局核验者/全部进入“火灾调查的重写Rewriting Fire Investigation”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单就只是口径产物,而不是经反例保留下来的领域判断。

改进“火灾调查的重写Rewriting Fire Investigation”时,应让火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单对应版本、阈值与覆写。验收火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单不能只数采纳量,还要核查未统计风险。 另一可复核锚点是通风、闪燃与灭火可制造过去被当作助燃剂痕迹的图案,旧经验规则曾系统支持错误纵火结论;这条观察必须保留原分母和时序。

跨面板看,第 124 号第 2 条“协作拓扑——谁能叫停一项医嘱,决定了错误在哪一步被拦住”与火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单共享回写难题。它进入考核后会塑造行为,故须比较回写路径。

位置E——火灾调查的重写Rewriting Fire Investigation的制度环境是决定项 单因只有火灾调查必须以可复现实验和火灾动力学替代经验性燃烧图案清单 预设〔21 制度采纳不改变指标含义〕制度变化不改变“火灾调查的重写Rewriting Fire Investigation”对象的原有含义 量纲完成关键结局核验者/全部进入“火灾调查的重写Rewriting Fire Investigation”评估者 失效当失败者被排除在分母外时,火灾调查的重写Rewriting Fire Investigation成功率越高,总体风险反而越难被看见 自曝阈值漂移边界:“火灾调查的重写Rewriting Fire Investigation”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 124 号第 2 条“协作拓扑——谁能叫停一项医嘱,决定了错误在哪一步被拦住

二、基础效度与应用效度Foundational Validity and Validity as Applied

提出PCAST,2016年法庭特征比对报告。 争议Koehler,2017年《Psychological Science in the Public Interest》18:201–250。 最新NIST,2024年科学基础审查框架。 关键基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对

2016 年一份总统科学顾问委员会报告给出了迄今最明确的判据:一种特征比对方法要被法庭接受,必须具备基础效度——由多项独立的黑箱研究证明其在实际条件下的错误率可接受;此外还需具备应用效度——本案的检验人员确实按经过验证的程序操作。

它推翻的是把方法的可接受性交由专业共同体自我认定的做法,并给出了一个可以在法庭上直接使用的清单。按这一清单,报告认定只有单一来源 DNA、贡献者不超过两人的混合 DNA 与潜在指纹达到了基础效度。

这份报告随即遭到执法与部分专业组织的强烈反对,理由包括判据过严、忽视了非黑箱形式的证据、以及委员会缺乏法庭科学从业者。此后的判例分析显示,多数法院并未据此排除证据,实质变化有限。 最需要保存的经验事实是方法在理想研究中可区分不等于个案报告可靠,人员能力、设备、流程和案件难度会改变实际误差。围绕基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对,仍须处理基线、失访和测量误差。

未决的是司法采纳。法官拥有排除不可靠证据的权力与工具,而实际行使极少。这十年出现了个别排除枪弹痕迹证据的判决,但仍属例外。制度上的瓶颈不在科学而在司法惯性。另一处值得记下的是它的可操作性:这份报告第一次给辩护方提供了一份可以逐条对照的清单,使质证不再依赖于找到一位愿意作证的对方专家。判据的公开本身改变了法庭上的力量对比。 可证伪的边界是当名称更新却不改变责任链时,基础效度与应用效度Foundational Validity and Validity as Applied规范越完整,实际无人承担的环节反而越多。跨机构比较至少要固定“完成关键结局核验者/全部进入“基础效度与应用效度Foundational Validity and Validity as Applied”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对就只是口径产物,而不是经反例保留下来的领域判断。

基础效度与应用效度Foundational Validity and Validity as Applied”进入指南后,须用基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对设置审计和对照。把基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对同旧流程及随访比较,才能区分改名和结构改变。 另一可复核锚点是方法在理想研究中可区分不等于个案报告可靠,人员能力、设备、流程和案件难度会改变实际误差;这条观察必须保留原分母和时序。

另见第 126 号第一幕第二条“镜像疗法:运动可以先由视觉替身启动”给基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对提供反证。检验时须检查承载、指标回写和成功者遮蔽;任一失守都应下调结论。

位置S——基础效度与应用效度Foundational Validity and Validity as Applied的可见结局是决定项 单因只有基础效度与应用效度必须分开证明方法能做什么以及实验室是否做对 预设〔15 同名即同物〕制度变化不改变“基础效度与应用效度Foundational Validity and Validity as Applied”对象的原有含义 量纲完成关键结局核验者/全部进入“基础效度与应用效度Foundational Validity and Validity as Applied”评估者 失效当名称更新却不改变责任链时,基础效度与应用效度Foundational Validity and Validity as Applied规范越完整,实际无人承担的环节反而越多 自曝利益冲突边界:“基础效度与应用效度Foundational Validity and Validity as Applied”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 126 号第一幕第二条“镜像疗法:运动可以先由视觉替身启动

三、概率基因分型的验证之争Validating Probabilistic Genotyping

提出Coble与Bright,2019年《Forensic Science International: Genetics》38:14–25。 争议NIST,2021年DNA混合物科学基础审查。 最新OSAC,2024年概率基因分型验证标准。 关键概率基因分型软件须经版本特定、边界条件和独立外部验证

概率基因分型软件在这十年成为混合样本解释的主流工具,也成为最激烈的争议点:软件输出一个似然比,而这个数字的产生过程对辩护方不可见。

争议的核心是可验证性。辩方要求获得源代码以检验模型假设与实现是否正确,开发方以商业秘密抗辩。多起案件围绕源代码的可及性作出相反裁定,而已公开检验的案例中确实发现过影响结果的缺陷。

技术上的独立问题是模型间分歧:不同软件、不同参数设置对同一份样本给出的似然比可以相差数个数量级,尤其在贡献者多、模板量低的样本上。有基础评审直接指出,超过一定复杂度的混合样本目前缺乏可靠的解释方法。 该项证据的硬读数是同一混合样本的似然比取决于软件模型、参数与运行设置,内部验证不能覆盖所有贡献者与亲缘场景。围绕概率基因分型软件须经版本特定、边界条件和独立外部验证,该读数不能越过样本和时间窗外推。

未决的是可接受的复杂度上限。实验室倾向于对越来越复杂的样本给出结论,而验证研究覆盖的复杂度有限。这条线的实质问题因此是:在没有验证数据的区域,专家是否应当拒绝出具意见。还有一处被反复指出的不对称:软件由控方一侧采购与使用,其验证研究也多由开发方或使用方完成。在这种结构下,独立复核不是额外要求,而是效度成立的必要条件。另一处技术进展是开源实现的出现,它使模型假设第一次可以被独立研究者逐条检查。 可证伪的边界是当资源只投向最容易达标的概率基因分型的验证之争Validating Probabilistic Genotyping对象时,覆盖越高,原有差距反而越可能扩大。跨机构比较至少要固定“完成关键结局核验者/全部进入“概率基因分型的验证之争Validating Probabilistic Genotyping”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,概率基因分型软件须经版本特定、边界条件和独立外部验证就只是口径产物,而不是经反例保留下来的领域判断。

实践上应为“概率基因分型的验证之争Validating Probabilistic Genotyping”建立前测、过程与结局账,使概率基因分型软件须经版本特定、边界条件和独立外部验证可观察。检验概率基因分型软件须经版本特定、边界条件和独立外部验证须预设停止和替代阈值,不能只报成功者。 另一可复核锚点是同一混合样本的似然比取决于软件模型、参数与运行设置,内部验证不能覆盖所有贡献者与亲缘场景;这条观察必须保留原分母和时序。

另见第 150 号第 19 条“企业风险治理从合规转向情景”提供接口:概率基因分型软件须经版本特定、边界条件和独立外部验证必须拆成分子、分母和失效条件,并记录进入、排除与结果回写。

位置D——概率基因分型的验证之争Validating Probabilistic Genotyping的实施序列是决定项 单因只有概率基因分型软件须经版本特定、边界条件和独立外部验证 预设〔15 同名即同物〕制度变化不改变“概率基因分型的验证之争Validating Probabilistic Genotyping”对象的原有含义 量纲完成关键结局核验者/全部进入“概率基因分型的验证之争Validating Probabilistic Genotyping”评估者 失效当资源只投向最容易达标的概率基因分型的验证之争Validating Probabilistic Genotyping对象时,覆盖越高,原有差距反而越可能扩大 自曝技术依赖边界:“概率基因分型的验证之争Validating Probabilistic Genotyping”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 150 号第 19 条“企业风险治理从合规转向情景

四、活动层命题Activity Level Propositions

提出Cook、Evett、Jackson、Jones与Lambert,1998年《Science & Justice》38:231–239。 争议ENFSI,2015年评价性报告指南。 最新Taylor等,2024年《Forensic Science International: Genetics》活动层评估更新。 关键活动层命题要解释DNA如何沉积而不只是可能来自谁

这十年法庭上最常见的问题不再是「这是不是他的 DNA」,而是「他的 DNA 为什么会在这里」。活动层评估要求专家在两个关于行为的竞争命题下评估证据,而不是仅回答来源问题。

它推翻的是把来源结论直接用于行为推断的做法。检出某人的 DNA 与该人实施了某个行为之间隔着转移、存留、普遍性与回收四个环节,而这四个环节各自受大量条件影响。

方法上,这一层级的评估依赖贝叶斯网络与转移实验数据;国际专业组织在这十年发布了指南,要求在活动层发言的专家必须接受专门训练并有数据支撑,而不是凭经验作出判断。 可复核材料首先给出当来源并无争议时,转移、持续和恢复概率才决定发现DNA对接触、使用或袭击命题的支持;接触时序、表面材质、清洁与采样位置必须同时进入模型。围绕活动层命题要解释DNA如何沉积而不只是可能来自谁,换掉分母会改变政策含义。

未决的是数据基础。转移与存留的实验数据覆盖的场景有限,而案件情形无穷;相关的官方审查已指出,大量分析人员在庭上就转移问题给出了没有数据支撑的意见。这是当前法庭科学中最活跃、也最容易越界的一块。另一处需要区分的是能力与职责:即便专家有能力就转移作出判断,是否应当在庭上作出,还取决于该判断所需的假设是否能被明示与质证。活动层的风险不在于难,而在于它的假设很容易隐藏在专业表述里。另一处提醒是层级不可跳跃:在没有来源层结论的情况下直接就活动层发言,是这一框架明确禁止的做法。 可证伪的边界是当测量进入考核后,活动层命题Activity Level Propositions指标越漂亮,未被指标捕捉的真实结局反而越可能恶化。跨机构比较至少要固定“完成关键结局核验者/全部进入“活动层命题Activity Level Propositions”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,活动层命题要解释DNA如何沉积而不只是可能来自谁就只是口径产物,而不是经反例保留下来的领域判断。

落地“活动层命题Activity Level Propositions”不能只改名称,应由活动层命题要解释DNA如何沉积而不只是可能来自谁确定起点、强度和延迟后果。若不检验拒绝与失访,效果便没有分母。 另一可复核锚点是当来源并无争议时,转移、持续和恢复概率才决定发现DNA对接触、使用或袭击命题的支持;接触时序、表面材质、清洁与采样位置必须同时进入模型;这条观察必须保留原分母和时序。

与第 150 号第 9 条“共同所有权的反竞争效应之争”对撞后,活动层命题要解释DNA如何沉积而不只是可能来自谁成为责任链。只留最终输出会抹掉停止权和无人承担项。

位置E——活动层命题Activity Level Propositions的制度环境是决定项 单因只有活动层命题要解释DNA如何沉积而不只是可能来自谁 预设〔15 同名即同物〕制度变化不改变“活动层命题Activity Level Propositions”对象的原有含义 量纲完成关键结局核验者/全部进入“活动层命题Activity Level Propositions”评估者 失效当测量进入考核后,活动层命题Activity Level Propositions指标越漂亮,未被指标捕捉的真实结局反而越可能恶化 自曝执行异质边界:活动层解释还受到接触时序、表面材质、清洁过程与采样方案限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 150 号第 9 条“共同所有权的反竞争效应之争

五、微量 DNA 与二次转移Trace DNA and Secondary Transfer

提出Goray、Mitchell与van Oorschot,2010年《Forensic Science International: Genetics》4:62–67。 争议Meakin与Jamieson,2013年《Forensic Science International: Genetics》7:434–443。 最新NIST,2024年触摸DNA与转移研究更新。 关键微量DNA结论必须纳入二次转移、背景DNA和采样位置机制

检测灵敏度的提高使几十个细胞的痕迹即可给出完整谱型,随之而来的是一个被反复证实的现象:一个人的 DNA 可以在他从未接触过的物体上被检出——通过握手、共用物品或中间媒介的二次转移。

它推翻的是「检出即接触」这一朴素推断。个体的脱落倾向差异极大,背景 DNA 普遍存在,而痕迹量的多少并不能可靠地区分直接接触与间接转移。

这一发现把灵敏度的提升变成了一把双刃剑:更强的检出能力同时意味着更多与案件无关的 DNA 进入证据,而对它们的解释需要的正是活动层框架与相应的实验数据。 把争论落到分母后可以看到短暂接触可留下可检出的DNA,未直接接触也可能经物品或他人转移,检出并不等于相关活动发生。围绕微量DNA结论必须纳入二次转移、背景DNA和采样位置机制,它把问题推进到适用条件。

未决的是取样策略。近年提出的做法是同时采集背景与对照样本,以估计在案发场景中该人 DNA 本来就会出现的概率;这类设计在原理上正确,而在现场勘查的实际流程中尚未成为常规。还有一处实践含义:现场勘查的取样决定了后续一切分析的可能性,而取样通常由训练最少的人在最早的时间完成。灵敏度提高之后,这一环的重要性远超以往,却几乎没有相应的质量控制。另一处未决是量化:现有转移实验多在实验室条件下完成,与真实场景的接触强度、时间与介质差异极大。这使得活动层评估在原理上可行,在具体案件中却常常缺少可用的参照数据。 可证伪的边界是当实施依赖高资源中心时,微量 DNA 与二次转移Trace DNA and Secondary Transfer证据越成熟,向基层迁移后的有效性反而越不稳定。跨机构比较至少要固定“完成关键结局核验者/全部进入“微量 DNA 与二次转移Trace DNA and Secondary Transfer”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,微量DNA结论必须纳入二次转移、背景DNA和采样位置机制就只是口径产物,而不是经反例保留下来的领域判断。

微量 DNA 与二次转移Trace DNA and Secondary Transfer”应依微量DNA结论必须纳入二次转移、背景DNA和采样位置机制分开专业判断、目标和资源。若微量DNA结论必须纳入二次转移、背景DNA和采样位置机制只在中心成立,推广前须结算基层容量和失败补救。 另一可复核锚点是短暂接触可留下可检出的DNA,未直接接触也可能经物品或他人转移,检出并不等于相关活动发生;这条观察必须保留原分母和时序。

另见第 158 号第 14 条“消费者搜寻与遮蔽”可检验微量DNA结论必须纳入二次转移、背景DNA和采样位置机制的外推边界。若它依赖特定机构或高资源人群,就须固定单位并单列反号。

位置S——微量 DNA 与二次转移Trace DNA and Secondary Transfer的可见结局是决定项 单因只有微量DNA结论必须纳入二次转移、背景DNA和采样位置机制 预设〔02 名称揭示本质〕制度变化不改变“微量 DNA 与二次转移Trace DNA and Secondary Transfer”对象的原有含义 量纲完成关键结局核验者/全部进入“微量 DNA 与二次转移Trace DNA and Secondary Transfer”评估者 失效当实施依赖高资源中心时,微量 DNA 与二次转移Trace DNA and Secondary Transfer证据越成熟,向基层迁移后的有效性反而越不稳定 自曝长期结局边界:“微量 DNA 与二次转移Trace DNA and Secondary Transfer”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 158 号第 14 条“消费者搜寻与遮蔽

六、法医基因谱系Forensic Genetic Genealogy

提出Erlich、Shor、Pe'er与Carmi,2018年《Science》362:690–694,DOI 10.1126/science.aau4832。 争议美国司法部,2019年《Interim Policy on Forensic Genetic Genealogical DNA Analysis and Searching》。 最新美国司法部,2024年法医遗传谱系政策更新。 关键法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权

这十年侦查手段发生了一次跃迁:把犯罪现场的 DNA 上传到消费级家谱数据库,通过远亲匹配与家谱重建缩小范围,从而侦破了大量陈年悬案。第一批公开案例出现在 2018 年前后。

它推翻的是 DNA 数据库只能命中已入库者这一限制。由于亲缘关系的覆盖面,即使本人从未入库,只要有足够多的远亲提交过样本,就可能被定位——这意味着数据库的实际覆盖人群远大于其登记人数。

随之而来的是治理问题:提交样本的人同意的是家谱服务,而不是刑事侦查;被牵连的是从未同意任何事的亲属。这十年多国出台了限制规则——限于重罪、需司法授权、限于明确选择加入的数据库——但规则的强度与执行差异极大。 这一判断不是概念推演,材料显示数据库命中可能指向未上传DNA的亲属,家谱数据库覆盖不均会让部分家系承受更高调查概率。围绕法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权,支持、异质性与未测对象必须同表。

未决的是效力与代价的比较。这一手段确实侦破了此前无解的案件,而它同时把整个人群纳入了可被检索的状态。这条线因此不是技术问题,而是社会对遗传可检索性的容忍度问题——目前尚无任何社会完成过这场讨论。另一处值得注意的是它的不可逆性:一旦某个人群的遗传数据以任何形式可被检索,就无法通过后续退出而恢复原状——亲属已经提交的数据仍然指向他。这使得同意这一概念在遗传信息上的适用性本身成为问题。 可证伪的边界是当失败者被排除在分母外时,法医基因谱系Forensic Genetic Genealogy成功率越高,总体风险反而越难被看见。跨机构比较至少要固定“完成关键结局核验者/全部进入“法医基因谱系Forensic Genetic Genealogy”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权就只是口径产物,而不是经反例保留下来的领域判断。

改进“法医基因谱系Forensic Genetic Genealogy”时,应让法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权对应版本、阈值与覆写。验收法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权不能只数采纳量,还要核查未统计风险。 另一可复核锚点是数据库命中可能指向未上传DNA的亲属,家谱数据库覆盖不均会让部分家系承受更高调查概率;这条观察必须保留原分母和时序。

跨面板看,第 183 号第 14 条“参与式规划的证据化”与法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权共享回写难题。它进入考核后会塑造行为,故须比较回写路径。

位置D——法医基因谱系Forensic Genetic Genealogy的实施序列是决定项 单因只有法医遗传谱系搜索须把亲属外溢、族群代表性与误认风险纳入授权 预设〔02 名称揭示本质〕制度变化不改变“法医基因谱系Forensic Genetic Genealogy”对象的原有含义 量纲完成关键结局核验者/全部进入“法医基因谱系Forensic Genetic Genealogy”评估者 失效当失败者被排除在分母外时,法医基因谱系Forensic Genetic Genealogy成功率越高,总体风险反而越难被看见 自曝弱势样本边界:“法医基因谱系Forensic Genetic Genealogy”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 183 号第 14 条“参与式规划的证据化

七、标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews

提出美国国家科学院,2009年法庭科学体系报告。 争议NIST,2020年《Organization of Scientific Area Committees for Forensic Science》框架。 最新OSAC,2024年标准注册表更新。 关键标准化必须把科学基础审查、方法标准和实验室实施责任分层

针对报告建议未被采纳的现实,这十年建立了替代路径:由标准组织制定各学科的技术标准与文件,并由计量机构对具体方法开展科学基础评审,系统梳理已有证据、指出空缺。

它推翻的是改革必须依靠单一联邦机构的设想,转而采用自下而上的路径:先把标准写出来,再通过实验室认证与采购要求使其具有约束力。

这条路径的成效有限但真实:部分学科的术语与报告用语被统一,某些没有依据的表述被明确禁止;而基础评审公开指出了包括复杂 DNA 混合样本在内的若干方法的证据不足。 最需要保存的经验事实是发布统一操作标准可以减少实验室差异,却不能替代方法本身是否有效的独立证据审查。围绕标准化必须把科学基础审查、方法标准和实验室实施责任分层,仍须处理基线、失访和测量误差。

未决的是约束力。标准是自愿采纳的,而实验室的主要压力来自案件积压而非科学严格性;同时标准制定过程由从业者主导,涉及自身方法的负面结论难以产生。这与研究评价改革遇到的集体行动问题结构相同。还有一处进展是术语统一:把「匹配」「一致」「确认」这类含义模糊的词从报告中清除,本身就减少了大量误读。这类低成本改动的实际效果,可能超过许多技术性改进。另一处治理难点是跨境:数据库与检索行为可能分处不同法域,而各国规则差异极大。这使得单一国家的限制规则在技术上很容易被绕开,实际约束力远低于其文本强度。 可证伪的边界是当名称更新却不改变责任链时,标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews规范越完整,实际无人承担的环节反而越多。跨机构比较至少要固定“完成关键结局核验者/全部进入“标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,标准化必须把科学基础审查、方法标准和实验室实施责任分层就只是口径产物,而不是经反例保留下来的领域判断。

标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews”进入指南后,须用标准化必须把科学基础审查、方法标准和实验室实施责任分层设置审计和对照。把标准化必须把科学基础审查、方法标准和实验室实施责任分层同旧流程及随访比较,才能区分改名和结构改变。 另一可复核锚点是发布统一操作标准可以减少实验室差异,却不能替代方法本身是否有效的独立证据审查;这条观察必须保留原分母和时序。

另见第 535 号第 10 条“模型卡:性能报告第一次按人群与用途伴随模型”给标准化必须把科学基础审查、方法标准和实验室实施责任分层提供反证。检验时须检查承载、指标回写和成功者遮蔽;任一失守都应下调结论。

位置E——标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews的制度环境是决定项 单因只有标准化必须把科学基础审查、方法标准和实验室实施责任分层 预设〔02 名称揭示本质〕制度变化不改变“标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews”对象的原有含义 量纲完成关键结局核验者/全部进入“标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews”评估者 失效当名称更新却不改变责任链时,标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews规范越完整,实际无人承担的环节反而越多 自曝版本迁移边界:“标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 535 号第 10 条“模型卡:性能报告第一次按人群与用途伴随模型

八、错误率的统计学争论Statistical Disputes over Error Rates

提出Koehler,2017年《Psychological Science in the Public Interest》18:201–250。 争议AAAS,2017年《Forensic Science Assessments: A Quality and Gap Analysis》。 最新NIST,2024年法庭测量不确定度与错误率研讨报告。 关键错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字

这十年一项关于弹壳比对的大规模研究引发了统计学界的公开争论:研究报告的准确率很高,而批评者指出其推断把「在检验中作出正确结论的比例」误读成「作出某结论时该结论为真的概率」,两者只有在先验概率为五成时才相等。

这一争论推翻的是把黑箱研究结果直接转译为法庭陈述的做法。同一组数据在不同先验假设下支持的结论强度差别巨大,而现实案件中的先验绝非五成。

它同时暴露了一个更普遍的问题:法庭科学研究的读者是法官与陪审员,而这些结论的正确表述需要条件概率的训练。研究结论的错误使用,可能比研究本身的缺陷造成更大的影响。 该项证据的硬读数是错误并非常数,难度筛选、无结论处理、参与者退出和答案反馈都会改变分子与分母。围绕错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字,该读数不能越过样本和时间窗外推。

未决的是表述规范。目前没有统一规则约束专家如何在庭上引用错误率数据,而错误的引用方式在修辞上往往更有力。这十年提出的对策是要求同时报告两类错误率与研究设计限制,采纳程度仍然有限。另一处值得记下的是它揭示的读者问题:法庭科学研究的最终使用者不是科学家,因此结论的表述形式与结论本身同等重要。这一认识在这十年才被普遍接受。另一处结构问题是资金:基础评审与标准制定依赖持续的公共投入,而这类投入在预算紧缩时最先被削减。 可证伪的边界是当资源只投向最容易达标的错误率的统计学争论Statistical Disputes over Error Rates对象时,覆盖越高,原有差距反而越可能扩大。跨机构比较至少要固定“完成关键结局核验者/全部进入“错误率的统计学争论Statistical Disputes over Error Rates”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字就只是口径产物,而不是经反例保留下来的领域判断。

实践上应为“错误率的统计学争论Statistical Disputes over Error Rates”建立前测、过程与结局账,使错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字可观察。检验错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字须预设停止和替代阈值,不能只报成功者。 另一可复核锚点是错误并非常数,难度筛选、无结论处理、参与者退出和答案反馈都会改变分子与分母;这条观察必须保留原分母和时序。

另见第 535 号第 6 条“个体公平:相似的人必须得到相似决定”提供接口:错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字必须拆成分子、分母和失效条件,并记录进入、排除与结果回写。

位置S——错误率的统计学争论Statistical Disputes over Error Rates的可见结局是决定项 单因只有错误率陈述必须给出研究设计、置信区间和错误类型而非一个通用数字 预设〔07 负项无需结算〕制度变化不改变“错误率的统计学争论Statistical Disputes over Error Rates”对象的原有含义 量纲完成关键结局核验者/全部进入“错误率的统计学争论Statistical Disputes over Error Rates”评估者 失效当资源只投向最容易达标的错误率的统计学争论Statistical Disputes over Error Rates对象时,覆盖越高,原有差距反而越可能扩大 自曝数据可得边界:“错误率的统计学争论Statistical Disputes over Error Rates”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 535 号第 6 条“个体公平:相似的人必须得到相似决定

九、结论用语的改革Reforming Conclusion Language

提出Martire等,2013年《Law and Human Behavior》37:425–434。 争议美国司法部,2018年统一证言与报告语言系列。 最新NIST,2024年法庭科学沟通与决策研究更新。 关键结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界

这十年多国修改了法庭科学的报告用语:禁止「同一认定」「排除其他一切来源」「零误差」这类表述,改用分级的支持程度用语,并要求说明所依据的数据与限制。

它推翻的是结论的确定性表述。修改的依据很直接——既然方法的效度是概率性的,用确定性语言表述就是对证据强度的错误陈述,无论专家主观上多么确信。

实证研究随即发现新问题:分级用语的理解在人群中差异很大,同一个词在不同人心中对应的概率范围相差数倍;而数字表述又容易被误读为来源为真的概率。表述改革因此变成了一个沟通研究问题。 可复核材料首先给出有限类别词如一致或不能排除常被陪审员理解为唯一来源,语言标准必须用理解实验验证。围绕结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界,换掉分母会改变政策含义。

未决的是最优形式。目前的证据倾向于同时给出语言等级与数值区间,并明确说明它是关于证据的陈述而非关于被告的陈述;但没有任何一种形式被证明能可靠避免误解。这与医学中的风险沟通面临完全相同的困难。另一处未被处理的是不对称使用:控方专家常按新规范表述,而辩方难以获得同等资源作出对应陈述。表述规范的改革若只作用于一方,可能改变的是修辞平衡而非证据质量。另一处后果是研究的可引用性:一项被广泛引用的研究若结论表述有误,纠正它所需的时间远长于它被引用的速度。 可证伪的边界是当测量进入考核后,结论用语的改革Reforming Conclusion Language指标越漂亮,未被指标捕捉的真实结局反而越可能恶化。跨机构比较至少要固定“完成关键结局核验者/全部进入“结论用语的改革Reforming Conclusion Language”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界就只是口径产物,而不是经反例保留下来的领域判断。

落地“结论用语的改革Reforming Conclusion Language”不能只改名称,应由结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界确定起点、强度和延迟后果。若不检验拒绝与失访,效果便没有分母。 另一可复核锚点是有限类别词如一致或不能排除常被陪审员理解为唯一来源,语言标准必须用理解实验验证;这条观察必须保留原分母和时序。

与第 600 号第 12 条“事故学习与近失误报告”对撞后,结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界成为责任链。只留最终输出会抹掉停止权和无人承担项。

位置D——结论用语的改革Reforming Conclusion Language的实施序列是决定项 单因只有结论用语改革要校准语言等级并禁止确定性、零误差和事实裁判越界 预设〔07 负项无需结算〕制度变化不改变“结论用语的改革Reforming Conclusion Language”对象的原有含义 量纲完成关键结局核验者/全部进入“结论用语的改革Reforming Conclusion Language”评估者 失效当测量进入考核后,结论用语的改革Reforming Conclusion Language指标越漂亮,未被指标捕捉的真实结局反而越可能恶化 自曝责任归属边界:“结论用语的改革Reforming Conclusion Language”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 600 号第 12 条“事故学习与近失误报告

十、死因鉴定的能力危机The Death Investigation Capacity Crisis

提出美国国家科学院,2009年法庭科学报告死亡调查章节。 争议National Commission on Forensic Science,2016年医学死亡调查建议。 最新CDC,2024年《Medicolegal Death Investigation Data》现代化项目。 关键死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据

这十年多国出现法医病理人员严重短缺、尸检率持续下降的情况,部分地区死因认定由缺乏医学训练的官员作出。与此同时,药物过量死亡等复杂案件的数量大幅上升。

它推翻的是把法医学的质量问题主要理解为方法学问题的看法。在死因鉴定这一环,问题首先是产能:没有足够的人做尸检,方法再可靠也无从施展。

后果被逐条记录:死因统计的系统性偏差、他杀被误记为意外的风险、以及公共卫生监测数据质量的下降——药物流行病学的许多结论正建立在这些数据上。 把争论落到分母后可以看到验尸官与法医制度在资质、资源和独立性上高度不一,超额案件量会压缩现场调查、尸检与毒理检测。围绕死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据,它把问题推进到适用条件。

未决的是人力再生产。法医病理的培养周期长、收入低于临床同行、工作条件差,而扩大招收的努力在多国收效甚微。这与教师短缺的结构完全相同:培养数量不是主要瓶颈,留任与待遇才是。还有一层公共卫生含义:死因数据是药物政策、伤害预防与流行病学研究的基础输入,其质量下降会以不易察觉的方式扭曲这些领域的全部结论。另一处补救方向是把死因认定与临床病理体系打通,以共享稀缺的病理人力;这一做法在部分地区已试行,但受制于司法与卫生两套体制的分离,推进缓慢。两套体制的预算与人事分列,是这条路径最主要的阻力。 可证伪的边界是当实施依赖高资源中心时,死因鉴定的能力危机The Death Investigation Capacity Crisis证据越成熟,向基层迁移后的有效性反而越不稳定。跨机构比较至少要固定“完成关键结局核验者/全部进入“死因鉴定的能力危机The Death Investigation Capacity Crisis”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据就只是口径产物,而不是经反例保留下来的领域判断。

死因鉴定的能力危机The Death Investigation Capacity Crisis”应依死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据分开专业判断、目标和资源。若死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据只在中心成立,推广前须结算基层容量和失败补救。 另一可复核锚点是验尸官与法医制度在资质、资源和独立性上高度不一,超额案件量会压缩现场调查、尸检与毒理检测;这条观察必须保留原分母和时序。

另见第 196 号第 15 条“数据新闻与计算新闻学:报道对象包括数据本身”可检验死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据的外推边界。若它依赖特定机构或高资源人群,就须固定单位并单列反号。

位置E——死因鉴定的能力危机The Death Investigation Capacity Crisis的制度环境是决定项 单因只有死因鉴定能力危机要求独立治理、统一资质与可比死亡调查数据 预设〔07 负项无需结算〕制度变化不改变“死因鉴定的能力危机The Death Investigation Capacity Crisis”对象的原有含义 量纲完成关键结局核验者/全部进入“死因鉴定的能力危机The Death Investigation Capacity Crisis”评估者 失效当实施依赖高资源中心时,死因鉴定的能力危机The Death Investigation Capacity Crisis证据越成熟,向基层迁移后的有效性反而越不稳定 自曝比较基线边界:“死因鉴定的能力危机The Death Investigation Capacity Crisis”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 196 号第 15 条“数据新闻与计算新闻学:报道对象包括数据本身

十一、数字取证的爆炸The Explosion of Digital Forensics

提出Casey,2011年《Digital Evidence and Computer Crime》第三版。 争议NIST,2022年《Digital Forensics and Incident Response》工具测试计划。 最新NIST,2024年《Computer Forensics Tool Testing》更新。 关键数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸

这十年绝大多数案件的证据重心从物理痕迹转向数字痕迹:手机、云端记录、位置数据、通讯内容。数字取证的工作量增长速度远超传统法庭科学,也带来了完全不同的方法学问题。

它推翻的是法庭科学以物理痕迹为中心的学科结构。数字证据的难点不在检出——数据通常完整可读——而在解释:一条位置记录说明设备在那里,不说明持有人在那里;一条消息说明账号发出,不说明谁在操作。

这一领域的效度问题因此以新形态出现:提取工具的可靠性、数据完整性的证明链、以及自动分析结果的可复现性。多数商业取证工具与概率基因分型软件面临同样的源代码不可见问题。 这一判断不是概念推演,材料显示单案设备与云端数据可达数TB,穷尽式人工检查不可行,自动筛选会决定哪些证据进入视野。围绕数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸,支持、异质性与未测对象必须同表。

未决的是规模。案件中的数据量已超出人工审阅能力,实践上依赖自动筛选,而筛选规则本身决定了什么会被发现——这使得「检索了什么、没检索什么」成为证据链上一个新的、目前几乎不被质证的环节。另一处值得记下的是保存问题:数字证据依赖第三方持有的数据,而保存期限由企业政策决定。证据可能在案件进入司法程序之前就已被合法删除——这是传统物证从未面对过的情形。另一处未决是解释的专业归属:谁有资格就设备使用者身份作出推断,目前既无资格标准也无错误率数据。 可证伪的边界是当失败者被排除在分母外时,数字取证的爆炸The Explosion of Digital Forensics成功率越高,总体风险反而越难被看见。跨机构比较至少要固定“完成关键结局核验者/全部进入“数字取证的爆炸The Explosion of Digital Forensics”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸就只是口径产物,而不是经反例保留下来的领域判断。

改进“数字取证的爆炸The Explosion of Digital Forensics”时,应让数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸对应版本、阈值与覆写。验收数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸不能只数采纳量,还要核查未统计风险。 另一可复核锚点是单案设备与云端数据可达数TB,穷尽式人工检查不可行,自动筛选会决定哪些证据进入视野;这条观察必须保留原分母和时序。

跨面板看,第 198 号第 20 条“生成式影像与劳资条款:技术第一次以合同回答”与数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸共享回写难题。它进入考核后会塑造行为,故须比较回写路径。

位置S——数字取证的爆炸The Explosion of Digital Forensics的可见结局是决定项 单因只有数字取证必须用筛选协议、来源真实性和工具验证应对数据规模爆炸 预设〔09 成功者代表总体〕制度变化不改变“数字取证的爆炸The Explosion of Digital Forensics”对象的原有含义 量纲完成关键结局核验者/全部进入“数字取证的爆炸The Explosion of Digital Forensics”评估者 失效当失败者被排除在分母外时,数字取证的爆炸The Explosion of Digital Forensics成功率越高,总体风险反而越难被看见 自曝未发表结果边界:“数字取证的爆炸The Explosion of Digital Forensics”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 198 号第 20 条“生成式影像与劳资条款:技术第一次以合同回答

十二、自动比对与算法证据Automated Comparison and Algorithmic Evidence

提出Garvie、Bedoya与Frankle,2016年《The Perpetual Line-Up》。 争议NIST,2022年《Face Recognition Vendor Test》人口差异评估。 最新NIST,2024年《AI Risk Management Framework: Generative AI Profile》法庭应用参考。 关键自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录

这十年人脸识别、自动弹道比对、自动指纹检索等系统深度介入侦查与鉴定。它们的功能定位通常是产生候选线索,而实践中候选结果常常直接影响后续的人工判断与侦查方向。

它推翻的是自动系统与人工判断相互独立这一假设。系统给出的排序本身是一种强语境信息:知道某个候选排在第一位的检验人员,其判断已不再独立——这与认知偏差研究的结论直接对接。

由此产生的具体要求是把算法输出纳入语境管理:检验人员不应知道候选的排序位置,且系统的错误率必须与人工检验的错误率分别报告。多数体系目前尚未这样做。 最需要保存的经验事实是总体准确率可能遮蔽不同质量图像与人群的失配,专有系统若不可审计会阻断被告对证据的有效质证。围绕自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录,仍须处理基线、失访和测量误差。

未决的是问责。当侦查线索由算法产生、结论由人给出时,错误的归属变得模糊;而算法的效度证据往往来自厂商而非独立测试。这与教育中的算法治理是同一类问题,只是后果直接落在人身自由上。还有一处需要盯住的是训练数据:自动比对系统在不同人群上的性能差异已被反复记录,而这些差异在司法场景中直接转化为不平等的错误分布。另一处制度空缺是使用记录:多数司法辖区并不要求披露侦查中是否使用过自动比对系统,因而这一环节在庭上根本不会出现。 可证伪的边界是当名称更新却不改变责任链时,自动比对与算法证据Automated Comparison and Algorithmic Evidence规范越完整,实际无人承担的环节反而越多。跨机构比较至少要固定“完成关键结局核验者/全部进入“自动比对与算法证据Automated Comparison and Algorithmic Evidence”评估者”的分子与分母,并把未入样本者、拒绝者、失访者、执行失败与负担未结算者单列;若这些对象继续被并入“其他”,自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录就只是口径产物,而不是经反例保留下来的领域判断。

自动比对与算法证据Automated Comparison and Algorithmic Evidence”进入指南后,须用自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录设置审计和对照。把自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录同旧流程及随访比较,才能区分改名和结构改变。 另一可复核锚点是总体准确率可能遮蔽不同质量图像与人群的失配,专有系统若不可审计会阻断被告对证据的有效质证;这条观察必须保留原分母和时序。

另见第 199 号第 13 条“流媒体经济学:按流付费改变写歌本身”给自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录提供反证。检验时须检查承载、指标回写和成功者遮蔽;任一失守都应下调结论。

位置D——自动比对与算法证据Automated Comparison and Algorithmic Evidence的实施序列是决定项 单因只有自动比对与算法证据必须公开性能分层、训练边界和人工覆写记录 预设〔09 成功者代表总体〕制度变化不改变“自动比对与算法证据Automated Comparison and Algorithmic Evidence”对象的原有含义 量纲完成关键结局核验者/全部进入“自动比对与算法证据Automated Comparison and Algorithmic Evidence”评估者 失效当名称更新却不改变责任链时,自动比对与算法证据Automated Comparison and Algorithmic Evidence规范越完整,实际无人承担的环节反而越多 自曝推广成本边界:“自动比对与算法证据Automated Comparison and Algorithmic Evidence”证据仍受样本、场景与未观察结局限制 空栏未入样本者、拒绝者、失访者、执行失败与负担未结算者 异名跨领域同构;另见第 199 号第 13 条“流媒体经济学:按流付费改变写歌本身

◎ 二十年连起来看

二十条首先重定义对象:特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption、个体化主张的退场The End of Individualisation、认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making把旧单因解释拆成互动结构。

随后,咬痕证据的崩塌The Collapse of Bitemark Evidence、似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions、DNA 混合样本解释的危机The Mixture Interpretation Crisis把强度、顺序和停止权带进证据链。

最后,微量 DNA 与二次转移Trace DNA and Secondary Transfer、法医基因谱系Forensic Genetic Genealogy、标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews说明技术、资源与规则会回写对象。

◎ 三个常见误解

第一个误解是新名称自动表示新机制。特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption与个体化主张的退场The End of Individualisation都要求给出能排除旧解释的证据。

第二个误解是指南采纳等于真实改善。火灾调查的重写Rewriting Fire Investigation与微量 DNA 与二次转移Trace DNA and Secondary Transfer提醒覆盖、执行与结局是三个不同分母。

第三个误解是数字工具天然扩大公平。死因鉴定的能力危机The Death Investigation Capacity Crisis与自动比对与算法证据Automated Comparison and Algorithmic Evidence表明接口、数据和责任配置可能制造新的遗漏。

◎ 与相邻领域的接口

与第196号新闻业研究比较指标回写。

与第535号人工智能治理比较模型卡、效度和覆写。

与第183号城市规划比较参与和成本。

◎ 争议现场

特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption与认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making的因果边界仍未封口,机制证据不能只靠相关共现。

基础效度与应用效度Foundational Validity and Validity as Applied与标准化组织与基础评审Standards Bodies and Scientific Foundation Reviews的推广证据受机构容量和选择进入影响,头部成功不能代表总体。

数字取证的爆炸The Explosion of Digital Forensics与自动比对与算法证据Automated Comparison and Algorithmic Evidence引入算法或新规则后,透明、问责和弱势对象的净收益仍需长期检验。

◎ 往下五年看什么

未来五年应为特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption建立跨机构共同最小数据集,同时保留地方差异。

应对概率基因分型的验证之争Validating Probabilistic Genotyping开展预注册、外部验证和失败案例公开,缩短证据与制度之间的回写链。

应把自动比对与算法证据Automated Comparison and Algorithmic Evidence的效率、分配与长期风险分账,避免单一指标垄断政策判断。

◎ 可与哪些领域对撞

与第196号新闻业研究对撞数据、指标与职业责任。

与第535号人工智能治理对撞模型性能、可解释性和人工停止权。

与第183号城市规划对撞可及性、地方容量和公共资源分配。

◎ 十条可做的研究命题

检验“特征比对传统的科学地位被推翻The 2009 Report and the Collapse of an Assumption”:结局、失访与两年随访。

检验“个体化主张的退场The End of Individualisation”:结局、失访与一年随访。

检验“认知偏差进入法庭科学Cognitive Bias in Forensic Decision Making”:结局、失访与两年随访。

检验“语境信息管理与线性顺序揭示Context Management and Linear Sequential Unmasking”:结局、失访与一年随访。

检验“咬痕证据的崩塌The Collapse of Bitemark Evidence”:结局、失访与两年随访。

检验“似然比与命题层级Likelihood Ratios and the Hierarchy of Propositions”:结局、失访与一年随访。

检验“DNA 混合样本解释的危机The Mixture Interpretation Crisis”:结局、失访与两年随访。

检验“黑箱研究与错误率Black-Box Studies and Error Rates”:结局、失访与一年随访。

检验“火灾调查的重写Rewriting Fire Investigation”:结局、失访与两年随访。

检验“基础效度与应用效度Foundational Validity and Validity as Applied”:结局、失访与一年随访。

◎ 资料核验

  1. 美国国家科学院,2009年《Strengthening Forensic Science in the United States: A Path Forward》。
  2. PCAST,2016年《Forensic Science in Criminal Courts: Ensuring Scientific Validity of Feature-Comparison Methods》。
  3. NIST,2024年《Forensic Science Research and Standards》项目更新。
  4. Saks与Koehler,2005年《Science》309:892–895,DOI 10.1126/science.1111565。
  5. 美国司法部,2018年《Uniform Language for Testimony and Reports》系列。
  6. NIST,2024年法庭结论表达工作组报告。
  7. Dror、Charlton与Péron,2006年《Forensic Science International》162:74–78,DOI 10.1016/j.forsciint.2006.06.058。
  8. National Commission on Forensic Science,2015年《Ensuring That Forensic Analysis Is Based Upon Task-Relevant Information》。
  9. NIST,2024年《Human Factors in Forensic Science》更新。
  10. Dror等,2015年《Journal of Forensic Sciences》60:1111–1117,线性顺序揭示。
  11. 美国法庭科学委员会,2015年任务相关信息建议。
  12. OSAC,2024年法庭科学语境管理标准工作。
  13. PCAST,2016年法庭特征比对有效性报告。
  14. NIST,2023年《Bitemark Analysis: A NIST Scientific Foundation Review》。
  15. 美国国家司法研究院,2024年咬痕证据研究更新。
  16. Evett、Jackson、Lambert与McCrossan,2000年《Science & Justice》40:233–239。
  17. ENFSI,2015年《Guideline for Evaluative Reporting in Forensic Science》。
  18. Royal Statistical Society,2024年法庭证据概率解释指引。
  19. Balding与Buckleton,2009年《Forensic Science International: Genetics》4:1–10。
  20. NIST,2021年《DNA Mixture Interpretation: A NIST Scientific Foundation Review》。
  21. SWGDAM,2024年《Interpretation Guidelines for Autosomal STR Typing》。
  22. Ulery等,2011年《PNAS》108:7733–7738,DOI 10.1073/pnas.1018707108。
  23. PCAST,2016年法庭特征比对报告。
  24. NIST,2024年法庭黑箱研究设计指南。
  25. NFPA,2011年《Guide for Fire and Explosion Investigations》921。
  26. 美国国家科学院,2009年法庭科学报告火灾调查章节。
  27. NFPA,2024年《NFPA 921》新版。
  28. Koehler,2017年《Psychological Science in the Public Interest》18:201–250。
  29. NIST,2024年科学基础审查框架。
  30. Coble与Bright,2019年《Forensic Science International: Genetics》38:14–25。
  31. NIST,2021年DNA混合物科学基础审查。
  32. OSAC,2024年概率基因分型验证标准。
  33. Cook、Evett、Jackson、Jones与Lambert,1998年《Science & Justice》38:231–239。
  34. ENFSI,2015年评价性报告指南。
  35. Taylor等,2024年《Forensic Science International: Genetics》活动层评估更新。
  36. Goray、Mitchell与van Oorschot,2010年《Forensic Science International: Genetics》4:62–67。
  37. Meakin与Jamieson,2013年《Forensic Science International: Genetics》7:434–443。
  38. NIST,2024年触摸DNA与转移研究更新。
  39. Erlich、Shor、Pe'er与Carmi,2018年《Science》362:690–694,DOI 10.1126/science.aau4832。
  40. 美国司法部,2019年《Interim Policy on Forensic Genetic Genealogical DNA Analysis and Searching》。
  41. 美国司法部,2024年法医遗传谱系政策更新。
  42. 美国国家科学院,2009年法庭科学体系报告。
  43. NIST,2020年《Organization of Scientific Area Committees for Forensic Science》框架。
  44. OSAC,2024年标准注册表更新。
  45. AAAS,2017年《Forensic Science Assessments: A Quality and Gap Analysis》。
  46. NIST,2024年法庭测量不确定度与错误率研讨报告。
  47. Martire等,2013年《Law and Human Behavior》37:425–434。
  48. 美国司法部,2018年统一证言与报告语言系列。
  49. NIST,2024年法庭科学沟通与决策研究更新。
  50. 美国国家科学院,2009年法庭科学报告死亡调查章节。
  51. National Commission on Forensic Science,2016年医学死亡调查建议。
  52. CDC,2024年《Medicolegal Death Investigation Data》现代化项目。
  53. Casey,2011年《Digital Evidence and Computer Crime》第三版。
  54. NIST,2022年《Digital Forensics and Incident Response》工具测试计划。
  55. NIST,2024年《Computer Forensics Tool Testing》更新。
  56. Garvie、Bedoya与Frankle,2016年《The Perpetual Line-Up》。
  57. NIST,2022年《Face Recognition Vendor Test》人口差异评估。
  58. NIST,2024年《AI Risk Management Framework: Generative AI Profile》法庭应用参考。
新思想前沿 · 第 290 号 · 法医学与法庭科学 · ← 返回栏目