语言习得的本质:空缺举证资格的形成
——古生物学与演化形态 × 数据库与数据系统 × 开放科学与科研诚信的三维碰撞
语言习得研究长期把“出现过什么”视为最自然的证据单位:听到了多少词、见过多少构式、接受了多少反馈、成功产出了多少次。然而语言知识还有另一半来自“没有出现什么”。一个表达在本应出现的位置长期缺席,可能使学习者降低其可接受性;统计抢占、间接负证据和采样假设研究已经证明,人类可以在一定条件下从这种缺席中学习。问题在于,零出现本身并不携带解释。它可能意味着该形式受语言系统约束,也可能只是语料太少、功能机会未出现、说话人偏好、体裁偏斜、记录系统漏检、数据迟到或发表机制选择性沉默。若学习者把所有未见都当成“不允许”,稀疏输入会制造过度收缩;若把所有未见都当成“未知”,系统又无法从正面输入中形成排异性知识。本章以本书的三源对撞工序,从领域索引池固定随机抽样80组三元候选,最终冻结第4组:古生物学与演化形态、数据库与数据系统、开放科学与科研诚信。三域分别从对象、处理路径与可见条件三个位置共同逼问:一个“空缺”什么时候才有资格成为证据。本章提出新事件类别“可判空缺事件”(Qualified Absence Event, QAE)与核心构念“空缺举证资格”(Absence Warrant, AW):只有在目标形式确有功能机会、观察通道具有足够可见覆盖、同功能竞争形式真实占位、空缺跨独立来源或语境复现时,一次未出现才被允许进入负向证据账本;当这些条件撤销时,成熟系统应撤销原负向推断。为使构念可裁决,本章提出四门资格闸O/V/C/R、2×2“资格×收缩”辨别格,以及单一主读数“空缺举证翻转率”(AWR)。公开数据反撞使用Universal Dependencies English EWT 2.18:精确词元查询发现dev语料中afraid、asleep、aware均没有总体暴露,alive仅见一个非定语实例,因此“前置定语位置为零”根本不能在该样本中直接充当语法负证据。这一不利结果迫使理论把“机会分母”写入定义,而非把零频率当作验证。论文进一步与Gold的正证据可学性问题、Reiter的开放/封闭世界、统计抢占、采样假设、显式否定、语料固化、发表偏倚及本书既有理论作硬划界,并提出实验方案、八条可证伪预测、伦理边界与2031撤回赌注。本章的系统级回答是:语言习得不只是学会从“有”中更新,也是在经验世界中形成一套关于“无”何时有资格约束未来的可撤回举证制度。
关键词:语言习得;空缺举证资格;可判空缺事件;间接负证据;统计抢占;采样假设;开放世界;可证伪性
The Essence of Language Acquisition: The Formation of Absence Warrant
This paper proposes Absence Warrant (AW) as a system-level construct in language acquisition. Learners do not only learn from observed forms; under some conditions they infer restrictions from forms that fail to occur. Yet non-occurrence is not self-interpreting. It may reflect a linguistic restriction, or merely insufficient opportunity, weak observability, register bias, source selection, delayed data, or selective reporting. Following constrained random sampling from the跨学科领域索引discipline pool and iterative hostile-neighbour screening, the paper collides paleontology and evolutionary morphology, database and data systems, and open science and research integrity. The resulting new observational unit is the Qualified Absence Event (QAE): an absence may enter the learner’s negative-evidence ledger only when four gates are jointly satisfied—functional Opportunity, Visibility, competing-form Occupancy, and cross-source Replication. Mature learning must also revoke the negative inference when the warrant conditions are withdrawn. The paper operationalizes this claim with a 2×2 diagnostic grid and a single paired measure, the Absence-Warrant Reversal rate (AWR). An adverse public-data audit of UD English EWT 2.18 shows why zero counts cannot serve as their own denominator: several classic a-adjectives are completely absent from the development sample, so zero prenominal tokens cannot establish a grammatical restriction. The theory is distinguished from statistical preemption, sampling-assumption accounts, explicit negation, closed-world reasoning, and earlier accounts of language acquisition. It is presented as a falsifiable construct, not as an established finding.
语言学习最直观的证据总是“有”。儿童听见dog,于是词形与对象逐步对齐;学习者反复见到过去式,于是时间关系与形态建立联系;对话里出现澄清、反馈和重述,于是原有表征被修订。实验也天然偏爱可见事件:一次反应、一个眼跳、一个错误、一个选择,都能落进数据表。于是研究方法容易默默接受一个前提:只有出现的事件才是学习材料,未出现只是空白。这个前提并不成立。自然语言包含大量分布限制,母语者知道许多“通常不这样说”的知识,而他们很少逐条接受显式禁止。学习者必须在正面经验中逐渐发现:某些形式即使逻辑上可造,也没有取得与另一形式相同的使用资格。
但一旦承认“未出现也能提供信息”,更危险的问题立刻出现。假设一个儿童在三十分钟游戏里从未听到某个新词的复数形式,这个零能否约束他下一次的产出?假设二语学习者只和一位教师交流,从未听见某种地区变体,他是否应据此把变体判为错误?假设某个语料库中没有找到一种构式,它究竟说明构式受语法限制,还是搜索范围没有覆盖相应体裁?如果“没见过”自动变成“不允许”,学习者的知识会被自身经历的偶然贫乏不断削窄。
反方向同样有问题。若学习者永远把缺席解释成“可能只是没碰见”,那么分布学习只能积累正向概率,却很难形成真正的排异。很多语言约束并不是靠老师说“绝对不能”,而是靠同功能竞争项反复出现、目标形式在高机会位置持续缺席而形成。因此成熟系统必须同时具备两种相反能力:在证据充分时让空缺获得约束力,在证据不足时拒绝把空缺升级为禁令。本章认为,这种“何时允许没有发生的东西进入证据账本”的能力,尚未被作为一个独立的语言习得对象充分结算。
于是,本轮问题不再是“学习者能否利用间接负证据”,因为答案已经是肯定的;也不再是“统计抢占是否存在”,因为该机制已有成熟研究。本轮真正追问的是:一次未出现事件需要满足哪些资格条件,才有权改变学习者未来的生成空间?更进一步,当这些资格条件变化时,学习者能否撤回已经形成的负向推断?只有把“授予资格”和“撤销资格”放在同一设计中,空缺才从静态频率变成一个可检验的认识论对象。
本题属于What型问题,按照本书的方法采用三维度碰撞:最终三个来源必须分别在对象是什么、差异怎样被处理、结论在什么条件场中才成立三个位置上形成互不替代的压力。为降低作者先有答案再找材料的污染,本轮先建立三个位置候选池,各20门学科,以固定种子202608111830独立抽取80组三元组合。抽样前排除本书此前成为最终来源的学科以及高度相邻替身;抽样后不以“离语言越远越好”评分,而是以位置清晰度、冲突烈度、同脊风险、本书自家占位和最近邻占位逐轮淘汰。
| 轮次 | S候选 | D候选 | E候选 | 第一轮裁决 |
|---|---|---|---|---|
| 1 | 320 天文观测技术与巡天 | 249 编程语言与编译 | 156 商业伦理与企业责任 | 淘汰 |
| 2 | 339 古生物学与演化形态 | 369 制造工艺与精密加工 | 404 官僚制与国家能力 | 保留到二筛后淘汰 |
| 3 | 286 眼科与视觉科学 | 367 半导体制造与封装工程 | 399 人口健康与健康公平 | 淘汰 |
| 4 | 339 古生物学与演化形态 | 250 数据库与数据系统 | 496 开放科学与科研诚信 | 放行:最终组合 |
| 5 | 223 病毒学 | 214 最优化理论 | 295 保险与精算 | 淘汰 |
| 6 | 223 病毒学 | 185 交通与出行科学 | 416 制度经济学与产权 | 淘汰 |
| 7 | 393 妇幼与生殖健康 | 244 运筹学与工业工程 | 207 和平与冲突研究 | 淘汰 |
| 8 | 109 病理与诊断学 | 438 项目与工程项目管理 | 494 专业伦理与职业规范 | 淘汰 |
| 9 | 218 计量学与精密测量 | 213 数值分析与科学计算 | 175 家庭与亲密关系 | 淘汰 |
| 10 | 342 土壤科学 | 302 调和分析 | 478 合成媒体与信息完整性 | 淘汰 |
| 11 | 290 法医学 | 214 最优化理论 | 156 商业伦理与企业责任 | 淘汰 |
| 12 | 497 同行评审与学术出版 | 214 最优化理论 | 404 官僚制与国家能力 | 淘汰 |
| 13 | 320 天文观测技术与巡天 | 353 信息检索与推荐系统 | 478 合成媒体与信息完整性 | 淘汰 |
| 14 | 473 数字人文 | 367 半导体制造与封装工程 | 496 开放科学与科研诚信 | 淘汰 |
| 15 | 306 生物统计学 | 250 数据库与数据系统 | 430 法律职业与司法制度 | 保留到二筛后淘汰 |
| 16 | 312 引力波与多信使天文 | 213 数值分析与科学计算 | 478 合成媒体与信息完整性 | 淘汰 |
| 17 | 391 环境卫生与暴露科学 | 237 化学工程 | 295 保险与精算 | 淘汰 |
| 18 | 339 古生物学与演化形态 | 353 信息检索与推荐系统 | 268 社会政策与干预 | 保留到二筛后淘汰 |
| 19 | 193 图书情报与知识组织 | 237 化学工程 | 181 科学技术与社会 | 淘汰 |
| 20 | 391 环境卫生与暴露科学 | 249 编程语言与编译 | 494 专业伦理与职业规范 | 淘汰 |
| 21 | 473 数字人文 | 185 交通与出行科学 | 416 制度经济学与产权 | 淘汰 |
| 22 | 342 土壤科学 | 426 争议解决与仲裁 | 268 社会政策与干预 | 淘汰 |
| 23 | 497 同行评审与学术出版 | 432 商业分析与决策科学 | 122 健康经济学 | 淘汰 |
| 24 | 218 计量学与精密测量 | 291 体育与运动科学 | 268 社会政策与干预 | 淘汰 |
第4组并不是因为编号早而胜出。它的优势是三家都处理“没有被看见的东西”,但给出互不兼容的许可条件:古生物学不允许把未发现化石直接等同于未存在;数据库理论在开放世界与封闭世界之间明确区分“查不到”和“为假”;开放科学又说明可见记录本身可能经过选择性写作、提交与发表。因此三家并不共同歌颂“空缺有意义”,恰恰共同破坏“空缺天然有意义”这一默认。
化石记录最适合摧毁“零计数=零存在”的直觉。一个类群是否进入可见记录,至少要穿过死亡、埋藏、保存、地层暴露、现代地表覆盖、野外采样、鉴定和数据库录入等一串门。2025年的Current Biology研究继续显示,末白垩纪恐龙“被检测到”的概率会受到地质露头与现代土地覆盖影响,采样不一致和数据缺失会让真实生物趋势与采样伪影难以分离。另一项2025研究表明,对化石多样化速率进行采样校正后,原本看似强烈的时间尺度效应可以显著缩小甚至消失。古生物学因此提供的不是“化石像语言输入”的比喻,而是一条硬纪律:任何关于缺失的本体判断,都必须先通过观察机会模型。
把这条纪律移入语言习得,零出现的第一问不应是“这是不是不合语法”,而应是“学习者是否真的经历了足够多该形式本可以出现的功能机会”。例如,要判断学习者是否从dative alternation中学会某个动词不能进入双宾结构,不能只数双宾结构为零;必须知道他是否遇到足够多需要表达同一转移事件的场景、是否反复听到介词结构承担该功能。没有功能机会,空缺只是在错误的分母上得到零。
数据库理论给第二刀。Reiter在1977技术报告与1978章节中系统区分开放世界和封闭世界:在开放世界中,数据库不能证明某命题,并不因此证明其否定;在封闭世界中,特定条件下“无法证明正命题”才被允许转化为否定。这个差异极其适合语言学习,因为儿童和二语学习者面对的输入既不是完整数据库,也不是纯随机无限样本。他们必须隐式判断当前经验究竟更像一个封闭清单,还是一个永远可能继续增加新项的开放世界。
现代数据系统又把问题推进到时间与来源。流式系统中的事件可以迟到;数据血缘可能不完整;查询结果为零可能来自分区未加载、过滤条件、权限、版本差异或数据源尚未到达。对应到语言经验,“我从没听过”也可能只是某个语域、某位教师、某个应用程序的局部数据库。一个成熟语言系统不能把局部查询失败自动升级为语言总体的否定。数据库视角因此把空缺的处理路径从“数频率”改成“先判定当前世界是否具有关闭资格”。
开放科学提供第三刀:即使一个事件真实发生,公开记录也未必如实显示。Franco、Malhotra与Simonovits对221项TESS社会科学实验的完整总体进行追踪,发现强结果比零结果更容易被写出和发表,选择性发生在“是否写稿、是否提交”等环节。2025年的注册研究元研究继续发现选择性缺失的迹象;同时,预注册与注册表之所以重要,正因为它们允许研究者定位那些最后没有发表的研究。这里的核心不是把学习者比作科学家,而是指出一个结构事实:观察到的语料分布可能是生成过程再乘以一个可见性/报告机制之后的结果。
语言输入同样存在社会选择。课堂教师会规避自己认为“太口语”的变体,教材编辑会标准化拼写,平台推荐会偏向高互动内容,家庭成员可能因礼貌或身份关系避免某些表达。如果学习者只看最终可见语料,不问这些形式是否被系统性过滤,就可能把“被制度性隐藏”误学为“语言上不存在”。因此,空缺举证资格必须同时包含来源与可见条件,而不能只看形式的裸频率。
| # | 古生物约束 | 数据库约束 | 开放科学约束 | 对语言习得的共同后果 |
|---|---|---|---|---|
| 1 | 保存/采样链决定可见性 | 开放世界与封闭世界需先声明 | 发表/报告选择改变可见记录 | 必须先判定经验世界是否足以关闭;开放世界中的零优先记为未知。 |
| 2 | 保存/采样链决定可见性 | 开放世界与封闭世界需先声明 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 3 | 保存/采样链决定可见性 | 开放世界与封闭世界需先声明 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 4 | 保存/采样链决定可见性 | 迟到/未加载会制造假零 | 发表/报告选择改变可见记录 | 零出现须等待可定义的观察窗口,不能把尚未到达的证据记成否定。 |
| 5 | 保存/采样链决定可见性 | 迟到/未加载会制造假零 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 6 | 保存/采样链决定可见性 | 迟到/未加载会制造假零 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 7 | 保存/采样链决定可见性 | 血缘与来源决定查询解释 | 发表/报告选择改变可见记录 | 同一零计数若来自同一上游来源,不能伪装成跨源复现。 |
| 8 | 保存/采样链决定可见性 | 血缘与来源决定查询解释 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 9 | 保存/采样链决定可见性 | 血缘与来源决定查询解释 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 10 | 检测概率随环境而变 | 开放世界与封闭世界需先声明 | 发表/报告选择改变可见记录 | 必须先判定经验世界是否足以关闭;开放世界中的零优先记为未知。 |
| 11 | 检测概率随环境而变 | 开放世界与封闭世界需先声明 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 12 | 检测概率随环境而变 | 开放世界与封闭世界需先声明 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 13 | 检测概率随环境而变 | 迟到/未加载会制造假零 | 发表/报告选择改变可见记录 | 零出现须等待可定义的观察窗口,不能把尚未到达的证据记成否定。 |
| 14 | 检测概率随环境而变 | 迟到/未加载会制造假零 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 15 | 检测概率随环境而变 | 迟到/未加载会制造假零 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 16 | 检测概率随环境而变 | 血缘与来源决定查询解释 | 发表/报告选择改变可见记录 | 同一零计数若来自同一上游来源,不能伪装成跨源复现。 |
| 17 | 检测概率随环境而变 | 血缘与来源决定查询解释 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 18 | 检测概率随环境而变 | 血缘与来源决定查询解释 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 19 | 缺口不等于真实消失 | 开放世界与封闭世界需先声明 | 发表/报告选择改变可见记录 | 必须先判定经验世界是否足以关闭;开放世界中的零优先记为未知。 |
| 20 | 缺口不等于真实消失 | 开放世界与封闭世界需先声明 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 21 | 缺口不等于真实消失 | 开放世界与封闭世界需先声明 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 22 | 缺口不等于真实消失 | 迟到/未加载会制造假零 | 发表/报告选择改变可见记录 | 零出现须等待可定义的观察窗口,不能把尚未到达的证据记成否定。 |
| 23 | 缺口不等于真实消失 | 迟到/未加载会制造假零 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 24 | 缺口不等于真实消失 | 迟到/未加载会制造假零 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
| 25 | 缺口不等于真实消失 | 血缘与来源决定查询解释 | 发表/报告选择改变可见记录 | 同一零计数若来自同一上游来源,不能伪装成跨源复现。 |
| 26 | 缺口不等于真实消失 | 血缘与来源决定查询解释 | 预注册让未发表对象仍可被找到 | 可见性提高能把“未见”从报告偏差中解耦,空缺资格才可能上升。 |
| 27 | 缺口不等于真实消失 | 血缘与来源决定查询解释 | 选择性结果缺失会扭曲总体 | 当来源存在选择性删除时,空缺的举证权必须被降级或撤销。 |
27次交叉并没有直接推出一个漂亮结论,而是反复把同一个偷换暴露出来:研究者常把“观察结果里是零”偷换成“对象世界里不存在”。三门学科分别从保存、查询和报告三个环节证明,零需要资格。只有当“本可出现—本可被看见—竞争项确实占位—空缺不是单源偶然”同时成立时,未出现才开始获得改变未来判断的权利。
| 候选 | 承重命题 | 敌意裁决 |
|---|---|---|
| 候选一:空缺学习 | 学习者能从未出现形式中学习限制。 | 被间接负证据与统计抢占直接覆盖,淘汰。 |
| 候选二:开放世界语言观 | 陌生形式默认保持可能性,不因未见而拒绝。 | 过度开放会无法学习真实限制;被数据库开放世界类比吞没,淘汰。 |
| 候选三:可靠空缺 | 只有大语料中的零才可信。 | “大”不是资格,单一偏斜大语料仍会制造假零,淘汰。 |
| 候选四:空缺阈值 | 出现机会超过阈值而目标仍为零,就形成排异。 | 接近entrenchment/preemption,只增加新阈值,不够新。 |
| 候选五:空缺举证资格 | 空缺须通过机会、可见、竞争、跨源复现四闸;条件撤销时负向推断也必须撤销。 | 保留:新增对象是“空缺是否有资格作证”的可撤回事件,而非新频率指标。 |
最危险的占位来自Hsu与Griffiths(2016)。他们已经证明成人会根据输入是strong sampling还是weak sampling改变对间接负证据的使用:当样本被理解为从目标分布中有意抽取时,缺席更有信息;当样本机制不提供这种保证时,缺席不必被当作不合语法证据。若本章只说“学习者要考虑采样方式”,没有任何新增。
第二个危险占位是Boyd与Goldberg(2011)的统计抢占。其核心并非简单零频率,而是学习者反复见到一个替代表达在相同功能位置出现,从而降低未见竞争形式的生产倾向;研究还显示学习者可以折扣伪抢占语境。2025年的成人西班牙语预注册研究进一步证明,在没有显式反馈的条件下,三天重复接触常规表达足以降低相应非常规表达的可接受度。本章不能把“竞争项占位”当成自己的发现。
因此最后剩下的独立位置必须更窄:统计抢占回答“竞争项怎样让另一形式被压低”,采样假设回答“样本生成方式怎样影响负证据推断”;空缺举证资格则把未出现本身变成一个需要审计的证据对象,并要求同一学习者在匹配条件中完成方向翻转。高资格条件下应该让零获得约束力;低资格条件下,即使表面零计数完全相同,也应保持开放或撤回先前收缩。只有这个“同零不同判”的配对结构,才是本章的最小新存在。
本章把“可判空缺事件”(Qualified Absence Event, QAE)定义为:在预注册语言功能机会中,目标形式未出现,同时四项资格闸全部通过,因此该未出现被允许作为负向证据改变后续生成或判断。四项资格闸分别是O(Opportunity,功能机会)、V(Visibility,可见覆盖)、C(Competitor,同功能竞争占位)和R(Replication,跨独立来源/语境复现)。只要任何一闸未通过,该零计数都必须编码为“未判定空缺”,而不能把0直接当负证据。
| 资格闸 | 固定定义 | 禁止性提醒 |
|---|---|---|
| O 功能机会 | 学习者确实经历了目标形式若合法便有理由出现的同功能场景。 | 只出现零次词本身,不算机会。 |
| V 可见覆盖 | 若目标形式出现,当前观察/记录通道有高概率把它暴露给学习者。 | 语料截断、字幕省略、教师过滤会降低V。 |
| C 竞争占位 | 同一功能被一个或多个替代表达实际承担,而非功能本身根本没出现。 | 只看目标缺席而无竞争项,不足以抢占。 |
| R 跨源复现 | 空缺在至少两个预先区分的独立来源、说话人群或语境层复现。 | 同一教材反复复制不算多源。 |
“空缺举证资格”(Absence Warrant, AW)不是某个形式永久拥有的属性,而是“目标形式×功能机会×观察环境×来源结构”之间的关系。相同表达在儿童家庭输入里可能AW很低,在一个封闭人工语言实验里AW很高;同一个学习者今天只有一位教师的样本,明天进入多个社群后,过去的空缺资格可能下降。把AW写成关系性而非词项属性,是为了阻止研究者把局部语料的沉默永远封印成语言事实。
本章把另一种隐藏状态称为“空缺幻证事件”(False-Warrant Absence, FWA):目标形式在低资格条件下未出现,学习者却据此主动压低或拒绝该形式。它最危险的地方是可以表现得很“规范”。一个只接受标准教材输入的学习者可能对某些地区变体、口语形式或社群表达做出高置信拒绝,在考试里甚至得到奖励;但若其拒绝仅来自狭窄输入的局部零,这不是语言知识更精确,而是观察世界被错误关闭。
| 空缺资格 | 学习者后续反应 | 状态解释 |
|---|---|---|
| 资格低 | 仍收缩/拒绝 | 空缺幻证态:把欠覆盖的零误判为限制。 |
| 资格低 | 保持开放 | 校准开放态:承认当前证据不足,不强制归零。 |
| 资格高 | 仍保持开放 | 欠约束态:面对高机会、高可见、竞争占位仍不形成排异。 |
| 资格高 | 收缩/拒绝 | 有证收缩态:空缺在充分资格下进入负向证据。 |
单看任何一个格都不能定义成熟。本章真正的成熟对象是“匹配翻转”:同一目标关系在高AW与低AW条件间切换时,学习者的负向推断随资格而切换。成熟不是永远排除,也不是永远宽容,而是让排除权跟着证据资格走。这个设计避免把谨慎的人自动评为好,也避免把规范化的人自动评为高水平。
为了不把理论藏在多个漂亮指标后面,本章只保留一个主读数:空缺举证翻转率(Absence-Warrant Reversal rate, AWR)。实验先构造成对探针:两组材料在目标形式零出现、功能内容、总暴露量与最终测试上尽量匹配,仅系统改变一项资格闸,使一组达到高AW,另一组保持低AW。若学习者在高AW组压低目标形式、在低AW组保持开放,则该配对记1;其余记0。AWR=正确资格翻转的合格配对数/全部可判定配对数。不可判项目单列,不得偷偷删除。
本章建议探索性预注册门槛AWR≥0.70,并要求至少两个不同语言现象、一个延迟测点同方向,才把个体或组水平描述为“举证校准较高”。0.70不是自然常数,也不是理论本体;它只是为了让首次实验不能在看完数据后移动球门。后续研究应报告完整连续分布与敏感性分析,而不是把70%变成新的能力等级。
我们针对统计抢占文献中的经典a-adjective思路,对dev文件进行精确lemma查询。结果是:afraid、asleep、aware在该dev样本中连总体词元都没有检出;alive只检出一个明确的非前置定语实例(keep ... projects alive)。这意味着如果研究者写下“prenominal afraid=0,因此英语限制*the afraid boy”,这个推断在该样本上连第一道O/V资格都没有通过。目标形式不是在大量同类机会中持续缺席,而是目标词本身没有进入可观察样本。
这个结果对理论并不“有利”到可以当验证。严格按本章四闸,当前dev语料能够直接编码的QAE数量为0,因为我们没有为每个目标形式预注册完整功能机会、竞争项与独立来源复现结构。换言之,真实数据没有证明AW存在;它只证明“零不能自己给自己当分母”。正是这次失败迫使本章删除初稿中的“零频率阈值”,把机会与可见覆盖写成构念的必要组成。
| lemma | dev总体检出 | 前置定语检出 | 资格裁决 |
|---|---|---|---|
| afraid | 0 | 0 | 无法判:总体暴露为0,零前置使用没有机会分母。 |
| asleep | 0 | 0 | 无法判:总体暴露为0。 |
| aware | 0 | 0 | 无法判:总体暴露为0。 |
| alive | 1 | 0 | 仍无法判:仅1次且为非定语;覆盖与竞争机会不足。 |
| 结论 | — | — | 严格QAE可直接编码数=0;这是测量缺口,不是理论支持。 |
| 最近邻 | 已经解释的核心 | 与本章的判决性分离 |
|---|---|---|
| Gold 1967 正证据可学性 | 信息呈现条件决定可识别性;正面文本学习存在形式限制。 | 不提供行为层“一个具体零何时取得负证据资格”的四闸与撤回配对。 |
| Reiter 1977/1978 开放/封闭世界 | 在封闭世界中特定的查不到可被当成否定;开放世界不行。 | 数据库是逻辑查询制度;本章把“关闭资格”转成学习者可实验的机会/可见/竞争/复现关系。 |
| 统计抢占 Boyd & Goldberg | 同功能替代表达反复出现,使未见表达被压低。 | C只是AW四闸之一;本章关键预测是同样零在低AW条件下必须停止压低。 |
| Hsu & Griffiths采样假设 | strong/weak sampling改变间接负证据使用。 | 最危险近邻;本章增加对象级四闸、跨源复现、可见性与 matched reversal,若这些无增量价值则并入该理论。 |
| Entrenchment | 高总频率却缺少某构式可压低泛化。 | 总频率不能替代功能机会、可见机制与竞争占位。 |
| 显式否定学习 | “not X”直接告诉学习者排除一个候选。 | 显式负句本身是出现的正面事件,不等于从未出现推断。 |
| 语料/分布学习 | 从频率分布估计概率。 | AW问的是零的证据资格,不是把概率估得更精确。 |
| 开放科学/发表偏差 | 解释为什么可见文献总体偏斜。 | 只提供E位限制;不直接给语言学习中的O/V/C/R行为判据。 |
| 动态系统 | 表现随时间与条件波动。 | 不对“未出现是否可作证”给特定资格规则。 |
| 社会语言变异 | 语言形式受社群、身份与语域条件化。 | 提供低AW的重要来源,但AW是证据资格,不把任何变体预设为标准/非标准。 |
第一阶段是“零不可读”。早期经验稀疏,学习者面对大量从未见过的词序、词形和搭配。如果此时每个零都被当成禁令,语言系统几乎无法扩张。婴幼儿和初学者因此必须天然保持一定开放性:出现证据能快速增加候选,缺席证据则需要更高门槛。这里的开放不是无规则,而是承认自身样本尚未封闭。
第二阶段是“机会计数”。随着同类事件重复,学习者不再只数目标形式出现了几次,而开始感知“它本来有多少次机会出现”。例如,一个动词在大量转移事件中总以介词结构出现,与一个动词只出现一次且恰好是介词结构,二者目标构式都可能是零,但负证据强度不应相同。统计抢占与entrenchment已经触及这一步;本章把它纳入O与C,而不据为原创。
第三阶段是“来源拆分”。真实语言不是单一母分布。家庭、学校、同伴、地区、职业和媒体产生不同子分布。成熟学习者逐渐发现:某形式在教师话语中不出现,并不自动意味着在同伴口语中不出现;正式写作的零不能直接取消口语许可。R闸要求空缺至少跨预先区分的来源或语境复现,正是为了让系统摆脱“一个权威来源=整个语言”的早期闭合。
第四阶段是“资格可撤回”。这是本章真正新增的发展预测。学习不是让禁令越来越多,而是让禁令的证据链越来越可审计。一个学习者在早期高覆盖课堂中合理地形成某种排异,进入新社群后若发现过去的来源结构不足,成熟表现不是维护旧规则的尊严,而是降低空缺举证资格、重新开放候选。能够撤回曾经合理的负向推断,是AW与一般统计抢占最重要的分离点。
| 现象 | 表面零 | AW重新裁决 |
|---|---|---|
| 双宾与介词与格结构 | 动词反复在相同转移语义中使用to-dative,双宾持续缺席。 | 高O/C且跨说话人复现可提高AW;若语料只来自一种教学模板,R低,不能过早封闭。 |
| a-adjective前置限制 | afraid/asleep等常见于表语而非前置定语。 | 经典统计抢占对象;本章要求总体词项暴露、合适名词修饰机会和多源复现,避免“词都没见过却拿零作证”。 |
| 冠词与零冠词 | 某体裁中名词短语系统性无冠词。 | 专业标题、笔记体或某些英语变体会改变可见分布;低R/V时不得把体裁零推广成全局语法。 |
| 礼貌与语用公式 | 学习者从未听某老师使用直接命令。 | 可能是角色/课堂制度过滤而非语言禁止;需跨关系、跨权力距离才提高AW。 |
| 语音与口音变体 | 教材中某地区音系变体长期为零。 | 教材选择机制会主动清洗变体,V对“语言总体”很低;空缺不得成为污名化证据。 |
| 词汇搭配与专业语域 | 普通语料里某专业搭配为零。 | 功能机会本身缺失时O=0;大语料也不能替代领域机会。 |
六类压力测试显示,AW不是“越保守越好”。在真正高资格的构式限制上,若学习者始终保持开放,会产生过度泛化;在社会变体、低频专业语域和单一课堂来源上,若学习者快速关闭,又会把经历贫乏升级成语言规范。因此同一个指标必须允许两种方向相反的错误:欠约束与空缺幻证。
儿童的困难主要在“世界到底有多大”。照护者输入并非随机抽样,成人会根据儿童年龄、兴趣和理解水平主动选择表达。Hsu与Griffiths的研究恰好提醒我们,学习者对采样机制的假设会影响间接负证据使用。因此儿童AW实验必须操纵“为什么这些句子被说给你听”,不能只操纵频率。若成人明确从一个封闭玩具语言中随机抽取,零可能更有资格;若成人自由聊天,弱采样条件应降低零的约束力。
二语学习者的困难更多来自来源偏斜。课堂、考试材料和母语教师常把输入高度规范化,这会提高某些标准形式的竞争占位,却同时降低非标准变体的可见性。如果研究只看课堂语料,学习者“从未听过X”并不等价于目标语社群“没有X”。因此二语成熟不应被定义为更快把课堂零写成禁令,而是能够在进入新社群时重估R与V。
多语者进一步暴露“空缺跨语言误投”。一个结构在L2中没见过,学习者可能因为L1有相似结构而保持开放,也可能因为教师强调差异而过度关闭。AW理论不预设跨语迁移是帮助还是干扰,它只要求负向推断的资格来源可追踪:是目标语高机会空缺,还是母语类比,还是教学显式规则。只有前者属于本章定义的QAE;后两者需要单列。
如果把AW引入教学,最直接的改变不是增加更多禁用清单,而是让学生比较两种表面同为零的材料。第一种材料给足同功能机会,并让竞争形式由多个说话人稳定承担;第二种材料总暴露量相同,却刻意减少功能机会或限制来源。最后问学生:两组里都没见到目标表达,你对它的判断应该一样吗?这样的任务第一次把“零的资格”显性化。
教师纠错也应区分三句话:“我没听过”“这里的人一般不这样说”“这个结构在当前规范中受限制”。三句话表面都可能导向不采用某形式,但证据责任不同。第一句只报告个人样本;第二句报告社群分布;第三句提出规范判断。把它们混在一起,教师的个人输入史会被误装成语言法则。AW要求每次强否定都能指出O/V/C/R至少哪几项支撑它。
对儿童英语尤其要防止“教材封闭世界”。一本分级读物没有出现某个表达,往往只是词汇等级、主题和篇幅选择的结果。若连续若干教材都从同一出版社模板生成,R也并没有真正增加。教学中应主动引入不同作者、说话人、体裁和任务,使学习者体验“跨源零”和“单源零”的差别。这样做不是鼓励随便说,而是让规范判断建立在更真实的语言生态上。
生成式AI把AW问题放大到前所未有的程度。模型以巨大语料训练,用户容易把“模型不熟悉某表达”理解成“语言不存在该表达”。但训练语料的来源、去重、版权过滤、语言比例和安全过滤都改变可见性;模型自身也无法向用户完整报告某形式究竟在哪些来源中没有出现。因此“大模型没见过”依然是一个来源不透明的零。
2026年关于大型语言模型是否表现出统计抢占的预印本已经出现方向相反的结果:一部分研究报告模型的竞争形式频率能够因果改变非常规构式偏好,另一部分则认为模型能表现构式强制却不能稳定把preemption推广到新项目。本章不以任何一篇预印本作为定论;这种冲突反而说明,模型的负向知识必须同时报告训练机会与测试外推,而不能把低概率直接叫“知道不能说”。
未来AI语言学习工具可以直接实现AW训练:系统不只告诉学生某句“不自然”,还展示“我为什么有资格这样判断”——来自多少独立来源、哪些同功能竞争表达、哪些语域例外、哪些数据尚未覆盖。更重要的是,当用户提供新的社群证据时,系统应能把原先的强否定降级为“在我当前证据中少见”。这不是礼貌措辞,而是把可撤回性嵌入语言知识。
任何研究“什么没有出现”的理论都天然带有规范风险。主流语料库规模大、标注好、检索方便,因此研究者可能误以为主流语料中的零比少数社群的实际使用更有权威。AW理论若被这样使用,会从认识论工具退化成数据殖民:因为某变体在标准语料里缺席,就把它标成错误。本章必须明确反向约束:当语料的来源结构不覆盖目标共同体时,V与R对该共同体都不能判1。
口音、方言、跨语实践、身份标记和新兴网络表达尤其需要这一保护。它们的低频可能来自历史压制、平台内容治理、教育标准化或标注体系不承认,而非使用者没有语法。研究者若无法证明观察通道对该社群具有覆盖,空缺没有举证资格。这样一来,AW不是“用数据证明谁说错”,而是首先要求拥有大数据的人证明自己的数据有权发言。
同样,AW不得用于给学习者贴“过度开放型”“规则感差”等固定人格标签。AWR只能描述特定语言现象、特定来源结构与特定时间点。一个人在正式书面英语上高AW收缩,在新兴社交媒体表达上保持开放,完全可能是合理状态。伦理上必须报告任务域、来源域和不可判比例,而不能把所有配对压成一个排名分数。
实验可招募180名中等水平英语学习者,预注册六组人工构式或真实低频构式,每组包含同一语义功能的A与B两个候选。训练材料分三条件:高资格组给出足够功能机会,由三类独立说话人持续使用A而B为零;低机会组总句数与A频率相同,但真正需要A/B表达目标功能的机会显著减少;单源组机会相同,却所有A实例来自同一说话人或同一教材模板。三组在表面上都得到B=0,但O/R结构不同。
即时测试不直接问“B合不合语法”,而要求学习者在新语义项目、新说话人和新语域中选择/评分A与B。延迟48小时后,再向一半材料补入新来源,形成资格撤回条件:原本高AW的零若被证明只属于某社群,学习者是否重新开放B。核心读数不是总体接受率,而是预注册匹配配对的AWR。
为排除一般记忆和保守偏好,实验同时测量A的学习正确率、词汇记忆、一般风险偏好、规则意识和总反应时,但这些都只作为控制变量。若学习者只是“越不确定越都接受”,AWR不会呈现高AW收缩/低AW开放的方向特异翻转;若只是记住A频率,低机会组和高资格组因为A频率匹配也不应显著分开。
| 条件 | 资格结构 | 表面观察 | AW预测 |
|---|---|---|---|
| 高资格 | 高O、高V、高C、高R | B=0 | 应压低B |
| 低机会 | 低O,其他尽量匹配 | B=0 | 应保持更开放 |
| 单源 | R低,其他尽量匹配 | B=0 | 应保持更开放 |
| 撤回 | 先高AW,后补入新来源反例 | 早期B=0 | 应部分恢复B资格 |
P1 增量预测:控制目标词频、竞争形式频率、熟练度和一般不确定性后,O/V/R操纵仍应改变负向判断;若归零,AW退回preemption/频率模型。
P2 同零翻转:零计数完全相同但资格不同的配对,应产生不同判断;若只看零本身即可解释全部结果,AW没有价值。
P3 撤回性:先在高AW形成负向推断,后降低R或V并提供新来源证据,应出现可重复的重新开放;若负向推断只会累积不会撤回,核心“可撤回资格”失败。
P4 跨源特异:把同一材料复制成多个表面文件但保持同一上游来源,不应像真正独立来源那样提高AW;若文件数量即可替代来源独立性,R定义失败。
P5 机会优先:总词频高但相关功能机会低时,负向推断应弱于总词频相近且功能机会高的条件;若无差异,O闸多余。
P6 可见性反转:明确告诉学习者材料经过强过滤/删节,应降低对零的负向使用,即使频率表不变;若完全不变,V闸缺乏心理现实。
P7 社群边界:标准语料零不应自动预测对未覆盖社群变体的拒绝;若高水平使用者也稳定把单一标准源外推到所有社群,本章的来源校准主张失败。
P8 主读数不可替代:若AWR在所有数据集上都可由统计抢占强度、熵、总频率或接受度单指标无损替代,则停止使用“空缺举证资格”独立理论名。
撤回赌注:到2031年12月31日,如果至少三个独立研究团队、两种语言、两类语言现象在预注册设计中都无法得到“同零不同资格→判断翻转”,或者四闸模型在控制统计抢占/采样假设后没有任何可重复增量预测,本章应撤回“语言习得系统级本质”的表述,只保留为空缺数据审计工具。反过来,只有当授予与撤销都被行为数据稳定观察到,AW才有资格从候选构念升级为成熟理论。
| 内部最近邻 | 它已经占住的轴 | 为什么本章仍可分离 |
|---|---|---|
| 生成可达域重构 | 问哪些未发生路径仍然可达。 | 对象是未来生成路网;AW问观察到的“零”是否有资格充当负证据。 |
| 证据源换手 | 问下一条证据由谁产生、证据来源如何从外部换到学习者。 | AW不问谁生产下一证据,而问非发生事件能否成为证据。 |
| 求证路由内生化 | 问不确定事件应内决、外询还是挂起。 | AW先决定一个零是否有资格进入裁决;即使路由相同,资格可不同。 |
| 修复义务边界/知差悬修 | 问已检测差异何时必须修。 | AW可以在没有任何错误或修复事件时形成,只处理空缺负证据。 |
| 语言写域 | 问一次已发生经验应写入多大更新范围。 | AW问未发生经验是否有写入资格;“写哪里”与“能不能作证”正交。 |
| 成元余备 | 问未选成元方式是否仍保有能力。 | 与空缺的证据资格无直接关系。 |
| 决前因果资格 | 问已存在知识能否在最后可逆点前进入行为因果链。 | 时间资格;AW是认识论资格,可在离线判断中测试。 |
| 反事实语言边界(语感系列) | 已明确承认统计抢占,并加入修复路径与情境重划。 | AW不建边界网络,不要求修复;把“零是否有资格作证”单独冻结,并要求高/低资格配对翻转。 |
| 语法等证体 | 区分“没有证据”和“证据显示没有差异”,寻找首判异探针。 | AW不是候选结构等证,而是非出现证据的授权条件。 |
内部自撞中最危险的是“反事实语言边界”和“语法等证体”。前者已经明确承认统计抢占不新,并要求情境变化可以重划边界;后者已经明确区分“当前没有证据”和“证据显示没有差异”。因此本章不能宣称第一次发现这些思想。它唯一能保留的独立位置,是把“非出现能否取得证据身份”冻结成四闸事件,并用同零匹配翻转把资格本身变成可失败的实验对象。若未来发现内部旧稿已经完整包含O/V/C/R与撤回配对,本章必须并回旧理论。
把AW称为“系统级本质”,不是声称所有语言学习都靠空缺发生。婴儿形成音系类别、新词映射、短时记忆痕迹时,完全可能不需要任何负向空缺推理。本章的强主张限定在这样一类问题:学习者不仅要知道哪些形式可用,还必须逐步限制过度泛化,并在开放、社会异质的输入世界中决定“未见”是否足以收缩候选。对这类生成性与规范性知识而言,如何处理空缺不是附属技巧,而决定系统会不会把有限经历错误地等同于语言本身。
它之所以触及更深层,是因为语言习得同时面临两个相反的不可解风险:经验永远有限,但语言知识必须超越经验;经验中没有出现的东西无限多,但成熟者又必须知道其中某些确实不被许可。只靠正面出现,系统容易过度泛化;只靠零频率,系统又会把世界的巨大未知全部误判为禁止。AW提供的不是第三种输入,而是一套关于负向推断责任的制度:谁有资格让未来空间缩小。
因此,本轮对“语言习得的本质是什么”的回答可以压缩成一句话:语言习得的系统级本质之一,是空缺举证资格的形成——学习者逐渐学会,不仅从出现的语言中更新,也判断没有出现的语言何时真正有权约束未来,并在观察条件改变时撤回这份权力。真正成熟的语言系统,不把所有沉默都当成禁止,也不把所有沉默都当成无意义;它让“无”在有证据资格时说话,在没有资格时保持沉默。
把空缺举证资格理解成一个一次性判决,仍然不够。语言经验持续扩张,过去合理的零会因为新来源进入而改变意义。本章因此提出“空缺资格生命周期”:未授权、暂授权、稳授权、降权、撤权五个状态。未授权指O/V/C/R尚不足,零只能记录不能推断;暂授权指资格初步齐全但来源范围狭窄,允许形成低置信收缩;稳授权指跨来源、跨时间复现,且竞争项持续占位;降权指新的观察条件暴露原样本存在过滤、体裁偏斜或机会不足;撤权则是出现足以破坏原资格链的新证据,原来的负向推断必须重新开放。这个生命周期让语言知识不再被想成一张只增不减的禁用清单。
生命周期最重要的性质是不对称。一个形式第一次出现,往往足以证明“至少在某个条件下可能”;但一个形式一百次没有出现,也未必证明“不可能”,除非这一百次都属于真正机会并且可见。正证据和空缺证据因此不是镜像。正例的存在性证明门槛低,空缺的排异性证明门槛高。这种不对称解释了为什么开放语言系统既能快速吸收新表达,又不会因为每个偶然缺席不断自我封闭。
资格的暂时性还改变了“遗忘”的解释。如果学习者过去拒绝某构式,后来进入新社群后开始接受,并不一定是原有知识退化;也可能是R或V结构改变,使旧空缺失去举证资格。传统前后测若只看接受率上升,会把这种变化记作规则松动;AW则要求进一步问:学习者是否获得了新的来源证据,是否能说明旧规则只适用于原域。只有把资格历史带入测量,才能区分无原则漂移与有证据的撤权。
这也说明为什么AWR不能只在一次实验里解释全部习得。真正的长期证据应记录资格状态随经验如何迁移:第一次高AW是否形成收缩;一周后新增来源是否造成降权;三个月后跨社群暴露是否使某些旧排异消失而另一些保持。若AW理论正确,发展曲线不必单调。某些限制会随着覆盖增加越来越稳定,另一些“课堂规则”反而会随着世界扩展而撤销。成熟不是禁令数量上升,而是资格与世界结构越来越匹配。
语言学习研究常把过度泛化作为主要失败:儿童说goed,学习者说*explain me the problem,说明候选空间太宽。但AW提醒我们,过度封闭同样是错误,而且更容易被规范化教学隐藏。一个学习者因为没见过某种合法变体而拒绝它,表面上可能更“谨慎”、错误率更低,却失去了理解新说话人、进入新社群和适应新体裁的能力。因此评价系统若只惩罚过度开放,会奖励空缺幻证。
本章把两类成本记为“漏约束成本”和“伪约束成本”。漏约束成本发生在高AW条件下仍保持不受限制,导致非常规组合持续泛化;伪约束成本发生在低AW条件下过早收缩,导致合法候选被删除。两类成本不应简单加成一个总分,因为它们的伦理后果不同。在安全关键、法律或考试规范中,漏约束可能代价更高;在跨文化交流、方言理解和创新表达中,伪约束可能更伤害功能。AWR的用途不是消灭这种价值权衡,而是先把“证据资格对不对”从“哪个错误更严重”中分离出来。
这种双成本结构还能解释一些教学悖论。高频纠错可以迅速降低漏约束,却可能让学生把教师个人偏好当作全球禁令;大量真实输入可以减少伪约束,却也可能因为噪声太高延缓真正构式限制的形成。最优教学因此不是“更多纠错”或“更多输入”的单变量最大化,而是让学生经历可比较的资格条件:什么时候高覆盖空缺值得信,什么时候新来源足以推翻旧判断。
研究设计也必须防止把“更接受”自动当成更开放、更成熟。如果低AW条件下学习者接受目标形式,可能是资格校准,也可能只是整体宽松偏差;必须同时观察高AW条件下他是否能够收缩。反之,高AW下拒绝也不自动证明学会限制,若低AW下同样拒绝,可能只是保守人格或考试策略。只有方向交叉才是AW最有信息量的形状。
R闸看似最简单,实际最容易被伪造。数字环境里十个网页可能转载同一原稿,一百条短视频可能使用同一字幕模板,多个教材可能共享同一语料库。若研究按表面文件数计算来源独立性,会把一次选择性过滤复制成“跨源复现”。因此R不是数量,而是生成链的独立程度。理想研究应记录说话人、编辑流程、语料上游、体裁与时间;至少确认空缺不是由同一个上游决策共同造成。
数据库的data lineage在这里不只是工程术语,而是AW的必要反例。一个形式在三个应用程序中都为零,如果三个应用程序都调用同一审核词库,那么三个零只有一个来源。相反,两位不同社群说话者在不同任务中独立选择同功能竞争式,其证据价值可能高于一千个自动复制句子。R闸迫使语言学习研究把“输入量”与“输入独立性”分开。
对儿童研究,这一问题尤其明显。父母、绘本和教师看似三个来源,却可能共同受学校课程、标准语意识或家庭语言政策控制。若所有成人都主动避免某种口语变体,儿童的多源零其实是一个社会过滤机制的重复。AW理论预测:当儿童进入同伴群体并首次接触被过滤变体时,过去的R应被重新估计,而不是把新证据当成“例外错误”。
对AI训练数据,来源独立性更难。大规模抓取语料存在镜像、转载、SEO复制和模型生成内容回流。一个表达在数十亿token里频率很低,不能单凭规模推断真实社会稀有;分母可能由同一分布的大量复制膨胀。未来若用模型模拟AW,必须引入文档血缘或来源聚类,否则模型可能表现出极高“统计信心”,却只是对重复数据的过度计票。
语言限制常常不是“全语言”层面的,而是嵌套在语域、构式、社群和互动位置中。某形式在学术论文标题中长期缺席,可能只说明标题体裁的压缩规则;某请求方式在师生对话中缺席,可能只说明权力关系;某音系变体在新闻播报中缺席,不能推出家庭会话也缺席。AW因此必须与条件层级绑定:资格只对它实际覆盖的域有效,任何向更大域外推都需要新的O/V/R证据。
这与“语言写域”理论看似接近,却处在不同步骤。写域问一条已经获得证据资格的经验应更新多大范围;AW问这条“没有发生的经验”在进入更新之前有没有证据资格。两者可顺序连接:先审计空缺能不能作证,再决定有资格的负证据写到哪一层。把二者混合会让AW失去独立可证伪性,因此本章有意不构建复杂的层级写入模型。
实验上可以用三层嵌套设计测试外推。训练阶段让目标形式只在正式语域中形成高AW空缺,同时在口语域保持未覆盖;测试分别进入原语域、邻近语域和远语域。若学习者在原语域收缩、在未覆盖语域保持开放,说明资格边界被正确条件化;若拒绝无差别扩散,属于空缺幻证的域外传播。这个结果不能由“总体接受度低”解释,因为关键是层级交互。
这一层级性也保护语言变化。新构式在形成初期本来就低频,旧语料中的长期零不能永久取消其未来合法性。当社群开始稳定使用新形式,V与R结构发生变化,旧空缺资格应下降。一个理论如果允许历史零永远压制创新,就无法解释语言演化;AW的撤权机制使语言系统既能形成传统限制,也能在共同体实践改变时重新开放。
O闸是AW最容易被研究者事后操纵的一项。如果一个零结果符合预期,研究者可以说“机会很多”;不符合预期,又可以说“真正机会不够”。为了避免这种不可证伪,功能机会必须在实验前定义。以dative为例,什么算一次双宾/介词结构都合理的转移事件,应由母语者预试、语义角色和信息结构共同确认,而不能看学习者最后用了哪一式再倒推机会。
同样,V闸必须有独立检查。研究者不能因为目标形式没出现就宣布可见性高。可以通过插入已知探针形式来测量观察通道:若同频率、同长度的探针也常被字幕过滤、听漏或检索不到,则目标零的V应下调。语料研究则可以用多查询方式、人工抽查与不同标注层交叉验证。可见性必须由“若出现能否被看到”的正向证据支持。
C闸也需要功能匹配,而不是任何竞争形式都算。统计抢占之所以有力量,是替代表达在目标表达本可完成的功能位置出现。若两种形式语义、信息结构或社会意义不同,竞争频率不能直接给目标空缺授予资格。实验应预注册功能等价范围,并允许“部分竞争”作为不可判或分层分析,不能为了提高AW把所有近义表达合并。
R闸最后要求真正的独立复现。首次研究可以把两位说话人、两个体裁或两个时间窗口作为最低层,但应报告为什么这些层在生成机制上足够独立。如果来源共享同一上游脚本,则R不得判1。这样一来,四闸都拥有实验外部的检查通道,AW才不是一个研究者想授予就授予的解释许可证。
第一,绝对逻辑不可能不依赖经验空缺。若某组合被语言的定义规则或形式系统直接排除,学习者可能通过显式规则、推理或结构知识拒绝它,不需要QAE。AW只研究经验性未出现如何获得负向资格,不声称所有“不可能”都来自空缺。
第二,词汇世界具有长尾。专名、专业术语、新造词和一次性表达的零频率极其常见,功能机会难以定义。对这些对象强行计算AW会让理论无限扩张。本章优先适用于存在可比较竞争结构的构式、搭配、语用选择和条件变体,而不是任何字符串的零计数。
第三,社会禁忌造成的空缺可能同时是语言知识和权力结构结果。某词在公开场合不出现,学习者确实可能需要知道这种社会限制;但研究者不能把“未公开”直接解释成“词不属于语言”。AW只能支持条件化的使用限制,不能把道德、政治或身份评价偷偷写进语法存在性。
第四,极低水平学习者可能尚不能表示目标功能,因此O即使在环境中存在,对其心理系统也未必构成真实机会。实验应确保学习者理解相关语义功能,否则环境机会与主观机会混淆。这个限制会缩小AW的适用面,却防止把“没学到功能”误写成“从空缺学会限制”。
AW最值得强调的理论不对称,是“存在证明”和“排除证明”并不需要同样的证据量。一个合法表达第一次真实出现,就足以反驳“它绝对不可能”的强命题;但一个表达在有限样本中一千次未出现,仍不能单独证明绝对不可能,因为这一千次是否构成相关机会、是否可见、是否来自独立来源仍需审计。语言系统因此天然需要一种非对称更新:正例可以快速扩大候选,空缺只能在更严格资格下缩小候选。
这种非对称性可以解释儿童语言中常见的“先敢说、后收缩”。早期过度泛化并不只是规则太宽,也可能是合理地拒绝让稀疏零频率过早关闭语言世界。随着功能机会增加、竞争表达稳定出现、来源变得多样,某些空缺才逐渐获得举证资格。换言之,发展不是从无规则走向规则,而是从“多数空缺不可读”走向“少数空缺获得可审计的负向权力”。
它也解释成人二语学习中的另一种失败:有经验的学习者可能因为考试与纠错经历形成过强的关闭倾向。遇到陌生表达时,他们不是等待证据,而是把“我没学过”直接翻译成“不正确”。这种策略在封闭题库中可能提高成绩,在真实社群中却会降低适应性。AW预测,高水平并不必然意味着更多拒绝,而应表现为拒绝与证据资格之间更强的条件耦合。
理论上,这种不对称让AW区别于简单贝叶斯“多看数据就更确定”的叙述。关键不是数据量单调增加,而是数据是否改变资格结构。一万个来自同一过滤源的零,可能仍弱于一百个跨独立来源、同功能机会清楚的零;一次明确的合法反例又可能迅速撤掉绝对禁令。因此语言知识的负向部分不是频率的镜像,而是由资格门控的非对称证据制度。
若第一阶段人工语言实验支持AWR,第二阶段必须进入自然语言,因为人工语言天然更接近封闭世界,容易高估学习者使用空缺的能力。可以选择真实构式变异,例如英语双宾结构、a-adjective、冠词选择或礼貌公式,招募处于同一熟练度的学习者,记录他们四周内来自课堂、影视、同伴和自选阅读的来源分布。研究不需要监听全部生活,而是用体验采样与小型个人语料库估计O/V/R。
随后选择同一学习者的两类目标:一类在多来源、高机会条件下持续缺席且竞争式稳定出现;另一类表面零相近,却主要来自单一来源或低机会。延迟测试使用新说话人和新材料,比较学习者是否只对前者形成稳定收缩。若自然环境中的AWR仍能预测迁移,而总暴露量、熟练度和词频不能完全替代,AW才真正跨出人工范式。
第三步应做“来源冲击”自然实验。比如学习者进入新社群、交换学校、开始接触新的英语变体或专业领域,此时过去某些空缺突然出现合法反例。研究者应观察原有负向判断是否按证据变化调整,以及调整是否局限于新域。如果学习者无论新证据多少都固守旧零,说明资格撤回没有发生;如果所有旧限制同时崩掉,则又可能是一般不稳定。真正支持AW的是选择性撤权。
最后需要跨语言复制。不同语言在形态丰富度、语序自由度、敬语系统和社会变体结构上差异很大,AW若只在英语构式上成立,就不配称系统级命题。最低要求应包括一门形态较丰富语言和一门与英语类型距离较远的语言,并重新定义功能机会,而不是照搬英语构式。如果四闸只能靠英语特定现象维持,本理论应主动收窄为英语负证据测量框架。
传统语言习得叙事几乎都从“输入了什么”开始。本章经过80组三学科随机候选、内部避重、敌意拓宽和公开数据反撞后,把观察方向反过来:系统也在不断面对没有出现的形式。古生物学告诉我们,缺失必须先通过保存与检测机会;数据库告诉我们,查不到只有在世界足够关闭时才有资格变成否定;开放科学告诉我们,可见记录可能被报告制度系统性改写。三家共同逼出的不是“absence matters”这种旧判断,而是一条更严格的责任原则:空缺必须取得举证资格。
在这一原则下,可判空缺事件QAE由O/V/C/R四闸定义,空缺幻证事件则揭示学习者怎样把低资格零错误升级成规则。AWR用同样的零计数制造高/低资格配对,要求成熟者方向翻转。真实UD数据没有验证理论,反而暴露了最关键的不利事实:经典a-adjective在一个开发集中的零前置计数,可能只是因为整个词都没出现。没有机会分母,零没有任何语法权力。
所以,本轮最终回答不是“语言习得就是统计学习”“就是负证据”“就是会排除错误形式”,而是:在需要形成生成限制的语言系统里,习得包含一项更基础的认识论成熟——让经验中的空白接受举证审计。学习者真正学会的不只是哪些句子存在,还包括什么时候一个没有出现的句子终于有资格改变他下一次会说什么。
空缺举证资格若只被记成一个新术语,本轮碰撞就失败了。它真正要求改变的是研究者与教师对零的责任分配:看到零时,第一动作不再是解释零,而是证明自己拥有解释零的资格。研究者要交代机会从哪里来、观察为何足够、竞争项怎样承担同一功能、来源为何独立;教师要区分个人没听过、特定社群少用和目标规范限制;学习者则要保留一种可撤回的认识论姿态。这样,语言习得的负向知识不再由经验贫乏自动生成,而由一条可检查、可推翻、可随世界扩展而重写的证据链生成。这个转向也是本章能够从三门远域学科中保留下来的最低创新单位。
随机种子固定为202608111830。三个20门候选池分别承担S对象、D路径、E条件场位置。以下补列第25–40组,证明第4组不是事后手选后伪装随机。完整80组可由同一候选池和种子复现。
| 轮次 | S | D | E | 裁决 |
|---|---|---|---|---|
| 25 | 334 蛋白质组学与代谢组学 | 185 交通与出行科学 | 122 健康经济学 | 淘汰 |
| 26 | 306 生物统计学 | 246 海洋与船舶工程 | 156 商业伦理与企业责任 | 淘汰 |
| 27 | 342 土壤科学 | 432 商业分析与决策科学 | 149 会计与审计 | 淘汰 |
| 28 | 312 引力波与多信使天文 | 309 时间序列与预测方法 | 399 人口健康与健康公平 | 淘汰 |
| 29 | 339 古生物学与演化形态 | 426 争议解决与仲裁 | 268 社会政策与干预 | 淘汰 |
| 30 | 473 数字人文 | 351 高性能与并行计算 | 122 健康经济学 | 淘汰 |
| 31 | 286 眼科与视觉科学 | 246 海洋与船舶工程 | 268 社会政策与干预 | 淘汰 |
| 32 | 286 眼科与视觉科学 | 369 制造工艺与精密加工 | 175 家庭与亲密关系 | 淘汰 |
| 33 | 109 病理与诊断学 | 185 交通与出行科学 | 205 风险与灾害治理 | 淘汰 |
| 34 | 227 地质与矿产 | 308 实验设计与抽样调查 | 175 家庭与亲密关系 | 淘汰 |
| 35 | 286 眼科与视觉科学 | 213 数值分析与科学计算 | 268 社会政策与干预 | 淘汰 |
| 36 | 223 病毒学 | 185 交通与出行科学 | 295 保险与精算 | 淘汰 |
| 37 | 195 博物馆学与文化遗产 | 214 最优化理论 | 209 供应链与经济安全 | 淘汰 |
| 38 | 393 妇幼与生殖健康 | 426 争议解决与仲裁 | 268 社会政策与干预 | 淘汰 |
| 39 | 473 数字人文 | 213 数值分析与科学计算 | 430 法律职业与司法制度 | 淘汰 |
| 40 | 320 天文观测技术与巡天 | 438 项目与工程项目管理 | 295 保险与精算 | 淘汰 |
人工淘汰原则:①若三家共享同一认识论脊,只是不同术语说“数据要完整”,淘汰;②若只能得到教学策略而没有新对象,淘汰;③若新结论可被本书已有“可达域、证据源、写域、修复、路由、因果资格”等轴直接吸收,淘汰;④若最近邻文献已完整给出同一判据,只换名字,淘汰;⑤随机组合即使很奇妙,只要不能给出零情态词判据与可失败实验,也淘汰。
| 字段 | 固定规则 |
|---|---|
| 研究单位 | 一个预注册目标形式/构式 × 一个明确功能机会家系 × 一个学习者。 |
| 目标空缺 | 训练窗口内目标形式出现数=0;若>0,不属于空缺事件。 |
| O | 预注册功能机会达到研究设定阈值,且母语/熟练对照确认这些机会中目标形式若合法可以合理出现。 |
| V | 观察通道足以记录目标形式;已知过滤、删节、权限缺失、语域不覆盖时记0或不可判。 |
| C | 同一功能在训练中由竞争形式实际承担;只出现语义无关材料不计。 |
| R | 至少两个预先定义的独立来源/说话人层/体裁层出现同方向空缺;复制同一上游文本不计。 |
| QAE | 目标空缺且O=V=C=R=1。任何一项0则不是QAE;未知项记不可判。 |
| 负向反应 | 预注册测试中目标形式选择率/可接受度相对基线下降到设定判据;同一研究只用一种口径。 |
| AWR配对 | 高AW与低AW条件表面零相同,仅资格闸被操纵;高AW收缩且低AW开放记1。 |
| AWR | 正确翻转配对数÷全部可判定匹配配对数。探索性高值阈值0.70。 |
| 不可判 | O/V/C/R任何一项无法确认;必须单列比例,不能并入0。 |
| 撤回检查 | 若新增来源使R/V降低或出现合法反例,测试学习者是否恢复目标候选;不允许只测单向收缩。 |
本章处理过统计抢占、间接负证据、采样假设与闭世界假设,但漏掉了两条在儿童语言与贝叶斯学习里更成熟的线。
其一,固化。 Ambridge 及其同事用分级可接受度判断做了一系列实验:一个动词出现的频率越高,把它用进它从未出现过的论元结构里,成人与儿童给出的可接受度就越低。这条效应不需要任何“资格”概念——只要一个形式反复以某种方式出现而从未以另一种方式出现,它对另一种用法的容忍度就下降。若本章只是说“长期不出现会压低可接受性”,固化已经说完,且有大量分级数据支持。
分离线是资格与频率的可分离性。固化预测容忍度随目标项自身频率单调下降;本章预测的是一种与频率无关的翻转:在总暴露量、功能内容与最终测试全部匹配的成对条件下,仅改变一项资格闸(例如是否提供了独立来源的复现,或功能机会是否被系统性遮蔽),学习者的负向推断应随之翻转。若在严格匹配的成对设计里翻转不出现,或翻转幅度完全由目标项频率预测,本章并入固化,空缺举证资格降级为频率效应的一种描述。
其二,规模原理与采样假设。 贝叶斯词义学习研究给出一个形式化结论:若假定样例是从目标概念中随机抽取的,那么在一个较窄的假设下重复看到若干一致样例,其似然会随假设的“尺寸”迅速下降,因而学习者理性地收窄推断——没有出现的东西之所以能提供信息,是因为它在一个“若为真则本应出现”的抽样结构里缺席。Xu 与 Tenenbaum 把这一原理用在词义泛化上;Perfors 等人把它推到抽象句法原则的可学性。
这条线与本章距离最短:它已经把“零之所以能说话,取决于抽样结构”写成了形式。本章不能宣称第一次发现这一点。
本章的独立空间只有一处,而且必须写硬:规模原理把抽样假设当作模型的前提,由研究者设定;本章把它当作学习者可以判断的对象,因而可以被弄错,也可以被实验操纵。也就是说,规模原理回答“若抽样是随机的,零应当意味着什么”;本章回答“学习者有没有在判断抽样是否随机,以及判断错了会怎样”。空缺幻证事件——在低资格条件下仍做出高置信排除——在规模原理里不是一种失败,只是先验设错;在本章里它是核心的坏格。判决性预测:若把抽样结构的可见性作为唯一操纵变量,学习者的负向推断应随之改变;若不改变,本章的对象不存在。
本章反复主张“零不能自己当分母”,因此必须对自己执行同一条判据。
本章的公开数据检查在一个网络文本树库的开发集上进行,结果是可编码事件为零:三个目标形容词连词元都没有出现,第四个只出现一次且不在关键位置。按本章自己的四闸,这个零没有资格支持任何结论——它既不能支持“英语确实限制这些前置用法”,也不能支持“本章的构念存在”。本章在正文里据此删掉了初稿的零频率阈值,这一步是对的;但必须同时承认,这次检查对本章构念本身的证据贡献为零。
更尖锐的一处自反:本章在敌意拓宽里声称若干近邻“没有把资格本身做成实验对象”。这个声称本身就是一次从缺席出发的推断,而它没有通过本章的四闸——本章没有为“资格实验”预注册一份完整的功能机会清单,没有列出同功能竞争项,也没有做跨独立来源的复现检索。因此本章的正确写法是:在本章检索到的范围内未见,而不是“尚无人做过”。全书凡涉及“尚无人处理”的表述,一律按此改写。
这一条自反检验同时给出本章最可能失败的方式:一个宣称“别人没有做过”的理论,最有可能死于自己没有做过的那份检索。
“语言开域环”主张一次表达在闭合当下歧义的同时改写下一轮可提问的可能域。它与本章都处理“没有被说出来的那一部分”,重叠在“可能性”上。分离线:开域环的对象是未来还能问什么,本章的对象是已经没出现的东西算不算证据。前者向前,后者向后。可分的交叉格:一名学习者可以在每次表达后大幅打开下一轮的可能域(开域读数高),却把一切局部零一律读成禁止(举证翻转率低)——这正是本章所说的空缺幻证事件在开域框架里看不见的原因。若这一格不存在,两个构念应合并。