语言学
理论语言学的近二十年转向与 1950—2006 年经典思想在同一页对读:现代层说明新证据怎样改写问题,经典层倒查旧前提由谁、用什么材料建立。四十条均保留来源、量纲、失效与异名接口;经典二十条逐一回指上文,不把年代久远误当成仍然有效。
第一幕是极简语法、类型学、使用为本与统计学习的正面交锋;争点从理论标签逐步转到可复现实验。
甲、极简方案把语言装置压缩到最少操作Minimalist syntax
2012 年,本世纪头十年,生成语法把普遍语法的内容一再收缩,最终有影响的一种表述认为:人类语言官能特有的可能只剩下递归这一项,其余归于一般认知与感知运动系统。把概念史与估计拆开,Noam Chomsky(2005)的《Three Factors in Language Design》只在样本来源与纳入路径内解释理论所需基本操作数;Ferdinand de Saussure(1916)的《Cours de linguistique générale》负责旧命名,不替代现代识别。在语料库、实验反应时、田野录音、句法标注与跨语言数据库里,Noam Chomsky(2005)留下的可复查接口是理论所需基本操作数,而不是条目标题本身。
合并、移位和接口条件约束句法派生。据此以理论所需基本操作数辨向,低资源语言的负证据对“言装置压缩到最少操作”的影响构成反事实缺口。可失败版本可以写成:理论所需基本操作数是唯一决定项。在样本来源与纳入路径中拿走理论所需基本操作数而结果仍同号,就否证《Three Factors in Language Design》的机制解释(Noam Chomsky,2005)。
极简方案把语言装置压缩到最少操作在 2006 年用理论所需基本操作数除以能够生成结构留下第 1 组可比读数。Noam Chomsky(2005)没有报告理论所需基本操作数可跨样本搬用的点估计,本页不替《Three Factors in Language Design》补造效应量。可证伪阈值预注册为R1=理论所需基本操作数除以可生成结构:R1>1.00倍才支持原方向,R1≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
把主张收窄本是理论成熟的表现,但它也把整个纲领押在了一处:如果递归被证明不是普遍的,压力会集中到那一点上。一旦选择进入分母时,覆盖越高,估计偏差反而越大。反对笔改换了识别窗:Christian Chiarcos、Ilya Khait、Émilie Pagé-(2018)的《Annotating a Low-Resource Language with LLOD Technology: Sumerian Morphology and Syntax》只在刺激和判断任务可重复的语言样本中的极简方案把语言装置压缩到样本外与Noam Chomsky(2005)形成反号;边界内的同号证据不被冒充为普遍定律。
就“极简方案把语言装置压缩到最少操作”而言,以可生成结构中可识别“极简方案把语言装置压缩到最少操作”的观察单位为外沿。近端研究把尺度推远:本条资料卡(2020)在《所列研究》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的理论所需基本操作数变成可比较对象。
与“极简方案把语言装置压缩到最少操作”相邻,语法归纳可作跨域检索词;低资源语言的负证据对“言装置压缩到最少操作”的影响到 2024 年仍无统一数据。对撞发生在相同前提下:第233号《语言技术偏差把“中性模型”改写为权力分配》结算另一生成层;《Three Factors in Language Design》仍以理论所需基本操作数对可生成结构辨向。两边若同时成立,理论所需基本操作数会迫使样本来源与纳入路径成为第三项(2005/2020)。
乙、皮拉罕语争论挑战递归的普遍地位Pirahã and recursion
2005 年前后,一份关于亚马逊某语言缺乏句法递归的田野报告引发长期争论,涉及描写是否准确、递归的定义、以及单一反例能否否证一个关于官能的主张。从原始终点看,Daniel L. Everett(2005)的《Cultural Constraints on Grammar and Cognition in Pirahã》只在制度建立时点内解释可复核递归结构例数;Leonard Bloomfield(1933)的《Language》负责旧命名,不替代现代识别。Leonard Bloomfield(1933)提出的旧对象在2005年被改造成能够复核递归结构例数除以自然语料与诱导任务;可复核递归结构例数新增了可被数据推翻的分母。
可复核递归结构例数的变化经由文化话语实践与语法能力可能在证据中混合产生。由此可反驳的说法是:可复核递归结构例数是唯一决定项。在制度建立时点中拿走可复核递归结构例数而结果仍同号,就否证《Cultural Constraints on Grammar and Cognition in Pirahã》的机制解释(Daniel L. Everett,2005)。第463号《组合分布语义》与《Cultural Constraints on Grammar and Cognition in Pirahã》的分离线是语料规模与说话者背景均已报告的研究中的皮拉罕语争论挑战递:前者解释接口,后者解释可复核递归结构例数。
2005 年前后,一份关于亚马逊某语言缺乏句法递归的田野报告引发长期争论,涉及描写是否准确、递归的定义、以及单一反例能否否证一个关于官能的主张。Daniel L. Everett(2005)没有报告可复核递归结构例数可跨样本搬用的点估计,本页不替《Cultural Constraints on Grammar and Cognition in Pirahã》补造效应量。可证伪阈值预注册为R2=可复核递归结构例数除以自然语料与诱导任务:R2>1.00倍才支持原方向,R2≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
争论持续多年且未能收敛,很大程度上因为双方对「递归」的操作定义不同——一场无法收敛的争论,通常是因为关键概念没有被操作化。反例并不在同一格里:DOMINIQUE DEVRIESE、FRANK PIESSENS(2012)的《Finally tagless observable recursion for an abstract grammar model》只在语料规模与说话者背景均已报告的研究中的皮拉罕语争论挑战递归的普样本外与Daniel L. Everett(2005)形成反号;边界内的同号证据不被冒充为普遍定律。
就“皮拉罕语争论挑战递归的普遍地位”而言,本项只承诺皮拉罕语争论挑战递归的普遍地位的同口径观察,儿童自然输入的完整分布对“论挑战递归的普遍地位”的影响不得混入分母。这项读数进入新的执行场:Carlos Gómez-Rodríguez、Morten H. Christian(2022)在《Memory limitations are hidden in grammar》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的可复核递归结构例数变成可比较对象。
与“皮拉罕语争论挑战递归的普遍地位”相邻,相邻学科称其为使用为本,但儿童自然输入的完整分布对“论挑战递归的普遍地位”的影响尚未纳入 2022 年资料。相邻面板提供反方向切片:第463号《组合分布语义》结算另一生成层;《Cultural Constraints on Grammar and Cognition in Pirahã》仍以可复核递归结构例数对自然语料与诱导任务辨向。两边若同时成立,可复核递归结构例数会迫使制度建立时点成为第三项(2005/2022)。
丙、类型学以大样本挑战绝对普遍语法Typology against universals
2009 年前后,一篇影响广泛的文章基于跨语言类型学证据主张:所谓语言普遍性几乎没有一条经得起全球样本的检验,多样性才是常态。按主证据的时序,Michael Dunn、Simon J. Greenhill、Stephen C.(2011)的《Evolved Structure of Language Shows Lineage-Specific Trends in Word-Order Universals》只在关系网络中心度内解释无例外共性数;Noam Chomsky(1957)的《Syntactic Structures》负责旧命名,不替代现代识别。
先观察历史谱系与区域接触产生分布偏好而非先天硬约束,再核对无例外共性数;遗漏判断任务的文化与教育偏差对“样本挑战绝对普遍语法”的影响会错认先后次序。这把主张压成一条硬命题:无例外共性数是唯一决定项。在关系网络中心度中拿走无例外共性数而结果仍同号,就否证《Evolved Structure of Language Shows Lineage-Specific Trends in Word-Order Universals》的机制解释(Michael Dunn、Simon J. Greenhill、Stephen C.,2011)。到2026年,Jianhui Wei、Mingchao Yang、Keshu Xiang把相同对象移入语言档案馆、实验室、语料库联盟、学校与语言社区;外部效度因而取决于可区分结构知识与加工限制的实验中的类型学以大样本。
2009 年前后,一篇影响广泛的文章基于跨语言类型学证据主张:所谓语言普遍性几乎没有一条经得起全球样本的检验,多样性才是常态。Michael Dunn、Simon J. Greenhill、Stephen C.(2011)没有报告无例外共性数可跨样本搬用的点估计,本页不替《Evolved Structure of Language Shows Lineage-Specific Trends in Word-Order Universals》补造效应量。可证伪阈值预注册为R3=无例外共性数除以跨语言样本:R3>1.00倍才支持原方向,R3≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Michael Dunn、Simon J. Greenhill、Stephen C.(2011)的贡献不是再命名,而是把无例外共性数放进跨语言样本这一可失败分母。
它把争论从个案转到了统计,也逼出了一个更精确的问题:如果没有普遍规则,那么儿童学会语言所依赖的先天成分到底是什么、有多少。两篇论文的冲突要用同终点辨认:Dietmar Zaefferer、David Poeppel(2010)的《Linguistic Universals as Human Universals — Divergent Views and Converging Evidence on Language Congruence and Diversity》只在可区分结构知识与加工限制的实验中的类型学以大样本挑战绝对普样本外与Michael Dunn、Simon J. Greenhill、Stephen C.(2011)形成反号;边界内的同号证据不被冒充为普遍定律。
就“类型学以大样本挑战绝对普遍语法”而言,无例外共性数除以跨语言样本定义比较面;判断任务的文化与教育偏差对“样本挑战绝对普遍语法”的影响会使样本失去代表性。复核对象不再停在论文样本:Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)在《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的无例外共性数变成可比较对象。
与“类型学以大样本挑战绝对普遍语法”相邻,以形式语言对接外部文献时,判断任务的文化与教育偏差对“样本挑战绝对普遍语法”的影响仍是一处未观测量(2026)。邻接条目改用另一分母:第464号《自然语音的皮层语义地图》结算另一生成层;《Evolved Structure of Language Shows Lineage-Specific Trends in Word-Order Universals》仍以无例外共性数对跨语言样本辨向。两边若同时成立,无例外共性数会迫使关系网络中心度成为第三项(2011/2026)。
丁、使用为本以频率和构式替代抽象规则优先Usage based grammar
2010 年,同期,构式语法与使用为本的习得理论成型:语言知识是从输入中抽取的构式网络,不必假设专门的句法模块。回到提出笔,Adele E. Goldberg(2006)的《Constructions at Work: The Nature of Generalization in Language》只在处理暴露强度内解释构式频率对产出与理解的解释量;Noam Chomsky(1965)的《Aspects of the Theory of Syntax》负责旧命名,不替代现代识别。
机制链写作重复实例经范畴化和类比形成结构知识。真正需要承担因果责任的是:构式频率对产出与理解的解释量是唯一决定项。在处理暴露强度中拿走构式频率对产出与理解的解释量而结果仍同号,就否证《Constructions at Work: The Nature of Generalization in Language》的机制解释(Adele E. Goldberg,2006)。
使用为本以频率和构式替代抽象规则优先在 2008 年用构式频率对产出与理解的解释量除以学习者留下第 4 组可比读数。Adele E. Goldberg(2006)没有报告构式频率对产出与理解的解释量可跨样本搬用的点估计,本页不替《Constructions at Work: The Nature of Generalization in Language》补造效应量。可证伪阈值预注册为R4=构式频率对产出与理解的解释量除以学习者:R4>1.00倍才支持原方向,R4≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
它提供了一个可与生成语法竞争的完整方案,而不只是批评,这使争论第一次有了两个可比的候选。一旦关键资源只能小规模供给,试点效应越大,推广后反而缩水。争论的分水岭落到样本边缘:Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)的《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》只在具有跨语言对照和原始材料的分析中的使用为本以频率和构式替代样本外与Adele E. Goldberg(2006)形成反号;边界内的同号证据不被冒充为普遍定律。模型表示与人类表征的因果对应对构式替代抽象规则优先的影响没有进入构式频率对产出与理解的解释量的中心读数,这正是《Constructions at Work: The Nature of Generalization in Language》最容易被过度外推的地方。
就“使用为本以频率和构式替代抽象规则优先”而言,越过学习者中可识别“使用为本以频率和构式替代抽象规则优先”的观察单位,首先变化的是使用为本以频率和构式替代抽象规则优先本身。延伸证据改换了承载机构:Isa Hendrikx、Kristel Van Goethem(2024)在《Dutch compound constructions in additional language acquisition》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的构式频率对产出与理解的解释量变成可比较对象。
与“使用为本以频率和构式替代抽象规则优先”相邻,模型表示与人类表征的因果对应对“构式替代抽象规则优先”的影响没有随加工可预测性一起进入共同口径,截至 2024 年仍然如此。两块材料只共享条件场:第465号《Dolma开放三万亿词元语料》结算另一生成层;《Constructions at Work: The Nature of Generalization in Language》仍以构式频率对产出与理解的解释量对学习者辨向。两边若同时成立,构式频率对产出与理解的解释量会迫使处理暴露强度成为第三项(2006/2024)。
戊、婴儿统计学习展示分布线索的力量Infant statistical learning
2010 年,同一时期,婴儿能从连续语流中抽取统计规律的实验被反复重复并扩展,显示一般学习机制的力量远超此前估计。沿着样本表,Richard N. Aslin、Elissa L. Newport(2012)的《Statistical Learning: From Acquiring Specific Items to Forming General Rules》只在样本进入路径内解释高低转移概率串的注视时长差;Joseph H. Greenberg(1963)的《Universals of Language》负责旧命名,不替代现代识别。
从音节转移概率帮助从连续语流分割候选词可推出高低转移概率串的注视时长差。反事实只移动一项:高低转移概率串的注视时长差是唯一决定项。在样本进入路径中拿走高低转移概率串的注视时长差而结果仍同号,就否证《Statistical Learning: From Acquiring Specific Items to Forming General Rules》的机制解释(Richard N. Aslin、Elissa L. Newport,2012)。
婴儿统计学习展示分布线索的力量在 2009 年用高低转移概率串的注视时长差除以婴儿留下第 5 组可比读数;分母取婴儿中可识别“婴儿统计学习展示分布线索的力量”的观察单位。Richard N. Aslin、Elissa L. Newport(2012)没有报告高低转移概率串的注视时长差可跨样本搬用的点估计,本页不替《Statistical Learning: From Acquiring Specific Items to Forming General Rules》补造效应量。可证伪阈值预注册为R5=高低转移概率串的注视时长差除以婴儿:R5>1.00倍才支持原方向,R5≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
这削弱了「输入太贫乏、必须先天」的论证前提,也把问题从「有没有先天成分」推到「需要多少」。一旦制度回应改变行为时,干预越强,原有比较组反而越不成立。边界条件在近端复核中显形:Freda Shi(2025)的《Learning Language Structures Through Grounding》只在刺激和判断任务可重复的语言样本中的婴儿统计学习展示分布线索样本外与Richard N. Aslin、Elissa L. Newport(2012)形成反号;边界内的同号证据不被冒充为普遍定律。《Statistical Learning: From Acquiring Specific Items to Forming General Rules》与《Learning Language Structures Through Grounding》共同承认样本进入路径会改变识别,但对高低转移概率串的注视时长差的方向给出不同承诺。
就“婴儿统计学习展示分布线索的力量”而言,外推前应暂停并直接测量低资源语言的负证据对“习展示分布线索的力量”的影响,不能借高低转移概率串的注视时长差代替。制度接口随后移动:Mari Carmen Carilla Pérez、Raúl Ruiz Cecili(2025)在《Creativity and social networks in English language learning: a systematic literature review》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的高低转移概率串的注视时长差变成可比较对象。语言档案馆采用《Creativity and social networks in English language learning: a systematic literature review》的口径时,婴儿与原样本不一致,不能直接比较点估计。
与“婴儿统计学习展示分布线索的力量”相邻,2025 年的邻域术语是语法归纳;资料缺口则落在低资源语言的负证据对“习展示分布线索的力量”的影响。跨块接口不靠同名:第495号《公众参与评估:从到场人数转向影响与包容》结算另一生成层;《Statistical Learning: From Acquiring Specific Items to Forming General Rules》仍以高低转移概率串的注视时长差对婴儿辨向。两边若同时成立,高低转移概率串的注视时长差会迫使样本进入路径成为第三项(2012/2025)。
己、濒危语言迫使描写与社区治理同步Language documentation
2016 年,同期语言记录与濒危语言保护成为学科重心之一,大量此前无描写的语言被记录。把概念史与估计拆开,Jonathan Hsy(2016)的《Language Ecologies: Ethics, Community, and Digital Affect》只在危机前资产负债表内解释完成转写注释且社区可用的小时数;Richard Montague(1974)的《Formal Philosophy》负责旧命名,不替代现代识别。
这既是伦理责任,也是方法必需:所有关于普遍性的主张,都取决于样本覆盖了多少种语言。可失败版本可以写成:完成转写注释且社区可用的小时数是唯一决定项。在危机前资产负债表中拿走完成转写注释且社区可用的小时而结果仍同号,就否证《Language Ecologies: Ethics, Community, and Digital Affect》的机制解释(Jonathan Hsy,2016)。
濒危语言迫使描写与社区治理同步在 2011 年用完成转写注释且社区能够用的小时数除以记录语料留下第 6 组可比读数;分母取记录语料中可识别“濒危语言迫使描写与社区治理同步”的观察单位。Jonathan Hsy(2016)没有报告完成转写注释且社区可用的小时数可跨样本搬用的点估计,本页不替《Language Ecologies: Ethics, Community, and Digital Affect》补造效应量。可证伪阈值预注册为R6=完成转写注释且社区可用的小时数除以记录语料:R6>1.00倍才支持原方向,R6≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
濒危语言与描写的紧迫性是这门学科的现实约束:现存语言中相当大一部分使用者不足万人且不再向儿童传承,而理论所依赖的类型学证据恰恰需要多样性。反对笔改换了识别窗:Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)的《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》只在语料规模与说话者背景均已报告的研究中的濒危语言迫使描写与社区治样本外与Jonathan Hsy(2016)形成反号;边界内的同号证据不被冒充为普遍定律。
每消失一种结构独特的语言,能用来检验普遍性主张的样本就少一个,且不可再生。近端研究把尺度推远:Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)在《Evidence Against Syntactic Encapsulation in Large Language Models》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的完成转写注释且社区可用的小时数变成可比较对象。
与“濒危语言迫使描写与社区治理同步”相邻,使用为本连接了相邻研究,儿童自然输入的完整分布对“使描写与社区治理同步”的影响却仍停在 2026 年数据库之外。对撞发生在相同前提下:第478号《跨平台协同行为检测》结算另一生成层;《Language Ecologies: Ethics, Community, and Digital Affect》仍以完成转写注释且社区可用的小时数对记录语料辨向。两边若同时成立,完成转写注释且社区可用的小时会迫使危机前资产负债表成为第三项(2016/2026)。《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》把语料规模与说话者背景均已报告的研究中的濒危语言迫使描写与社区换成对照域,完成转写注释且社区可用的小时数因此可能从同号变成零或反号。
庚、信息论把可预测性接到语言形式Uniform information density
语言形式不仅表达结构,也管理处理负荷。2011 年的研究把信息论把可预测性接到语言形式与单位词的信息量方差除以话语序列直接相连。从原始终点看,Steven T. Piantadosi、Harry Tily、Edward Gib(2011)的《Word lengths are optimized for efficient communication》只在年龄与代际内解释单位词的信息量方差;Charles J. Fillmore(1968)的《所列研究》负责旧命名,不替代现代识别。Charles J. Fillmore(1968)提出的旧对象在2011年被改造成单位词的信息量方差除以话语序列;单位词的信息量方差新增了可被数据推翻的分母。
识别从单位词的信息量方差回溯到说话者在产出限制下平滑信息密度并选择形式;判断任务的文化与教育偏差对“可预测性接到语言形式”的影响是尚未封闭的旁路。由此可反驳的说法是:单位词的信息量方差是唯一决定项。在年龄与代际中拿走单位词的信息量方差而结果仍同号,就否证《Word lengths are optimized for efficient communication》的机制解释(Steven T. Piantadosi、Harry Tily、Edward Gib,2011)。
2012 年前后的信息密度研究以词的条件概率估计惊异度,检验说话者是否避免连续出现 2 个以上极难预测成分。;分母取话语序列中可识别“信息论把可预测性接到语言形式”的观察单位。Steven T. Piantadosi、Harry Tily、Edward Gib(2011)没有报告单位词的信息量方差可跨样本搬用的点估计,本页不替《Word lengths are optimized for efficient communication》补造效应量。可证伪阈值预注册为R7=单位词的信息量方差除以话语序列:R7>1.00倍才支持原方向,R7≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2012 年前后的信息密度研究以词的条件概率估计惊异度,检验说话者是否避免连续出现 2 个以上极难预测成分。一旦分类门槛随地区变化,差距越显著,跨地可比性反而越低。反例并不在同一格里:Thomas Hikaru Clark、Clara Meister、Tiago Pi(2023)的《A Cross-Linguistic Pressure for Uniform Information Density in Word Order》只在可区分结构知识与加工限制的实验中的信息论把可预测性接到语言样本外与Steven T. Piantadosi、Harry Tily、Edward Gib(2011)形成反号;边界内的同号证据不被冒充为普遍定律。
就“信息论把可预测性接到语言形式”而言,若改用其他总体,单位词的信息量方差会被选择机制扭转。这项读数进入新的执行场:Richard Futrell(2023)在《Information-theoretic principles in incremental language production》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的单位词的信息量方差变成可比较对象。
与“信息论把可预测性接到语言形式”相邻,跨域对应为形式语言。到 2023 年,判断任务的文化与教育偏差对“可预测性接到语言形式”的影响仍缺可比较记录。相邻面板提供反方向切片:第257号《可迁移性把“样本内无偏”与“目标人群有效”分开》结算另一生成层;《Word lengths are optimized for efficient communication》仍以单位词的信息量方差对话语序列辨向。两边若同时成立,单位词的信息量方差会迫使年龄与代际成为第三项(2011/2023)。
辛、依存距离把加工约束转成跨语言读数Dependency length minimization
如果语言结构受在线加工限制,依存相关词应比随机排列更接近。2008 年的研究把依存距离把加工约束转成跨语言读数与实际依存距离相对随机语序的缩减除以句子直接相连。按主证据的时序,David Temperley(2008)的《Dependency-length minimization in natural and artificial languages∗》只在组织规模内解释实际依存距离相对随机语序的缩减;E. Mark Gold(1967)的《所列研究》负责旧命名,不替代现代识别。
若工作记忆压力偏好让相互依赖的词靠近成立,实际依存距离相对随机语序的缩减应同步改变。这把主张压成一条硬命题:实际依存距离相对随机语序的缩减是唯一决定项。在组织规模中拿走实际依存距离相对随机语序的缩而结果仍同号,就否证《Dependency-length minimization in natural and artificial languages∗》的机制解释(David Temperley,2008)。到2024年,Marie-Pauline Krielke把相同对象移入语言档案馆、实验室、语料库联盟、学校与语言社区;外部效度因而取决于具有跨语言对照和原始材料的分析中的依存距离把加工。
2015 年的跨语言树库比较用实际总距离除以随机基线,发现多数语言都表现出压缩但强度不同。;分母取句子中可识别“依存距离把加工约束转成跨语言读数”的观察单位。David Temperley(2008)没有报告实际依存距离相对随机语序的缩减可跨样本搬用的点估计,本页不替《Dependency-length minimization in natural and artificial languages∗》补造效应量。可证伪阈值预注册为R8=实际依存距离相对随机语序的缩减除以句子:R8>1.00倍才支持原方向,R8≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对David Temperley(2008)的DOI提出笔与Marie-Pauline Krielke(2024)的DOI近端笔。
2015 年的跨语言树库比较用实际总距离除以随机基线,发现多数语言都表现出压缩但强度不同。一旦高风险者主动退出观察时,平均表现越好,真实风险反而越高。两篇论文的冲突要用同终点辨认:Richard Futrell、Kyle Mahowald、Edward Gibso(2015)的《Large-scale evidence of dependency length minimization in 37 languages》只在具有跨语言对照和原始材料的分析中的依存距离把加工约束转成跨样本外与David Temperley(2008)形成反号;边界内的同号证据不被冒充为普遍定律。
就“依存距离把加工约束转成跨语言读数”而言,可比单位是句子中可识别“依存距离把加工约束转成跨语言读数”的观察单位。复核对象不再停在论文样本:Marie-Pauline Krielke(2024)在《Cross-linguistic Dependency Length Minimization in scientific language》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的实际依存距离相对随机语序的缩减变成可比较对象。
与“依存距离把加工约束转成跨语言读数”相邻,若按加工可预测性检索,可找到相邻证据;截至 2024 年仍在更新。邻接条目改用另一分母:第233号《性别包容语言把二元代词边界改写为可协商系统》结算另一生成层;《Dependency-length minimization in natural and artificial languages∗》仍以实际依存距离相对随机语序的缩减对句子辨向。两边若同时成立,实际依存距离相对随机语序的缩会迫使组织规模成为第三项(2008/2024)。
第二幕不再期待单一模型通吃:语料、加工、跨语言结构和神经模型分别承担解释,并接受人类行为对照。
一、生成与使用争论被改写为可区分预测Competing models of grammar
2026 年,生成语法的起点是刺激贫乏论证:儿童听到的语料既有限又杂乱,却在几年内掌握了远超输入的语法判断,包括从未听过的句子的合法性。回到提出笔,Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)的《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》只在信息可见度内解释两类模型在留出结构上的预测差;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
这个论证支撑了半个多世纪的研究纲领。两类模型在留出结构上的预测差不是起点,而是抽象规则与分布学习对低频新结构给出不同外推留下的读数。真正需要承担因果责任的是:两类模型在留出结构上的预测差是唯一决定项。在信息可见度中拿走两类模型在留出结构上的预测差而结果仍同号,就否证《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》的机制解释(Jianhui Wei、Mingchao Yang、Keshu Xiang,2026)。
需要说清楚的是,先天性并不等于「有一部现成的语法写在基因里」。读数:生成与使用争论被改写为可区分预测在 2017 年用两类模型在留出结构上的预测差除以实验项目留下第 9 组可比读数。Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)没有报告两类模型在留出结构上的预测差可跨样本搬用的点估计,本页不替《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》补造效应量。可证伪阈值预注册为R9=两类模型在留出结构上的预测差除以实验项目:R9>1.00倍才支持原方向,R9≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。两类模型在留出结构上的预测差除以实验项目;这项证据只承担信息可见度内的方向,不承担域外的统一量级。
近二十年生成语法的主流版本已经把先天成分压缩得相当小,争论的焦点因此转成:那个不可再压缩的最小内核究竟是什么,或者是否还需要它。争论的分水岭落到样本边缘:Liying Pan(2025)的《Research on AI tool usage and language acquisition in foreign language education》只在刺激和判断任务可重复的语言样本中的生成与使用争论被改写为可样本外与Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)形成反号;边界内的同号证据不被冒充为普遍定律。
围绕它形成的两条路线,一条假设人类具有专门的语言官能与先天约束,另一条主张一般的统计学习加社会互动即可解释。延伸证据改换了承载机构:Samirah Ujang(2024)在《Usage in Second Language Acquisition: Critical Reflections and Future Directions (Book Review)》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的两类模型在留出结构上的预测差变成可比较对象。
这十年的变化不在于哪一方获胜,而在于双方第一次共享了可比较的实验平台。截至 2024 年仍在更新。两块材料只共享条件场:第463号《多模态落地语义》结算另一生成层;《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》仍以两类模型在留出结构上的预测差对实验项目辨向。两边若同时成立,两类模型在留出结构上的预测差会迫使信息可见度成为第三项(2026/2024)。
二、深度模型学会结构但数据需求远超儿童Neural language models and syntax
2023 年,一篇题为《现代语言模型反驳乔姆斯基的进路》的文章直白地下了断言。沿着样本表,Alex Warstadt、Samuel R. Bowman(2022)的《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》只在执行者裁量内解释语法最小对准确率;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
若不用这些也能成,那么「必需」的论证就垮了。经验链以分布表示从大规模文本提取长程依存线索连接语法最小对准确率,并把儿童自然输入的完整分布对“构但数据需求远超儿童”的影响列作竞争机制。反事实只移动一项:语法最小对准确率是唯一决定项。在执行者裁量中拿走语法最小对准确率而结果仍同号,就否证《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》的机制解释(Alex Warstadt、Samuel R. Bowman,2022)。到2024年,Myung-Kwan Park、Keonwoo Koo、Jaemin Lee、Won把相同对象移入语言档案馆、实验室、语料库联盟、学校与语言社区;外部效度因而取决于语料规模与说话者背景均已报告的研究中的深度模型学。
挑战的核心是递归是否普遍:有报告称某些语言缺少嵌套从句这类结构,因而不支持递归是人类语言普遍特征的主张。Alex Warstadt、Samuel R. Bowman(2022)没有报告语法最小对准确率可跨样本搬用的点估计,本页不替《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》补造效应量。可证伪阈值预注册为R10=语法最小对准确率除以测试句对:R10>1.00倍才支持原方向,R10≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Alex Warstadt、Samuel R. Bowman(2022)的贡献不是再命名,而是把语法最小对准确率放进测试句对这一可失败分母。
反对者质疑该报告的田野资料与语言能力的判定标准。在规范快速变化阶段,历史窗口越长,当前预测反而越迟钝。边界条件在近端复核中显形:Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun (2026)的《Optimizing knowledge reasoning with combined graph neural networks and large language models》只在语料规模与说话者背景均已报告的研究中的深度模型学会结构但数据需样本外与Alex Warstadt、Samuel R. Bowman(2022)形成反号;边界内的同号证据不被冒充为普遍定律。《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》与《Optimizing knowledge reasoning with combined graph neural networks and large language models》共同承认执行者裁量会改变识别,但对语法最小对准确率的方向给出不同承诺。
这场争论之所以旷日持久,是因为它同时涉及经验事实、术语定义与田野伦理,而三者纠缠在一起。制度接口随后移动:Myung-Kwan Park、Keonwoo Koo、Jaemin Lee、Won(2024)在《Investigating Syntactic Transfer from English to Korean in Neural L2 Language Models》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的语法最小对准确率变成可比较对象。
与“深度模型学会结构但数据需求远超儿童”相邻,使用为本给出另一种命名;儿童自然输入的完整分布对“构但数据需求远超儿童”的影响则是 2024 年之后要补的观察格。跨块接口不靠同名:第464号《跨主体脑语义解码》结算另一生成层;《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》仍以语法最小对准确率对测试句对辨向。两边若同时成立,语法最小对准确率会迫使执行者裁量成为第三项(2022/2024)。
三、贫刺激论转向输入量和学习偏置的实证账Poverty of stimulus revisited
2023 年,回应立刻分成两路。一路指出概念上的混淆:语法中是否包含概率,与学习器是否使用概率,是两件事,生成语法反对的是前者。把概念史与估计拆开,Lisa Pearl、Jon Sprouse(2013)的《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》只在短窗与长窗内解释儿童输入中关键结构例数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
另一路给出更硬的数字:儿童在几年内接触的词量与模型的训练语料相差好几个数量级,而正是这个数据量上的悬殊构成了当初的谜题——模型没有解决它,只是用蛮力绕开了它。可失败版本可以写成:儿童输入中关键结构例数是唯一决定项。在短窗与长窗中拿走儿童输入中关键结构例数而结果仍同号,就否证《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》的机制解释(Lisa Pearl、Jon Sprouse,2013)。
换句话说,模型证明了「这样的语法在原则上可从数据中学出」,但没有证明「人是这样学的」。Lisa Pearl、Jon Sprouse(2013)没有报告儿童输入中关键结构例数可跨样本搬用的点估计,本页不替《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》补造效应量。可证伪阈值预注册为R11=儿童输入中关键结构例数除以百万词:R11>1.00倍才支持原方向,R11≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。儿童输入中关键结构例数除以百万词;这项证据只承担短窗与长窗内的方向,不承担域外的统一量级。
这两句话的距离,是整场争论的实质。反击一方的论证也被量化了:所谓刺激贫乏,指的是儿童接触到的语料不足以在没有先天约束的情况下推出正确规则。反对笔改换了识别窗:Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)的《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》只在可区分结构知识与加工限制的实验中的贫刺激论转向输入量和学习样本外与Lisa Pearl、Jon Sprouse(2013)形成反号;边界内的同号证据不被冒充为普遍定律。判断任务的文化与教育偏差对量和学习偏置的实证账的影响没有进入儿童输入中关键结构例数的中心读数,这正是《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》最容易被过度外推的地方。
近年的做法是把儿童实际语料统计出来,检验关键结构的出现频率是否真的低到不可学。近端研究把尺度推远:Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)在《Evidence Against Syntactic Encapsulation in Large Language Models》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的儿童输入中关键结构例数变成可比较对象。Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)若改变百万词的构成,提出笔的方向必须重新估计,不能沿用旧系数。
结论仍有争议,但争论的形式已经变了——现在双方比的是语料统计与学习模型,而不是直觉。截至 2026 年仍在更新。对撞发生在相同前提下:第465号《CulturaX多语言清洗》结算另一生成层;《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》仍以儿童输入中关键结构例数对百万词辨向。两边若同时成立,儿童输入中关键结构例数会迫使短窗与长窗成为第三项(2013/2026)。
四、争论进入预注册多实验室复制Experimental syntax replication
真正的进展是有人把它做成了实验。2024 年的一项工作提出:如果模型什么模式都能学得同样好,那它对人类语言就没有说明力。从原始终点看,ManyBabies Consortium(2020)的《Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference》只在中心与边缘节点内解释跨实验室效应一致率;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
于是构造一批被人类语言普遍排除的「不可能语言」——例如按词的序数位置而非句法结构来计数的规则——让模型去学。由此可反驳的说法是:跨实验室效应一致率是唯一决定项。在中心与边缘节点中拿走跨实验室效应一致率而结果仍同号,就否证《Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference》的机制解释(ManyBabies Consortium,2020)。
结果是模型学这些语言明显更吃力。这意味着模型并非无差别的学习器,它自身带有某种归纳偏置,而这种偏置与人类语言的分布有部分重合。ManyBabies Consortium(2020)没有报告跨实验室效应一致率可跨样本搬用的点估计,本页不替《Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference》补造效应量。可证伪阈值预注册为R12=跨实验室效应一致率除以预注册语言样本:R12>1.00倍才支持原方向,R12≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
随后又有研究者从方法论上反驳这类对照是否公允——但争论第一次有了可跑、可复现、可被反驳的判据。反例并不在同一格里:Christian Chiarcos、Ilya Khait、Émilie Pagé-(2018)的《Annotating a Low-Resource Language with LLOD Technology: Sumerian Morphology and Syntax》只在具有跨语言对照和原始材料的分析中的争论进入预注册多实验室复样本外与ManyBabies Consortium(2020)形成反号;边界内的同号证据不被冒充为普遍定律。
争论变成实验,最典型的是用受限数据训练模型:如果只给模型一个孩子在几年里能听到的语料量,它能否学会复杂的句法规则?这项读数进入新的执行场:本条资料卡(2020)在《所列研究》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的跨实验室效应一致率变成可比较对象。语言档案馆采用《所列研究》的口径时,预注册语言样本与原样本不一致,不能直接比较点估计。该处同时核对ManyBabies Consortium(2020)的DOI提出笔与本条资料卡(2020)的DOI近端笔。
目前的结果是分裂的——模型在某些结构上表现良好,在另一些依赖层级结构的判断上仍系统性出错,两派各取所需。截至 2024 年仍在更新。相邻面板提供反方向切片:第495号《纠错反弹并非常态:不要把公众写成不可说服》结算另一生成层;《Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference》仍以跨实验室效应一致率对预注册语言样本辨向。两边若同时成立,跨实验室效应一致率会迫使中心与边缘节点成为第三项(2020/2020)。对形式结构、使用频率、语义推理、加工限制、变异与语言接触分别分层后,跨实验室效应一致率若只在中心组存在,原命题就必须缩域。
五、计算模型与人类实验形成分工Model human comparison
2025 年一篇长篇综述给出了目前多数人接受的定位:语言模型不该被当作人类语言能力的理论,而该被当作研究可学性的实验对象——一台可以任意改造训练数据与架构。按主证据的时序,Richard Futrell、Ethan Wilcox、Takashi Morit(2019)的《Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State》只在首次事件与重复事件内解释模型惊异度对阅读时的解释增量;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。在语料库、实验反应时、田野录音、句法标注与跨语言数据库里,Richard Futrell、Ethan Wilcox、Takashi Morit(2019)留下的可复查接口是模型惊异度对阅读时的解释增量,而不是条目标题本身。
这一条把先天性之争改写成了一个可测量的量——要多少归纳偏置才够。先固定模型惊异度对阅读时的解释增量的定义,再检验模型提供分布预测,人类数据检验加工与表征对应。这把主张压成一条硬命题:模型惊异度对阅读时的解释增量是唯一决定项。在首次事件与重复事件中拿走模型惊异度对阅读时的解释增量而结果仍同号,就否证《Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State》的机制解释(Richard Futrell、Ethan Wilcox、Takashi Morit,2019)。
这场转向也带来了失落:许多语言学家发现,工业界的语言技术已经不再需要语言学理论。Richard Futrell、Ethan Wilcox、Takashi Morit(2019)没有报告模型惊异度对阅读时的解释增量可跨样本搬用的点估计,本页不替《Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State》补造效应量。可证伪阈值预注册为R13=模型惊异度对阅读时的解释增量除以词位:R13>1.00倍才支持原方向,R13≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
但另一面同时打开——类型学、习得、失语与手语研究里那些长期缺少对照的假设,第一次有了可以反复重训的对照体。两篇论文的冲突要用同终点辨认:Md Rabiul Islam Hridoy、Syada Miel Ahmed(2026)的《Psycholinguistic reactivity in large language models: Affective asymmetry under ideological priming》只在刺激和判断任务可重复的语言样本中的计算模型与人类实验形成分样本外与Richard Futrell、Ethan Wilcox、Takashi Morit(2019)形成反号;边界内的同号证据不被冒充为普遍定律。
描写与记录一侧则在与时间赛跑——多数语言缺乏完整语法与语料,而使用者正在快速减少。就“计算模型与人类实验形成分工”而言,模型惊异度对阅读时的解释增量提供同质窗口。复核对象不再停在论文样本:Sean Trott(2024)在《Can large language models help augment English psycholinguistic datasets?》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的模型惊异度对阅读时的解释增量变成可比较对象。
理论的野心与材料的可得性之间,出现了一个此前不存在的现实约束。截至 2024 年仍在更新。邻接条目改用另一分母:第478号《C2PA与内容来源凭证》结算另一生成层;《Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State》仍以模型惊异度对阅读时的解释增量对词位辨向。两边若同时成立,模型惊异度对阅读时的解释增量会迫使首次事件与重复事件成为第三项(2019/2024)。
六、单一普遍机制让位于分层解释Plural explanations in linguistics
2021 年,语言学最老的问题从「是不是天生的」变成了「先天结构与数据各要多少」。回到提出笔,Gabe Dupre(2021)的《Linguistics and the explanatory economy》只在正式规则与非正式实践内解释结构、加工、使用与历史模型独立解释量;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
不同层次机制对同一形式提供可组合而非互斥解释把对象推向结构、加工、使用与历史模型独立解释量。真正需要承担因果责任的是:结构、加工、使用与历史模型独立解释量是唯一决定项。在正式规则与非正式实践中拿走结构、加工、使用与历史模型独而结果仍同号,就否证《Linguistics and the explanatory economy》的机制解释(Gabe Dupre,2021)。第257号《e值把连续查看数据从违规变成可结算的证据过程》与《Linguistics and the explanatory economy》的分离线是语料规模与说话者背景均已报告的研究中的单一普遍机制让位于:前者解释接口,后者解释结构、加工、使用与历史模型独立解释量。
单一普遍机制让位于分层解释在 2021 年用结构、加工、使用与历史模型独立解释量除以现象留下第 14 组可比读数;分母取现象中可识别“单一普遍机制让位于分层解释”的观察单位。Gabe Dupre(2021)没有报告结构、加工、使用与历史模型独立解释量可跨样本搬用的点估计,本页不替《Linguistics and the explanatory economy》补造效应量。可证伪阈值预注册为R14=结构、加工、使用与历史模型独立解释量除以现象:R14>1.00倍才支持原方向,R14≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。该处同时核对Gabe Dupre(2021)的DOI提出笔与Sonja NOVOTNI、Mihailo MARKOVIC(2024)的DOI近端笔。
机器没有终结这场争论,而是第一次把它变成了可以做的实验。若关系与结果同步形成,网络相关越稳定,影响方向反而越难识别。争论的分水岭落到样本边缘:Sabrina Coninx、Pascale Willemsen、Kevin Reu(2023)的《Pain Linguistics: A Case for Pluralism》只在语料规模与说话者背景均已报告的研究中的单一普遍机制让位于分层解样本外与Gabe Dupre(2021)形成反号;边界内的同号证据不被冒充为普遍定律。
就“单一普遍机制让位于分层解释”而言,证据能辨识单一普遍机制让位于分层解释,却不能等量识别儿童自然输入的完整分布对“遍机制让位于分层解释”的影响。延伸证据改换了承载机构:Sonja NOVOTNI、Mihailo MARKOVIC(2024)在《TEXT LINGUISTICS (DIACHRONIC REVIEW)》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的结构、加工、使用与历史模型独立解释量变成可比较对象。
与“单一普遍机制让位于分层解释”相邻,外部名称使用为本可以对撞,唯独儿童自然输入的完整分布对“遍机制让位于分层解释”的影响在 2024 年仍不能复算。两块材料只共享条件场:第257号《e值把连续查看数据从违规变成可结算的证据过程》结算另一生成层;《Linguistics and the explanatory economy》仍以结构、加工、使用与历史模型独立解释量对现象辨向。两边若同时成立,结构、加工、使用与历史模型独会迫使正式规则与非正式实践成为第三项(2021/2024)。
七、大型跨语言树库暴露资料不均衡Cross linguistic treebanks
2024 年,统一依存标注让上百种语言进入同一查询,但世界约 7,000 种语言中多数仍没有足量树库。沿着样本表,Daniel Zeman、Jan Hajič、Martin Popel 等(2018)的《CoNLL 2018 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies》只在成功、失败与退出内解释具有稳定标注与足量文本的语言数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
读数具有稳定标注与足量文本的语言数需与统一标签提高比较性却受资源语言和体裁偏倚限制逐期对齐。反事实只移动一项:具有稳定标注与足量文本的语言数是唯一决定项。在成功、失败与退出中拿走具有稳定标注与足量文本的语言而结果仍同号,就否证《CoNLL 2018 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies》的机制解释(Daniel Zeman、Jan Hajič、Martin Popel 等,2018)。
统一依存标注让上百种语言进入同一查询,但世界约 7,000 种语言中多数仍没有足量树库。;分母取世界语言中可识别“大型跨语言树库暴露资料不均衡”的观察单位。Daniel Zeman、Jan Hajič、Martin Popel 等(2018)没有报告具有稳定标注与足量文本的语言数可跨样本搬用的点估计,本页不替《CoNLL 2018 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies》补造效应量。可证伪阈值预注册为R15=具有稳定标注与足量文本的语言数除以世界语言:R15>1.00倍才支持原方向,R15≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。Daniel Zeman、Jan Hajič、Martin Popel 等(2018)的贡献不是再命名,而是把具有稳定标注与足量文本的语言数放进世界语言这一可失败分母。
2020 年后的比较因此必须同时报告语言数、语系数和文本体裁。一旦法律名义与执行实践分离时,规则越统一,实际差异反而越大。边界条件在近端复核中显形:Thomas Hikaru Clark、Clara Meister、Tiago Pi(2023)的《A Cross-Linguistic Pressure for Uniform Information Density in Word Order》只在可区分结构知识与加工限制的实验中的大型跨语言树库暴露资料不样本外与Daniel Zeman、Jan Hajič、Martin Popel 等(2018)形成反号;边界内的同号证据不被冒充为普遍定律。
就“大型跨语言树库暴露资料不均衡”而言,大型跨语言树库暴露资料不均衡的适用域落在世界语言中可识别“大型跨语言树库暴露资料不均衡”的观察单位,缺口单独登记。制度接口随后移动:Himanshu Yadav、Shubham Mittal、Samar Husain(2022)在《A Reappraisal of Dependency Length Minimization as a Linguistic Universal》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的具有稳定标注与足量文本的语言数变成可比较对象。
与“大型跨语言树库暴露资料不均衡”相邻,2022 年以前的跨域别名是形式语言;未填部分是判断任务的文化与教育偏差对“言树库暴露资料不均衡”的影响。跨块接口不靠同名:第233号《算法语言治理把被删除内容改写为平台语言秩序》结算另一生成层;《CoNLL 2018 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies》仍以具有稳定标注与足量文本的语言数对世界语言辨向。两边若同时成立,具有稳定标注与足量文本的语言会迫使成功、失败与退出成为第三项(2018/2022)。
八、语音表征研究从类别转向连续动态Speech perception dynamics
2021 年,眼动和鼠标轨迹显示,语音识别不是瞬间选中一个类别。把概念史与估计拆开,Dave F. Kleinschmidt、T. Florian Jaeger(2015)的《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》只在高频与低频状态内解释声学线索权重随时间的变化;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
模型表示与人类表征的因果对应对“究从类别转向连续动态”的影响若扩大。可失败版本可以写成:声学线索权重随时间的变化是唯一决定项。在高频与低频状态中拿走声学线索权重随时间的变化而结果仍同号,就否证《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》的机制解释(Dave F. Kleinschmidt、T. Florian Jaeger,2015)。
2021 年的实验以毫秒级路径估计至少 2 个竞争词如何被逐步排除,把连续加工写回表征理论。Dave F. Kleinschmidt、T. Florian Jaeger(2015)没有报告声学线索权重随时间的变化可跨样本搬用的点估计,本页不替《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》补造效应量。可证伪阈值预注册为R16=声学线索权重随时间的变化除以语音试次:R16>1.00倍才支持原方向,R16≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。声学线索权重随时间的变化除以语音试次;这项证据只承担高频与低频状态内的方向,不承担域外的统一量级。
2021 年的实验以毫秒级路径估计至少 2 个竞争词如何被逐步排除,把连续加工写回表征理论。若成本转嫁给未观察者,表内收益越高,社会净收益反而越低。反对笔改换了识别窗:Cheryl Gilford、Martin Meyer、Balthasar Bick(2026)的《The Neural Dynamics of Hierarchical Syntactic Structures During Language Comprehension》只在具有跨语言对照和原始材料的分析中的语音表征研究从类别转向连样本外与Dave F. Kleinschmidt、T. Florian Jaeger(2015)形成反号;边界内的同号证据不被冒充为普遍定律。模型表示与人类表征的因果对应对究从类别转向连续动态的影响没有进入声学线索权重随时间的变化的中心读数,这正是《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》最容易被过度外推的地方。
就“语音表征研究从类别转向连续动态”而言,跨出当前样本时,先确认声学线索权重随时间的变化除以语音试次仍指同一件事。近端研究把尺度推远:本条资料卡(2020)在《所列研究》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的声学线索权重随时间的变化变成可比较对象。
与“语音表征研究从类别转向连续动态”相邻,沿加工可预测性可追到相邻学科,沿模型表示与人类表征的因果对应对“究从类别转向连续动态”的影响则在 2024 年资料处中断。对撞发生在相同前提下:第463号《自然语言推理成为语义基准》结算另一生成层;《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》仍以声学线索权重随时间的变化对语音试次辨向。两边若同时成立,声学线索权重随时间的变化会迫使高频与低频状态成为第三项(2015/2020)。
九、低资源语言技术要求社区同意与收益回流Language technology low resource ethics
2018 年,把濒危语言录音直接当成模型燃料,会复制提取式研究。从原始终点看,Steven Bird(2020)的《Decolonising Speech and Language Technology》只在本地与跨境链条内解释社区控制且可撤回的数据集数;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
这里的中介是数据主权、许可和本地收益决定技术扩张是否可持续,终点是社区控制且可撤回的数据集数。由此可反驳的说法是:社区控制且可撤回的数据集数是唯一决定项。在本地与跨境链条中拿走社区控制且可撤回的数据集数而结果仍同号,就否证《Decolonising Speech and Language Technology》的机制解释(Steven Bird,2020)。
2022 年后的框架要求至少记录 3 项:谁能授权、谁能撤回、模型收益如何回到社区。;分母取语言项目中可识别“低资源语言技术要求社区同意与收益回流”的观察单位。Steven Bird(2020)没有报告社区控制且可撤回的数据集数可跨样本搬用的点估计,本页不替《Decolonising Speech and Language Technology》补造效应量。可证伪阈值预注册为R17=社区控制且可撤回的数据集数除以语言项目:R17>1.00倍才支持原方向,R17≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2022 年后的框架要求至少记录 3 项:谁能授权、谁能撤回、模型收益如何回到社区。在低基线人群中,曝光越多,边际改变却越接近零。反例并不在同一格里:Paolo Valentinelli(2026)的《Low-resource language》只在刺激和判断任务可重复的语言样本中的低资源语言技术要求社区同样本外与Steven Bird(2020)形成反号;边界内的同号证据不被冒充为普遍定律。《Decolonising Speech and Language Technology》与《Low-resource language》共同承认本地与跨境链条会改变识别,但对社区控制且可撤回的数据集数的方向给出不同承诺。
就“低资源语言技术要求社区同意与收益回流”而言,最低可比条件是保留语言项目中可识别“低资源语言技术要求社区同意与收益回流”的观察单位,否则方向含混。这项读数进入新的执行场:Annie Rajan、Nehal Kalita、Ambuja Salgaonkar(2025)在《Spell Checker for Low-resource Konkani Language》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的社区控制且可撤回的数据集数变成可比较对象。语言档案馆采用《Spell Checker for Low-resource Konkani Language》的口径时,语言项目与原样本不一致,不能直接比较点估计。
与“低资源语言技术要求社区同意与收益回流”相邻,语法归纳解决名称对应,未解决低资源语言的负证据对“求社区同意与收益回流”的影响;后者到 2025 年仍是缺口。相邻面板提供反方向切片:第464号《下一词预测与脑响应对齐》结算另一生成层;《Decolonising Speech and Language Technology》仍以社区控制且可撤回的数据集数对语言项目辨向。两边若同时成立,社区控制且可撤回的数据集数会迫使本地与跨境链条成为第三项(2020/2025)。
十、多模态学习重新引入情境与指称Multimodal language learning
纯文本模型见到词与词,却看不到词指向什么。2026 年的研究把多模态学习重新引入情境与指称与加入视觉情境后的指称理解增量除以测试项目直接相连。按主证据的时序,Ziheng Xia、Chao Li、Ding Ding、Ye Wang 等(2026)的《Multimodal Large Language Model for Virtual Object Grounding》只在公开承诺与实际行动内解释加入视觉情境后的指称理解增量;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。
加入视觉情境后的指称理解增量仅在视觉、动作与话语共同约束词义和事件结构可追踪时有机制含义。这把主张压成一条硬命题:加入视觉情境后的指称理解增量是唯一决定项。在公开承诺与实际行动中拿走加入视觉情境后的指称理解增量而结果仍同号,就否证《Multimodal Large Language Model for Virtual Object Grounding》的机制解释(Ziheng Xia、Chao Li、Ding Ding、Ye Wang 等,2026)。
2022 年后多模态实验把图像、动作和对话至少 3 类线索与文本并表,检验情境是否减少表面共现捷径。Ziheng Xia、Chao Li、Ding Ding、Ye Wang 等(2026)没有报告加入视觉情境后的指称理解增量可跨样本搬用的点估计,本页不替《Multimodal Large Language Model for Virtual Object Grounding》补造效应量。可证伪阈值预注册为R18=加入视觉情境后的指称理解增量除以测试项目:R18>1.00倍才支持原方向,R18≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2022 年后多模态实验把图像、动作和对话至少 3 类线索与文本并表,检验情境是否减少表面共现捷径。两篇论文的冲突要用同终点辨认:Jianlong Wu、Wei Liu、Ye Liu、Meng Liu 等(2026)的《A Survey on Video Temporal Grounding With Multimodal Large Language Model》只在语料规模与说话者背景均已报告的研究中的多模态学习重新引入情境与样本外与Ziheng Xia、Chao Li、Ding Ding、Ye Wang 等(2026)形成反号;边界内的同号证据不被冒充为普遍定律。
就“多模态学习重新引入情境与指称”而言,这条经验限于多模态学习重新引入情境与指称,没有覆盖儿童自然输入的完整分布对“习重新引入情境与指称”的影响的路径。复核对象不再停在论文样本:Freda Shi(2025)在《Learning Language Structures Through Grounding》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的加入视觉情境后的指称理解增量变成可比较对象。
与“多模态学习重新引入情境与指称”相邻,截至 2025 年,儿童自然输入的完整分布对“习重新引入情境与指称”的影响没有统一口径,尽管邻域已称作使用为本。邻接条目改用另一分母:第465号《DataComp-LM的数据中心基准》结算另一生成层;《Multimodal Large Language Model for Virtual Object Grounding》仍以加入视觉情境后的指称理解增量对测试项目辨向。两边若同时成立,加入视觉情境后的指称理解增量会迫使公开承诺与实际行动成为第三项(2026/2025)。《A Survey on Video Temporal Grounding With Multimodal Large Language Model》把语料规模与说话者背景均已报告的研究中的多模态学习重新引入情境换成对照域,加入视觉情境后的指称理解增量因此可能从同号变成零或反号。
十一、大语言模型的流畅性不等于人类式语法Large language models and grammar
2026 年,大模型在许多语法测试上接近人类,却也会被词频和提示格式显著翻转。回到提出笔,Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)的《Evidence Against Syntactic Encapsulation in Large Language Models》只在平均组与分布尾部内解释模型与人类判断相关;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。本条资料卡(1980)提出的旧对象在2026年被改造成模型与人类判断相关除以最小句对;模型与人类判断相关新增了可被数据推翻的分母。
把海量预测训练可复现模式但未证明同一表征机制和模型与人类判断相关分别编码。真正需要承担因果责任的是:模型与人类判断相关是唯一决定项。在平均组与分布尾部中拿走模型与人类判断相关而结果仍同号,就否证《Evidence Against Syntactic Encapsulation in Large Language Models》的机制解释(Thomas A. McGee、Yiyang Zhang、Idan A. Blank,2026)。
2023 年后的评估至少比较准确率、置信度和干预稳定性,避免把 1 个排行榜分数当成理论证明。;分母取最小句对中可识别“大语言模型的流畅性不等于人类式语法”的观察单位。Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)没有报告模型与人类判断相关可跨样本搬用的点估计,本页不替《Evidence Against Syntactic Encapsulation in Large Language Models》补造效应量。可证伪阈值预注册为R19=模型与人类判断相关除以最小句对:R19>1.00倍才支持原方向,R19≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2023 年后的评估至少比较准确率、置信度和干预稳定性,避免把 1 个排行榜分数当成理论证明。一旦分母排除最难触达者时,成功率越高,公平性反而越差。争论的分水岭落到样本边缘:Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun (2026)的《Optimizing knowledge reasoning with combined graph neural networks and large language models》只在可区分结构知识与加工限制的实验中的大语言模型的流畅性不等于样本外与Thomas A. McGee、Yiyang Zhang、Idan A. Blank(2026)形成反号;边界内的同号证据不被冒充为普遍定律。
就“大语言模型的流畅性不等于人类式语法”而言,模型与人类判断相关仅在原分母内可解释,边外不可原样搬用。延伸证据改换了承载机构:Shurong Zheng、Yousong Zhu、Hongyin Zhao、Fan(2026)在《GeM-VG: Towards Generalized Multi-image Visual Grounding with Multimodal Large Language Models》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的模型与人类判断相关变成可比较对象。
与“大语言模型的流畅性不等于人类式语法”相邻,判断任务的文化与教育偏差对“畅性不等于人类式语法”的影响是当前遗漏项;形式语言只是其相邻称谓,记录止于 2026 年。两块材料只共享条件场:第495号《预防性揭示:在错误到来前训练识别》结算另一生成层;《Evidence Against Syntactic Encapsulation in Large Language Models》仍以模型与人类判断相关对最小句对辨向。两边若同时成立,模型与人类判断相关会迫使平均组与分布尾部成为第三项(2026/2026)。对形式结构、使用频率、语义推理、加工限制、变异与语言接触分别分层后,模型与人类判断相关若只在中心组存在,原命题就必须缩域。
十二、语言学开始用干预实验探查模型内部机制Mechanistic interpretability for language
若某层能预测句法标签,并不表示模型用它完成任务。2026 年的研究把语言学开始用干预实验探查模型内部机制与定向干预后目标结构准确率变化除以模型层直接相连。沿着样本表,Matthew Finlayson、Aaron Mueller、Sebastian (2021)的《Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models》只在原始编码与修订编码内解释定向干预后目标结构准确率变化;本条资料卡(1980)的《所列研究》负责旧命名,不替代现代识别。在语料库、实验反应时、田野录音、句法标注与跨语言数据库里,Matthew Finlayson、Aaron Mueller、Sebastian (2021)留下的可复查接口是定向干预后目标结构准确率变化,而不是条目标题本身。
核心过程为表示探针与因果干预区分相关编码和真正计算。反事实只移动一项:定向干预后目标结构准确率变化是唯一决定项。在原始编码与修订编码中拿走定向干预后目标结构准确率变化而结果仍同号,就否证《Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models》的机制解释(Matthew Finlayson、Aaron Mueller、Sebastian ,2021)。到2025年,Yoon Pyo Lee把相同对象移入语言档案馆、实验室、语料库联盟、学校与语言社区;外部效度因而取决于具有跨语言对照和原始材料的分析中的语言学开始用干。
2024 年的机制研究通过抹除、替换或激活特定表示,观察目标结构至少在 2 个对照条件下是否随之变化。Matthew Finlayson、Aaron Mueller、Sebastian (2021)没有报告定向干预后目标结构准确率变化可跨样本搬用的点估计,本页不替《Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models》补造效应量。可证伪阈值预注册为R20=定向干预后目标结构准确率变化除以模型层:R20>1.00倍才支持原方向,R20≤1.00倍即记反号;1.00倍是复核闸,不是论文实测值。
2024 年的机制研究通过抹除、替换或激活特定表示,观察目标结构至少在 2 个对照条件下是否随之变化。一旦多种机制方向相反,样本越大,平均效应反而越接近零。边界条件在近端复核中显形:Qi Liu、Haozhe Duan、Jiaxin Mao、Ji-Rong Wen(2026)的《How Do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective》只在具有跨语言对照和原始材料的分析中的语言学开始用干预实验探查样本外与Matthew Finlayson、Aaron Mueller、Sebastian (2021)形成反号;边界内的同号证据不被冒充为普遍定律。
就“语言学开始用干预实验探查模型内部机制”而言,向其他人群推广前,先补齐模型表示与人类表征的因果对应对“实验探查模型内部机制”的影响的独立证据。制度接口随后移动:Yoon Pyo Lee(2025)在《Mechanistic Interpretability of Lora-Adapted Language Models for Nuclear Reactor Safety Applications》中连接语言档案馆、实验室、语料库联盟、学校与语言社区,并把形式结构、使用频率、语义推理、加工限制、变异与语言接触中的定向干预后目标结构准确率变化变成可比较对象。
与“语言学开始用干预实验探查模型内部机制”相邻,邻接术语写作加工可预测性。截至 2025 年仍在更新。跨块接口不靠同名:第478号《水印与检测的脆弱性》结算另一生成层;《Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models》仍以定向干预后目标结构准确率变化对模型层辨向。两边若同时成立,定向干预后目标结构准确率变化会迫使原始编码与修订编码成为第三项(2021/2025)。
◎ 二十年连起来看
《极简方案把语言装置压缩到最少操作》与《生成与使用争论被改写为可区分预测》构成第1条时间线:Noam Chomsky(2005)先改写理论所需基本操作数,Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)再把裁决移到两类模型在留出结构上的预测差。样本来源与纳入路径与信息可见度须分账。
《使用为本以频率和构式替代抽象规则优先》与《计算模型与人类实验形成分工》构成第2条时间线:Adele E. Goldberg(2006)先改写构式频率对产出与理解的解释量,Richard Futrell、Ethan Wilcox、Takashi Morit(2019)再把裁决移到模型惊异度对阅读时的解释增量。处理暴露强度与首次事件与重复事件须分账。
《依存距离把加工约束转成跨语言读数》与《二、语言学开始用干预实验探查模型内部机制》构成第3条时间线:David Temperley(2008)先改写实际依存距离相对随机语序的缩减,Matthew Finlayson、Aaron Mueller、Sebastian (2021)再把裁决移到定向干预后目标结构准确率变化。组织规模与原始编码与修订编码须分账。
◎ 三个常见误解
第1个误解是把《极简方案把语言装置压缩到最少操作》当成《生成与使用争论被改写为可区分预测》的否定;两者看似都谈理论所需基本操作数。前者用理论所需基本操作数/可生成结构,后者用两类模型在留出结构上的预测差/实验项目,分母不同,不能把尺度差写成理论冲突。
第2个误解是把《使用为本以频率和构式替代抽象规则优先》当成《计算模型与人类实验形成分工》的否定;两者看似都谈构式频率对产出与理解的解释量。前者用构式频率对产出与理解的解释量/学习者,后者用模型惊异度对阅读时的解释增量/词位,分母不同,不能把尺度差写成理论冲突。
第3个误解是把《依存距离把加工约束转成跨语言读数》当成《二、语言学开始用干预实验探查模型内部机制》的否定;两者看似都谈实际依存距离相对随机语序的缩减。前者用实际依存距离相对随机语序的缩减/句子,后者用定向干预后目标结构准确率变化/模型层,分母不同,不能把尺度差写成理论冲突。
◎ 与相邻领域的接口
第233号《语言景观把公共文字的缺席纳入语言权利》与本块在首次事件与重复事件处分工:这里追踪模型惊异度对阅读时的解释增量/词位,社会语言学解释另一生成层。Richard Futrell、Ethan Wilcox、Takashi Morit(2019)换用对方分母后须重估符号。
第463号《协作型RSA》与本块在原始编码与修订编码处分工:这里追踪定向干预后目标结构准确率变化/模型层,语义学与语用学解释另一生成层。Matthew Finlayson、Aaron Mueller、Sebastian (2021)换用对方分母后须重估符号。
第464号《内部类人、外部超人》与本块在年龄与代际处分工:这里追踪单位词的信息量方差/话语序列,心理语言学解释另一生成层。Steven T. Piantadosi、Harry Tily、Edward Gib(2011)换用对方分母后须重估符号。
◎ 争议现场
Noam Chomsky(2005)与Christian Chiarcos、Ilya Khait、Émilie Pagé-(2018)围绕《极简方案把语言装置压缩到最少操作》未收敛。以理论所需基本操作数/可生成结构为共同终点;在刺激和判断任务可重复的语言样本中的极简方案把语言装置压缩到样本外稳定反号,才淘汰原解释。
Adele E. Goldberg(2006)与Jianhui Wei、Mingchao Yang、Keshu Xiang(2026)围绕《使用为本以频率和构式替代抽象规则优先》未收敛。以构式频率对产出与理解的解释量/学习者为共同终点;在具有跨语言对照和原始材料的分析中的使用为本以频率和构式替代样本外稳定反号,才淘汰原解释。
David Temperley(2008)与Richard Futrell、Kyle Mahowald、Edward Gibso(2015)围绕《依存距离把加工约束转成跨语言读数》未收敛。以实际依存距离相对随机语序的缩减/句子为共同终点;在具有跨语言对照和原始材料的分析中的依存距离把加工约束转成跨样本外稳定反号,才淘汰原解释。
◎ 往下五年看什么
2026—2031年追踪理论所需基本操作数/可生成结构。语料库、实验反应时、田野录音、句法标注与跨语言数据库保存样本来源与纳入路径、退出和版本;读数若随纳入规则翻转,《极简方案把语言装置压缩到最少操作》即降级。
2026—2031年追踪构式频率对产出与理解的解释量/学习者。语料库、实验反应时、田野录音、句法标注与跨语言数据库保存处理暴露强度、退出和版本;读数若随纳入规则翻转,《使用为本以频率和构式替代抽象规则优先》即降级。
2026—2031年追踪实际依存距离相对随机语序的缩减/句子。语料库、实验反应时、田野录音、句法标注与跨语言数据库保存组织规模、退出和版本;读数若随纳入规则翻转,《依存距离把加工约束转成跨语言读数》即降级。
◎ 可与哪些领域对撞
本块第1条《极简方案把语言装置压缩到最少操作》对撞第233号《语言景观把公共文字的缺席纳入语言权利》。共享预设是“01 谁进入分母”。本块以理论所需基本操作数辨向,对方从社会语言学解释生成路径。若两边都成立,矛盾迫使模型新增未入账的形式结构退出与阴性个案。
本块第4条《使用为本以频率和构式替代抽象规则优先》对撞第463号《协作型RSA》。共享预设是“02 单一读数代表复杂对象”。本块以构式频率对产出与理解的解释量辨向,对方从语义学与语用学解释生成路径。若两边都成立,矛盾迫使模型新增未入账的加工限制退出与阴性个案。
本块第8条《依存距离把加工约束转成跨语言读数》对撞第464号《内部类人、外部超人》。共享预设是“02 单一读数代表复杂对象”。本块以实际依存距离相对随机语序的缩减辨向,对方从心理语言学解释生成路径。若两边都成立,矛盾迫使模型新增未入账的使用频率退出与阴性个案。
◎ 十条可做的研究命题
- 命题 1:《极简方案把语言装置压缩到最少操》与《贫刺激论转向输入量和学习偏置》分账后,理论所需基本操作数/可生成结构应保持2005年方向。用预注册分群复算并单列未入账的形式结构退出与阴性个案;越过刺激和判断任务可重复的语言样后复算反号即证伪。
- 命题 2:《皮拉罕语争论挑战递归的普遍地位》与《争论进入预注册多实验室复制》分账后,可复核递归结构例数/自然语料与诱导任务应保持2005年方向。用连接行政记录与过程日志并单列未入账的使用频率退出与阴性个案;越过语料规模与说话者背景均已报告后复算反号即证伪。
- 命题 3:《类型学以大样本挑战绝对普遍语法》与《计算模型与人类实验形成分工》分账后,无例外共性数/跨语言样本应保持2011年方向。用设置跨制度成对比较并单列未入账的语义推理退出与阴性个案;越过可区分结构知识与加工限制的实后复算反号即证伪。
- 命题 4:《使用为本以频率和构式替代抽象规》与《单一普遍机制让位于分层解释》分账后,构式频率对产出与理解的解释量/学习者应保持2006年方向。用保留退出者重估分母并单列未入账的加工限制退出与阴性个案;越过具有跨语言对照和原始材料的分后复算反号即证伪。
- 命题 5:《婴儿统计学习展示分布线索的力量》与《大型跨语言树库暴露资料不均衡》分账后,高低转移概率串的注视时长差/婴儿应保持2012年方向。用用两套盲法编码复核并单列未入账的变异退出与阴性个案;越过刺激和判断任务可重复的语言样后复算反号即证伪。
- 命题 6:《濒危语言迫使描写与社区治理同步》与《语音表征研究从类别转向连续动态》分账后,完成转写注释且社区可用的小时数/记录语料应保持2016年方向。用并列短窗与长窗并单列未入账的语言接触退出与阴性个案;越过语料规模与说话者背景均已报告后复算反号即证伪。
- 命题 7:《信息论把可预测性接到语言形式》与《低资源语言技术要求社区同意与收》分账后,单位词的信息量方差/话语序列应保持2011年方向。用拆开中心与尾部样本并单列未入账的形式结构退出与阴性个案;越过可区分结构知识与加工限制的实后复算反号即证伪。
- 命题 8:《依存距离把加工约束转成跨语言读》与《多模态学习重新引入情境与指称》分账后,实际依存距离相对随机语序的缩减/句子应保持2008年方向。用追踪首次与重复事件并单列未入账的使用频率退出与阴性个案;越过具有跨语言对照和原始材料的分后复算反号即证伪。
- 命题 9:《生成与使用争论被改写为可区分预》与《一、大语言模型的流畅性不等于人》分账后,两类模型在留出结构上的预测差/实验项目应保持2026年方向。用对照公开承诺与实际行动并单列未入账的语义推理退出与阴性个案;越过刺激和判断任务可重复的语言样后复算反号即证伪。
- 命题 10:《深度模型学会结构但数据需求远超》与《二、语言学开始用干预实验探查模》分账后,语法最小对准确率/测试句对应保持2022年方向。用保存原始与修订版本并单列未入账的加工限制退出与阴性个案;越过语料规模与说话者背景均已报告后复算反号即证伪。
◎ 参考文献 · 原始提出、争议与近端复核
- Noam Chomsky,2005,《Three Factors in Language Design》,Linguistic Inquiry 36(1):1–22,DOI 10.1162/0024389052993655
- Christian Chiarcos、Ilya Khait、Émilie Pagé-Perron、Niko Schenk 等,2018,《Annotating a Low-Resource Language with LLOD Technology: Sumerian Morphology and Syntax》,Information:290,DOI 10.3390/info9110290
- Ferdinand de Saussure,1916,《Cours de linguistique générale》
- Daniel L. Everett,2005,《Cultural Constraints on Grammar and Cognition in Pirahã》,Current Anthropology 46(4):621–646,DOI 10.1086/431525
- DOMINIQUE DEVRIESE、FRANK PIESSENS,2012,《Finally tagless observable recursion for an abstract grammar model》,Journal of Functional Programming 22(6):757–796,DOI 10.1017/s0956796812000226
- Carlos Gómez-Rodríguez、Morten H. Christiansen、Ramon Ferrer-i-Cancho,2022,《Memory limitations are hidden in grammar》,Glottometrics 52:39–64,DOI 10.53482/2022_52_397
- Leonard Bloomfield,1933,《Language》
- Michael Dunn、Simon J. Greenhill、Stephen C. Levinson 等,2011,《Evolved Structure of Language Shows Lineage-Specific Trends in Word-Order Universals》,Nature 473:79–82,DOI 10.1038/nature09923
- Dietmar Zaefferer、David Poeppel,2010,《Linguistic Universals as Human Universals — Divergent Views and Converging Evidence on Language Congruence and Diversity》,Biolinguistics 4(2-3):159–164,DOI 10.5964/bioling.8779
- Jianhui Wei、Mingchao Yang、Keshu Xiang,2026,《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》,Language Learning and Development:190–215,DOI 10.1080/15475441.2025.2560814
- Noam Chomsky,1957,《Syntactic Structures》
- Adele E. Goldberg,2006,《Constructions at Work: The Nature of Generalization in Language》,Oxford University Press(专著)
- Isa Hendrikx、Kristel Van Goethem,2024,《Dutch compound constructions in additional language acquisition》,Constructions and Frames 16(1):64–99,DOI 10.1075/cf.22023.hen
- Noam Chomsky,1965,《Aspects of the Theory of Syntax》
- Richard N. Aslin、Elissa L. Newport,2012,《Statistical Learning: From Acquiring Specific Items to Forming General Rules》,Current Directions in Psychological Science 21(3):170–176,DOI 10.1177/0963721412436806
- Freda Shi,2025,《Learning Language Structures Through Grounding》,Proceedings of the AAAI Conference on Artificial Intelligence 39(27):28725–28725,DOI 10.1609/aaai.v39i27.35119
- Mari Carmen Carilla Pérez、Raúl Ruiz Cecilia,2025,《Creativity and social networks in English language learning: a systematic literature review》,Onomázein:208–240,DOI 10.7764/onomazein.ne16.10
- Joseph H. Greenberg,1963,《Universals of Language》
- Jonathan Hsy,2016,《Language Ecologies: Ethics, Community, and Digital Affect》,Publications of the Modern Language Association of America:373–380,DOI 10.1632/pmla.2016.131.2.373
- Thomas A. McGee、Yiyang Zhang、Idan A. Blank,2026,《Evidence Against Syntactic Encapsulation in Large Language Models》,Cognitive Science,DOI 10.1111/cogs.70187
- Richard Montague,1974,《Formal Philosophy》
- Steven T. Piantadosi、Harry Tily、Edward Gibson,2011,《Word lengths are optimized for efficient communication》,Proceedings of the National Academy of Sciences:3526–3529,DOI 10.1073/pnas.1012551108
- Thomas Hikaru Clark、Clara Meister、Tiago Pimentel、Michael Hahn 等,2023,《A Cross-Linguistic Pressure for Uniform Information Density in Word Order》,Transactions of the Association for Computational Linguistics 11:1048–1065,DOI 10.1162/tacl_a_00589
- Richard Futrell,2023,《Information-theoretic principles in incremental language production》,Proceedings of the National Academy of Sciences 120(39),DOI 10.1073/pnas.2220593120
- Charles J. Fillmore,1968,〈The Case for Case〉
- David Temperley,2008,《Dependency-length minimization in natural and artificial languages∗》,Journal of Quantitative Linguistics:256–282,DOI 10.1080/09296170802159512
- Richard Futrell、Kyle Mahowald、Edward Gibson,2015,《Large-scale evidence of dependency length minimization in 37 languages》,Proceedings of the National Academy of Sciences 112(33):10336–10341,DOI 10.1073/pnas.1502134112
- Marie-Pauline Krielke,2024,《Cross-linguistic Dependency Length Minimization in scientific language》,Languages in Contrast:133–163,DOI 10.1075/lic.00038.kri
- E. Mark Gold,1967,〈Language Identification in the Limit〉
- Liying Pan,2025,《Research on AI tool usage and language acquisition in foreign language education》,Russian Journal of Education and Psychology 16(6):340–361,DOI 10.12731/2658-4034-2025-16-6-1011
- Samirah Ujang,2024,《Usage in Second Language Acquisition: Critical Reflections and Future Directions (Book Review)》,Teaching English as a Second or Foreign Language--TESL-EJ 28(3),DOI 10.55593/ej.28111r3
- Alex Warstadt、Samuel R. Bowman,2022,《What Artificial Neural Networks Can Tell Us about Human Language Acquisition》,Algebraic Structures in Natural Language 17:17–60,DOI 10.1201/9781003309680-2
- Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun Fang,2026,《Optimizing knowledge reasoning with combined graph neural networks and large language models》,Neurocomputing 677:133121,DOI 10.1016/j.neucom.2026.133121
- Myung-Kwan Park、Keonwoo Koo、Jaemin Lee、Wonil Chung,2024,《Investigating Syntactic Transfer from English to Korean in Neural L2 Language Models》,Studies in Modern Grammar 121:177–201,DOI 10.14342/smog.2024.121.177
- Lisa Pearl、Jon Sprouse,2013,《Syntactic Islands and Learning Biases: Combining Experimental Syntax and Computational Modeling to Investigate Constraints on Language Learning》,Language Acquisition 20(1):23–68,DOI 10.1080/10489223.2012.738742
- ManyBabies Consortium,2020,《Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference》,Advances in Methods and Practices in Psychological Science 3(1):24–52,DOI 10.1177/2515245919900809
- Richard Futrell、Ethan Wilcox、Takashi Morita 等,2019,《Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State》,NAACL 2019:32–42,DOI 10.18653/v1/N19-1004
- Md Rabiul Islam Hridoy、Syada Miel Ahmed,2026,《Psycholinguistic reactivity in large language models: Affective asymmetry under ideological priming》,Computers in Human Behavior: Artificial Humans 9:100340,DOI 10.1016/j.chbah.2026.100340
- Sean Trott,2024,《Can large language models help augment English psycholinguistic datasets?》,Behavior Research Methods 56(6):6082–6100,DOI 10.3758/s13428-024-02337-z
- Gabe Dupre,2021,《Linguistics and the explanatory economy》,Synthese:177–219,DOI 10.1007/s11229-019-02290-x
- Sabrina Coninx、Pascale Willemsen、Kevin Reuter,2023,《Pain Linguistics: A Case for Pluralism》,The Philosophical Quarterly 74(1):145–168,DOI 10.1093/pq/pqad048
- Sonja NOVOTNI、Mihailo MARKOVIC,2024,《TEXT LINGUISTICS (DIACHRONIC REVIEW)》,International Journal of Human Sciences - Filologjia 12(22-23):303–310,DOI 10.62792/ut.filologjia.v12.i22-23.p2530
- Daniel Zeman、Jan Hajič、Martin Popel 等,2018,《CoNLL 2018 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies》,CoNLL 2018:1–21,DOI 10.18653/v1/K18-2001
- Himanshu Yadav、Shubham Mittal、Samar Husain,2022,《A Reappraisal of Dependency Length Minimization as a Linguistic Universal》,Open Mind 6:147–168,DOI 10.1162/opmi_a_00060
- Dave F. Kleinschmidt、T. Florian Jaeger,2015,《Robust Speech Perception: Recognize the Familiar, Generalize to the Similar, and Adapt to the Novel》,Psychological Review 122(2):148–203,DOI 10.1037/a0038695
- Cheryl Gilford、Martin Meyer、Balthasar Bickel、Nina Kazanina,2026,《The Neural Dynamics of Hierarchical Syntactic Structures During Language Comprehension》,JoCN Forum,DOI 10.21428/8e6ba8ef.da8c9a73
- Steven Bird,2020,《Decolonising Speech and Language Technology》,COLING 2020:3504–3519,DOI 10.18653/v1/2020.coling-main.313
- Paolo Valentinelli,2026,《Low-resource language》,AI-Linguistica. Linguistic Studies on AI-Generated Texts and Discourses 6(1),DOI 10.62408/ai-ling.v6i1.77
- Annie Rajan、Nehal Kalita、Ambuja Salgaonkar,2025,《Spell Checker for Low-resource Konkani Language》,Journal of Information and Communications Technology: Algorithms, Systems and Applications 1(3),DOI 10.64189/ict.25316
- Ziheng Xia、Chao Li、Ding Ding、Ye Wang 等,2026,《Multimodal Large Language Model for Virtual Object Grounding》,ACM Transactions on Multimedia Computing, Communications, and Applications:1–22,DOI 10.1145/3796717
- Jianlong Wu、Wei Liu、Ye Liu、Meng Liu 等,2026,《A Survey on Video Temporal Grounding With Multimodal Large Language Model》,IEEE Transactions on Pattern Analysis and Machine Intelligence 48(2):1521–1541,DOI 10.1109/tpami.2025.3615586
- Shurong Zheng、Yousong Zhu、Hongyin Zhao、Fan Yang 等,2026,《GeM-VG: Towards Generalized Multi-image Visual Grounding with Multimodal Large Language Models》,Proceedings of the AAAI Conference on Artificial Intelligence 40(34):28857–28865,DOI 10.1609/aaai.v40i34.40120
- Matthew Finlayson、Aaron Mueller、Sebastian Gehrmann 等,2021,《Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models》,ACL-IJCNLP 2021:1828–1843,DOI 10.18653/v1/2021.acl-long.144
- Qi Liu、Haozhe Duan、Jiaxin Mao、Ji-Rong Wen,2026,《How Do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective》,ACM Transactions on Information Systems 44(2):1–27,DOI 10.1145/3774942
- Yoon Pyo Lee,2025,《Mechanistic Interpretability of Lora-Adapted Language Models for Nuclear Reactor Safety Applications》,Nuclear Technology:1–13,DOI 10.1080/00295450.2025.2560760
以下二十条倒着追问理论语言学的现代判断:旧前提由谁提出、凭什么材料成立、后来在哪个分母上被修正。每条都回指上文一条现代思想,并把失效条件与异名接口一并保留。
经一、生成语法与句法结构Classic 01 · Theoretical Linguistics
1957年的《生成语法与句法结构》不是名人标签。Noam Chomsky沿机制史把理论语言学中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《生成语法与句法结构》的阴性对象与退出记录由此能在同一账本重算。
Christian Chiarcos、Ilya Khait、Émilie Pagé-Perron、Niko Sche…后来反向校验《生成语法与句法结构》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块甲对读。现代关键读数是“理论所需基本操作数/可生成结构”。它说明《生成语法与句法结构》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《生成语法与句法结构》的新证据。核验《生成语法与句法结构》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《生成语法与句法结构》须注明采用哪一版定义,同名术语不等于同一证据单位。
经二、语言共性与语序类型Classic 02 · Theoretical Linguistics
《语言共性与语序类型》出现前,理论语言学常把同名现象当作同一对象。Joseph H. Greenberg于1963年沿机制史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《语言共性与语序类型》改变的是判决程序,不是增加一条永远正确的结论。
DOMINIQUE DEVRIESE、FRANK PIESSENS,2012,《Finally tagless ob…把《语言共性与语序类型》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块乙仍借用这套接口;其中关键读数是“可复核递归结构例数/自然语料与诱导任务”。《语言共性与语序类型》若改用另一分母,结论就可能反号。《语言共性与语序类型》因此成为现代条目的历史压力测试。核验《语言共性与语序类型》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《语言共性与语序类型》须注明采用哪一版定义,同名术语不等于同一证据单位。
经三、语言能力与语言运用Classic 03 · Theoretical Linguistics
《语言能力与语言运用》在1965年造成的转向首先是一项机制史选择。Noam Chomsky在《语言能力与语言运用》中把对象、操作和失败读数排成可质疑次序,没有把理论语言学的复杂性缩成权威判断。《语言能力与语言运用》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Dietmar Zaefferer、David Poeppel,2010,《Linguistic Universal…缩窄或改写了《语言能力与语言运用》。它连接本块丙时,现代证据“无例外共性数/跨语言样本”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《语言能力与语言运用》的外推,而不是替经典找托词。核验《语言能力与语言运用》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《语言能力与语言运用》须注明采用哪一版定义,同名术语不等于同一证据单位。
经四、极限识别与语言可学习性Classic 04 · Theoretical Linguistics
E. Mark Gold在1967年的《极限识别与语言可学习性》为理论语言学留下机制史装置:公开对象怎样进入分母,并把例外放在模型内。《极限识别与语言可学习性》以前的争论容易把测量便利当成本体事实;《极限识别与语言可学习性》使两者能够分账。《极限识别与语言可学习性》成为经典,靠的是接受反例修订。
用Jianhui Wei、Mingchao Yang、Keshu Xiang,2026,《Unraveling ove…回看《极限识别与语言可学习性》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块丁保存这条差异;关键判断是“构式频率对产出与理解的解释量/学习者”。它把《极限识别与语言可学习性》的失败对象送回比较。《极限识别与语言可学习性》的旧前提由本块检验证据成本。核验《极限识别与语言可学习性》时须同时保存它没有解释的对象,不能只汇集成功分支。
经五、格语法Classic 05 · Theoretical Linguistics
1968年的《格语法》不是名人标签。Charles J. Fillmore沿机制史把理论语言学中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《格语法》的阴性对象与退出记录由此能在同一账本重算。
Freda Shi,2025,《Learning Language Structures Through Groun…后来反向校验《格语法》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块戊对读。现代关键读数是“高低转移概率串的注视时长差/婴儿”。它说明《格语法》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《格语法》的新证据。核验《格语法》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《格语法》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《格语法》应先冻结分母和停止规则,再比较旧读数与新读数。若《格语法》的失败记录不可访问,当前支持率只能视为幸存者读数。
经六、社会语言学的变异规则Classic 06 · Theoretical Linguistics
《社会语言学的变异规则》出现前,理论语言学常把同名现象当作同一对象。William Labov于1972年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《社会语言学的变异规则》改变的是判决程序,不是增加一条永远正确的结论。
Jianhui Wei、Mingchao Yang、Keshu Xiang,2026,《Unraveling ove…把《社会语言学的变异规则》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块己仍借用这套接口;其中关键读数是“完成转写注释且社区可用的小时数/记录语料”。《社会语言学的变异规则》若改用另一分母,结论就可能反号。《社会语言学的变异规则》因此成为现代条目的历史压力测试。核验《社会语言学的变异规则》时须同时保存它没有解释的对象,不能只汇集成功分支。
经七、蒙太古语法Classic 07 · Theoretical Linguistics
《蒙太古语法》在1974年造成的转向首先是一项测量史选择。Richard Montague在《蒙太古语法》中把对象、操作和失败读数排成可质疑次序,没有把理论语言学的复杂性缩成权威判断。《蒙太古语法》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Thomas Hikaru Clark、Clara Meister、Tiago Pimentel、Michael H…缩窄或改写了《蒙太古语法》。它连接本块庚时,现代证据“单位词的信息量方差/话语序列”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《蒙太古语法》的外推,而不是替经典找托词。核验《蒙太古语法》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《蒙太古语法》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《蒙太古语法》应先冻结分母和停止规则,再比较旧读数与新读数。
经八、会话含义与合作原则Classic 08 · Theoretical Linguistics
H. Paul Grice在1975年的《会话含义与合作原则》为理论语言学留下测量史装置:公开对象怎样进入分母,并把例外放在模型内。《会话含义与合作原则》以前的争论容易把测量便利当成本体事实;《会话含义与合作原则》使两者能够分账。《会话含义与合作原则》成为经典,靠的是接受反例修订。
用Richard Futrell、Kyle Mahowald、Edward Gibson,2015,《Large-sc…回看《会话含义与合作原则》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块辛保存这条差异;关键判断是“实际依存距离相对随机语序的缩减/句子”。它把《会话含义与合作原则》的失败对象送回比较。《会话含义与合作原则》的旧前提由本块检验证据成本。核验《会话含义与合作原则》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《会话含义与合作原则》须注明采用哪一版定义,同名术语不等于同一证据单位。
经九、概念语义学Classic 09 · Theoretical Linguistics
1983年的《概念语义学》不是名人标签。Ray Jackendoff沿测量史把理论语言学中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《概念语义学》的阴性对象与退出记录由此能在同一账本重算。
Liying Pan,2025,《Research on AI tool usage and language ac…后来反向校验《概念语义学》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块一对读。现代关键读数是“两类模型在留出结构上的预测差/实验项目”。它说明《概念语义学》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《概念语义学》的新证据。核验《概念语义学》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《概念语义学》须注明采用哪一版定义,同名术语不等于同一证据单位。重算《概念语义学》应先冻结分母和停止规则,再比较旧读数与新读数。
经十、认知语法与范畴化Classic 10 · Theoretical Linguistics
《认知语法与范畴化》出现前,理论语言学常把同名现象当作同一对象。George Lakoff于1987年沿测量史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《认知语法与范畴化》改变的是判决程序,不是增加一条永远正确的结论。
Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun Fang,2026,《Optim…把《认知语法与范畴化》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块二仍借用这套接口;其中关键读数是“语法最小对准确率/测试句对”。《认知语法与范畴化》若改用另一分母,结论就可能反号。《认知语法与范畴化》因此成为现代条目的历史压力测试。核验《认知语法与范畴化》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《认知语法与范畴化》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十一、语言游戏与规则使用Classic 11 · Theoretical Linguistics
《语言游戏与规则使用》在1953年造成的转向首先是一项制度史选择。Ludwig Wittgenstein在《语言游戏与规则使用》中把对象、操作和失败读数排成可质疑次序,没有把理论语言学的复杂性缩成权威判断。《语言游戏与规则使用》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Jianhui Wei、Mingchao Yang、Keshu Xiang,2026,《Unraveling ove…缩窄或改写了《语言游戏与规则使用》。它连接本块三时,现代证据“儿童输入中关键结构例数/百万词”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《语言游戏与规则使用》的外推,而不是替经典找托词。核验《语言游戏与规则使用》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《语言游戏与规则使用》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十二、社会理论与中层机制Classic 12 · Theoretical Linguistics
Robert K. Merton在1957年的《社会理论与中层机制》为理论语言学留下制度史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论与中层机制》以前的争论容易把测量便利当成本体事实;《社会理论与中层机制》使两者能够分账。《社会理论与中层机制》成为经典,靠的是接受反例修订。
用Christian Chiarcos、Ilya Khait、Émilie Pagé-Perron、Niko Sche…回看《社会理论与中层机制》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块四保存这条差异;关键判断是“跨实验室效应一致率/预注册语言样本”。它把《社会理论与中层机制》的失败对象送回比较。《社会理论与中层机制》的旧前提由本块检验证据成本。核验《社会理论与中层机制》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十三、日常生活中的自我呈现Classic 13 · Theoretical Linguistics
1959年的《日常生活中的自我呈现》不是名人标签。Erving Goffman沿制度史把理论语言学中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《日常生活中的自我呈现》的阴性对象与退出记录由此能在同一账本重算。
Md Rabiul Islam Hridoy、Syada Miel Ahmed,2026,《Psycholingui…后来反向校验《日常生活中的自我呈现》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块五对读。现代关键读数是“模型惊异度对阅读时的解释增量/词位”。它说明《日常生活中的自我呈现》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《日常生活中的自我呈现》的新证据。核验《日常生活中的自我呈现》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十四、范式与科学共同体Classic 14 · Theoretical Linguistics
《范式与科学共同体》出现前,理论语言学常把同名现象当作同一对象。Thomas S. Kuhn于1962年沿制度史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《范式与科学共同体》改变的是判决程序,不是增加一条永远正确的结论。
Sabrina Coninx、Pascale Willemsen、Kevin Reuter,2023,《Pain L…把《范式与科学共同体》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块六仍借用这套接口;其中关键读数是“结构、加工、使用与历史模型独立解释量/现象”。《范式与科学共同体》若改用另一分母,结论就可能反号。《范式与科学共同体》因此成为现代条目的历史压力测试。核验《范式与科学共同体》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《范式与科学共同体》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十五、正义的制度排序Classic 15 · Theoretical Linguistics
《正义的制度排序》在1971年造成的转向首先是一项制度史选择。John Rawls在《正义的制度排序》中把对象、操作和失败读数排成可质疑次序,没有把理论语言学的复杂性缩成权威判断。《正义的制度排序》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Thomas Hikaru Clark、Clara Meister、Tiago Pimentel、Michael H…缩窄或改写了《正义的制度排序》。它连接本块七时,现代证据“具有稳定标注与足量文本的语言数/世界语言”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《正义的制度排序》的外推,而不是替经典找托词。核验《正义的制度排序》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《正义的制度排序》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十六、深描与文化解释Classic 16 · Theoretical Linguistics
Clifford Geertz在1973年的《深描与文化解释》为理论语言学留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《深描与文化解释》以前的争论容易把测量便利当成本体事实;《深描与文化解释》使两者能够分账。《深描与文化解释》成为经典,靠的是接受反例修订。
用Cheryl Gilford、Martin Meyer、Balthasar Bickel、Nina Kazanina…回看《深描与文化解释》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块八保存这条差异;关键判断是“声学线索权重随时间的变化/语音试次”。它把《深描与文化解释》的失败对象送回比较。《深描与文化解释》的旧前提由本块检验证据成本。核验《深描与文化解释》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《深描与文化解释》须注明采用哪一版定义,同名术语不等于同一证据单位。
经十七、规训、记录与可治理身体Classic 17 · Theoretical Linguistics
1975年的《规训、记录与可治理身体》不是名人标签。Michel Foucault沿人物史把理论语言学中混写的对象、证据和价值判断分开,规定什么材料算支持、哪种记录足以迫使命题后退。《规训、记录与可治理身体》的阴性对象与退出记录由此能在同一账本重算。
Paolo Valentinelli,2026,《Low-resource language》,AI-Linguis…后来反向校验《规训、记录与可治理身体》,保留可迁移结构,也撤回只在旧制度和旧测量中成立的扩展。与本块九对读。现代关键读数是“社区控制且可撤回的数据集数/语言项目”。它说明《规训、记录与可治理身体》的哪项设置被继承,又在哪个分母上被改写。经典地位不能替代《规训、记录与可治理身体》的新证据。核验《规训、记录与可治理身体》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十八、区分、品味与社会再生产Classic 18 · Theoretical Linguistics
《区分、品味与社会再生产》出现前,理论语言学常把同名现象当作同一对象。Pierre Bourdieu于1979年沿人物史先限定观察者能看到什么,再说明遗漏什么会让解释失真。《区分、品味与社会再生产》改变的是判决程序,不是增加一条永远正确的结论。
Jianlong Wu、Wei Liu、Ye Liu、Meng Liu 等,2026,《A Survey on Vi…把《区分、品味与社会再生产》送进不同样本与制度,保留可证伪骨架,撤掉不再成立的普遍化。本块十仍借用这套接口;其中关键读数是“加入视觉情境后的指称理解增量/测试项目”。《区分、品味与社会再生产》若改用另一分母,结论就可能反号。《区分、品味与社会再生产》因此成为现代条目的历史压力测试。核验《区分、品味与社会再生产》时须同时保存它没有解释的对象,不能只汇集成功分支。
经十九、交往行动与公共理由Classic 19 · Theoretical Linguistics
《交往行动与公共理由》在1981年造成的转向首先是一项人物史选择。Jürgen Habermas在《交往行动与公共理由》中把对象、操作和失败读数排成可质疑次序,没有把理论语言学的复杂性缩成权威判断。《交往行动与公共理由》原文本之外仍有空栏,教科书式扩写不能自动填平。
后续争论Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun Fang,2026,《Optim…缩窄或改写了《交往行动与公共理由》。它连接本块十一时,现代证据“模型与人类判断相关/最小句对”承担复核责任。若重编对象、延长时间窗或补回排除者后排序翻转,就应承认现代层反驳了《交往行动与公共理由》的外推,而不是替经典找托词。核验《交往行动与公共理由》时须同时保存它没有解释的对象,不能只汇集成功分支。迁移《交往行动与公共理由》须注明采用哪一版定义,同名术语不等于同一证据单位。
经二十、社会理论的微观基础Classic 20 · Theoretical Linguistics
James S. Coleman在1990年的《社会理论的微观基础》为理论语言学留下人物史装置:公开对象怎样进入分母,并把例外放在模型内。《社会理论的微观基础》以前的争论容易把测量便利当成本体事实;《社会理论的微观基础》使两者能够分账。《社会理论的微观基础》成为经典,靠的是接受反例修订。
用Qi Liu、Haozhe Duan、Jiaxin Mao、Ji-Rong Wen,2026,《How Do Lar…回看《社会理论的微观基础》,可辨哪些结果来自原命题,哪些只是后来制度借名包装。本块十二保存这条差异;关键判断是“定向干预后目标结构准确率变化/模型层”。它把《社会理论的微观基础》的失败对象送回比较。《社会理论的微观基础》的旧前提由本块检验证据成本。核验《社会理论的微观基础》时须同时保存它没有解释的对象,不能只汇集成功分支。
◎ 这一层怎么用
先从“今用”回到上文对应现代条,再比较对象、分母和停止规则。只共享名词而不能换算量纲的关系登记为异名;能够共用失败对象的关系才进入碰撞。
经典身份不提供豁免。提出年份只决定它属于哪一层,后续反例负责划出今天仍可使用的边界;同一经典在新制度里失效,应明确写成撤回而不是补托词。
◎ 经典层资料核验
- Chomsky N. Syntactic Structures. Mouton (1957)(专著)。
- Greenberg JH, ed. Universals of Language. MIT Press (1963)(专著)。
- Chomsky N. Aspects of the Theory of Syntax. MIT Press (1965)(专著)。
- Gold EM. Language Identification in the Limit. Information and Control 10 (1967)。
- Fillmore CJ. The Case for Case. In Universals in Linguistic Theory. Holt, Rinehart and Winston (1968)(专著)。
- Labov W. Sociolinguistic Patterns. University of Pennsylvania Press (1972)(专著)。
- Montague R. Formal Philosophy. Yale University Press (1974)(专著)。
- Grice HP. Logic and Conversation. In Syntax and Semantics 3. Academic Press (1975)(专著)。
- Jackendoff R. Semantics and Cognition. MIT Press (1983)(专著)。
- Lakoff G. Women, Fire, and Dangerous Things. University of Chicago Press (1987)(专著)。
- Wittgenstein L. Philosophical Investigations. Blackwell (1953)(专著)。
- Merton RK. Social Theory and Social Structure. Free Press (1957)(专著)。
- Goffman E. The Presentation of Self in Everyday Life. Doubleday (1959)(专著)。
- Kuhn TS. The Structure of Scientific Revolutions. University of Chicago Press (1962)(专著)。
- Rawls J. A Theory of Justice. Harvard University Press (1971)(专著)。
- Geertz C. The Interpretation of Cultures. Basic Books (1973)(专著)。
- Foucault M. Discipline and Punish. Gallimard (1975)(专著)。
- Bourdieu P. La Distinction. Éditions de Minuit (1979)(专著)。
- Habermas J. The Theory of Communicative Action. Beacon Press (1981)(专著)。
- Coleman JS. Foundations of Social Theory. Harvard University Press (1990)(专著)。
- Christian Chiarcos、Ilya Khait、Émilie Pagé-Perron、Niko Schenk 等,2018,《Annotating a Low-Resource Language with LLOD Technology: Sumerian Morphology and Syntax》,Information:290,DOI 10.3390/info9110290。
- DOMINIQUE DEVRIESE、FRANK PIESSENS,2012,《Finally tagless observable recursion for an abstract grammar model》,Journal of Functional Programming 22(6):757–796,DOI 10.1017/s0956796812000226。
- Dietmar Zaefferer、David Poeppel,2010,《Linguistic Universals as Human Universals — Divergent Views and Converging Evidence on Language Congruence and Diversity》,Biolinguistics 4(2-3):159–164,DOI 10.5964/bioling.8779。
- Jianhui Wei、Mingchao Yang、Keshu Xiang,2026,《Unraveling overgeneralization in second language acquisition: a usage-based perspective on transitive and intransitive constructions in Chinese EFL learners》,Language Learning and Development:190–215,DOI 10.1080/15475441.2025.2560814。
- Freda Shi,2025,《Learning Language Structures Through Grounding》,Proceedings of the AAAI Conference on Artificial Intelligence 39(27):28725–28725,DOI 10.1609/aaai.v39i27.35119。
- Thomas Hikaru Clark、Clara Meister、Tiago Pimentel、Michael Hahn 等,2023,《A Cross-Linguistic Pressure for Uniform Information Density in Word Order》,Transactions of the Association for Computational Linguistics 11:1048–1065,DOI 10.1162/tacl_a_00589。
- Richard Futrell、Kyle Mahowald、Edward Gibson,2015,《Large-scale evidence of dependency length minimization in 37 languages》,Proceedings of the National Academy of Sciences 112(33):10336–10341,DOI 10.1073/pnas.1502134112。
- Liying Pan,2025,《Research on AI tool usage and language acquisition in foreign language education》,Russian Journal of Education and Psychology 16(6):340–361,DOI 10.12731/2658-4034-2025-16-6-1011。
- Mengxiao Zhang、Xun Liu、Weibing Wan、Zhijun Fang,2026,《Optimizing knowledge reasoning with combined graph neural networks and large language models》,Neurocomputing 677:133121,DOI 10.1016/j.neucom.2026.133121。
- Md Rabiul Islam Hridoy、Syada Miel Ahmed,2026,《Psycholinguistic reactivity in large language models: Affective asymmetry under ideological priming》,Computers in Human Behavior: Artificial Humans 9:100340,DOI 10.1016/j.chbah.2026.100340。
- Sabrina Coninx、Pascale Willemsen、Kevin Reuter,2023,《Pain Linguistics: A Case for Pluralism》,The Philosophical Quarterly 74(1):145–168,DOI 10.1093/pq/pqad048。
- Cheryl Gilford、Martin Meyer、Balthasar Bickel、Nina Kazanina,2026,《The Neural Dynamics of Hierarchical Syntactic Structures During Language Comprehension》,JoCN Forum,DOI 10.21428/8e6ba8ef.da8c9a73。
- Paolo Valentinelli,2026,《Low-resource language》,AI-Linguistica. Linguistic Studies on AI-Generated Texts and Discourses 6(1),DOI 10.62408/ai-ling.v6i1.77。
- Jianlong Wu、Wei Liu、Ye Liu、Meng Liu 等,2026,《A Survey on Video Temporal Grounding With Multimodal Large Language Model》,IEEE Transactions on Pattern Analysis and Machine Intelligence 48(2):1521–1541,DOI 10.1109/tpami.2025.3615586。
- Qi Liu、Haozhe Duan、Jiaxin Mao、Ji-Rong Wen,2026,《How Do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective》,ACM Transactions on Information Systems 44(2):1–27,DOI 10.1145/3774942。
核验说明:提出栏优先使用原始论文、专著或正式文集;流变栏只承担后续修订。2006 年后的材料不改变经典条的入选年份。