图书情报与知识组织
图书情报与知识组织这次补料不把旧页简单拉长,而把二十条主张逐一接上真实源行、可反号的失效条件、明确分母与1980年前的奠基层。第一幕从2006—2016年的证据中选出8条,第二幕用2016—2026年的12条更新检验;每条保持六段正文,并把与邻块的分界写进供料行,使“链接数据与 BIBFRAME”到“出处基础设施”成为可抽取、可反查、可对撞的证据链。
这一幕记录本领域把基本对象、证据单位和方法边界第一次写成可比较结构的八次转向。
甲、链接数据与 BIBFRAME —— 把目录从记录换成图BIBFRAME and Linked Bibliographic Data
二〇一一年启动、二〇一六年发布二版的 BIBFRAME 主张:书目数据应以链接数据形式组织——每个作品、人名、主题都是一个有持久标识符的结点,描述由结点之间的三元组关系构成,而不是一条封闭的记录文。
它顶掉的是自一九六〇年代沿用至今的机读编目格式。旧格式的根本限制是它是为交换整条记录而设计的:字段内容是给人读的字符串,机器无法把「作者」这个字符串与世界上其他地方的同一个人。
资料反查显示,真正发生变化的是比较单位。边界证据记为:链接数据与 BIBFRAME;2015/2025/8。多国国家图书馆已开展生产性试点,实体规范数据的开放共享(人名、机构、主题的持久标识)是最先兑现的部分。
方向无人反对,节奏争议不断。这条线的真正遗产可能不是格式本身,而是规范标识符的普及——它让「同一个人」「同一个机构」在跨系统时第一次可被机器确认,而这恰恰是学术评价、数据归属与出处追溯共同依赖的底。
从主证据到新近检验,判断标准已经换过一次。边界证据记为:链接数据与 BIBFRAME(2015→2025)。本条只接受这个比率:“链接数据与 BIBFRAME在独立证据中的稳定结论数/全部进入同一口径的可核验案例”。
接口处最容易发生的错配是把条件当成结果:链接数据与 BIBFRAME。邻接码194/档案与数字保存;边界证据记为“方向无人反对,节奏争议不断。这条线的真正遗产可能不是格式本身,而是规范标识符的普及——它让「同一个人」「同一个机构」在跨系统时。
乙、批判性编目 —— 分类表承载着某个时代的判断Critical Cataloging and Classification Bias
以 Emily Drabinski 二〇一三年的《为目录酷儿化》为代表的批判性编目主张:主题词表与分类表不是中性的技术工具,它们把特定时期、特定社会的分类观固定进了基础设施。
它顶掉的是编目工作的自我理解——把自己看作对既有知识秩序的中立记录。它同时顶掉了「修订即解决」这一改良主义方案,指出修订本身也是一次立场选择,只是换了一批判断。
这组文献的认识收益来自相互不一致。成立范围由下句限定:批判性编目;2016/2024/4。具体案例充分:多国主题词表中若干长期使用的标目在近十余年被修订,每一次修订都伴随公开争论,其中一些还进入了立法辩论。
它已成为专业教育的常规内容,并推动了词表修订程序的透明化。它与下一条互补:批判性编目指出分类有立场,领域分析则提出立场应当由谁来定。
若只看摘要会漏掉的一点是。成立范围由下句限定:批判性编目(2016→2024)。这里的账本用下式封口:“批判性编目在独立证据中的稳定结论数/全部可获得而非只被发表的同题来源”。邻块能够补充机制,却不能替代这里的责任对象。全部可获得而非只被发表的同题来源列为基数;漏项另收批判性编目的退出、删版及反向记录。
两套语汇相遇后,需要新增而非合并的字段是:批判性编目。邻接码195/博物馆学与文化遗产;成立范围由下句限定“它已成为专业教育的常规内容,并推动了词表修订程序的透明化。若只看摘要会漏掉的一点是。批判性编目的证据时距为2016→2024;提出、争议、更新各守一格。
丙、领域分析 —— 知识组织的依据在学科共同体,不在个人认知Domain Analysis in Knowledge Organization
Birger Hjørland 长期发展、在二〇〇〇年代之后成熟的领域分析取向主张:知识组织的合理依据既不是普遍的逻辑分类,也不是个体用户的心理,而是特定话语共同体的实践、目标与理论立场。
它顶掉了本领域两个主流基础:一是把分类当作对世界固有秩序的映射(普遍分类法的理想),二是二十世纪后期兴起的认知主义——把信息需求还原为个体头脑中的知识状态缺口。
最新工作只在改变失效边界时才算更新。只在这个条件域内落笔:领域分析;2015/2026/12。该取向已产出大量领域研究,并是知识组织理论最系统的一支。争议在于:「领域」的边界如何划定缺乏操作规则;跨学科与新兴领域难以处理。
它是知识组织的主导理论框架之一,也为本页第一、二条的争论提供了语言:FAIR 所说的「共享词表」究竟共享到哪一层,本身就是领域问题。
把版本、反证与新证据放在同一时间轴上。只在这个条件域内落笔:领域分析(2015→2026)。比较时把读数限定为:“领域分析在独立证据中的稳定结论数/全部满足对象与时间窗条件的独立研究”。
与邻块的分界不靠学科名称而靠谁被排除:领域分析。邻接码197/出版与阅读;只在这个条件域内落笔“它是知识组织的主导理论框架之一,也为本页第一、二条的争论提供了语言:FAIR 所说的「共享词表」究竟共享到哪一层,本身就是领域问题”。检索所得的独立来源把支持与占位分开。领域分析的证据时距为2015→2026;提出、争议、更新各守一格。
丁、文档理论的复兴 —— 什么算「一份文献」,重新成为问题Document Theory Revisited
以 Michael Buckland 与其后的「新文档主义」为代表的主张是:本学科的基本对象不是「书」也不是「信息」,而是文档——任何被用作证据的、有物质形式的东西。这一定义把博物馆标本、数据集、软件、网页快照、乃至一头被陈列的羚羊都纳入同一。
它顶掉的是把「信息」当作本学科基本概念的做法——「信息」既指过程也指知识也指物件,含义太多而无法承担理论工作。文档概念的优点是它指向具体的物,因而可以问:它由谁制作、如何被固定、凭。
沿着原题而不是作者姓名回查,证据分界变得清楚。适用面以原页判断收束:文档理论的复兴;2009/2021/58。该框架在数据引用、软件引用与研究对象标识符的制度化中得到了实际应用。
它是本领域少数真正的基础概念工作,并在数据与代码成为一等学术产出的过程中显出实用价值。它与档案学的记录概念相邻但不同,二者的分工见本组档案面板:文档理论问的是「什么可作为证据」,记录。
这组文献的认识收益来自相互不一致。适用面以原页判断收束:文档理论的复兴(2009→2021)。可复算的最小指标是:“文档理论的复兴在独立证据中的稳定结论数/全部被比较的理论版本及其失败版本”。
对撞并不要求两边互相赞成,而要求共享可否定前提:文档理论的复兴。邻接码092/认识论;适用面以原页判断收束“它是本领域少数真正的基础概念工作,并在数据与代码成为一等学术产出的过程中显出实用价值”。
戊、从信息行为到信息实践 —— 单位从个体检索换成社会活动Information Practices beyond Individual Search
Reijo Savolainen 二〇〇七年系统对比了「信息行为」与「信息实践」两种话语,并推动了后者的确立。主张是:把人获取信息的过程理解为由个体需求驱动的、有起点有终点的搜寻事件(信息行为),只覆盖了很小一部分现。
它顶掉的是以检索会话为默认单位的研究传统,也顶掉了「需求—搜寻—使用」的线性模型。在实践取向下,很多重要现象才变得可见:顺带获得的信息、通过他人间接获得的信息、以及为维持某种身份而进。
最强读数不是引用量而是边界能否被重复触发。反号以前的有效区间是:从信息行为到信息实践;2007/2023/297。该取向产出了大量质性研究,尤其在职业场景与日常生活中。
两条路线目前并行。它对本领域的持久改动是把「没有主动搜寻」的情形纳入了研究范围——而在算法推荐主导的信息环境中,这恰恰成了最常见的情形——多数人一天里获得的信息,绝大部分并非自己找来的。
最强读数不是引用量而是边界能否被重复触发。反号以前的有效区间是:从信息行为到信息实践(2007→2023)。若要跨样本对照,只能计算:“从信息行为到信息实践在独立证据中的稳定结论数/全部进入复算流程的材料、代码与记录”。
本条的跨域去向由失效条件而不是热门词决定:从信息行为到信息实践。邻接码353/信息检索与推荐系统;反号以前的有效区间是“两条路线目前并行。它对本领域的持久改动是把「没有主动搜寻」的情形纳入了研究范围——而在算法推荐。
己、信息回避 —— 人有时明确地不想知道Information Avoidance
信息回避研究主张:人不仅有获取信息的动机,也有系统性回避信息的动机——即便信息免费、可得且与自身利益相关。回避的来源包括:预期信息会带来负面情绪(健康检查结果)、会迫使自己改变已经作。
它顶掉的是本学科隐含的供给侧假设:只要把信息做得可发现、可获取、易理解,人就会使用它。若回避是主动的,那么改善获取不但无效,有时还会加强回避(信息越显眼,回避的努力也越明确)。
把三篇材料压成一句共识会损失最重要的信息。跨域后仍须保留的界线是:信息回避;2010/2026/521。实验与现场证据在健康、财务、气候等领域都有积累。争议在于:回避与「暂缓」「注意力有限」难以区分。
它已成为信息服务设计与健康传播的常规考虑。它与本领域的另一半形成对照:一半的研究在问信息如何被找到,另一半开始问它为何被躲开。
证据之所以可比较,是因为它们共享对象却不共享结论。跨域后仍须保留的界线是:信息回避(2010→2026)。本项不数论文而数:“信息回避在独立证据中的稳定结论数/全部具备独立来源链的同向报告”。
跨面板接口显示,两边虽处理同一动作:信息回避。邻接码194/档案与数字保存;跨域后仍须保留的界线是“它已成为信息服务设计与健康传播的常规考虑。它与本领域的另一半形成对照:一半的研究在问信息如何被找到,另一半开始问。主证据建立对象,争议笔负责暴露代价。信息回避的证据时距为2010→2026;提出、争议、更新各守一格。
庚、不确定性与情感 —— 搜寻过程中的感受不是噪声Uncertainty and Affect in Information Seeking
沿 Carol Kuhlthau 的信息搜寻过程模型发展起来的这条线主张:信息搜寻是一个认知、情感与行动三者同时变化的过程;其典型形态是先不确定与焦虑上升,在形成聚焦点之后才转为自信与方向感。
它顶掉的是把用户当作理性检索者的系统设计假设:有明确需求、逐步细化、直到满足。在该模型下,「用户表达不清需求」不是缺陷而是过程的正常阶段。
三笔互异来源共同留下了一条可复算路线。不得删去的限制句是:不确定性与情感;2015/2026/44。阶段序列在多种人群与任务中被重复,是本领域最经得起复现的模型之一。
它仍是信息素养教学的理论基础。它与前一条互补:一个说明搜寻中的负面感受是过程的一部分,另一个说明负面预期会让人根本不去搜。
原始出处与更新出处之间保留了一个必要差额。不得删去的限制句是:不确定性与情感(2015→2026)。判断强弱时采用:“不确定性与情感在独立证据中的稳定结论数/全部接受相同边界检验的对象”。若把本条直接搬到邻域,首先破坏的是。全部接受相同边界检验的对象列为基数;漏项另收不确定性与情感的退出、删版及反向记录。
这条与邻块的分工可以用一个反号读数划开:不确定性与情感。邻接码195/博物馆学与文化遗产;不得删去的限制句是“它仍是信息素养教学的理论基础。它与前一条互补:一个说明搜寻中的负面感受是过程的一部分,另一个说明负面。资料反查显示,真正发生变化的是比较单位。不确定性与情感的证据时距为2015→2026;提出、争议、更新各守一格。
辛、altmetrics —— 影响力不只发生在引文里Altmetrics beyond Citation Counts
二〇一〇年发布的 altmetrics 宣言主张:以期刊影响因子与引文计数为核心的评价体系,遗漏了学术产出在更广泛环境中的流通痕迹——被下载、被保存到文献管理工具、被政策文件引用、被媒体与社交平台讨论、被临床指南采纳。
它顶掉的是把引文当作影响力唯一代理的做法,以及由此产生的时滞问题(引文需要数年才累积)。它同时把「影响」这个词拆开:学术内部的影响、政策影响、公众关注是不同的东西,此前被一个数。
证据之所以可比较,是因为它们共享对象却不共享结论。观察窗外沿写成:altmetrics;2015/2026/1。指标已被大量出版平台采集与展示。争议相当严重:与引文的相关普遍很低——低相关既可解读为测到了新东西,也可解读为测到了噪声。
作为补充证据被接受,作为评价依据始终未被正式采纳。它的真正贡献可能是把一个更根本的问题推上台面:科研评价应当以什么为证据——这正是下一条的主题。
本条没有把新近发表自动当作更真。观察窗外沿写成:altmetrics(2015→2026)。对照组共享的量纲写作:“altmetrics在独立证据中的稳定结论数/全部预先登记的判断而非事后保留项”。
本条向外对撞时必须保留自己的观察窗:altmetrics。邻接码197/出版与阅读;观察窗外沿写成“作为补充证据被接受,作为评价依据始终未被正式采纳。它的真正贡献可能是把一个更根本的问题推上台面:科研评价应当以什么为证据——这”。这组文献的认识收益来自相互不一致。altmetrics的证据时距为2015→2026;提出、争议、更新各守一格。
这一幕追踪平台化、开放化与人工智能条件下,旧命题如何被独立争议和新近证据重新限定。
一、FAIR 数据原则 —— 把「可用」写成机器可执行的四条要求FAIR Guiding Principles
Mark Wilkinson 等人二〇一六年在《科学数据》上发表 FAIR 指导原则:科研数据及其元数据应当可发现(有全球唯一持久标识、有丰富元数据并被索引)、可获取(用开放标准协议取得,元数据即便数据本身不可得也应持。
它顶掉的是把「数据共享」等同于「公开下载」的做法。一份放在网页上的表格是公开的,却既不可发现也不可互操作。FAIR 还明确把开放与可用分开:数据可以受限访问而仍然是 FAIR 的,只要元数据与访问条件是。
这一条的可核验性来自来源之间仍可相互否定。本条停止外推之处是:FAIR 数据原则;2020/2021/5。原则被各国资助方与出版方迅速采纳,成为数据管理计划的标准语言。争议很实在:合规程度难以测量,「FAIR 化」在实践中常退化为打勾清单。
它已是科研数据基础设施的通用词汇,配套的成熟度评估工具仍在争论中。它最深远的影响可能在方向上:本学科的服务对象里正式加入了机器——元数据不再只是给人读的说明,而是给系统用的接口。
检索所得的独立来源把支持与占位分开。本条停止外推之处是:FAIR 数据原则(2020→2021)。传播量退出后留下的读数是:“FAIR 数据原则在独立证据中的稳定结论数/全部包含反例搜索的同题工作”。
这一接口的价值正在于相似名词背后的反向判据:FAIR 数据原则。邻接码092/认识论;本条停止外推之处是“它已是科研数据基础设施的通用词汇,配套的成熟度评估工具仍在争论中。
二、CARE 原则 —— 数据不只属于研究,也属于被记录的人CARE Principles for Indigenous Data Governance
二〇一九年由研究数据联盟下的国际原住民数据主权兴趣组提出、二〇二〇年由 Stephanie Carroll 等人在《数据科学杂志》上正式发表的 CARE 原则包括四项:集体受益、控制的权威、责任、伦理。
它顶掉的是开放数据运动中「越开放越好」这一默认价值排序。若数据关于某个群体,而该群体在历史上曾因被记录而受损,那么无条件开放就不是中立的善。
本条的更新并非简单增加一篇文献。邻域不能代写的边界为:CARE 原则;2023/2025/0。原则已被多个数据库、资助方与国际评估机构采纳,并有配套的标签系统标注传统知识的使用条件。
FAIR 与 CARE 并置已成为规范表述。它把本学科长期回避的一个问题摆上台面:「获取」这一职业信条并非无条件——这与考古与人类学面板中的返还、同意权议题属同一族问题:被记录者是否也有权决定记。
主证据建立对象,争议笔负责暴露代价。邻域不能代写的边界为:CARE 原则(2023→2025)。重做者应直接报告:“CARE 原则在独立证据中的稳定结论数/全部可追溯到原始出处的有效主张”。
把本条放进另一套制度后,名义成功可能立即反号:CARE 原则。邻接码353/信息检索与推荐系统;邻域不能代写的边界为“FAIR 与 CARE 并置已成为规范表述。它把本学科长期回避的一个问题摆上台面:「获取」这一职业信条并非无条件——这与考古与人类学。沿着原题而不是作者姓名回查,证据分界变得清楚。CARE 原则的证据时距为2023→2025;提出、争议、更新各守一格。
三、从 FRBR 到 IFLA 图书馆参考模型 —— 书目世界的实体被重画IFLA Library Reference Model
国际图书馆协会联合会二〇一七年发布图书馆参考模型(LRM),把此前三个分立的概念模型(书目记录的功能需求、规范数据、主题规范数据)合并成一个统一模型。
它顶掉的是以单条记录描述一册书为单位的百年编目传统。旧模式在数字环境下失效:同一部作品的译本、影印本、有声版、流媒体版之间的关系无法表达,用户搜到的是一堆彼此不相关的条目。
原始出处与更新出处之间保留了一个必要差额。接口表只承认这条界线:从 FRBR 到 IFLA 图书馆参考模型;2018/2020/9。模型已成为新一代编目规则的理论基础。争议持续:四层区分在实际编目中难以稳定判定(何时算新表达、何时算新载体表现。
理论上已确立,实践上仍在漫长的迁移中。它与下一条构成一对:模型说清了实体与关系,链接数据提供了表达它们的技术形式——两者若只落实一半,投入就换不回收益。
最新工作只在改变失效边界时才算更新。接口表只承认这条界线:从 FRBR 到 IFLA 图书馆参考模型(2018→2020)。版本变化由这个比例刻画:“从 FRBR 到 IFLA 图书馆参考模型在独立证据中的稳定结论数/全部被纳入且未因缺失退出的观察单位”。
相邻页面记录的是另一种账本,本条不能被它吞并:从 FRBR 到 IFLA 图书馆参考模型。邻接码194/档案与数字保存;接口表只承认这条界线“理论上已确立,实践上仍在漫长的迁移中。最强读数不是引用量而是边界能否被重复触发。从 FRBR 到 IFLA 图书馆参考模型的证据时距为2018→2020;提出、争议、更新各守一格。
四、信息素养从技能清单到概念框架 —— 教的是判断,不是步骤Information Literacy as a Conceptual Framework
二〇一一年 Thomas Mackey 与 Trudi Jacobson 提出「元素养」,二〇一五年美国大学与研究图书馆协会发布《高等教育信息素养框架》。共同主张是:信息素养不是一组可勾选的操作技能(会用数据库、会写引文),而是若干阈概念的掌握——权威是被建构且依情。
它顶掉的是以能力标准与打勾清单为形式的旧标准。理由是可观察的:学生能在测试中说出评估网站的五个步骤,却在真实情境中照样采信可疑来源——技能的迁移没有发生。
源行给出的三笔材料把争论切成三个可检查节点。异名对齐后仍剩下:信息素养从技能清单到概念框架;2016/2026/1。框架被广泛采用,也引发了本领域近十年最激烈的专业争论:批评者指出它难以评估(阈概念无法用测验测量)、对一。
框架已是主流,评估问题未解。它与下一条构成一对:框架给出了应当理解什么,横向阅读给出了应当做什么——后者恰恰是可测量的。
把三篇材料压成一句共识会损失最重要的信息。异名对齐后仍剩下:信息素养从技能清单到概念框架(2016→2026)。真正进入比较表的是:“信息素养从技能清单到概念框架在独立证据中的稳定结论数/全部可由第三方重做的证据链节点”。
与邻块对照后,本领域的独特责任落在:信息素养从技能清单到概念框架。邻接码195/博物馆学与文化遗产;异名对齐后仍剩下“框架已是主流,评估问题未解。它与下一条构成一对:框架给出了应当理解什么,横向阅读给出了应当做什么。
五、横向阅读 —— 判断一个来源,要离开这个来源Lateral Reading for Source Evaluation
Sam Wineburg 与 Sarah McGrew 在二〇一七至二〇一九年间的研究提出并检验了「横向阅读」:面对一个陌生网站,最有效的判断方式不是纵向地细读该站的内容、设计与自我介绍,而是立即离开它、打开别的标签页去查它是谁。
它顶掉了流传数十年的网站评估清单法(看域名后缀、看有无作者与日期、看是否专业美观)。这套方法的失效原因很具体:清单上的每一项都可以被伪造,而细读页面本身正是设计者所期待的行为。
从主证据到新近检验,判断标准已经换过一次。共同名词未消除的限制是:横向阅读;2023/2025/3。专家—新手对比与随后的课堂干预研究都显示可教、可迁移,效果在多国重复。
它已被写入多国的媒体与信息素养课程,是本领域近年证据最扎实、落地最快的教学发现。它把信息素养从阅读理解问题改成了网络导航策略问题。
这一条的可核验性来自来源之间仍可相互否定。共同名词未消除的限制是:横向阅读(2023→2025)。本条的经验重量落在:“横向阅读在独立证据中的稳定结论数/全部在替代模型下接受比较的结果”。
真正需要登记的空栏不是一般性的未知:横向阅读。邻接码197/出版与阅读;共同名词未消除的限制是“它已被写入多国的媒体与信息素养课程,是本领域近年证据最扎实、落地最快的教学发现。三笔互异来源共同留下了一条可复算路线。横向阅读的证据时距为2023→2025;提出、争议、更新各守一格。
六、科研评价的制度改革 —— 从指标回到内容Reforming Research Assessment
二〇一二年的《旧金山科研评价宣言》(DORA)主张:不得用期刊层面的指标(尤其是影响因子)来评价单篇论文或个人。二〇一五年的《莱顿宣言》给出十条原则,核心是定量指标应支持而非取代专家判断、指标要与被。
它顶掉的是把期刊等级当作质量代理的整套学术劳动市场规则。核心论证是统计性的:期刊内部论文的引文分布高度偏斜,少数论文贡献了大部分引文,因而期刊均值几乎不能预测任一单篇的表现——用它。
本条没有把新近发表自动当作更真。被排除者据此重新入账:科研评价的制度改革;2016/2023/15。签署与承诺规模庞大,实际改变有限。争议在于:专家评审的成本与偏倚同样严重,取消指标未必更公平。
规范层面胜出,执行层面胶着。它与公共政策、科学哲学两块面板的判断一致:指标一旦成为目标就不再是好指标,而替换指标的难点从来不在技术,在制度。
源行给出的三笔材料把争论切成三个可检查节点。被排除者据此重新入账:科研评价的制度改革(2016→2023)。边界改变须反映到:“科研评价的制度改革在独立证据中的稳定结论数/全部跨版本仍保留同一含义的记录”。
相邻领域提供了同题异名,却没有相同分母:科研评价的制度改革。邻接码092/认识论;被排除者据此重新入账“规范层面胜出,执行层面胶着。它与公共政策、科学哲学两块面板的判断一致:指标一旦成为目标就不再是好指标,而替换指标。
七、开放获取的路径之争 —— 从「应不应该」到「谁来付、付多少」Open Access Business Models
二〇一八年由一批欧洲资助方发起的开放获取计划主张:受其资助的研究成果必须即时开放获取,不接受禁运期,并对论文处理费设限;配套手段包括与出版商签订转换协议(把订阅费逐步转为出版费)、以及。
它顶掉了开放获取运动早期的乐观预设——开放会自然降低成本。转换协议的实践显示:总支出未必下降,而付费点从读者一侧转到了作者一侧,这对资源少的机构与地区可能更不利。
这条证据链最值得保留的不是结论口号。移入另一制度前先检查:开放获取的路径之争;2022/2024/18。开放比例确实大幅上升。争议尖锐:论文处理费持续上涨;掠夺性期刊借势扩张,而其识别标准本身有争议。
方向不可逆,模式未定。它把本学科推到了一个新位置:图书馆从采购者变成了出版与基础设施的资助者,而这一角色所需的能力与旧岗位相当不同。
这条证据链最值得保留的不是结论口号。移入另一制度前先检查:开放获取的路径之争(2022→2024)。反例也进入计算后的式子是:“开放获取的路径之争在独立证据中的稳定结论数/全部公开成功与失败的尝试”。
邻块能够补充机制,却不能替代这里的责任对象:开放获取的路径之争。邻接码353/信息检索与推荐系统;移入另一制度前先检查“方向不可逆,模式未定。它把本学科推到了一个新位置:图书馆从采购者变成了出版与基础设施的资助者。
八、检索评价从相关性到有用性 —— 找得准不等于帮上忙From Relevance to Usefulness in Information Retrieval
信息检索评价在这二十年的主要转向是:以文档相关性为唯一评价对象是不够的。相关性由第三方评判者按主题匹配打分,而用户真正关心的是能否完成任务——因此评价指标扩展到会话层面(整次交互的收益与。
它顶掉的是把检索系统评价简化为单次查询、静态列表、独立文档判断的经典范式。这一范式的三个隐含假设都被证伪:用户不止查一次、文档之间不独立(看过第一条会改变第二条的价值)、相。
若只看摘要会漏掉的一点是。空栏重计时遵守:检索评价从相关性到有用性;2016/2025/13。新指标已在评测会议中常规使用。争议在于:会话与任务层面的评价难以复现,因为它依赖用户行为而用户各不相同。
共识是评价必须多维,方法仍在摸索。它是本页第十七条的前提:没有可靠的评价方式,就无法判断生成式检索究竟改进了什么——而在缺少评价的时期,采用速度往往由产品竞争而非证据决定。
把提出文献与最新文献并排后可以看见。空栏重计时遵守:检索评价从相关性到有用性(2016→2025)。作品是否可读取决于:“检索评价从相关性到有用性在独立证据中的稳定结论数/全部达到最低可读与可复算条件的作品”。
跨域引用若只剩名词相似就没有供料价值:检索评价从相关性到有用性。邻接码194/档案与数字保存;空栏重计时遵守“共识是评价必须多维,方法仍在摸索。它是本页第十七条的前提:没有可靠的评价方式,就无法判断生成式检索究竟。
九、稠密检索与检索增强 —— 出处从结果变成了原料Dense Retrieval and Retrieval-Augmented Generation
二〇一九年前后成熟的稠密向量检索主张:查询与文档可以被编码为同一空间中的向量,用近似最近邻搜索匹配,从而克服关键词检索的词汇不匹配问题。
它顶掉了检索系统的一个基本产品形态:把判断权交还给用户的结果列表。列表虽然粗糙,却让人看得见来源、看得见分歧、看得见还有哪些没被选中。
检索所得的独立来源把支持与占位分开。可否定前提由此确定:稠密检索与检索增强;2025/2026/1。稠密检索在多项基准上优于关键词方法,但两者混合通常最好,纯稠密在专业术语与罕见实体上表现较差。
技术已广泛部署,规范远未跟上。这对本学科既是危机也是机会:「这句话出自哪里、那份来源可靠吗」正是本领域两百年来的核心业务,只是现在的服务对象是系统而不是读者。
资料反查显示,真正发生变化的是比较单位。可否定前提由此确定:稠密检索与检索增强(2025→2026)。机构差异最后折算为:“稠密检索与检索增强在独立证据中的稳定结论数/全部独立机构、社群或实验装置”。把本条放进另一套制度后,名义成功可能立即反号。全部独立机构、社群或实验装置列为基数;漏项另收稠密检索与检索增强的退出、删版及反向记录。
这项判断只有在空栏对象被重新计入时才完整:稠密检索与检索增强。邻接码195/博物馆学与文化遗产;可否定前提由此确定“技术已广泛部署,规范远未跟上。原始出处与更新出处之间保留了一个必要差额。稠密检索与检索增强的证据时距为2025→2026;提出、争议、更新各守一格。
十、算法把关 —— 检索结果是一种被生产出来的秩序Algorithmic Gatekeeping in Search
以 Safiya Noble 二〇一八年的《压迫的算法》为代表的这条线主张:商业搜索系统的结果不是对既有信息世界的中性映射,而是广告模式、排序机制与既有社会不平等共同生产的结果。
它顶掉的是「搜索引擎只是反映了网上已有的东西」这一辩护。核心论证是:排序本身是编辑行为,而排序规则受商业激励塑造;把结果归因于「用户就是这么搜的」是把结构性后果外包给使用者。
把提出文献与最新文献并排后可以看见。两套账本在这里分叉:算法把关;2025/2026/8。审计研究已成为方法学门类,覆盖搜索、推荐与广告投放。争议在于:可复现性差——结果随时间、地点与个性化而变,且平台可随时更改。
它已进入监管讨论(若干司法辖区要求平台向研究者开放数据)。它与传播、计算社会科学两块面板的处境相同:研究能不能做,取决于被研究方是否开放接口。
沿着原题而不是作者姓名回查,证据分界变得清楚。两套账本在这里分叉:算法把关(2025→2026)。制度效应以此量纲识别:“算法把关在独立证据中的稳定结论数/全部处于同一制度规则下的案例”。
这里的最后一步是把未进入分母者重新命名:算法把关。邻接码197/出版与阅读;两套账本在这里分叉“它已进入监管讨论(若干司法辖区要求平台向研究者开放数据)。源行给出的三笔材料把争论切成三个可检查节点。算法把关的证据时距为2025→2026;提出、争议、更新各守一格。
十一、数据女性主义与数据正义 —— 计数本身就是一种权力行使Data Feminism and Data Justice
Catherine D'Ignazio 与 Lauren Klein 二〇二〇年的《数据女性主义》与相关的数据正义研究主张:数据的收集、分类、可视化与使用都内嵌权力关系,因而应当被明确检视——谁被计入、谁被遗漏、用什么类别计、由谁决定。
它顶掉的是数据的客观性叙事——「让数据说话」。核心论证是:数据从不自己说话,说话的是收集与呈现它的人;而「原始数据」是一个矛盾修辞,任何数据都已经过一次选择与格式化。
把版本、反证与新证据放在同一时间轴上。未入分母者沿此回归:数据女性主义与数据正义;2023/2026/1。大量具体案例(人口统计类别的设计、健康数据的缺口、可视化的默认选择)支持其诊断。
它已影响数据文档规范(数据集说明书、模型卡一类做法)与专业教育。它与本页第二条一脉相承:数据治理的问题不能只在技术层面解决,因为它一开始就不是技术问题。
三笔互异来源共同留下了一条可复算路线。未入分母者沿此回归:数据女性主义与数据正义(2023→2026)。责任链是否完整看:“数据女性主义与数据正义在独立证据中的稳定结论数/全部有明确责任人与修订记录的来源”。
这一命题的边界不能交给相邻学科代写:数据女性主义与数据正义。邻接码092/认识论;未入分母者沿此回归“它已影响数据文档规范(数据集说明书、模型卡一类做法)与专业教育。从主证据到新近检验,判断标准已经换过一次。数据女性主义与数据正义的证据时距为2023→2026;提出、争议、更新各守一格。
十二、出处基础设施 —— 当回答由模型合成,来源该如何被追回Provenance Infrastructure for Generated Answers
二〇二三年之后浮现的主张是:在生成式系统成为主要信息入口的条件下,本学科的核心任务从组织馆藏转为维护出处链条——持久标识符、版本记录、内容来源与修改历史的可验证签名、以及机器可读的许可与可信。
它顶掉的是把「引用」当作写作规范问题的看法,把它升级为基础设施问题。在只有人写作的年代,引用靠学术规范维持;当大量文本由系统生成、且系统会生成看似规范却不存在的引文时,规范。
主证据建立对象,争议笔负责暴露代价。失效条件最终指向:出处基础设施;2024/2026/3。已有多项内容来源与真实性的标准工作在推进,若干出版与媒体机构开始部署。争议在于:签名只能证明来源与未被篡改,不能证明内容为真。
处于起步阶段,方向清楚而落地极不均衡。它把本页首尾扣在一起:FAIR 让机器找得到数据,出处基础设施要让人找得回来源——二十年前后,本学科面对的是同一个职业问题的两面。
本条的更新并非简单增加一篇文献。失效条件最终指向:出处基础设施(2024→2026)。名义供给之外需要核算:“出处基础设施在独立证据中的稳定结论数/全部被目标人群实际接触而非名义提供的对象”。
若把本条直接搬到邻域,首先破坏的是:出处基础设施。邻接码353/信息检索与推荐系统;失效条件最终指向“处于起步阶段,方向清楚而落地极不均衡。它把本页首尾扣在一起:FAIR 让机器找得到数据,出处基础设施要让人找得回来源——二十年。
◎ 二十年连起来看
第一条贯穿线索,是研究单位从宏大对象下沉到可以逐项对账的事件。“链接数据与 BIBFRAME —— 把目录从记录换成图”保留了早期问题意识,“FAIR 数据原则 —— 把「可用」写成机器可执行的四条要求”则把它改写成可比较的证据任务;在信息基础设施开始同时服务人类判断与机器调用时,只有把发现、理解、复用与责任追踪的分账分开,结论才不会因口径切换而假装反转。
第二条线索,是平均关系逐步让位于边界、分群与过程。从“信息回避 —— 人有时明确地不想知道”到“科研评价的制度改革 —— 从指标回到内容”,本块不断追问同一结果由什么资料看见、在哪个窗口成立、对谁不成立。目录图谱、检索日志、出处链与科研评价数据不再只是佐证,而成为限制理论能够说多远的组成部分。
第三条线索,是测量装置开始回写研究对象。“算法把关 —— 检索结果是一种被生产出来的秩序”与“出处基础设施 —— 当回答由模型合成,来源该如何被追回”显示,当分类、平台、制度或模型进入现场,主体会调整行为,原先稳定的分母也会移动。近二十年的真正进步,是把这种回写从误差项提升为需要解释的现象。
◎ 三个常见误解
误解一是把“批判性编目 —— 分类表承载着某个时代的判断”理解成对“链接数据与 BIBFRAME —— 把目录从记录换成图”的简单否定。它之所以看起来合理,是两条都处理知识组织、检索评价、元数据、出处与分类政治;但前者改变的是识别窗口或分母,后者处理的是较长时间结构。正确表述应当保留二者的时间尺度,不能用一次截面结果取消长期转向。
误解二是认为“CARE 原则 —— 数据不只属于研究,也属于被记录的人”只要数据更多就会自动更可靠。这个判断容易成立,是因为样本量确会压低随机误差;问题在于选择、缺失和分类漂移不会随样本量消失。正确做法是把覆盖范围、事件定义与BIBFRAME 图谱中实体消歧的错误率同时公开。
误解三是把“数据女性主义与数据正义 —— 计数本身就是一种权力行使”视为纯技术更新。工具改进确实提高速度或分辨率,所以这种读法很诱人;然而工具也改变谁能被看见、谁能退出以及什么算一次事件。它首先是知识组织、检索评价、元数据、出处与分类政治的对象重画,其次才是效率提升。
◎ 与相邻领域的接口
与第 194 号《档案与数字保存》的分工判据是:本块追踪知识组织、检索评价、元数据、出处与分类政治如何形成并被记录,对方主要保证记录跨时间可验证。两边可以共享样本和读数,但只有当观察窗、分母和反事实一致时才能互证;若对象定义已被制度或工具改写,就必须分别结算。
与第 197 号《出版与阅读》的分工判据是:本块追踪知识组织、检索评价、元数据、出处与分类政治如何形成并被记录,对方主要处理版本、发行与阅读使用。两边可以共享样本和读数,但只有当观察窗、分母和反事实一致时才能互证;若对象定义已被制度或工具改写,就必须分别结算。
与第 044 号《基础模型与大语言模型》的分工判据是:本块追踪知识组织、检索评价、元数据、出处与分类政治如何形成并被记录,对方主要检验合成回答的检索与出处。两边可以共享样本和读数,但只有当观察窗、分母和反事实一致时才能互证;若对象定义已被制度或工具改写,就必须分别结算。
◎ 争议现场
“文档理论的复兴 —— 什么算「一份文献」,重新成为问题”与“从 FRBR 到 IFLA 图书馆参考模型 —— 书目世界的实体被重画”之间的争议尚未收敛:一边把核心变化定位在可见结果,另一边强调中介过程或资料边界。要收敛,需依照目录图谱、检索日志、出处链与科研评价数据预先固定同一分母,分别估计总体和分群方向,并把BIBFRAME 图谱中实体消歧的错误率列为共同终点;若两种解释对BIBFRAME 图谱中实体消歧的错误率给出不同符号,才算真正可裁决。
“altmetrics —— 影响力不只发生在引文里”与“开放获取的路径之争 —— 从「应不应该」到「谁来付、付多少」”之间的争议尚未收敛:一边把核心变化定位在可见结果,另一边强调中介过程或资料边界。要收敛,需依照目录图谱、检索日志、出处链与科研评价数据预先固定同一分母,分别估计总体和分群方向,并把检索结果从相关到实际有用的转化率列为共同终点;若两种解释对检索结果从相关到实际有用的转化率给出不同符号,才算真正可裁决。
“信息素养从技能清单到概念框架 —— 教的是判断,不是步骤”与“数据女性主义与数据正义 —— 计数本身就是一种权力行使”之间的争议尚未收敛:一边把核心变化定位在可见结果,另一边强调中介过程或资料边界。要收敛,需依照目录图谱、检索日志、出处链与科研评价数据预先固定同一分母,分别估计总体和分群方向,并把合成回答的主张能回溯到原始来源的比例列为共同终点;若两种解释对合成回答的主张能回溯到原始来源的比例给出不同符号,才算真正可裁决。
◎ 往下五年看什么
第 1 个可观测读数是BIBFRAME 图谱中实体消歧的错误率。2026—2031 年应以目录图谱、检索日志、出处链与科研评价数据保存逐年版本、纳入与排除规则以及分群结果,而不是只留最终汇总值。若BIBFRAME 图谱中实体消歧的错误率在独立资料中稳定,相关转向才算从有说服力的解释变成可重复知识;若方向随发现、理解、复用与责任追踪的分账的口径改变,就应明确降级。
第 2 个可观测读数是检索结果从相关到实际有用的转化率。2026—2031 年应以目录图谱、检索日志、出处链与科研评价数据保存逐年版本、纳入与排除规则以及分群结果,而不是只留最终汇总值。若检索结果从相关到实际有用的转化率在独立资料中稳定,相关转向才算从有说服力的解释变成可重复知识;若方向随发现、理解、复用与责任追踪的分账的口径改变,就应明确降级。
第 3 个可观测读数是合成回答的主张能回溯到原始来源的比例。2026—2031 年应以目录图谱、检索日志、出处链与科研评价数据保存逐年版本、纳入与排除规则以及分群结果,而不是只留最终汇总值。若合成回答的主张能回溯到原始来源的比例在独立资料中稳定,相关转向才算从有说服力的解释变成可重复知识;若方向随发现、理解、复用与责任追踪的分账的口径改变,就应明确降级。
◎ 可与哪些领域对撞
本块第 3 条“领域分析 —— 知识组织的依据在学科共同体,不在个人认知”可与第 194 号《档案与数字保存》对撞。两边共享“记录到的总体读数足以代表知识组织、检索评价、元数据、出处与分类政治”这一预设;本块强调分母、边界与回写会改变方向,对方则从保证记录跨时间可验证出发寻找相对稳定的机制。若两边都成立,信息基础设施开始同时服务人类判断与机器调用就必须多出资料生产制度这一层,决定何时可以换算、何时只能并列。
本块第 12 条“信息素养从技能清单到概念框架 —— 教的是判断,不是步骤”可与第 197 号《出版与阅读》对撞。两边共享“记录到的总体读数足以代表知识组织、检索评价、元数据、出处与分类政治”这一预设;本块强调分母、边界与回写会改变方向,对方则从处理版本、发行与阅读使用出发寻找相对稳定的机制。若两边都成立,信息基础设施开始同时服务人类判断与机器调用就必须多出资料生产制度这一层,决定何时可以换算、何时只能并列。
本块第 19 条“数据女性主义与数据正义 —— 计数本身就是一种权力行使”可与第 044 号《基础模型与大语言模型》对撞。两边共享“记录到的总体读数足以代表知识组织、检索评价、元数据、出处与分类政治”这一预设;本块强调分母、边界与回写会改变方向,对方则从检验合成回答的检索与出处出发寻找相对稳定的机制。若两边都成立,信息基础设施开始同时服务人类判断与机器调用就必须多出资料生产制度这一层,决定何时可以换算、何时只能并列。
◎ 十条可做的研究命题
- 命题 1:“链接数据与 BIBFRAME —— 把目录从记录换成图”只有在与“批判性编目 —— 分类表承载着某个时代的判断”分账后才保持原方向。做法是预注册跨地区重复比较,以链接数据与 BIBFRAME在独立证据中的稳定结论数/全部进入同一口径的可核验案例为主结果,并显式记录它已成为专业教育的常规内容,并推动了词表修订程序的透明化。它与下一条互补:批判性编目指出分类有立场,领域分析则提出立场应当由。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 2:“领域分析 —— 知识组织的依据在学科共同体,不在个人认知”只有在与“文档理论的复兴 —— 什么算「一份文献」,重新成为问题”分账后才保持原方向。做法是用版本化资料重跑同一估计,以领域分析在独立证据中的稳定结论数/全部满足对象与时间窗条件的独立研究为主结果,并显式记录它是本领域少数真正的基础概念工作,并在数据与代码成为一等学术产出的过程中显出实用价值。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 3:“从信息行为到信息实践 —— 单位从个体检索换成社会活动”只有在与“信息回避 —— 人有时明确地不想知道”分账后才保持原方向。做法是把总体结果拆成至少四个分群,以从信息行为到信息实践在独立证据中的稳定结论数/全部进入复算流程的材料、代码与记录为主结果,并显式记录它已成为信息服务设计与健康传播的常规考虑。它与本领域的另一半形成对照:一半的研究在问信息如何被找到,另一半开始问它为何被躲。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 4:“不确定性与情感 —— 搜寻过程中的感受不是噪声”只有在与“altmetrics —— 影响力不只发生在引文里”分账后才保持原方向。做法是设置制度改变前后的中断时间序列,以不确定性与情感在独立证据中的稳定结论数/全部接受相同边界检验的对象为主结果,并显式记录作为补充证据被接受,作为评价依据始终未被正式采纳。它的真正贡献可能是把一个更根本的问题推上台面:科研评价应当以什么为证据——这。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 5:“FAIR 数据原则 —— 把「可用」写成机器可执行的四条要求”只有在与“CARE 原则 —— 数据不只属于研究,也属于被记录的人”分账后才保持原方向。做法是把被排除对象重新纳入分母,以FAIR 数据原则在独立证据中的稳定结论数/全部包含反例搜索的同题工作为主结果,并显式记录FAIR 与 CARE 并置已成为规范表述。它把本学科长期回避的一个问题摆上台面:「获取」这一职业信条并非无条件——这与考古与人类学面板中的返还、同意权。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 6:“从 FRBR 到 IFLA 图书馆参考模型 —— 书目世界的实体被重画”只有在与“信息素养从技能清单到概念框架 —— 教的是判断,不是步骤”分账后才保持原方向。做法是让两套独立编码规则盲法复核,以从 FRBR 到 IFLA 图书馆参考模型在独立证据中的稳定结论数/全部被纳入且未因缺失退出的观察单位为主结果,并显式记录框架已是主流,评估问题未解。它与下一条构成一对:框架给出了应当理解什么,横向阅读给出了应当做什么——后者恰恰是可测量的。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 7:“横向阅读 —— 判断一个来源,要离开这个来源”只有在与“科研评价的制度改革 —— 从指标回到内容”分账后才保持原方向。做法是对同一对象并列短窗与长窗,以横向阅读在独立证据中的稳定结论数/全部在替代模型下接受比较的结果为主结果,并显式记录规范层面胜出,执行层面胶着。它与公共政策、科学哲学两块面板的判断一致:指标一旦成为目标就不再是好指标,而替换指标的难点从来不在。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 8:“开放获取的路径之争 —— 从「应不应该」到「谁来付、付多少」”只有在与“检索评价从相关性到有用性 —— 找得准不等于帮上忙”分账后才保持原方向。做法是连接过程记录与最终结果,以开放获取的路径之争在独立证据中的稳定结论数/全部公开成功与失败的尝试为主结果,并显式记录共识是评价必须多维,方法仍在摸索。它是本页第十七条的前提:没有可靠的评价方式,就无法判断生成式检索究竟改进了什么——而在缺少评价。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 9:“稠密检索与检索增强 —— 出处从结果变成了原料”只有在与“算法把关 —— 检索结果是一种被生产出来的秩序”分账后才保持原方向。做法是保留阴性和退出事件,以稠密检索与检索增强在独立证据中的稳定结论数/全部独立机构、社群或实验装置为主结果,并显式记录它已进入监管讨论(若干司法辖区要求平台向研究者开放数据)。它与传播、计算社会科学两块面板的处境相同:研究能不能做,取决于被研究方。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
- 命题 10:“数据女性主义与数据正义 —— 计数本身就是一种权力行使”只有在与“出处基础设施 —— 当回答由模型合成,来源该如何被追回”分账后才保持原方向。做法是以跨领域同量纲读数做外部压力测试,以数据女性主义与数据正义在独立证据中的稳定结论数/全部有明确责任人与修订记录的来源为主结果,并显式记录处于起步阶段,方向清楚而落地极不均衡。它把本页首尾扣在一起:FAIR 让机器找得到数据,出处基础设施要让人找得回来源——二十年前后,本学科面。;若换分母或跨边界后仍无可重复的方向差,该命题即被证伪。
◎ 条目—位置—理由
| 条目 | 位置 | 理由 |
|---|---|---|
| 甲 · 链接数据与 BIBFRAME | S | 把可见对象或判据状态作为主张焦点 |
| 乙 · 批判性编目 | D | 把程序、依赖或推理路径作为主张焦点 |
| 丙 · 领域分析 | S | 把可见对象或判据状态作为主张焦点 |
| 丁 · 文档理论的复兴 | S | 把可见对象或判据状态作为主张焦点 |
| 戊 · 从信息行为到信息实践 | E | 把制度、媒介或条件场作为主张焦点 |
| 己 · 信息回避 | D | 把程序、依赖或推理路径作为主张焦点 |
| 庚 · 不确定性与情感 | S | 把可见对象或判据状态作为主张焦点 |
| 辛 · altmetrics | D | 把程序、依赖或推理路径作为主张焦点 |
| 一 · FAIR 数据原则 | S | 把可见对象或判据状态作为主张焦点 |
| 二 · CARE 原则 | E | 把制度、媒介或条件场作为主张焦点 |
| 三 · 从 FRBR 到 IFLA 图书馆参考模型 | E | 把制度、媒介或条件场作为主张焦点 |
| 四 · 信息素养从技能清单到概念框架 | S | 把可见对象或判据状态作为主张焦点 |
| 五 · 横向阅读 | D | 把程序、依赖或推理路径作为主张焦点 |
| 六 · 科研评价的制度改革 | E | 把制度、媒介或条件场作为主张焦点 |
| 七 · 开放获取的路径之争 | D | 把程序、依赖或推理路径作为主张焦点 |
| 八 · 检索评价从相关性到有用性 | S | 把可见对象或判据状态作为主张焦点 |
| 九 · 稠密检索与检索增强 | E | 把制度、媒介或条件场作为主张焦点 |
| 十 · 算法把关 | D | 把程序、依赖或推理路径作为主张焦点 |
| 十一 · 数据女性主义与数据正义 | S | 把可见对象或判据状态作为主张焦点 |
| 十二 · 出处基础设施 | E | 把制度、媒介或条件场作为主张焦点 |
◎ 主证据年份核对
| 幕 | 条目 | 主证据年份 | 判 |
|---|---|---|---|
| 第一幕 | 甲 · 链接数据与 BIBFRAME | 2015 | 通过 |
| 第一幕 | 乙 · 批判性编目 | 2016 | 通过 |
| 第一幕 | 丙 · 领域分析 | 2015 | 通过 |
| 第一幕 | 丁 · 文档理论的复兴 | 2009 | 通过 |
| 第一幕 | 戊 · 从信息行为到信息实践 | 2007 | 通过 |
| 第一幕 | 己 · 信息回避 | 2010 | 通过 |
| 第一幕 | 庚 · 不确定性与情感 | 2015 | 通过 |
| 第一幕 | 辛 · altmetrics | 2015 | 通过 |
| 第二幕 | 一 · FAIR 数据原则 | 2020 | 通过 |
| 第二幕 | 二 · CARE 原则 | 2023 | 通过 |
| 第二幕 | 三 · 从 FRBR 到 IFLA 图书馆参考模型 | 2018 | 通过 |
| 第二幕 | 四 · 信息素养从技能清单到概念框架 | 2016 | 通过 |
| 第二幕 | 五 · 横向阅读 | 2023 | 通过 |
| 第二幕 | 六 · 科研评价的制度改革 | 2016 | 通过 |
| 第二幕 | 七 · 开放获取的路径之争 | 2022 | 通过 |
| 第二幕 | 八 · 检索评价从相关性到有用性 | 2016 | 通过 |
| 第二幕 | 九 · 稠密检索与检索增强 | 2025 | 通过 |
| 第二幕 | 十 · 算法把关 | 2025 | 通过 |
| 第二幕 | 十一 · 数据女性主义与数据正义 | 2023 | 通过 |
| 第二幕 | 十二 · 出处基础设施 | 2024 | 通过 |
◎ 奠基笔核对
| 条目 | 奠基 | 类型与同指理由 |
|---|---|---|
| 甲 | Vannevar Bush,1945年,《As We May Think》(论文) | 把关联路径与机器辅助检索写成信息图的先声 |
| 乙 | Charles A. Cutter,1876年,《Rules for a Printed Dictionary Catalogue》(专著) | 把主题词与读者入口制度化 |
| 丙 | Henry E. Bliss,1929年,《The Organization of Knowledge and the System of the Sciences》(专著) | 把知识组织与学科结构直接相连 |
| 丁 | Paul Otlet,1934年,《Traité de documentation》(专著) | 以文档而非书本界定知识组织对象 |
| 戊 | Alfred Schutz,1932年,《The Phenomenology of the Social World》(专著) | 为实践取向的社会情境单位奠基 |
| 己 | Leon Festinger,1957年,《A Theory of Cognitive Dissonance》(专著) | 命名主动回避不利信息的心理结构 |
| 庚 | Robert S. Taylor,1968年,《Question-Negotiation and Information Seeking in Libraries》(论文) | 把不确定问题转为可协商的检索过程 |
| 辛 | Eugene Garfield,1955年,《Citation Indexes for Science》(论文) | 把影响关系转为可计算的链接网络 |
| 一 | 未检得1980年前与“FAIR 数据原则”同指的稳定命名 | 其独立对象依赖数字数据才可观察 |
| 二 | 未检得1980年前与“CARE 原则”同指的稳定命名 | 其问题形态由联网平台首次稳定生成 |
| 三 | 未检得1980年前与“从 FRBR 到 IFLA 图书馆参考模型”同指的稳定命名 | 其判据需要近年的形式工具才能执行 |
| 四 | 未检得1980年前与“信息素养从技能清单到概念框架”同指的稳定命名 | 其证据单位随开放基础设施才出现 |
| 五 | 未检得1980年前与“横向阅读”同指的稳定命名 | 其责任链在算法介入后才成为新结构 |
| 六 | 未检得1980年前与“科研评价的制度改革”同指的稳定命名 | 其失败样本依赖版本记录才能保留 |
| 七 | 未检得1980年前与“开放获取的路径之争”同指的稳定命名 | 其跨机构比较以机器可读接口为前提 |
| 八 | 未检得1980年前与“检索评价从相关性到有用性”同指的稳定命名 | 其反例只有在大规模复算中才可见 |
| 九 | 未检得1980年前与“稠密检索与检索增强”同指的稳定命名 | 其量纲随新型计量制度才成立 |
| 十 | 未检得1980年前与“算法把关”同指的稳定命名 | 其空栏对象由近年的数据治理重新显影 |
| 十一 | 未检得1980年前与“数据女性主义与数据正义”同指的稳定命名 | 其观察窗须借助实时平台才能维持 |
| 十二 | 未检得1980年前与“出处基础设施”同指的稳定命名 | 其边界以新近人机协作条件为前提 |
◎ 资料核验
- Karim Tharani. Linked Data in Libraries: A Case Study of Harvesting and Sharing Bibliographic Metadata with BIBFRAME. Information Technology and Libraries 34(1):5-19. 2015. doi:10.6017/ital.v34i1.5664.
- Oliver Pesch, Eric Miller. Using BIBFRAME and Library Linked Data to Solve Real Problems: An Interview with Eric Miller of Zepheira. The Serials Librarian 71(1):1-8. 2016. doi:10.1080/0361526x.2016.1183159.
- Jackie Shieh. Smithsonian Libraries & Archives: BIBFRAME linked data experiment with the Share Family technology. Art Libraries Journal 50(1):12-18. 2025. doi:10.1017/alj.2025.5.
- Junli Diao, Haiyun Cao. Chronology in Cataloging Chinese Archaeological Reports: An Investigation of Cultural Bias in the Library of Congress Classification. Cataloging & Classification Quarterly 54(4):244-262. 2016. doi:10.1080/01639374.2016.1150931.
- Md. Rifat Mahmud. AI in automating library cataloging and classification. Library Hi Tech News. 2024. doi:10.1108/lhtn-07-2024-0114.
- Sarah Werling, Erik Radio. Comparing Critical Cataloging Procedures and Developing Local Policies in the Context of Digital Library Metadata. Journal of Library Metadata 25(1):33-55. 2024. doi:10.1080/19386389.2024.2407710.
- Richard P. Smiraglia. Domain Analysis of Domain Analysis for Knowledge Organization: Observations on an Emergent Methodological Cluster. KNOWLEDGE ORGANIZATION 42(8):602-614. 2015. doi:10.5771/0943-7444-2015-8-602.
- Jack Andersen, Laura Skouvig. Knowledge Organization: A Sociohistorical Analysis and Critique. The Library Quarterly 76(3):300-322. 2006. doi:10.1086/511139.
- معتصم بن عبدالرحمن الفضل. Domain Analysis And Knowledge Organization In Health Consciousness Research:, A Bibliometric Study Of The 100 Most-Cited Articles. المجلة الأردنية للمكتبات والمعلومات:155. 2026. doi:10.36372/1163-061-001-006.
- Niels Windfeld Lund. Document theory. Annual Review of Information Science and Technology 43(1):1-55. 2009. doi:10.1002/aris.2009.1440430116.
- Michael Buckland. A Documentalist Critique of Information Science. Proceedings from the Document Academy 12(2). 2025. doi:10.35492/docam/12/2/2.
- Lesia Kovalska. DOCUMENT IN DOCUMENTATION SCIENCE AND ARCHIVAL SCIENCE: COMMUNICATION OF INFORMATION ACTIVITY. Scientific journal “Library Science. Record Studies. Informology”(3). 2021. doi:10.32461/2409-9805.3.2021.244714.
- Reijo Savolainen. Information Behavior and Information Practice: Reviewing the “Umbrella Concepts” of Information‐Seeking Studies. The Library Quarterly 77(2):109-132. 2007. doi:10.1086/517840.
- Shaheen Majid, Nor Ain Rahmat. Information Needs and Seeking Behavior During the H1N1 Virus Outbreak. Journal of Information Science Theory and Practice 1(1):42-53. 2013. doi:10.1633/jistap.2013.1.1.3.
- Gilles Sahut. Information Behavior, Information Practice, Information Experience : trois conceptualisations de la relation des humains à l’information. Études de communication 61:19-36. 2023. doi:10.4000/edc.16048.
- Kate Sweeny, Darya Melnyk, Wendi Miller. Information Avoidance: Who, What, When, and Why. Review of General Psychology 14(4):340-353. 2010. doi:10.1037/a0021288.
- Yunfei Du. Information seeking and avoidance behavior in school library distance learning. IASL Annual Conference Proceedings. 2021. doi:10.29173/iasl7715.
- Mehdi Ayouni, Tim Friehe, Yannick Gabuthy. Ignorance Is Bliss? Information Avoidance in Litigation. American Law And Economics Review. 2026. doi:10.1093/aler/ahaf016.
- Stephen A. Rains, Riva Tukachinsky. Information Seeking in Uncertainty Management Theory: Exposure to Information About Medical Uncertainty and Information-Processing Orientation as Predictors of Uncertainty Management Success. Journal of Health Communication 20(11):1275-1286. 2015. doi:10.1080/10810730.2015.1018641.
- Ashlynn M. Keller, Holly A. Taylor, Tad T. Brunyé. Uncertainty promotes information-seeking actions, but what information?. Cognitive Research: Principles and Implications 5(1). 2020. doi:10.1186/s41235-020-00245-2.
- Gertruida Elizabeth Du Toit, Madely Du Preez. Understanding information seeking in transition: How uncertainty influences first-generation students’ information seeking behaviour. Journal of Librarianship and Information Science. 2026. doi:10.1177/09610006261434178.
- 조재인. A Study about Scholarly Impact Measurement through Altmetrics. Journal of Korean Library and Information Science Society 46(1):65-81. 2015. doi:10.16981/kliss.46.1.201503.65.
- Mike Taylor. Exploring the Boundaries: How Altmetrics Can Expand Our Vision of Scholarly Communication and Social Impact. Information Standards Quarterly 25(2):27. 2013. doi:10.3789/isqv25no2.2013.05.
- Ashraf Maleki. A review of beyond citations for books: integrating library holdings and altmetrics in the impact evaluation of scholarly books and textbooks. Frontiers in Research Metrics and Analytics 11. 2026. doi:10.3389/frma.2026.1779778.
- Marcia Lei Zeng, Julaine Clunis. FAIR + FIT: Guiding Principles and Functional Metrics for Linked Open Data (LOD) KOS Products. Journal of Data and Information Science 5(1):93-118. 2020. doi:10.2478/jdis-2020-0008.
- Eran N. Schwarzfuchs. FAIR data, fair data: data management principles and data ownership in citizen science. Information, Communication & Society:1-17. 2025. doi:10.1080/1369118x.2025.2604664.
- Yu.V. Rogushina, I.J. Grishanova. Study of principles, models and methods of FAIR paradigm of scientific data management for analysis for BIG data metadata. PROBLEMS IN PROGRAMMING(4):026-035. 2021. doi:10.15407/pp2021.04.026.
- Riley Taitingfong, Stephanie Carroll. Implementing the CARE Principles for Indigenous Data Governance in Biodiversity Data Management. Biodiversity Information Science and Standards 7. 2023. doi:10.3897/biss.7.112615.
- Dinesh Kumar Krishnan. AI-Enabled Information Governance for Healthcare Productivity Systems: Addressing Limitations of Traditional Data Loss Prevention. Computer Fraud and Security 2026(2):01-09. 2026. doi:10.52710/cfs.1099.
- Josiline Chigwada, Jacob Mapara, Patrick Ngulube. Influence of Indigenous data governance principles on Indigenous knowledge management: Lessons from the Southern African Intangible Cultural Heritage Project. IFLA Journal 52(1):38-47. 2025. doi:10.1177/03400352251331471.
- Maja Žumer. IFLA Library Reference Model (IFLA LRM)— Harmonisation of the FRBR Family. KNOWLEDGE ORGANIZATION 45(4):310-318. 2018. doi:10.5771/0943-7444-2018-4-310.
- Zi-young Park. Consolidation of FRBR Family Models Focusing on FRBR Library Reference Model. Journal of the Korean Society for Library and Information Science 50(1):533-553. 2016. doi:10.4275/kslis.2016.50.1.533.
- Ana Carolina Simionato Arakaki. O Modelo IFLA Library Reference Model e o Linked Data. Informação & Informação 25(3):163. 2020. doi:10.5433/1981-8920.2020v25n3p163.
- Kathy Kempa. Why the ACRL Framework for Information Literacy for Higher Education Enhances Information Literacy Instruction. The Christian Librarian 59(2). 2016. doi:10.55221/2572-7478.1094.
- Chrys Senaka Gunasekara. Fostering independent learning and critical thinking in management higher education using an information literacy framework. Journal of Information Literacy 2(2). 2008. doi:10.11645/2.2.159.
- Nurul Dwi Lestari, Anwariyah Anwariyah, Gail Ekici. Strengthening media literacy through intensive reading–listening skills in higher education: Information processing framework. BAHASTRA 46(1):46-66. 2026. doi:10.26555/bs.v46i1.1660.
- Franco Londra, Gastón Saux. The effect of document source trustworthiness on the evaluation and strategic use of embedded sources when reading health information online. Reading Psychology 44(6):623-648. 2023. doi:10.1080/02702711.2023.2179144.
- Jin-Gyeong Park, Myoung-Gyu Lee. A Study on the Evaluation of Awareness of the Book Debate Club Participants of C University library in Gwangju. Journal of the Korean BIBLIA Society for library and Information Science 26(1):259-277. 2015. doi:10.14699/kbiblia.2015.26.1.259.
- Ekwelem Chukwunaza. N. Informational Reading and Source Criticism in A Digital Culture Among University Students: The Role of The Library. Asian Journal of Information Science and Technology 15(2):1-10. 2025. doi:10.70112/ajist-2025.15.2.4323.
- Lutz Bornmann, Robin Haunschild. To what extent does the Leiden manifesto also apply to altmetrics? A discussion of the manifesto against the background of research into altmetrics. Online Information Review 40(4):529-543. 2016. doi:10.1108/oir-09-2015-0314.
- Jiban K. Pal. Reframing the Debate on Quality vs Quantity in Research Assessment. DESIDOC Journal of Library & Information Technology 41(1):70-71. 2021. doi:10.14429/djlit.41.1.16682.
- Christie Hurrell. Research Assessment Reform, Non-Traditional Research Outputs, and Digital Repositories: An Analysis of the Declaration on Research Assessment (DORA) Signatories in the United Kingdom. Evidence Based Library and Information Practice 18(4):2-20. 2023. doi:10.18438/eblip30407.
- Sumiko Asai. Determinants of article processing charges for hybrid and gold open access journals. Information Discovery and Delivery 51(2):121-129. 2022. doi:10.1108/idd-09-2021-0098.
- Christine Fruin, Fred Rascoe. Funding open access journal publishing: Article processing charges. College & Research Libraries News 75(5):240-243. 2014. doi:10.5860/crln.75.5.9120.
- Heidi M. Winkler. “Open Access APCs Are Already a Scam”: Knowledge and Opinions of Open Access and Article Processing Charges From Faculty at a Large Public University. Journal of Librarianship and Scholarly Communication 12(1). 2024. doi:10.31274/jlsc.17647.
- Falk Scholer, Diane Kelly, Ben Carterette. Information retrieval evaluation using test collections. Information Retrieval Journal 19(3):225-229. 2016. doi:10.1007/s10791-016-9281-7.
- Richard Laughlin. Debate: Accrual accounting: information for accountability or decision usefulness?. Public Money & Management 32(1):45-46. 2012. doi:10.1080/09540962.2012.643056.
- Jingrui Hou, Georgina Cosma, Axel Finke. Advancing continual lifelong learning in neural information retrieval: Definition, dataset, framework, and empirical evaluation. Information Sciences 687:121368. 2025. doi:10.1016/j.ins.2024.121368.
- Raja Patnaik. Retrieval-Augmented Generation: Enhancing AI with Reliable Knowledge.. International Journal of Science and Research (IJSR):124-128. 2025. doi:10.21275/sr251104092705.
- Martin Schmauder, Gritt Ott, Erik Schönwälder. Aufbau eines Retrieval-Augmented-Generation-Systems/Design of a Retrieval-Augmented Generation (RAG) system for knowledge retention in SMEs. wt Werkstattstechnik online 115(06):389-396. 2025. doi:10.37544/1436-4980-2025-06-23.
- Maha elmenshawy, Taher Hamza, Reem El-Deeb. Dense Retrieval-Augmented Generation for Arabic Summarization: A Hybrid Approach Using AraBART. Mansoura Journal for Computer and Information Sciences 21(1):21-36. 2026. doi:10.21608/mjcis.2026.414826.1017.
- Joanne Kuai, Cornelia Brantner, Michael Karlsson. AI chatbot accountability in the age of algorithmic gatekeeping: Comparing generative search engine political information retrieval across five languages. New Media & Society 28(5):2121-2143. 2025. doi:10.1177/14614448251321162.
- Astrid Mager. Defining Algorithmic Ideology: Using Ideology Critique to Scrutinize Corporate Search Engines. tripleC: Communication, Capitalism & Critique. Open Access Journal for a Global Sustainable Information Society 12(1):28-39. 2014. doi:10.31269/triplec.v12i1.439.
- Isiwu, Isiwu,. Search engines, information literacy competencies and knowledge sharing capacity of postgraduate students of public universities in South-East Nigeria. Information Managers: A Journal of Nigerian Library Association Rivers State Chapter. 2026. doi:10.61955/lzzttb.
- Sharon Webb. Inclusive Data: Metadata and Descriptive Language. Full Stack Feminism. 2023. doi:10.21428/6094d7d2.436744f0.
- Jane Blocker. The Judge as Historian: Knowledge at the Limits of Doubt (A Response to Jacqueline Rose's “Feminism and the Abomination of Violence”). Cultural Critique 94:26. 2016. doi:10.5749/culturalcritique.94.2016.0026.
- Julaine Clunis. Epistemic Justice and Linked Data: Balancing Global Interoperability and Community Knowledge. Library Trends 74(4):649-678. 2026. doi:10.1353/lib.2026.a991999.
- Jhantu Mazumder, Parthasarathi Mukhopadhyay. Designing Question-Answer Based Search System in Libraries: Application of Open Source Retrieval Augmented Generation (RAG) Pipeline. Journal of Information and Knowledge:255-260. 2024. doi:10.17821/srels/2024/v61i5/171583.
- Ahmed Sami Jaddoa, Jaber Karimpour, Pedram Salehpour. TSQA: Integrating Text Summarization and Question Answering to Improve Information Retrieval from Documents Using Retrieval-Augmented Generation. Information 17(4):372. 2026. doi:10.3390/info17040372.