← 专著首页目录同源论文专著栏目

附录六 第一次实测报告

附录六 第一次实测报告

被测对象:本书自身。测量日:2026-09-09。

零 为什么是这份报告

本书出现二十六个读数,每一个都写明了取值方法,而在这份附录之前,一个都没有被测量过——这句话写在总序、写在读数总表、写在每一章自曝的第一条。

它是本书最大的欠账。这份附录还其中一部分。

先说清楚能测什么、不能测什么,以及为什么。

不能测的(十九个):落差 Λ、共涨系数 γ、判负率 ν、外部推翻占比 ω、攻深 D\*、分歧率 d、净生长率 G、换血率 r、入场费占比 φ、承接兑现率 τ、超越—抄袭比 π、保护冗余比 ρ、执行门槛比 σ、半萃取次数 n½、形态成立度 M、持有者再生产率、理解者密度、回流率、命中率。

它们不能测的原因是同一个:全部需要本书之外的东西——跨基底盲评、多个互质来源两两对测、一个真实运转的库、一段可跟踪的时间。本书此刻手上没有这些,而拿别的东西凑数据是这本书最不该做的事。

能测的(七个):条件密度、模糊词密度、来源核验率、作废条件覆盖率、自曝覆盖率、牵连度、以及本书是否满足它自己的最小判据。

它们能测,是因为被测对象就是这份文本自己。

一 测量方法与它的粗糙处

全部测量在书稿正文(十四章,230,532 汉字)上进行,用正则匹配统计。

条件密度:统计"除非…/当…时/在…情形下/若…则/低于·高于·超过…/什么时候会错/何时不成立"这类可判定的边界表述的出现次数,除以字数。

模糊词密度:统计"通常/一般来说/往往/大致/视情况/在一定程度上/某种程度上/基本上"。

来源核验率:统计占位者标注中"已核验"与"未复核/按通行表述引述/未做文献核验"的条数之比。

牵连度:从各章的交叉引用建有向图,做反转检验——撤掉某章,直接受损的章数与二阶传导的章数。

方法的四处粗糙,必须先说:

· 正则会误判。 "低于"可能出现在与边界无关的句子里;"通常"也可能是一句正当的概括。这些数字是量级指示,不是精确计数。

· 模糊词不等于坏。 有些概括性表述是恰当的。这个读数只在与条件密度对照时才有意义。

· 牵连度只统计明写的"第X章"引用,不含概念上的隐含依赖——因此它低估了真实的牵连。

· 测量者是作者本人。 利益冲突不可自证(第二十节)。

二 读数一:条件密度与模糊词密度

边界/千字模糊/千字比值
一 何谓个人知识1.81.51.2
二 个人知识的新形态0.80.32.8
三 磐石在寓居之处0.90.33.2
四 知识产权保护的失效1.40.0
五 私密知识的服务悖论1.20.34.4
六 为何是现在0.40.31.2
七 个人知识生态平台的三命题0.80.114.0
八 碰撞1.40.26.0
九 生长1.20.52.3
十 被使用而仍是他的1.40.52.6
十一 SDE 知识生态平台0.80.42.0
十二 从知识到实践应用0.90.52.0
十三 只给 AI 阅读的知识1.41.31.1
十四 谁不需要这套东西1.50.114.0
全书1.10.42.7

三个发现,两个对本书不利。

发现一(不利)·第十三章的比值是全书最低的 1.1。

那一章讲的正是"不要用模糊措辞"——它明写了一条规范:"人读到'通常''一般'会自动打折,而机器不会,它会把模糊当确定读走。"

而它自己的模糊词密度是全书第二高(1.3/千字)。

这是一次实测抓到的自我违反,不是理论上的可能。 处置见第六节。

发现二(不利)·第一章的比值也只有 1.2。

第一章是全书给判据的那一章——"一条个人知识,是一个你说得出它什么时候会错的判断"。它的边界密度确实是全书最高(1.8),而模糊词密度也是全书最高(1.5)。

一个可能的解释是:第一章为了讲清"什么是模糊表述",大量引用了模糊词作为反例。这个解释是我事后给的,而正则分不清"使用"与"引用"——这是方法粗糙处第一条的实例。

发现三·第六章的条件密度是全书最低(0.4)。

第六章是历史章。历史叙述天然少边界表述,这一条不构成违反。但它与第三节那个 0% 的核验率合在一起,使第六章成为全书最弱的一章(第五节)。

三 读数二:来源核验率

这是本次实测最难看的一个数。

已核验未复核核验率
四 知识产权保护的失效5183%
五 私密知识的服务悖论3350%
三 磐石在寓居之处5838%
七 三命题2529%
八 碰撞2918%
二 个人知识的新形态1517%
九 生长21115%
一 何谓个人知识1147%
六 为何是现在030%
十 被使用而仍是他的080%
十一 SDE 知识生态平台040%
十二 从知识到实践应用030%
十三 只给 AI 阅读的知识030%
十四 谁不需要这套东西050%
全书218220%

三件必须说明的事:

其一·实测比本书自己估的更差。

附录五写的是"〔核〕约二十条,〔述〕约三十条,〔提〕约十条"。实测:已核验 21 条(与估计相符),而未复核 82 条——是估计的两倍以上。

换句话说,本书低估了自己未核验的部分。 这一条现已回填进附录五。

其二·六章核验率为零。

第六、十、十一、十二、十三、十四章的占位者全部未复核。这印证了各章自曝里那句"本章未做实搜"——它不是一句谦辞,是一个可以被数出来的事实。

其三·最严重的一处是第六章。

它是全书最依赖历史事实的一章(威尼斯专利法、印刷术、学会与同行评议的形成),而它的核验率是 0%,条件密度也是全书最低。 两项都垫底。

四 读数三:作废条件与自曝的覆盖

结果
有作废条件的章14 / 14(100%)
有自曝的章14 / 14(100%)
作废条件总数74 条
自曝总数122 条

这是本次实测唯一好看的一组数。

而它好看得有限,理由要说清楚:作废条件与自曝是写作时的自觉动作,不是外部检验的结果。它们证明的是体例被执行了,不证明书里的主张是对的。

用本书自己的话说:这一组数测的是"有没有给自己留一个可以被打的面",不是"被打过没有"。

五 读数四:牵连度与反转检验

撤掉某一章,直接受损与二阶传导的章数:

被引次数一阶受损二阶传导
五 私密知识的服务悖论47111
二 个人知识的新形态70100
一 何谓个人知识9382
三 磐石在寓居之处2473
四 知识产权保护的失效2874
七 三命题3174
八 碰撞5972
九 生长5863
十 被使用而仍是他的3264
六 为何是现在1945
十一 SDE 知识生态平台835
十二 从知识到实践应用2432
十四 谁不需要这套东西2135
十三 只给 AI 阅读的知识1323

这张表与上一节那张表叠在一起,给出本次实测最重要的一个发现。

本书第九章说过:一个"高牵连、低抗攻"的条目,是库里最大的风险源,应当优先送去挨打。

把牵连度与核验率并排:

一阶受损核验率判定
一 何谓个人知识87%🔴 高牵连 · 极低核验
二 个人知识的新形态1017%🔴 高牵连 · 极低核验
五 私密知识的服务悖论1150%高牵连 · 中等核验
八 碰撞718%🟡 中高牵连 · 低核验
九 生长615%🟡 中高牵连 · 低核验
第一章与第二章是全书最危险的两章:它们撑着最多的东西,而它们的外部核验最少。

这一条不是我读出来的判断,是两张表叉乘之后掉出来的。 而它精确对应本书第九章那个判据——这本书自己就是它所描述的那种风险结构。

处置:这两章的占位者应当被优先补实搜,优先于任何新的写作。见第六节。

六 实测之后的处置

当场能改的(已改):

· 附录五的估数回填为实测数:未复核不是"约三十条",是 82 条;全书核验率 20%

· 第十三章的自我违反已在该章补一句:它的模糊词密度是全书第二高,与它自己那条规范相违。

· 读数总表的"测过"一栏:七个读数由 ❌ 改为 ✅,并注明"实测于本书自身"。

不能当场改、记为欠账的(按优先级):

优先级欠账依据
1第一、二章补实搜(高牵连 × 极低核验)第五节那张叉乘表
2第六章补实搜(最依赖史实 × 0% 核验 × 最低条件密度)第二、三节
3第八、九章补实搜(中高牵连 × 低核验)第五节
4其余十九个读数的真实取值第零节

一句必须写下的话这份报告没有改变本书任何一个主张的对错。 它测的是这本书的形式健康度——边界写得够不够密、来源核过没核过、承重的地方有没有被检验。

而按它自己的判据,一本形式健康度不错、外部核验率只有 20% 的书,仍然是一批待检验的候选主张。

七 一条必须补上的判读纪律:零结果怎么读

这一节是这份报告最要紧的一节,而它指出的是本书自己的一处不一致。

先把纪律写出来:

统计没有发现,只能说明"还未发生",不能否定"将来不会发生"。

一个零结果有三种来源,而它们在数据上长得一模一样:

· 真的没有差异——被检验的那个效应确实不存在;

· 样本不足或时间不够——效应存在,而这次检验没有能力看见它;

· 测量不够敏感——效应存在,而所用的量具测不到它。

只有第一种才构成证伪。而数据本身分不出是哪一种。

七之一 本书在这一点上自相矛盾

本书在一个地方执行了这条纪律,在另一个地方没有执行。

执行了的地方——敌意实搜(第八章第十三节):

查到了 → 强结论(你的主张确实被占了,这是确定的);
没查到 → 弱结论(只能记"本轮 N 轮实搜未见",并写明搜了哪些方向)。

书中所有占位者一节都遵守了它:写的是"本轮实搜未见等价物",而不是"没有人做过"

没有执行的地方——作废条件。

本次实测数了一遍:全书 74 条作废条件里,有 14 条建立在"零结果"上。它们的形状都是同一个:

若……没有差异没有分化并不更高并未下降,则本章作废。

按上面那条纪律,这 14 条都不成立——因为"没有测到差异"可能只是第二、三种来源,而它们被当成了第一种。

这是本书自己的判据没有被一致地应用。 它不是一个小疏漏:它意味着本书可能被一次不够有力的检验错误地判负。

七之二 统一的限定条款

逐条去改那 14 条,容易漏,也会让作废条件变得冗长。这里立一条统一的限定,对全书所有依赖零结果的作废条件生效:

凡本书中形如"若未观察到差异则本章作废"的作废条件,只有在检验同时满足下列三条时才生效:
其一·预注册。 检验方案(样本、时长、判定标准)在看到数据之前写定并公开。
其二·可见度声明。 报告这次检验有能力看见多大的效应——样本量、跟踪时长,以及在这个规模下多小的差异会被漏掉。说不出这一条的零结果,不构成证伪。
其三·范围限定。 结论只在被检验的那个范围内成立,写法是"在某某条件下未发现差异",不是"没有差异"。
三条缺任何一条,该次检验只能记为"本轮未发现",不触发作废。

这条限定同时收紧了本书的可证伪性——它让本书更难被推翻。而这正是需要说清楚的地方:

收紧可证伪性通常是一件可疑的事(一个不断给自己加豁免条款的理论,最终会变得不可证伪)。本书对此的回答是:

· 这三条不是本书发明的豁免,是任何一次零结果检验本来就该报告的东西

· 而且它是对称的——同样的限定也约束本书的正面主张:本书说"本轮实搜未见等价物",同样不等于"确实没有人做过"。

如果有人认为这三条仍然过宽,那么正确的做法不是删掉它们,是去做一次满足这三条的检验。 本书的十四条零结果作废条件,至今一条都没有被这样检验过。

七之三 这条纪律怎么反过来读本次实测

本次实测本身就有大量零结果,它们必须按同一条纪律读:

· 六章核验率为 0% —— 这是计数,不是零结果推断。"该章没有一条占位者被核验过"是一个可以直接数出来的事实,它成立。

· 跨章重复段落 0 处 —— 这是在 120 字窗口下未发现重复。换一个窗口长度,结论可能不同。 正确的写法是"在 120 字窗口下未发现",本报告第一节已按此写。

· 第四章模糊词密度 0.0/千字 —— 同样是计数,成立;但"这一章没有模糊表述"不成立,因为模糊词表只有八个词,表外的模糊表述测不到。

三个例子的分别值得记住:

数出来的零(计数)是事实;推断出来的零(未发现效应)只是"还没看见"。

本书今后所有的实测报告,都应当先分清这两种零。

八 这份报告自己的自曝

一、被测对象与测量者是同一个人。 本书全书都在论证"写手不能评自己写的东西"(第七章:自评稳定偏高),而这份报告正是自评。 它唯一的辩护是:所测的都是可数的量(次数、条数、比例),不是质量判断——但选择"数哪些量"这件事本身,仍然由我决定。

二、正则统计有系统性误差(第一节四条)。尤其"引用模糊词作为反例"与"使用模糊词"分不开,这直接影响第一章的读数。

三、牵连度低估了真实牵连。 只统计了明写的章号引用,概念上的依赖没有计入。真实的牵连结构比这张表更密,也就是说风险比测出来的更高,不是更低。

四、"能测的七个"这个划分是我做的。 也许有别的读数用别的办法也能测,而我没有想到——没想到与不能测,在这份报告里被写成了同一件事。

五、这份报告本身没有作废条件。 按本书的体例,它应当有。我给不出——因为我想不出什么情况下"数一数本书里有多少条边界表述"这件事会是错的。这可能说明这份报告的判据太弱,而不是它太可靠。

© 德麦国际出版社 · 王德生《AI 时代的个人知识》· ISBN 979-8-90690-038-8