被测对象:本书自身。测量日:2026-09-09。
本书出现二十六个读数,每一个都写明了取值方法,而在这份附录之前,一个都没有被测量过——这句话写在总序、写在读数总表、写在每一章自曝的第一条。
它是本书最大的欠账。这份附录还其中一部分。
先说清楚能测什么、不能测什么,以及为什么。
不能测的(十九个):落差 Λ、共涨系数 γ、判负率 ν、外部推翻占比 ω、攻深 D\*、分歧率 d、净生长率 G、换血率 r、入场费占比 φ、承接兑现率 τ、超越—抄袭比 π、保护冗余比 ρ、执行门槛比 σ、半萃取次数 n½、形态成立度 M、持有者再生产率、理解者密度、回流率、命中率。
它们不能测的原因是同一个:全部需要本书之外的东西——跨基底盲评、多个互质来源两两对测、一个真实运转的库、一段可跟踪的时间。本书此刻手上没有这些,而拿别的东西凑数据是这本书最不该做的事。
能测的(七个):条件密度、模糊词密度、来源核验率、作废条件覆盖率、自曝覆盖率、牵连度、以及本书是否满足它自己的最小判据。
它们能测,是因为被测对象就是这份文本自己。
全部测量在书稿正文(十四章,230,532 汉字)上进行,用正则匹配统计。
条件密度:统计"除非…/当…时/在…情形下/若…则/低于·高于·超过…/什么时候会错/何时不成立"这类可判定的边界表述的出现次数,除以字数。
模糊词密度:统计"通常/一般来说/往往/大致/视情况/在一定程度上/某种程度上/基本上"。
来源核验率:统计占位者标注中"已核验"与"未复核/按通行表述引述/未做文献核验"的条数之比。
牵连度:从各章的交叉引用建有向图,做反转检验——撤掉某章,直接受损的章数与二阶传导的章数。
方法的四处粗糙,必须先说:
· 正则会误判。 "低于"可能出现在与边界无关的句子里;"通常"也可能是一句正当的概括。这些数字是量级指示,不是精确计数。
· 模糊词不等于坏。 有些概括性表述是恰当的。这个读数只在与条件密度对照时才有意义。
· 牵连度只统计明写的"第X章"引用,不含概念上的隐含依赖——因此它低估了真实的牵连。
· 测量者是作者本人。 利益冲突不可自证(第二十节)。
| 章 | 边界/千字 | 模糊/千字 | 比值 |
|---|---|---|---|
| 一 何谓个人知识 | 1.8 | 1.5 | 1.2 |
| 二 个人知识的新形态 | 0.8 | 0.3 | 2.8 |
| 三 磐石在寓居之处 | 0.9 | 0.3 | 3.2 |
| 四 知识产权保护的失效 | 1.4 | 0.0 | ∞ |
| 五 私密知识的服务悖论 | 1.2 | 0.3 | 4.4 |
| 六 为何是现在 | 0.4 | 0.3 | 1.2 |
| 七 个人知识生态平台的三命题 | 0.8 | 0.1 | 14.0 |
| 八 碰撞 | 1.4 | 0.2 | 6.0 |
| 九 生长 | 1.2 | 0.5 | 2.3 |
| 十 被使用而仍是他的 | 1.4 | 0.5 | 2.6 |
| 十一 SDE 知识生态平台 | 0.8 | 0.4 | 2.0 |
| 十二 从知识到实践应用 | 0.9 | 0.5 | 2.0 |
| 十三 只给 AI 阅读的知识 | 1.4 | 1.3 | 1.1 |
| 十四 谁不需要这套东西 | 1.5 | 0.1 | 14.0 |
| 全书 | 1.1 | 0.4 | 2.7 |
三个发现,两个对本书不利。
发现一(不利)·第十三章的比值是全书最低的 1.1。
那一章讲的正是"不要用模糊措辞"——它明写了一条规范:"人读到'通常''一般'会自动打折,而机器不会,它会把模糊当确定读走。"
而它自己的模糊词密度是全书第二高(1.3/千字)。
这是一次实测抓到的自我违反,不是理论上的可能。 处置见第六节。
发现二(不利)·第一章的比值也只有 1.2。
第一章是全书给判据的那一章——"一条个人知识,是一个你说得出它什么时候会错的判断"。它的边界密度确实是全书最高(1.8),而模糊词密度也是全书最高(1.5)。
一个可能的解释是:第一章为了讲清"什么是模糊表述",大量引用了模糊词作为反例。这个解释是我事后给的,而正则分不清"使用"与"引用"——这是方法粗糙处第一条的实例。
发现三·第六章的条件密度是全书最低(0.4)。
第六章是历史章。历史叙述天然少边界表述,这一条不构成违反。但它与第三节那个 0% 的核验率合在一起,使第六章成为全书最弱的一章(第五节)。
这是本次实测最难看的一个数。
| 章 | 已核验 | 未复核 | 核验率 |
|---|---|---|---|
| 四 知识产权保护的失效 | 5 | 1 | 83% |
| 五 私密知识的服务悖论 | 3 | 3 | 50% |
| 三 磐石在寓居之处 | 5 | 8 | 38% |
| 七 三命题 | 2 | 5 | 29% |
| 八 碰撞 | 2 | 9 | 18% |
| 二 个人知识的新形态 | 1 | 5 | 17% |
| 九 生长 | 2 | 11 | 15% |
| 一 何谓个人知识 | 1 | 14 | 7% |
| 六 为何是现在 | 0 | 3 | 0% |
| 十 被使用而仍是他的 | 0 | 8 | 0% |
| 十一 SDE 知识生态平台 | 0 | 4 | 0% |
| 十二 从知识到实践应用 | 0 | 3 | 0% |
| 十三 只给 AI 阅读的知识 | 0 | 3 | 0% |
| 十四 谁不需要这套东西 | 0 | 5 | 0% |
| 全书 | 21 | 82 | 20% |
三件必须说明的事:
其一·实测比本书自己估的更差。
附录五写的是"〔核〕约二十条,〔述〕约三十条,〔提〕约十条"。实测:已核验 21 条(与估计相符),而未复核 82 条——是估计的两倍以上。
换句话说,本书低估了自己未核验的部分。 这一条现已回填进附录五。
其二·六章核验率为零。
第六、十、十一、十二、十三、十四章的占位者全部未复核。这印证了各章自曝里那句"本章未做实搜"——它不是一句谦辞,是一个可以被数出来的事实。
其三·最严重的一处是第六章。
它是全书最依赖历史事实的一章(威尼斯专利法、印刷术、学会与同行评议的形成),而它的核验率是 0%,条件密度也是全书最低。 两项都垫底。
| 结果 | |
|---|---|
| 有作废条件的章 | 14 / 14(100%) |
| 有自曝的章 | 14 / 14(100%) |
| 作废条件总数 | 74 条 |
| 自曝总数 | 122 条 |
这是本次实测唯一好看的一组数。
而它好看得有限,理由要说清楚:作废条件与自曝是写作时的自觉动作,不是外部检验的结果。它们证明的是体例被执行了,不证明书里的主张是对的。
用本书自己的话说:这一组数测的是"有没有给自己留一个可以被打的面",不是"被打过没有"。
撤掉某一章,直接受损与二阶传导的章数:
| 章 | 被引次数 | 一阶受损 | 二阶传导 |
|---|---|---|---|
| 五 私密知识的服务悖论 | 47 | 11 | 1 |
| 二 个人知识的新形态 | 70 | 10 | 0 |
| 一 何谓个人知识 | 93 | 8 | 2 |
| 三 磐石在寓居之处 | 24 | 7 | 3 |
| 四 知识产权保护的失效 | 28 | 7 | 4 |
| 七 三命题 | 31 | 7 | 4 |
| 八 碰撞 | 59 | 7 | 2 |
| 九 生长 | 58 | 6 | 3 |
| 十 被使用而仍是他的 | 32 | 6 | 4 |
| 六 为何是现在 | 19 | 4 | 5 |
| 十一 SDE 知识生态平台 | 8 | 3 | 5 |
| 十二 从知识到实践应用 | 24 | 3 | 2 |
| 十四 谁不需要这套东西 | 21 | 3 | 5 |
| 十三 只给 AI 阅读的知识 | 13 | 2 | 3 |
这张表与上一节那张表叠在一起,给出本次实测最重要的一个发现。
本书第九章说过:一个"高牵连、低抗攻"的条目,是库里最大的风险源,应当优先送去挨打。
把牵连度与核验率并排:
| 章 | 一阶受损 | 核验率 | 判定 |
|---|---|---|---|
| 一 何谓个人知识 | 8 | 7% | 🔴 高牵连 · 极低核验 |
| 二 个人知识的新形态 | 10 | 17% | 🔴 高牵连 · 极低核验 |
| 五 私密知识的服务悖论 | 11 | 50% | 高牵连 · 中等核验 |
| 八 碰撞 | 7 | 18% | 🟡 中高牵连 · 低核验 |
| 九 生长 | 6 | 15% | 🟡 中高牵连 · 低核验 |
第一章与第二章是全书最危险的两章:它们撑着最多的东西,而它们的外部核验最少。
这一条不是我读出来的判断,是两张表叉乘之后掉出来的。 而它精确对应本书第九章那个判据——这本书自己就是它所描述的那种风险结构。
处置:这两章的占位者应当被优先补实搜,优先于任何新的写作。见第六节。
当场能改的(已改):
· 附录五的估数回填为实测数:未复核不是"约三十条",是 82 条;全书核验率 20%。
· 第十三章的自我违反已在该章补一句:它的模糊词密度是全书第二高,与它自己那条规范相违。
· 读数总表的"测过"一栏:七个读数由 ❌ 改为 ✅,并注明"实测于本书自身"。
不能当场改、记为欠账的(按优先级):
| 优先级 | 欠账 | 依据 |
|---|---|---|
| 1 | 第一、二章补实搜(高牵连 × 极低核验) | 第五节那张叉乘表 |
| 2 | 第六章补实搜(最依赖史实 × 0% 核验 × 最低条件密度) | 第二、三节 |
| 3 | 第八、九章补实搜(中高牵连 × 低核验) | 第五节 |
| 4 | 其余十九个读数的真实取值 | 第零节 |
一句必须写下的话:这份报告没有改变本书任何一个主张的对错。 它测的是这本书的形式健康度——边界写得够不够密、来源核过没核过、承重的地方有没有被检验。
而按它自己的判据,一本形式健康度不错、外部核验率只有 20% 的书,仍然是一批待检验的候选主张。
这一节是这份报告最要紧的一节,而它指出的是本书自己的一处不一致。
先把纪律写出来:
统计没有发现,只能说明"还未发生",不能否定"将来不会发生"。
一个零结果有三种来源,而它们在数据上长得一模一样:
· 真的没有差异——被检验的那个效应确实不存在;
· 样本不足或时间不够——效应存在,而这次检验没有能力看见它;
· 测量不够敏感——效应存在,而所用的量具测不到它。
只有第一种才构成证伪。而数据本身分不出是哪一种。
本书在一个地方执行了这条纪律,在另一个地方没有执行。
执行了的地方——敌意实搜(第八章第十三节):
查到了 → 强结论(你的主张确实被占了,这是确定的);
没查到 → 弱结论(只能记"本轮 N 轮实搜未见",并写明搜了哪些方向)。
书中所有占位者一节都遵守了它:写的是"本轮实搜未见等价物",而不是"没有人做过"。
没有执行的地方——作废条件。
本次实测数了一遍:全书 74 条作废条件里,有 14 条建立在"零结果"上。它们的形状都是同一个:
若……没有差异 / 没有分化 / 并不更高 / 并未下降,则本章作废。
按上面那条纪律,这 14 条都不成立——因为"没有测到差异"可能只是第二、三种来源,而它们被当成了第一种。
这是本书自己的判据没有被一致地应用。 它不是一个小疏漏:它意味着本书可能被一次不够有力的检验错误地判负。
逐条去改那 14 条,容易漏,也会让作废条件变得冗长。这里立一条统一的限定,对全书所有依赖零结果的作废条件生效:
凡本书中形如"若未观察到差异则本章作废"的作废条件,只有在检验同时满足下列三条时才生效:
其一·预注册。 检验方案(样本、时长、判定标准)在看到数据之前写定并公开。
其二·可见度声明。 报告这次检验有能力看见多大的效应——样本量、跟踪时长,以及在这个规模下多小的差异会被漏掉。说不出这一条的零结果,不构成证伪。
其三·范围限定。 结论只在被检验的那个范围内成立,写法是"在某某条件下未发现差异",不是"没有差异"。
三条缺任何一条,该次检验只能记为"本轮未发现",不触发作废。
这条限定同时收紧了本书的可证伪性——它让本书更难被推翻。而这正是需要说清楚的地方:
收紧可证伪性通常是一件可疑的事(一个不断给自己加豁免条款的理论,最终会变得不可证伪)。本书对此的回答是:
· 这三条不是本书发明的豁免,是任何一次零结果检验本来就该报告的东西;
· 而且它是对称的——同样的限定也约束本书的正面主张:本书说"本轮实搜未见等价物",同样不等于"确实没有人做过"。
如果有人认为这三条仍然过宽,那么正确的做法不是删掉它们,是去做一次满足这三条的检验。 本书的十四条零结果作废条件,至今一条都没有被这样检验过。
本次实测本身就有大量零结果,它们必须按同一条纪律读:
· 六章核验率为 0% —— 这是计数,不是零结果推断。"该章没有一条占位者被核验过"是一个可以直接数出来的事实,它成立。
· 跨章重复段落 0 处 —— 这是在 120 字窗口下未发现重复。换一个窗口长度,结论可能不同。 正确的写法是"在 120 字窗口下未发现",本报告第一节已按此写。
· 第四章模糊词密度 0.0/千字 —— 同样是计数,成立;但"这一章没有模糊表述"不成立,因为模糊词表只有八个词,表外的模糊表述测不到。
三个例子的分别值得记住:
数出来的零(计数)是事实;推断出来的零(未发现效应)只是"还没看见"。
本书今后所有的实测报告,都应当先分清这两种零。
一、被测对象与测量者是同一个人。 本书全书都在论证"写手不能评自己写的东西"(第七章:自评稳定偏高),而这份报告正是自评。 它唯一的辩护是:所测的都是可数的量(次数、条数、比例),不是质量判断——但选择"数哪些量"这件事本身,仍然由我决定。
二、正则统计有系统性误差(第一节四条)。尤其"引用模糊词作为反例"与"使用模糊词"分不开,这直接影响第一章的读数。
三、牵连度低估了真实牵连。 只统计了明写的章号引用,概念上的依赖没有计入。真实的牵连结构比这张表更密,也就是说风险比测出来的更高,不是更低。
四、"能测的七个"这个划分是我做的。 也许有别的读数用别的办法也能测,而我没有想到——没想到与不能测,在这份报告里被写成了同一件事。
五、这份报告本身没有作废条件。 按本书的体例,它应当有。我给不出——因为我想不出什么情况下"数一数本书里有多少条边界表述"这件事会是错的。这可能说明这份报告的判据太弱,而不是它太可靠。