记下那条被删掉的分支:共创轨迹的事件图、四环判定与分支互换
把母文的研究设计做成一份可以在自己的改稿流程里跑完的记录与检验工序
SDE 编辑部 · 2026年8月
先写死一条
母文是理论与研究设计论文,不是实证结果报告。它自己写明:其中的统计模型、阈值、实验预测与死亡条件,是用来规定"什么结果能支持、降级或删除这个命题"的,不构成经验发现。
所以这一篇给的不是"已被验证的方法",而是一套记录规程和一套自检判据。它的价值在于:即使那个命题最后被删掉,这套记录本身仍然是你手上此前没有的东西。
这套工序做什么,不做什么
做:把一次反复改稿的过程记成能追因果的形状;判断你的哪一次否定属于四种机制里的哪一种;给出一个能真做因果干预的实验设计。
不做:不评价作品好坏,不评价谁更有创造力,不产生"该多否还是少否"的建议。
适用:任何"提候选—否掉—再提"的反复过程:跟工具改稿、跟设计师改方案、带学生改论文、产品评审、编辑与作者往返。
安全边界
- **不用它评价人。**这套东西测的是一条因果链在不在,不是能力高低。
- **不用它当作"多否几次"的理由。**第一环要求的是可定位的差异;笼统的否定连第一环都过不了,只会增加返工。
- **不把未验证的命题当结论用。**任何"因为生成性拒绝所以应该……"的推论,现在都没有依据。
- **不在没有告知的情况下记录他人的工作过程。**这套记录涉及别人的每一次修改与理由,要事先说清楚记什么、给谁看、存多久。
第一步:把线性日志换成事件图
母文这一步的理由说得很清楚:提示—输出—选择的线性日志只能说明事件先后,不能说明后继候选是对哪一次否定的回应。
所以它把每次共创记成一张有向图:
- 节点:候选、接受、拒绝、理由、修改请求、对方回应、成品。
- 边分三种:时间相邻边、版本父子边、回应边。
第三种边是全部关键。母文对建立回应边给了一条硬判据:
只有当后继候选的变化,与本人拒绝理由的匹配程度,高于配对他人理由、也高于冻结置换理由时,才建立回应边。
这一句可以直接抄成操作规则。它的意思是:不能因为"我说了之后它变了"就认定这是回应——得跟两个对照比:拿别人的理由去比对同一个变化(配对他人理由),以及拿一个打乱过的理由去比对(冻结置换)。只有本人理由的匹配明显更高,这条边才算数。
母文还写了一条数据纪律:截图可以用于审计,但不能成为唯一数据源;没有稳定的会话、节点、父节点和版本标识的轨迹,不进入确认性分析。
第二步:让每一次否定都可定位
第一环叫"差异化拒绝",要求你否掉的是一个可定位的差异,不是笼统的不满。
实操办法:每次否定,强制填两栏——
| 栏 | 写什么 | 不合格的样子 |
|---|---|---|
| 被否的差异 | 具体到某一处、某一维("结尾收得太满""这一段密度太高") | "感觉不对""再改改" |
| 理由 | 为什么这一处不行(可以短,但要指向那一处) | "不喜欢" |
这一步的成本极低,收益却最大:不填这两栏,后面所有的判定都做不了——因为没有理由向量,就没法跟对照比,回应边就建立不起来。
第三步:判回应依赖
对每一条候选的回应边,问一句:下一版的变化,是不是针对我这一句?
判法就是第一步那条:跟"配对他人理由"和"冻结置换理由"比。三者匹配度差不多,说明对方本来就会那么改,跟你说不说无关——这条边不成立。
这一步单独就有用。很多团队以为"我提了意见对方改了",比一比才发现改的方向跟意见没关系。
第四步:判再次承接
第三环问的是:对方改过之后,你有没有对新版继续接受、修改或再定向地否?
如果你对改过的版本只是"嗯行吧"就过了,那么对方的变化没有进入你的选择边界——这一环为 0。
判法:看新版之后你有没有产生新的可定位差异。有,就说明那个方向进来了;没有,就是你在原地。
第五步:判跨作品迁移
第四环最贵,也最不能省:隔一段时间(母文用四周),拿全新的材料来测你的判断。
关键在"全新"两个字——材料要跟原作品无关,最好也跟原来那个伙伴无关,并且不带来源标签。母文的主要终点写得很具体:在四周后的纯人类留出作品判断中,回应签名相对于成品、接受项、简单拒绝签名、记忆与能动感的增量预测效力。
翻成日常:控制掉"你做出了什么""你接受过什么""你否过什么""你还记得什么""你觉得自己做主了没有"这五样之后,还剩下多少预测力。剩得下,这一环成立;剩不下,不成立。
第六步:过乘法门,别用总分
这是母文最该被抄走的一条设计。
g = z × d × r × t(作品表征消失 × 回应依赖 × 再次承接 × 延迟迁移)
母文写明:这是逻辑合取,不是效应量模型。任何一项为 0,结果就是 0。
一句话:"回应很强"不能补偿"没有承接";"迁移很强"不能补偿"那条分支其实还留在成品里"。
这条设计的通用价值远超本题:凡是由几个必要条件构成的东西,都不能用加权总分来判,因为总分永远允许一项高分盖住一项零分。要判资格,用乘法门;要估大小,另做模型。
第七步:对着四格表,说出你在哪一格
| 你的未来判断变了 | 没变 | |
|---|---|---|
| 对方因你的否定改变了下一项 | 候选(还要过承接与迁移) | 单向适配 |
| 没改变 | 负例学习 | 终止型拒绝 |
母文由此给出的那条修正,值得贴在评审室墙上:更高的系统响应性不等于更深的人类学习;更强的人类偏好变化也不等于它由互动构成。
右上那一格尤其要警惕:一个工具越来越懂你、越来越会给你想要的,看着像配合变好,也可能意味着你不再长出新的区分。
第八步:分支互换实验
这是唯一能做因果干预的一步,设计是"同成品—同接受项—异被拒绝分支":
- 两组人最后拿到的成品一样、接受过的东西一样、暴露量一样;
- 唯一不同的是当初被否掉、如今已从成品里消失的那条分支;
- 这条分支是随机交换的;
- 四周后测对全新材料的判断,看两组是否分化。
随机交换这一步是它的全部力量所在:它把"看起来有关联"变成了"可以做干预"。
母文同时写死了失败条件:如果分支互换不能交换后测差异,命题必须降级或删除。
走完一遍:一次文档改稿
一个团队跟一个写作工具反复改一份对外文档,八轮定稿。
- 第一步事件图:把八轮记成节点,每次否定都带理由,建回应边。发现八次否定里只有三次能建立回应边——另外五次,下一版的变化跟提出的理由匹配度并不高于配对他人的理由。这三个月来大家以为"提了就改了",实际只有三次。
- 第二步可定位:五次不合格的否定,理由栏写的都是"感觉太硬了""再自然点"。这类理由没法比对,所以连判都判不了。第一件该改的事,是让否定可定位。
- 第三步、第四步:三次成立的回应边里,有两次之后作者只是接受了新版没再动,再次承接为 0;只有一次,作者在新版基础上提出了一个新的可定位差异。
- 第五步迁移:四周后拿一份跟这份文档完全无关的材料,请同一批人判断。控制掉成品、接受项、否定历史、记忆之后——样本只有五个人,做不出任何有意义的判定。这一步照实记为"不可判定",不往结论上凑。
- 第六步乘法门:因为 t 无法判定,g 不成立。不是"部分成立",是不成立。
- 第八步互换:团队规模做不了随机互换实验,这一步跳过并写明。
- 结论怎么用:这一轮什么都没证明——但它产出了两个此前没有的事实:八次否定里只有三次真的被回应了;三次被回应里只有一次被承接了。这两个数就是改进的入口,而它们跟母文的命题成不成立无关。
这个例子最值钱的是最后一句:即使那个假说将来被删掉,这套记录本身也已经交付了东西。
给你自己的领域定一张"可操纵的测量面"
第二步要求否定可定位,而"可定位"必须落在一组具体的维度上。母文在音乐那个场地用了九维(密度、切分、音程离散、调性偏离、动机复现、乐句对称、终止闭合、音域、动态反差),并写明一句定位:这九维不是审美本体,而是第一个可操纵的测量面。
搬到你的领域,定这张表有三条要求:
- **能被独立算出或独立打分。**最好一半自动、一半由两个人盲态编码。只能靠一个人拍板的维度不要进表。
- **数目要小。**九个左右就够。维度一多,每一维上的差异都变小,回应边的匹配就没有分辨力了。
- **必须能被交换。**这是最容易漏的一条——第八步要拿"被否掉的分支"去做随机互换,如果你的维度描述不出那条分支,互换就无从做起。
举例:一份文案的测量面可以是句长分布、术语密度、主动被动比、段落对称、结尾闭合强度、具体名词占比、数字密度、称呼距离、情绪词强度。一版设计稿可以是留白率、层级数、对比度、字重跨度、栅格偏离、圆角一致性、色相数、信息密度、首屏承载量。
表定好之后,"否定"这个动作就从一句评价变成了一次坐标上的标注——这一步做完,前面所有的判定才有对象。
两个读数:回应忠实度与回应签名
母文给了两个可算的量,形式很简单,用处很大。
回应忠实度:在第 k 回合,你否掉了候选 r,理由是
u,对方返回了候选 n。那么这一次的转化向量就是 n 与 r
在那张测量面上的差:c = x(n) − x(r)。回应忠实度问的是:这个转化向量,跟你理由所指的方向有多贴。
回应签名:把一次共创里所有的转化向量合起来,得到的那个方向性的整体——这就是第五步里要拿去做增量预测的东西。
两个量的实用价值在于:它们把"对方是不是在听我说话"从一句印象,换成了一个可以逐回合算出来的数。而且它们不需要那个理论命题成立也能用——就算生成性拒绝将来被删掉,"这次改动跟我提的方向贴不贴"仍然是一个你会想知道的数。
一条纪律:转化向量要在同一张表上算。跨表比较(这次用九维、下次用七维)没有意义,理由同第八步那条——量纲不同的东西不能直接相减。
读数与代价
- **代价一:每次否定多填两栏。**这是唯一的硬成本,但省不掉。
- 代价二:对照要跑两个(配对他人理由、冻结置换)。没有对照,回应边就是靠感觉建的。
- **代价三:迁移那一步需要延迟和样本,多数团队跑不了。**跑不了就照实记"不可判定",不要用"看起来是有影响的"代替。
- 一条读数:如果你的回应边成立率接近 100%,先怀疑对照没做对——真实数据里这个比例通常低得多。
三种典型事故
**事故一:用总分代替乘法门。**四项打个平均分说"整体不错",这正是母文设计乘法门要挡的事。
**事故二:把"记得"当成"迁移"。**母文写明:如果只能证明参与者记住了当初的负例,载体没有完成转换,结论应降级为记忆或反事实学习。
**事故三:看到结果之后挑更有利的表示。**母文准备了两种预注册的表示方式,并写死:**若两者方向相反,主张保持未建立。**任何"换个算法就好看了"的动作都作废。
停手线
- 一旦这套记录被用来评价个人,停手。
- 一旦有人拿未验证的命题去支持一个实际决定,停手。
- 一旦记录别人的改稿过程没有事先告知,停手。
什么时候该怀疑这套说法
母文给了十条死亡条件,这里挑三条你能自己跑的:
- 回应不依赖本人拒绝——配对他人理由与本人理由的匹配度没差别,或者一个无关维度的伪回应也能产生同样后果。母文明说:这种情况下,这个概念应当被路径依赖或一般序列效应吸收。
- 成品或简单路径吸收了全部效应——控制成品与接受项之后没有剩余,那么作品对效力的存储是完备的,命题失败。母文把这一句和它的正面主张写在同一段里。
- 分支互换不能交换后测差异——这是最直接的一刀,交换了原因却没交换结果,因果链不成立。
四种常见反对
**「这不就是说要重视过程吗?」**不是。母文明确否认"过程总比作品重要"这个夸张读法,它只提一个可检验的例外,而且写明了这个例外失败的条件。
**「记这么多,值吗?」**先只做第二步(让否定可定位)。这一步成本最低,而且它是后面所有判定的前提。做完这一步再决定要不要往下走。
**「我们没条件做互换实验。」**那就跳过并写明,像上面那个例子一样。写明"没做",比用一句"看起来是有影响的"顶上去要诚实得多。
**「工具越来越懂我,难道不好吗?」**母文没有说这不好。它只是提醒:响应性提高和你自己长出新区分,是两件事,四格表里它们分属两格。哪一格更值得,母文没有排序。
三个岗位怎么用
- 带人改稿的:只做第二步。要求每次意见落到一处具体的差异上,一个月就能看出返工率的变化。
- 做工具与产品的:重点在四格表。别把"用户采纳率上升"当成"用户被帮助了"——那可能正好是右上格。
- 做研究设计的:抄两样——乘法门(必要条件不能用总分判)和双对照建边(配对他人理由+冻结置换)。这两样跟本题无关也能用。
一个人的自查版
回想最近一次你跟工具或跟人反复改一样东西:
- 我否掉的那几次,说得出具体是哪一处吗?
- 对方后来的变化,是针对我那句话,还是它本来就会那么改?
- 改过之后,我有没有在新版里看见一个此前没有的区别?
第三问答得上来,才是这件事;答不上来,那是一次正常的改稿——而正常的改稿也没什么不好。
本文用到的母文词,各在哪一步
| 母文词 | 用在第几步 |
|---|---|
| 事件图(节点/时间边/版本边/回应边) | 第一步 |
| 回应边的双对照判据(配对他人理由+冻结置换) | 第一步与第三步 |
| 四环之一:差异化拒绝 | 第二步 |
| 四环之二:回应依赖 | 第三步 |
| 四环之三:再次承接 | 第四步 |
| 四环之四:跨作品迁移;增量预测效力 | 第五步 |
| 乘法门 g = z×d×r×t,逻辑合取而非效应量 | 第六步 |
| 二维判决四格(终止型/负例学习/单向适配/候选) | 第七步 |
| 分支互换(同成品—同接受项—异被拒绝分支) | 第八步 |
| 「若两种表示方向相反,主张保持未建立」 | 事故三 |
| 十条死亡条件 | 「什么时候该怀疑」 |
来源说明
本文由 SDE 编辑部撰写,是对少敏《作品不能保存全部原创性》一文中研究设计的流程转写,不替代原文,不代表原作者措辞。文档改稿那个例子与本文的八步排法为编辑部所拟,不是母文的主张。
母文明确声明:它是一篇理论与研究设计论文,不是实证结果报告;其模型、阈值与预测用于规定何种结果能支持、降级或删除命题,不构成经验发现。本文所述的一切判定,因此都是待验证的检验设计,不得当作已确立的结论使用。