近似问句不能按字面逐条建页,而应先归入“认知—比较—执行”三个决策阶段,再决定哪些合并、哪些独立。样本少时,人工判断往往成立;量级上来后,例外主要来自同一句话背后不同的前置条件,而不是问法本身。
假设你手工整理二十条问句,很容易凭语感把它们分成“想了解概念”“想比较方案”“想直接操作”三类。扩到几百条后,同一批问句会同时落进两个阶段,例如“某方法适不适合我”既可能是认知期的自我评估,也可能是执行前的最后确认。
这不是分类标准失效,而是近似问句天然携带省略信息。问句越短,缺失的前提越多;缺失的前提越多,同一句话在不同人那里指向的阶段就越分散。
第一种解释认为阶段由问法决定:出现“是什么”偏认知,出现“哪个好”偏比较,出现“怎么做”偏执行。这种解释在样本干净时好用,但它默认了提问者已经具备相同背景。
第二种解释认为阶段由前置条件决定:提问者是否已有候选方案、是否已排除某些做法、是否带着时间或资源约束。问法只是表层,前置条件才决定他下一步要做什么。大量近似问句之所以难整理,正是因为它们问法接近、前置条件却相差很远。
可以回到搜索意图的上下文线索,而不是只看问句本身。以下证据更支持“前置条件解释”:
如果这些差异稳定出现,就说明按问法归类会掩盖真实阶段;如果差异始终不出现,按问法归类反而更省成本。
具体做法是给每条近似问句补一个前置条件标签,而不是直接写标题。标签可以包括:是否已有候选方案、是否已做过尝试、是否受时间或资源限制、是否需要向他人解释。标注完成后,把前置条件相同的问句合并成一个决策阶段,把前置条件明显不同的拆开。
这个动作的结果会直接影响下一步:合并后的阶段对应一篇内容,内部按“先确认条件、再给判断依据、最后给动作”组织;拆开的问句则各自需要独立的判断入口,否则读者会在错误阶段看到无关信息。
假设有两条问句:“这个方案适合新手吗”和“这个方案适合已经用过同类工具的人吗”。问法几乎一样,但前置条件相反。若合并成一篇,开头就必须先让读者自测属于哪一类;若拆成两篇,每篇的论证起点会清晰得多。这里的取舍不取决于字数或关键词密度,而取决于前置条件能否在一段话内讲清。
这套整理方式在问句数量有限、前置条件可枚举时最有效。当问句来自完全不同的渠道、提问者背景无法从上下文判断时,强行补标签会制造虚假的确定性。此时更稳妥的做法是保留一个宽阶段,用页面内的分支结构承接差异,而不是为每条问句单独建页。
另外,近似问句合并后如果只是把同义词机械换写,并不会带来新的决策价值;真正需要保留的是前置条件差异,而不是措辞差异。
整理完成后,用一条判断顺序检查:读者读完当前内容,是否知道下一步该做什么。如果答案是否定的,说明阶段划分还停留在问法层面;如果读者能明确说出“我已满足哪些条件,所以接下来选哪条路”,说明前置条件已经进入内容结构。这个检查不依赖任何固定阈值,只依赖读者能否据此推进决策。