结论先行:当可创建的百科页面数量被动或主动收缩时,保留高价值需求覆盖的可行办法,是把覆盖单位从“页面数量”改成“需求簇”,用更少页面承接同一批意图;但这套做法只在需求之间共享同一套可核验事实时成立。如果两个需求各自需要独立的定义、时间线和来源体系,合并页面会同时削弱两边,此时应当保留拆分,而不是硬压数量。
百度百科创建的对象是词条,而词条能否成立取决于是否有足够独立、可核验的来源支撑。页面减少通常来自两种情形:一是原先打算铺开的候选词条被判定为缺乏独立关注度,二是同一主体的多个相近词条被合并。这两种情形对需求覆盖的影响完全不同。
前一种情形下,减少的本来就是低价值候选,覆盖损失有限;后一种情形下,被合并的页面往往各自承接了不同搜索意图,比如“品牌本身是什么”与“品牌旗下某产品是什么”,合并后读者进入同一个页面却找不到自己那一层答案。判断属于哪一种,可以看一个信号:缩减后,原候选词对应的检索词是否仍能通过现有页面在首段得到直接回答。能,就属于可接受缩减;不能,就是覆盖缺口。
不要从“还剩几个页面”出发,而要从“读者会用哪些问法找过来”出发。把同一主体下相近的问法归为一簇,例如“是什么”“谁创办的”“哪一年成立”“有哪些主要产品”可以归入同一主体簇。归一簇之后,再判断这一簇能否被一个词条的目录结构容纳。
这个动作的结果直接影响下一步:如果一簇需求能被一个词条的定义段、历史段、业务段分别承接,就可以放心合并;如果某一簇需求需要独立的时间线或独立来源,就应把它标为“不可合并”,在缩减时优先保住它。
高价值需求能不能保留,最终取决于来源。可以按来源的独立程度分三档:
这个分档的作用是让取舍有依据,而不是凭感觉保留“看起来重要”的词。需要说明的是,来源数量多不等于覆盖一定成立,若多篇来源实为同一稿件的转载,独立程度并不增加。
假设某主体原有三个候选词条,缩减为一个。可以做一个假设性的比较:把三个原候选词分别作为检索意图,看合并后的词条首段能否在读完第一段后回答其中至少两个。若能,说明覆盖基本保住;若只能回答一个,说明另外两个意图已经流失,需要评估是否值得为它们单独保留页面或调整目录层级。这里的关键动作是逐条比对,而不是看页面总数是否好看。
如果被缩减的两个需求分别属于“主体”和“主体引发的争议事件”,合并几乎必然失败。争议事件通常需要独立的时间线、当事方回应和后续进展,塞进主体词条会稀释定义段,也会让读者在错误层级寻找答案。此时页面数量减少带来的不是覆盖集中,而是两边都答不清。
类似地,当两个需求分属不同法律主体或不同注册实体时,也不应合并。判断边界的方法很简单:把两个需求的事实来源放在一起,如果它们的时间、主体名称、事件因果无法共用同一段叙述,就说明合并条件不成立。
先做一次覆盖盘点:把缩减前后的候选需求逐条列出,标注每条需求当前由哪个页面、哪一段承接,以及支撑它的来源是否独立。盘点后会得到三类结果——已被现有页面直接回答的、只能间接回答的、完全无页面承接的。对第二类和第三类,优先调整现有页面的目录与首段,而不是立刻新增页面;只有当某一簇需求同时满足“来源独立”和“无法被现有页面首段回答”两个条件时,才把它列为需要单独保留或新建的对象。这样做的结果是,页面数量可以下降,但高价值需求不会因为页面消失而失去落点。