没有真实业务数据时,构造有限假设的正确做法不是“编一份完整报表”,而是把练习目标压缩成一条可验证的因果链:先固定一个输入条件,再规定一个可观察输出,最后写清哪些结论不能从这个输出推出。只要输入和输出都能在本地或公开页面上复现,练习就成立;反过来,如果假设依赖真实流量、真实排名或真实转化,那它就不属于可练习范围。
缺数据通常分两种,对应的假设构造方式完全不同。
第一种:完全没有后台权限,但能看到公开页面。此时可用的输入只有页面本身:标题写法、正文结构、内链位置、URL 层级、更新时间。你能构造的假设必须落在这些可观察项上,例如“把同一主题的两篇文章做不同内链密度,观察抓取路径是否变化”。这里不能假设点击率、停留时长或转化率,因为你没有观测手段。
第二种:有部分后台数据,但样本量小或时间窗口短。此时可以做对照,但必须给假设加上“仅在本样本内成立”的限定。例如两周内只有几十次展现,那么“标题改动后展现上升”只能作为待验证方向,不能当作规则。判断依据是:数据量是否足以区分随机波动与处理效应。做不到这一点,就退回到第一种条件。
选择哪种条件,取决于你能否对输出做重复观测。能重复观测的,才值得写成假设;只能观测一次的,写成观察记录即可。
一个可练习的有限假设应包含三部分:固定输入、单一变量、可观察输出。缺任何一部分,练习就会滑向空泛讨论。
假设写成一句话:在条件 A 下,只改变 X,输出 Y 会朝某个方向变化。例如“在页面内容不变的前提下,只把内链从正文底部移到首段之后,目标页获得的内链入口是否更早出现在抓取路径中”。这个假设不需要真实业务数据,只需要你能查看页面和抓取记录。
条件一:只能看到公开页面,没有任何后台记录。选择做“结构对照”而不是“效果对照”。动作是复制两个结构不同的页面,只改一个结构变量,然后手动记录差异。结果是你能得到一份结构差异清单,但推不出哪种结构更利于排名。下一步应把清单转成待验证问题,而不是直接改成模板。
条件二:有小样本后台数据,能看到展现和点击。选择做“时间前后对照”,但要接受它不能排除季节、竞争和平台改版的影响。动作是记录改动前后的同一指标,并标注同期是否有其他变化。结果是你能判断“是否值得继续观察”,不能判断“改动导致了变化”。下一步是延长观察窗口或增加对照页面,而不是立刻推广改动。
两种条件的分界不在数据多少,而在能否排除同时发生的其他变化。排不掉,就只能当假设,不能当结论。
假设你有一个练习站点,共 12 个页面,没有真实流量。你想练习内链规则,可以这样构造:
这个例子的价值在于:它强迫你把“内链更好”拆成可观察的入口变化,而不是停在感觉上。如果连入口变化都看不到,说明变量选得太大,应缩小到单个链接位置。
练习中最容易犯的错,是把某个现象归零或上升直接当成处理正确的证据。以下现象都有其他合理解释:
遇到这些现象,下一步不是下结论,而是补一个对照:找同类页面看是否出现相同变化。对照也没有,就说明当前数据不足以支撑任何判断,应退回只记录不推断的状态。
有限假设的终点不是“证明我对了”,而是得到一份可继续验证的问题清单。把每个假设标成三种状态:已观察到方向但未排除干扰、完全无法观察、观察结果与预期相反。第一种进入下一轮对照,第二种说明输入选错了,第三种最有价值,因为它直接告诉你原来的因果链缺了哪一环。只有把假设限制在可观察、可重复、可对照的范围内,没有真实业务数据时练习才不会变成自说自话。