我们写着要把假设分层,自己的台账里却连一条成功标准都没有
为了确认规则是否被遵守,我们统计了文档中的词语,结果是3份。打开一看,全都是解释概念的文档,没有一处真正应用。我们改为公开一个没有字符串陷阱的数字。
我们在启动项目时,会写明要把假设拆成三层。
大假设 1个 问题的根本原因
└ 中假设 2~4个 若大假设成立则必须成立的事项
└ 小假设 各1个 在2周内实际做出判定的事项
我们决定检查一下,这一点在我们自己的文档中是否真正落实了。过程中发现了两件事:一件是我们工作上的缺陷,另一件是我们测量方法上的缺陷。第二件更为重要。
首先,测量错了
我们检索了全部工作文档,统计包含"大假设"一词的文档,结果是3份。这个数字很低,我们本打算直接使用。
但我们把这3份文档打开看了。
全部都是解释"大假设"这一概念的文档。一份定义了规则,一份审查了该规则,一份记录了内容选题。真正设立了大假设的项目文档,一份也没有。
"3份"的意思是出现这个词的文件有3个,而不是建立了这一层的项目有3个。我们统计的是字符串。
再核对一次,情况更加清楚。在准备本文的过程中我们写了几份相关文档,同一个数字随之增加到6份。并不是因为有人设立了大假设,而是因为使用"大假设"这个词的文档变多了。您正在阅读的这篇文章一旦发布,也会让这个数字再加一。
统计词语,和查看是否真正在做,是两回事。因此,本文没有把这个数字当作证据。
一个没有字符串陷阱的数字
我们转而查看了另一样东西。我们把所有判断都记录在决策台账中。开始撰写本文时,台账共有985条。
这不是文档正文,而是记录中的字段,所以我们看的不是词语,而是字段是否已填写。
- 判定该决策成功的标准 — 0条
- 看到什么就放弃 — 0条
- 何时重新审视 — 0条
985条中为0条。这里没有任何解读空间。
放在一起看,是这样的:
决策 985条
执行 2,825条
结果 66条
决策和执行不断累积,结果却不在那里。因为没有写下判定标准,事后也就无从判定。
然后是今天
在统计这些数字的过程中,我们把当天的三项决策新录入了台账。
这三项同样没有写成功标准。
我们在统计这个缺陷的同时,又把它制造了三次。并不是因为不知道规则——那条规则正是我们自己写的。
为什么会这样
原因很简单:做决策的时间点和做判定的时间点不同。
做决策时,要做什么是清晰的,所以只写这一点。"看到什么就承认这是错的",当时不写,工作照样推进。眼下没有任何问题。
问题出现在几个月后。重新打开那项决策时,没有人知道该以什么为标准来判断成败。于是往往以"当时那样做是对的"收场。这就不再是判定,而成了回顾。
为什么需要分层
- 大假设是项目赖以成立的前提。一旦它错了,一切都要重新审视,所以不会经常去动它。
- 中假设是大假设成立时必然随之成立的事项。即使被否定,项目依然存在。
- 小假设是切分到能在短周期内判定的大小。我们定为2周。
关键在于,否定会成为常态。某个中假设错了并不会让项目崩塌,所以大家能够说出"错了"。如果只有一层,否定假设就等于否定项目,于是没有人会说错了。
顺带一提,即使是设计良好的实验,目标指标得到改善的也只占1/3。另外1/3没有变化,剩下1/3反而变差。否定不是例外,而是默认状态。
如果今天只做一件事
请从正在进行的工作中只挑一项,写下一句话。
看到什么,就承认这是错的?
如果这句话写不出来,那项工作就还不是假设,而是计划。计划可以完成,却无法判定。
另外根据我们的经验再补充一点——检查这句话是否写下时,不要以文档里是否出现这个词来计数。我们就是这样做的,得到了3这个数字,打开一看却是0。
写这篇文章时改变了什么
过去的985条无法追溯补填。取而代之的是,在撰写本文期间,我们为当天的三项决策填上了三个字段——成功标准、放弃标准、复查日期。
989条中的3条。这不是值得炫耀的数字。但它是第一个不为0的数字,今后记录的决策从哪里起步,也由此确定。
如果不确定正在进行的工作是否处于可判定的状态
通过2分钟诊断,您可以看到现在应优先着手的一项课题、2周试点的启动方案,以及必须由人确认的风险。按您方便的程度作答即可。
注释
① 参考资料·核实日期(测量时间 2026-08-12 14:04 · 复测 15:37)
- 决策台账 985条 → 989条(测量期间增加)· 直接查询台账
- 成功标准 / 放弃标准 / 复查日期 各0条 → 3条 — 查询的是字段是否存在。3条为撰写本文时所填
- 执行 / 结果 2,825 → 2,841 / 66(正文中的数据块与985条属同一时间点的数据,故保留2,825)
- "大假设"字符串检索 3份(8/10)→ 6份(8/12)— ⚠️ 不作为证据,正文中仅作反例使用
⚠️ 决策台账是每天都在累积的记录。上述总数为测量时间点的数值,您阅读时已经更多。审核期间也在不断变化(983 → 984 → 985 → 989)。没有变化的是"0条"这一边——本文的论点不在于总数,而在于那个0。
实验结果按改善、无效、恶化各占1/3的说法,出自微软整理12年在线对照实验、于2015年在学术会议上发表的资料。
② 本文未使用的数据
- 没有把"含大假设的文档3份"作为缺陷的依据。初稿曾把它放进标题,但审核中有人指出字符串计数会被自我指涉所污染,核实后确实如此(从3增加到6)。我们没有替换数字,而是把这次失败本身保留在了正文中。
- 比例(%)表述 — 分母中大部分是日志、会议记录这类不需要假设的文档,换算成比例会显得比实际更糟。
- "命中率1/3" — 内部文档中是这样简写的,但原始资料是改善/无效/恶化各1/3。我们按原始资料表述。
- 2周标准的外部依据 — 虽有外部报告建议采用短周期,但其标准是1周。我们的2周比它宽松,因此没有借用他人的数字作为依据。
- 各业务线的细分数据 · 我们的课程、咨询满意度或业绩数据 — 与论点无关,已删去。
③ 制作方式
由AI生成初稿,经人工核实和编辑。初稿在事实审核中被退回过一次——指出核心数据按其测量方法并不成立,核实后确认属实,于是修改了标题和论点并重新撰写。未使用生成式图像或语音。
Engagement
浏览和互动会保存为内部内容运营指标。
要点
- •确认规则是否被遵守时,如果以文档中是否出现该词来计数,连解释概念的文档也会被一并算入,结果会比实际更好看。
- •决策台账985条中,写有成功标准、放弃标准、复查日期的各为0条(之后填写了3条);这个值看的是字段是否存在,没有解读空间。
- •决策和执行不断累积却没有结果,是因为做决策时没有写下判定标准,而不写眼下也不会有任何问题。
- •把假设分成三层后,中假设被否定时项目依然存在,否定因此成为常态;如果只有一层,就没有人会说错了。
- •即使是设计良好的实验,改善的也只有1/3,其余是无效或恶化,所以否定不是例外,而是默认状态。
常见问题
如何确认我们团队是否在遵守规则?
如果以文档中是否出现某个词来计数,连解释概念的文档也会被算进去,结果会比实际更好看。更准确的做法是看产出物中的字段是否已填写,也就是标准是否真正写了下来。
为什么决策中经常漏写成功标准?
因为不写,工作眼下也能推进。做决策时要做什么很清晰,于是只写这一点;而看到什么就承认错了,要到几个月后才需要。到那时已经无法再补写。
把假设分成三层,会带来什么变化?
否定会成为常态。只有一层时,说假设错了就等于说项目错了,于是没有人会提出来。只有在中假设被否定、项目依然存在的结构下,验证才会真正发生。
STAR-T
STAR-T首席顾问
作为IT服务规划和设计专家,我研究并分享来自各种初创公司和企业的成功案例。
立即行动
阅读之后,立即连接到可以执行的服务和咨询。
通过洞察理解问题后,下一步是确定执行结构。可以直接跳转到相关服务或免费咨询。