Decisive evidence gaps · v1.0
每条预测,只追一个能改变概率的数据包
登记 2026-07-19 · 首次结算 2026-10-19 · 先写规则,后看结果
5决定性数据包
3预写结算:上调 / 下调 / 不可判定
0允许用规模指标补因果缺口
10-19首次执行日期
停止规则
拿不到决定性数据,就诚实写“不可判定”
不可判定不是预测错误,也不是支持原判断;它只表示本复查期无法识别机制。原概率暂留,但不得用 ARR、交易数或宣传案例补洞。
五条预测的唯一数据包
| 预测 | 唯一决定性数据包 | 上调触发 | 下调触发 | 不可判定 |
|---|---|---|---|---|
| F-01 72% | 同产品相近客户,按 seat / usage / outcome / hybrid 分 cohort 的 12 个月消费兑现、GRR/NRR、毛利 | hybrid 占比扩大,兑现、留存、毛利不劣于席位 | 大量退回席位,或兑现/续费/毛利明显更差 | 只有价格页、ARR 总额或交易数 |
| F-02 58% | 同工作流相近客户,执行层 vs 只读层的 12 个月 NRR 与单客户毛利额 | 执行层两项持续更高,且非客户规模/服务投入造成 | 只增成本,NRR/毛利额无优势或更差 | 只有总 ARR、客户数或公司毛利率 |
| F-03 68% | 同等能力下,模型单价指数 vs 含重试、复核、支持、实施的每成功任务全成本 | 多数任务全成本降幅持续小于模型单价降幅 | 全成本等速或更快下降,且非个别产品特例 | 只有 token 价格或总成本,无成功任务分母 |
| F-04 66% | outcome 合同库:结果、归因窗口、冲正/争议、责任上限,并按反馈时长/责任分类 | 多数集中在短反馈、低争议、责任可封顶任务 | 长反馈高责任任务无四接口仍大规模普及 | 只有“按结果收费”宣传,无合同条款 |
| F-05 64% | 同任务同模型,有/无闭环或权威内容层,跨模型升级比较质量、复核成本、续费/愿付价格 | 优势跨升级保留并兑现为续费或价格 | 通用模型抹平质量与商业优势 | 只有数据量、产品增长或无对照案例 |
10 月 19 日怎么执行
- 先检查数据包字段是否齐全;不齐,直接登记不可判定。
- 写明缺失字段与已检查的公开来源,不能静默跳过。
- 只有命中预写的上调/下调条件,才调整概率。
- 若调整达到 ±10%,必须写入强制解释与变更日志。
停止收集
更多总收入、ARR、交易数、产品发布、管理层形容词和无对照客户案例。
更多总收入、ARR、交易数、产品发布、管理层形容词和无对照客户案例。
开始等待
可比 cohort、合同续费、单位毛利、成功任务全成本和同任务对照。
可比 cohort、合同续费、单位毛利、成功任务全成本和同任务对照。