为什么第一步比模型更重要
选错第一个场景,后续 3-6 个月都会被绑在低价值或不可行的方向上。选对第一个场景,即使模型不完美,也能在真实样本上跑出可对比的指标,作为后续扩展的基础。
第一个场景的判断标准
同时满足四条,才进入候选:
- 今天有人在做:不是"未来可能做",而是当前由员工在重复执行。
- 有可量化的结果:时间、错误率、人工步骤或业务结果至少有一项可统计。
- 有真实样本:可以拿到 30 条以上的真实数据用于验证。
- 允许保留人工确认关口:不是"全自动化",而是"AI 做一部分,人做关键判断"。
五维评分表
每个候选场景 0-5 分:
- 频率:每周发生次数;高 = 5
- 成本:单次耗时与错误成本;高 = 5
- 风险:出错后业务影响;低 = 5
- 数据:是否有真实可用的样本与口径;好 = 5
- 阻力:业务、流程、组织上的推行难度;低 = 5
按总分排序,优先选择同时满足"四条件"且评分最高的 1-3 个场景做技术验证。
一个真实样本
在外贸代理场景中,可用同一张评分表把候选场景从 12 个筛到 3 个,再在真实样本上验证关键判断。验证不通过的场景不进入开发,验证通过的才立项。
常见错误
- 把"老板觉得重要"等同于"AI 场景"。
- 第一个场景就选最难、最高风险的。
- 没有真实样本就开始开发。
- 把"AI 能不能做"当成问题;真正的问题是"今天谁在做、做得怎样、能不能更好"。
立项后下一步
进入 FDE 落地或 Agent 定制,按"先验证关键判断,再开发接入,再指标验收"的节奏推进。