可运行原型不等于精美演示。本课继续同一项目,用代表性测试找出失败模式,再为非作者准备发布、使用、失败恢复和反馈说明。
- 搭建能完成 MVW 的可运行原型
- 建立正常、异常与高风险测试集
- 准备发布、使用、恢复和复用说明
从概念到可执行判断
先跑通最小端到端原型
原型只实现 MVW 所需输入、步骤、输出、把关和恢复。先用一个经授权的正常样例跑通,保留每步输入输出和人工修改,不急于增加界面和自动动作。
构建三类测试集
正常样例检查主路径;异常样例覆盖缺失、格式、冲突和系统故障;高风险样例检查 Human Gate、拒绝和升级。每个样例写明期望结果与实际证据。
按失败模式修改
将错误区分为任务定义、输入、知识、步骤、模型、权限和人工交接问题。每次修改记录假设和影响,重跑关键测试,避免修好一个样例却破坏另一个。
为他人使用准备发布包
发布包包含适用任务、准备材料、操作步骤、检查点、异常与高风险处理、失败恢复、版本和反馈方式。在非作者试用前,不把作者会操作当作可复用证据。
销售拜访纪要的测试不只看文笔
原型在完整纪要上表现良好,但会对缺失决策人和未授权个人信息的样例自行补全。
项目增加缺失字段、冲突表述和敏感信息样例,要求缺失时标记待确认,敏感信息阻断并升级。
评估要证明流程知道何时停下,不只证明它能生成内容。
发布前六项检查
让每项都有实际测试证据:
正常样例能否完成完整任务?
缺失、冲突和故障能否停止或恢复?
Human Gate、拒绝与升级是否有效?
输入、来源、版本和修改是否保留?
非作者能否看懂准备、检查和恢复?
新版本失败时能否恢复已验证版本或人工路径?
先回答,再展开答案
01为什么正常样例通过还不能发布?
工作流还需证明能识别异常、阻断高风险并在失败后恢复。
02测试样例至少要包含哪三类?
正常、异常和高风险样例。
03为什么作者成功使用不能证明可复用?
作者掌握未写入说明的隐性知识,需由非作者独立试用才能发现缺口。
04发布包为什么要写恢复说明?
输入、工具或结果异常时,用户需能停止自动动作并回到可控的人工路径。
把方法带回真实工作
工作流项目任务
继续推进同一个岗位 AI 工作流改造项目,提交可运行原型、正常/异常/高风险测试和发布恢复说明。
所需材料
- L1-03 MVW、Human Gate 与失败恢复设计
- L1-04 上下文包与数据边界
- 经授权的正常、异常和高风险样例
交付物
- 可运行工作流原型
- 正常、异常和高风险测试记录
- 发布、使用、失败恢复与反馈说明
通过标准
- 原型能跑通 MVW
- 正常、异常和高风险测试有期望与实际结果
- 失败可恢复且高风险 Human Gate 有效
- 发布包足以供非作者试用
能力证据
- 一次完整原型运行记录
- 正常、异常和高风险测试证据
- 一份带版本的发布、使用与恢复说明
填写模板或完成课程不等于能力达标;通过必须以真实任务、现场行为和可复核证据为依据。