Demo、原型、PoC、试点和生产能证明的事情不同。FDE 要公开每个阶段的证据与限制,并在进入生产前落实接口、版本、日志、告警、回滚和运行责任。项目结束时要回答两个问题:客户内部获得了什么可继续运行的能力,交付方又从现场获得了什么经过验证的产品输入。只有前者,交付方会不断重复定制;只有后者,客户会继续依赖外部团队。工程主修要提交真实运行和故障证据:发布、回滚、人工接管、事件响应与组件复用都必须经过演练或实际运行验证。
- 建立可回滚发布与运行责任
- 组织故障分级、响应、恢复与复盘
- 将验证过的共性能力沉淀为平台组件
从概念到可执行判断
从试点到生产的发布门
Demo 展示一个想法;原型验证最大不确定性;PoC 证明关键技术与质量可以成立;试点让限定用户在真实任务中运行;生产要求稳定、可支持、可审计并有持续责任。
前一阶段成功不能自动证明后一阶段已经就绪。项目汇报必须写清当前阶段和仍未证明的部分。
进入下一阶段前检查真实数据、用户、接口、质量、权限、日志、回退和负责人。PoC 毕业进入试点,需要关键质量、代表性样本、真实用户与业务流程都具备。
试点进入生产,还要补齐容量、稳定性、告警、故障响应、发布和维护责任。
生产代码、可观察性与回滚
生产交付需要版本控制、测试、配置与密钥管理、发布记录、Trace、日志、业务指标、告警和回滚。每次运行保留模型、Prompt、知识、输入、输出、人工干预、时延和成本。
生产代码硬边界保证系统可被定位、修复和恢复。它不能在项目后期临时补齐。
运行责任、故障响应与退出
上线前明确谁响应故障、谁批准变更、谁更新知识、谁判断业务影响、谁与用户沟通。外部 FDE 还要说明支持范围、响应时限、升级路径和退出条件。
客户接管不等于外部团队立即离场。责任应通过共同运行、演练和逐步移交完成。
用故障演练验证恢复
选择一个代表性依赖中断、越权或结果风险,演练检测、分级、告警、人工接管、回滚、恢复和复盘,记录每个响应时间与责任人。
从现场沉淀平台组件
每个项目结束都要区分客户独有问题、同类客户会重复的问题、可做成模板或 Skill 的内容,以及需要平台解决的系统能力。
备忘录还要记录哪些现场证据推翻了原有产品假设、临时修补为何出现,以及不建议产品化的原因。
第一层复用方法、检查表和作业模板;第二层复用 Skill、连接器和评估组件;第三层才进入平台能力。越接近平台,越需要跨客户证据和维护责任。
不是所有客户需求都应该产品化。过早把专属规则写进平台,会把一次性交付问题长期带给所有客户。
从文档处理 Demo 到可试用工作流
演示时,团队提前整理好文档并手工补齐缺失信息,结果看起来稳定。
冷启动测试改用真实脱敏材料,让用户独立上传、查看来源、处理缺失字段并反馈错误。
暴露问题是原型的价值。越早看见隐藏人工和异常路径,越少在上线后付出代价。
五阶段门
每次推进前先问当前阶段能证明什么:
这个想法能否被清楚展示?
最大的未知假设是否得到快速验证?
关键技术、数据与质量是否达到预设毕业条件?
限定用户能否在真实工作中稳定使用并留下证据?
系统是否可支持、可观察、可回滚且有人持续负责?
先回答,再展开答案
01Demo、PoC 与试点最大的差别是什么?
Demo 展示想法,PoC 验证关键技术与质量,试点让限定用户在真实工作中运行。
02为什么 PoC 成功不能直接宣布生产上线?
生产还需要稳定性、权限、监控、告警、回滚、支持和持续责任。
03生产前必须明确哪些运行责任?
故障响应、变更批准、知识更新、业务影响判断、用户沟通和升级退出。
04所有客户需求都应该进入平台吗?
不应该。客户专属规则需要与跨客户共性问题分开,平台能力还需要复用证据和维护责任。
把方法带回真实工作
企业内部推进(默认)
对企业内部真实试点执行发布、故障恢复演练与一项组件化候选评审。
外部客户交付(可选)
与客户运行团队共同完成发布门、故障演练与平台回流。
所需材料
- Agent PRD
- 代表性脱敏样本
- 测试环境与权限
- 目标用户与运行负责人
- 项目全部交付物
- 内部维护者
- 权限与责任安排
- 产品或平台评审角色
交付物
- 生产发布与回滚方案
- 故障响应、人工接管与复盘记录
- 平台组件候选与复用边界
通过标准
- 真实发布有阶段门、可观察性、回滚与人工路径
- 故障演练可验证检测、响应、恢复和责任
- 组件候选有多项目共性证据与不适用边界
能力证据
- 一次真实运行的发布记录、故障演练与回滚证据
- 一项经评审的平台组件复用证据或拒绝理由
填写模板或完成课程不等于能力达标;通过必须以真实任务、现场行为和可复核证据为依据。