← 所有文章结果与验收 / METHOD NOTE

演示之后,怎样验收一个 AI 试点

用同样的任务比较表现,也把失败和维护成本记下来。

先约定怎样算完成

在开始前说明任务、样本、预期输出和判断人。每项需求都应对应到交付物与检查方式,避免实现完成后才发现双方说的“做好”并不一样。

用同题样本比较

让原流程与试点处理相同或可比较的任务,记录耗时、错误和需要人工介入的位置。样本应包含常见任务,也包含信息缺失和例外情况。

单独看失败

记录失败发生在哪里:资料缺失、规则冲突、检索错误还是操作交接中断。不要用一个平均值把不同原因混在一起。能解释失败,才能判断下一步怎样改。

把继续使用算进去

交付还包括权限、更新责任、操作说明和维护方式。一次成功演示没有回答长期使用的问题。用实际结果决定继续、调整或停止,并留下可复查的依据。