智能体工作流能生成结果,不代表已经适合自动写入业务系统。上线前,建议分别验收任务边界、状态保存、人工确认和重复执行;尤其要验证中断恢复后是否再次触发外部操作。下面是一份基于官方文档整理的检查清单,未作产品实测。
- 先确定哪些步骤固定,哪些步骤允许模型自行决策。
- 恢复流程需要可持久保存的状态,也要明确恢复的是哪一次任务。
- 人工确认与防重复执行分别验收,不能互相替代。
一、先写清任务边界
Anthropic在《Building effective agents》中,将按预定义代码路径编排模型和工具的系统称为工作流,将由模型动态决定过程和工具使用的系统称为智能体。[1] 这是该文采用的架构划分,并非所有产品都遵循的统一命名。
编辑建议:把实际业务拆成输入、判断、外部操作和验收四部分。以网站日更为例,选题可以允许模型探索,事实核查未通过就停止,发布数量与目标域名则应由明确规则约束。验收时记录每一步允许读什么、写什么、何时退出,避免把“模型认为完成了”当作唯一完成条件。
二、验证重启后能否找回状态
LangGraph官方文档区分了两类持久化:checkpointer保存线程内的图状态,store保存应用定义的跨线程数据。文档也提醒,InMemorySaver将检查点保存在内存中,进程重启后会丢失。[2] 因此,演示中可以暂停,并不自动证明部署环境能在重启后恢复。
建议在测试环境执行一次恢复演练:创建任务并记录任务标识,在外部写入之前暂停,重启执行进程,再检查能否找回同一任务及当前审批状态。保存草稿、保存执行状态、保存发布回执是不同责任,应分别检查,不能用存在一份文章文件来证明整个流程可恢复。
三、让人工确认对应具体操作
LangGraph的interrupt机制可以暂停图执行、等待外部输入;官方说明恢复需要检查点机制,并使用同一thread_id定位此前状态。[3] 这些机制提供了实现人工介入的基础,但不能替代业务系统自己的权限检查。
编辑建议:确认页面应展示目标网站、将执行的操作和待发布内容,并把批准结果与该版本绑定。内容变化后重新确认;拒绝后检查是否确实没有写入。对于已经明确授权的低风险日常操作,可按事先约定执行;新增访问权限等事项,应保留单独的授权边界。
四、用重复触发检查外部写入
LangGraph文档特别说明,interrupt恢复时会从所在节点开头重新执行,位于中断之前的代码可能再次运行。[3] 这是该框架的执行语义,不能直接推广为所有智能体平台的行为。
建议把“批准后执行”与“相同任务只产生一份结果”分别测试。测试环境连续提交同一任务、重复发送恢复信号,再模拟写入成功但回执未保存的情况;逐项核对是否出现重复文章、重复通知或多次业务写入。可为业务操作设置唯一标识,并在执行前后核对外部实际结果;这属于设计建议,可靠性仍需结合业务系统验证。
上线验收表可以只保留四行:任务边界是否明确、重启状态是否可恢复、批准是否对应当前操作、重试是否造成重复副作用。每行附测试输入、观察结果和失败处理方式,比只保留一段成功运行录像更方便复核。
适用条件与限制
本篇为架构与验收建议,不构成对任何平台可靠性的认证。恢复细节只依据核对日可访问的LangGraph文档;生产环境还应核对具体版本、持久化后端、权限及外部接口约束。Anthropic文章较早,仅引用其架构划分。没有性能对比或保证自动化无故障。