正在加载模式…
💾
持久化执行与检查点(DE)
在每一步都持久化工作流和智能体的状态,使长时间运行的任务在崩溃后能从最近的检查点恢复、在不重复已完成工作的情况下确定性地重放、为等待人工输入而暂停并恢复,并通过从更早的检查点分叉来实现时间回溯。以检查点为支撑的图引擎(如 LangGraph)以及 Temporal 式的持久化引擎,为可靠、长期运行、人在回路的智能体提供了底层支撑。
复杂度: high工作流编排
30秒速览
- 是什么
- 在每一步之后持久化工作流状态,因此崩溃后可从最近的检查点恢复,重放会跳过已完成的工作,运行还能从更早的时点分叉。
- 何时使用
- 崩溃代价高昂的长时间多步骤任务、流程中途需要人工审批,或必须在不重做已完成步骤的前提下重试的场景。
- 注意
- 检查点存储与序列化开销可能占据大部分运行时间;非确定性步骤(随机数、外部调用)会破坏重放保证。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
持久化执行与检查点: 概览
在每一步都持久化工作流和智能体的状态,使长时间运行的任务在崩溃后能从最近的检查点恢复、在不重复已完成工作的情况下确定性地重放、为等待人工输入而暂停并恢复,并通过从更早的检查点分叉来实现时间回溯。以检查点为支撑的图引擎(如 LangGraph)以及 Temporal 式的持久化引擎,为可靠、长期运行、人在回路的智能体提供了底层支撑。
- State checkpointed after each step
- Crash recovery resumes from the last checkpoint
- Deterministic replay skips completed steps
- Interrupt and resume for human-in-the-loop
- Time-travel: fork alternate runs from any checkpoint
- Durable timers for long waits and retries
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前