当前位置:首页 > 文章列表 > 科技周边 > 人工智能 > OpenAI Agents SDK 怎么把沙箱任务拆成可恢复步骤

OpenAI Agents SDK 怎么把沙箱任务拆成可恢复步骤

来源:17golang原创 2026-09-07 01:45:55 0浏览 收藏

OpenAI Agents SDK 的沙箱任务要想失败后继续,关键不是把整段提示词再发一遍,而是同时保存“运行状态”和“工作区状态”。可以把任务拆成 prepare、transform、review 等阶段,每个阶段成功后在沙箱里写入一个幂等检查点;恢复时再根据故障位置选择 RunStatesession_statesnapshot。这套 Sandbox Agents 能力目前仍是 beta,接口细节可能变化。

记住一个简单判断:同一次 Agent 运行被暂停,用 RunState;还想连回已经序列化的沙箱会话,用 session_state;要启动一个新沙箱但带上旧文件,用 snapshot。snapshot 保存的是工作区内容,不是完整的对话历史。
要点速览
  • Manifest 负责新会话的初始工作区,不能代替运行期间产生的检查点。
  • 每个阶段只在产物落盘并可复查后更新 checkpoint.json,重试才有明确起点。
  • 恢复前要确认快照来源、检查点版本和沙箱会话身份,不能把未经确认的容器 ID 当成恢复依据。

先把三种恢复边界分开

这三个名字容易被当成同一种“保存状态”,但负责的对象不同。RunState 是 Runner 管理的运行级暂停/恢复边界,适合人工审批、进程中断或需要继续同一条运行链的场景;session_state 是已经序列化的沙箱会话状态,交给同一个沙箱客户端去重连;snapshot 则是新会话的工作区种子,里面应该是可以重新装载的文件和产物。

场景主要保存物下一次运行的入口
一次运行被暂停或需要人工接管RunState恢复原来的 Runner 状态
沙箱客户端仍可识别原会话session_stateSandboxRunConfig(session_state=...)
原会话已结束,要新建一个沙箱工作区快照SandboxRunConfig(snapshot=...)
OpenAI Agents SDK 中 SandboxAgent、Manifest、SandboxRunConfig 与三种恢复载体的静态边界关系
图1:把 Agent 定义、初始工作区和运行配置放在运行定义域,把 RunState、session_state 与 snapshot 放在恢复载体域,避免把对话、会话和文件状态混成一层。

尤其不要把 snapshot 当作聊天记录备份。它的职责是恢复文件、目录和生成的工件;如果还需要继续模型对话,应另外保存 SDK 的会话或运行上下文。挂载目录和临时目录也不应被当成快照中的永久文件。

为每个阶段写入幂等检查点

“可恢复”首先是业务设计,其次才是 SDK 配置。每个阶段应该有稳定名称、输入摘要、产物路径和状态。阶段成功后再写检查点,失败时不要先把阶段标成完成;这样即使下一次从快照启动,也能判断哪些文件可信。

from pathlib import Path
import json

STAGES = ("prepare", "transform", "review")
CHECKPOINT = Path("state/checkpoint.json")

def save_checkpoint(stage, artifacts):
    # 只有产物已经落盘并可复查时,才推进检查点
    CHECKPOINT.parent.mkdir(parents=True, exist_ok=True)
    payload = {"stage": stage, "artifacts": artifacts}
    CHECKPOINT.write_text(json.dumps(payload, ensure_ascii=False, indent=2), encoding="utf-8")

def next_stage():
    # 缺少检查点就从第一阶段开始,避免凭猜测跳过工作
    if not CHECKPOINT.exists():
        return STAGES[0]
    saved = json.loads(CHECKPOINT.read_text(encoding="utf-8"))
    index = STAGES.index(saved["stage"])
    return STAGES[index + 1] if index + 1 

这段代码刻意只记录文件工件,不记录模型“认为已经完成”的自然语言。生产任务还应给每个阶段增加输入摘要、写入时间和版本号;重试时先验证这些工件存在,再决定是否跳过已经完成的阶段。阶段函数要做到幂等,例如重复执行 transform 不会把同一个结果追加两次。

OpenAI Agents SDK 沙箱任务中阶段输入、SandboxRunConfig、工作区 checkpoint.json、snapshot 与下一阶段的静态关系
图2:检查点文件位于沙箱工作区内,快照只负责把已确认的工作区带到新会话;下一阶段仍要读取检查点并验证产物,而不是盲目重放全部任务。

用 SandboxRunConfig 组织恢复或新建

真正调用 Runner 时,先问一个问题:手上是活的 session、可反序列化的 session_state,还是只有工作区快照?活会话由应用自己负责生命周期;序列化会话需要客户端恢复;只有快照时则创建新的沙箱。下面的配置表达的是选择关系,快照目录应由应用配置,不要从用户输入拼接受信任的宿主路径。

from pathlib import Path
from agents import Runner
from agents.run import RunConfig
from agents.sandbox import LocalSnapshotSpec, SandboxRunConfig
from agents.sandbox.sandboxes.unix_local import UnixLocalSandboxClient

async def run_from_snapshot(agent, prompt):
    # 新会话从持久化工作区启动;对话历史仍由上层单独管理
    client = UnixLocalSandboxClient()
    sandbox = SandboxRunConfig(
        client=client,
        snapshot=LocalSnapshotSpec(base_path=Path("/var/lib/agent-snapshots")),
    )
    return await Runner.run(agent, prompt, run_config=RunConfig(sandbox=sandbox))

如果原沙箱仍然可信且只是在进程间迁移,传入序列化后的 session_state;如果是 Runner 自己管理的暂停流程,优先让 RunState 携带它的沙箱状态。不要把三者同时填上再期待 SDK 替你猜意图,恢复来源应该由外层任务状态明确选择。

故障后按检查清单恢复

  1. 先读取 checkpoint.json,确认最后一个成功阶段和产物清单;文件不完整就回退到上一个检查点。
  2. 判断故障属于运行暂停、会话断开还是工作区重建,分别选择 RunStatesession_statesnapshot
  3. 为当前阶段生成新的幂等任务键,避免重试把外部写入、上传或通知执行两遍。
  4. 恢复后先做轻量复查:工作目录存在、检查点版本匹配、必需工件可读,再让 Agent 继续。
  5. 如果容器身份或快照来源无法确认,宁可从可信快照新建沙箱,也不要附着到不明会话。

这套拆分的价值在于把“模型继续思考”和“文件继续存在”分开管理。前者由运行或会话状态负责,后者由检查点和快照负责;任何一层丢失时,故障范围都能被限制在当前阶段。

OpenAI Agents SDK 沙箱恢复常见问题

RunState 和 snapshot 能互相替代吗?

不能。RunState 面向一次 Runner 运行的暂停与恢复,snapshot 面向新沙箱的工作区内容。一个保存了运行上下文,也不意味着另一个会自动保存所有文件。

什么时候应该使用 session_state?

当应用已经把沙箱会话序列化,并且仍准备通过同一个客户端恢复该会话时使用。若只想带着文件启动干净的新会话,应改用 snapshot。

检查点文件要不要写进 snapshot?

要。检查点是判断阶段和产物是否可信的最小依据,应与对应产物一起持久化;但恢复后仍要检查版本和文件完整性。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go 关闭 channel 后继续发送为什么直接 panicGo 关闭 channel 后继续发送为什么直接 panic
上一篇
Go 关闭 channel 后继续发送为什么直接 panic
Go 怎么为 ZIP 文件生成目录索引而不解压内容
下一篇
Go 怎么为 ZIP 文件生成目录索引而不解压内容
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • SuperCLUE中文大模型评测基准:功能、能力维度与应用指南
    SuperCLUE
    SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
    167次使用
  • C-Eval中文评测基准:大语言模型多学科能力评估指南
    C-Eval
    深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
    93次使用
  • AI Prompt Library:免费AI提示词库,助力ChatGPT高效创作与营销
    AI Prompt Library
    探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
    16次使用
  • LangGPT提示词框架:结构化Prompt设计方法与开源工具指南
    LangGPT
    LangGPT是一种受编程语言启发的结构化提示词设计工具,提供双层框架、模块化模板及变量功能,帮助用户高效编写高质量Prompt。该项目已在GitHub免费开源,适用于内容创作、编程辅助等多场景。
    29次使用
  • ClickPrompt:AI提示词生成与优化工具,支持Stable Diffusion、ChatGPT及代码辅助
    ClickPrompt
    ClickPrompt是一款专为AI提示词编写者设计的开源在线工具,支持Stable Diffusion绘图、ChatGPT对话及GitHub Copilot代码辅助。提供Prompt自动生成、一键运行、社区分享及可视化优化功能,帮助用户高效获取精准AI输出。
    61次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码