OpenAI Responses API 迁移时旧状态模型如何处理
如果你的系统还把 Assistants API 的 Thread ID 当成唯一会话状态,迁移到 Responses API 时最容易踩的坑不是改接口名,而是历史数据归属变了。Assistants API 已在 2026 年 8 月 26 日停止服务,旧 Thread 消息接口不能再作为迁移时的读取入口。正确做法是先使用应用自己保存的消息,转换为 Responses 的输入项,再创建 Conversation 或按需串联 Response。
官方迁移文档:https://developers.openai.com/api/docs/assistants/migration
旧状态不会因为换成 Responses API 就自动出现在新会话里。把历史消息掌握在自己的存储中,长期会话使用 Conversations,短链路续问使用 previous_response_id,并单独保存模型、提示词版本和业务会话的映射关系。
- Assistants、Threads、Runs、Run steps 分别对应 Prompts、Conversations、Responses、Items,迁移重点是职责重画而不是机械改名。
- 旧历史应从应用数据库、消息表或归档中恢复,不能等旧 Thread 接口替你导出。
- Conversation 适合可恢复的长期会话;
previous_response_id适合短链路,但两者不能在同一次请求中同时使用。
先处理历史归属:旧 Thread 不是新 Conversation
迁移前先列出每个业务会话的用户消息、助手消息、图片输入、工具调用结果和时间顺序。若这些内容只存在 OpenAI 的旧 Thread 中,迁移窗口已经结束后就没有可靠的旧接口可供读取;若应用曾同步保存消息,就应以自己的记录为准重建。
可以把旧对象按职责理解,而不要把 ID 直接互换:
| 旧对象 | 新对象 | 迁移时要保留什么 |
|---|---|---|
| Assistant | Prompt 或应用配置 | 模型、指令、工具声明、版本 |
| Thread | Conversation | 用户与助手的有序输入项 |
| Run | Response | 一次模型响应、工具回合和输出 |
| Run step | Item | 消息、工具调用、工具结果等具体事件 |

历史消息应先转成输入项,再启动新会话
历史转换时至少区分 user 和 assistant,把文本放入对应的输入内容类型;图片输入则保留原始可访问地址或文件引用。迁移脚本应记录原 Thread ID、目标 Conversation ID、最后一条消息时间和转换失败原因,便于重跑而不重复导入。
import OpenAI from "openai";
const client = new OpenAI();
// 历史消息来自应用自己的数据库,不再读取已经停止服务的旧 Thread 接口。
const legacyMessages = await loadMessagesFromDatabase("biz-session-42");
const items = legacyMessages.map((message) => ({
// 只把旧角色映射成 Responses 可理解的输入角色。
role: message.role === "assistant" ? "assistant" : "user",
content: [{
// 迁移文本时保留原顺序,避免把多轮上下文拼成一段摘要。
type: message.role === "assistant" ? "output_text" : "input_text",
text: message.text,
}],
}));
// 创建后把新 ID 与业务会话绑定,后续请求只使用这个映射。
const conversation = await client.conversations.create({ items });
await saveConversationLink("biz-session-42", conversation.id);
// 新消息走 Responses API;这里不把 conversation 和 previous_response_id 混用。
const response = await client.responses.create({
model: "gpt-5.5",
conversation: conversation.id,
input: [{ role: "user", content: "请继续处理这条业务请求。" }],
});
console.log(response.output_text); // 只打印可展示文本,工具 Item 另行记录。
示例只表达迁移边界:真实项目需要为图片、工具调用、失败重试和重复导入增加分支。尤其不要把数据库中的助手输出重新包装成用户输入,否则后续模型会失去原有角色语义。
Conversation 与 previous_response_id 怎么选
Responses API 有两种常见的状态管理方式。Conversation 是一个可持续的项目级会话容器,输入项和输出项会归档到其中,适合客服会话、审核任务和需要跨进程恢复的业务。previous_response_id 则是把下一次 Response 接到上一次 Response 后面,适合一次任务中的短链路追问、分支实验或临时确认。

| 场景 | 优先方案 | 额外注意 |
|---|---|---|
| 跨服务、跨天恢复的业务会话 | Conversation | 保存业务会话与 Conversation ID 的一对一映射 |
| 一次请求后的紧接追问 | previous_response_id | 要保存上一个 Response ID,并处理过期或不可取回 |
| 零数据保留或自管上下文 | 手动传入完整输入 | 自行控制脱敏、截断和上下文窗口 |
两者不能在同一次请求中同时使用。使用 previous_response_id 时,前一响应的 instructions 不会自动带到下一次请求,所以模型、提示词版本和租户策略不要只藏在上一轮。官方文档还提示,响应对象默认保存 30 天;Conversation 中的项目不受这个 30 天 TTL 约束。即便沿用 previous response 链,之前的输入 token 仍会计费,不能把它当成免费缓存。
迁移后的兼容检查要看三个结果
第一,用一段已脱敏的历史消息回放,确认角色顺序、图片输入和工具结果没有错位。第二,连续发送两条新消息,分别验证 Conversation 续接和 previous response 续接,确认业务侧拿到的是同一条会话链。第三,人为制造上下文过长、Response ID 不可取回和重复导入,检查系统是否能回退到自己的消息存储并重新组装输入。
如果只是新项目,不必再设计 Assistants、Thread、Run 三层对象;直接让业务会话、Prompt 版本、Conversation、Response 和 Item 各自承担清晰职责,后续切换模型或工具时会更容易追踪。
常见问题
旧 Assistant ID 能直接当作 Prompt ID 使用吗?
不能。迁移指南要求从控制台或新的配置流程创建 Prompt,并重新确认模型、指令、工具和版本;旧 ID 不是新资源的同义字段。
没有保存旧 Thread 消息怎么办?
先盘点业务日志、客服记录、缓存归档和导出文件。若历史确实没有留存,不要编造上下文,改为从新的用户输入建立 Conversation,并在系统中记录迁移缺口。
previous_response_id 适合永久保存聊天记录吗?
不适合单独承担永久记录职责。它解决的是响应之间的续接;长期可审计会话仍应使用 Conversation 或自己的消息存储,并设计删除、脱敏和归档策略。
Go net/url JoinPath 如何避免路径双斜杠
- 上一篇
- Go net/url JoinPath 如何避免路径双斜杠
- 下一篇
- PHP pcntl_signal 异步回调如何避免重入
-
- 科技周边 · 业界新闻 | 3小时前 |
- Python 新异步任务组能力如何影响服务编排
- 170浏览 收藏
-
- 科技周边 · 业界新闻 | 6小时前 | 云原生 · WebAssembly · 架构设计 · wit · 组件模型 · WebAssembly Component Model WIT WebAssembly组件 服务边界
- WebAssembly Component Model 适合拆分哪些服务边界
- 249浏览 收藏
-
- 科技周边 · 业界新闻 | 9小时前 | 云原生 · kubernetes · 网关路由 · Kubernetes ingress Gateway API HTTPRoute
- Kubernetes Gateway API 替换 Ingress 时要核对哪些路由
- 311浏览 收藏
-
- 科技周边 · 业界新闻 | 10小时前 | 日志 · trace · opentelemetry · 可观测性 OpenTelemetry trace_id 日志关联
- OpenTelemetry 日志信号进入生产后如何和 trace_id 对齐
- 400浏览 收藏
-
- 科技周边 · 业界新闻 | 11小时前 | gitHub actions · 持续集成 · 构建验证 · GitHub Actions runner images 构建矩阵
- GitHub Actions Runner Images 更新时如何验证构建矩阵
- 344浏览 收藏
-
- 科技周边 · 业界新闻 | 12小时前 |
- OpenTelemetry GenAI 语义约定变化后如何整理追踪字段
- 272浏览 收藏
-
- 科技周边 · 业界新闻 | 14小时前 |
- PHP 8.5 新语法发布后旧项目如何安排兼容性扫描
- 430浏览 收藏
-
- 科技周边 · 业界新闻 | 16小时前 |
- Python 3.14 free-threaded 构建如何确认解释器模式
- 446浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 31次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 135次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 71次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 27次使用
-
- CMMLU
- 深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
- 17次使用
-
- Redis 向量集合怎么落地:VADD、VDIM 与 VSIM 的维度和结果校验
- 2026-08-16 225浏览
-
- AI 批量调用成本控制:从请求日志到预算阈值的完整工作流
- 2026-06-17 202浏览
-
- AI 调用可观测架构:从散乱日志到 OpenTelemetry GenAI 字段统一
- 2026-07-01 427浏览
-
- Go 接 Responses API background mode:轮询异步任务、状态与数据保留边界
- 2026-07-24 183浏览
-
- Go 调用 OpenAI Responses API 后台模式:从超时请求迁移到可轮询任务
- 2026-07-24 388浏览

