OpenAI Responses API 怎么把工具调用结果串成多轮任务
把 Responses API 接入订单、库存或内部查询时,真正容易出错的不是工具定义,而是第二轮请求没有把“哪一次调用的结果”交还给模型。稳定做法只有一条:读取 response.output 里的 function_call,按 name 执行本地函数,再用同一个 call_id 生成 function_call_output。需要继续对话时,可以用 previous_response_id 接上响应链;但 tools 和 instructions 仍应在下一轮明确提供。
function_call是模型提出的调用请求,arguments只是 JSON 字符串,必须在应用侧解析和校验。- 业务结果通过
function_call_output回传,call_id对不上,模型就无法把结果归到正确调用。 - 多轮续接可以选
previous_response_id,但不要把它误当成完整应用状态库;审计、重放和超长链路仍应自管输入输出。
先把一次工具调用拆成三类状态
以“查询订单后再给出处理建议”为例,模型先返回调用名和参数,应用执行数据库或业务服务,最后再把结果交回模型。这里至少要保存三类状态:模型请求的 arguments、用于关联的 call_id、以及可供模型继续判断的业务结果。不要只把结果拼成一段普通用户文本,否则下一轮缺少工具调用上下文。
import json
from openai import OpenAI
client = OpenAI()
# 工具参数只描述模型需要决定的字段,业务权限仍由本地代码控制
tools = [{
"type": "function",
"name": "lookup_order",
"description": "查询订单当前状态和可执行的下一步",
"parameters": {
"type": "object",
"properties": {"order_id": {"type": "string"}},
"required": ["order_id"],
"additionalProperties": False,
},
}]
# 首轮只负责让模型判断是否需要工具
response = client.responses.create(
model="gpt-5",
instructions="只能根据工具返回的订单事实回答,不要猜测状态。",
tools=tools,
input="帮我查订单 A-1024,并说明下一步。",
)
tool_outputs = []
for item in response.output:
if item.type != "function_call":
continue
args = json.loads(item.arguments)
# 生产代码应在这里校验订单格式、租户和访问权限
result = lookup_order(args["order_id"])
tool_outputs.append({
"type": "function_call_output",
"call_id": item.call_id, # 必须回填模型给出的同一标识
"output": json.dumps(result, ensure_ascii=False),
})

一个响应可能含有多个函数调用,所以应遍历整个 response.output,而不是只取第一个。工具异常也建议返回结构化结果,例如 {"ok": false, "code": "ORDER_NOT_FOUND"},让模型决定如何向用户解释;不要把数据库异常堆栈直接暴露给模型。
用 previous_response_id 把下一轮继续接上
拿到工具结果后,下一次请求需要让模型同时看到上一轮响应和本轮工具输出。短链路可以使用 previous_response_id=response.id,并把工具结果作为新的 input 传入:
# 用上一轮 response.id 续接,但仍显式声明工具和行为约束
follow_up = client.responses.create(
model="gpt-5",
previous_response_id=response.id,
instructions="只用工具结果回答;如果结果失败,给出可操作的排查建议。",
tools=tools,
input=tool_outputs,
)
print(follow_up.output_text)
这里有两个常见误解。第一,previous_response_id 是响应链的指针,不等于你自己的会话数据库;需要跨租户审计时仍要落库。第二,官方文档明确提醒,使用它时上一轮的 instructions 不会自动带到下一轮,因此每一轮都要把关键约束写清楚。

多轮循环里,参数和错误要各自负责
如果模型在收到订单结果后还需要查询物流,应用会再次得到新的 function_call。因此不要把流程硬编码成“最多两次请求”,而是用有上限的循环:每轮处理所有调用,达到上限就返回人工接管或明确失败。参数 JSON 解析失败、未知工具名、业务超时,都应该在应用侧记录并转成稳定的错误对象。
| 对象 | 谁负责 | 推荐处理 |
|---|---|---|
name | 模型选择、应用白名单 | 未知名称立即拒绝 |
arguments | 模型生成、应用校验 | 解析后检查类型、租户和权限 |
call_id | API 生成、应用回填 | 原样写入工具输出 |
output | 业务系统提供 | 返回最小必要事实和错误码 |
工具数量也不宜一次暴露过多。先提供当前任务真正需要的函数,既减少输入上下文,也让模型更容易选对工具。对于需要人工确认的写操作,工具函数先返回“待确认”状态,把真正提交动作放到确认后的独立接口。
什么时候保存 previous_response_id,什么时候保存完整历史
只做一次查询和一次解释时,保存最后一个 response.id 就够轻量;要支持重放、问题定位、跨服务恢复或合规审计,则应保存每轮输入、响应摘要、调用参数、工具输出和错误码。自己维护 input 历史时,要把上一轮响应中的相关输出项与工具结果一起纳入下一次请求,不能只保存最终文本。
- 短任务:
previous_response_id+ 每轮重复的tools与instructions。 - 可恢复任务:自管事件表,按
response_id、call_id和业务请求号建立关联。 - 高风险写操作:工具返回待确认状态,确认事件与真正执行事件分开记录。
常见问题
为什么回传工具结果后模型仍然重复调用?
优先检查 call_id 是否与对应的 function_call 完全一致,以及下一轮是否仍提供了同一工具定义和清晰的完成条件。
多个 function_call 可以只回传一个吗?
不建议。遍历本轮全部调用并逐个回传;漏掉其中一个时,模型可能一直等待缺失结果。
工具结果应该返回字符串还是 JSON?
两者都可以,关键是稳定、短小且可解释。订单状态、错误码和下一步建议适合用 JSON,便于应用日志与模型理解保持一致。
Go nil 指针方法为什么有时能调用有时会 panic
- 上一篇
- Go nil 指针方法为什么有时能调用有时会 panic
- 下一篇
- Go bufio.Scanner 读取长日志怎么解除单行长度限制
-
- 科技周边 · 人工智能 | 14小时前 | 人工智能 · faiss · 向量数据库 · 向量检索 FAISS IndexIDMap 文档ID
- FAISS 检索结果怎么映射回原始文档 ID
- 426浏览 收藏
-
- 科技周边 · 人工智能 | 16小时前 |
- 向量检索怎么按租户和文档类型过滤结果
- 473浏览 收藏
-
- 科技周边 · 人工智能 | 18小时前 | 人工智能 · LangChain · rag · RAG 文档分块 RecursiveCharacterTextSplitter chunk_size chunk_overlap
- RAG 文档分块怎么设置 chunk_size 和 overlap
- 192浏览 收藏
-
- 科技周边 · 人工智能 | 19小时前 | 检索增强生成 RAG 重排 CrossEncoder
- RAG 检索结果怎么用 CrossEncoder 重新排序
- 237浏览 收藏
-
- 科技周边 · 人工智能 | 20小时前 |
- 本地大模型反复输出同一句话怎么调整生成参数
- 501浏览 收藏
-
- 科技周边 · 人工智能 | 21小时前 | python · 人工智能 · transformers · 流式输出 · SSE Transformers TextIteratorStreamer 流式生成
- Transformers 怎么把生成结果逐段返回给网页
- 472浏览 收藏
-
- 科技周边 · 人工智能 | 22小时前 |
- Hugging Face 模型缓存怎么换目录并离线加载
- 384浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- 本地大模型聊天效果差怎么检查 chat template
- 273浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- 大模型批量输入为什么要设置 padding 和 attention_mask
- 282浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 | 人工智能 · transformers · 文本处理 · Transformers 文本分段 tokenizer max_length stride
- Transformers 文本超过最大长度怎么分段处理
- 286浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- Embedding 向量归一化后应该用点积还是余弦相似度
- 103浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- SuperCLUE
- SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
- 167次使用
-
- C-Eval
- 深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
- 93次使用
-
- AI Prompt Library
- 探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
- 15次使用
-
- LangGPT
- LangGPT是一种受编程语言启发的结构化提示词设计工具,提供双层框架、模块化模板及变量功能,帮助用户高效编写高质量Prompt。该项目已在GitHub免费开源,适用于内容创作、编程辅助等多场景。
- 28次使用
-
- ClickPrompt
- ClickPrompt是一款专为AI提示词编写者设计的开源在线工具,支持Stable Diffusion绘图、ChatGPT对话及GitHub Copilot代码辅助。提供Prompt自动生成、一键运行、社区分享及可视化优化功能,帮助用户高效获取精准AI输出。
- 60次使用
-
- 本地大模型反复输出同一句话怎么调整生成参数
- 2026-09-06 501浏览
-
- Python 调用大模型时如何用结构化输出校验 JSON:从解析失败到可重试
- 2026-08-29 501浏览
-
- AI写作工具免费版安装教程(含豆包Clawdbot)
- 2026-05-30 501浏览
-
- WPS AI能自动生成PPT吗?输入主题一键制作演示文稿
- 2026-05-27 501浏览
-
- Canva手机闪退解决方法及适配指南
- 2026-05-25 501浏览

