当前位置:首页 > 文章列表 > 科技周边 > 人工智能 > 工具调用参数校验怎么配置或排查

工具调用参数校验怎么配置或排查

来源:17golang原创 2026-09-13 06:50:21 0浏览 收藏

工具调用参数校验出问题时,先别急着改提示词。更稳定的做法是把问题拆成三层:工具定义是否生成了正确的 JSON Schema,模型返回的 tool_calls 是否符合当前框架的数据形状,最后才是业务参数能不能执行。Hugging Face 官方资料把工具名称、描述、参数类型和参数说明都视为模型选择工具的重要契约。

官方地址:https://huggingface.co/docs/transformers/main/chat_extras

要点速览
  • properties 描述字段,required 只列真正必填项,二者不能混用。
  • Transformers 常见工具调用里的 function.arguments 是字典;如果你的适配层给出 JSON 字符串,要先解析再校验。
  • 结构校验通过只代表“形状正确”,地点、权限、时间范围等业务规则仍要单独拦截。

先固定工具名、参数名和类型

最容易漏掉的是把自然语言说明写得很长,却没有把参数契约写完整。以天气工具为例,模型需要看到唯一的工具名、用途描述、参数对象、字段类型以及必填字段。函数签名、Python 类型提示、Google 风格 docstring 和手写 JSON Schema,至少要保证参数名一致。

from typing import Literal

def get_weather(location: str, unit: Literal["celsius", "fahrenheit"] = "celsius") -> str:
    """查询指定地点的天气。

    Args:
        location: 城市或地区名称。
        unit: 温度单位,只允许 celsius 或 fahrenheit。
    """
    # 这里只演示工具契约;真实项目应在这里调用受控的数据服务。
    return f"{location}: 22° {unit}"

tools = [get_weather]
# Transformers 会根据函数签名和 docstring 生成模型可见的 JSON Schema。
model_input = tokenizer.apply_chat_template(
    messages, tools=tools, add_generation_prompt=True, return_tensors="pt"
)
工具调用参数校验中工具名称、properties、required与模型工具列表的静态关系示意图
图1:工具定义与参数 schema 的关系示意,先看 properties 和 required 是否覆盖函数签名。

如果手写 schema,重点检查三件事:parameters.type 是否为 objectproperties 中是否有每个字段的类型和描述,以及 required 是否只包含没有默认值的字段。把可选字段全部塞进 required,会让模型频繁补齐并不必要的参数;反过来漏掉真正必填字段,则会把错误推迟到工具内部。

模型返回异常时先看参数形状

同一个工具调用概念,在不同客户端的表示不完全相同。Transformers 推荐把调用放在 assistant 消息的 tool_calls 列表中,函数名和参数位于 function 内;官方示例中的参数是字典。兼容 OpenAI 风格的适配层有时会返回 JSON 字符串,这时不要直接把字符串当成 **arguments 使用。

现象优先检查对应结论
找不到工具名tool_calls[0].function.name模型输出或模板解析层有问题
** 展开失败function.arguments 的类型可能仍是 JSON 字符串,需先 loads
缺少字段required 与默认值schema 契约和函数签名不一致
值看似合法却拒绝枚举、范围、权限等业务规则结构校验之后仍需业务校验
import json

def normalize_arguments(raw):
    # 兼容字典和 JSON 字符串,其他类型直接拒绝,避免静默猜值。
    if isinstance(raw, str):
        try:
            raw = json.loads(raw)
        except json.JSONDecodeError as exc:
            raise ValueError("工具参数不是合法 JSON") from exc
    if not isinstance(raw, dict):
        raise TypeError("工具参数必须是 JSON 对象")
    return raw

执行前做结构与业务两层校验

参数能被解析成对象,只说明第一关通过。生产代码至少要在执行前检查必填字段、类型、枚举、字符串长度和数值范围;涉及权限、租户、资源归属或时间窗口时,再做业务校验。可以用 JSON Schema 做通用结构约束,也可以用 Pydantic 把 Python 类型和错误路径集中起来,但校验失败时不要继续调用真实工具。

from pydantic import BaseModel, Field, ValidationError
from typing import Literal

class WeatherArgs(BaseModel):
    # Field 约束用于尽早发现空地点和不支持的单位。
    location: str = Field(min_length=1, max_length=80)
    unit: Literal["celsius", "fahrenheit"] = "celsius"

def validate_before_execute(raw_args):
    # 先做结构校验;异常信息应记录路径,但不要泄露敏感输入。
    try:
        args = WeatherArgs.model_validate(normalize_arguments(raw_args))
    except (TypeError, ValueError, ValidationError) as exc:
        return {"ok": False, "error": str(exc)}
    # 业务层可继续检查租户权限、地点白名单或调用配额。
    return {"ok": True, "args": args.model_dump()}
tool_calls到function.arguments再到JSON Schema、Pydantic和业务规则的工具执行边界关系示意图
图2:模型调用参数进入工具前的校验边界示意,结构合法不等于业务参数可执行。

按证据修复,再做一次反向验证

排查时建议保留四类脱敏记录:原始调用的工具名、参数字段集合、结构校验错误路径、业务拒绝原因。若错误出现在模板渲染前,检查函数类型提示和 docstring;若出现在解析后,检查 arguments 是字符串还是对象;若只有真实执行时失败,就回到权限、范围和外部服务响应。修复后分别用“缺字段、错误类型、合法边界值、越权值”四组样例确认:前三类能给出明确错误,最后一类不能触发真实工具。

常见问题:把 required 写成所有 properties 可以吗?

不建议。只有没有默认值且业务上必须提供的字段才放进 required,可选字段应保留默认值或由业务层补齐。

常见问题:为什么 tool_calls 明明存在,函数仍然调用失败?

先确认消息层级和 function.arguments 类型,再确认字段名与 schema 一致。列表存在不代表参数已经通过校验。

常见问题:JSON Schema 校验通过后还要 Pydantic 吗?

不一定。二者可以择一作为结构校验;但权限、租户、额度和资源状态等业务规则仍应单独执行,不能交给 schema 代替。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Lovart做海报该用自由提示还是Lovart Skill?任务选择表Lovart做海报该用自由提示还是Lovart Skill?任务选择表
上一篇
Lovart做海报该用自由提示还是Lovart Skill?任务选择表
Go filepath.WalkDir 如何控制符号链接
下一篇
Go filepath.WalkDir 如何控制符号链接
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    111次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    31次使用
  • OpenCompass大模型评测体系详解:功能、使用指南与应用场景
    OpenCompass
    OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
    46次使用
  • AGI-Eval大模型评测平台:权威榜单、数据集与人机协同评测方案
    AGI-Eval
    AGI-Eval是由上海交大等高校联合发布的大模型评测社区,提供公正透明的LLM能力榜单、多领域评测集及Data Studio数据服务,助力AI模型性能评估与NLP科研开发。
    29次使用
  • SuperCLUE中文大模型评测基准:功能、能力维度与应用指南
    SuperCLUE
    SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
    265次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码