当前位置:首页 > 文章列表 > 科技周边 > 人工智能 > Gemini Files API 怎么管理上传文件:ACTIVE 状态、48 小时过期与主动删除

Gemini Files API 怎么管理上传文件:ACTIVE 状态、48 小时过期与主动删除

来源:17golang原创 2026-08-16 15:32:02 0浏览 收藏

把 PDF 或视频直接塞进每一次 Gemini 请求,最先变慢的通常不是模型,而是重复上传。同一份资料要问三四个问题时,更合适的做法是先交给 Files API,再用返回的文件 URI 参与后续请求。不过“上传接口返回成功”只说明资源已经创建,文件是否完成处理、何时过期、什么时候应该主动删除,还需要应用自己管控。

要点速览
  • 上传后先读取 File 资源的 state,只有 ACTIVE 才进入模型请求。
  • 官方文档给出的 Files API 保存窗口是 48 小时,项目总量上限 20 GB,单文件上限 2 GB。
  • 把 name、uri、expirationTime 和原文件哈希一起存下来,重试和清理才不会靠猜。
  • 敏感资料或短任务应该在业务完成后主动删除,不要把 48 小时当成默认保留策略。

先分清三个状态:已创建、处理中、可引用

Files API 返回的是一个 File 资源。资源里有 name、uri、state、sizeBytes、createTime 和 expirationTime 等字段。真正影响下一步的不是 HTTP 200 响应,而是 state:上传后文件可能还在后台处理,失败时还会在资源里带上对应的错误信息。

因此,业务表不要只保存一个“上传成功”布尔值。最少要把远端资源名、URI、状态和过期时间记录下来,并保留本地文件的 SHA-256。这样同一文件重试时可以判断是“已有可复用资源”,还是“旧资源已过期,需要重新上传”。

Gemini Files API 从上传完成到 ACTIVE 的状态检查与失败分支

上传、查询和删除应该怎么选

如果资料会被多个提示复用,Files API 能把媒体上传与模型请求拆开,减少每次请求重复传输。若只有一次很小的请求,直接以内联数据提交更简单;若是大文件、视频或需要多轮提问,先上传再引用通常更容易控制重试和成本。

场景推荐做法必须记录的字段
一次性小图片直接随请求发送请求 ID、失败原因
PDF、视频、多次复用上传后轮询到 ACTIVEname、uri、state、expirationTime、sha256
敏感资料或短任务完成后主动删除删除时间、业务任务 ID、审计结果

这里有一个容易混淆的点:文件的 uri 是给模型请求引用的资源地址,不能当作永久下载地址。官方说明文件在保存期间也不能通过 Files API 下载,所以原文件仍要由自己的对象存储或业务归档负责。

用 Go 把 ACTIVE 检查做成可重试步骤

下面的示例只保留生命周期里最关键的读取动作。上传接口的 multipart 细节可以交给项目现有的上传模块;拿到 files/... 资源名后,统一用 GET 查询状态。轮询要有上限,不能让一个处理异常的文件一直占住任务。

type GeminiFile struct {
    Name           string `json:"name"`
    URI            string `json:"uri"`
    State          string `json:"state"`
    ExpirationTime string `json:"expirationTime"`
    Error          *struct {
        Message string `json:"message"`
    } `json:"error,omitempty"`
}

func waitFile(ctx context.Context, client *http.Client, apiKey, resource string) (GeminiFile, error) {
    for attempt := 0; attempt 

生产代码还应检查响应状态码、限制响应体大小,并对 429、5xx 和网络断开做带上限的退避。示例故意没有把轮询次数写成无限循环:处理异常时,明确失败比悄悄堆积任务更容易恢复。

48 小时窗口内,哪些数据要落库

官方文档列出的保存窗口和容量限制适合做任务级资源,不适合替代自己的文件管理。可以建立一张简化的 ai_file_asset 表:

CREATE TABLE ai_file_asset (
  id BIGINT PRIMARY KEY,
  task_id VARCHAR(64) NOT NULL,
  source_sha256 CHAR(64) NOT NULL,
  remote_name VARCHAR(128) NOT NULL,
  remote_uri TEXT NOT NULL,
  state VARCHAR(16) NOT NULL,
  expires_at TIMESTAMP NULL,
  deleted_at TIMESTAMP NULL,
  created_at TIMESTAMP NOT NULL,
  UNIQUE KEY uk_task_file (task_id, source_sha256)
);

任务重试时先按 task_id + source_sha256 查找。记录仍为 ACTIVE 且距离 expires_at 有余量,就继续复用;已经过期或查询返回资源不存在,则重新上传。删除动作写入 deleted_at,不要直接物理抹掉整行,否则很难解释一次任务到底用了哪份资料。

Gemini Files API 的 ACTIVE 引用、任务完成和主动删除闭环

容易踩中的四个边界

  • 把 HTTP 成功当成 ACTIVE:上传后的处理状态仍需查询,不能立即把 URI 交给模型。
  • 只保存 URI:没有远端 name 和本地哈希,过期重传时容易产生重复资源。
  • 依赖远端文件长期保存:48 小时是 Files API 的窗口,不是项目归档方案。
  • 删除后不留审计:任务完成、用户撤回或敏感数据清理,都应记录触发原因和时间。

常见问题

Gemini Files API 上传后为什么不能马上使用?

文件可能仍处于处理状态。先读取 File 资源,等 state 变成 ACTIVE,失败则读取错误信息并结束本次任务。

Files API 的文件能保存多久?

官方文档说明文件保存 48 小时,并提供 expirationTime。需要更长时间时,应在自己的存储系统保留原件并在需要时重新上传。

文件 URI 可以当下载链接吗?

不可以。URI 主要用于在 Gemini 请求中引用文件,Files API 文档还特别说明保存期间不能下载文件。

什么时候应该主动删除文件?

短任务完成、用户撤回资料、资料包含敏感内容,或本地已经确认不再需要时,都可以主动删除,并把删除结果写入任务审计记录。

把文件当成有期限的任务资源

Files API 最稳妥的接法不是“上传一次、拿到 URI 就结束”,而是把它当作有状态、有期限、可回收的任务资源:上传后查询,ACTIVE 后引用,任务结束后删除,过期前由本地记录决定是否重传。这样既能享受大文件复用的便利,也不会把临时文件误当成永久知识库。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Linux PrivateTmp 开启后 /tmp 文件去哪了:服务命名空间与排查边界Linux PrivateTmp 开启后 /tmp 文件去哪了:服务命名空间与排查边界
上一篇
Linux PrivateTmp 开启后 /tmp 文件去哪了:服务命名空间与排查边界
OpenAI Responses API Webhook 怎么验签:原始请求体、时间窗口与 response.completed 处理
下一篇
OpenAI Responses API Webhook 怎么验签:原始请求体、时间窗口与 response.completed 处理
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    281次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    334次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    331次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    301次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    121次使用