当前位置:首页 > 文章列表 > Golang > Go教程 > Go archive/zip 怎么用 CreateRaw 复制已压缩条目

Go archive/zip 怎么用 CreateRaw 复制已压缩条目

来源:17golang原创 2026-09-26 20:53:44 0浏览 收藏

如果要把一个 ZIP 中的已压缩条目搬到另一个 ZIP,archive/zip 不必先解压再压缩。正确组合是:从源文件调用 OpenRaw 取得原始压缩数据,复制一份 FileHeader,再把数据写入目标 Writer 的 CreateRaw。这样能保留原条目的压缩方法、大小和 CRC,减少一次解压与压缩。

官方文档:https://pkg.go.dev/archive/zip

关键边界只有一句话:Open 给你解压后的内容,OpenRaw 给你归档里的压缩内容;只有后者才能直接交给 CreateRaw。
要点速览
  • CreateRaw 不会压缩写入的数据,输入必须与 FileHeader 描述的压缩格式一致。
  • 复制头部时使用独立的 FileHeader,不要在写入后继续修改它。
  • 目标 Writer.Close 会写中央目录,关闭失败也属于发布归档失败。

1. 先判断要复制的是解压内容还是原始压缩内容

File.Open 返回可读的解压内容,适合修改文本、转换格式或重新计算压缩结果;File.OpenRaw 返回归档中已经压缩的字节,适合做 ZIP 合并、筛选复制和归档迁移。两者不能混用:把 Open 的输出写给 CreateRaw,目标文件头仍声称它是原来的压缩格式,读回时就可能校验失败。

这个任务的关键是同时搬运两部分:FileHeader 描述名称、压缩方法、压缩尺寸、未压缩尺寸和 CRC;OpenRaw 提供与这些字段对应的压缩数据。头和数据必须来自同一个源条目。

Go archive zip OpenRaw 与 CreateRaw 复制压缩条目的关系说明图
图1:说明图,展示源 ZIP 的 FileHeader 与 OpenRaw 如何成对进入目标 ZIP 的 CreateRaw。

2. 复制 FileHeader 后用 CreateRaw 写入目标归档

下面的函数只复制指定名称。复制结构体而不是直接把源文件内嵌的头指针交给目标 Writer,便于在目标写入前后保持所有权边界清楚。OpenRaw 不返回需要关闭的 Reader,源 ZIP 本身仍要由调用方负责关闭。

package main

import (
    "archive/zip"
    "fmt"
    "io"
    "os"
)

func copyRawEntry(dst *zip.Writer, src *zip.File, targetName string) error {
    if src.Name != targetName {
        return fmt.Errorf("源条目 %q 与目标 %q 不匹配", src.Name, targetName)
    }

    // 复制元数据,避免目标 Writer 持有源条目的可变头部。
    header := src.FileHeader
    raw, err := src.OpenRaw()
    if err != nil {
        return fmt.Errorf("打开原始压缩数据失败: %w", err)
    }

    // CreateRaw 不会再次压缩,写入内容必须与 header 的压缩方法一致。
    out, err := dst.CreateRaw(&header)
    if err != nil {
        return fmt.Errorf("创建原始条目失败: %w", err)
    }
    if _, err = io.Copy(out, raw); err != nil {
        return fmt.Errorf("复制条目 %q 失败: %w", targetName, err)
    }
    return nil
}

func copyOne(srcPath, dstPath, name string) (err error) {
    // OpenReader 返回的资源包含源文件描述符,函数结束前必须关闭。
    src, err := zip.OpenReader(srcPath)
    if err != nil {
        return fmt.Errorf("打开源 ZIP 失败: %w", err)
    }
    defer func() {
        if closeErr := src.Close(); err == nil && closeErr != nil {
            err = fmt.Errorf("关闭源 ZIP 失败: %w", closeErr)
        }
    }()

    file, err := os.Create(dstPath)
    if err != nil {
        return fmt.Errorf("创建目标 ZIP 失败: %w", err)
    }
    // os.File 和 zip.Writer 都要收尾,不能只检查 io.Copy 的结果。
    defer func() {
        if closeErr := file.Close(); err == nil && closeErr != nil {
            err = fmt.Errorf("关闭目标文件失败: %w", closeErr)
        }
    }()

    dst := zip.NewWriter(file)
    for _, item := range src.File {
        if item.Name == name {
            if err = copyRawEntry(dst, item, name); err != nil {
                return err
            }
            break
        }
    }
    if err = dst.Close(); err != nil {
        return fmt.Errorf("写入 ZIP 中央目录失败: %w", err)
    }
    return nil
}

示例中把 dst.Close 放在复制循环之后,是因为它会写中央目录;如果在这里报错,目标文件不能当作成功产物。生产代码还应在循环结束后确认确实找到目标名称,避免把“没有复制任何条目”误认为成功。

3. 用 OpenRaw 和 CreateRaw 时要守住三个边界

第一,header.Method 必须和 raw 数据匹配。常见的 zip.Store 是不压缩,zip.Deflate 是 DEFLATE;不能读取一个条目的 raw 数据后,随手改成另一种方法。第二,目录条目通常以斜杠结尾,没有文件内容,不应把它当普通文件复制。第三,FileHeader 的尺寸和 CRC 是源数据的一部分,除非你同步重算数据,否则不要改。

任务推荐 API原因
原样迁移已压缩条目OpenRaw + CreateRaw绕过解压和再次压缩
直接复制 Reader 中的文件Writer.Copy由标准库完成 raw 复制,代码更短
修改正文后重新归档Open + Create 或 CreateHeader需要使用新的内容、尺寸和校验值
改变压缩算法读取解压内容后重新写入raw 字节不能直接冒充另一种方法

4. 复制多个条目时处理重名和收尾错误

多个条目复制时,目标 ZIP 允许出现重复名称,但它不会自动覆盖旧条目。迁移工具应先建立目标名称集合:遇到同名条目时明确选择“跳过、替换或报错”,不要依赖读取方碰巧返回哪一个。名称来自上传文件时,还应拒绝绝对路径和上级跳转,避免把归档迁移变成路径穿越入口。

如果源 ZIP 来自不可信输入,打开时还要单独处理 zip.ErrInsecurePath。这类错误与 raw 复制无关,忽略它并不会让条目变得安全;只有完成名称审计并确认业务允许时,才考虑继续使用返回的 Reader。

Go archive zip 原始条目复制中的头部数据和收尾边界说明图
图2:结构说明图,展示多条目迁移时名称集合、原始数据、目标头部和 Close 收尾之间的边界。

常见问题

为什么不能把 Open 的结果直接给 CreateRaw?

因为 Open 已经解压了内容,而 CreateRaw 要求写入与头部压缩方法相符的原始压缩字节。需要重新压缩时,应改用 Create 或 CreateHeader。

复制完一个条目后还必须调用 Writer.Close 吗?

必须。条目数据写完不代表 ZIP 完整,Writer.Close 负责写中央目录;不检查它的错误,目标文件可能无法被正常读取。

只想复制 Reader 中的文件,是否一定要手写 CreateRaw?

不一定。Writer.Copy 也会直接复制 raw 形式;当你需要自定义目标名称、筛选条目或在写入前审计头部时,使用 CreateRaw 更容易表达过程。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
人类基准反应测试误点怎么办?等待变绿、重测与结果核对人类基准反应测试误点怎么办?等待变绿、重测与结果核对
上一篇
人类基准反应测试误点怎么办?等待变绿、重测与结果核对
Lanerc动漫安装包怎么核对?页面信息与安全提示边界说明
下一篇
Lanerc动漫安装包怎么核对?页面信息与安全提示边界说明
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    228次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    275次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    236次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    219次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    13次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码