登录
推荐 文章 Go 技术 课程 下载 专题 AI
首页 >  Golang >  Go教程

Go archive/zip 怎么读取压缩包内文件名和大小

来源:17golang原创

时间:2026-09-09 07:12:40 280浏览 收藏

如果只想查看 ZIP 压缩包里有哪些文件,不需要先把内容全部解压。Go 的 archive/zip 已经把目录信息放在 Reader.File 中:文件名读 Name,压缩前大小读 UncompressedSize64,压缩后大小读 CompressedSize64。遍历这些条目即可生成清单,同时要记得关闭 OpenReader 返回的读取器。

要点速览
  • zip.OpenReader 适合读取本地 ZIP,返回的 ReadCloser 要及时 Close
  • Reader.File 中每个元素都是一个条目,Name 是路径,FileInfo().IsDir() 可判断目录。
  • 大小优先使用 64 位字段;目录扫描阶段不必调用 File.Open,发现路径安全错误时应停止导入。

先把 ZIP 目录元数据读出来

最小实现只需要打开压缩包、遍历 r.File,再读取嵌入的 FileHeader 字段。下面的函数不解压文件内容,只输出名称、目录标记、压缩前大小和压缩后大小,适合上传预检、归档索引和导入前确认。

package main

import (
    "archive/zip"
    "errors"
    "fmt"
    "log"
)

func listZip(path string) error {
    r, err := zip.OpenReader(path)
    if err != nil {
        // 路径不安全时不要继续把压缩包交给后续导入逻辑。
        if errors.Is(err, zip.ErrInsecurePath) {
            return fmt.Errorf("压缩包包含不安全路径: %w", err)
        }
        return fmt.Errorf("打开 ZIP 失败: %w", err)
    }
    defer r.Close() // 读取目录完成后释放底层文件句柄。

    for _, entry := range r.File {
        info := entry.FileInfo()
        fmt.Printf("%s\\tdir=%t\\tplain=%d B\\tpacked=%d B\\n",
            entry.Name, info.IsDir(), entry.UncompressedSize64,
            entry.CompressedSize64)
    }
    return nil
}

func main() {
    if err := listZip("backup.zip"); err != nil {
        log.Fatal(err)
    }
}

这里的 plain 是条目解压后的逻辑大小,packed 是 ZIP 中实际保存的压缩大小。两者都以字节计。目录项通常以斜杠结尾,FileInfo().IsDir() 比单纯检查字符串更适合表达代码意图。

Go archive zip 的 Reader File、FileHeader Name、目录标记和两种大小字段静态关系图
图1:ZIP 条目元数据关系:Reader.File 提供条目,FileHeader.Name 表示路径,目录标记和两种 64 位大小分别服务于清单展示。

四个字段分别代表什么

读取清单时最容易把“文件大小”和“压缩包占用空间”混为一谈。可以按下面的表格理解:

字段或方法含义使用场景
Name条目在 ZIP 内的相对路径展示清单、匹配允许目录
FileInfo().IsDir()当前条目是否为目录跳过目录、区分文件数量
UncompressedSize64解压后的逻辑字节数限制导入体积、显示文件大小
CompressedSize64压缩后占用的字节数估算归档空间和压缩效果

不要优先读取旧的 32 位大小字段。ZIP64 文件可能让 32 位字段变成 0xffffffff,而 64 位字段才是正确值。即使当前业务只处理小文件,统一使用 64 位字段也能避免以后遇到大归档时出现异常数值。

只看清单时不要提前打开条目内容

entry.Open() 的职责是读取条目内容,不是获取文件名和大小。清单阶段调用它会增加解压、校验和资源管理的复杂度;只有确定要读取正文时再打开,并在同一作用域内关闭返回的 io.ReadCloser

如果还需要计算压缩率,可以先判断原始大小是否为零,避免空文件除零:

func compressionRatio(entry *zip.File) (float64, bool) {
    plain := entry.UncompressedSize64
    if plain == 0 {
        // 空文件没有有意义的压缩率,交给调用方显示为 --。
        return 0, false
    }
    return float64(entry.CompressedSize64) / float64(plain), true
}

这个比例只是归档空间的参考,不等于解压耗时,也不能替代对总解压大小、条目数量和文件名的安全检查。

Go ZIP 条目中压缩前大小、压缩后大小、ZIP64 和目录条目的静态边界图
图2:大小字段的边界:ZIP64 由 64 位大小承载,目录条目应与普通文件分开统计,压缩率只连接两种大小字段。

生产导入前要检查路径和资源边界

如果 ZIP 来自用户上传,文件名不能直接拼到目标目录后写盘。当前标准库会识别非本地路径或包含反斜杠的名称,并可通过 zip.ErrInsecurePath 报告路径风险;调用方应把它当成导入拒绝条件,而不是忽略后继续解压。

发布前至少复查这几项:读取器是否在函数结束前关闭;目录项是否没有被计入文件数量;总的 UncompressedSize64 是否受上限约束;文件名是否只允许业务目录;需要正文时是否对每个 entry.Open() 的返回值单独关闭。清单能回答“里面有什么”和“多大”,不能证明内容可信,也不能代替解压过程中的逐条限制。

常见问题

文件名应该读 Name 还是 FileInfo().Name?

遍历 ZIP 条目时直接读 entry.Name 最清楚,它保留 ZIP 内的相对路径;FileInfo() 更适合查询目录属性。

为什么大小字段要用 UncompressedSize64?

因为 ZIP64 归档可能超过 32 位范围,旧字段会出现占位值。64 位字段才覆盖大文件场景。

读取文件名和大小需要调用 entry.Open 吗?

不需要。名称和大小已经在目录条目元数据中;只有要读取正文、计算校验或复制内容时才打开条目。

拿到 ErrInsecurePath 还能继续用 Reader 吗?

标准库文档说明可能返回带错误的读取器,但对用户上传导入场景不应默认放行。除非业务已经明确验证每个路径,否则应记录错误并拒绝后续解压。

声明:本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>