Go archive/zip 怎么读取压缩包内文件名和大小
来源:17golang原创
时间:2026-09-09 07:12:40 280浏览 收藏
如果只想查看 ZIP 压缩包里有哪些文件,不需要先把内容全部解压。Go 的 archive/zip 已经把目录信息放在 Reader.File 中:文件名读 Name,压缩前大小读 UncompressedSize64,压缩后大小读 CompressedSize64。遍历这些条目即可生成清单,同时要记得关闭 OpenReader 返回的读取器。
zip.OpenReader适合读取本地 ZIP,返回的ReadCloser要及时Close。Reader.File中每个元素都是一个条目,Name是路径,FileInfo().IsDir()可判断目录。- 大小优先使用 64 位字段;目录扫描阶段不必调用
File.Open,发现路径安全错误时应停止导入。
先把 ZIP 目录元数据读出来
最小实现只需要打开压缩包、遍历 r.File,再读取嵌入的 FileHeader 字段。下面的函数不解压文件内容,只输出名称、目录标记、压缩前大小和压缩后大小,适合上传预检、归档索引和导入前确认。
package main
import (
"archive/zip"
"errors"
"fmt"
"log"
)
func listZip(path string) error {
r, err := zip.OpenReader(path)
if err != nil {
// 路径不安全时不要继续把压缩包交给后续导入逻辑。
if errors.Is(err, zip.ErrInsecurePath) {
return fmt.Errorf("压缩包包含不安全路径: %w", err)
}
return fmt.Errorf("打开 ZIP 失败: %w", err)
}
defer r.Close() // 读取目录完成后释放底层文件句柄。
for _, entry := range r.File {
info := entry.FileInfo()
fmt.Printf("%s\\tdir=%t\\tplain=%d B\\tpacked=%d B\\n",
entry.Name, info.IsDir(), entry.UncompressedSize64,
entry.CompressedSize64)
}
return nil
}
func main() {
if err := listZip("backup.zip"); err != nil {
log.Fatal(err)
}
}
这里的 plain 是条目解压后的逻辑大小,packed 是 ZIP 中实际保存的压缩大小。两者都以字节计。目录项通常以斜杠结尾,FileInfo().IsDir() 比单纯检查字符串更适合表达代码意图。

四个字段分别代表什么
读取清单时最容易把“文件大小”和“压缩包占用空间”混为一谈。可以按下面的表格理解:
| 字段或方法 | 含义 | 使用场景 |
|---|---|---|
Name | 条目在 ZIP 内的相对路径 | 展示清单、匹配允许目录 |
FileInfo().IsDir() | 当前条目是否为目录 | 跳过目录、区分文件数量 |
UncompressedSize64 | 解压后的逻辑字节数 | 限制导入体积、显示文件大小 |
CompressedSize64 | 压缩后占用的字节数 | 估算归档空间和压缩效果 |
不要优先读取旧的 32 位大小字段。ZIP64 文件可能让 32 位字段变成 0xffffffff,而 64 位字段才是正确值。即使当前业务只处理小文件,统一使用 64 位字段也能避免以后遇到大归档时出现异常数值。
只看清单时不要提前打开条目内容
entry.Open() 的职责是读取条目内容,不是获取文件名和大小。清单阶段调用它会增加解压、校验和资源管理的复杂度;只有确定要读取正文时再打开,并在同一作用域内关闭返回的 io.ReadCloser。
如果还需要计算压缩率,可以先判断原始大小是否为零,避免空文件除零:
func compressionRatio(entry *zip.File) (float64, bool) {
plain := entry.UncompressedSize64
if plain == 0 {
// 空文件没有有意义的压缩率,交给调用方显示为 --。
return 0, false
}
return float64(entry.CompressedSize64) / float64(plain), true
}
这个比例只是归档空间的参考,不等于解压耗时,也不能替代对总解压大小、条目数量和文件名的安全检查。

生产导入前要检查路径和资源边界
如果 ZIP 来自用户上传,文件名不能直接拼到目标目录后写盘。当前标准库会识别非本地路径或包含反斜杠的名称,并可通过 zip.ErrInsecurePath 报告路径风险;调用方应把它当成导入拒绝条件,而不是忽略后继续解压。
发布前至少复查这几项:读取器是否在函数结束前关闭;目录项是否没有被计入文件数量;总的 UncompressedSize64 是否受上限约束;文件名是否只允许业务目录;需要正文时是否对每个 entry.Open() 的返回值单独关闭。清单能回答“里面有什么”和“多大”,不能证明内容可信,也不能代替解压过程中的逐条限制。
常见问题
文件名应该读 Name 还是 FileInfo().Name?
遍历 ZIP 条目时直接读 entry.Name 最清楚,它保留 ZIP 内的相对路径;FileInfo() 更适合查询目录属性。
为什么大小字段要用 UncompressedSize64?
因为 ZIP64 归档可能超过 32 位范围,旧字段会出现占位值。64 位字段才覆盖大文件场景。
读取文件名和大小需要调用 entry.Open 吗?
不需要。名称和大小已经在目录条目元数据中;只有要读取正文、计算校验或复制内容时才打开条目。
拿到 ErrInsecurePath 还能继续用 Reader 吗?
标准库文档说明可能返回带错误的读取器,但对用户上传导入场景不应默认放行。除非业务已经明确验证每个路径,否则应记录错误并拒绝后续解压。
-
369 收藏
-
344 收藏
-
464 收藏
-
327 收藏
-
349 收藏
-
433 收藏
-
139 收藏
-
203 收藏
-
420 收藏
-
498 收藏
-
129 收藏
-
151 收藏
-
367 收藏
-
468 收藏
-
234 收藏
-
475 收藏
-
115 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 485次学习