登录
推荐 文章 Go 技术 课程 下载 专题 AI
首页 >  Golang >  Go教程

Go encoding/csv FieldsPerRecord 列数错误发生在 Read 还是 ReadAll

来源:17golang原创

时间:2026-09-10 17:03:28 315浏览 收藏

结论先说:FieldsPerRecord 的列数检查发生在读取某一条记录时,不是等 ReadAll 把文件读完才统一检查。Read 发现列数不符时会返回当前记录和 ErrFieldCountReadAll 在同一个记录处停止,但它的接口会返回 nil, err,不会把前面已经读到的记录交给调用方。

要点速览
  • FieldsPerRecord > 0 固定期望列数,= 0 用第一条有效记录定标, 不做列数检查。
  • Read 适合边读边处理和保留故障行;ReadAll 适合确认全部成功后一次性使用。
  • errors.Is 判断 csv.ErrFieldCount,再用 errors.As 读取 csv.ParseError 的行号。

一、先把 FieldsPerRecord 的三种语义分清

默认值是 0。它并不表示“永远不检查”,而是第一次读到有效记录后,把该记录的字段数写回 FieldsPerRecord,后续记录都按这个数比较。表头有 4 列、第二行有 3 列时,第二行才会触发错误。

设置含义适合场景
正数每条记录必须有指定列数固定格式导入
0第一条有效记录作为基准列数由文件头决定
负数不检查列数确实允许变长记录
Go encoding/csv Reader 与 FieldsPerRecord 三种列数契约的静态关系图
图1:CSV 输入进入 csv.Reader 后,FieldsPerRecord 分成固定列数、首条记录定标和变长记录三种契约。

二、Read 发现错误时,故障行已经被读出来

Read 每次只处理一条记录。列数不符时,返回值中的 record 仍然是当前行解析出的字段,err 可被识别为 csv.ErrFieldCount。因此导入程序可以打印故障行、记录行号,或把它放进人工复核队列。

package main

import (
    "encoding/csv"
    "errors"
    "fmt"
    "io"
    "strings"
)

func main() {
    input := "name,age,city\nLin,18\nWang,20,Shenzhen\n"
    reader := csv.NewReader(strings.NewReader(input))

    for row := 1; ; row++ {
        record, err := reader.Read()
        if errors.Is(err, io.EOF) {
            break // 读完文件后退出循环,不把 EOF 当成业务错误。
        }
        if err != nil {
            var parseErr *csv.ParseError
            if errors.As(err, &parseErr) {
                fmt.Printf("第%d行,字段数=%d,错误=%v\n", parseErr.Line, len(record), err)
            } else {
                fmt.Printf("第%d条记录读取失败:%v\n", row, err)
            }
            continue // 这里选择跳过坏行;严格导入时也可以直接 return。
        }
        fmt.Println(record) // 只有 err 为空时才把记录交给后续字段映射。
    }
}

上例中第二行会返回 record=[Lin 18] 和一个包装了 ErrFieldCountParseError。代码选择继续读取只是示例;如果文件必须全量正确,应在错误分支立即终止,不要把缺列记录映射到固定下标。

三、ReadAll 不是另一套列数校验

ReadAll 内部仍然逐条读取,所以错误出现的记录位置和 Read 相同。区别在于它把成功记录累积到二维切片;遇到任何错误就返回 nil, err,调用方拿不到前缀数据。只有完整读到文件末尾时,返回的 err 才是 nil,不会返回 io.EOF

reader := csv.NewReader(strings.NewReader(input))
records, err := reader.ReadAll()
if err != nil {
    // ReadAll 出错时不要继续使用 records;先区分列数错误和语法错误。
    if errors.Is(err, csv.ErrFieldCount) {
        var parseErr *csv.ParseError
        if errors.As(err, &parseErr) {
            fmt.Printf("CSV 第%d行列数不符:%v\n", parseErr.Line, err)
        }
    }
    return
}
fmt.Printf("完整读取 %d 条记录\n", len(records)) // 成功时 err == nil,而不是 io.EOF。

所以“Read 还是 ReadAll”真正要问的是:是否需要在错误时保留当前记录和已处理进度。需要就用流式 Read;只接受全量成功、并且数据量适合放入内存时,再用 ReadAll

Go csv.Read 返回故障记录而 ReadAll 返回 nil 错误的边界关系图
图2:同一个 ErrFieldCount 在 Reader 读取边界被发现,Read 保留当前 record,ReadAll 在聚合接口处返回 nil 与错误。

四、用 ParseError 和读取模式定位坏数据

列数错误不是普通字符串比较的结果,官方实现会把它放进 csv.ParseError.Err。用 errors.Is(err, csv.ErrFieldCount) 判断类别,用 errors.As 取出 Line;不要只比较 err.Error(),否则错误包装后容易失效。

  • 固定列格式:设置正数,尽早拒绝缺列或多列数据。
  • 首行定标格式:保持 0,但先确认第一条有效记录确实是正确模板。
  • 变长格式:设置负数,并在业务层用 len(record) 判断必填字段,再访问下标。

一个实用的排查清单是:先确认分隔符 Comma,再确认是否把表头算作首条记录,接着打印 ParseError.Linelen(record),最后决定是修复源 CSV、调整列数契约,还是允许变长记录。

常见问题

FieldsPerRecord 设为 0 还会出现 ErrFieldCount 吗?

会。第一条有效记录只负责建立基准,后续记录仍必须拥有相同字段数。

ReadAll 出错后还能拿到前面正确的记录吗?

按接口返回值不能可靠拿到;需要逐条保留成功前缀时,改用 Read 循环自行累积。

列数不固定是不是应该永远设为负数?

不一定。只有输入契约真的允许变长时才设为负数,否则应保留检查,并把错误尽早暴露。

声明:本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>