登录
推荐 文章 Go 技术 课程 下载 专题 AI
首页 >  文章 >  linux

Linux ethtool 怎么判断网卡丢包发生在哪一层:ring 参数、统计计数与复测

来源:17golang原创

时间:2026-08-29 23:07:11 192浏览 收藏

线上服务出现短暂丢包时,先别急着把网卡 ring 调到最大。ethtool -S eth0 能看到驱动统计,ethtool -g eth0 能看到当前与上限,ip -s link show dev eth0 则提供内核网络设备层的计数。把三组数据放在同一时间窗口里,才能判断丢包是在驱动接收队列、内核设备层,还是更上游的链路。

先保存基线,再让计数器增长;只有当 ethtool -S 的接收丢弃字段与 ring 压力同时出现,才值得评估 ring 调整,不能仅凭 ping 丢一个包下结论。

要点速览
  • ethtool -S 的字段名称由驱动决定,先找出实际增长的 rx/drop/missed 计数。
  • ethtool -g 对照 current 与 max,避免把“支持上限”误当成当前配置。
  • 用两次采样和固定流量复测,不要边压测边盲目反复改 ring。
  • 修改前记录驱动、队列和计数,异常时恢复原值并复核。

先把三层计数放到同一个时间窗口

登录故障节点后,先记录接口、驱动和当前计数。下面的命令只读,不会改变网卡配置:

IF=eth0
date -Is
ethtool -i "$IF"
ip -s link show dev "$IF"
ethtool -S "$IF" | tee /tmp/ethtool-eth0.before
ethtool -g "$IF"

重点不是某个固定字段一定存在,而是找出现场输出中的接收丢弃、错包、溢出或 missed 类计数。不同驱动的命名并不统一;如果只看到标准接口计数,仍要保留完整输出,后面才能和复测结果对照。

用 ethtool -S 定位驱动统计里的增长项

先等待一个固定窗口,再采样同一接口。示例用 30 秒,是为了让低流量场景也有机会出现可比较的变化;生产环境可以按业务流量调整。

sleep 30
ethtool -S "$IF" | tee /tmp/ethtool-eth0.after
diff -u /tmp/ethtool-eth0.before /tmp/ethtool-eth0.after

如果 rx_missed_errorsrx_no_buffer 或驱动提供的等价接收丢弃字段增长,说明问题已经靠近接收路径,但仍不能直接断定是 ring 太小。要继续对照 ring 当前值、队列数量、CPU 处理能力和链路对端。

Linux ethtool -S 从驱动统计到接收丢包字段的增长路径

用 ethtool -g 区分当前 ring 与可用上限

ethtool -g eth0 通常会同时列出 Pre-set maximums 和 Current hardware settings。前者是设备或驱动支持的上限,后者才是正在工作的 RX/TX ring。调整前把两段都保存下来:

ethtool -g eth0
# 仅示例命令:具体数值必须以现场的 Current hardware settings 为准
sudo ethtool -G eth0 rx 2048 tx 2048
ethtool -g eth0

如果 current 已经接近 max,继续加大通常没有收益;如果 current 明显偏小,才可以在维护窗口里做一次小步调整。驱动可能拒绝某些值,或者重启后恢复默认,所以命令返回成功后还要再次读取配置并观察计数。

Linux ethtool -g 对照 ring 当前值与上限后进行一次复测

把驱动计数和 ip -s link 结果交叉验证

同一窗口内再看内核设备层统计:

ip -s link show dev eth0
ethtool -S eth0 | grep -Ei 'rx|drop|miss|error|buffer|fifo'

若内核层的 dropped 增长而驱动专属接收计数不动,排查重点就不应只放在 ring;可能还要看队列绑定、CPU 软中断和上游限速。若两边都增长,再结合驱动文档解释字段含义,避免把 CRC、帧错或发送队列问题混成同一种丢包。

修改后的复测与回滚顺序

每次只改一个变量,记录变更前后的 ethtool -gethtool -Sip -s link。复测使用固定接口、固定流量和固定时长;如果丢包计数不再增长但延迟、CPU 或内存压力恶化,应恢复原值。

  1. 保存当前 ring 与三组计数,确认测试流量确实经过 eth0
  2. 只调整一个 RX 或 TX 参数,立即重新读取 Current hardware settings。
  3. 等待同样的时间窗口,比较接收丢弃字段与 ip -s link 的增量。
  4. 记录结果;若无改善或出现副作用,执行原值回滚并再次采样。

常见问题

ethtool -S 没有 rx_missed_errors 怎么办?

不要自行补造字段。保留完整输出,寻找驱动实际提供的 rx、drop、error、buffer 或 fifo 计数,并用驱动文档解释。

ring 越大是不是一定越不丢包?

不是。ring 只是缓冲边界,过大可能增加排队延迟和内存占用;必须用同一流量窗口比较计数与延迟。

为什么 ping 丢包但 ethtool 计数不变?

丢包可能发生在链路对端、交换机、路由策略或更高层。先确认测试路径,再把接口计数与对端设备统计放到同一时间段。

收尾检查

判断 Linux 网卡丢包,关键是把“看到一个现象”变成“确认哪一层的计数在增长”。ethtool -S 负责驱动证据,ethtool -g 负责 ring 边界,ip -s link 负责设备层交叉检查。只有基线、单变量变更和复测结果相互吻合,调整才值得保留。

声明:本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>