linux技术文章
-
Linux nftables 规则命中不清楚时,先用 counter、handle 和规则顺序定位,再用受限 nftrace 复核数据包经过的链与最终 verdict。436 收藏 -
绑定挂载只对宿主不可见,通常不是 bind mount 失败,而是新 mount namespace 的挂载视图被隔离,或目标挂载点没有向宿主传播。本文用 private、shared、slave 和 mountinfo 说明判断与配置方法。314 收藏 -
Linux strace -f 会把子进程的系统调用也带进来,输出很快变得难读。本文用 -e、-P、-o、-ff、-qq 和 -s 分层缩小范围,并说明如何验证筛选没有把关键调用隐藏掉。149 收藏 -
Linux perf record 采样频率过高时,优先用 -F/--freq 降低单次采样目标,再检查 kernel.perf_event_max_sample_rate 和 perf_cpu_time_max_percent,最后用数据量、热点稳定性和任务开销复查调整是否合适。324 收藏 -
讲清 journalctl 如何先用 --list-boots 确定启动编号或 Boot ID,再用 --since、--until 和 -u 组合筛选故障日志,并给出空结果的排查顺序。127 收藏 -
systemd timer 的 Persistent=true 只对 OnCalendar 生效。本文用一个 oneshot service 演示如何区分计划时间、补跑候选、实际触发和服务失败。418 收藏 -
Linux vmstat 的 r 列长期升高,通常表示可运行任务在等待 CPU 时间,但不能只看一个数字下结论。本文区分 r、b、load average 与 D 状态,并给出从 CPU 核心到进程亲和性和 cgroup 配额的排查方法。215 收藏 -
Linux memory PSI 中 some 表示至少一个任务因内存资源停顿,full 表示所有非空闲任务同时停顿。本文结合 avg10、avg60、avg300 和 total,说明如何判断近期事件、持续趋势与压力毛刺。270 收藏 -
Linux 删除日志后磁盘空间没有释放时,用 lsof +L1 找到仍持有 deleted 文件描述符的进程,再通过 /proc 复核 PID、FD 和 inode,并用服务重开或受控重启安全释放空间。486 收藏 -
strace -ff 会按 PID 生成多个追踪文件。本文说明如何用 -tt 保留微秒时间戳,再用 strace-log-merge 合并子进程日志,并解释何时应保留原始 PID 文件。316 收藏 -
通过 udevadm monitor 的 -k、-u、-p 和 -s 参数,区分内核 uevent 与 udev 规则处理后的事件,并用 DEVPATH、ACTION 和 udevadm test 完成设备事件排查。498 收藏 -
Linux nmcli 连接没有自动激活时,按设备管理状态、profile 自动连接开关、接口名、MAC、match 条件和优先级逐层排查,定位候选不合格还是连接被其他 profile 占用。431 收藏 -
使用 ip netns exec 找不到接口时,先确认命名空间名称和进程所在的 network namespace,再区分接口归属与链路状态,避免在错误的视图里重复创建或启用设备。421 收藏 -
Linux ip rule 出现多条匹配规则时,先按 priority 从小到大梳理 RPDB,再用同一组源地址、目标地址、网卡和 mark 执行 ip route get,确认数据包实际查询的路由表。本文给出排障、修正和回滚方法。357 收藏 -
setcap 给文件写入能力并不等于运行中的进程拥有全部能力。本文从 getcap 文件检查出发,再用 /proc/PID/status 解码 CapPrm、CapEff、CapBnd 与 CapAmb,定位实际生效范围变小的原因。383 收藏