linux技术文章
-
用 Linux ss 先按监听状态、协议和本地 sport 端口收窄范围,再从 users 字段定位进程名与 PID,并补充权限、IPv4/IPv6 和 network namespace 的排查边界。315 收藏 -
Linux 上用 perf stat 统计 branches 和 branch-misses 时,先确认事件列表,再按进程范围测量,最后根据权限拒绝、事件不可用和计数器缩放提示分层排查。314 收藏 -
绑定挂载只对宿主不可见,通常不是 bind mount 失败,而是新 mount namespace 的挂载视图被隔离,或目标挂载点没有向宿主传播。本文用 private、shared、slave 和 mountinfo 说明判断与配置方法。314 收藏 -
Go 服务把日志写到固定文件后,文件会持续变大,直接删除又可能让进程继续写入已删除文件。本文从一个小型 Go 日志服务开始,配置 logrotate 的轮转、保留、压缩和 copytruncate,再用状态文件与实际文件大小验证配置是否真的生效。310 收藏 -
用 Linux ss 分层确认端口监听、进程归属和 TCP 连接状态,掌握 -l、-p、-n、state established 等参数的排查顺序。308 收藏 -
Linux 上 getent hosts、ping 和应用访问结果不一致时,先看 NSS 顺序,再核对 /etc/hosts、resolv.conf 和 DNS 响应。本文用一组可复现的命令区分本机静态解析、DNS 查询和应用实际使用的解析路径。307 收藏 -
用 oom_score_adj 调整 Linux OOM-killer 的进程选择倾向,理解数值范围、权限边界、临时写入和重启持久化,避免把回收优先级误当成内存限额。306 收藏 -
Linux 文件监控收到 IN_Q_OVERFLOW,不只是把 max_queued_events 调大就结束了。本文从队列溢出的含义、内核参数、消费者处理速度和恢复流程入手,给出可核对的排查命令与重建监控状态的方法。305 收藏 -
单个服务文件句柄持续上涨时,不要只修改全局 limits.conf。用 prlimit 可以先查看并调整目标 PID 的 RLIMIT_NOFILE,再用服务管理器的 LimitNOFILE 和 /proc/PID/limits 做启动后验收,区分软上限、硬上限与实际打开数量。304 收藏 -
容器被杀掉时,单看宿主机 free -h 很容易误判。本文以 cgroups v2 为例,逐项核对 memory.current、memory.high、memory.max 和 memory.events,区分限流、硬上限与 OOM,并给出可复查的验证顺序。304 收藏 -
mount --bind 把已有目录接入当前挂载视图,符号链接只在路径解析时跳转到目标。本文用命令、检查方式和回滚边界说明两者该怎么选。302 收藏 -
cron 任务并不会自动继承交互终端的完整环境。本文从 PATH、HOME、Shell 和工作目录差异入手,给出显式变量、包装脚本、日志和干净环境排查方法。302 收藏 -
Linux 主机端口还没耗尽却偶发新连接超时,不能只盯着 ss 数量。本文从 conntrack 表使用率、网卡丢包计数和回收参数入手,拆出证据链、处理顺序与复测边界。301 收藏 -
用 vmstat 观察全机运行队列和 iowait,再用 iostat -x 对照设备 await、aqu-sz 与 %util,判断 Linux 变慢究竟偏向 CPU 争用还是磁盘等待。299 收藏 -
用 findmnt、df 和 cp --reflink=always 区分文件系统能力、跨挂载点与参数问题,避免把 auto 回退误判为写时复制成功。298 收藏