linux技术文章
-
文章 · linux | 1星期前 | Linux · 热更新 · 文件描述符 · io_uring · 并发排空 · Linux io_uring 固定文件热更新 draining IORING_REGISTER_FILES_UPDATE
围绕 io_uring 固定文件热更新,说明稀疏槽、IORING_REGISTER_FILES_UPDATE 和 draining 状态如何配合,避免旧请求与新文件交错。226 收藏 -
进程的 rchar、wchar 很大,不代表磁盘真的读写了同样多的数据。本文用 /proc/PID/io 拆开用户态读写、实际块设备读写和取消写入,给出一套可复查的 Linux I/O 排查方法。224 收藏 -
Linux 7.2 已进入主线发布阶段,但 mainline、stable 与长期支持版本承担的风险不同。本文按生产升级的判断顺序,说明如何核对版本来源、准备回滚、做最小验证,再决定是否采用。222 收藏 -
vmstat 输出里的 r 和 b 经常被误读成 CPU 使用率。本文从运行队列、不可中断睡眠和 load average 的关系入手,给出一套从现象到证据的 Linux 性能排查方法。222 收藏 -
从进程级句柄数量、ulimit -n 和 /proc 文件系统入手,定位 Linux 文件描述符耗尽的真实原因,给出服务管理器配置、分批恢复和验证清单。215 收藏 -
服务停止时日志已经出现 SIGTERM,但进程迟迟不退,甚至留下僵尸进程。本文用一个可复查的 Linux 场景讲清信号是否送达、进程是否处理、子进程如何回收,以及服务管理器的停止边界。208 收藏 -
服务刚刚恢复时,先别把整本日志倒出来。本文用 journalctl 的时间、unit、boot 和 invocation 四层筛选,把一次 systemd 服务故障压缩成可核对的证据链,并给出日志不持久化时的处理边界。200 收藏 -
Linux 上的 systemd 服务突然退出并生成 core 文件时,可以先列出崩溃记录,再查看信号、进程和可执行文件,最后决定是否进入调试器。文章同时说明 Storage、保留期限和权限边界,避免只会下载 core 却找不到可用证据。199 收藏 -
Linux 服务启动失败时,先确认服务状态,再缩小日志时间范围。本文整理状态、日志、权限、配置和依赖的排查顺序,帮助更快落到具体原因。195 收藏 -
网卡丢包不能只看 ping。本文用 ethtool -S、ethtool -g 和 ip -s link 对照驱动统计、收发 ring 与内核计数,判断丢包发生在哪一层,并给出安全复测顺序。192 收藏 -
Linux 服务可以把系统目录设为只读,再用 ReadWritePaths 只放行应用数据目录。本文给出最小 unit 配置、验证命令、回滚路径和容易误判的权限边界。191 收藏 -
rsync --delete 会删除目标端多出来的文件,但源路径边界、通配符和试运行步骤一旦弄错,就可能把误差放大成批量删除。本文从误删现场出发,讲清目录语义、--dry-run 核对和恢复检查。189 收藏 -
用 findmnt --verify 在重启前检查 fstab 的语法、设备路径和挂载选项,区分配置可解析、设备可见与真正挂载成功这三个验收层次。188 收藏 -
最简可靠方式是修改/etc/pam.d/su,注释所有auth行或启用pam_wheel.so限制wheel组,配合SU_WHEEL_ONLY或pam_listfile.so实现白名单控制,禁用su后须确保sudo等替代路径可用。187 收藏 -
Linux 服务手工启动正常,交给服务管理器重启却提示找不到命令或配置,通常不是程序突然坏了,而是启动环境与登录 Shell 不同。本文用一个 worker 服务复盘 PATH、EnvironmentFile、工作目录和 journal 日志之间的排查顺序。187 收藏