linux技术文章
-
服务停止时日志已经出现 SIGTERM,但进程迟迟不退,甚至留下僵尸进程。本文用一个可复查的 Linux 场景讲清信号是否送达、进程是否处理、子进程如何回收,以及服务管理器的停止边界。208 收藏 -
服务刚刚恢复时,先别把整本日志倒出来。本文用 journalctl 的时间、unit、boot 和 invocation 四层筛选,把一次 systemd 服务故障压缩成可核对的证据链,并给出日志不持久化时的处理边界。200 收藏 -
Linux 上的 systemd 服务突然退出并生成 core 文件时,可以先列出崩溃记录,再查看信号、进程和可执行文件,最后决定是否进入调试器。文章同时说明 Storage、保留期限和权限边界,避免只会下载 core 却找不到可用证据。199 收藏 -
rsync --delete 会删除目标端多出来的文件,但源路径边界、通配符和试运行步骤一旦弄错,就可能把误差放大成批量删除。本文从误删现场出发,讲清目录语义、--dry-run 核对和恢复检查。189 收藏 -
用 findmnt --verify 在重启前检查 fstab 的语法、设备路径和挂载选项,区分配置可解析、设备可见与真正挂载成功这三个验收层次。188 收藏 -
服务 unit 里写了 LimitNOFILE,进程却仍然拿到旧限制,通常不是参数拼错,而是改错了 unit 层级、管理器没有重新读取,或服务仍在使用旧 PID。本文用服务管理器命令、配置校验和 /proc//limits 做一套可回滚的验收流程。 185 收藏 -
Linux 服务加上严格只读隔离后,配置和运行文件写入失败并不一定是文件权限问题。本文用 ReadWritePaths、RuntimeDirectory 和 findmnt 验证真实挂载边界,再给出可回滚的 unit 配置与验收清单。185 收藏 -
服务 unit 里写了 LimitNOFILE,进程却仍然拿到旧限制,通常不是参数拼错,而是改错了 unit 层级、管理器没有重新读取,或服务仍在使用旧 PID。本文用服务管理器命令、配置校验和 /proc//limits 做一套可回滚的验收流程。 179 收藏 -
日志轮转后磁盘空间没有下降、旧日志文件仍在增长,常见原因是服务进程还握着旧文件句柄。本文用 copytruncate 与重新打开日志两条路径解释现象,给出安全配置、验证顺序和回滚判断。174 收藏 -
Linux 用 rsync 做目录同步时,--delete 会让目标端跟随源端删除文件,参数写错就可能扩大事故。本文用 dry-run 预演、排除规则、日志留存和快照核对,给出一套可回滚的增量同步流程。164 收藏 -
nftables 规则看起来写对了,流量却没有按预期放行或拒绝,通常要从 counter、链优先级和实际生效配置三处核对。本文给出一套可回滚的排查顺序。158 收藏 -
tmpfs 挂载点明明还有空间,应用却可能报 No space left on device。本文按容量、inode 和内存回收三个维度,用 df、df -i、findmnt 与内核回收指标定位真正的限制,并给出可回滚的调整顺序。158 收藏 -
ext4 默认会保留一部分数据块给特权进程使用,普通业务写入可能先遇到保留块边界。本文用 df、tune2fs -l 和保留块数量换算出真实余量,再说明何时可以用 tune2fs -m 调整、如何复测以及为什么不建议直接改成 0。156 收藏 -
用 stat 对照 Linux 文件的 inode、mtime、ctime 和 sha256sum,判断配置是否真的被替换,以及服务是否重新读取了新文件。147 收藏 -
Linux 主机出现端口不通时,不要先改一堆 nftables 规则。本文用规则计数器确认流量是否到达,再用 nft monitor trace 追踪 input、forward 或 output 链的实际命中位置,最后给出恢复与清理方法。134 收藏