Linux
已收录文章:17篇
-
容器或 unshare 环境里的挂载偶尔会出现在宿主机,根因常是 mount propagation 而不是命名空间失效。本文用 findmnt、/proc/self/mountinfo 和三种传播类型复现 shared、slave、private 的差异,给出安全验证与回滚顺序。252 收藏
-
文章 · linux | 7小时前 | oom · 内存 · Linux · 运维排查 · cgroup · Linux OOM cgroup v2 memory.events memory.current memory.max memory.highLinux cgroup v2 出现内存告警时,不要只盯着 memory.current。本文用 memory.events、memory.events.local、memory.high 和 memory.max 组成证据链,区分回收压力、硬限额命中与 OOM,并给出可复查的命令顺序。456 收藏
-
文章 · linux | 7小时前 | Linux · 性能监控 · 系统排查 · 资源压力 · Linux 性能排查 PSI Pressure Stall Information /proc/pressureLinux load 高并不一定能说明业务正在等待什么资源。本文用 PSI(Pressure Stall Information)读取 /proc/pressure/cpu、memory、io,解释 some 与 full、avg10/avg60/avg300 的含义,并给出从判断压力类型到设置 poll 阈值的排查和告警方法。461 收藏
-
Linux 服务管理器的 RuntimeMaxSec 可以给服务设置最长运行时间,但它不是普通的请求超时。本文用一次性数据同步服务说明如何配置运行时限、从服务状态命令和 journalctl 判断超时结果,并区分正常退出、失败重启与限时后的恢复边界。389 收藏
-
Linux 服务管理器的 RuntimeMaxSec 可以给服务设置最长运行时间,但它不是普通的请求超时。本文用一次性数据同步服务说明如何配置运行时限、从服务状态命令和 journalctl 判断超时结果,并区分正常退出、失败重启与限时后的恢复边界。474 收藏
-
Linux 网关或容器节点出现新连接失败时,先用 nf_conntrack_count、nf_conntrack_max 和内核日志确认是否为连接跟踪表逼近上限,再区分短连接洪峰、超时过长和异常流量,最后用可回滚的 sysctl 调整与复测闭环。129 收藏
-
服务开启 PrivateTmp=yes 后,宿主机和服务进程看到的 /tmp 不再是同一个目录。本文用一个临时文件消失的现场,解释配置生效值、主进程和挂载信息的核对顺序,并给出共享临时文件与安全隔离的取舍。254 收藏
-
ext4 默认会保留一部分数据块给特权进程使用,普通业务写入可能先遇到保留块边界。本文用 df、tune2fs -l 和保留块数量换算出真实余量,再说明何时可以用 tune2fs -m 调整、如何复测以及为什么不建议直接改成 0。156 收藏
-
Linux 服务出现连接超时,不要先盲目调大内核参数。本文用 ss 区分 LISTEN、SYN-RECV、TIME-WAIT 三类状态,再结合 somaxconn、tcp_max_syn_backlog 和应用 accept 速率定位监听队列瓶颈,给出可复查的调参与回滚步骤。321 收藏
-
服务 unit 里写了 LimitNOFILE,进程却仍然拿到旧限制,通常不是参数拼错,而是改错了 unit 层级、管理器没有重新读取,或服务仍在使用旧 PID。本文用服务管理器命令、配置校验和 /proc/
/limits 做一套可回滚的验收流程。 179 收藏 -
服务 unit 里写了 LimitNOFILE,进程却仍然拿到旧限制,通常不是参数拼错,而是改错了 unit 层级、管理器没有重新读取,或服务仍在使用旧 PID。本文用服务管理器命令、配置校验和 /proc/
/limits 做一套可回滚的验收流程。 185 收藏 -
一个服务只需要绑定低端口时,不必长期以 root 身份运行。本文用 Linux capabilities、setcap/getcap 和服务管理器的能力边界配置,做一条可复查的最小权限方案,并说明文件能力的边界与回滚方式。422 收藏