linux技术文章
-
Linux 的 page cache 占用高不等于内存泄漏,本文从 free、top、slab 和回收验证入手,区分缓存、进程匿名内存与内核对象的边界。331 收藏 -
Linux 进程突然退出时,先确认崩溃收集服务是否保存了可用转储,再用 coredumpctl debug 进入 gdb;本文按转储存在性、时间筛选、回溯可信度和生产安全边界拆解一条可复查的定位路径。329 收藏 -
Linux 上删除大文件后 df 仍显示空间紧张,常见原因是进程仍持有已删除文件的文件描述符。本文用 lsof +L1、/proc/PID/fd 和 df/du 对照定位占用者,说明安全释放空间与重启复核的顺序。328 收藏 -
容器里的 DNS 偶发失败时,不要只反复改 nameserver。先核对 resolv.conf,再比较 getent 与 nslookup 的结果,最后用 ip route get 和 NSS 顺序确认请求到底走哪条路径,区分配置、路由和解析库问题。326 收藏 -
用 Linux ss 命令查看监听端口、协议、进程名和 PID,掌握目标端口过滤、IPv4/IPv6 与权限不足时的排查边界。326 收藏 -
Linux perf record 采样频率过高时,优先用 -F/--freq 降低单次采样目标,再检查 kernel.perf_event_max_sample_rate 和 perf_cpu_time_max_percent,最后用数据量、热点稳定性和任务开销复查调整是否合适。324 收藏 -
GNU tar 增量归档可用 --listed-incremental 保存变化状态,并以 --exclude-from 排除固定缓存路径、--exclude-caches-all 排除带 CACHEDIR.TAG 的目录。本文给出最小命令、排除文件、检查与恢复边界。324 收藏 -
Linux kernel 参数用 sysctl -w 临时修改后,如何通过 /etc/sysctl.d/ 安全持久化?本文按备份、加载、覆盖检查和回滚说明完整流程。322 收藏 -
Linux 服务出现连接超时,不要先盲目调大内核参数。本文用 ss 区分 LISTEN、SYN-RECV、TIME-WAIT 三类状态,再结合 somaxconn、tcp_max_syn_backlog 和应用 accept 速率定位监听队列瓶颈,给出可复查的调参与回滚步骤。321 收藏 -
journalctl 可在同一次调用中组合 --vacuum-time 与 --vacuum-size,同时约束归档日志的保留时间和容量。本文说明 --rotate、活动日志边界、清理前后核对及长期策略。321 收藏 -
从 uname -r 里的短横线后缀识别发行版内核,区分上游 mainline、stable 与厂商维护边界,并判断故障应该提交给谁。320 收藏 -
Linux df -h 看着还有空间,服务却报 No space left on device?问题可能不是磁盘容量,而是 inode 已经耗尽。本文用 df -i、find 和小文件统计定位原因,给出可回滚的清理顺序,并用复测确认系统恢复。317 收藏 -
Linux huge pages 配置前要先区分 HugeTLB 与透明大页 THP:前者需要预留页池并由应用显式使用,后者由内核按策略自动尝试。本文给出配置命令、状态检查和不生效排查路径。317 收藏 -
服务突然退出且日志只有 Killed,不要先盯着应用异常。用内核日志确认 OOM 受害进程,再区分主机内存压力与 cgroup 上限,最后通过峰值、限额和回归压测闭环。316 收藏 -
strace -ff 会按 PID 生成多个追踪文件。本文说明如何用 -tt 保留微秒时间戳,再用 strace-log-merge 合并子进程日志,并解释何时应保留原始 PID 文件。316 收藏