运维
已收录文章:26篇
-
Redis Stream 消费组出现 pending 积压时,先用 XPENDING 看数量和空闲时间,再用 XAUTOCLAIM 接管超时消息,最后通过幂等、分批和回滚把积压安全排空。494 收藏
-
本文用 Nginx 访问日志举例,讲清 Linux logrotate 的配置方法:按天轮转、压缩保留、创建新日志文件,并用调试模式检查规则是否会正确生效。494 收藏
-
Linux 上部署一个常驻业务服务时,服务单元与 Docker Compose 的差别不只在于是否容器化。用启动依赖、日志入口、恢复方式和回滚颗粒度四个维度,判断订单、接口等服务该选哪条路径。473 收藏
-
通过一次服务器磁盘占满案例,演示如何用 df、du、lsof 和 journalctl 快速定位大目录、已删除但仍被占用的文件、日志膨胀和清理风险。436 收藏
-
PHP 定时任务重叠运行时,单靠进程号或临时文件往往不够可靠。用 flock 保持互斥、写入 PID 与开始时间,再配合超时观察和可复查日志,可以把重复处理、锁误判与人工介入边界拆清楚。424 收藏
-
用一个可复现的小实验讲清 Linux inode 用满的现象、df -i 检查、目录文件数定位、安全清理和恢复验证,避免只看 df -h 误判磁盘问题。399 收藏
-
本文用服务启动失败的场景,演示如何用 ss、lsof、ps 定位占用端口的进程,并根据业务归属选择停止旧进程、修改端口或回收僵尸进程。360 收藏
-
服务突然退出且日志只有 Killed,不要先盯着应用异常。用内核日志确认 OOM 受害进程,再区分主机内存压力与 cgroup 上限,最后通过峰值、限额和回归压测闭环。316 收藏
-
Go 服务把日志写到固定文件后,文件会持续变大,直接删除又可能让进程继续写入已删除文件。本文从一个小型 Go 日志服务开始,配置 logrotate 的轮转、保留、压缩和 copytruncate,再用状态文件与实际文件大小验证配置是否真的生效。310 收藏
-
日志归档不应只是一条 tar 命令。本文给出一个 Bash 最小脚本:固定来源路径、按天生成压缩包和 SHA-256 清单、校验后清理过期归档,并说明失败时如何保留原日志。297 收藏
-
文章 · linux | 1星期前 | Linux · 运维 · 性能排查 · 负载 · D状态 · iowait · Linux负载高 load average D状态 iowait vmstat 磁盘队列Linux 的 load average 不只统计正在抢 CPU 的任务,也会计入等待 I/O 的不可中断任务。遇到负载高而 CPU 看似空闲时,先对齐 uptime、/proc/loadavg、vmstat 和进程状态,再确认具体等待点与磁盘或网络存储的时间关系,避免一上来扩容或杀进程。292 收藏
-
crontab 里明明写了任务,到了时间却没有结果。本文从任务是否登记、时间表达式是否命中、环境变量是否缺失、工作目录是否正确、日志是否能回查几个方向逐步排查,整理一套稳定的定时任务写法。286 收藏