运维
已收录文章:95篇
-
Redis Streams 消费者在确认消息前宕机时,消息会留在待确认列表。本文说明如何通过 XAUTOCLAIM 有节制地接管超时消息,并监控重试与清理结果。110 收藏
-
rsync 同步大目录时,慢的往往不是网卡,而是海量小文件的扫描、元数据比较和落盘节奏。通过先测基线、生成变更文件清单、分批同步并做抽样校验,可把同步过程从不可控等待变成可观测的增量链路。140 收藏
-
服务突然退出且日志只有 Killed,不要先盯着应用异常。用内核日志确认 OOM 受害进程,再区分主机内存压力与 cgroup 上限,最后通过峰值、限额和回归压测闭环。316 收藏
-
用一个可复现的小实验讲清 Linux inode 用满的现象、df -i 检查、目录文件数定位、安全清理和恢复验证,避免只看 df -h 误判磁盘问题。399 收藏
-
用运行手册方式讲解 Go HTTP 服务优雅停机:识别 SIGTERM、停止接流量、等待正在处理的请求、设置超时退出,并给出回滚路径、告警确认和复盘清单。176 收藏
-
围绕日志目录占满磁盘的问题,给出一套可复制的 Linux 清理配方:先定位大文件,再压缩旧日志,最后按保留期删除归档,并补充参数变体和兼容坑。120 收藏
-
文章 · linux | 1个月前 | Linux · 运维 · 性能排查 · 磁盘IO · iostat · pidstat · Linux 性能排查 iostat 磁盘IO pidstat %util本文从 Linux 接口变慢和磁盘 IO 飙高的现场开始,使用 iostat 判断磁盘压力,再用 pidstat 定位写入进程,最后通过限速清理、迁移写入和复查指标恢复稳定。260 收藏
-
crontab 里明明写了任务,到了时间却没有结果。本文从任务是否登记、时间表达式是否命中、环境变量是否缺失、工作目录是否正确、日志是否能回查几个方向逐步排查,整理一套稳定的定时任务写法。286 收藏
-
本文用 Nginx 访问日志举例,讲清 Linux logrotate 的配置方法:按天轮转、压缩保留、创建新日志文件,并用调试模式检查规则是否会正确生效。494 收藏
-
本文用服务启动失败的场景,演示如何用 ss、lsof、ps 定位占用端口的进程,并根据业务归属选择停止旧进程、修改端口或回收僵尸进程。360 收藏
-
本文从一次内存告警出发,演示如何用 free、top、ps 等命令判断可用内存、定位高占用进程,并区分文件缓存增长、进程内存异常和 OOM 风险。108 收藏
-
本文用一个 Web 服务示例讲清楚 Linux 服务单元文件怎么写,如何配置环境变量、自启动、日志查看和失败重启策略,让进程重启后能稳定恢复。227 收藏