运维
已收录文章:38篇
-
本文用 Nginx 访问日志举例,讲清 Linux logrotate 的配置方法:按天轮转、压缩保留、创建新日志文件,并用调试模式检查规则是否会正确生效。494 收藏
-
Redis Stream 消费组出现 pending 积压时,先用 XPENDING 看数量和空闲时间,再用 XAUTOCLAIM 接管超时消息,最后通过幂等、分批和回滚把积压安全排空。494 收藏
-
Linux 上部署一个常驻业务服务时,服务单元与 Docker Compose 的差别不只在于是否容器化。用启动依赖、日志入口、恢复方式和回滚颗粒度四个维度,判断订单、接口等服务该选哪条路径。473 收藏
-
日志轮转后 df 仍显示磁盘快满,常见原因不是旧日志还在目录里,而是进程仍持有已删除文件的文件描述符。本文用 df、du、lsof 和服务管理器日志命令逐层确认占用来源,并给出不误杀业务进程的恢复步骤。469 收藏
-
Redis 8.6 新增 HOTKEYS,可以在指定采样窗口内按 CPU 或网络指标找出高频访问键。本文从缓存延迟升高的现场出发,演示 HOTKEYS START、GET、STOP 的最小用法,解释 COUNT、DURATION、SAMPLE 与 SLOTS 的边界,并给出集群分片、误判和上线验收清单。456 收藏
-
通过一次服务器磁盘占满案例,演示如何用 df、du、lsof 和 journalctl 快速定位大目录、已删除但仍被占用的文件、日志膨胀和清理风险。436 收藏
-
科技周边 · 业界新闻 | 3天前 | 云原生 · 容器 · 运维 · kubernetes · 业界新闻 · 集群升级 Kubernetes v1.37 kubectl run Volume Health Monitor CSIKubernetes 官方公布 v1.37 计划变化:kubectl run 的 --filename/-f 参数将弃用,CSI Volume Health Monitor 重新进入 Alpha。本文按资产、兼容风险和验证动作拆解升级前检查清单。427 收藏
-
PHP 定时任务重叠运行时,单靠进程号或临时文件往往不够可靠。用 flock 保持互斥、写入 PID 与开始时间,再配合超时观察和可复查日志,可以把重复处理、锁误判与人工介入边界拆清楚。424 收藏
-
用一个可复现的小实验讲清 Linux inode 用满的现象、df -i 检查、目录文件数定位、安全清理和恢复验证,避免只看 df -h 误判磁盘问题。399 收藏
-
Kubernetes 官方页面显示 1.34 将于 2026 年 8 月 27 日进入维护模式、10 月 27 日结束生命周期。本文从版本偏差、补丁支持和升级门禁三个角度,给出一套在窗口期前核对集群的实用流程。363 收藏
-
本文用服务启动失败的场景,演示如何用 ss、lsof、ps 定位占用端口的进程,并根据业务归属选择停止旧进程、修改端口或回收僵尸进程。360 收藏
-
Redis 设置了 EXPIRE,业务却发现旧缓存没有在整点消失,通常不是 TTL 失效,而是过期判定、删除时机和监控口径混在了一起。本文从过期键残留现场出发,拆解惰性删除与定期扫描的边界,给出可复查的命令、通知配置和生产处理建议。331 收藏