故障排查
已收录文章:57篇
-
文章 · python教程 | 1个月前 | 配置管理 · logging · 故障排查 · Python教程 · Python logging.config.dictConfig 日志热更新 disable_existing_loggers 日志回滚Python 用 logging.config.dictConfig 更新日志配置时,最容易误伤已有日志器、重复打开文件句柄或留下半套配置。本文用可回滚的热更新流程拆解 disable_existing_loggers、incremental 和文件处理器的边界,并给出复查方法。214 收藏
-
用 findmnt --verify 在重启前检查 fstab 的语法、设备路径和挂载选项,区分配置可解析、设备可见与真正挂载成功这三个验收层次。188 收藏
-
nftables 规则看起来写对了,流量却没有按预期放行或拒绝,通常要从 counter、链优先级和实际生效配置三处核对。本文给出一套可回滚的排查顺序。158 收藏
-
Redis Streams 使用 XREADGROUP 时,空结果不一定代表没有消息。本文从 BLOCK 超时、已确认消息和 XPENDING 消费者状态三条线核对消息是否真正读到,并给出可复查的命令与边界。382 收藏
-
MySQL XA 事务进入 PREPARED 后,连接断开并不代表事务已经消失。本文从 XA RECOVER、事务分支和业务提交记录入手,说明如何区分可提交、可回滚和需要人工确认的状态,并给出恢复前后的验收边界。412 收藏
-
Redis 写入成功不等于副本已收到,也不等于 AOF 已落盘。本文用 WAIT 和 WAITAOF 拆开复制确认、AOF 持久化确认、超时返回与故障切换边界,给出 redis-cli 验收命令和业务侧选型清单。218 收藏
-
Linux 上的 systemd 服务突然退出并生成 core 文件时,可以先列出崩溃记录,再查看信号、进程和可执行文件,最后决定是否进入调试器。文章同时说明 Storage、保留期限和权限边界,避免只会下载 core 却找不到可用证据。199 收藏
-
Python 3.14 为 asyncio 增加 ps 和 pstree 命令,可以直接查看运行进程里的任务名、协程栈和等待链。本文用一个可复现的卡住任务场景说明如何选择 PID、读取输出、定位等待点,并给出版本与权限边界。207 收藏
-
PHP 的 TCP 探活不该只看一个布尔值。本文用 stream_socket_client() 拆解 DNS、连接超时、端口拒绝、上下文参数和日志归因,给出可回归的最小检查器。130 收藏
-
Linux 目录统计结果异常时,du 和 find 可能把挂载点、bind mount 或其他文件系统算进来。本文用 find -xdev、-mount、df、findmnt 组成核对路径,区分目录树大小与底层文件系统用量。416 收藏
-
Redis LCS 不只是返回两段文本的最长公共子序列,还能用 IDX 找到两边的匹配区间。本文用配置版本对比说明 LEN、IDX、MINMATCHLEN 和 WITHMATCHLEN 的结果结构、顺序陷阱与生产边界。208 收藏
-
Redis Lua 脚本一旦超过 lua-time-limit,会阻塞其他命令并返回 -BUSY。本文用一个长脚本现场说明如何确认阻塞、何时可以 SCRIPT KILL、写入后为什么只能重启,以及如何在脚本侧避免再次拖住主线程。184 收藏