文件处理
已收录文章:33篇
-
对于纯文本文件,我们必须创建自定义的格式,理想的格式应该易于解析和扩展。下面是某单个发票以自定义纯文本格式存储的数据。INVOICE ID=5441 CUSTOMER=960 RAISED=2012-09-06 DUE=2012-10-06 PAID=trueITEM ID222 收藏
-
临时目录清理最容易出问题的地方,不是调用 unlink,而是筛选条件太宽、相对路径越界和删错文件后无法复盘。用 pathlib 统一解析路径,按后缀和 mtime 过滤,先写入待删清单再处理,就能把一次性脚本变成可检查、可回退的清理流程。219 收藏
-
本文用 Python 标准库实现配置文件原子写入:先写临时文件、刷盘校验,再用 os.replace 一步替换目标文件,避免程序中断时留下半截配置。209 收藏
-
复盘一次 Python 大文件导入导致内存飙升的问题,按影响面、时间线、触发条件、根因、修复动作和防复发清单讲清 read() 一次读入与分块迭代的差异。196 收藏
-
切片提供了 Go语言中处理 I/O 缓冲的标准方式,下面 cat 函数的第二版中,在一个切片缓冲内使用无限 for 循环(直到文件尾部 EOF)读取文件,并写入到标准输出(os.Stdout)。func cat(f *os.File) {190 收藏
-
用下载目录整理场景演示 Python pathlib 的实用写法:扫描文件、按扩展名创建分类目录、处理同名冲突、移动文件并记录日志,让批量文件整理脚本更稳。166 收藏
-
在本节中,我们构建一个程序,根据命令行指定的输入,报告一个或多个目录的磁盘使用情况,类似于 UNIX du 命令。大多数的工作由下面的 walkDir 函数完成,它使用 dirents 辅助函数来枚举目录中137 收藏
-
读取日志头、文件摘要或上传内容前 N 个字节时,io.LimitReader、io.CopyN 和手动缓冲的行为并不一样。本文按目标是限制读取、严格读取还是复用缓冲,给出选择边界、EOF 判断和可验证示例。130 收藏
-
虽然 Go语言的 encoding/gob 包非常易用,而且使用时所需代码量也非常少,我们仍有可能需要创建自定义的二进制格式。自定义的二进制格式有可能做到最紧凑的数据表示,并且读写速度可以非常103 收藏