用脚本清理重复文件名的小练习
手机照片、截图和下载文件积累久了,很容易出现名称相近但内容不同的文件。 这次练习目标不是自动删除,而是先把可疑文件列出来人工确认。
先做分组
可以先按文件大小分组,再对大小相同的文件计算哈希,减少不必要的读取。
find . -type f -printf '%s %p\n' |
sort -n |
awk '{print $1}'
保持保守
文件清理脚本不要一开始就删除。更稳的做法是输出报告,比如路径、大小、哈希和修改时间, 确认无误后再移动到临时目录。
这个练习的收获是:自动化脚本不一定要替人做最后决定,先把信息整理清楚,本身就很有价值。