Linux下一次刪除百萬文件


Linux下一次刪除百萬文件

線上環境遇到的一個問題,文件數量過多,執行rm命令報錯

# rm -f ./*

-bash: /bin/rm: Argument list too long

根據報錯檢查狀態

# ls | wc -l

634084

# du -sh

64G

在線下環境進行故障復現

測試環境准備

# df -Th

Filesystem     Type   Size  Used Avail Use% Mounted on

/dev/sda3      ext4   1.8T  331G  1.4T  20% /

tmpfs          tmpfs  7.7G     0  7.7G   0% /dev/shm

/dev/sda1      ext4   190M   61M  120M  34% /boot

# grep name /proc/cpuinfo

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

model name      : Intel(R) Xeon(R) CPU E5-2609 v3 @ 1.90GHz

# free -m

             total       used       free     shared    buffers     cached

Mem:         15709       1643      14066          8        452        559

-/+ buffers/cache:        631      15078

Swap:         8191          0       8191

# cat /etc/redhat-release

CentOS release 6.8 (Final)

# uname -r

2.6.32-642.1.1.el6.x86_64

測試生成測試數據

# for i in `seq 1000000`;do echo "${i}" >> ${i}.txt;done

# ls | wc -l

1000000

# du -sh

3.9G .

# ls *.txt

-bash: /bin/ls: Argument list too long

# rm -f ./*

-bash: /bin/rm: Argument list too long

 

 

方法1:使用for循環方式執行刪除任務

# time for i in `ls ./`;do rm -f ${i};done

 

real   58m44.234s

user  8m59.930s

sys    37m16.453s

時間太長了,絕壁不能忍

 

 

方法2:直接刪目錄

# time rm -rf test && mkdir test

 

real   0m56.768s

user  0m1.453s

sys    0m22.603s

# du -sh test

4.0K  test

速度不錯,然而很多情況下不能直接刪目錄,有點蛋疼

 

 

方法3:使用 find + xargs 組合命令執行刪除任務(網上流傳最多的方法)

# time find ./ -type f | xargs -n 1 rm -f

 

real   18m30.267s

user  0m9.536s

sys    1m38.999s

 

# time find ./ -type f | xargs rm -f

 

real   16m16.774s

user  0m2.232s

sys    0m30.454s

一樣蛋疼,如果需求是刪除全部文件的話,用這種方法就太low了,適合刪除部分數據的場景

 

 

方法4:使用 ls + xargs 組合命令執行刪除任務

# time ls | xargs -L 100 rm -f

 

real   1m3.801s

user  0m7.054s

sys    0m28.582s

 

# time ls | xargs -L 1000 rm -f

 

real   0m55.917s

user  0m5.322s

sys    0m24.778s

 

# time ls | xargs -L 2000 rm -f

 

real   0m55.560s

user  0m5.209s

sys    0m24.702s

 

# time ls | xargs -L 5000 rm -f

 

real   0m55.057s

user  0m5.196s

sys    0m24.666s

 

# time ls | xargs -L 10000 rm -f

 

real   0m55.733s

user  0m5.121s

sys    0m24.657s

 

# time ls | xargs -L 100000 rm -f

xargs: argument list too long

 

real   0m4.018s

user  0m3.324s

sys    0m0.701s

速度杠杠滴~~但是注意文件名長度,選擇合適的傳參數量

 

 

方法5:使用rsync命令來執行刪除任務

# mkdir /tmp/Null

# time rsync --delete-before -d /tmp/Null/ ./

 

real   0m56.386s

user  0m1.767s

sys    0m28.075s

# ll

total 0

# du -sh ./

29M ./

 沒什么優點,缺點是rsync命令比較冷門,參數不容易記住,用的機會也不多,作為拓展方法了解一下就好

 

如果你有其他好的方法,可以一起探討一下~~

 

 

原創文章,侵權必究

 


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM