花費 5 ms
Spark讀取HDFS小文件優化

Spark讀取HDFS目錄,若該目錄下存在大量小文件時,每個文件都會生成一個Task,當存在大量任務時,可能存在性能不足的問題,可以使用CombineTextInputFormat類代替TextInp ...

Sun Mar 27 23:17:00 CST 2022 0 625

 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM