Spark優化之三:Kryo序列化


Spark默認采用Java的序列化器,這里建議采用Kryo序列化提高性能。實測性能最高甚至提高一倍。

Spark之所以不默認使用Kryo序列化,可能的原因是需要對類進行注冊。

Java程序中注冊很簡單:

        SparkConf conf = new SparkConf().setAppName(appName);
        conf.set("spark.serializer", "org.apache.spark.serializer.KryoSerializer");
        conf.registerKryoClasses(new Class[]{YOUR_SPARK_CLASS.class});

  


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM