sparkR操作HDFS上面的CSV文件

本文转载自查看原文 2016-03-01 14:24 1848 大数据相关

./bin/sparkR --packages com.databricks:spark-csv_2.10:1.3.0 --master yarn

hdfs://master:9000/tmp/demo.cvs 替换你的hdfs路径
>sc = sparkR.init(master = "yarn″, appName="SparkR")
>sqlContext = sparkRSQL.init(sc)
>demo = read.df(sqlContext,'hdfs://master:9000/tmp/demo.cvs',source ='com.databricks.spark.csv')
>head(demo)

免责声明！

本站转载的文章为个人学习借鉴使用，本站对版权不负任何法律责任。如果侵犯了您的隐私权益，请联系本站邮箱yoyou2525@163.com删除。

猜您在找 spark读取hdfs上的文件和写入数据到hdfs上面 spark读取hdfs上的文件和写入数据到hdfs上面 SPARKR，对RDD操作的介绍 HDFS文件的基本操作 hdfs基本文件操作 Hive_hdfs导入csv文件 java 操作 csv文件 Java操作csv文件 python操作csv文件 csv文件操作