• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Build Spark1.3.1 with CDH HADOOP,spark1.3.1cdh

Build Spark1.3.1 with CDH HADOOP,spark1.3.1cdh

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含cdh spark,cdh安装spark,泰拉瑞亚1.3.1下载,xstream 1.3.1.jar,我的世界1.3.1等服务器相关知识,网友希望可以进行参考

Build Spark1.3.1 with CDH HADOOP,spark1.3.1cdh


Build Spark1.3.1 with CDH HADOOP

1、找到CDH的版本

[root@web02 spark1.3]# hadoop version
Hadoop 2.0.0-cdh4.7.0
Subversion file:///var/lib/jenkins/workspace/CDH4.7.0-Packaging-Hadoop/build/cdh4/hadoop/2.0.0-cdh4.7.0/source/hadoop-common-project/hadoop-common -r c2ecdeb17590d43320f2151f64e48603aa4849f7
Compiled by jenkins on Wed May 28 09:41:14 PDT 2014
From source with checksum f60207d0daa9f943f253cc8932d598c8
This command was run using /app/home/hadoop/src/hadoop-2.0.0-cdh4.7.0/share/hadoop/common/hadoop-common-2.0.0-cdh4.7.0.jar

对应版本号:
2.0.0-cdh4.7.0

编译参考地址:http://spark.apache.org/docs/latest/building-spark.html

Maven编译(版本要选择在apache-maven-3.0.4以上)

指定编译的profile,可以选择的有yarn, hive, hive-thriftserver

Apache版本

mvn -Dhadoop.version=1.2.1 -DskipTests clean package

CDH版本

/app/hadoop/shengli/apache-maven-3.0.5/bin/mvn -Dhadoop.version=2.0.0-cdh4.7.0 -Pyarn-alpha -Phive -Phive-thriftserver -DskipTests clean package

Test Case测试:
mvn -Dhadoop.version=… -DwildcardSuites=org.apache.spark.repl.ReplSuite test

SBT编译

对对应版本号进行编译:

build/sbt -Pyarn -Phadoop-2.3 assembly

运行Spark-on-YARN需要Spark的二进制发布包。参考编译

SPARK_YARN_USER_ENV

  用户可以在这个参数中设置Spark on YARN的环境变量,可以省略。

  例如:SPARK_YARN_USER_ENV=”JAVA_HOME=/jdk64,FOO=bar”

SPARK_JAR

  设置Spark jar在HDFS的位置。

例如:export SPARK_JAR=hdfs:///some/path.

在每台Hadoop NodeManager节点上设置变量

将Spark发布包放到hdfs上,而不是每次提交都提交spark jar包,使用命令 SPARK_JAR=hdfs://xxx/xx/spark-assembly-1.3.1-hadoop2.5.0.jar

例如:

SPARK_JAR=hdfs://xxxxxx/xxxxxxx/spark-assembly-1.3.1-hadoop2.5.0.jar \
./bin/spark-submit --class org.apache.spark.examples.SparkPI \
    --master yarn-cluster \
    --num-executors 3 \
    --driver-memory 1g \
    --executor-memory 3g \
    --executor-cores 2 \
    lib/spark-examples*.jar \
    10

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Build Spark1.3.1 with CDH HADOOP,spark1.3.1cdh

相关文章

  • MyEclipse字体和保护色设置,myeclipse保护色
  • hadoop单机存储均衡和坏block处理,hadoop单机block
  • hive 如何处理科学计数法,hive处理科学计数
  • spark-OutOfMemory:GC overhead limit exceeded 解决,timelimitexceeded
  • Nodejs课堂笔记-第六课 在DynamoDB中如何创建表,nodejsdynamodb
  • Ryu拓扑发现原理分析,Ryu拓扑原理分析
  • 2015年中国的云计算标准有哪些?,2015年中国标准
  • kafka 效率优化,kafka优化
  • 【hadoop】 3002-mapreduce程序统计单词个数示例,hadoopmapreduce
  • hadoop2.6.0伪分布式安装,hadoop2.6.0伪

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • 与Greenplum度过的三个星期,greenplum三个星期
    • Apache Pig的前世今生,apachepig前世今生
    • 我与英语技术书籍,英语技术书籍
    • Spark中配置Parquet参数,sparkparquet参数
    • Hive学习笔记(二),hive学习笔记
    • HDP出现Could not create the Java Virtual Machine解决方法,hdpvirtual
    • 企业的云之旅程,企业云之旅程
    • shell命令curl抓取网页内容-下载xls文件,
    • Apache Spark的设计思路,apachespark
    • Nodejs课堂笔记-第六课 在DynamoDB中如何创建表,nodejsdynamodb

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有