• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > CDH集群中YARN的参数配置,cdh集群yarn参数

CDH集群中YARN的参数配置,cdh集群yarn参数

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含cdh集群,cdh集群安装,cdh集群是什么,cdh,cdh安装等服务器相关知识,网友希望可以进行参考

CDH集群中YARN的参数配置,cdh集群yarn参数


前言:Hadoop 2.0之后,原先的MapReduce不在是简单的离线批处理MR任务的框架,升级为MapReduceV2(Yarn)版本,也就是把资源调度和任务分发两块分离开来。而在最新的CDH版本中,同时集成了MapReduceV1和MapReduceV2(Yarn)两个版本,如果集群中需要使用Yarn做统一的资源调度,建议使用Yarn。

CDH对Yarn的部分参数做了少了修改,并且添加了相关的中文说明,本文着重介绍了CDH中相比 MapReduceV1一些参数改动的配置。

一、CPU配置

ApplicationMaster虚拟 CPU 内核

yarn.app.mapreduce.am.resource.cpu-vcores       // ApplicationMaster占用的cpu内核数(Gateway--资源管理)

容器虚拟 CPU 内核

yarn.nodemanager.resource.cpu-vcores        //单 个NodeManager 最大能分配的cpu核数(NodeManager --资源管理)

结论:当前 nodemanager 申请的 ApplicationMaster数总 和小于 nodemanager最大cpu内核数

二、内存配置

容器内存   

yarn.nodemanager.resource.memory-mb      //单个NodeManager能分配的最大内存(NodeManager --资源管理)                //Memory Total= 单个NodeManager内存 * 节点数

结论:提交任务占用内存Memory Used 小于Memory Total

Map 任务内存   

mapreduce.map.memory.mb                         //为作业的每个 Map 任务分配的物理内存量  (Gateway--资源管理 )

结论:map或reduce的内存需求不大于appmaster的内存需求

最大容器内存  

yarn.scheduler.maximum-allocation-mb     //单个任务可申请最大内存 (ResourceManager--资源管理 )

三、同一个Map或者Reduce 并行执行

Map 任务推理执行

mapreduce.map.speculative                       //Gateway

Reduce 任务推理执行

mapreduce.reduce.speculative                   //Gateway

四、JVM重用

启用 Ubertask 优化 :

mapreduce.job.ubertask.enable | (默认false)     //true则表示启用jvm重用(Gateway--性能)

jvm重用的决定参数如下:

Ubertask最大 Map   

mapreduce.job.ubertask.maxmaps                   //超过多少个map启用jvm重用(Gateway--性能)

Ubertask最大 Reduce   

mapreduce.job.ubertask.maxreduces               //超过多少  Reduce  启用jvm重用,目前支持1个 (Gateway--性能)

Ubertask最大作业大小   

mapreduce.job.ubertask.maxbytes                  //application的输入大小的阀值,默认为 block大小(Gateway--性能)

五、其他参数

给spark加日志编辑 spark-defaults.conf

spark.yarn.historyServer.address=http://cloud003:18080/

更多精彩内容请关注:http://bbs.superwu.cn

关注超人学院微信二维码:

关注超人学院java免费学习交流群:

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • CDH集群集成kafka,cdh集群kafka
  • CDH集群中YARN的参数配置,cdh集群yarn参数

相关文章

  • 分析MapReduce与Storm的异同,mapreducestorm
  • 1006-HBase操作实战(JAVA API模式),1006-hbaseapi
  • Spark如何读写hive
  • Azkaban的AJAX的RestFul接口调用事例
  • 机器学习基础,学习基础
  • hive sql,hive
  • 机器学习--k-近邻(kNN)算法案例,--k-knn
  • 吐槽Oozie: 挖好坑,等你跳!,oozie
  • Hadoop之——分布式集群安装过程简化版,hadoop集群简化版
  • 产品型公司的发展-Zoho发布费用管理新品,让CRM系统更强大,-zohocrm

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • ERROR (ConnectionError): HTTPConnectionPool (Caused by <class 'socket.error'>: [Errno 111] Connecti,errno111
    • 2015年中国的云计算标准有哪些?,2015年中国标准
    • Java MapReduce详解--(3),mapreduce详解
    • CloudStack VM运行状态的监控-Management,cloudstack系统vm
    • 解决sqoop导入关系库更新联合主键的问题,sqoop主键
    • HDFS命令行接口详解,hdfs命令行详解
    • mysql数据导入hbase
    • Navicat连接oracle,出现Only compatible with oci version 8.1 and&nb,navicatoci
    • 机器学习基础,学习基础
    • spark on yarn的cpu使用,sparkonyarncpu

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有