Hadoop参数调优
【摘要】 1)在hdfs-site.xml文件中配置多目录,最好提前配置好,否则更改目录需要重新启动集群
2)NameNode有一个工作线程池,用来处理不同DataNode的并发心跳以及客户端并发的元数据操作。
dfs.namenode.handler.count=20 * log2(Cluster Size),比如集群规模为10台时,此参数设置为60
3)编辑日志存储路径dfs.nam...
1)在hdfs-site.xml
文件中配置多目录,最好提前配置好,否则更改目录需要重新启动集群
2)NameNode
有一个工作线程池,用来处理不同DataNode
的并发心跳以及客户端并发的元数据操作。
dfs.namenode.handler.count=20 * log2(Cluster Size)
,比如集群规模为10台时,此参数设置为60
3)编辑日志存储路径dfs.namenode.edits.dir
设置与镜像文件存储路径dfs.namenode.name.dir
尽量分开,达到最低写入延迟
4)服务器节点上YARN
可使用的物理内存总量,默认是8192(MB),注意,如果你的节点内存资源不够8GB,则需要调减小这个值,而YARN
不会智能的探测节点的物理内存总量。yarn.nodemanager.resource.memory-mb
5)单个任务可申请的最多物理内存量,默认是8192
(MB)。yarn.scheduler.maximum-allocation-mb
文章来源: www.jianshu.com,作者:百忍成金的虚竹,版权归原作者所有,如需转载,请联系作者。
原文链接:www.jianshu.com/p/128b1fdf29f0
【版权声明】本文为华为云社区用户转载文章,如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱:
cloudbbs@huaweicloud.com
- 点赞
- 收藏
- 关注作者
评论(0)