博客
关于我
Hadoop-之数据均衡
阅读量:723 次
发布时间:2019-03-21

本文共 800 字,大约阅读时间需要 2 分钟。

Hadoop 数据均衡操作

数据的均衡问题在集群操作中经常出现,可能存在于不同节点之间,也可能出现在同一节点的多个磁盘之间。为解决这些不均衡问题,我们需要设计数据迁移和传输策略,无论是跨节点迁移还是跨磁盘迁移,均需要合理规划和执行。

节点间数据均衡

Hadoop提供了一些默认脚本来实现节点间的数据均衡。此类脚本可以通过以下路径访问:

[路径] start-balancer.sh

在进行该操作之前,务必确保集群处于空闲状态,因为否则跨节点的RPC网络传输可能会占用大量资源,导致集群在忙碌时长时间无法获取到所需的资源而导致任务运行失败。

脚本使用默认参数为10,该参数表示集群中任何两个节点的磁盘使用率之差不超过10%。可根据实际集群负载情况调整该参数。若需要停止正在进行的均衡操作,可执行:

[路径] stop-balancer.sh

磁盘间数据均衡

对于磁盘间的数据均衡,可按照以下步骤进行操作:

1. 生成均衡计划

按照以下命令生成一个均衡计划文件:

hdfs diskbalancer -plan shufang102.plan.json

该命令会生成一个JSON文件,文件名为shufang102.plan.json。文件名可根据实际需求进行命名。

2. 执行均衡计划

按照生成的计划文件执行均衡操作:

hdfs diskbalancer -execute shufang102.plan.json

3. 查看任务执行情况

在均衡操作进行期间,可以使用以下命令查看当前任务的执行状态:

hdfs diskbalancer -query shufang102

4. 取消已计划的任务

如需中止计划中的任务,可执行以下命令:

hdfs diskbalancer -cancel shufang102.plan.json

注意:上述命令仅为示例,具体操作时请根据实际环境自行调整参数和文件命名。

转载地址:http://jcygz.baihongyu.com/

你可能感兴趣的文章
OpenStack安装部署实战
查看>>
OpenStack的基本概念与架构详解
查看>>
Openstack的视频学习
查看>>
openstack虚拟机迁移live-migration中libvirt配置
查看>>
ORACEL学习--理解over()函数
查看>>
ORACLE Bug 4431215 引发的血案—原因分析篇
查看>>
oracle dblink 创建使用 垮库转移数据
查看>>
oracle dblink结合同义词的用法 PLS-00352:无法访问另一数据库
查看>>
Oracle dbms_job.submit参数错误导致问题(ora-12011 无法执行1作业)
查看>>
oracle dg switchover,DG Switchover fails
查看>>
Oracle EBS环境下查找数据源(OAF篇)
查看>>
Oracle GoldenGate Director安装和配置(无图)
查看>>
oracle script
查看>>
Oracle select表要带双引号的原因
查看>>
Oracle SOA Suit Adapter
查看>>
Oracle Spatial空间数据库建立
查看>>
UML— 活动图
查看>>
Oracle Statspack分析报告详解(一)
查看>>
oracle where 条件的执行顺序分析1
查看>>
oracle 使用leading, use_nl, rownum调优
查看>>