E-MapReduce的HBase集群间迁移-阿里云开发者社区

E-MapReduce的HBase集群间迁移

2017-02-21 3398

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

本文涉及的产品

EMR Serverless StarRocks，5000CU*H 48000GB*H

简介： E-MapReduce提供HBase服务，本文介绍了几种HBase集群间迁移的方法

HBase集群间数据迁移

0. 前置

HBase集群	HDFS
Cluster-A	hdfs:/A
Cluster-B	hdfs:/B

Cluster-A集群数据迁移到Cluster-B

1. Export/Import

将Cluster-A中HBase表export到Cluster-B的HDFS中，然后在Cluster-B中使用import导入HBase

a) Cluster-A和Cluster-B网络通

Cluster-B中建好相关迁移的表

hbase(main):001:0>create 'TestTable', 'info'

Cluster-A中执行Export命令

sudo su hdfs
hbase org.apache.hadoop.hbase.mapreduce.Driver export TestTable hdfs://B:9000/hbase_tmp

Cluster-B中执行Import命令

sudo su hdfs
hbase org.apache.hadoop.hbase.mapreduce.Driver import TestTable hdfs://B:9000/hbase_tmp

清理Cluster-B的HDFS中临时文件夹/hbase_tmp

hadoop fs -rmr /hbase_tmp

b) Cluster-A和Cluster-B网络不通

网络不通的情况下，可以将数据Export到OSS中，然后从OSS中Import

Cluster-B中建好相关迁移的表

hbase(main):001:0>create 'TestTable', 'info'

Cluster-A中执行Export命令导出到OSS

sudo su hdfs
hbase org.apache.hadoop.hbase.mapreduce.Driver export TestTable oss://$bucket/$path

Cluster-B中执行Import命令

sudo su hdfs
hbase org.apache.hadoop.hbase.mapreduce.Driver import TestTable oss://$bucket/$path

清理OSS中临时文件夹

2. distcp

将Cluster-A中HDFS的表文件distcp拷贝到Cluster-B的HBase在HDFS中对应的目录

Cluster-A中将HBase的表在HDFS存储文件distcp到Cluster-B的HBase在HDFS中对应的目录(hdfs账户)

sudo su hdfs
hadoop distcp /hbase/data/default/* hdfs://B:9000/hbase/data/default

备注:

/hbase/data/default是E-MapReduce中HBase表在HDFS存储路径，例如表TestTable 的存储路径是/hbase/data/default/TestHbase, 可以只有单个表的路径，也可以是default下面所有表的路径(即*表示)

Cluster-B中执行HBase repair修复(hdfs账户)

 sudo su hdfs
 hbase hbck -repair

相关实践学习

lindorm多模间数据无缝流转

展现了Lindorm多模融合能力——用kafka API写入，无缝流转在各引擎内进行数据存储和计算的实验。

云数据库HBase版使用教程

  相关的阿里云产品：云数据库 HBase 版面向大数据领域的一站式NoSQL服务，100%兼容开源HBase并深度扩展，支持海量数据下的实时存储、高并发吞吐、轻SQL分析、全文检索、时序时空查询等能力，是风控、推荐、广告、物联网、车联网、Feeds流、数据大屏等场景首选数据库，是为淘宝、支付宝、菜鸟等众多阿里核心业务提供关键支撑的数据库。了解产品详情: https://cn.aliyun.com/product/hbase   ------------------------------------------------------------------------- 阿里云数据库体验：数据库上云实战开发者云会免费提供一台带自建MySQL的源数据库 ECS 实例和一台目标数据库 RDS实例。跟着指引，您可以一步步实现将ECS自建数据库迁移到目标数据库RDS。点击下方链接，领取免费ECS&RDS资源，30分钟完成数据库上云实战！https://developer.aliyun.com/adc/scenario/51eefbd1894e42f6bb9acacadd3f9121?spm=a2c6h.13788135.J_3257954370.9.4ba85f24utseFl

E-MapReduce的HBase集群间迁移

HBase集群间数据迁移

0. 前置

1. Export/Import

a) Cluster-A和Cluster-B网络通

b) Cluster-A和Cluster-B网络不通

2. distcp

开源大数据平台 E-MapReduce

热门文章

最新文章

相关课程

相关电子书

相关实验场景