注意事项:
1.有足够的带宽,最好能300M/S = 磁盘写入速度
2.两个集群的在一个网络,且新集群的主机名=可以访问的域名。
CDH的主机名不能轻易更改,若只能换主机名建议重新部署CDH集群。
3.数据拷贝跑后台进程
hive表跨集群备份
注意事项:
1.老集群使用hdfs
2.传输命令带上用户权限参数,带上数目参数
HBase表跨集群备份
注意事项:
1.老集群使用hbase用户
2.传输命令带上用户权限参数
3.最重要!在hbase上建立快照后,传输完成后要立刻删掉快照。
原数据不变时,快照不占空间。原数据变化,快照会把该时刻的数据copy一份。
4.覆盖之前的数据可在结尾处加 -overwrite