952版本集群重做系统后恢复纯data节点操作步骤
[gbase@s100 ~]$ gcadmin showcluster vc vc1
CLUSTER STATE: ACTIVE
VIRTUAL CLUSTER MODE: NORMAL
=============================================
| GBASE VIRTUAL CLUSTER INFORMATION |
=============================================
| VcName | DistributionId | comment |
---------------------------------------------
| vc1 | 1 | vc1 |
---------------------------------------------
=========================================================================================================
| VIRTUAL CLUSTER DATA NODE INFORMATION |
=========================================================================================================
| NodeName | IpAddress | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
| node1 | 192.168.5.21 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node2 | 192.168.5.22 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node3 | 192.168.5.23 | 1 | CLOSE | CLOSE | 1 |
---------------------------------------------------------------------------------------------------------
3 data node
gbase> select * from test.t1;
+------+-----------+
| id | name |
+------+-----------+
| 3 | zhangsan3 |
| 6 | zhangsan6 |
| 7 | zhangsan7 |
| 8 | zhangsan8 |
| 1 | zhangsan1 |
| 2 | zhangsan2 |
| 4 | zhangsan4 |
| 5 | zhangsan5 |
+------+-----------+
8 rows in set (Elapsed: 00:00:00.01)
=========故障节点重做操作系统且数据目录文件未丢失
1、故障节点安装操作系统并检查依赖包
检查依赖包:bc 、bzip、cgroup、lsof
若没有,请安装。
2、将故障节点/opt下的gcluster和gnode重命名
[root@s102 opt]# mv gcluster gcluster_210623
[root@s102 opt]# mv gnode gnode_210623
3、关闭所有管理节点的gcmonit和gcrecover服务
[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcmonit.sh stop'
Stopping GCMonit success!
[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcluster_services gcrecover stop'
Stopping gcrecover : [ OK ]
4、故障节点安装集群(纯data节点)
1)故障节点创建gbase用户
[root@s102 opt]# useradd gbase
[root@s102 opt]# passwd gbase
2)拷贝集群安装文件到故障节点
[gbase@s100 ~]$ scp -r GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3/ 192.168.5.23:/home/gbase/
3)修改/opt目录属组并准备安装文件
[root@s102 ~]# chown gbase:gbase /opt
[gbase@s102 GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3]$ cp -r /home/gbase/GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3/gcinstall /opt/cluster_prepare
4)编辑demo.options文件
[gbase@s102 cluster_prepare]$ vi /opt/cluster_prepare/demo.options
[gbase@s102 cluster_prepare]$ cat /opt/cluster_prepare/demo.options
installPrefix= /opt
coordinateHost = 192.168.5.21
coordinateHostNodeID = 21
dataHost = 192.168.5.21,192.168.5.22,192.168.5.23
#existCoordinateHost =
#existDataHost =
dbaUser = gbase
dbaGroup = gbase
dbaPwd = 'gbase'
rootPwd = '111111'
#rootPwdFile = rootPwd.json
dbaPwd='gbase'
7)拷贝修改环境变量脚本并执行
[root@s102 cluster_prepare]# cp /opt/cluster_prepare/SetSysEnv.py /opt/
[root@s102 cluster_prepare]# python /opt/SetSysEnv.py --dbaUser=gbase --installPrefix=/opt --cgroup
8)执行安装
[gbase@s102 opt]$ cd /opt/cluster_prepare/
[gbase@s102 cluster_prepare]$ python InstallTar.py --silent=demo.options --IsData
5、停止故障节点的集群服务
[gbase@s102 ~]$ gcluster_services all stop
6、备份的数据文件更改属组
[root@s102 opt]# chown gbase:gbase gcluster_210623/ -R
[root@s102 opt]# chown gbase:gbase gnode_210623/ -R
7、恢复备份数据文件
[gbase@s102 opt]# mv gcluster gcluster_newbak
[gbase@s102 opt]# mv gnode gnode_newbak
[gbase@s102 opt]# mv gcluster_210623 gcluster
[gbase@s102 opt]# mv gnode_210623 gnode
8、启动故障节点的集群服务
[gbase@s102 opt]$ gcluster_services all start
Starting gbase : [ OK ]
Starting syncserver : [ OK ]
Starting GCMonit success!
9、查看集群状态
[gbase@s100 gcinstall]$ gcadmin showcluster vc vc1
CLUSTER STATE: ACTIVE
VIRTUAL CLUSTER MODE: NORMAL
=============================================
| GBASE VIRTUAL CLUSTER INFORMATION |
=============================================
| VcName | DistributionId | comment |
---------------------------------------------
| vc1 | 1 | vc1 |
---------------------------------------------
=========================================================================================================
| VIRTUAL CLUSTER DATA NODE INFORMATION |
=========================================================================================================
| NodeName | IpAddress | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
| node1 | 192.168.5.21 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node2 | 192.168.5.22 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node3 | 192.168.5.23 | 1 | OPEN | OPEN | 1 |
---------------------------------------------------------------------------------------------------------
3 data node
10、开启所有管理节点的gcmonit和gcrecover服务
[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcmonit.sh start'
=====192.168.5.21======
Starting GCMonit success!
11、观察同步情况及集群状态
[gbase@s100 gcinstall]$ gcadmin showcluster vc vc1
CLUSTER STATE: ACTIVE
VIRTUAL CLUSTER MODE: NORMAL
=============================================
| GBASE VIRTUAL CLUSTER INFORMATION |
=============================================
| VcName | DistributionId | comment |
---------------------------------------------
| vc1 | 1 | vc1 |
---------------------------------------------
=========================================================================================================
| VIRTUAL CLUSTER DATA NODE INFORMATION |
=========================================================================================================
| NodeName | IpAddress | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
| node1 | 192.168.5.21 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node2 | 192.168.5.22 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
| node3 | 192.168.5.23 | 1 | OPEN | OPEN | 0 |
---------------------------------------------------------------------------------------------------------
3 data node
至此,纯data节点恢复成功,数据已同步完成。
评论
热门帖子
- 12025-12-01浏览数:182763
- 22023-05-09浏览数:25057
- 42023-09-25浏览数:18525
- 52020-05-11浏览数:17528