GBase 8a
运维管理
文章

952版本集群重做系统后恢复纯data节点操作步骤

发表于2024-12-31 13:51:1421次浏览0个评论

[gbase@s100 ~]$ gcadmin showcluster vc vc1
CLUSTER STATE:         ACTIVE
VIRTUAL CLUSTER MODE:  NORMAL

=============================================
|     GBASE VIRTUAL CLUSTER INFORMATION     |
=============================================
|    VcName    | DistributionId |  comment  |
---------------------------------------------
|     vc1      |       1        | vc1       |
---------------------------------------------
=========================================================================================================
|                                 VIRTUAL CLUSTER DATA NODE INFORMATION                                 |
=========================================================================================================
| NodeName |                IpAddress                 | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
|  node1   |               192.168.5.21               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node2   |               192.168.5.22               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node3   |               192.168.5.23               |       1        | CLOSE |   CLOSE    |     1     |
---------------------------------------------------------------------------------------------------------

3 data node


gbase> select * from test.t1;
+------+-----------+
| id   | name      |
+------+-----------+
|    3 | zhangsan3 |
|    6 | zhangsan6 |
|    7 | zhangsan7 |
|    8 | zhangsan8 |
|    1 | zhangsan1 |
|    2 | zhangsan2 |
|    4 | zhangsan4 |
|    5 | zhangsan5 |
+------+-----------+
8 rows in set (Elapsed: 00:00:00.01)


=========故障节点重做操作系统且数据目录文件未丢失
1、故障节点安装操作系统并检查依赖包
检查依赖包:bc 、bzip、cgroup、lsof
若没有,请安装。

2、将故障节点/opt下的gcluster和gnode重命名
[root@s102 opt]# mv gcluster gcluster_210623
[root@s102 opt]# mv gnode gnode_210623

3、关闭所有管理节点的gcmonit和gcrecover服务
[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcmonit.sh stop'
Stopping GCMonit success!

[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcluster_services gcrecover stop'
Stopping gcrecover :                                       [  OK  ]

4、故障节点安装集群(纯data节点)
1)故障节点创建gbase用户
[root@s102 opt]# useradd gbase
[root@s102 opt]# passwd gbase

2)拷贝集群安装文件到故障节点
[gbase@s100 ~]$ scp -r  GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3/ 192.168.5.23:/home/gbase/

3)修改/opt目录属组并准备安装文件
[root@s102 ~]# chown gbase:gbase /opt
[gbase@s102 GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3]$ cp -r /home/gbase/GBase8a_MPP_Cluster-NoLicense-9.5.2.17-redhat7.3/gcinstall /opt/cluster_prepare

4)编辑demo.options文件
[gbase@s102 cluster_prepare]$ vi /opt/cluster_prepare/demo.options
[gbase@s102 cluster_prepare]$ cat /opt/cluster_prepare/demo.options 
installPrefix= /opt
coordinateHost = 192.168.5.21
coordinateHostNodeID = 21
dataHost = 192.168.5.21,192.168.5.22,192.168.5.23
#existCoordinateHost =
#existDataHost =
dbaUser = gbase
dbaGroup = gbase
dbaPwd = 'gbase'
rootPwd = '111111'
#rootPwdFile = rootPwd.json
dbaPwd='gbase'

7)拷贝修改环境变量脚本并执行
[root@s102 cluster_prepare]# cp /opt/cluster_prepare/SetSysEnv.py /opt/
[root@s102 cluster_prepare]# python /opt/SetSysEnv.py --dbaUser=gbase --installPrefix=/opt --cgroup

8)执行安装
[gbase@s102 opt]$ cd /opt/cluster_prepare/
[gbase@s102 cluster_prepare]$ python InstallTar.py --silent=demo.options --IsData

5、停止故障节点的集群服务
[gbase@s102 ~]$ gcluster_services all stop

6、备份的数据文件更改属组
[root@s102 opt]# chown gbase:gbase gcluster_210623/ -R
[root@s102 opt]# chown gbase:gbase gnode_210623/ -R

7、恢复备份数据文件
[gbase@s102 opt]# mv gcluster gcluster_newbak
[gbase@s102 opt]# mv gnode gnode_newbak

[gbase@s102 opt]# mv gcluster_210623 gcluster
[gbase@s102 opt]# mv gnode_210623 gnode

8、启动故障节点的集群服务
[gbase@s102 opt]$ gcluster_services all start
Starting gbase :                                           [  OK  ]
Starting syncserver :                                      [  OK  ]
Starting GCMonit success!

9、查看集群状态
[gbase@s100 gcinstall]$ gcadmin showcluster vc vc1
CLUSTER STATE:         ACTIVE
VIRTUAL CLUSTER MODE:  NORMAL

=============================================
|     GBASE VIRTUAL CLUSTER INFORMATION     |
=============================================
|    VcName    | DistributionId |  comment  |
---------------------------------------------
|     vc1      |       1        | vc1       |
---------------------------------------------
=========================================================================================================
|                                 VIRTUAL CLUSTER DATA NODE INFORMATION                                 |
=========================================================================================================
| NodeName |                IpAddress                 | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
|  node1   |               192.168.5.21               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node2   |               192.168.5.22               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node3   |               192.168.5.23               |       1        | OPEN  |    OPEN    |     1     |
---------------------------------------------------------------------------------------------------------

3 data node


10、开启所有管理节点的gcmonit和gcrecover服务
[gbase@s100 gcinstall]$ cexec coor: '/opt/gcluster/server/bin/gcmonit.sh start'
=====192.168.5.21======
Starting GCMonit success!

11、观察同步情况及集群状态
[gbase@s100 gcinstall]$ gcadmin showcluster vc vc1
CLUSTER STATE:         ACTIVE
VIRTUAL CLUSTER MODE:  NORMAL

=============================================
|     GBASE VIRTUAL CLUSTER INFORMATION     |
=============================================
|    VcName    | DistributionId |  comment  |
---------------------------------------------
|     vc1      |       1        | vc1       |
---------------------------------------------
=========================================================================================================
|                                 VIRTUAL CLUSTER DATA NODE INFORMATION                                 |
=========================================================================================================
| NodeName |                IpAddress                 | DistributionId | gnode | syncserver | DataState |
---------------------------------------------------------------------------------------------------------
|  node1   |               192.168.5.21               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node2   |               192.168.5.22               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------
|  node3   |               192.168.5.23               |       1        | OPEN  |    OPEN    |     0     |
---------------------------------------------------------------------------------------------------------

3 data node

至此,纯data节点恢复成功,数据已同步完成。

 

评论

登录后才可以发表评论