GBase 8a
运维管理
文章

集群节点数据不一致

发表于2024-12-30 17:54:3671次浏览2个评论

问题现象:

       检查集群状态发现coor 12.1节点的datastate状态为1,日志审计无法开启

排查分析:

      1、检查日志发现12.1节点的gcluster-audit.log一直在更新,正常状况下审计日志是写到表中的,登陆数据库检查审计状态为off,手动开启报错,提示error 145

        >show variables like '%log%';

        >set globle audit_log=1;

计算机生成了可选文字:
Abas已@r:Jb彐5已Cll〕1:gcluster$gcadminshowc上LIS乜巳rC
CLUSTERSTATE:ACT工VE
NO}L
CLUSTERMODE:
GBASE
NodeName
coordinat0F21'
c00d主na乜0r3后
C00℃士na乜0r4丨
-4一十汾0地”一
c00r9土台t?5i
COORD工NATORCLUSTER工NFC)F下T工0
IpÄddress
|gcware
133,95·12,1
丨OPEN
11《OPEN
133'95。1厶
133“95·12、2£上
133·95.,12·3
133,95,12
1《.1?E
lgcluster|DataStateI
|《OPEN
OPEN
PE
0
1
0
0
0
0

 

计算机生成了可选文字:
gbase>setglobalaudit10g=1多
ERROR145(HY000):Tablö'./gbase/audit10g'ismarkedascrashedandshouldberepa
Abase>

     2、排查集群节点的恢复日志,查看具体报错信息,发现21节点的日志包12.1的audit-log表读取失败

         cexec 'tail -n3 /opt/gcluster/log/gcluster/gc-recover.log'

计算机生成了可选文字:
e@gb彐5e001:gcluster$cexec
,tail—n3/opt/gcluster/log/gcluster/gcrecover.log,
COOL"
133,95.12.1一
0一06一0200:34:56.966[INFO
<CLockResource>:UnLOCk:sqmdbcity.a_pm5ginterfereupc91上dD88707C8一BB5F一41D8一
780953Bunlocksucce55
20一06一0200:34:56·967[INFO
<DÄTA-Recover—1>:Enddrnlrecoversqmdb_city.a_pm5ginterfereup_cell_d,tid431724
20一06一0200:34:56.967[INFO
<RECOVER—INFO—1>:FinishingRecoveringsqmdbcity•a_pm5g一主n诧rfere_up_celld,℃主d4.
133.95.12.11一
20一06一0200:34:29·960[INFO
<CLockResource>:UnLock:sqmdbcity.a_pm5ginterfere_upcelldD88707C8一BB5F一41D8一
780953Bunlocksucce5s
20一06一0200:34:29·960〔INFO
<DATA—Recover—1>:EnddmIrecover3qmdbcity.a_pm5gintrfereup_ce11d,亡d4317249
02Q一06一0200:34:29·960[INFO
<RECOVER—INFO—1>:主n主sh主ngRecoveringsqmdb_city.a_pm5g_interfere_up_celld,tid43.
133。95·12·21一
020一06一0210:27:05·531[INFO
<RecovercomohQuerp:QueryExecuteip133.95.12.1,port5258,do”setselfg10alaudi
Oft"
020一06一0210:27:05531[INFO
<STORAGE—Recover—0>:;recoverirxfogc(sys):event土d=1170525,tablename=gbase·audit10
x185360261《133.95·12.11)dst:017588101133.95、12.1)《t
]<STORAGE—ReeOver—P>f7'《,下新esystemtable,eventid=1170525,tablename=gbase.aud:
020一06一0210:27:05“531[INFO
meth=l,forgcluster=true
133·95·12.31一
]<CLOcEResout《0>《UnLPck:gclusterdb.gc$520904581481063D88707C8一BB541D8一禹F9一55A7E
2020一06一0200:17:40·132[INFO

     3、确认是12.1的audit-log表损坏导致的数据同步异常

处理过程:

      1、登陆12.1的数据库,修复audit-log表

         >repair table gbase.audit-log;

计算机生成了可选文字:
gbase>repalr
Table
gbaseaudit
1COWinset
tan-Legnase
(E上昴5:0
。al-IClIt
MSg_type丨Msg_text|
丨OK
0§:0·29

       2、修复完成后,coor集群的datastate状态恢复正常

评论

登录后才可以发表评论
用户头像
levvel发表于 7个月前
评论是一种尊重
崔哥发表于 5个月前
梅花不肯傍春光,自向深冬著艳阳。龙笛远吹胡地月,燕钗初试汉宫妆。风虽强暴翻添思,雪欲侵凌更助香。应笑暂时桃李树,盗天和气作年芳。