GBase 8a
运维管理
文章
集群节点数据不一致
发表于2024-12-30 17:54:3671次浏览2个评论
问题现象:
检查集群状态发现coor 12.1节点的datastate状态为1,日志审计无法开启
排查分析:
1、检查日志发现12.1节点的gcluster-audit.log一直在更新,正常状况下审计日志是写到表中的,登陆数据库检查审计状态为off,手动开启报错,提示error 145
>show variables like '%log%';
>set globle audit_log=1;


2、排查集群节点的恢复日志,查看具体报错信息,发现21节点的日志包12.1的audit-log表读取失败
cexec 'tail -n3 /opt/gcluster/log/gcluster/gc-recover.log'
![计算机生成了可选文字:
e@gb彐5e001:gcluster$cexec
,tail—n3/opt/gcluster/log/gcluster/gcrecover.log,
COOL"
133,95.12.1一
0一06一0200:34:56.966[INFO
<CLockResource>:UnLOCk:sqmdbcity.a_pm5ginterfereupc91上dD88707C8一BB5F一41D8一
780953Bunlocksucce55
20一06一0200:34:56·967[INFO
<DÄTA-Recover—1>:Enddrnlrecoversqmdb_city.a_pm5ginterfereup_cell_d,tid431724
20一06一0200:34:56.967[INFO
<RECOVER—INFO—1>:FinishingRecoveringsqmdbcity•a_pm5g一主n诧rfere_up_celld,℃主d4.
133.95.12.11一
20一06一0200:34:29·960[INFO
<CLockResource>:UnLock:sqmdbcity.a_pm5ginterfere_upcelldD88707C8一BB5F一41D8一
780953Bunlocksucce5s
20一06一0200:34:29·960〔INFO
<DATA—Recover—1>:EnddmIrecover3qmdbcity.a_pm5gintrfereup_ce11d,亡d4317249
02Q一06一0200:34:29·960[INFO
<RECOVER—INFO—1>:主n主sh主ngRecoveringsqmdb_city.a_pm5g_interfere_up_celld,tid43.
133。95·12·21一
020一06一0210:27:05·531[INFO
<RecovercomohQuerp:QueryExecuteip133.95.12.1,port5258,do”setselfg10alaudi
Oft"
020一06一0210:27:05531[INFO
<STORAGE—Recover—0>:;recoverirxfogc(sys):event土d=1170525,tablename=gbase·audit10
x185360261《133.95·12.11)dst:017588101133.95、12.1)《t
]<STORAGE—ReeOver—P>f7'《,下新esystemtable,eventid=1170525,tablename=gbase.aud:
020一06一0210:27:05“531[INFO
meth=l,forgcluster=true
133·95·12.31一
]<CLOcEResout《0>《UnLPck:gclusterdb.gc$520904581481063D88707C8一BB541D8一禹F9一55A7E
2020一06一0200:17:40·132[INFO](https://g1.cdn.gbase.cn/CommunityUploads/nKyVy7Gax4FdGFV90gvDJ/image.png)
3、确认是12.1的audit-log表损坏导致的数据同步异常
处理过程:
1、登陆12.1的数据库,修复audit-log表
>repair table gbase.audit-log;

2、修复完成后,coor集群的datastate状态恢复正常
热门帖子
- 12025-12-01浏览数:182759
- 22023-05-09浏览数:25052
- 42023-09-25浏览数:18521
- 52020-05-11浏览数:17526