GBase 8a
备份恢复
问答

恢复报错unknown error

发表于2024-09-19 10:47:35276次浏览13个评论

为提高效率,提问时请提供以下信息,问题描述清晰可优先响应。

【GBase版本】:9.5.3.28.12509af27

【操作系统】:Red Hat Enterprise Linux Server release 7.5 (Maipo)

【CPU】:4核

【问题描述】*:

恢复时报错unknow error,以下是日志信息的报错部分截图,请问如何定位这个问题以及解决办法。

评论

登录后才可以发表评论
小白591发表于 1年前
请提供:
$GCLUSTER_BASE/log/gcluster/gcrcman.log
$GBASE_BASE/log/gbase/rcman.log
两个日志中的详细报错内容
阳光爱上彩虹发表于 1年前
@小白591:$GCLUSTER_BASE/log/gcluster/gcrcman.log报错信息如下:
2024-09-18 18:06:34,492 INFO gcrcman_task.py (1624): recover read backup info ok
2024-09-18 18:06:34,493 INFO gcrcman_task.py (1646): begin recover
2024-09-18 18:06:34,494 INFO gcrcman_task.py (41): doLocalRcmanCommand begin
2024-09-18 18:06:34,497 INFO gcrcman_task.py (87): Gnode operator: /opt/gbase/192.168.35.58/gnode/server/bin/rcman -g -T 20110531000000 -Ugbase -t192.168.35.58 -pXXXXXXX -r 4 -c -C -d "/usr/local/csdu/working/dc_mnt/c7b0b4dcad794421862812740a7fa591/vc1.bigdb/GclusterData_coordinator1_node1/BackupCycle_0/gnode" -e "recover database bigdb 0 0"
2024-09-18 18:06:35,630 INFO gcrcman_br_node.py (403): node (192.168.35.61) run success
2024-09-18 18:06:36,454 INFO gcrcman_br_node.py (403): node (192.168.35.60) run success
2024-09-18 18:06:39,134 ERROR gcrcman_br_node.py (399): node (192.168.35.58) rcman : DatabaseRecover error!! nRet = -1, Error message:unknown error
2024-09-18 18:06:39,233 ERROR gcrcman_task.py (131): doLocalRcmanCommand error status: 255 sigstatus:None oristatus:65280
2024-09-18 18:06:39,234 ERROR gcrcman_task.py (1684): recover gnode data error
2024-09-18 18:06:40,238 INFO gcrcman_node.py (226): gcrcman_run finish
2024-09-18 18:06:40,363 INFO gcrcman_br_node.py (403): node (192.168.35.58) error:(GBA-01BR-0114) rcman fail to do command, please check rcman run log cmd:recover database vc1.bigdb 0 0
2024-09-18 18:06:40,379 INFO gcrcman_gcluster_process.py (72): node (192.168.35.58) error:(GBA-01BR-0114) rcman fail to do command, please check rcman run log cmd:recover database vc1.bigdb 0 0
2024-09-18 18:06:40,381 INFO gcrcman_gcluster_process.py (76): node (192.168.35.60) Recover database success
2024-09-18 18:06:40,382 INFO gcrcman_gcluster_process.py (76): node (192.168.35.61) Recover database success
阳光爱上彩虹发表于 1年前
@小白591:$GBASE_BASE/log/gbase/rcman.log报错信息如下:
阳光爱上彩虹发表于 1年前
@小白591:$GBASE_BASE/log/gbase/rcman.log报错信息如下
小白591发表于 1年前
@阳光爱上彩虹:请把执行gcrcman.py ... -e"show backup"的结果发一下
阳光爱上彩虹发表于 1年前
@小白591:不好意思啊,有问题的备份集找不到了,因为我这边也在测试修改,导致刚刚一直在还原当时的代码复现这个问题。下图最新的备份集信息,用这个备份集恢复时报错和之前发的两个日志一样,所以可以认定是同一个问题
小白591发表于 1年前
@阳光爱上彩虹:从报错信息看,192.168.35.58这个节点在执行recover操作的时候报了unknow error,192.168.35.61和60两个节点可以正常执行,需要排查192.168.35.58节点备份目录下的数据是否完整,包括备份目录的权限等信息。
可以直接在58节点上执行:
/opt/gbase/192.168.35.58/gnode/server/bin/rcman -g -T 20110531000000 -Ugbase -t192.168.35.58 -pXXXXXXX -r 4 -c -C -d "/usr/local/csdu/working/dc_mnt/c7b0b4dcad794421862812740a7fa591/vc1.bigdb/GclusterData_coordinator1_node1/BackupCycle_0/gnode" -e "recover database bigdb 0 0"
看手动执行时会输出怎样的报错
阳光爱上彩虹发表于 1年前
@小白591:好的我试试,谢谢啦
阳光爱上彩虹发表于 1年前
@小白591:-r参数无法使用,我就把这个参数去掉了,最终的结果是这样的:
WARNING: Access denied for user 'gbase'@'192.168.35.58' (using password: YES)

Welcome to the GBase backup and recovery tool.

------------------------------
Recover Database bigdb begin!
file /opt/gbase/192.168.35.58/gnode/userdata/gbase/bigdb/metadata/testtb1_n1.GED/table.info.A not exists
mmap file /usr/local/csdu/working/dc_mnt/c7b0b4dcad794421862812740a7fa591/vc1.bigdb/GclusterData_coordinator1_node1/BackupCycle_0/gnode/20240920153539.lv0/bigdb/metadata/testtb1_n1.GED/table.info.B failed: No such device
Gnode Rcman Error: DatabaseRecover error!! nRet = -1, Error message:unknown error
阳光爱上彩虹发表于 1年前
@小白591:输出信息:file /opt/gbase/192.168.35.58/gnode/userdata/gbase/bigdb/metadata/testtb1_n1.GED/table.info.A not exists
忽略,是我之前恢复失败的库没有删除导致的
阳光爱上彩虹发表于 1年前
@小白591:问题定位到了,我把权限改成777就能成功恢复。您这边暂时不用定位,辛苦您了

最佳回答
用户头像
levvel发表于 4个月前
先水一个
崔哥发表于 3个月前
杏花开了燕飞忙,正是好春光。偏是好春光,者几日、风凄雨凉。杨枝飘泊,桃根娇小,独自个思量。刚待不思量,吹一片、箫声过墙。