IBM MQ集群对象损坏引发通道异常与磁盘耗尽问题求助
IBM MQ集群对象损坏引发通道重试与日志无法释放问题求助
环境配置
- 发送端:12个QMGR(STAT00-11),向目标集群发送消息
- 目标集群:4个QMGR,包含2个全存储库(HUB01、HUB02)、2个部分存储库(HUB03、HUB04)
问题现象
- 通道状态异常:STAT02 QMGR上指向HUB01的CLUSSDR通道进入重试状态,STAT02日志报错:
AMQ9506: Message receipt confirmation failed.
- HUB01对象损坏报错:
AMQ7472: Object %CHLBATCH.706, type scratchpad damaged.(大量重复出现)AMQ9999: Channel 'TO_HUB01' to host 'server02 (n.n.n.n)' ended abnormally.AMQ9588: Program cannot update queue manager object.(单次出现)AMQ9587: Program cannot open queue manager object(大量重复出现)
- 磁盘耗尽新问题:停止STAT02上的该CLUSSDR通道后,HUB01因采用线性日志无法释放日志文件,触发新错误:
AMQ7084: Object syncfile, type syncfile damaged.
此错误导致HUB01所在磁盘空间被占满。
已执行操作及矛盾点
- 尝试在HUB01上执行对象恢复命令:
返回结果:rcrmqobj -m HUB01 -t channel TO_STAT02AMQ7085: Object TO_STAT02, type channel not found. - 但以下命令结果与上述返回矛盾:
- 执行
DIS CLUSQMGR(STAT*) CHANNEL,输出包含TO_STAT02通道在内的所有STAT*系列QMGR列表 - 执行
DIS CHS(TO_STAT*) STATUS,显示包括TO_STAT02在内的所有通道处于RUNNING状态
- 执行
历史情况
近一个月内不同集群第二次出现此类问题,上次因磁盘耗尽导致QMGR崩溃,最终只能通过重建QMGR解决。
求有类似问题处理经验的同行提供解决思路或可行方案。
内容的提问来源于stack exchange,提问作者Craig
相关产品推荐
相关产品推荐

