程序Checkpoint持续超时失败求助:调整并行度未解决问题
Flink Checkpoint 超时故障排查求助
- 程序初始运行正常,但运行数小时或数天后会出现Checkpoint超时失败
- 未检测到Backpressure效应,数据分配平衡,JobManager和TaskManager运行状态均正常
- 多次重启作业,始终出现operator subTask_id:9的Checkpoint问题
更新记录:
- 将并行度从40调整至60后,作业前18小时运行正常,随后再次出现Checkpoint问题(涉及subTask_id:13、18),30次Checkpoint失败后出现Backpressure效应
- 今日将并行度设置为10,问题仍未解决
相关截图:







内容的提问来源于stack exchange,提问作者Viacheslav Ryabchikov
相关产品推荐
相关产品推荐

