ECS Fargate无法从ECR拉取镜像,任务启动失败求助
ECS任务启动失败(CannotPullContainerError)临时恢复问题排查
错误信息
CannotPullContainerError: pull image manifest has been retried 5 time(s): failed to resolve ref 709686272029.dkr.ecr.us-west-2.amazonaws.com/leo-imap-connection-manager:latest: failed to do request: Head "https://709686272029.dkr.ecr.us-west-2.amazonaws.com/v2/leo-imap-connection-manager/manifests/latest": dial tcp 52.35.2.78:443: i/o timeout Stopped: September 18, 2023 at 13:50 (UTC-4:00)
可能的临时故障原因
- ECR区域性服务临时波动:AWS ECR在us-west-2区域可能存在短暂的性能峰值、队列拥堵或隐性维护,导致镜像拉取请求超时。这类问题通常自愈,重试即可恢复,可通过AWS服务健康仪表板查看对应时间段的区域状态。
- 容器实例与ECR间的网络链路抖动:即使本地网络配置未变更,AWS内部跨AZ链路、公网路由或ISP临时故障都可能导致短时间内网络丢包、延迟升高,阻断镜像拉取请求。若使用VPC端点访问ECR,端点的ENI也可能出现临时连接异常。
- 容器实例资源临时耗尽:报错时间点容器实例的CPU、内存或网络带宽被其他运行中的任务占满,无法分配资源完成镜像拉取操作。待其他任务释放资源后,重试即可成功,可查看该实例的CloudWatch监控指标(CPU使用率、网络吞吐量)确认。
- DNS解析临时异常:DNS服务器短暂故障或解析到的ECR端点IP临时不可用,导致TCP连接超时。重试时DNS重新解析到可用IP,恢复正常拉取。
内容的提问来源于stack exchange,提问作者Encycode
相关产品推荐
相关产品推荐

