Nginx前置AWS ALB时间歇性出现上游连接超时错误的排查求助
Nginx前置AWS ALB时间歇性出现上游连接超时错误的排查求助
大家好,我遇到一个挺棘手的间歇性问题,想请教下各位大佬。我的架构是Nginx放在AWS ALB前面,HTTP请求会先到Nginx,再转发到后端的ALB目标,具体的请求流程是这样的:
- Nginx通过
proxy_pass转发请求,比如配置是proxy_pass http://service.example.internal - DNS解析
service.example.internal,这个域名是Route 53托管区里定义的CNAME,指向AWS ALB的域名 - ALB绑定了三个弹性网卡,所以DNS解析后会得到三个IP地址,比如:10.192.10.75、10.192.11.133、10.192.10.45
- Nginx会随机挑选其中一个IP发起连接
但现在的问题是,会间歇性出现连接失败的情况,Nginx日志里会生成类似这样的错误:
[error] 41#41: *32767409 upstream timed out (110: Operation timed out) while connecting to upstream, client: 10.128.73.156, server: *.example.com, request: "GET /api/v1.0/example HTTP/1.1", upstream: "...
我现在搞不清楚为什么会间歇性出现这种超时,有没有大佬遇到过类似的情况,或者能给点排查方向的建议?谢谢大家!
备注:内容来源于stack exchange,提问作者Sunny Chen
相关产品推荐
相关产品推荐

