AWS ECS Fargate任务出站流量节流导致本地服务器调用超时问题排查求助
AWS ECS Fargate任务出站流量节流导致本地服务器调用超时问题排查求助
各位大佬好,想请教一个卡了好久没头绪的问题:
我这边有个部署在AWS ECS Fargate上的.NET API应用任务,这个任务需要调用我们本地机房的服务器。ECS任务放在VPC的私有子网里,通过中转网关(Transit Gateway)和本地服务器打通网络。
为了简化测试场景,我们直接用任务的私有IP发起调用测试。当调用量很少的时候,任务都能正常响应,调用本地服务器也没毛病。但当我们把虚拟用户加到200个、启动性能压测之后,大概过了一分钟,任务向本地服务器发起的内部调用就开始频繁超时了——正常这个调用只需要3秒,我们设置的超时时间是1分钟,按道理完全够处理的。
目前我们观察到几个关键点:
- 应用日志里能看到明确的超时错误,一部分请求能成功处理,但另一部分直接因为超时失败。
- 我们查了本地服务器的日志,确认那些超时失败的请求根本没传到本地服务器上,说明问题应该出在Fargate任务到本地服务器的网络传输环节,不是本地服务器处理不过来。
想问问有没有大佬遇到过类似的情况?或者有没有什么排查方向可以推荐?比如Fargate本身有没有出站连接数的限制?中转网关会不会有节流配置?或者VPC私有子网的网络ACL、安全组有没有什么容易忽略的限制?
备注:内容来源于stack exchange,提问作者leonsPAPA
相关产品推荐
相关产品推荐

