You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Google Cloud Platform负载均衡器后端利用率达500%致业务异常求助

针对Google Load Balancer后端负载500%但实例资源正常的排查建议

我之前碰到过类似的情况,当时折腾了好一阵才找到原因,给你几个实际可行的排查方向试试:

  • 检查后端健康检查配置
    有时候Google LB的健康检查规则会和实际后端服务不匹配,导致LB误判实例状态,进而引发流量分配异常。比如健康检查的端口、路径设置错误,或者超时阈值过短,LB会反复尝试连接后端,累积大量无效请求,最终显示出离谱的负载百分比。你可以先去LB的后端详情里查看健康检查状态,确认两台pfSense实例是否都被标记为健康,同时检查健康检查请求的响应码是否符合预期(比如200 OK)。

  • 排查pfSense的端口转发/NAT规则
    因为Web服务器部署在pfSense之后,LB的流量需要通过pfSense转发到后端Web服务。如果pfSense的转发规则存在问题——比如端口映射错误、连接数限制过低,或者防火墙规则拦截了LB的请求——LB会因为连接无法正常建立而累积大量半开连接,导致它统计的负载飙升,但pfSense本身的CPU、内存资源可能还处于正常水平。你可以登录pfSense后台,查看「状态->防火墙->连接数」,看看是否有大量来自LB IP段的异常连接,同时检查转发规则的运行状态。

  • 验证会话保持配置
    如果LB开启了会话保持(比如基于客户端IP的粘性会话),且超时时间设置过长,可能导致大量请求被绑定到同一台pfSense实例,虽然pfSense会把流量转发到多台Web服务器,但LB统计的是到pfSense的连接数,从而显示负载过高。你可以检查LB的会话保持设置,尝试临时关闭粘性会话,看看负载百分比是否恢复正常。

  • 分析LB的请求日志
    去Google Cloud Logging里搜索LB的请求日志,筛选出异常请求(比如5xx响应码、被拒绝的请求)。我之前遇到过大量恶意扫描请求打到LB,pfSense的防火墙拦截了这些请求,但LB仍将其计入负载统计,导致面板显示负载异常,但实例资源消耗很低。通过日志可以快速定位这类问题。

  • 尝试刷新后端服务注册
    有时候LB的统计数据会出现缓存或bug,尝试将两台pfSense实例从后端服务中临时移除,等待几分钟后重新添加,或者重启pfSense的防火墙/转发服务,说不定能刷新LB的统计数据,恢复正常负载显示。


内容的提问来源于stack exchange,提问作者Andrea A.

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.07 00:13:11