You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

AMD EPYC 7443网络带宽性能不及Intel Broadwell的技术排查请求

PCIe网络设备带宽基准测试性能差异分析求助

测试背景

基于osu_bw基准测试代码开展PCIe连接网络设备的带宽测试,采用通信框架传输消息,每个发送操作对应一个send request。

测试配置

  • 发送端与接收端硬件、软件配置完全一致(CPU、内存、网卡、操作系统、软件及驱动均相同)
  • 每端采用单核心单线程运行,包含预热阶段
  • 进程基于系统NUMA拓扑绑定至特定核心

异常性能现象

理论性能更优的AMD EPYC 7443系统,实测带宽比Intel E5-2680 v4低20%。

补充统计数据

发送端缓存命中情况

  • AMD EPYC 7443:cache-references为4,064,775,312,cache-misses达293,339,910,缓存miss占比7.217%
  • Intel E5-2680 v4:cache-references为2,025,418,233,cache-misses仅362,591,缓存miss占比0.018%

内存占用

  • Intel E5-2680 v4:626452K
  • AMD EPYC 7443:469760K

请求生命周期测量

通过clock()函数测量发送端每个请求从创建到完成的生命周期,采样5000个请求生成周期图;当设备资源不足时,请求会进入软件实现的等待队列。

疑问与需求

  1. Intel设备上大量请求生命周期显示为0周期,是否属于测量误差?
  2. 因CPU架构存在差异(Intel为单片式),无法明确性能差异的具体成因,请求分析性能差距的原因及优化方向。

内容的提问来源于stack exchange,提问作者Brave

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.26 18:59:55