You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

关于AMD xDNA架构(RDNA、CDNA)GPU独立纹理缓存及存储位置的问询

AMD xDNA架构(RDNA/CDNA)GPU纹理缓存问题解析

核心结论

AMD RDNA与CDNA架构的GPU均配备独立的纹理缓存,纹理数据并非存储在Local Data Share(LDS)中。

具体说明

  • 从各代xDNA架构的计算单元(CU)框图可见,独立的Texture LD/ST单元、Texture Filtering单元对应配套了专属的纹理缓存层级:
    • RDNA系列:每个CU内部集成独立的L1纹理缓存,同时GPU全局层面设有统一L2缓存。纹理数据会先经过L1纹理缓存完成采样、过滤等操作,再根据需求与L2缓存交互,完全匹配纹理访问的特殊模式。
    • CDNA系列:即便主打高性能计算场景,也保留了适配计算类纹理任务的独立纹理缓存设计,保障纹理相关计算的高效数据访问。
  • 纹理缓存与LDS是完全独立的硬件资源:LDS是CU内供线程间共享通用计算数据的共享内存,而纹理缓存是针对纹理数据的地址转换、采样过滤等特性专门优化的专用缓存,二者功能定位、硬件实现完全分离。

验证思路

你可以通过测试平台对比纹理操作与通用内存操作的缓存命中延迟:纹理操作的延迟会符合专属L1纹理缓存的特性,与LDS的访问延迟存在明显差异,以此验证你捕获的缓存数据准确性。


内容的提问来源于stack exchange,提问作者MaxiMaxi

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.19 10:22:22