You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

UVM环境下重复故障成因及‘未满足请求’含义技术咨询

关于UVM中“未满足请求”与重复故障的解释

一、“未满足请求(unsatisfied requests)”的具体含义

这里的未满足请求,指的是GPU已经发起,但因触发页故障而被挂起、尚未完成的内存访问请求。在UVM的按需分页机制下,当GPU访问的虚拟地址还未完成物理内存映射,或者对应数据还未从主机端迁移到GPU端时,会触发页故障,对应的访问操作会暂停等待故障处理完成,这类暂停的请求就是“未满足请求”。

二、重复故障的生成原因

当系统中存在未处理故障(outstanding faults)(即已经触发但UVM驱动还未完成映射/数据迁移的页故障)时发起故障重放,会让GPU重新尝试执行之前被挂起的访问操作:

  • 此时原未满足请求对应的虚拟地址仍然没有完成映射或数据迁移(原故障的处理流程还在进行中),GPU再次访问该地址时,会触发完全相同的页故障。
  • 这些重复触发的故障会被UVM的故障缓冲区捕获,生成重复故障条目,进而导致UVM驱动需要按照策略额外处理这些重复项,增加了不必要的运行开销。

此外,在存在未处理故障(outstanding faults)时发起重放会导致未满足请求(unsatisfied requests)再次触发故障,在故障缓冲区(fault buffer)中生成重复故障(duplicate faults),并使UVM驱动程序根据策略进行更多处理。[3.E节:按需分页的开销] —— 摘自论文《Demystifying GPU UVM Cost with Deep Runtime and Workload Analysis》

内容的提问来源于stack exchange,提问作者kdh

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.13 20:03:16