CUDA计算能力8.6架构是否支持FP64张量核操作?
关于CUDA编程指南中FP64张量核支持的冲突解释
这个矛盾其实是文档宽泛描述和硬件产品线细分的差异导致的:
- 计算能力8.0对应Ampere架构的数据中心级设备(比如A100),这类硬件确实支持FP64张量核,所以5.4.11.3章节里“8.0及以上支持FP64张量核”的说法,本质是针对该架构下具备完整张量核能力的型号。
- 而计算能力8.6对应Ampere架构的消费级设备(比如RTX 30系列),这类硬件出厂时阉割了FP64张量核的支持,所以表33里没有标注它支持FP64输入。
CUDA文档的章节描述有时会用宽泛的架构版本范围,但具体硬件的支持能力,永远以**计算能力对应的张量核数据类型表(即你提到的表33)**为准,这是最精准的参考依据。
内容的提问来源于stack exchange,提问作者StackMonkey
相关产品推荐
相关产品推荐

