完整的AD102核心
RTX 4070 Ti使用的AD104核心
RTX 4070使用的AD104核心
本次RTX 4070使用了AD104芯片,采用了4组GPC,其中1组少了1组TPC,并且NVENC单元变为2个。
另外可以看到本次RTX 40系显卡的L2缓存都占比较大,其实也是有意为之。
这张RTX 4070的L2缓存为36MB,而上一代RTX 3070 Ti为4MB,达到了9倍的差距。增加L2缓存的大小可以提高性能,降低延迟,并提高续航时长,数据访问在GPU上即可完成(否则GPU就要频繁从显存读取数据,过分依赖显存带宽)。所以,这也是为什么在RTX 40系显卡中,位宽带宽普遍偏小的原因。
其实根据完整的架构图就能看出,此次Ada架构整体结构性的改动并不大,这一点从SM单元便能清晰印证,同样的FP32 CUDA核心,同样的FP32/INT32混合CUDA核心,同样的L1级缓存等等。当然,每个SM单元内部的Tensor Core升级为第四代。