| 显卡型号 | 核心架构 | 制程工艺 | 基础频率 | 加速频率 | 流处理 | 内存类型 | 内存频率 | 内存位宽 | TDP功耗 | ||
| NVIDIA RTX 2080 Super Mobile | Turing | 12 nm | 1365 MHz | 1560 MHz | 3072 | GDDR6 | 1750 MHz 14 Gbps |
256 bit | 150W | 详细参数>> | |
| NVIDIA RTX 4070 | Ada Lovelace | 5 nm | 1920 MHz | 2475 MHz | 5888 | GDDR6X | 1313 MHz 21 Gbps |
192 bit | 200W | 详细参数>> |
RTX 4070 在核心频率、TDP、核心数量、Tensor/Core 与 RT Core 以及显存带宽方面均显著高于 RTX 2080S Mobile。
核心频率 1920 MHz 与 2475 MHz 的 Turbo 与 1365 MHz/1560 MHz 的 2080S 相比,能够在相同负载下完成更多指令。
12 nm 2080S 与 5 nm 4070 的工艺差距导致 4070 的晶体管密度更高,单个 SM 的 L1/L2 缓存分别翻倍与扩大至 36 MB,可有效降低内存访问延迟。
3072 Shader Units 对比 5888,TMU 192 对 184(虽然 4070 少 8),但其更大 SM 数量与更宽缓存补偿了这一差距。
FP32 性能从 9.585 TFLOPS 跃升至 29.15 TFLOPS,FP16 也从 19.17 TFLOPS (2:1) 提升至 29.15 TFLOPS (1:1)。
Tensor Core 数量从 384 降至 184,意味着 4070 在某些 AI 推理工作负载中可能略逊;但在 Ray Tracing 与传统光照上,RT Core 与更高时钟可获得更快渲染。
显存侧面:8 GB GDDR6 与 256 bit/448 GB/s 对比 12 GB GDDR6X、192 bit/504 GB/s。虽然位宽略低,GDDR6X 的 21 Gbps 频率与更高带宽使 4070 在高分辨率纹理与大场景时更具优势。
跑分对比:
从游戏体验看:
选择建议:
两张卡在 DirectX、OpenGL、Vulkan 等接口兼容层相同,CUDA 版本差异(7.5 vs 8.9)意味着 4070 可使用更新的编译器与库,带来更好的 API 支持与优化。
整体而言,RTX 4070 在绝大多数性能指标与跑分上远超 RTX 2080S Mobile,适合需要更高渲染吞吐量与更大显存容量的使用场景。