| 显卡型号 | 核心架构 | 制程工艺 | 基础频率 | 加速频率 | 流处理 | 内存类型 | 内存频率 | 内存位宽 | TDP功耗 | ||
| NVIDIA RTX 2080 Ti | Turing | 12 nm | 1350 MHz | 1545 MHz | 4352 | GDDR6 | 1750 MHz 14 Gbps |
352 bit | 250W | 详细参数>> | |
| NVIDIA GTX 1070 | Pascal | 16 nm | 1506 MHz | 1683 MHz | 1920 | GDDR5 | 2002 MHz 8 Gbps |
256 bit | 150W | 详细参数>> |
核心计算单元方面,2080 Ti 的 GPU 计算能力和并行度远高于1070。核心数从1920提升到4352,SM 数量从15增至68,L2 缓存由2 MB扩展到5.5 MB,L1 缓存从48 KB提升到64 KB。FP32 单精度算力从6.463 TFLOPS升至13.45 TFLOPS,FP16 双精度同理。纹理单元(TMU)从120增至272,像素和纹理处理速率分别提升约27 %和104 %。显存方面,2080 Ti 配备11 GB GDDR6,位宽352 bit,带宽达616 GB/s,显存容量和频宽都大幅超过1070 的8 GB GDDR5、256 bit、256 GB/s。TDP 由150 W提升到250 W,说明其功耗与性能同涨。
在基准测试中,2080 Ti 在各项 3DMark 指标均超过1070。Time Spy、Fire Strike、Ice Storm 等分数差距通常在两倍以上;在计算型基准(如 Autolykos、CuckooCycle、DaggerHashimoto 等)中,2080 Ti 的算力亦为 1070 的两倍左右。OpenGL Cinebench R15 也表现出约17 % 的提升。
从实际使用场景看:
高分辨率游戏:如果目标是 4K 或 1440 p 高帧率游戏,尤其开启光线追踪或使用 DLSS,2080 Ti 能提供足够的 CUDA 核心与显存宽带来保持 60 fps 以上。1070 在 1080 p 下表现尚可,但在 1440 p 或开启光线追踪时会明显下降。
专业工作负载:在 3D 渲染、视频后期、机器学习训练等需要大量浮点运算或大显存的工作场景,2080 Ti 的算力和显存优势能显著缩短渲染时间或提升批处理效率。1070 在此类任务中同样可用,但完成时间会更长。
日常和轻度游戏:若预算或功耗是主要考虑,1070 在 1080 p 的大部分现代游戏中已足够畅玩,且功耗仅为 150 W,电源需求相对较低。2080 Ti 由于更高的功耗和热量,要求更强的电源和散热。
未来兼容性:2080 Ti 支持 DirectX 12 Ultimate、CUDA 7.5 以及更高的 Shader Model;1070 仅到 DirectX 12 及 CUDA 6.1。对需要使用最新 API 或 CUDA 功能的开发者而言,2080 Ti 更具优势。
综上,若追求顶级游戏体验、需要光线追踪、或从事计算密集型工作,2080 Ti 的更高算力、显存和 API 支持是关键优势;若以 1080 p 游戏为主,功耗更低且成本相对可控,1070 仍能满足日常需求。