RTX 5090 Mobile 与 RTX 3090Ti 在核心频率、纹理单元与光栅单元等单元参数上几乎相同,但前者采用 4 nm Blackwell 2.0 工艺,后者为 8 nm Ampere。
- 频率与算力:3090Ti 的核心频率高达 1560 MHz,Turbo 1860 MHz;5090 Mobile 为 990 MHz/1515 MHz。单精度 FP32 计算力分别为 40 TFLOPS 与 31.8 TFLOPS。
- SM 与缓存:5090 Mobile 82 SM、L1 128 KB、L2 64 MB;3090Ti 84 SM、L1 128 KB、L2 6 MB。后者 L2 缓存较小,但 4 nm 工艺使晶体管密度大幅提升。
- 显存:两款均配 24 GB;5090 Mobile 采用 GDDR7 2000 MHz、256 bit 位宽;3090Ti 采用 GDDR6X 1313 MHz、384 bit 位宽。带宽分别为 1.02 TB/s 与 1.01 TB/s,差距可忽略。
- TDP 与功耗:5090 Mobile 95 W;3090Ti 450 W,后者需要 16‑pin 电源。
3DMark 基准
- Time Spy:5090 Mobile 24483 > 21645;说明在 DirectX 12 场景下,移动版在多线程与异步计算优化上更好。
- Ice Storm Unlimited/Extreme:5090 Mobile 分别 849 431 / 588 672,高于 564 087 / 444 102,表明其在轻量级跨平台渲染中占优。
- Fire Strike Standard/Graphics:5090 Mobile 38990 / 50816,略低于 3090Ti 36563 / 53110,显示在传统 DirectX 11 负载下桌面版仍有一定优势。
- Cloud Gate:5090 Mobile 72337 < 75753;在低功耗集成显卡环境中桌面版更强。
- Wild Life Unlimited:5090 Mobile 153 090 > 118 439,移动平台表现更好。
真实使用场景
- 高分辨率游戏:在 4K/144 Hz 的 PC 游戏里,3090Ti 的更高频率与更宽的显存总线可提供更稳定的帧率;5090 Mobile 在 1080p‑1440p 级别游戏中已能接近桌面性能,并且功耗仅 95 W,适合轻薄本。
- 内容创作:两款显存容量相同,但 3090Ti 的 384 bit 位宽与更高频率可在 3D 渲染、视频后期中略占优势;5090 Mobile 由于 GDDR7 的更高数据率,纹理加载速度更快。
- 专业工作站:3090Ti 支持更高的 CUDA 版本(8.6)与更大显存带宽,对大规模并行计算与科学仿真更友好;5090 Mobile 的 CUDA 10.1 与 4 nm 工艺在功耗受限的移动工作站上更为合适。
选型建议
- 需要桌面级显卡并且能接受高功耗、占用空间:3090Ti 仍是更具竞争力的选择。
- 需在笔记本或轻薄机型中实现高性能游戏与创作:5090 Mobile 在功耗与散热方面更具优势,且在大多数现代游戏基准中表现不落后。
- 对 API 兼容性与未来适配性有更高要求:5090 Mobile 支持 Vulkan 1.4 与最新 DirectX 12 feature‑level,架构更前瞻。
- 对 CUDA 版本或专业软件兼容性有严格要求:3090Ti 的 CUDA 8.6 与成熟驱动生态在专业软件中更为成熟。
综上,两款显卡在不同应用场景与功耗要求下各有优势,选型时需重点考虑使用平台、功耗限制以及对新技术的需求。