跳到内容
视角姬
记录

NVIDIA Ada 与 Blackwell:Tensor、光流与 DLSS 实现记录

架构 NVIDIA DLSS Tensor

Ada(RTX 40)和 Blackwell(RTX 50)是本站独立显卡榜上的两条主架构。研究记录只写「能调到的单元」和「驱动封装」,不写营销代际形容词。

单元

  • CUDA Core:通用超分 / 插帧(PyTorch、NCNN)。
  • Tensor Core:INT8/FP8/FP16 矩阵。Real-ESRGAN、RIFE TensorRT 走这里。
  • Optical Flow Accelerator:硬件光流。DLSS 3 帧生成依赖它;RIFE 默认并不调用 OFA。
  • NVENC / NVDEC:编解码。AV1 从 Ada 消费级开始完整。超分管线若绕开 NVDEC 改走 CPU 解码,记录里要标明。

DLSS 与研究管线的边界

DLSS 超分辨率和帧生成是游戏运行时效果,输入是运动向量、深度、曝光。把它们的画质拿去对比 Real-ESRGAN 放大一张 PNG,没有意义。

研究侧可复现的接口:

  1. TensorRT 导出超分 / 插帧引擎。
  2. Optical Flow SDK 取硬件光流,再自己 warp。
  3. Video Super Resolution / Maxine 一类 SDK(许可与场景另记)。

Blackwell 的多帧生成(MFG)是模型生成多张中间帧,不是 OFA 简单加倍。延迟和伪影模式与 Ada FG 不同,对照实验要锁驱动版本。

和榜的关系

Time Spy 几乎不吃 Tensor 和 OFA。一张卡 Time Spy 高,不代表 RIFE 快。本站把 3DMark 和「超分/插帧吞吐」分成两张表,避免用游戏光栅分数代替研究负载。