数据中心、消费级、专业卡、汽车机器人、网络软件五条线。每类产品是什么、干什么、多少钱,一篇对齐
英伟达在售产品按客户和形态分成五条线。
英伟达的产品目录比"显卡公司"这个印象长得多。把2026年在售的产品摊开,是五条线:数据中心GPU与整机、消费级GeForce、专业卡RTX PRO、汽车与机器人芯片、网络设备与软件栈。
五条线各管一段:GeForce卖给玩家和创作者,出货量最大;数据中心GPU卖给云厂商和AI实验室,是营收主力;RTX PRO装进工作站和企业的推理服务器;DRIVE和Jetson装进汽车与机器人;网络和软件(NVLink、InfiniBand、CUDA)把前面所有硬件连起来、跑起来。
看懂整个体系,抓两条线索就够。一条是架构代际——数据中心芯片以科学家命名,Hopper、Blackwell、Rubin、Feynman,一年一代往下走。另一条是产品形态——从单卡到8卡服务器,再到72卡液冷机柜,越往上越"当一块GPU用"。
四代架构的规格与状态。
英伟达的数据中心GPU一年一代,当前节奏是:Hopper(2022)→ Blackwell(2024)→ Vera Rubin(2026下半年量产)→ Feynman(2028,预研)。
Blackwell是当前量产主力。B200单卡2080亿晶体管、192GB HBM3e显存;GB300(Blackwell Ultra)是这一代的增强版。云厂商和AI实验室正在大规模部署。
Vera Rubin刚进入量产。Rubin GPU为3360亿晶体管、288GB HBM4(带宽22TB/s)、第六代NVLink(单向3.6TB/s)。官方公布的对比口径基于GB200 NVL72:训练同等规模的MoE模型只需四分之一的GPU数量,推理每百万Token成本降到十分之一。
Feynman是2028年的预研方向:台积电1.6nm A16工艺、背面供电、硅光互联。
| 架构 | 代表产品 | 晶体管 | 显存 | 互联 | 状态 |
|---|---|---|---|---|---|
| Hopper | H100 / H200 | 800亿 | 80GB HBM3 / 141GB HBM3e | NVLink 4 | 上一代,存量部署 |
| Blackwell | B200 / GB200 / GB300 | 2080亿 | 192GB HBM3e | NVLink 5(1.8TB/s) | 当前量产主力 |
| Vera Rubin | Rubin GPU + Vera CPU | 3360亿 | 288GB HBM4(22TB/s) | NVLink 6(3.6TB/s) | 2026下半年量产 |
| Feynman | — | — | — | 硅光互联 | 2028预研,1.6nm |
HGX、DGX、NVL72——三种打包方式,一级比一级大。
单颗GPU之外,英伟达卖三种"打包方式"。
HGX是8颗GPU组成的基板,加上NVLink交换,卖给浪潮、超微、戴尔这类服务器厂商,由它们组装成整机。同一块HGX B200基板,不同厂商能做出不同型号的服务器。
DGX是英伟达自己的整机:GPU、软件栈、散热装好,开箱即用,面向不想自己集成的大企业。
NVL72是机柜级产品:72颗GPU加36颗CPU,全液冷,整柜通过NVLink连成一个计算域。GB200 NVL72、GB300 NVL72、Vera Rubin NVL72是这个形态的三代产品。官方的说法是,这72颗GPU"作为一块巨型GPU运行"。
机柜里的芯片不止GPU。以Vera Rubin平台为例,一个完整系统有七颗芯片协同:Rubin GPU、Vera CPU(88核)、NVLink 6交换芯片、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6以太网交换芯片,以及与Groq合作设计的LPX推理加速器——纯SRAM架构,专攻低延迟长上下文推理。
采购规模可以参考日本:政府和产业界联合启动的国家级AI基础设施,由Noetra公司运营的AI工厂将部署13,750颗Vera CPU和27,500颗Rubin GPU。
| 形态 | 构成 | 面向对象 |
|---|---|---|
| HGX | 8卡基板 + NVLink交换 | 服务器厂商(OEM/ODM) |
| DGX | 整机,含软件栈 | 企业,开箱即用 |
| NVL72 | 72 GPU + 36 CPU 液冷机柜 | 云厂商、AI工厂 |
| MGX | 模块化参考设计 | 80+生态伙伴快速出机型 |
Blackwell架构,从5090到5050七档。
消费级这条线最好认:GeForce RTX 50系列,Blackwell架构,从5090到5050七档。数字越大越强,Ti是同数字的加强版。
这一代的共同配置:GDDR7显存、第五代Tensor Core、第四代光追核心,支持DLSS 5(含动态多帧生成)。用途也不限于游戏——本地跑Stable Diffusion、微调小模型、视频剪辑导出,用的也是同一批卡。
| 型号 | CUDA核心 | 显存 | 显存带宽 | 首发建议价 |
|---|---|---|---|---|
| RTX 5090 D v2 | 21760 | 24GB GDDR7 | 1344GB/s | 16499元 |
| RTX 5080 | 10752 | 16GB GDDR7 | 960GB/s | 8299元 |
| RTX 5070 Ti | 8960 | 16GB GDDR7 | 896GB/s | 7299元 |
| RTX 5070 | 6144 | 12GB GDDR7 | 672GB/s | 4899元 |
| RTX 5060 Ti | 4608 | 16 / 8GB GDDR7 | 448GB/s | 3599 / 3199元 |
| RTX 5060 | 3840 | 8GB GDDR7 | 448GB/s | 2999元 |
| RTX 5050 | 2560 | 8GB GDDR6 | 320GB/s | 2199元 |
同样的Blackwell,更大的显存、认证驱动、虚拟化切分。
专业卡和GeForce用同样的架构,差别在三处:显存更大且带ECC;驱动经过ISV认证(CAD、DCC软件厂商逐一验证);支持多卡扩展和MIG切分——一块卡可以划成多个虚拟GPU,分给不同的虚拟机。
产品按使用位置分两类。Workstation Edition装进工作站,涡轮散热、注重静音,跑CAD、三维创作、渲染;Server Edition装进服务器,多卡并行,跑AI推理、可视化云桌面、视频流。
| 型号 | 显存 | 形态 | 典型用途 |
|---|---|---|---|
| RTX PRO 6000 Blackwell | 96GB GDDR7 ECC | 工作站 / 服务器 | 本地大模型推理、渲染、数据科学 |
| RTX PRO 5000 Blackwell | 48GB | 工作站 | 三维创作、渲染、AI辅助设计 |
| RTX PRO 4500 Blackwell | 32GB | 工作站 / 服务器 | 中端工作站、企业多负载 |
| RTX PRO 4000 Blackwell | 24GB | 工作站 | 入门专业卡 |
| RTX PRO 3000 Blackwell | 16GB | 移动工作站 | 笔记本工作站 |
专业卡走OEM和渠道销售,无统一零售价,以经销商报价为准。
DRIVE、Jetson两条硬件线,加配套模型。
汽车和机器人是一条独立的嵌入式产品线。
DRIVE是自动驾驶计算平台:Orin(254 TOPS)是上一代主力,仍在大量装车;Thor是当前旗舰,2000 TOPS,定位L4/L5中央计算——一颗芯片接管智驾、座舱和泊车。小鹏、理想等车企已宣布采用。
Jetson是机器人与边缘设备的模组:Thor模组面向人形机器人和机械臂,Orin NX/Nano面向小型机器人和边缘盒子。
芯片之上还有配套模型:Isaac GR00T是人形机器人基础模型,Cosmos是物理AI世界模型,两者配合Omniverse做仿真训练。
| 产品 | 算力 / 规格 | 用途 |
|---|---|---|
| DRIVE Thor | 2000 TOPS | L4/L5自动驾驶中央计算 |
| DRIVE Orin | 254 TOPS | 主流量产车智能驾驶 |
| Jetson Thor | 2070 TFLOPS(FP4) | 人形机器人、机械臂 |
| Jetson Orin NX | 100 TOPS | 小型机器人、AMR |
| Jetson Orin Nano Super | 67 TOPS | 入门边缘AI盒子 |
| Isaac GR00T | 基础模型 | 人形机器人视觉-语言-动作 |
把GPU连成集群靠网络,把开发者留住靠软件。
网络分三层。机柜内:NVLink 6(每GPU单向3.6TB/s)通过NVLink交换芯片互联。集群间:Quantum-X800 InfiniBand或Spectrum-X/Spectrum-6以太网,最新一代采用共封装光学。节点上:ConnectX-9 SuperNIC(1.6Tb/s)负责数据进出,BlueField-4 DPU卸载网络、存储和安全任务。
软件栈的名字更常见:CUDA是GPU编程基础;TensorRT负责推理加速;NeMo是训练框架;Omniverse做数字孪生和工业仿真;NIM把模型打包成可部署的微服务。对企业客户,这些打包在NVIDIA AI Enterprise订阅里。
| 层级 | 产品 | 规格 / 作用 |
|---|---|---|
| 机柜内互联 | NVLink 6 | 3.6TB/s,72卡连成一个计算域 |
| 集群互联 | Quantum-X800 / Spectrum-6 | InfiniBand / 以太网,共封装光学 |
| 网卡 | ConnectX-9 SuperNIC | 1.6Tb/s,GPU直连网络 |
| DPU | BlueField-4 | 卸载网络、存储、安全 |
| 编程 | CUDA | GPU编程基础 |
| 推理 | TensorRT | 推理加速与部署 |
| 训练 | NeMo | 大模型训练框架 |
| 仿真 | Omniverse | 数字孪生、工业仿真 |
| 部署 | NIM | 模型打包成微服务 |
按需求找产品。
| 需求 | 对应产品 |
|---|---|
| 打游戏、装家用机 | GeForce RTX 5060 – 5080 |
| 4K高刷、本地跑大模型、AI绘图 | RTX 5090 D v2 |
| 工作站(CAD / 渲染 / 剪辑) | RTX PRO 5000 / 6000 Workstation |
| 企业AI推理、可视化云桌面 | RTX PRO 6000 Server Edition |
| 大模型训练、AI工厂 | HGX / DGX / NVL72 |
| 机器人、边缘设备 | Jetson Orin / Thor |
| 自动驾驶 | DRIVE Orin / Thor |
| 数字孪生、工业仿真 | Omniverse + RTX PRO |
型号每年都在换:Blackwell正在出货,Rubin刚进量产,Feynman已经在路上。但产品体系的骨架这几年没有大变——五条线,各管一段。下次在新闻里看到GB300、Rubin NVL72或者Thor,能立刻对上它在体系里的位置,这篇文章的任务就完成了。