芯片目录 · 产品指南

英伟达产品体系全览:从RTX 5090到Rubin机柜

数据中心、消费级、专业卡、汽车机器人、网络软件五条线。每类产品是什么、干什么、多少钱,一篇对齐

2026-09-11NVIDIA · 全栈算力含价格速查

00总览:五条产品线

英伟达在售产品按客户和形态分成五条线。

英伟达的产品目录比"显卡公司"这个印象长得多。把2026年在售的产品摊开,是五条线:数据中心GPU与整机、消费级GeForce、专业卡RTX PRO、汽车与机器人芯片、网络设备与软件栈。

五条线各管一段:GeForce卖给玩家和创作者,出货量最大;数据中心GPU卖给云厂商和AI实验室,是营收主力;RTX PRO装进工作站和企业的推理服务器;DRIVE和Jetson装进汽车与机器人;网络和软件(NVLink、InfiniBand、CUDA)把前面所有硬件连起来、跑起来。

看懂整个体系,抓两条线索就够。一条是架构代际——数据中心芯片以科学家命名,Hopper、Blackwell、Rubin、Feynman,一年一代往下走。另一条是产品形态——从单卡到8卡服务器,再到72卡液冷机柜,越往上越"当一块GPU用"。

01数据中心:架构演进

四代架构的规格与状态。

英伟达的数据中心GPU一年一代,当前节奏是:Hopper(2022)→ Blackwell(2024)→ Vera Rubin(2026下半年量产)→ Feynman(2028,预研)。

Blackwell是当前量产主力。B200单卡2080亿晶体管、192GB HBM3e显存;GB300(Blackwell Ultra)是这一代的增强版。云厂商和AI实验室正在大规模部署。

Vera Rubin刚进入量产。Rubin GPU为3360亿晶体管、288GB HBM4(带宽22TB/s)、第六代NVLink(单向3.6TB/s)。官方公布的对比口径基于GB200 NVL72:训练同等规模的MoE模型只需四分之一的GPU数量,推理每百万Token成本降到十分之一。

Feynman是2028年的预研方向:台积电1.6nm A16工艺、背面供电、硅光互联。

架构代表产品晶体管显存互联状态
HopperH100 / H200800亿80GB HBM3 / 141GB HBM3eNVLink 4上一代,存量部署
BlackwellB200 / GB200 / GB3002080亿192GB HBM3eNVLink 5(1.8TB/s)当前量产主力
Vera RubinRubin GPU + Vera CPU3360亿288GB HBM4(22TB/s)NVLink 6(3.6TB/s)2026下半年量产
Feynman硅光互联2028预研,1.6nm

02数据中心:产品形态阶梯

HGX、DGX、NVL72——三种打包方式,一级比一级大。

单颗GPU之外,英伟达卖三种"打包方式"。

HGX是8颗GPU组成的基板,加上NVLink交换,卖给浪潮、超微、戴尔这类服务器厂商,由它们组装成整机。同一块HGX B200基板,不同厂商能做出不同型号的服务器。

DGX是英伟达自己的整机:GPU、软件栈、散热装好,开箱即用,面向不想自己集成的大企业。

NVL72是机柜级产品:72颗GPU加36颗CPU,全液冷,整柜通过NVLink连成一个计算域。GB200 NVL72、GB300 NVL72、Vera Rubin NVL72是这个形态的三代产品。官方的说法是,这72颗GPU"作为一块巨型GPU运行"。

机柜里的芯片不止GPU。以Vera Rubin平台为例,一个完整系统有七颗芯片协同:Rubin GPU、Vera CPU(88核)、NVLink 6交换芯片、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6以太网交换芯片,以及与Groq合作设计的LPX推理加速器——纯SRAM架构,专攻低延迟长上下文推理。

采购规模可以参考日本:政府和产业界联合启动的国家级AI基础设施,由Noetra公司运营的AI工厂将部署13,750颗Vera CPU和27,500颗Rubin GPU。

形态构成面向对象
HGX8卡基板 + NVLink交换服务器厂商(OEM/ODM)
DGX整机,含软件栈企业,开箱即用
NVL7272 GPU + 36 CPU 液冷机柜云厂商、AI工厂
MGX模块化参考设计80+生态伙伴快速出机型

03消费级:GeForce RTX 50

Blackwell架构,从5090到5050七档。

消费级这条线最好认:GeForce RTX 50系列,Blackwell架构,从5090到5050七档。数字越大越强,Ti是同数字的加强版。

这一代的共同配置:GDDR7显存、第五代Tensor Core、第四代光追核心,支持DLSS 5(含动态多帧生成)。用途也不限于游戏——本地跑Stable Diffusion、微调小模型、视频剪辑导出,用的也是同一批卡。

型号CUDA核心显存显存带宽首发建议价
RTX 5090 D v22176024GB GDDR71344GB/s16499元
RTX 50801075216GB GDDR7960GB/s8299元
RTX 5070 Ti896016GB GDDR7896GB/s7299元
RTX 5070614412GB GDDR7672GB/s4899元
RTX 5060 Ti460816 / 8GB GDDR7448GB/s3599 / 3199元
RTX 506038408GB GDDR7448GB/s2999元
RTX 505025608GB GDDR6320GB/s2199元
价格口径
表中为国内首发建议价。国内行货旗舰为5090 D v2(24GB);海外版RTX 5090为32GB、512-bit。2026年9月的实际零售价明显更高:显存涨价沿产业链传导,据媒体报道,华强北RTX 5060 Ti 8GB报约3400元,5090系列约3.5万元——用一位商户的话说,"写不了报价单,一天一个价"。购买以渠道现货为准。

04专业卡:RTX PRO

同样的Blackwell,更大的显存、认证驱动、虚拟化切分。

专业卡和GeForce用同样的架构,差别在三处:显存更大且带ECC;驱动经过ISV认证(CAD、DCC软件厂商逐一验证);支持多卡扩展和MIG切分——一块卡可以划成多个虚拟GPU,分给不同的虚拟机。

产品按使用位置分两类。Workstation Edition装进工作站,涡轮散热、注重静音,跑CAD、三维创作、渲染;Server Edition装进服务器,多卡并行,跑AI推理、可视化云桌面、视频流。

型号显存形态典型用途
RTX PRO 6000 Blackwell96GB GDDR7 ECC工作站 / 服务器本地大模型推理、渲染、数据科学
RTX PRO 5000 Blackwell48GB工作站三维创作、渲染、AI辅助设计
RTX PRO 4500 Blackwell32GB工作站 / 服务器中端工作站、企业多负载
RTX PRO 4000 Blackwell24GB工作站入门专业卡
RTX PRO 3000 Blackwell16GB移动工作站笔记本工作站

专业卡走OEM和渠道销售,无统一零售价,以经销商报价为准。

05汽车与机器人

DRIVE、Jetson两条硬件线,加配套模型。

汽车和机器人是一条独立的嵌入式产品线。

DRIVE是自动驾驶计算平台:Orin(254 TOPS)是上一代主力,仍在大量装车;Thor是当前旗舰,2000 TOPS,定位L4/L5中央计算——一颗芯片接管智驾、座舱和泊车。小鹏、理想等车企已宣布采用。

Jetson是机器人与边缘设备的模组:Thor模组面向人形机器人和机械臂,Orin NX/Nano面向小型机器人和边缘盒子。

芯片之上还有配套模型:Isaac GR00T是人形机器人基础模型,Cosmos是物理AI世界模型,两者配合Omniverse做仿真训练。

产品算力 / 规格用途
DRIVE Thor2000 TOPSL4/L5自动驾驶中央计算
DRIVE Orin254 TOPS主流量产车智能驾驶
Jetson Thor2070 TFLOPS(FP4)人形机器人、机械臂
Jetson Orin NX100 TOPS小型机器人、AMR
Jetson Orin Nano Super67 TOPS入门边缘AI盒子
Isaac GR00T基础模型人形机器人视觉-语言-动作

06网络与软件栈

把GPU连成集群靠网络,把开发者留住靠软件。

网络分三层。机柜内:NVLink 6(每GPU单向3.6TB/s)通过NVLink交换芯片互联。集群间:Quantum-X800 InfiniBand或Spectrum-X/Spectrum-6以太网,最新一代采用共封装光学。节点上:ConnectX-9 SuperNIC(1.6Tb/s)负责数据进出,BlueField-4 DPU卸载网络、存储和安全任务。

软件栈的名字更常见:CUDA是GPU编程基础;TensorRT负责推理加速;NeMo是训练框架;Omniverse做数字孪生和工业仿真;NIM把模型打包成可部署的微服务。对企业客户,这些打包在NVIDIA AI Enterprise订阅里。

层级产品规格 / 作用
机柜内互联NVLink 63.6TB/s,72卡连成一个计算域
集群互联Quantum-X800 / Spectrum-6InfiniBand / 以太网,共封装光学
网卡ConnectX-9 SuperNIC1.6Tb/s,GPU直连网络
DPUBlueField-4卸载网络、存储、安全
编程CUDAGPU编程基础
推理TensorRT推理加速与部署
训练NeMo大模型训练框架
仿真Omniverse数字孪生、工业仿真
部署NIM模型打包成微服务

07场景速查

按需求找产品。

需求对应产品
打游戏、装家用机GeForce RTX 5060 – 5080
4K高刷、本地跑大模型、AI绘图RTX 5090 D v2
工作站(CAD / 渲染 / 剪辑)RTX PRO 5000 / 6000 Workstation
企业AI推理、可视化云桌面RTX PRO 6000 Server Edition
大模型训练、AI工厂HGX / DGX / NVL72
机器人、边缘设备Jetson Orin / Thor
自动驾驶DRIVE Orin / Thor
数字孪生、工业仿真Omniverse + RTX PRO

型号每年都在换:Blackwell正在出货,Rubin刚进量产,Feynman已经在路上。但产品体系的骨架这几年没有大变——五条线,各管一段。下次在新闻里看到GB300、Rubin NVL72或者Thor,能立刻对上它在体系里的位置,这篇文章的任务就完成了。