
英伟达新一代 AI 算力平台 Vera Rubin 已进入全面量产。基于该平台的 Vera Rubin NVL72 机柜整合 72 颗 Rubin GPU 与 36 颗 Vera CPU,采用 HBM4 显存与 NVLink 6 互联,面向“智能体 AI 工厂”场景。
代际跃升
- 官方称其 LLM 推理成本约为上代 Blackwell(GB200 NVL72)的 十分之一,训练可用四分之一的 GPU 数量完成;
- Rubin GPU 配备 HBM4 与 50 PFLOPS 的 NVFP4 Transformer Engine,专为下一代 AI 设计;
- 结合 Groq 低延迟处理器(LPU),可将大规模实时推理任务分流,提升整体吞吐。
消费端:RTX Spark 入局
在 IFA 2026 上,英伟达确认搭载 N1X SoC 的首批 RTX Spark Windows PC 将于 10 月上市。N1X 将 Grace ARM CPU 与 Blackwell GPU 整合于单芯片,CPU 与 GPU 共享最高 128GB 统一内存,主打本地 AI 与内容创作。首批设备包括联想 Yoga 二合一笔记本、宏碁紧凑型桌面机等,CUDA、TensorRT、RTX 加速等技术栈将原生支持,并对 llama.cpp、vLLM 等做了优化。
影响与解读
从数据中心到轻薄本,英伟达正把 AI 算力推进到“新一代”节点。机柜级平台让智能体时代的高并发推理更经济,而 RTX Spark 则把大模型本地运行门槛大幅拉低,有望推动个人 AI 工作站与创作本的普及。
信息来源:NVIDIA 官网、Tom’s Hardware
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

评论(0)