在2026年COMPUTEX期间举办的NVIDIA GTC Taipei大会上,英伟达创始人兼CEO黄仁勋发表了主题演讲。与三个月前聚焦于“芯片全家桶”和“算力全家桶”的系统级解决方案不同,本次大会的核心议题转向了这些基础设施将服务的终极目标——Agent。

黄仁勋指出,Agent AI和实用型人工智能时代已经来临。他强调,Token已成为新的利润单位,AI则是GDP的“生成器”。他反驳了AI减少工作岗位的观点,认为实际上软件工程师的需求正在增加。

Vera Rubin:专为Agent任务优化的AI工厂

Vera Rubin平台已全面进入量产阶段。与上一代主要服务于大模型训练和推理不同,Vera Rubin从设计之初就将Agent视为核心工作负载。一个典型的Agent任务包含推理、搜索、工具调用、代码执行和结果验证等多个环节,涉及数千个步骤。未来数据中心需要处理的是大量持续运行、相互协作的Agent任务。

该平台被定义为一个巨大的、统一的计算单元级AI超级计算机。在同等规模的超大型数据中心中,Vera Rubin运行自主AI智能体任务的效率是上一代Grace Blackwell平台的10倍。

网络方面,Vera Rubin引入了Spectrum-X Ethernet Photonics网络系统,这是英伟达首次将共封装光学(CPO)技术大规模应用于AI数据中心网络,有效降低了能耗和信号损失。

安全方面,英伟达将机密计算能力扩展到整个平台,通过可信执行环境、硬件级验证和端到端加密机制,为企业处理私有数据和敏感信息提供更高等级的安全保障。

Vera Rubin已进入量产,预计今年秋季开始正式出货,其背后涉及超过150家合作伙伴、350多座工厂,覆盖30多个国家和地区的供应链体系。

为Agent打造的处理器

英伟达推出了专为智能体时代设计的Vera CPU。作为Grace的继任者,Vera采用自研的“Olympus”CPU核心架构,核心数量从72个提升至88个,并大幅增强了内存和数据处理能力。在Agent相关工作负载测试中,Vera的任务执行速度达到同期x86服务器CPU的1.8倍。

Vera通过第二代NVLink-C2C与Rubin GPU连接,互联带宽达到1.8TB/s,显著降低了Agent运行过程中CPU和GPU之间的数据传输开销。黄仁勋透露,Vera Rubin采用美光、SK海力士和三星的HBM,供应链规模是上一代Blackwell的两倍,且部署时间从Blackwell的两小时压缩至5分钟级别。

DSX:AI工厂从建设走向运营

英伟达推出的DSX是一套“AI工厂建设和运营工具箱”。它将服务器、网络、电力、冷却、机房设计和运维系统等分散环节整合到一个统一框架中,为客户提供从设计、仿真、建设到运营的全流程标准化方案。

DSX最重要的新增能力有两个:一是DSX MaxLPS,它结合液冷和机架内功耗优化,允许运营商在不明显影响性能的情况下多运行最多40%的GPU。二是DSX OS,作为AI工厂的运营软件,负责生命周期管理、智能调度、健康监测、故障恢复和多租户管理等核心功能。

此外,DSX产品矩阵还包括提供参考设计的Reference Design、用于仿真的DSX Sim、连接AI工厂与电网的DSX Flex,以及打通IT与运营数据接口的DSX Exchange。目前,CoreWeave、Crusoe、Lambda等云合作伙伴正积极部署DSX系列产品。

Windows与ARM生态的深度融合

英伟达发布了DGX Station for Windows,这是一款面向Windows生态的桌面级AI超级计算机。它搭载GB300 Grace Blackwell Ultra Desktop Superchip,提供最高748GB统一内存和20 PFLOPS FP4性能。该产品旨在让企业能够在本地、安全、可管理的Windows环境中运行多个Agent,并将其接入设计、工程、数据科学和物理AI等工作流。

同时,英伟达还推出了RTX Spark SoC,将N1X CPU和Blackwell GPU集成于单一芯片。N1X是英伟达与微软共同打造的首款基于Arm架构的PC处理器,由联发科定制设计,采用台积电3纳米工艺。该芯片将首发搭载于微软、戴尔、惠普、华硕、联想和微星等品牌的高端轻薄本中。

Agent的“两个大脑”:Nemotron与Cosmos

英伟达发布了拥有5500亿参数的混合专家模型Nemotron 3 Ultra,专为代码开发、科研及企业业务流程中的长效智能体提供顶尖智能能力。相较于同级别主流开源模型,其推理速度最高提升5倍,使用成本最高降低30%。

围绕Nemotron,英伟达发布了NemoClaw(负责将模型组织成Agent)、OpenShell(负责运行时安全)和Agent Toolkit(将CUDA-X等软件库变成Agent可调用的工具)等一系列软件和开源模型。黄仁勋强调,全球软件公司正在将AI Agent带入真实工作系统,NemoClaw提供了构建长期运行Agent所需的开放组件。

Cosmos 3是Cosmos系列的第三代产品,是一次架构层面的重大重构。它是一个面向物理AI的世界基础模型,采用混合Transformer架构,首次将视觉推理、世界生成和动作预测统一到一个系统中。它能够原生理解并生成文本、图像、视频、环境声音和动作,在物理准确性上达到领先水平,有望将物理AI的训练和评估周期从数月压缩到数天。

降低Physical AI门槛

英伟达与宇树联合发布了H2 Plus,这是全球首款基于NVIDIA Isaac GR00T开发平台构建的开放式人形机器人参考设计。该产品旨在解决人形机器人开发中硬件集成、数据采集、仿真、训练、评估和部署各环节碎片化的痛点,让研究团队跳过底层集成,直接进入技能开发和真实场景验证。

此外,英伟达还宣布开源一套物理AI Skills工具集,覆盖机器人、自动驾驶、视觉AI和工业数字孪生等核心场景。这套工具集将英伟达旗下Cosmos、Omniverse、Isaac、Metropolis等平台的使用方式标准化,形成智能体可直接执行的操作指令,大幅简化开发流程。

升级AI存储与安全:从性能到治理

在3月份的GTC上,英伟达发布了Vera BlueField-4 STX,主打为智能体长上下文推理提供高性能KV Cache存储。此次大会,英伟达在此基础上新增了一套安全能力,重点从“存储性能”转向“存储安全”。随着Agent在无人监督下持续读写和跨系统共享信息,数据访问权限和泄露风险成为企业关注焦点。英伟达的解决方案是在加速存储基础上加了一层基于NVIDIA DOCA安全软件和BlueField-4芯片的安全能力,实现实时管控代理、数据和上下文记忆之间的互动。

与台积电的“互为供应商”新关系

本次大会中,英伟达与台积电的合作关系发生了微妙变化。过去三十年的单向甲乙方关系(台积电为英伟达造芯片)正在转变为双向依存。台积电正利用NVIDIA的AI和加速计算技术,通过仿真、优化和AI来提升先进晶圆厂的周转时间、能效、良率与运营生产力,以应对全球最复杂的设计和制造挑战。

结语

回看这场发布会,英伟达正围绕“Agent”构建一个完整的生态蓝图。从为Agent调度任务的Vera CPU,到提供算力的Vera Rubin,到守护数据安全的BlueField-4 STX,再到理解物理世界的Cosmos 3,以及让Agent被组织、调用、约束的Nemotron+NemoClaw+OpenShell,再到进入企业桌面的DGX Station和拥有身体的H2 Plus,最后是通过DSX和Skills实现批量生产和部署。黄仁勋描绘了一个新的计算时代:当Agent成为AI基础设施的核心,每一层都能看到英伟达的身影。

市场资讯部点评
此次英伟达GTC Taipei的发布,标志着行业从“训练时代”正式迈入“Agent应用时代”。黄仁勋的战略洞察极为清晰:AI的下一波增长引擎不再是单纯的大模型竞赛,而是将算力、模型、数据与物理世界深度耦合的智能体生态。英伟达正通过构建从芯片到操作系统的全栈Agent基础设施,抢占AI价值链的最高点。尤其值得关注的是与Windows、ARM生态的协同,以及与宇树、台积电的双向赋能,这预示着AI产业正从单点技术突破转向网络化、体系化竞争。对于投资者而言,英伟达已不仅是一家芯片公司,更是一个驱动全球AI生产力跃迁的“AI工厂”构建者。