7月21日,英伟达在AMD Advancing AI 2026大会前夕,抢先公布了数据中心CPU产品Vera的技术细节。这不仅是英伟达继Grace之后在CPU领域的又一重磅落子,更是其从卖显卡向卖AI工厂垂直整合战略的彻底摊牌。Vera是全球首款从核心层面专为代理式AI量身定制的处理器。
智能体AI工作负载对CPU提出了全新要求。智能体在沙箱中运行代码、调用工具、检索上下文、与数据库交互并分析结果,然后再将信息返回给模型。这一过程意味着CPU不再只是辅助加速器,而是成为AI工厂中控制密集型循环的核心执行者。英伟达强调,Vera围绕智能体负载设计,重点提升满负载条件下的单线程表现。
Vera的核心是Olympus架构,单颗集成88个核心,支持176线程。为应对智能体复杂的分支预测挑战,Olympus引入了神经分支预测器,配合10-wide解码引擎高效处理复杂逻辑。Vera也是首款在CPU核心中支持FP8精度的处理器,打通了与GPU之间的数值计算壁垒。

内存带宽是智能体并发执行的隐形杀手。Vera采用创新的SOCAMM2 LPDDR5X内存方案,实现1.2TB/s带宽,是传统DDR5服务器的两倍,功耗却不到后者一半。测试显示,Vera能维持90%的峰值带宽,确保即便数千个智能体并发时数据供给不掉队。
根据英伟达公布的基准测试,Vera针对智能体负载的优化效果显著:满载情况下单核性能达传统x86 CPU的1.8倍;AI智能体任务综合性能提升约50%;支持多达1.6倍的并发智能体运行,编排速度提升高达2.2倍。
星战科技在构建GPU算力平台和OPC智能体协作平台时,同样面临系统级协同的挑战。智能体在真实业务环境中持续运转,需要CPU、GPU、内存、网络的无缝配合。星战科技的算力调度能力支持异构资源管理,让企业能够灵活组合不同代际、不同品牌的芯片资源,而非被单一硬件生态锁定。

英伟达正在系统性地摆脱对单一GPU销售的依赖。网络互联业务成为增长最迅猛的曲线,2027财年第一季度数据中心网络收入创下148亿美元纪录,同比暴增199%。自研CPU业务则让英伟达正式杀入由英特尔与AMD长期统治的服务器CPU腹地。黄仁勋曾表示,Vera打开了一个全新的市场,CPU让智能体等待的每一刻,都是整栋建筑里最昂贵的东西GPU处于闲置状态的一刻。
算力竞争已经进入新阶段。单一GPU性能不再是唯一指标,CPU、GPU、网络互联的系统级协同能力成为关键。英伟达Vera的发布,标志着智能体时代对硬件提出了全新要求。