⚡ 前沿动态

首款面向AI智能体的CPU:NVIDIA Vera CPU

🕐 2026.08.25 星期二 来源 · 媒体 🔥 3 次点击

NVIDIA Vera是全球首款从底层专为AI智能体设计的CPU,而非从通用服务器CPU改造而来,核心定位是为Agentic AI场景提供专属算力支撑。

过去两年市场焦点几乎全部集中在GPU的算力与互联上,但Agentic AI的实际瓶颈正从GPU侧向CPU侧转移。Vera CPU的推出直接针对该问题,把"编排、工具调用、代码执行"从附带任务提升为一等公民。叠加Groq 3 LPX机架级推理加速器(FP8总算力315 PFLOPS、128GB SRAM、单机柜256颗LPU),NVIDIA正在构建"CPU+GPU+LPU"三层AI基础设施栈。

NVIDIA Vera是全球首款从底层专为AI智能体设计的CPU,而非从通用服务器CPU改造而来,核心定位是为Agentic AI场景提供专属算力支撑。

一、硬件参数

  • 核心配置‌:搭载88颗自研Olympus定制核心,搭配NVIDIA空间多线程技术,可同时输出176个执行线程,核心资源做了分区专属优化。
  • 内存规格‌:放弃传统DDR5内存,改用可插拔现场更换的SOCAMM模块搭载LPDDR5X,内存带宽最高可达1.2TB/s,是主流x86 CPU的2倍,单核心带宽达到竞品的3倍。
  • 功耗表现‌:同等算力下功耗仅为领先x86 CPU的约50%,大幅降低AI数据中心的供电与散热压力。

二、技术细节

1. 核心微架构优化‌

自研Olympus核心采用宽前端设计,集成神经分支预测器,每周期最多可取16条指令,解码器宽度达到10路,每周期可处理10条融合指令,专门针对智能体高频的工具调用、数据库访问类分支密集场景做了定向优化。

2. 专属硬件预取机制‌

内置专门针对指针密集型数据结构和图处理负载的图预取器,智能体在访问知识库、向量数据库时,数据命中率比传统x86 CPU高40%,大幅减少等待延迟。

3. 空间多线程技术‌

区别于传统同步多线程的资源争抢问题,每个核心的两个硬件线程可分区独占核心资源,支持一个线程优先运行高优先级的智能体主任务,另一个线程同步处理系统管理类任务,不会出现资源抢占导致的性能抖动。

三、横向对比

与主流服务器CPU对比

产品名称 核心数/线程数 内存带宽 单路最大内存容量 核心专属缓存 互联接口规格 目标场景
NVIDIA Vera CPU 88核/176线程 1.2TB/s(LPDDR5X) 1.5TB 64KB L1i + 96KB L1d + 2MB L2 + 164MB L3 NVLink-C2C 1.8TB/s + PCIe Gen6 + CXL 3.1 AI智能体专属负载
Intel Xeon 6 56核 56核/112线程 410GB/s(DDR5) 4TB 32KB L1i + 64KB L1d + 4MB L3 PCIe Gen5 + CXL 2.0 通用服务器负载
AMD EPYC 9005 128核 128核/256线程 540GB/s(DDR5) 6TB 32KB L1i + 32KB L1d + 16×16MB L3 PCIe Gen5 + CXL 3.0 通用数据中心负载

四、实测性能

  • 综合场景‌:在AI智能体、强化学习、数据处理三类核心工作负载下,任务完成速度比主流x86 CPU快1.8倍。
  • 专项场景‌:在智能体沙箱环境中,性能领先优势进一步扩大,相比x86 CPU提速最高可达80%。
  • 协同效率‌:可与Rubin GPU、Groq 3 LPX推理芯片深度适配,大幅提升整套AI算力集群的智能体任务吞吐能力。
  • SQL数据处理‌:相比主流x86 CPU速度快3倍,适配智能体高频的结构化数据查询场景。
  • 实时流数据处理‌:纽约证券交易所实测行情/订单事件流处理,端到端P99延迟比x86方案快6倍,完全满足高并发金融智能体的低延迟要求。
  • Agent负载综合性能‌:NVIDIA内部2026年7月SPEC CPU 2026测试显示,特定智能体负载下性能最高可达x86系统的1.8倍,该数据目前尚未经过第三方独立验证。

以上数据仅供参考

五、部署情况

  • 首个大规模商用客户‌:SpaceXAI率先部署Vera CPU,用于支撑下一代AI智能体应用的超大规模算力需求,这也是该款芯片首次在超算级场景落地。
  • 潜在客户群体‌:目前纽约证券交易所、Anthropic、OpenAI、字节跳动、CoreWeave、Lambda、Oracle云基础设施等全球头部金融机构、AI企业与云服务商,均已启动对Vera CPU的引入评估。

六、行业影响

  • 打破x86垄断‌:首次在AI智能体核心算力场景中,用全新架构的专用CPU替代通用x86芯片,重构自主AI系统的底层算力底座。
  • 全栈体系补全‌:Vera CPU与Rubin GPU、Groq 3 LPX推理芯片、Spectrum-X网络组成完整的Agentic AI全栈算力体系,补齐了英伟达在AI智能体CPU侧的最后一块短板。
  • 行业趋势预判‌:英伟达CEO黄仁勋明确表示,AI智能体将成为未来最大的算力需求方,Vera CPU正是为这一趋势提前布局的核心硬件产品。
声明:文中数据及部分观点来源于网络,部分观点来源于个人分析和推理,仅供参考,不构成投资或商业决策建议。
资料来源
  1. NVIDIA官方博客
  2. unite.ai
  3. techbuzz.ai
← 返回 [前沿动态]