⚡ 前沿动态
首款面向AI智能体的CPU:NVIDIA Vera CPU
NVIDIA Vera是全球首款从底层专为AI智能体设计的CPU,而非从通用服务器CPU改造而来,核心定位是为Agentic AI场景提供专属算力支撑。
过去两年市场焦点几乎全部集中在GPU的算力与互联上,但Agentic AI的实际瓶颈正从GPU侧向CPU侧转移。Vera CPU的推出直接针对该问题,把"编排、工具调用、代码执行"从附带任务提升为一等公民。叠加Groq 3 LPX机架级推理加速器(FP8总算力315 PFLOPS、128GB SRAM、单机柜256颗LPU),NVIDIA正在构建"CPU+GPU+LPU"三层AI基础设施栈。
NVIDIA Vera是全球首款从底层专为AI智能体设计的CPU,而非从通用服务器CPU改造而来,核心定位是为Agentic AI场景提供专属算力支撑。
一、硬件参数
- 核心配置:搭载88颗自研Olympus定制核心,搭配NVIDIA空间多线程技术,可同时输出176个执行线程,核心资源做了分区专属优化。
- 内存规格:放弃传统DDR5内存,改用可插拔现场更换的SOCAMM模块搭载LPDDR5X,内存带宽最高可达1.2TB/s,是主流x86 CPU的2倍,单核心带宽达到竞品的3倍。
- 功耗表现:同等算力下功耗仅为领先x86 CPU的约50%,大幅降低AI数据中心的供电与散热压力。
二、技术细节
1. 核心微架构优化
自研Olympus核心采用宽前端设计,集成神经分支预测器,每周期最多可取16条指令,解码器宽度达到10路,每周期可处理10条融合指令,专门针对智能体高频的工具调用、数据库访问类分支密集场景做了定向优化。
2. 专属硬件预取机制
内置专门针对指针密集型数据结构和图处理负载的图预取器,智能体在访问知识库、向量数据库时,数据命中率比传统x86 CPU高40%,大幅减少等待延迟。
3. 空间多线程技术
区别于传统同步多线程的资源争抢问题,每个核心的两个硬件线程可分区独占核心资源,支持一个线程优先运行高优先级的智能体主任务,另一个线程同步处理系统管理类任务,不会出现资源抢占导致的性能抖动。
三、横向对比
与主流服务器CPU对比
| 产品名称 | 核心数/线程数 | 内存带宽 | 单路最大内存容量 | 核心专属缓存 | 互联接口规格 | 目标场景 |
|---|---|---|---|---|---|---|
| NVIDIA Vera CPU | 88核/176线程 | 1.2TB/s(LPDDR5X) | 1.5TB | 64KB L1i + 96KB L1d + 2MB L2 + 164MB L3 | NVLink-C2C 1.8TB/s + PCIe Gen6 + CXL 3.1 | AI智能体专属负载 |
| Intel Xeon 6 56核 | 56核/112线程 | 410GB/s(DDR5) | 4TB | 32KB L1i + 64KB L1d + 4MB L3 | PCIe Gen5 + CXL 2.0 | 通用服务器负载 |
| AMD EPYC 9005 128核 | 128核/256线程 | 540GB/s(DDR5) | 6TB | 32KB L1i + 32KB L1d + 16×16MB L3 | PCIe Gen5 + CXL 3.0 | 通用数据中心负载 |
四、实测性能
- 综合场景:在AI智能体、强化学习、数据处理三类核心工作负载下,任务完成速度比主流x86 CPU快1.8倍。
- 专项场景:在智能体沙箱环境中,性能领先优势进一步扩大,相比x86 CPU提速最高可达80%。
- 协同效率:可与Rubin GPU、Groq 3 LPX推理芯片深度适配,大幅提升整套AI算力集群的智能体任务吞吐能力。
- SQL数据处理:相比主流x86 CPU速度快3倍,适配智能体高频的结构化数据查询场景。
- 实时流数据处理:纽约证券交易所实测行情/订单事件流处理,端到端P99延迟比x86方案快6倍,完全满足高并发金融智能体的低延迟要求。
- Agent负载综合性能:NVIDIA内部2026年7月SPEC CPU 2026测试显示,特定智能体负载下性能最高可达x86系统的1.8倍,该数据目前尚未经过第三方独立验证。
以上数据仅供参考
五、部署情况
- 首个大规模商用客户:SpaceXAI率先部署Vera CPU,用于支撑下一代AI智能体应用的超大规模算力需求,这也是该款芯片首次在超算级场景落地。
- 潜在客户群体:目前纽约证券交易所、Anthropic、OpenAI、字节跳动、CoreWeave、Lambda、Oracle云基础设施等全球头部金融机构、AI企业与云服务商,均已启动对Vera CPU的引入评估。
六、行业影响
- 打破x86垄断:首次在AI智能体核心算力场景中,用全新架构的专用CPU替代通用x86芯片,重构自主AI系统的底层算力底座。
- 全栈体系补全:Vera CPU与Rubin GPU、Groq 3 LPX推理芯片、Spectrum-X网络组成完整的Agentic AI全栈算力体系,补齐了英伟达在AI智能体CPU侧的最后一块短板。
- 行业趋势预判:英伟达CEO黄仁勋明确表示,AI智能体将成为未来最大的算力需求方,Vera CPU正是为这一趋势提前布局的核心硬件产品。
声明:文中数据及部分观点来源于网络,部分观点来源于个人分析和推理,仅供参考,不构成投资或商业决策建议。
资料来源
- NVIDIA官方博客
- unite.ai
- techbuzz.ai