NVIDIA Vera CPU 以单线程效率重新定义 AI 工作负载

realtime news Jul 07, 2026 15:38

NVIDIA Vera CPU 为以 AI 为中心的任务提供 50% 更快的性能,通过突破性的单线程效率优化智能 AI 工厂的运行。

NVIDIA Vera CPU 以单线程效率重新定义 AI 工作负载

NVIDIA 于 2026 年 3 月推出的 Vera CPU 在 AI 领域掀起了波澜,为代理型 AI 时代提供了全新的解决方案。Vera 专为最大化单线程性能而设计,针对 AI 代理在连续、依赖循环中运行的工作负载进行了优化——这些任务是传统 CPU 无法以相同效率处理的。

Vera 的核心采用了 NVIDIA 定制的 Olympus CPU 架构,与 NVIDIA Grace 相比,每周期指令数提高了 50%。其拥有 88 核心和 1.2TB/s 的 LPDDR5X 内存带宽,解决了高核数 CPU 常见的瓶颈问题,这些 CPU 通常牺牲单线程速度以换取多线程吞吐量。这一转变对 AI 工厂尤为重要,因为每个代理的性能直接影响 GPU 的利用率和收入生成。

为何单线程性能至关重要

与传统 CPU 优先考虑高核数以最大化成本效率不同,Vera 是专为代理型 AI 工作流量身定制的。AI 代理依赖于快速、顺序执行的数据处理、工具管理和代码执行等任务。在单个代理循环中出现的任何延迟都会在更广泛的 AI 系统中引发效率低下。

Vera 的设计能够确保在高负载下每核性能的可预测延迟和一致性高性能。这使得 AI 工厂能够更快完成代理型任务,最大化其 GPU 资源的利用率。NVIDIA 声称,Vera 提供了领先 x86 CPU 的 1.8 倍持续单核性能,而合作伙伴如 Perplexity 已报告了在真实的编码工作流中任务执行速度提高至 1.9 倍。

与 AI 工厂的集成

Vera 不仅仅是一款更快的 CPU;它是 NVIDIA 主导 AI 基础设施更广泛战略的一部分。集成在 2026 年 5 月全面投产的 Vera Rubin 平台中,该 CPU 设计可通过 NVLink-C2C 与 NVIDIA GPU 无缝协作。此架构可实现高达 1.8TB/s 的一致带宽,使 CPU 与 GPU 能够作为统一系统运行——这一关键特性适用于运行数万并发代理环境的 AI 工厂。

除了强大的性能外,Vera 还通过无需为不同的 AI 工作负载配备单独的 CPU 简化了基础设施。无论是运行 SQL 分析(比 x86 CPU 快 3 倍)还是使用 Redpanda 进行实时流处理(延迟低 6 倍),Vera 都能高效处理各种任务。这种多功能性使其成为扩展 AI 运营的公司的一种有吸引力的选择。

未来展望

NVIDIA 已在规划下一代 Rosa CPU,它将采用 Rigel 内核。据悉,Rosa 将提供更高的单核性能,旨在以 Vera 为基础,进一步巩固 NVIDIA 满足代理型 AI 独特需求的承诺。

随着 AI 的加速普及,对 Vera 这样的专用硬件的需求只会持续增长。NVIDIA 对这一市场的战略投资使其成为以 AI 为中心的计算领域的领导者,而 Vera CPU 则体现了公司向垂直整合解决方案转型的方向。对于数据中心和 AI 工厂而言,信息已非常明确:速度和效率不再是可选项——而是必需品。

Image source: Shutterstock