新闻

NVIDIA Vera CPU 瞄准代理 AI 的高效性

NVIDIA 推出专为代理 AI 工作负载优化的 Vera CPU,在 AI 工厂操作中提供 1.5 倍的性能提升。

NVIDIA Vera CPU 瞄准代理 AI 的高效性

NVIDIA 推出了 Vera CPU,这是一款专为优化代理 AI 工作负载而设计的数据中心处理器,旨在简化 AI 工厂中的操作。根据超过 163,000 次代理会话的遥测数据,Vera CPU 在关键基准测试中实现了比 AMD 的 Venice CPU 高达 1.5 倍的性能,使其成为构建 AI 驱动系统的企业的一个重要选择。

与传统 CPU 不同,Vera CPU 是专为 AI 工厂设计的——在这些复杂系统中,AI 代理执行推理步骤、管理工具调用以及处理并行环境。NVIDIA 在 Vera 上的重点是通过兼顾高单线程性能和足够的并发性来应对这些环境中典型的不可预测、对延迟敏感的工作负载。该 CPU 的首要任务是高效完成用户会话,这些会话通常因顺序推理路径与并行任务突发交替而遭遇瓶颈。

真实世界中的代理 AI 挑战

NVIDIA 的遥测数据突出了优化代理工作负载的挑战。分析的 97% 以上的代理会话显示出独特的路径,这凸显了为处理这种多样性而设计硬件的难度。会话通常包括冗长的顺序依赖性,并伴随着短暂的并行活动。例如,在一场 33 分钟的 Claude Code 会话中,大部分时间都花费在顺序路径上,显示出每线程延迟在实现更快完成时间方面的重要作用。

NVIDIA 的 Vera CPU 通过结合强大的每核心性能与充足的并发性来应对这些挑战。这避免了将工作负载分散到专用 CPU 类型上的低效做法,这种方式可能导致资源闲置和更高的内存成本。相反,Vera 的平衡架构确保了顺序和并行需求都能被满足,而无需在性能或效率上妥协。

市场影响与竞争

NVIDIA 的 Vera CPU 是更广泛的 Vera Rubin AI 平台的一部分,该平台集成了 Rubin GPU、NVLink 6 互连以及其他数据中心基础设施,以优化 AI 工厂操作。通过这种整合的方式,NVIDIA 得以将自己定位为 AI 专用硬件解决方案日益增长市场中的领导者。截至 2026 年 8 月 24 日,NVIDIA 的市值达到了 5.13 万亿美元,反映了其在 AI 和数据中心技术领域的主导地位。

竞争依然激烈。例如,AMD 正在推动其 Venice CPU 的发展,但 NVIDIA 通过遥测支持的 1.5 倍更好的代理性能声明可能会扩大这一差距。Vera 对高单线程性能的专注(特别是针对代理控制循环)以及其与 NVIDIA GPU 生态系统的深度集成,使其在 AI 工厂中占据了优势,在这些场景中效率和速度至关重要。

展望未来

Vera CPU 对 AI 操作的影响可能是深远的,特别是在企业扩展 AI 工厂以处理更复杂的工作负载时。通过减少延迟和优化资源使用,Vera 实现了更快的任务完成和改进的舰队经济性,这些都是企业在大力投资 AI 技术时的重要指标。

对于那些对技术细节感兴趣的人,NVIDIA 已发布了一份白皮书,概述了 Vera CPU 的架构,包括其 SPEC CPU 2026 的结果以及与竞争平台的比较。随着 AI 采用的加速,Vera CPU 在应对代理工作负载挑战方面的能力,使 NVIDIA 成为下一阶段 AI 驱动创新中的关键角色。