云端AI推理平台DeepInfra近日公布了一项针对智能体AI(Agentic AI)负载的性能测试结果,数据显示英伟达Vera CPU在处理效率上显著领先于其他主流处理器。此次测试在统一的生产环境中进行,重点评估了不同CPU在运行AI推理任务时的延迟表现。
根据DeepInfra的测试数据,英伟达Vera CPU在运行基于Linux内核特性的runc轻量化容器时,延迟仅为29毫秒,而英特尔Sapphire Rapids处理器的延迟高达64毫秒,Vera CPU的响应速度快了2.2倍。这一结果与英伟达官方此前发布的性能提升数据相吻合——Vera CPU在处理智能体AI负载时,相比AMD的Turin 9755处理器性能提升了80%。
测试环境采用了严格统一的配置标准:每次运行均使用20个物理核心,每个核心运行1个线程,并限定在单个NUMA节点内,同时启用了CPU confinement技术以确保测试公平性。任何超出核心预算的运行任务将被自动丢弃,从而避免资源干扰对测试结果的影响。
在完整的性能对比数据中,英伟达Vera CPU的runc延迟为29毫秒,Kata容器延迟为58毫秒;AMD Zen5 Turin处理器的runc延迟为35毫秒,Kata容器延迟为87毫秒;英特尔Granite Rapids处理器的runc延迟为12.44毫秒,Kata容器延迟为103毫秒;而英特尔Sapphire Rapids处理器的runc延迟为64毫秒,Kata容器延迟为122毫秒。从数据可以看出,Vera CPU在runc轻量化容器场景下的延迟表现尤为突出。
此次测试结果进一步验证了英伟达Vera CPU在智能体AI负载处理领域的优势地位。随着AI应用场景的不断拓展,低延迟、高效率的处理器性能将成为推动行业发展的关键因素。DeepInfra的测试数据为开发者和技术决策者提供了重要的参考依据,有助于他们在构建AI基础设施时做出更优化的选择。











