英伟达于Hot Chips大会首次公布下一代旗舰机柜Vera Rubin NVL72的片上实测数据。在SemiAnalysis AgentX智能体工作负载、运行DeepSeek V4 Pro模型的测试中,Vera Rubin NVL72每兆瓦吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。
核心发布
同时发布的Groq 3 LPX主打低延迟Token生成,在Gemma 4 31B模型、10万Token上下文测试中达到每秒3400个输出Token。
SpaceXAI将进一步扩大对英伟达新一代平台的部署,采用Vera CPU支持下一代智能体AI应用,并计划将优化版Vera Rubin NVL72用于首代Starmind AI卫星,将AI计算平台从地面延伸至轨道计算。
行业意义
此次发布核心并非单纯刷新芯片性能,而是重新定义智能体时代AI基础设施的经济性——AI算力发展方向正从"通用大训练"转向"专用推理优化"。