英伟达于当地时间8月24日公布了两项关键进展。面向AI推理场景的Groq 3 LPX芯片宣布全面投入量产,在Gemma 4 31B模型、10万Token长上下文的测试条件下,输出速度达到了每秒3400个Token。与此同时,新一代Vera Rubin平台的数据更为亮眼:其NVL72配置在每兆瓦电力下的吞吐量,最高可达到上一代GB300 NVL72的30倍,单位Token的算力成本则最多可降低35倍。
此外,SpaceXAI透露将部署Vera Rubin平台,并计划把优化版本应用于其首代Starmind AI卫星,将AI计算能力从地面数据中心拓展到太空轨道。这标志着AI算力基础设施正在向极端环境延伸。
【AICOR 点评】英伟达正在用"每Token成本"重新定义AI基础设施的性价比标准。当算力成本以数十倍的幅度下降时,企业部署AI Agent的经济模型将彻底改写——不再是"预算够不够",而是"场景够不够多"。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。