英伟达于当地时间8月24日公布了两项关键进展。面向AI推理场景的Groq 3 LPX芯片宣布全面投入量产,在Gemma 4 31B模型、10万Token长上下文的测试条件下,输出速度达到了每秒3400个Token。与此同时,新一代Vera Rubin平台的数据更为亮眼:其NVL72配置在每兆瓦电力下的吞吐量,最高可达到上一代GB300 NVL72的30倍,单位Token的算力成本则最多可降低35倍。
此外,SpaceXAI透露将部署Vera Rubin平台,并计划把优化版本应用于其首代Starmind AI卫星,将AI计算能力从地面数据中心拓展到太空轨道。这标志着AI算力基础设施正在向极端环境延伸。
【AICOR 点评】英伟达正在用"每Token成本"重新定义AI基础设施的性价比标准。当算力成本以数十倍的幅度下降时,企业部署AI Agent的经济模型将彻底改写——不再是"预算够不够",而是"场景够不够多"。
Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.
Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.