英伟达Groq 3 LPX全面投产:Vera Rubin每瓦吞吐30倍,AI算力首入太空
2026年8月24日,英伟达宣布Groq 3 LPX正式全面投产,同时公布Vera Rubin平台在智能体工作负载下的全新性能数据。在独立评测机构Artificial Analysis的基准测试中,Groq 3 LPX搭载Gemma 4 31B模型、10万Token上下文,实现每秒3400个输出Token,响应速度达到最近竞争平台的4倍。同日,SpaceXAI宣布将优化版Vera Rubin NVL72用于首代Starmind AI卫星,把AI计算从地面数据中心延伸至轨道。(来源:Reuters、华尔街见闻)
Groq 3 LPX全面投产 智能体推理迎来极速引擎
2025年12月,英伟达以200亿美元收购芯片创业公司Groq的核心班底,这是英伟达史上最大规模收购交易。9个月后,这笔交易的成果正式落地。Groq 3 LPX专为低延迟Token生成设计,在Artificial Analysis基准测试中,搭载Gemma 4 31B模型、10万Token上下文条件下实现每秒3400个输出Token,创下该模型最高纪录。针对智能体编程等延迟敏感型工作负载,响应速度最高达到最近竞争平台的4倍。AI云服务商Nebius将成为首个采用Groq 3 LPX的云厂商,计划部署到其Token Factory生产推理平台,Groq自身也计划成为最早一批采用者。(来源:Artificial Analysis、澎湃新闻)
智能体AI与传统的”一问一答”模式截然不同。一次智能体任务需要读取文件、调用工具、执行代码、检查结果,再根据结果继续推理,可能循环数百甚至数千步。每一步Token生成速度直接影响整个任务的完成时间。Groq 3 LPX填补了传统GPU架构在低延迟Token生成方面的短板,让Vera Rubin平台同时拥有大规模上下文处理能力和极速单用户交互速度。英伟达CEO黄仁勋称其为”针对智能体AI时代设计的工作负载优化型AI工厂配置”。(来源:华尔街见闻)
Vera Rubin每瓦吞吐30倍 推理成本降35倍
英伟达同时公布Vera Rubin NVL72在真实智能体工作负载下的测试结果。基于SemiAnalysis的AgentX工作负载、采用DeepSeek V4 Pro模型测试,Vera Rubin每兆瓦吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。DeepSeek V4 Pro此前在Terminal Bench 2.1测试中距Fable 5仅差0.1分,如今被英伟达选为智能体工作负载基准模型,侧面印证了其技术地位。(来源:SemiAnalysis)
30倍这一数据的核心维度是每兆瓦能效。当AI推理从实验室走向规模化部署,能耗效率成为决定性因素。推理成本降一个数量级,意味着AI智能体的规模化部署不再卡在算力账单上。这与本月初Cerebras发布CS-4晶圆级推理系统形成对照,两家公司选择了不同的技术路线来挑战GPU在推理市场的统治地位。(来源:Cerebras官方)
SpaceXAI将AI算力送入太空 轨道计算时代开启
SpaceXAI宣布将进一步扩大对英伟达新一代平台的部署。采用Vera CPU支持下一代智能体AI应用,并随着自身算力向数GW规模扩张建设Vera Rubin基础设施。更具想象力的是,SpaceXAI计划将优化版Vera Rubin NVL72延伸至太空,用于首代Starmind AI卫星,将英伟达AI计算平台从地面数据中心延伸至轨道计算。(来源:Reuters、华尔街见闻)
这是AI计算基础设施首次明确向太空延伸的公开计划。如果Starmind卫星成功搭载Vera Rubin,意味着AI推理能力不再受限于地面数据中心的选址、供电和冷却,可以在轨道上直接处理数据。对于遥感、通信、导航等需要低延迟决策的太空应用场景,轨道AI计算将大幅减少数据回传延迟。英伟达的算力版图从数据中心延伸到轨道,这一组合拳的想象力远超单纯跑分。(来源:鉅亨網)
英伟达同步洽投Perplexity 从算力到应用全栈卡位
同一天,据The Information援引知情人士报道,英伟达正就投资AI搜索初创公司Perplexity进行谈判,融资完成后Perplexity估值有望突破300亿美元,较一年前约200亿美元的估值上涨超50%。Perplexity年化营收已从2026年初不足2.5亿美元攀升至超7.5亿美元,增长主要由AI智能体产品Perplexity Computer驱动。英伟达CEO黄仁勋公开表示Perplexity是其日常使用的AI聊天工具。(来源:The Information、Reuters)
英伟达正在从底层算力供应商向AI应用层延伸。通过Groq芯片量产锁定推理基础设施,通过Poolside许可获取模型开发能力,通过Perplexity投资卡位AI应用入口,全栈布局正在收口。本月中旬,英伟达刚与Poolside达成60亿美元许可协议加10亿美元股权投资,投前估值120亿美元。从芯片到模型再到应用,英伟达的触角已覆盖AI全产业链。(来源:华尔街见闻)
结语
英伟达8月24日的密集动作揭示了一条清晰路线:把AI算力做得更快、更便宜、更分散。从地面数据中心到轨道卫星,从芯片硬件到搜索应用,算力基础设施的边界正在被重新定义。当推理成本降一个数量级,智能体的规模化落地就只剩时间问题。