跳至正文
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
78227科技派

AI工具测评 | 科技资讯 | 软件推荐 - 客观真实的科技自媒体

78227科技派

AI工具测评 | 科技资讯 | 软件推荐 - 客观真实的科技自媒体

  • 首页
  • 关于我们
  • 广告合作
  • 联系我们
  • 首页
  • 关于我们
  • 广告合作
  • 联系我们
关

搜索

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
AI行业动态

英伟达Groq 3 LPX全面投产:Vera Rubin每瓦吞吐30倍,AI算力首入太空

作者 admin
2026-08-25 1 分钟阅读
0

2026年8月24日,英伟达宣布Groq 3 LPX正式全面投产,同时公布Vera Rubin平台在智能体工作负载下的全新性能数据。在独立评测机构Artificial Analysis的基准测试中,Groq 3 LPX搭载Gemma 4 31B模型、10万Token上下文,实现每秒3400个输出Token,响应速度达到最近竞争平台的4倍。同日,SpaceXAI宣布将优化版Vera Rubin NVL72用于首代Starmind AI卫星,把AI计算从地面数据中心延伸至轨道。(来源:Reuters、华尔街见闻)

Table of Contents

Toggle
  • Groq 3 LPX全面投产 智能体推理迎来极速引擎
  • Vera Rubin每瓦吞吐30倍 推理成本降35倍
  • SpaceXAI将AI算力送入太空 轨道计算时代开启
  • 英伟达同步洽投Perplexity 从算力到应用全栈卡位
  • 结语

Groq 3 LPX全面投产 智能体推理迎来极速引擎

2025年12月,英伟达以200亿美元收购芯片创业公司Groq的核心班底,这是英伟达史上最大规模收购交易。9个月后,这笔交易的成果正式落地。Groq 3 LPX专为低延迟Token生成设计,在Artificial Analysis基准测试中,搭载Gemma 4 31B模型、10万Token上下文条件下实现每秒3400个输出Token,创下该模型最高纪录。针对智能体编程等延迟敏感型工作负载,响应速度最高达到最近竞争平台的4倍。AI云服务商Nebius将成为首个采用Groq 3 LPX的云厂商,计划部署到其Token Factory生产推理平台,Groq自身也计划成为最早一批采用者。(来源:Artificial Analysis、澎湃新闻)

智能体AI与传统的”一问一答”模式截然不同。一次智能体任务需要读取文件、调用工具、执行代码、检查结果,再根据结果继续推理,可能循环数百甚至数千步。每一步Token生成速度直接影响整个任务的完成时间。Groq 3 LPX填补了传统GPU架构在低延迟Token生成方面的短板,让Vera Rubin平台同时拥有大规模上下文处理能力和极速单用户交互速度。英伟达CEO黄仁勋称其为”针对智能体AI时代设计的工作负载优化型AI工厂配置”。(来源:华尔街见闻)

Vera Rubin每瓦吞吐30倍 推理成本降35倍

英伟达同时公布Vera Rubin NVL72在真实智能体工作负载下的测试结果。基于SemiAnalysis的AgentX工作负载、采用DeepSeek V4 Pro模型测试,Vera Rubin每兆瓦吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。DeepSeek V4 Pro此前在Terminal Bench 2.1测试中距Fable 5仅差0.1分,如今被英伟达选为智能体工作负载基准模型,侧面印证了其技术地位。(来源:SemiAnalysis)

30倍这一数据的核心维度是每兆瓦能效。当AI推理从实验室走向规模化部署,能耗效率成为决定性因素。推理成本降一个数量级,意味着AI智能体的规模化部署不再卡在算力账单上。这与本月初Cerebras发布CS-4晶圆级推理系统形成对照,两家公司选择了不同的技术路线来挑战GPU在推理市场的统治地位。(来源:Cerebras官方)

SpaceXAI将AI算力送入太空 轨道计算时代开启

SpaceXAI宣布将进一步扩大对英伟达新一代平台的部署。采用Vera CPU支持下一代智能体AI应用,并随着自身算力向数GW规模扩张建设Vera Rubin基础设施。更具想象力的是,SpaceXAI计划将优化版Vera Rubin NVL72延伸至太空,用于首代Starmind AI卫星,将英伟达AI计算平台从地面数据中心延伸至轨道计算。(来源:Reuters、华尔街见闻)

这是AI计算基础设施首次明确向太空延伸的公开计划。如果Starmind卫星成功搭载Vera Rubin,意味着AI推理能力不再受限于地面数据中心的选址、供电和冷却,可以在轨道上直接处理数据。对于遥感、通信、导航等需要低延迟决策的太空应用场景,轨道AI计算将大幅减少数据回传延迟。英伟达的算力版图从数据中心延伸到轨道,这一组合拳的想象力远超单纯跑分。(来源:鉅亨網)

英伟达同步洽投Perplexity 从算力到应用全栈卡位

同一天,据The Information援引知情人士报道,英伟达正就投资AI搜索初创公司Perplexity进行谈判,融资完成后Perplexity估值有望突破300亿美元,较一年前约200亿美元的估值上涨超50%。Perplexity年化营收已从2026年初不足2.5亿美元攀升至超7.5亿美元,增长主要由AI智能体产品Perplexity Computer驱动。英伟达CEO黄仁勋公开表示Perplexity是其日常使用的AI聊天工具。(来源:The Information、Reuters)

英伟达正在从底层算力供应商向AI应用层延伸。通过Groq芯片量产锁定推理基础设施,通过Poolside许可获取模型开发能力,通过Perplexity投资卡位AI应用入口,全栈布局正在收口。本月中旬,英伟达刚与Poolside达成60亿美元许可协议加10亿美元股权投资,投前估值120亿美元。从芯片到模型再到应用,英伟达的触角已覆盖AI全产业链。(来源:华尔街见闻)

结语

英伟达8月24日的密集动作揭示了一条清晰路线:把AI算力做得更快、更便宜、更分散。从地面数据中心到轨道卫星,从芯片硬件到搜索应用,算力基础设施的边界正在被重新定义。当推理成本降一个数量级,智能体的规模化落地就只剩时间问题。

作者

admin

关注我
其他文章
上一个

HuggingFace被曝寻求出售,估值130亿美元翻倍,AI中间层价值爆发

下一个

智谱Ox Alpha登顶OpenRouter榜首:GLM系列匿测再下一城,编程模型调用量首超DeepSeek

近期文章

  • 英伟达35亿美元入股联发科:定制AI芯片战正式打响
  • 前英伟达VP带9000万美元出逃:Veeda押注”世界模型”成具身智能新基建
  • OpenAI自研芯片Jalapeno实测跑赢英伟达:AI推理成本战正式打响
  • AI吞噬现金流:中美巨头单季烧掉1318亿,自由现金流集体转负
  • Anthropic发布MHS标准:AI智能体首次跨入物理世界操控机械臂

归档

  • 2026 年 9 月
  • 2026 年 8 月
  • 2026 年 7 月
  • 2026 年 6 月
  • 2026 年 5 月
  • 2020 年 1 月

分类

  • AI大模型
  • AI工具测评
  • AI教育
  • AI硬件/芯片
  • AI编程工具
  • AI行业动态
  • AI设计/创作
  • SEO/搜索优化
  • 科技教育
  • 科技资讯
  • 赚钱攻略
  • 软件推荐
Copyright 2026 — 78227科技派. All rights reserved. Blogsy WordPress Theme