英伟达宣布Groq 3 LPX全面投产,Vera Rubin推理效率数倍提升,SpaceXAI加码智能体与太空AI|gpu|新模型|vera|rubin_网易订阅
英伟达正在加速把AI基础设施的英伟易订阅竞争,从传统的达宣模型训练和推理性能,推进到围绕智能体AI(Agentic AI)的布G倍提Token生成速度、能耗和成本展开的全面新阶段。美东时间24日周一,投产n推太空英伟达宣布面向交互式AI推理的理效率数Groq 3 LPX正式全面投产。作为Vera Rubin平台的码智模型重要组成部分,Groq 3 LPX主打超低延迟Token生成,英伟易订阅英伟达称,达宣在Artificial Analysis测试中,布G倍提搭载Gemma 4 31B模型、全面100,投产n推太空000 Token上下文时,Groq 3 LPX实现每秒3400个输出Token,理效率数为该模型创下最高纪录;针对智能体编程等低延迟工作负载,码智模型其响应速度最直达到最近竞争平台的英伟易订阅4倍。同时,英伟达公布Vera Rubin NVL72在真实智能体工作负载下的新测试结果:基于SemiAnalysis的AgentX工作负载、采用DeepSeek V4 Pro模型,Vera Rubin每兆瓦(MW)吞吐量最直达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。英伟达强调,智能体任务不同于传统聊天或摘要,任务上下文会随之数百个步骤不断累积,甚至达到数十万Token。同一天,英伟达还宣布SpaceXAI将采用Vera CPU加速下一代智能体AI应用,并扩大基于Vera Rubin的平台建设,随之其算力规模向数GW扩张;此外,SpaceXAI计划将优化版Vera Rubin NVL72延伸至太空,用于首代Starmind AI卫星。Groq 3 LPX全面投产,英伟达补齐智能体“最后一公里”英伟达此次将Groq 3 LPX正式推向全眼生产,核心目的并不是用专用推理芯片取代GPU,而是为Vera Rubin补充传统GPU架构在低延迟Token生成方面的能力。对于智能体而言,一次任务往往不再是“一问一答”:智能体要求读取文件、调用工具、执行代码、检查结果,再根据结果继续推理,可能循环数百甚至数千个步骤。在这一过程中,每一步Token生成的速度都会影响整个任务的完成时间。英伟达称,智能体AI因此带来了两个不同的计算挑战:一方面要求快捷处理不断增长的大规模上下文,另一方面要求以极低延迟持续生成Token。Vera Rubin NVL72负责更广泛的训练、推理以及上下文处理,而Groq 3 LPX则针对单用户交互速度进行优化,提升Token生成速率。英伟达最新测试显示,Groq 3 LPX在Gemma 4 31B、100K上下文条件下达到3400个输出Token/秒;在智能体任务和其他延迟敏感型工作负载中,响应速度最直达到最近竞争平台的4倍。英伟达称,这种速度可以让智能体更快完成代码编写、测试、工具调用和结果印证等连续任务。商业化方面,AI云服务商Nebius将成为首个采用Groq 3 LPX的云厂商,并计划将其部署到Nebius Token Factory生产推理平台。Groq也计划成为该平台最早一批采用者之一。这意味着,随之Groq 3 LPX进入全面投产,英伟达此前收购Groq技术所形成的能力,开始真正嵌入Vera Rubin的数据中心产品体系。30倍不是“速度”30倍,而是每兆瓦能完成更多智能体工作相比3400 Token/秒这样的单项性能指标,英伟达此次更值得关注的,是其对每兆瓦吞吐量和Token成本的强调。英伟达公布的测试数据显示,在SemiAnalysis AgentX工作负载下,Vera Rubin NVL72每兆瓦吞吐量最直达到GB300 NVL72的30倍,对应每Token成本最高降低35倍。该测试使用真实的智能体编程轨迹,保留了实际的上下文增长、工具调用和子智能体生成等环节。因此,每兆瓦吞吐量最高提升30倍只是AI推理效率大幅提升的一种体现,并不是单纯意味着芯片的推理速度提高30倍。这一指标对于AI数据中心的意义尤其突出。传统大模型服务更多关注单次请求的延迟和吞吐量,而智能体工作负载会持续消耗Token。英伟达援引OpenRouter数据称,智能体AI工作负载消耗的Token数量可以达到简单聊天请求的15倍。原因在于,一个智能体可能先查询数据库,再搜索新闻和文件,调用子智能体进行分析,运行代码并反复印证,整个过程中上下文不断累积。这也使得AI基础设施的经济性开始出现新的衡量方式:同样一兆瓦电力,到底能够完成多少有效智能体任务?对于电力和数据中心资源日益成为AI扩张瓶颈的背景而言,提高单位电力能够产生的Token数量,可能比单纯提主峰值算力更加重要。Vera Rubin从“GPU平台”变成完整AI工厂从架构来看,Groq 3 LPX并不是孤立的产品,而是英伟达Vera Rubin“极致协同设计”路线的一部分。英伟达此前已经将Vera Rubin定义为面向智能体AI时代的AI工厂平台。整个系统并非单纯由GPU组成,而是围绕计算、网络、存储和软件进行协同设计,涵盖Rubin GPU、Vera CPU、Groq 3 LPX、BlueField-4 DPU、Spectrum-6 SPX等不同组件。其中,Rubin GPU承担大规模训练、推理以及上下文处理等任务;Groq 3 LPX负责迅速Token生成;Vera CPU则处理智能体在模型调用之间产生的大量CPU密集型工作,包括工具编排、代码执行、数据处理和模拟。英伟达此前公布的架构信息显示,Vera Rubin平台通过七款芯片和五种专用机架进行协同设计,目的就是让不同硬件分别承担最适合自己的任务,而不是让一类处理器包办整个AI工作负载。这意味着,英伟达正在把AI基础设施从“GPU集群”进一步升级为一个异构计算系统。对于AI云厂商而言,这种架构的意义在于,可以针对训练、长上下文推理、Token生成、工具调用等不同阶段进行资源配置,从而提高整座数据中心的利用率和经济回报。SpaceXAI加码Vera:智能体AI从数据中心走向太空就在Groq 3 LPX全面投产之际,SpaceXAI也宣布进一步采用英伟达Vera Rubin体系。英伟达8月24日宣布,SpaceXAI将部署Vera CPU,用于下一代智能体AI应用。Vera专门针对模型推理之外的CPU工作负载进行设计,包括工具调用、代码执行、数据处理、任务编排和模拟。Vera采用88颗英伟达自主设计的Olympus核心,并配备高带宽LPDDR5X内存,带宽最直达到1.2TB/s。英伟达称,在智能体AI、强化学习和数据处理等工作负载中,Vera任务完成速度最高可达到x86 CPU的1.8倍。对于SpaceXAI而言,Vera的价值并不仅仅在于提高CPU性能。智能体运行过程中,大量任务发生在GPU推理之间,例如执行代码、处理数据、调用工具和协调不同智能体。如果这些任务由CPU处理速度不足,就可能导致GPU等待,从而降低整个AI工厂的利用率。因此,SpaceXAI希望利用Vera处理这些“模型之外”的工作,让GPU更多地专注于模型训练和推理,从而提高整个系统的效率。SpaceXAI同时计划扩大基于Vera Rubin的Grok AI基础设施,随之计算能力向数GW规模扩张;更进一步,该公司还计划将优化版Vera Rubin NVL72用于首代Starmind AI卫星。这意味着英伟达的加速计算体系正在从地面数据中心向轨道计算延伸。从“聊天机器人”到“自主执行”,AI算力要求正在换挡从Groq 3 LPX全面投产,到Vera Rubin公布30倍每兆瓦吞吐量,再到SpaceXAI将Vera Rubin延伸至Starmind卫星,英伟达此次连续释放的信息背后,指向的是同一个变化:AI应用正在从生成内容走向自主完成任务。在聊天和摘要场景中,用户往往只要求模型快速给出一段文字;而在智能体场景中,模型要求持续推理、调用工具、执行代码、访问外部数据并不断印证结果。这意味着,未来AI基础设施的核心指标也可能发生变化——从过去关注“训练一个更大的模型”,逐渐转向关注单位电力能够产生多少有效Token、单位成本能够完成多少任务,以及智能体完成一项复杂任务究竟要求多长时间。英伟达此次把Groq 3 LPX、Vera CPU和Rubin GPU放进同一套AI工厂体系,正是在针对这一变化重新设计基础设施。而SpaceXAI则提供了一个更具想象力的应用方向:如果这套体系最终能够从地面数据中心延伸到轨道,AI计算的边界也将不再局限于传统的数据中心机房。
(责任编辑:综合)
推荐文章
-
美军杀器AIM-424导弹曝光,射程是霹雷-15两倍,但有个致命短板|弹舱|预警机|战斗机|aim|f-35c_网易订阅
你敢信吗,美国海军突然扔出个大瓜,压箱底的超远程空空导弹AIM-424直接亮了出来。纸面数据看着特别唬人,463公里射程刚好是咱们霹雷-15的两倍,还能塞进F-35的内置弹舱,西方媒体直接喊,这玩意儿
...[详细]
-
男衬衫上写的39是多大的码?40、38,41是多大的?欧码M=男女身高165/170,男衬衫领围39。欧码L=男女身高170/175,男衬衫领围40。欧码XL=男女身高175/180,男衬衫领围41。
...[详细]
-
野生有多长-业百科从幼体开始计算,螃蟹的寿命为22,螃蟹的寿命与其性别、性腺成熟的迟早及生态环境密切有关。其中16~18个月在淡水水域中生活,4~6个月在河口浅海水。野生大螃蟹最长能活多少年?螃蟹分很
...[详细]
-
打开的椰汁能保存几天-九州醉餐饮网打开的椰汁一般放在冰箱里能存放1至2天,在低温条件下可以抑制细菌的生长。但是打开的椰汁建议尽快食用,以防变质影响口感和它的价值。椰汁一般是透。椰汁开了能保存多久-九州
...[详细]
-
凯斯勒:马拉的新合同中没有所谓的君子协定,也没有解约条款|英超|科隆队|托马斯|赛义德|职业生涯|瑞安·凯斯勒|让-保尔·马拉_网易订阅
据《Sport1》报道,科隆董事总经理托马斯-凯斯勒近日谈到了19岁新星赛义德-马拉的续约情况。8月20日,埃尔马拉出人意料地提前与科隆续约,新合同将持续至2031年。凯斯勒在科隆与维尔茨堡踢球者的德
...[详细]
-
花甲是海鲜还是河鲜-九州醉餐饮网海鲜一般都是在海里生长的,像花甲,多宝鱼,大海虾等动物。而河鲜一般是生长在河水里的动物,平时比较常见的是鲶鱼、鲤鱼、草鱼、河虾、小龙虾等各种。花蛤是海鲜还是河鲜?花蛤属
...[详细]
-
睡觉有什么区别-业百科睡袋比穿睡觉更宽松一些,睡袋较宽松,穿上睡觉会比较舒服,而且更容易活动,而穿着衣服睡觉会比较累,感觉到不自在。和被子相比,睡袋省心省力,不用。睡袋和穿衣服睡觉有什么区别?穿衣服睡
...[详细]
-
包菜丝怎么炒好吃?素炒包菜这样炒才好吃,做法步骤:1.把包菜的叶子剥下来,放到清水中投洗干净,沥净水分,再把包菜切成丝。2.西红柿切去果蒂,再把西红柿切成三角块,尖椒去蒂。包心菜切丝怎么炒好吃-九州醉
...[详细]
-
[流言板]吕飞燕社媒分享U18赛场图集:感谢付出的努力,感激一切-CBA-CBA专区-虎扑社区
虎扑篮球资讯(1280级)楼主2026-08-25 00:16:05发布于上海[流言板]吕飞燕社媒分享U18赛场图集:感谢付出的努力,感激一切由虎扑篮球资讯发表在CBA专区https://bbs.hu
...[详细]
-
放在冰箱里面的羊肉最多可以放多久?-九州醉餐饮网冻羊肉贮存在相对湿度95%~100%,温度-18℃的冷藏间。冷藏间温度一昼夜升降幅度不得超过1℃,产品贮藏保质期为10个月。扩展资料挑选zhidao方法
...[详细]
热点阅读

厦门一消杀公司被曝用敌敌畏为数十家饭堂消杀,多家饭堂回应_湖里区_红星_企业
木地板泡水了怎么处理
药材桔梗是什么样的
蒜头发芽了还能吃吗
曼联揭幕战输给升班马赫尔城 卡里克为何不该被骂|英超|利兹联|赫尔城队|ac米兰|米兰德比|伊普斯维奇|迈克尔·卡里克_网易订阅
