
一 | 8月25日消息,英伟达宣布,面向交互式AI推理的Groq 3 LPX处理器正式进入全面投产阶段。 萌宝初体验 LET’S GO 半 日 体 验 / / 金色摇篮青岛园 亲爱的家长朋友们,您是否在为孩子寻找一个充满爱与欢乐的成长乐园?金色摇篮青岛园半日体验活动重磅来袭! 在这里,孩子们将踏上一段奇妙的旅程。有规律的活动时间,还有丰富课程活动,还能促进同龄儿童之间的交往、分享与合作等。 该芯片是Vera Rubin平台的关键组件之一,专注于超低延迟Token生成,旨在弥补传统GPU架构在此类场景下的不足。 在为孩子寻觅优质教育的路上,我们是您的不二之选。 在Artificial Analysis的基准测试中,Groq 3 LPX搭载Gemma 4 31B模型、处理100,000 Token上下文时,实现了每秒3400个输出Token的吞吐量,创下该模型迄今最高纪录。诚邀您带孩子前来体验,感受温馨的校园氛围,我们用专业与爱心,助力孩子赢在成长起跑线。 针对智能体编程等对延迟敏感的工作负载,其响应速度最高可达近期竞品平台的4倍。 英伟达指出,智能体任务与传统聊天或摘要生成存在本质差异:一次任务可能包含数百甚至数千个推理步骤,智能体需反复读取文件、调用工具、执行代码、校验结果并迭代推理,上下文长度随之累积至数十万Token。 因此,智能体AI带来两个并行的计算需求:一是高效处理持续增长的大规模上下文,二是以极低延迟持续生成每一个输出Token。

二 | Vera Rubin平台通过多芯片协同设计应对这一挑战。其中,Rubin GPU负责大规模训练、推理及上下文处理;Groq 3 LPX则专为单用户交互场景优化Token生成速率;Vera CPU承担工具编排、代码执行、数据处理和模拟等CPU密集型工作;BlueField-4 DPU与Spectrum-6 SPX则分别负责网络与存储加速。 英伟达同步公布了Vera Rubin NVL72在真实智能体负载下的测试结果。

三 | 基于SemiAnalysis的AgentX工作负载,采用DeepSeek V4 Pro模型,Vera Rubin NVL72每兆瓦(MW)吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。 结合Groq 3 LPX的表现,该组合可使智能体在代码编写、测试执行、工具调用和结果验证等连续任务中获得更快的响应速度,从而显著缩短端到端任务完成时间。 活 动 详 情 活动时间 2025年2月22日(星期六) 上午9:00 邀请对象 2-6岁未入园的幼儿及家长 活动地址 青岛西海岸新区太行山路16号 金色摇篮幼儿园 活动流程 08:30-09:00快乐游园 09:00-09:30烘焙时光 09:30-10:00活动展示 10:00-10:20水果加餐 10:20-10:40缤纷课堂 10:40-11:00亲子游戏 11:00-11:10领取面包 报名方式 精 彩 瞬 间 温 馨 提 示 1.为了活动方便,请幼儿和爸爸妈妈们穿上比较舒适的服装和运动鞋。 2.请家长自行为幼儿准备水壶,及时为孩子补充水分。游戏中孩子避免独立活动,喝水、如厕请家长陪护,保证幼儿安全。 英伟达强调,Groq 3 LPX全面投产的核心目的并非以专用推理芯片取代GPU,而是为Vera Rubin平台补充传统GPU架构在超低延迟Token生成方面的短板。

四 | 整个Vera Rubin平台被定位为面向智能体AI时代的AI工厂系统,涵盖Rubin GPU、Vera CPU、Groq 3 LPX、BlueField-4 DPU、Spectrum-6 SPX等七款芯片及五种专用机架,所有组件围绕计算、网络、存储和软件进行深度协同设计,确保各类硬件各司其职,而非由单一处理器包揽全部工作负载。 3.活动过程中请家长看管好自己的孩子,妥善保管好自己的物品。如有特殊情况一定要及时告知老师。
Current article:http://ncp1isn.wengsengzhanhuangu.cyou/4c9/q3djr.html
Published on:13:13:42

