当前位置:主页 > 国内 >

国庆请假休29天

30倍吞吐碾压!英伟达Vera Rubin首测出炉:Agent工作负载下GB300被彻底超越_我的网站

格林第一季

一 |     8月25日消息,英伟达近日在Hot Chips 2026大会上首次公布了下一代旗舰机柜Vera Rubin NVL72的片上实测数据。    新加坡海军的威武级隐形护卫舰“忠诚号”将于本周日(9月1日)开始,与中国人民解放军海军进行一场双边海上合作演习。根据新加坡国防部周四(8月29日)的公告,“忠诚号”已抵达中国广东省湛江市的麻斜海军基地。

二 |          此次实测直接调用开源模型DeepSeek V4 Pro(1.6万亿参数),运行真实智能体编码任务,结果令人震惊。         在SemiAnalysis旗下AgentX基准测试中,Vera Rubin NVL72的每兆瓦吞吐量,比当前主力机皇GB300 NVL72最高飙升30倍,生产每百万Token的成本最高暴降35倍。

三 | 这次代号为“海事合作”的演习将从9月1日持续到9月5日。这是自2015年启动以来,两国海军第三次进行联合演习。9月1日至2日,两军将在麻斜海军基地进行岸上阶段的演习,包括演习规划和专业交流。随后在9月3日至5日,演习将转入海上阶段,内容涵盖直升机跨甲板着陆、炮火射击、搜救与机动演习,以及模拟发射程序的口令熟悉等。     作为对比,GB300的每兆瓦吞吐量相较上代H200也已提升15倍,Vera Rubin是在这个基础上再拔高30倍。         英伟达借此宣告旧基准作废:传统8K或1K固定序列测试已无法衡量智能体,必须回放含上下文增长与工具调用的真实工作流。

四 | 数据显示,一次Agent任务消耗的Token是普通聊天的15倍,长上下文成为关键瓶颈。

五 |     性能跃升来自极致协同设计。NVFP4量化将权重压至4位精度,第六代NVLink配合大模型MoE提供比以太网快10倍、延迟低3倍的互联,让DeepSeek这类专家模型在72颗GPU间行云流水调度。

六 |          同场还有两枚新芯量产:一是专为低延迟定制的Groq 3 LPX让Gemma 4 31B跑出每秒3400 Token;二是面向智能体打造的Vera CPU,含88个自研Olympus核心、内存带宽1.2TB/s。         值得一提的是Vera CPU已被马斯克SpaceXAI连夜装机,准备部署上太空。    

         

     【本文结束】如需转载请务必注明出处:      责任编辑:红茶     文章内容举报     

七 |

Current article:http://1bj.shengyaodanrongchui.buzz/f4alt/20260826/70865.html

Published on:02:48:31


相关新闻

最后更新

热门新闻