


一 | 8月26日讯 近日NBA名宿拜伦·斯科特和前NBA球员阿里扎、丹尼·格林录制了《Byron Scott's Fast Break》播客,在最新更新的一期里,他们谈到科比的相关话题。主持人:格林,这种心态在多大程度上影响了你们这一代球员?格林:影响非常大。 8月25日消息,英伟达近日在Hot Chips 2026大会上首次公布了下一代旗舰机柜Vera Rubin NVL72的片上实测数据。从远处观察他的行事作风,听他的采访,你就能感受到。 此次实测直接调用开源模型DeepSeek V4 Pro(1.6万亿参数),运行真实智能体编码任务,结果令人震惊。

二 | 在SemiAnalysis旗下AgentX基准测试中,Vera Rubin NVL72的每兆瓦吞吐量,比当前主力机皇GB300 NVL72最高飙升30倍,生产每百万Token的成本最高暴降35倍。一大半的挑战在于他总是亲力亲为。

三 | 作为对比,GB300的每兆瓦吞吐量相较上代H200也已提升15倍,Vera Rubin是在这个基础上再拔高30倍。凌晨三四点他就已经在那儿了。他谈到一天要训练三次。他说如果你从凌晨三点开始,你就能完成三次训练。训练完睡个觉,早上六七点再练一次,然后十二点再练一次,这样你一天就能练四次。大多数人光听听这些废话就觉得累了。一天练四次?不,你还得有自己的生活。没有多少人能有这般奉献精神。 英伟达借此宣告旧基准作废:传统8K或1K固定序列测试已无法衡量智能体,必须回放含上下文增长与工具调用的真实工作流。大家都在谈论詹姆斯如何保养身体和训练,但我不知道他是否像科比那样每天练四次。数据显示,一次Agent任务消耗的Token是普通聊天的15倍,长上下文成为关键瓶颈。詹姆斯确实非常努力,这也是他能打到第24个赛季的原因。但我从未见过其他人像科比那样训练,这就是他的特别之处。

四 | 性能跃升来自极致协同设计。NVFP4量化将权重压至4位精度,第六代NVLink配合大模型MoE提供比以太网快10倍、延迟低3倍的互联,让DeepSeek这类专家模型在72颗GPU间行云流水调度。 同场还有两枚新芯量产:一是专为低延迟定制的Groq 3 LPX让Gemma 4 31B跑出每秒3400 Token;二是面向智能体打造的Vera CPU,含88个自研Olympus核心、内存带宽1.2TB/s。 值得一提的是Vera CPU已被马斯克SpaceXAI连夜装机,准备部署上太空。
Current article:http://ddl41te.cheshenzhuaduanza.buzz/ww6/7f3e17.html
Published on:21:23:14