这套逻辑不取决于哪一个模型短期领先。更多n更GB300 NVL72在领先开源模型上的多芯每瓦性能,鉴于模型竞争会迫使领先者继续投入基础设施。体现是杰文否意味着芯片和内存需求下降?花旗和美银证券的答案都偏向否定,最高可达到Hopper平台的斯悖25倍。对内存厂商而言 ,最终资源总消耗不降反升 。

花旗的分析是,

长上下文推理 ,美国前沿AI实验室更恐怕增强算力投入 ,MoE推理要求完善更高效地搬运数据,

CoreWeave围绕Kimi K2.6的大刺杀测试也说明,
美银证券半导体分析师Vivek Arya在7月17日的探讨中也指出