关于我们

昇腾A2芯片立功!华为首次公开美团LongCat

字号+ 作者:遵义湘香进出口有限公司 来源:关于我们 2026-09-26 20:47:21 我要评论(0)

7月6日消息,华为CANN昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的完整部署方案。LongCat-2.0,总参数量达1.6万亿,原生支持100万

昇腾

昇腾

业内人士表示,片立单机16卡。功华超长序列采用DP16CP8+EP128方案,为首为AI算力国产替代提供了可复用的开美技术范本。将模型划分为8个独立计算Stage,昇腾测试版本在OpenRouter总调用量已跻身全球前三。片立加速矩阵运算。功华短请求采用DP128+EP128方案,为首将MoE专家计算与Dense层计算拆分为独立计算流,开美Prefill阶段采用FlashComm算法降低Vector算力消耗。昇腾压缩MoE通信耗时10倍。片立

Decode阶段根据序列长度差异化切分,功华LongCat-2.0基于昇腾Atlas A2 192卡集群部署,为首华为CANN(昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的开美完整部署方案。Decode阶段采用128卡超大规模专家并行EP部署。

昇腾A2单卡内置高速网卡可提供200Gbps传输带宽,有效支撑大规模分布式推理。

LongCat-2.0是美团继1月发布LongCat-Flash-2601后又一次重磅开源。

计算流调度上实现计算与通信双流并行,最大限度利用芯片带宽与算力。该模型是业界首个完全基于国产算力完成训练与推理全流程的万亿参数模型。此次华为首次公开昇腾A2完整部署方案与技术细节,Decode阶段利用A2超大L2 Cache优势实现模型权重异步预取,原生支持100万Token超长上下文。

CANN推理团队针对LongCat-2.0的MoE超稀疏专家架构与百万级长序列进行了系统级优化。

LongCat-2.0,

7月6日消息,

此次公开的部署细节显示,最终实现TPOT时延仅20ms。标志着国产芯片已具备承载万亿参数大模型推理任务的能力,Prefill阶段采用64张昇腾A2协同调度,

算法层面,总参数量达1.6万亿,

Prefill阶段融合流水线并行与序列并行双重策略,

1.本站遵循行业规范,任何转载的稿件都会明确标注作者和来源;2.本站的原创文章,请转载时务必注明文章作者和来源,不尊重原创的行为我们将追究责任;3.作者投稿可能会经我们编辑修改或补充。

相关文章
  • 博主借零跑车主之名造谣带货 知情人:零跑要求对方赔偿1元

    博主借零跑车主之名造谣带货 知情人:零跑要求对方赔偿1元

    2026-09-26 20:32

  • 全面升级与优化!《异度之刃3》NS2版 升级内容介绍

    全面升级与优化!《异度之刃3》NS2版 升级内容介绍

    2026-09-26 19:24

  • 一体机也能换CPU!超频三融核换装酷睿Ultra X7:性能终于不拉胯了

    一体机也能换CPU!超频三融核换装酷睿Ultra X7:性能终于不拉胯了

    2026-09-26 19:21

  • 《塞尔达传说》40周年庆典汇总!直面会信息量爆炸

    《塞尔达传说》40周年庆典汇总!直面会信息量爆炸

    2026-09-26 19:20

网友点评