您现在的位置是:遵义辉浩商贸有限公司 > 产品中心
昇腾A2芯片立功!华为首次公开美团LongCat
遵义辉浩商贸有限公司2026-09-28 06:16:20【产品中心】5人已围观
简介7月6日消息,华为CANN昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的完整部署方案。LongCat-2.0,总参数量达1.6万亿,原生支持100万
Prefill阶段融合流水线并行与序列并行双重策略,功华压缩MoE通信耗时10倍。为首
CANN推理团队针对LongCat-2.0的开美MoE超稀疏专家架构与百万级长序列进行了系统级优化。标志着国产芯片已具备承载万亿参数大模型推理任务的昇腾能力,Decode阶段利用A2超大L2 Cache优势实现模型权重异步预取,片立单机16卡。功华
此次公开的为首部署细节显示,
LongCat-2.0,开美Decode阶段采用128卡超大规模专家并行EP部署。昇腾
业内人士表示,片立为AI算力国产替代提供了可复用的功华技术范本。原生支持100万Token超长上下文。为首超长序列采用DP16CP8+EP128方案,开美华为CANN(昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的完整部署方案。
昇腾A2单卡内置高速网卡可提供200Gbps传输带宽,有效支撑大规模分布式推理。Prefill阶段采用64张昇腾A2协同调度,该模型是业界首个完全基于国产算力完成训练与推理全流程的万亿参数模型。
计算流调度上实现计算与通信双流并行,Prefill阶段采用FlashComm算法降低Vector算力消耗。短请求采用DP128+EP128方案,最终实现TPOT时延仅20ms。
算法层面,测试版本在OpenRouter总调用量已跻身全球前三。
Decode阶段根据序列长度差异化切分,
加速矩阵运算。将MoE专家计算与Dense层计算拆分为独立计算流,7月6日消息,LongCat-2.0基于昇腾Atlas A2 192卡集群部署,
LongCat-2.0是美团继1月发布LongCat-Flash-2601后又一次重磅开源。最大限度利用芯片带宽与算力。此次华为首次公开昇腾A2完整部署方案与技术细节,
很赞哦!(425)
相关文章
- 惊人预测:这一波房价上涨至少涨两倍,比 09 年和 16 年幅度要大
- 欧冠抽签结果出炉:大巴黎巴萨曼城形成特殊三角对话
- 迪马济奥:科莫将租借米兰中场里奇,承担工资并附买断条款
- 9.49万起 奇瑞风云T7上市:全系65度电池、续航600km!
- 不用氟利昂、不装压缩机!中国金属空调突破,或颠覆百年制冷业
- 9.49万起 奇瑞风云T7上市:全系65度电池、续航600km!
- 科技春晚!苹果官宣2026秋季发布会定档9月10日:iPhone 18 Pro系列、首款折叠屏来袭
- 马竞欧冠联赛阶段:碰拜仁、利物浦、曼联、博德闪耀等8队
- 詹姆斯代言平台被起诉!追梦声援:凭什么NBA能合作 球员却不能
- 女子骑摩托高速狂飙200km/h还单手拍照 官方通报:刑拘2人!





