美团开源 1.6 万亿 MoE 大模型 LongCat-2.0,国产算力全链路完整跑通
美团正式开源 1.6 万亿 MoE 超大模型 LongCat-2.0,实现五万卡国产算力集群全链路训推落地,打破海外算力依赖,详解 LongCat-2.0 技术亮点、性能优势与行业价值。
美团正式开源 1.6 万亿 MoE 超大模型 LongCat-2.0,实现五万卡国产算力集群全链路训推落地,打破海外算力依赖,详解 LongCat-2.0 技术亮点、性能优势与行业价值。
6月30日,美团正式对外发布并开源新一代超大混合专家大模型LongCat-2.0(龙猫2.0),这次发布最核心的突破不在于万亿级参数规模,而是实现完整训推流程100%依托国产算力,成为行业首个在五万卡国产算力集群完成从零预训练、线上推理全链路落地的万亿参数大模型,彻底打破“国产芯片只适合推理、大规模训练必须依赖海外高端GPU”的固有认知。
LongCat-2.0采用当前主流高效的MoE混合专家架构,纸面总参数规模达到1.6万亿,不同于稠密大模型全部参数参与计算,它依靠动态路由机制,单段文本平均仅激活480亿参数,浮动区间33B~56B,兼顾超大容量与推理成本可控。
配套训练数据体量同样惊人,累计消耗超30万亿Tokens预训练素材,覆盖中文通用文本、英文资料、海量开源代码、行业业务文档多维度数据,为长文本、代码、智能体任务打下扎实基础。
两大标志性能力直接拉满实用上限:
正式版上线前,该模型曾以匿名代号Owl Alpha在OpenRouter平台灰度测试,上线后快速冲到全球调用量前三,在代码生成赛道的月调用量稳居头部,收获大量海外开发者实测认可。
这次LongCat-2.0真正改变行业格局的亮点,是完整训练、推理全链路仅使用国产算力芯片,峰值调度超5万张国产加速卡,全程未使用一张英伟达显卡,完成业内首个万亿参数模型全国产算力闭环验证。
美团从2023年就启动“模芯协同”联合攻关,花费三年时间和国产算力厂商逐一解决万卡集群训练的各类工程痛点,落地多项自研底层优化方案:
在此之前,国内不少大模型厂商都会搭配海外GPU完成预训练,国产芯片仅做线上推理。LongCat-2.0的落地直接证明:现有国产算力集群,完全有能力承载工业级万亿参数大模型全周期开发,算力自主可控路线具备完整可行性。
为适配国产硬件并释放超大模型性能,美团团队在LongCat-2.0中落地三项自研核心技术,全部随开源包对外公开:
传统大模型处理百万字上下文时,注意力计算量呈平方级暴涨,硬件压力极大。自研LSA架构把计算复杂度降至线性级别,搭配分层索引复用,大幅降低长文本场景显存占用,也是它能稳定支撑1M上下文的核心底层支撑。
实现Token级精细化算力分配:短句、简单指令等轻量化文本,仅激活少量专家网络,节省算力开销;复杂代码、多步骤推理、超长文档自动调度更多专家模块深度运算,避免统一激活造成的资源浪费,大幅降低大规模推理成本。
把海量专家网络按场景划分三大组别:Agent工具调用、数学逻辑推理、多轮交互对话,输入内容自动分流至对应专业专家,专项任务精度明显提升。搭配1350亿参数Ngram嵌入模块,强化字词组合语义表达,减少长文本理解断层问题。
在全球通用代码评测基准SWE-bench Pro中,LongCat-2.0拿到59.5分,超过GPT-5.5(58.6)、Claude Opus 4.6(57.3),在国产开源大模型里代码能力稳居第一梯队。
结合普通开发者实际使用场景,优势集中在三块:
美团官方确认,LongCat-2.0配套内容将同步开源,包含模型权重、分布式训练基础设施、国产算力适配推理引擎、完整算子优化代码,个人开发者、中小企业、科研机构均可免费获取商用授权,不用再从零搭建万亿模型国产训练底层框架。
对整个行业来说,开源带来两层实际价值:
LongCat-2.0的发布,不只是又一款万亿参数开源大模型,更是国内AI产业发展的关键转折点。
过去国内大模型竞争大多比拼参数规模、通用评测分数,底层算力高度依赖海外硬件,一旦供应链受限,大规模训练项目极易停滞。而这次五万卡国产集群完整跑通万亿模型,给出清晰可行的替代路线:
放在全球AI开源格局来看,在GPT、Claude等闭源模型持续收紧商用权限、抬高调用定价的背景下,全栈自主的国产万亿开源模型,也给全球开发者提供了一套低成本、无封锁的替代选择。
作为国内首个全国产算力万亿级模型,LongCat-2.0仍存在现阶段无法回避的短板,开发者落地时需要提前规划:
从三年前启动国产算力小规模验证,到如今五万卡集群稳定训练1.6万亿MoE大模型并全面开源,美团LongCat-2.0完成了国产AI算力产业一次关键的实战验证。
参数规模只是表象,真正值得关注的是它证明:我们完全可以依靠本土算力硬件、本土工程团队,独立完成全球第一梯队超大模型从训练到上线的全部流程。随着这套方案开源扩散,未来会有更多企业依托国产算力打造专属大模型,国内AI产业算力自主、技术自主的发展节奏,也会进一步提速。