美团开源万亿参数大模型LongCat-2.0:国产算力集群完成全流程训练
7月11日,美团正式发布自研万亿参数大模型LongCat-2.0并宣布开源。该模型总参数达1.6万亿,采用混合专家架构,支持百万级Token上下文窗口,在多个基准测试中超越同量级开源模型。尤为值得关注的是,LongCat-2.0是业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型。
国产算力支撑万亿参数模型训练,打破技术壁垒
LongCat-2.0的发布具有重要意义。长期以来,训练万亿参数模型依赖英伟达等国外厂商的高端GPU。而LongCat-2.0完全基于国产算力集群完成训练,证明了国产AI算力已经具备支撑超大规模模型训练的能力。这一突破打破了国外算力垄断,为国产AI产业发展奠定了坚实基础。
混合专家架构提升效率,百万级Token上下文成标配
LongCat-2.0采用先进的混合专家(MoE)架构,在保持万亿参数规模的同时,大幅提升了推理效率。模型支持百万级Token上下文窗口,能够处理超长文档和复杂对话场景。在多个中文基准测试中,LongCat-2.0表现优异,超越了同量级的其他开源模型。
开源战略加速AI生态建设,美团正式加入大模型开源阵营
美团宣布将LongCat-2.0开源,这标志着美团正式加入大模型开源阵营。开源不仅有助于推动AI技术的普及和创新,也有助于建立美团在AI领域的技术影响力。开发者可以基于LongCat-2.0进行二次开发,加速AI应用的落地。
国产大模型百花齐放,AI产业自主化进程加速
随着美团LongCat-2.0的发布,国产大模型阵营又添一员猛将。此前,百度、阿里、腾讯、智谱AI等企业已经发布了多款大模型。国产大模型的百花齐放,正在加速中国AI产业的自主化进程,为人工智能应用的广泛落地提供了坚实支撑。
网友留言(0 条)