美团开源LongCat-2.0:用国产芯片训练的1.6万亿参数编程模型来了
外卖巨头的AI野心
6月29日,美团低调开源了一个重量级项目——LongCat-2.0,一个拥有1.6万亿参数的大型编程语言模型。更令人瞩目的是,这个模型完全基于国产AI芯片训练完成。

是的,你没看错——那家以送外卖闻名的公司,如今在AI编程模型领域扔下了一枚「重磅炸弹」。
技术亮点:1.6T参数 + 纯国产算力
LongCat-2.0采用了MoE(混合专家)架构,激活参数约占总参数的15%左右,在推理效率上做了大量优化。模型专注于代码生成、代码理解和代码修复三大场景,覆盖Python、Java、C++、Go、TypeScript等主流编程语言。
但真正让人侧目的是它的训练基础设施。在Nvidia高端芯片出口受限的背景下,美团使用华为昇腾等国产AI芯片集群完成了全部训练——这意味着中国在摆脱对英伟达芯片依赖的道路上迈出了关键一步。
性能表现:进入第一梯队
根据公开的基准测试数据,LongCat-2.0在HumanEval代码生成评测中得分89.7%,与GPT-4系列处于同一水平线。在SWE-Bench真实代码修复任务上,其表现甚至超过了部分同级别的开源模型。
**关键数据**:在中文代码场景(中文注释理解、中文需求转代码)中,LongCat-2.0的表现显著优于所有非中国团队开发的模型,这是其最大的差异化优势。
开源策略背后的商业逻辑
美团为什么要把如此昂贵的模型开源?
答案可能有三层:第一,建立开发者生态——通过开源吸引开发者使用和贡献,形成事实标准;第二,展示技术实力——在AI人才争夺战中,开源顶级的模型是最好的招聘广告;第三,推动国产芯片生态——LongCat-2.0的成功训练,本身就是对国产AI芯片可行性的最强背书。
对行业的冲击
LongCat-2.0的发布让AI编程助手市场更加拥挤。GitHub Copilot、Cursor、Claude Code等产品已经在这个赛道激烈竞争,而现在又杀出了一个「中国版的DeepSeek Coder」。
对于普通开发者来说,这无疑是好事——更多的竞争者意味着更低的成本和更好的工具。但对于AI编程赛道的创业公司来说,巨头的入局会让差异化变得更加困难。
国产AI芯片的里程碑
LongCat-2.0的价值不仅在于模型本身。它证明了在先进制程受限的情况下,通过架构创新和工程优化,使用国产芯片同样可以训练出世界级的AI模型。这个信号对整个中国AI产业链来说,比模型本身的benchmark分数更具战略意义。
当年谁也想不到,美团会成为中国AI自研道路上的一匹黑马。但这就是AI时代的魅力——英雄不问出处,只看代码。
🔥 关注LC智趣厅,第一时间看到AI行业的真正变量
👇 关注不错过,每天三分钟,AI世界尽在掌握
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
