美团悄悄开源万亿模型LongCat-2.0:22小时登顶全球前3
美团悄悄开源万亿模型LongCat-2.0:22小时登顶全球前3 OpenRouter 上全球最火的模型,跑出 10 万亿 token 的那个——竟然是美团做的 1.6 万亿 MoE。35 万亿 tokens 训练,全在 5 万张国产 AI 芯片上跑完,一块英伟达都没用。 外卖公司直接转型AI
美团悄悄开源万亿模型LongCat-2.0:22小时登顶全球前3
OpenRouter 上全球最火的模型,跑出 10 万亿 token 的那个——竟然是美团做的 1.6 万亿 MoE。35 万亿 tokens 训练,全在 5 万张国产 AI 芯片上跑完,一块英伟达都没用。
外卖公司直接转型AI
美团今天(6 月 30 日)正式上线 LongCat-2.0——但真正的故事其实从 22 小时前就开始了。
美团之前没打招呼,把这个模型以 Owl Alpha 的匿名代号悄悄挂上 OpenRouter(全球最大的 AI 模型聚合平台)。结果呢?默默跑了 22 小时,直接拿下 OpenRouter 日活 Top 3 全球。美团官推今天主动认领,给出的战绩更细:
- Hermes Agent:全球 #1
- Claude Code:全球 #2
- OpenClaw:全球 #3
你没看错——这三个是当下全球最主流的 AI 编程 Agent 框架。LongCat-2.0 直接在这三个框架的开发者使用榜上包揽前三。
这件事的反常之处在于:美团不是 AI 公司,是外卖公司。 一个靠送盒饭起家的公司,闷头 3 年做出一个全球开发者用脚投票选出来的最强开源模型——这个叙事本身就够反常识。
万亿模型里到底装了什么
LongCat-2.0 的硬参数有几个数字值得记住:
- 1.6 万亿总参数 / ~480 亿激活(MoE 架构,动态激活 33B-56B)
- 原生 1M 上下文(百万级,不是后来加的)
- 35 万亿 tokens 训练数据
- 5 万张国产 AI 芯片(ASIC,不是 GPU)
架构上美团自己提了三个创新:
LSA(Latent Sparse Attention)——把长文本的计算量压到线性增长,让 1M 上下文不再是堆算力的游戏。
Zero-Compute Experts——激活参数动态调整,每个 token 只激活 33B-56B,不浪费一点算力。
MOPD(Multi-expert Orchestration via Parallel Dispatch)——把专家分成 Agent / Reasoning / Interaction 三组,按任务门控路由,简单问题不调用贵的那组。
最关键的 benchmark:SWE-bench Pro 拿到 59.5 分——这是评估 AI 真实编程能力的硬指标,硅谷的开源旗舰基本都在这条线附近。这里要插一句:AIbase 之前翻译说"超越 GPT-5.5 和 Claude Opus 4.6"是过度演绎,美团原话只是"对标主流闭源"。
训练侧的数字更值得讲:35 万亿 tokens × 5 万张国产卡 × 3 年。美团透露他们靠自研的确定性算子和弹性恢复机制,把平均日故障率压下去 70% 以上,稳定日吞吐 1T tokens。3 年时间就为了把这套训练框架从"跑得动"打磨到"稳定跑出万亿模型"。
价格是真的便宜
SiliconFlow 同步上线 Day 0,价格表是这样的(每 1M tokens):
| 项 | 价格 |
|---|---|
| Input Cache(命中缓存) | $0.015 |
| Input(首次输入) | $0.75 |
| Output(生成) | $2.95 |
对比一下主流闭源旗舰(GPT-5、Claude Opus 这档)通常 Input 在 $3-15 之间——LongCat-2.0 的 Input 几乎是闭源旗舰的 1/4 到 1/20。对 Agent 开发者来说,这价格意味着同样的钱能跑 4-20 倍的 token 量,对长上下文任务(代码库分析、长文档总结)尤其友好。
这事意味着什么——三个判断
判断一:5 万张国产卡 ≠ 应急,是真打通了全流程。
很多人之前对国产 AI 芯片的印象是"推理能用,训练还得靠英伟达"。LongCat-2.0 是第一个全周期训练+推理都跑在国产 ASIC 集群上的万亿模型。这意味着从算子适配、通信优化到分布式稳定性这一整套工业级难题,国产芯片+国产框架是真打通了,不是 demo 级别。
判断二:开源旗舰的"性价比战争"还在加速。
DeepSeek 把闭源模型的价格打下来之后,国产阵营的开源旗舰就一直在追。LongCat-2.0 的定价基本是"再砍一刀"——而且这次不是靠补贴,是真的从硬件到训练栈全自主可控之后省出来的成本。闭源阵营如果不跟,要么失去长上下文市场,要么被迫降价——两难。
判断三:美团的野心不是外卖。
3 年时间砸出这个模型,又直接在 Hermes / Claude Code / OpenClaw 三个 Agent 框架里冲到全球前三——美团是在用"模型 + 工具链"的捆绑打法抢开发者心智。这跟当年字节靠 TikTok 算法抢用户一个逻辑:先用开源模型圈住全球开发者,再用工具链和应用层赚钱。
个人观点
LongCat-2.0 不一定是当下最强的模型(OpenRouter Top 3 是按调用量不是按绝对能力),但它证明了一件事:国产 AI 芯片已经能撑起万亿模型的工业级训练。这件事比单一模型的 benchmark 分数更重要——它把"国产卡只能跑推理"的行业认知直接掀了。
接下来 6 个月值得盯的,是看华为昇腾、寒武纪、海光这些国产 AI 芯片厂商,会不会借 LongCat-2.0 这波东风,把"训练卡 + 推理卡"的全栈方案真正推到企业级市场。如果跟上了,英伟达在中国市场的最后一块堡垒(万亿模型训练)就被正式攻破。
你怎么看
LongCat-2.0 这种"匿名试水 + 突然认领"的发布打法,你觉得是低调还是心机?
——以及更狠的那个问题:美团做这个模型,你觉得是真的为了 AI,还是为了给外卖业务找一个"科技公司"的新故事?
评论区聊聊
