LongCat

美团自研的5600亿参数开源MoE大模型平台,支持文本、图像、视频等多模态能力

深度报告

  • LongCat(龙猫)是美团于2024年3月21日发布的自研生成式AI大模型,2025年8月正式推出 LongCat- Flash-Chat 在线体验平台。该模型采用混合专家(MoE)架构,总参数达5600亿,创新的零计算专家机制(Zero-NVE)可大幅降低训练和推理成本。LongCat在编程、指令遵循和智能体任务中表现卓越,定位为美团内部的AI基础设施,同时通过 API 开放平台向外部开发者提供服务。2026年4月,智谱与美团签署战略合作协议,共同推进AI技术创新。

  • LongCat由美团视觉智能中心(VIC)主导研发,核心技术源自美团自研的生成式大语言模型。2024年3月发布LongCat基座模型,2025年8月上线 LongCat- Flash-Chat 对话平台。美团将AI视为提升内部运营效率的核心能力,LongCat支撑了美团外卖、到店、酒旅等多条业务线���智能化升级。此外,美团还通过API开放平台向开发者提供模型服务。2026年4月,智谱AI与美团签署战略合作协议,在模型能力互补、API互通等方面开展合作。

  • LongCat平台的核心能力覆盖四大方向:文本对话与创作,支持知识问答、文本生成、写作润色、数据分析、数学计算等日常助理场景;图像生成与编辑,支持文生图、图生图等视觉创作;视频生成,支持简短视频内容的智能生成;语音通话,支持语音对话的多模态交互。LongCat- Flash- Chat还提供深度思考模式(LongCat- Think),用于复杂推理任务。平台面向开发者的 API 支持批量调用和工具调用,可嵌入第三方应用。

  • LongCat采用 MoE(混合专家)架构,总参数约5600亿,零计算专家机制(Zero-NVE)通过动态激活子模型降低推理成本,提升计算效率。模型支持128K上下文窗口,能够处理长文本和多轮对话。在编程能力上,LongCat已在多个权威评测中超越 GPT-4 等标杆模型。在多模态方向,LongCat同时处理文本和图像,支持图文混合输入输出,实现了真正意义上的多模态理解和生成。

  • LongCat采用开源策略,模型权重已在Hugging Face和GitHub平台开源发布,开发者可免费获取并在本地部署。这一策略与智谱GLM、DeepSeek等国产开源模型形成了竞争态势。商业化路径通过API调用收费和私有化部署服务实现,面向企业客户提供定制化的模型微调和部署支持。开源社区对LongCat的技术创新给予了积极评价。

  • LongCat的响应速度快是用户最常提及的亮点。在多个第三方评测中,LongCat在编程任务上的表现可对标 GPT-4,显示出强大的代码生成和推理能力。美团内部员工表示,LongCat已在多个业务场景中替代了原有的 AI 辅助工具,提升了工作效率。多模态能力的整合也是用户好评的原因之一。 主要痛点在于:LongCat目前主要面向企业内部和合作开发者,普通用户直接体验的入口相对有限;开源版本与线上版本的能力可能存在差异,需要开发者具备一定的技术能力才能部署使用。

用户评论

  • 头像
    tub0594xm
    缓存免费是真的香,省了不少钱!

  • 头像
    戴秀
    速度太慢了,等得心累。

  • 头像
    Debra329
    在Claude Code里接上LongCat-2.0跑了一周,缓存命中率能到90%以上,成本确实低。但遇到复杂bug修复还是不太行。

  • 头像
    Emma_Murray168
    国产算力跑出万亿模型这个是真没想到,1M上下文做代码分析太方便了。

  • 头像
    6m938ys
    用了两个星期LongCat-2.0,整体感觉就是适合后台批量任务。缓存免费这个策略真的很聪明,OpenClaw里反复调工具的时候费用优势太明显了。不过如果你想要一个反应快的聊天助手,那还是算了,思考时间动不动就几十秒,急性子真受不了。

  • 头像
    Joyce_GomezQ
    Owl Alpha骗了全世界结果就是美团的外卖模型,笑死。

  • 头像
    Alice_FosterII
    SWE-bench上面跑分看着确实不错,比GPT-5.5还高一点。不过第三方实测说实际体验跟跑分有落差,这个要注意。

  • 头像
    DGonzales_7
    写代码能力整体ok的,我在Codex里试了一下让它重构一个旧插件,它能自己分析架构然后生成新代码,编译一次过。但让它修一个小bug反而卡了半天,这种反差挺迷惑的。感觉策略上还需要优化。

  • 头像
    RogerMitchell
    免费token送1000万,真·大方。

  • 头像
    Pamela.Morales520427
    MIT开源是好事,但权重到现在还没完全放出来吧?说是理论上的MIT。而且所有benchmark都是vendor-reported,独立验证还没看到。

  • 头像
    张睿云
    用LongCat做自动写周报和每日新闻摘要,后台跑着就行不用等,成本几乎为零,很香。

  • 头像
    Brittany_Williams168
    测了一周LongCat-2.0,优点和缺点都很极端。优点:1M上下文足以塞下整个项目,缓存免费让长期使用成本极低,SWE-bench Pro 59.5确实能打。缺点:响应速度慢,复杂任务稳定性不够,creative writing比较平淡,而且不支持多模态看图。建议当agent后端用,别当主力聊天模型。

  • 头像
    Janew498
    重思考模式下推理确实强,AIME能拿满分,但等它思考完你得有耐心。

  • 头像
    Eric_FloresSr
    3D生成能力给我惊喜了,一句话就能生成可交互的Three.js场景,而且效果还不错。做原型演示够用了。

  • 头像
    菊花_4
    免费token用不完,缓存不计费,适合养马养虾。

  • 头像
    阎丹刚
    作为每天写代码的开发者,我觉得LongCat-2.0最大的价值在于它证明了国产算力这条路能走通。五万卡集群训出万亿模型,这个工程能力是真的硬。实际用下来写Python和TypeScript的agent任务完成度挺高的,但写前端UI的时候经常有细节问题。如果团队预算敏感又需要长上下文coding能力,值得一试。

  • 头像
    JRoss3691
    消费档位太尴尬了,一个月400的看不上这点便宜,普通用户几十块预算又用不起。定位有点迷。

  • 头像
    EthanGonzalez_2022
    开源免费的万亿模型,还要啥自行车。

  • 头像
    Amanda848
    缓存命中率98%,一天用250万token只消耗18万,这性价比确实离谱。接OpenClaw跑多工具循环任务最适合,Agent工作流里反复调工具的时候费用优势特别明显。但日常对话还是算了,响应速度感人,急性子真受不了。

  • 头像
    KellyColeman_88
    说实话比预期好很多,匿名上OpenRouter冲到全球调用量前三不是没原因的。Agent能力接近Claude Opus 4.6了,代码生成和工具调用确实在开源模型里算顶尖水平。但creative writing这块还是明显短板,写小说比较平淡,而且不支持多模态看图,应用场景受限。

  • 头像
    SawyerWerner
    美团这个 LongCat 响应速度真的快,5600亿参数不是盖的

  • 头像
    STwri
    MoE架构确实高效,零计算专家机制很创新

  • 头像
    Teresa.Thomas_2021
    编程能力可以直接对标 GPT-4 了,国产之光

  • 头像
    DrEllaWhite
    LongCat 开源了!5600亿参数全开,美团大气

  • 头像
    吴芳
    多模态能力整合得很不错,图文都能处理

  • 头像
    4zwain8w
    128K上下文太够用了,长文档随便喂

  • 头像
    Bruce_Foster369
    LongCat-Think 深度思考模式解决复杂问题很有效

  • 头像
    KeithBarnesII
    API 平台文档很清晰,接入很方便

  • 头像
    Blake829
    智谱和美团合作了,强强联合,期待更多能力

  • 头像
    BlockWave
    美团内部应用 LongCat 效果不错,外部也开放了