深度报告
-
LongCat(龙猫)是美团于2024年3月21日发布的自研生成式AI大模型,2025年8月正式推出 LongCat- Flash-Chat 在线体验平台。该模型采用混合专家(MoE)架构,总参数达5600亿,创新的零计算专家机制(Zero-NVE)可大幅降低训练和推理成本。LongCat在编程、指令遵循和智能体任务中表现卓越,定位为美团内部的AI基础设施,同时通过 API 开放平台向外部开发者提供服务。2026年4月,智谱与美团签署战略合作协议,共同推进AI技术创新。
-
LongCat由美团视觉智能中心(VIC)主导研发,核心技术源自美团自研的生成式大语言模型。2024年3月发布LongCat基座模型,2025年8月上线 LongCat- Flash-Chat 对话平台。美团将AI视为提升内部运营效率的核心能力,LongCat支撑了美团外卖、到店、酒旅等多条业务线���智能化升级。此外,美团还通过API开放平台向开发者提供模型服务。2026年4月,智谱AI与美团签署战略合作协议,在模型能力互补、API互通等方面开展合作。
-
LongCat平台的核心能力覆盖四大方向:文本对话与创作,支持知识问答、文本生成、写作润色、数据分析、数学计算等日常助理场景;图像生成与编辑,支持文生图、图生图等视觉创作;视频生成,支持简短视频内容的智能生成;语音通话,支持语音对话的多模态交互。LongCat- Flash- Chat还提供深度思考模式(LongCat- Think),用于复杂推理任务。平台面向开发者的 API 支持批量调用和工具调用,可嵌入第三方应用。
-
LongCat采用 MoE(混合专家)架构,总参数约5600亿,零计算专家机制(Zero-NVE)通过动态激活子模型降低推理成本,提升计算效率。模型支持128K上下文窗口,能够处理长文本和多轮对话。在编程能力上,LongCat已在多个权威评测中超越 GPT-4 等标杆模型。在多模态方向,LongCat同时处理文本和图像,支持图文混合输入输出,实现了真正意义上的多模态理解和生成。
-
LongCat采用开源策略,模型权重已在Hugging Face和GitHub平台开源发布,开发者可免费获取并在本地部署。这一策略与智谱GLM、DeepSeek等国产开源模型形成了竞争态势。商业化路径通过API调用收费和私有化部署服务实现,面向企业客户提供定制化的模型微调和部署支持。开源社区对LongCat的技术创新给予了积极评价。
-
LongCat的响应速度快是用户最常提及的亮点。在多个第三方评测中,LongCat在编程任务上的表现可对标 GPT-4,显示出强大的代码生成和推理能力。美团内部员工表示,LongCat已在多个业务场景中替代了原有的 AI 辅助工具,提升了工作效率。多模态能力的整合也是用户好评的原因之一。 主要痛点在于:LongCat目前主要面向企业内部和合作开发者,普通用户直接体验的入口相对有限;开源版本与线上版本的能力可能存在差异,需要开发者具备一定的技术能力才能部署使用。
用户评论
-
tub0594xm—缓存免费是真的香,省了不少钱! -
戴秀—速度太慢了,等得心累。 -
Debra329—在Claude Code里接上LongCat-2.0跑了一周,缓存命中率能到90%以上,成本确实低。但遇到复杂bug修复还是不太行。 -
Emma_Murray168—国产算力跑出万亿模型这个是真没想到,1M上下文做代码分析太方便了。 -
6m938ys—用了两个星期LongCat-2.0,整体感觉就是适合后台批量任务。缓存免费这个策略真的很聪明,OpenClaw里反复调工具的时候费用优势太明显了。不过如果你想要一个反应快的聊天助手,那还是算了,思考时间动不动就几十秒,急性子真受不了。 -
Joyce_GomezQ—Owl Alpha骗了全世界结果就是美团的外卖模型,笑死。 -
Alice_FosterII—SWE-bench上面跑分看着确实不错,比GPT-5.5还高一点。不过第三方实测说实际体验跟跑分有落差,这个要注意。 -
DGonzales_7—写代码能力整体ok的,我在Codex里试了一下让它重构一个旧插件,它能自己分析架构然后生成新代码,编译一次过。但让它修一个小bug反而卡了半天,这种反差挺迷惑的。感觉策略上还需要优化。 -
RogerMitchell—免费token送1000万,真·大方。 -
Pamela.Morales520427—MIT开源是好事,但权重到现在还没完全放出来吧?说是理论上的MIT。而且所有benchmark都是vendor-reported,独立验证还没看到。 -
张睿云—用LongCat做自动写周报和每日新闻摘要,后台跑着就行不用等,成本几乎为零,很香。 -
Brittany_Williams168—测了一周LongCat-2.0,优点和缺点都很极端。优点:1M上下文足以塞下整个项目,缓存免费让长期使用成本极低,SWE-bench Pro 59.5确实能打。缺点:响应速度慢,复杂任务稳定性不够,creative writing比较平淡,而且不支持多模态看图。建议当agent后端用,别当主力聊天模型。 -
Janew498—重思考模式下推理确实强,AIME能拿满分,但等它思考完你得有耐心。 -
Eric_FloresSr—3D生成能力给我惊喜了,一句话就能生成可交互的Three.js场景,而且效果还不错。做原型演示够用了。 -
菊花_4—免费token用不完,缓存不计费,适合养马养虾。 -
阎丹刚—作为每天写代码的开发者,我觉得LongCat-2.0最大的价值在于它证明了国产算力这条路能走通。五万卡集群训出万亿模型,这个工程能力是真的硬。实际用下来写Python和TypeScript的agent任务完成度挺高的,但写前端UI的时候经常有细节问题。如果团队预算敏感又需要长上下文coding能力,值得一试。 -
JRoss3691—消费档位太尴尬了,一个月400的看不上这点便宜,普通用户几十块预算又用不起。定位有点迷。 -
EthanGonzalez_2022—开源免费的万亿模型,还要啥自行车。 -
Amanda848—缓存命中率98%,一天用250万token只消耗18万,这性价比确实离谱。接OpenClaw跑多工具循环任务最适合,Agent工作流里反复调工具的时候费用优势特别明显。但日常对话还是算了,响应速度感人,急性子真受不了。 -
KellyColeman_88—说实话比预期好很多,匿名上OpenRouter冲到全球调用量前三不是没原因的。Agent能力接近Claude Opus 4.6了,代码生成和工具调用确实在开源模型里算顶尖水平。但creative writing这块还是明显短板,写小说比较平淡,而且不支持多模态看图,应用场景受限。 -
SawyerWerner—美团这个 LongCat 响应速度真的快,5600亿参数不是盖的 -
STwri—MoE架构确实高效,零计算专家机制很创新 -
Teresa.Thomas_2021—编程能力可以直接对标 GPT-4 了,国产之光 -
DrEllaWhite—LongCat 开源了!5600亿参数全开,美团大气 -
吴芳—多模态能力整合得很不错,图文都能处理 -
4zwain8w—128K上下文太够用了,长文档随便喂 -
Bruce_Foster369—LongCat-Think 深度思考模式解决复杂问题很有效 -
KeithBarnesII—API 平台文档很清晰,接入很方便 -
Blake829—智谱和美团合作了,强强联合,期待更多能力 -
BlockWave—美团内部应用 LongCat 效果不错,外部也开放了