Grok 6
xAI 在 2026 下半年以 Grok 4.5(1.5 万亿参数、主打编程与 Agent)掀起价格战,Grok 4.6(2 万亿参数)预计 8 月接棒
Grok 6
xAI 在 2026 下半年以 Grok 4.5(1.5 万亿参数、主打编程与 Agent)掀起价格战,Grok 4.6(2 万亿参数)预计 8 月接棒
Upstage Solar 2
韩国 Upstage 推出的第二代旗舰大语言模型 Solar Pro 2,310 亿参数、单卡可跑、韩语霸榜且企业级落地扎实
Fireworks 2
由 PyTorch 原班团队创立的开源模型推理与训练云平台,主打在企业私有数据上定制「专属智能」
DeepSeek V4.5
深度求索 2026 年 7 月推出的旗舰大模型迭代版,强化代码、中文长文本与多轮一致性,延续开源与地板价打法
Claude Opus 5
Anthropic 2026 年 7 月推出的新一代 Opus 旗舰模型,主打百万级上下文与超强 agentic 编码,被官方称为全球最强编程模型,以约一半的价格逼近 Fable 5 的能力
Gemini 4.5 Pro
Google 旗下主打百万 token 长上下文与全模态理解的高性能旗舰大模型
Aleph Alpha 哥伦布
Aleph Alpha 面向欧洲企业与政府的主权 AI 平台,以合规、数据可控与可解释性为核心
网易 玉言 2
网易伏羲自研的中文角色扮演大模型,专攻剧情生成与人设对话,2026 年 6 月通过网信办备案
商汤 日日新 6
商汤第六代原生多模态大模型家族,以统一架构实现文本、图像、视频、语音的深度推理,并延伸出 6.7 Flash-Lite 办公智能体与开源 U1 统一模型
科大讯飞 星火 6
科大讯飞基于全国产算力训练的认知大模型,语音与教育两大场景极强,政企落地领先,但通用对话与代码能力偏中下
百度 文心 5.5
百度旗下全能 AI 助手,深耕中文知识问答、文学创作和逻辑推理场景,具备视频、图片、语音等多模态 AI 能力
Qwen3.5-Coder
阿里通义千问 Qwen 3.5 家族的代码专用开放权重模型,7B/32B 双尺寸、256K 上下文、Apache 2.0 可商用,主打本地部署的仓库级编程与 Coding Agent
Grok 5.5
xAI 的实时 AI 助手,唯一原生接入 X 实时数据流,Grok 5 测试版为 6 万亿参数 MoE 旗舰
Nemotron Ultra 253B
英伟达 253B 开放权重推理模型,文本推理与编码对标闭源旗舰,可商用
Gemma 5
谷歌 DeepMind 开放权重模型家族最新一代 Gemma 4(Apache 2.0,覆盖手机到服务器)
Claude Haiku 5
Anthropic 最快最便宜的模型(当前实为 Haiku 4.5),以接近旗舰的编码能力把成本和延迟压到最低
Mistral Codestral 2
Mistral 第二代代码专用模型,Apache 2.0 重新授权后可合法自托管与商用,擅长 IDE 内联补全
小米 MiMo 2
小米自研、面向智能体时代的开源大模型家族,开源可商用且 API 价格仅为闭源旗舰的几分之一
Yandex GPT 5
Yandex 第五代大语言模型家族,主打对俄语、俄罗斯法律与商业语境的深度适配
智源 RoboBrain Orca 世界模型
智源研究院推出的多模态表征世界模型,先学统一世界潜在表征再读出文本、图像与机器人动作
Amazon Nova 3
AWS 第三代自研多模态基础模型,延续前沿智能与极致性价比路线,深度集成 Bedrock 与 Agent 生态
Reka Core 2
Reka AI 第二代旗舰原生多模态模型,支持文本、图像、音频、视频理解,主打企业级可靠交付与 API 易用性
Inflection Pi 3
Inflection AI 旗舰对话模型,以共情式情感陪伴与高情商对话见长
Databricks DBRX 2
下一代开源 MoE 大模型
Anthropic Claude Opus 4.8
Anthropic 2026年5月发布的旗舰多模态推理模型,主打长程智能体编程、百万级上下文与更高诚实度
Google Gemini 4 Ultra
Google DeepMind 于 2026 年 5 月发布的第四代旗舰多模态大模型,支持千万级 Token 上下文、原生多模态生成与 Agentic 自主工作流,搭载第七代 Ironwood TPU
xAI Grok 5
xAI 正在开发的约 6 万亿参数 MoE 架构旗舰大模型,原生多模态并深度整合 X 平台实时数据流
Sakana AI Fugu Ultra
Sakana AI 发布的旗舰级多智能体编排基础模型,以单一 API 调度全球前沿模型、无需依赖单一供应商即可获得前沿性能
小红书 RedKnot
小红书开源的长文本大模型推理加速引擎,沿注意力头拆分 KV 缓存与 FFN,在近乎无损精度下大幅降低长上下文预填充算力与首字延迟
Kimi K3
月之暗面规划的 2.5 万亿参数旗舰大模型,主打 100 万 token 超长上下文与原生多模态