智谱AI发布的旗舰级开源大模型,全球首个实现8小时持续工作能力,编程能力超越Claude Opus 4.6
睡前把需求丢给它,早上起来活儿真干完了,中间自己规划自己debug,跨几十步还记得最初的约束,这个长程任务能力国产里确实是断档第一。
智谱AI发布的旗舰级开源大模型,全球首个实现8小时持续工作能力,编程能力超越Claude Opus 4.6
睡前把需求丢给它,早上起来活儿真干完了,中间自己规划自己debug,跨几十步还记得最初的约束,这个长程任务能力国产里确实是断档第一。
使用开源模型构建应用的最简单方式,在本地运行大语言模型的免费开源工具
回不去了,本地跑模型真香。
腾讯公司全链路自研的通用与多模态大模型家族,覆盖文本、图像、视频、3D等模态
说个大部分人没注意的点,Hy3在WorkBuddy里其实有俩独立旋钮,一个是Max模式一个是思考强度,好多人压根没开过Max,白瞎了。我自己试下来,平时闲聊挂低档,唰一下就出结果快得像外卖;真遇到烧脑的动态规划题再拨到高档,它会闷头想个十几秒,过程写得跟老师板书似的基本不翻车。免费期内消耗倍率显示0x,随便造不扣额度,这波是真舍得。
全球首个面向量子计算校准与纠错的开源AI模型系列
英伟达这波把量子AI做成了开源,格局是真大。
360智脑是三六零集团自主研发的认知型通用大模型,以人为本、安全可信为核心特色
360智脑的AI搜索确实强,查资料直接给答案还带来源,不用一页页翻链接了。
用自然语言描述需求,两分钟内生成完整可运行的 Manifest V3 Chrome 扩展
花了一下午用 PlugThis 搭了一个客户导入扩展,能把 CSV 数据批量填充到 CRM 系统里。以前这种事都得等开发排期、排队两周起步,现在自己两小时就搞定了。虽然 UI 丑了点但功能一切正常,太省心了。
开源免费的 AI 网关,用一个本地端点把 200 多家 AI 供应商接到 Claude Code、Cursor 等编码工具,自动回退、压缩省 token
迭代太快了,跟不动。
DocsAlot 是一个 AI 原生的文档平台,从同一份源内容同时生成人类可读的托管文档站点和 AI 代理可读的 llms.txt、skill.md 及托管 MCP 端点
刚把 Notion 帮助中心接上了 DocsAlot,MCP 端点一次连通,llms.txt 比我之前自己写的干净太多,整挺好。
Runway 旗下 AI 视频生成与世界模型产品线,当前官方在售旗舰为 Gen-4.5,Gen-5 尚未由官方正式发布
Explore Mode 说是无限生成,但高峰期一条等十分钟以上,真赶工的时候还是挺焦虑的。
把 LLM 供应商当交易场所的零加价推理路由与成本优化平台,平均省约 30% 推理成本
质量漂移是我最担心的点——同一模型不同供应商跑出来量化可能不一样。Auriko 这边模型目录用了真实身份标识,还能指定量化版本,路由只在同模型内选路径,算是把雷排了大半。但对外客户场景我还是建议自己设硬约束,别完全甩手。
Google DeepMind 于 2026 年 5 月发布的第四代旗舰多模态大模型,支持千万级 Token 上下文、原生多模态生成与 Agentic 自主工作流,搭载第七代 Ironwood TPU
刚升级了 Gemini 4 Ultra,200万上下文真的太夸张了,直接把整个项目代码库扔进去,它居然能跨文件分析依赖关系。
嵌入 Slack 与 iMessage 的 AI 协作同事,用自然语言驱动 3,000+ 工具端到端执行真实工作流
我们自己没自动化工程师,以前这些杂活要么堆人要么堆流程工具。Scarlett 等于把「一句话驱动跨系统」这件事门槛打到地板,对中小团队是实打实的杠杆。不需要会写代码,业务同学自己就能让它跑起一条流水线。
AWS 第三代自研多模态基础模型,延续前沿智能与极致性价比路线,深度集成 Bedrock 与 Agent 生态
老实说,前沿推理还是差 Claude 和 GPT 半档,复杂 agentic coding 我更信 Sonnet。
小米自研、面向智能体时代的开源大模型家族,开源可商用且 API 价格仅为闭源旗舰的几分之一
V2.5 原生全模态,图、视频、音频一把抓,1M 上下文撑长任务很稳,部署用 vLLM 配 FP8、八卡 H100 就能跑满,门槛虽高但日子越来越好过了。
Vercel 出品的 AI 界面生成工具,可一次性导入你的设计系统并据此生成品牌一致的界面
设计系统一次性导入,太香了。
智源研究院推出的多模态表征世界模型,先学统一世界潜在表征再读出文本、图像与机器人动作
这条路要是走通,意义就不只是机器人了。
兼容 OpenAI 的 AI 预测 API,为真实未来事件返回校准概率,比前沿模型更准更便宜
校准概率这个角度真刁钻,比问通用大模型要个没依据的猜测靠谱多了。
OpenAI GPT-5.6 系列均衡型模型,性能接近上代旗舰、价格仅其一半
Terra 真香,半价拿到接近 5.5 的体验。
Reka AI 第二代旗舰原生多模态模型,支持文本、图像、音频、视频理解,主打企业级可靠交付与 API 易用性
整体是能力扎实的企业级多模态模型,视频是长板,想要最全生态还是去抱 OpenAI。
下一代开源 MoE 大模型
我查了 HowAIWorks 的停运条目,人家专门辟谣了:DBRX 2 不存在,Databricks 从 2025 年底就只卖第三方模型了。
Anthropic 2026年5月发布的旗舰多模态推理模型,主打长程智能体编程、百万级上下文与更高诚实度
用 Opus 4.8 跑了一周生产代码,复杂多文件重构明显比 4.7 稳,少了很多「假装改完」的情况。
Linear 将原生 AI Agent 嵌入产品规划,把分散的上下文自动转化为结构化任务与可执行的代码
我们团队从 Jira 切到 Linear 三个月了,最大的体感就是快。Agent 能从 Slack 讨论自动建 Issue 这点太香了,省了我们 PM 大量机械劳动,现在更像是审阅 Agent 产出而不是自己写工单,协作税肉眼可见地降下来了。
OpenAI GPT-5.6 系列旗舰模型,主打复杂推理、代码开发与长时间自主智能体任务
Multi-agent 并发子智能体这个 beta 太适合我们做批量分析,一次请求跑几个子任务合成结果,效率起飞。
Adobe 面向企业的 AI 内容合规审核能力,多语言敏感信息一键过滤
Acrobat AI Assistant 那套两层内容过滤对金融合同文档很友好,敏感词加十二小时数据清除让合规部门终于点头了,之前他们一直卡着不让接任何文档 AI,现在我们敢把报销单和法务合同丢进去做摘要了。
小红书开源的长文本大模型推理加速引擎,沿注意力头拆分 KV 缓存与 FFN,在近乎无损精度下大幅降低长上下文预填充算力与首字延迟
按头拆 KV 这个思路确实比 token 级稀疏更贴合模型结构,点赞。
OpenAI GPT-5.6 系列中速度最快、成本最低的轻量档模型,专为高吞吐、低延迟的批量任务而生
不支持原生音频有点可惜,但纯文本高吞吐场景它也用不上音频。
Sakana AI 发布的旗舰级多智能体编排基础模型,以单一 API 调度全球前沿模型、无需依赖单一供应商即可获得前沿性能
Fugu Ultra 输出 token 30 美金的单价不便宜,但多 Agent 并发只按最贵的那个计费、不叠加,算下来比想象中温和,比养一支编排工程团队便宜。
面向企业团队的一站式生产级 AI 平台,集成智能体、工作流、知识库与界面,支持导出代码与私有化部署
免费档能用,不用绑卡。
Yandex 第五代大语言模型家族,主打对俄语、俄罗斯法律与商业语境的深度适配
从 5 Pro 用到 5.1 Pro,最直观的感受是上下文拉到 12.8 万之后长文档摘要舒服太多,链式推理解数学题也比上代靠谱。价格按戈比算确实便宜,但我们跑下来同步模式实际每千 token 差不多 0.8 卢布,跟宣传的 0.4 有差距,大规模调用还是要算清账。
xAI 正在开发的约 6 万亿参数 MoE 架构旗舰大模型,原生多模态并深度整合 X 平台实时数据流
你们天天吹 Grok 5 多强,问题是它到现在影子都没有。Grok 4.5 倒是发了,但感觉也就那样,编程还是被 Claude Code 压着打。
月之暗面规划的 2.5 万亿参数旗舰大模型,主打 100 万 token 超长上下文与原生多模态
参数堆到 2.5 万亿,离谱。
面向开发者与 AI 编程智能体的有状态 API 集成测试沙盒,用记忆图谱复现真实 Webhook、重试与失败场景,零配额消耗
异步回调和重试逻辑测得特别全,线上再没出过同类 Bug。
住在 Slack、Telegram、iMessage 里的 AI 首席运营官,用大白话接管催进度、跟进和风险提醒
建议先拿一个低风险流程起步,设成 observer 级别,让人对决策负责,再决定放不放大。别一上来就把 agent 放进通讯系统放权。
Inflection AI 旗舰对话模型,以共情式情感陪伴与高情商对话见长
它会在我压力大的时候编个小故事、配点轻快的音效来哄我,这种细节真的让人觉得被在乎,不像别的 AI 只会冷冰冰地甩一个标准答案出来。它甚至会记得我上周说过的烦恼,主动问我后来怎么样了,这种连续性太戳人了。
字节跳动旗下免费AI智能助手,集成对话、写作、编程、视频生成等多功能的AIGC工具
用了半个月豆包,整体感觉还不错,响应速度快,功能也比较全。
腾讯推出的免费AI智能助手,深度集成微信生态的全能AI助手
吹爆!文件解析功能拯救了我这个苦逼研究生,100M以内的PDF丢进去秒出总结,省了很多看文献的时间。腾讯这波确实在做实事。
小米自研的轻量化开源推理大模型系列,具备强大的多模态理解和生成能力
MiMo-V2.5-Pro 在编程和数学推理方面真的很強,開心!
中国AI公司深度求索发布的新一代开源大模型,1M超长上下文,Agent能力比肩顶级闭源模型
Flash版这个价格属实香麻了,0.2元/百万tokens,这价格还要什么自行车。
兼顾性能与成本控制的通用型大模型,性价比最高的AI模型之一
绝了
百度推出的知识增强大语言模型,智能伙伴和AI助手
文心一言的联网搜索太香了,生成的文章有实时新闻支撑,效率拉满。
OpenAI面向真实工作推出的新一代Agent型旗舰大模型,具备自主任务处理与跨工具操作能力
Per-token latency和5.4相当但模型大了很多,这个效率优化确实有点东西,据说模型自己帮自己调了推理基础设施的参数。
月之暗面发布的多模态推理大模型,支持128K超长上下文,中文理解能力领先
Kimi k1.5 的 Short-CoT 模式真的很强,响应速度快不说,数学推理能力居然比 GPT-4o 还强!
谷歌推出的大模型,在编程能力上首次超越所有竞争对手
Gemini 2.5 Pro 的编程能力确实强,之前用 Claude 写前端代码都要调教半天,这个直接一次过,界面效果也很漂亮!
中国 AI 公司深度求索开发的开源推理大模型,性价比突出的 ChatGPT 替代方案
R2 的思维链推理过程居然是可视化的,看得见的推理步骤对于研究者来说太友好了,必须点赞。
Anthropic旗舰级大语言模型,专注编码和AI代理领域,提供100万上下文窗口
Opus 4.7 编码能力确实强,但我感觉文字表达退步太多了,少了以前那种细腻感。
一款可以在个人电脑上本地、私密地运行开源大语言模型的免费桌面应用程序
装了LM Studio后彻底回不去用ChatGPT了,数据在自己电脑上跑的感觉太踏实了
国产 AI 智能助手,超长上下文窗口和中文理解能力著称
Kimi 的长文本处理能力是真的强,200万字上下文直接秒杀一片!用来读论文和财报效率拉满。
以极致性价比的开源大模型矩阵席卷全球
刚看到DeepSeek要融资的消息,100亿估值真的太低了,跟智谱507亿比差了好几倍。不过梁文锋本来就不缺钱,这轮融资大概率是为了给员工发期权留住人。毕竟核心骨干已经走了好几个了,再不激励真的要被大厂挖光了。
NVIDIA推出的开源大语言模型系列,开放权重和训练数据用于构建专用AI代理
Nemotron开源确实香,权重完全开放,可以随便下载部署。
法国AI初创公司Mistral AI发布的240亿参数开源多模态模型,在文本和多模态任务上表现出色
比GPT-4o Mini便宜太多,本地部署首选,配合Ollama使用体验很棒
OpenAI小型推理模型,专为快速、经济高效的推理而优化
o4-mini 性价比太高了,速度快效果也不错,日常使用首选。
OpenAI新一代旗舰推理模型,o系列迄今最智能的模型
图像思考功能太香了,直接把截图丢进去就能分析,效率直接拉满。
OpenAI新一代大语言模型,支持百万token上下文和强大编码能力
100万token上下文太强了,处理整个代码库完全没问题。
字节跳动面向海外市场的多功能 AI 助手,支持文字语音交互、Bot 定制与文档阅读
Cici 免费版够用了,日常对话翻译完全没问题。
阿里官方AI助手,提供最强Qwen大模型体验,集成AI搜索、网页总结、AI PPT、AI生图等功能
千问的文档解析功能太实用了,上传PDF直接提取重点,效率拉满!
智谱AI推出的免费AI模型体验与创意内容生成平台,集成GLM系列大模型,面向全球用户免费开放
GLM-5.1编程能力太顶了,SWE- Bench直接登顶全球第一,关键是还免费!
美团自研的5600亿参数开源MoE大模型平台,支持文本、图像、视频等多模态能力
美团这个 LongCat 响应速度真的快,5600亿参数不是盖的
Meta公司开发的免费AI智能助手,集成于Facebook、Instagram等社交平台
Meta AI免费是真的香,已经抛弃ChatGPT免费版了。
Anthropic 最强 AI 前沿模型,不对外公开发布,通过 Project Glasswing 仅向合作方提供
93.9%的SWE-bench得分也太恐怖了,之前Opus 4.6才80.8%,这提升幅度直接甩开竞品几条街。
中国科学院自动化研究所研发的全栈国产化多模态大模型
紫东太初的长视频理解能力很强,180分钟视频也能精准回答问题。
Meta推出的开源AI应用开发框架,OpenAI API的开源替代方案
用了两周 Llama Stack,整体感觉比直接用 Ollama 强大太多。Agent 编排和 RAG 功能都很完善,部署到生产环境应该没问题。
Quora推出的AI模型聚合平台,一站式对话ChatGPT、Claude、Gemini等多种AI模型
Poe 太香了!一个账号能玩 GPT、Claude、Gemini,对比答案超方便。
由上海人工智能实验室研发的开源大模型体系,覆盖语言、多模态、气象等领域
书生大模型确实不错,尤其是中文理解能力很强,用起来很顺手!
蚂蚁集团自研万亿级大模型
百灵大模型的智效比太香了,成本只有主流思考模型的四分之一。
法国Mistral AI推出的免费AI聊天机器人,基于开源大语言模型
Mistral Le Chat 太香了!免费额度虽然不多,但响应速度真心快。
阶跃星辰打造的多模态AI助手平台,集成文本对话、图像创作与语音交互
阶跃AI的深入核查功能确实好用,帮我减少了核对信息的时间!
Google推出的多模态AI大模型,2025年11月发布Gemini 3系列,LMArena首个突破1500分的模型
额度又涨了!!!
MiniMax发布的2290亿参数MoE架构代码与协作专用大模型,以Claude Opus约7%的成本完成90%以上代码任务质量
太香了这个价格,输入才0.3刀一百万token,Claude要15刀!
智谱AI基于GLM大模型开发的生成式AI助手,支持对话、写作与编程
免费的国产AI,沖。
阿里巴巴旗下阿里云自主研发的大语言模型产品,支持文本生成、智能对话、内容创作等AI服务
刚试了Qwen3.6-Plus,编程能力确实强,免费版已经这么猛了,不敢想象付费版有多强。
Meta最新发布的AI模型,医疗问答领域领先,Contemplating深度推理模式支持多智能体并行思考
试了一下meta.ai上的Muse Spark,图像分析功能太强了,能准确识别图片中物体的位置和数量,这对科研党来说太香了!
Anthropic发布的旗舰大语言模型,在高级软件工程和视觉理解方面实现显著提升
用了一周 Opus 4.7,代码能力确实强了,但输出太长了,一张口就是一大段话,看得累死了。
AI领域领军企业,开发Claude系列模型以推理能力和长文本处理著称
Claude Opus 4.7编程能力确实强,复杂代码任务上几乎没有对手。
OpenAI 开发的大型语言模型聊天机器人,全球最受欢迎的 AI 工具之一
GPT-5.4 真的太强了,写代码效率提升不止一点半点,之前要花半天写的脚本它几分钟就搞定,爱了!
OpenAI发布的旗舰大模型,拥有200万Token超长上下文和原生多模态Symphony架构
实测了一波GPT-6,不得不说200万Token是真的香扔进去一整年的项目代码都不带喘的,之前用GPT-4处理大项目要分段,现在一次性搞定!
面向企业的大型语言模型平台,提供私有化部署和数据隐私保护
用了三个月的 Cohere Command R+,来说说感受。数据安全这点确实香,我们的法务文档再也不用上传到第三方服务器了,私有化部署太安心。
由 Google DeepMind 发布的最新一代开源大模型
Gemma 4 31B 跑 Claude Code 真的太香了,70%日常开发任务都能Cover,月费直接省掉
埃隆·马斯克创立的AI公司,提供实时信息和幽默回复风格的Grok聊天机器人
实时信息确实香,问最新新闻立马有答案。
国内首个全产业AI大模型,覆盖97个行业,提供产业知识问答、AI研报创作、价格预测等服务
万联摩尔在CITE 2026上确实火了一把,产业AI这个方向还是有搞头的。