全球 AI 产品排行榜

2026-07-26 01:37 更新

1
65.0 ↑16.62
Midjourney 图像生成
美国

全球领先的AI图像生成平台,通过文本提示词在约60秒内生成高质量艺术图像

132 条评论 13 个相关链接

说一个很多人不知道的省钱技巧:Standard Plan(30刀/月)的Relax Mode实际上是无限出图的,只是高峰期可能要等2-5分钟。我之前一直傻傻地用Fast Mode,一个月900张很快就用完了。后来改成先用Relax迭代方向,确定了再切Fast出最终图,一个月实际能出2000+张,相当于单张成本不到一分五厘钱。但这个技巧仅限不急着出图的个人创作者,商业项目等不起的话还是老老实实上Pr

5
58.3 ↓-0.2
ComfyUI 视频生成
美国

功能强大的开源节点式生成式AI应用,支持图像、视频、音频和3D内容生成

53 条评论 8 个相关链接

ComfyUI 的 App Mode 推出来的时候我挺兴奋的,结果用了几次发现,本质上就是把节点图藏起来了而已。给客户交付确实方便了,但我自己调试的时候还是得切回完整模式。而且那个 ComfyHub 上的工作流质量参差不齐,很多都是半成品,下载下来还得自己改半天。

9
56.0 ↓-0.2
DALL-E 图像生成
美国

OpenAI 开发的第三代 AI 图像生成模型,与 ChatGPT 深度集成,支持对话式文本生成图像

55 条评论 12 个相关链接

上周赶一批电商详情页,二十张图给到 API,结果 DALL-E 3 单次只能十张,被迫分五批提交,总共等了快两分钟。更坑的是提示词里把一个专有名词拼错了一个字母,整批直接翻车重来,容错率是真的低。GPT-4o 那边同样的模板拼错都能给你脑补出合理结果,一次四十来秒二十张。DALL-E 3 在工程效率这块确实已经被自家新模型比下去了,除了 API 计费清楚这点还留着,别的真没什么非它不可的理由了。

13
53.1 ↓-0.9
ElevenLabs 语音与会议 语音合成
美国

AI语音生成和处理平台,提供文本转语音、语音克隆和语音智能体服务

146 条评论 8 个相关链接

做了四个月的深度测试,从 v2 到 v3 到 v3.5 一路跟过来。v3 确实是个分水岭,加了情感标签之后终于可以在脚本里控制语气了。以前读什么都是一本正经的新闻腔,现在加 [whispering] 真的能做出悄悄话的感觉,加 [laughs] 也能笑出来。虽然偶尔还是不稳定,但已经比两年前强太多了。

15
52.0 ↑5.62
Scenario 设计 游戏美术设计 游戏创意设计
美国

面向游戏与创意团队的生成式 AI 平台,训练专属模型批量产出画风统一的游戏美术资产

41 条评论 12 个相关链接

最近试了 Scenario 的 PBR 贴图生成,瓷砖和木纹的重复性还行但金属材质的高光反射不太对。做 prototype 够用了,真要上线的话还是得美术手动调一下。另外训练时素材数量最好在 20-30 张之间,太少模型学不到特征,太多又容易过拟合变成复制粘贴。

16
51.9
Google Veo 图像生成 视频生成 Google
美国

谷歌DeepMind推出的AI视频生成模型,支持文本/图像生成视频和原生音频

40 条评论 8 个相关链接

从 Sora 关停之后基本全转 Veo 了。说真的 Veo 3.1 现在是活着的高端子里唯一原生音画的,Flow 工作区能把多个 8 秒片段拼成长弧,参考图保持角色一致也比 Veo 3 强太多。但别被 demo 骗了,复杂多人对话场景人物会 merge、声音分不清谁在说话,单人和双人还行,三人以上饭桌聊天基本翻车。我们做法是先用三张参考图锁人设、场景拆短、每镜单独出再剪,成片能看但工作量不小。综合

17
50.8
JustAI 图像生成 写作工具 营销与客服 电商、跨境、出海
美国

面向中小商家的 AI 内容营销智能体,一句话生成可发布的图文笔记、公众号长文与 AI 封面配图

43 条评论 12 个相关链接

新用户送了50积分跑完IP起号方案基本就见底了,剩10积分刚好还能做一次AI作图。这积分消耗确实挺快的,想深度用肯定不够,建议新手先想清楚要测什么功能再动手,不然50积分一下子就花完了,连改图的机会都没有。

22
45.6 ↓-10.93
Stable Diffusion 图像生成
美国

开源AI图像生成模型,通过文本描述生成高质量图像

59 条评论 12 个相关链接

用了两年 SD 的感受就是,前期投入确实大,光显卡就花了五六千,装环境又搭进去一整天,但一旦跑通之后就是完全不一样的体验了。现在批量出图零成本,LoRA 自己训练角色一致性,ControlNet 精准控制构图,这些功能闭源工具根本给不了。唯一遗憾的是底模质量还是不如 Flux,得靠社区模型补。

23
45.5 ↓-0.27
Video to Text 语音合成
美国

基于 AI 的视频与音频转录工具,支持 99 种语言、说话人分离和多格式导出,采用按量付费模式

44 条评论 18 个相关链接

最近工作室接了个大单,要整理一百多小时的访谈素材。试了一圈工具,格镜的准确率和速度确实是最好的,10分钟视频90秒出完整文稿,中英混剪基本不用改。水印云也不错,长视频转写很稳定,两小时的会议录像一次跑完不卡顿。剪映我直接pass了,三十分钟以上的视频断句乱得没法看。

27
44.6
ShotLab 图像生成
美国

基于浏览器的轻量级截图美化工具,几秒把普通截图变成社媒吸睛配图

41 条评论 5 个相关链接

我们团队月产短剧大概30到40集,每集2到3分钟。用Shotlab之前是用可灵加剪映的组合,不算人力,单集AI素材成本在80到120元。换了Seedance 2.0的0.36元/秒之后,视频成本压到了30到40元每集,加上G Image 2的0.1元一张做概念图,单集总成本控制在40到60块左右。一个月下来比之前省了差不多两千块,对于小团队来说不是小钱。但说实话成本降低不是留在这个平台的主要原因,

36
43.4
ChatCut AI视频剪辑
中国

用对话来剪辑的浏览器端 AI 视频编辑器,把自然语言指令落到可继续编辑的真实时间轴上

18 条评论 14 个相关链接

它真正值钱的地方是把「对话式 Agent 加可编辑时间轴」做成了护城河。我用自然语言说「去掉冷场、加字幕、导出 9:16」,一条 prompt 就跑了转写、找高光、剪时间轴、压字幕全流程,导出还能走 XML 进 Premiere 接着精修,对长视频初剪是真能省大把时间的利器。

44
41.7 ↑5.5
Read PDF Aloud 语音合成
美国

免费在线 AI PDF 语音朗读工具,支持 142 种语言和 470 种 AI 语音,采用本地优先架构处理文字解析

20 条评论 20 个相关链接

把两篇论文和一本教材的扫描版都丢进去试了一下。OCR识别率确实高,400多页的书解析完不到20秒。朗读速度调到2倍刚刚好,英文发音很标准,连学术术语都读对了。就是中文差点意思,有点机器味,希望后续能优化一下中文语音。

47
40.5
Ideogram 图像生成
美国

AI图像生成器,以业界领先的文字渲染能力著称,能够在图像中准确嵌入可读文字

130 条评论 18 个相关链接

做了一年多的AI生图工具对比。Midjourney审美最好,DALL-E理解力最强,但要做带文字的图,尤其是有排版要求的海报和社媒素材,Ideogram确实是最稳的。它4.0版的JSON式提示词可以把画面拆成背景、主体、文字区分别控制,这个设计思维在我看来比纯靠抽卡式的出图要靠谱。缺点是不做视频,对手Runway和Pika都能做了,它还停在纯图片。另外高峰期排队真的慢,付费了有时也要等。