全球领先的AI图像生成平台,通过文本提示词在约60秒内生成高质量艺术图像
说一个很多人不知道的省钱技巧:Standard Plan(30刀/月)的Relax Mode实际上是无限出图的,只是高峰期可能要等2-5分钟。我之前一直傻傻地用Fast Mode,一个月900张很快就用完了。后来改成先用Relax迭代方向,确定了再切Fast出最终图,一个月实际能出2000+张,相当于单张成本不到一分五厘钱。但这个技巧仅限不急着出图的个人创作者,商业项目等不起的话还是老老实实上Pr
全球领先的AI图像生成平台,通过文本提示词在约60秒内生成高质量艺术图像
说一个很多人不知道的省钱技巧:Standard Plan(30刀/月)的Relax Mode实际上是无限出图的,只是高峰期可能要等2-5分钟。我之前一直傻傻地用Fast Mode,一个月900张很快就用完了。后来改成先用Relax迭代方向,确定了再切Fast出最终图,一个月实际能出2000+张,相当于单张成本不到一分五厘钱。但这个技巧仅限不急着出图的个人创作者,商业项目等不起的话还是老老实实上Pr
免费开源、跨平台的视频编辑器,CapCut 的开源替代品,视频本地处理、无水印无订阅
免费真香!剪映你继续收割吧,我跑了。
用于语音识别的神经网络,重塑语音识别格局的开源神器
拿 Whisper 转写了一整年的播客存档,几百个小时的音频。虽然跑了一周多,但最终结果很满意,每期播客都有了可搜索的文字版。
完全免费的AI图像和视频生成平台,基于Z-Image-Turbo等开源模型构建
每天免费 credits 真的太香了,不用注册就能直接用,打开网页就开始生图,门槛几乎为零。
功能强大的开源节点式生成式AI应用,支持图像、视频、音频和3D内容生成
ComfyUI 的 App Mode 推出来的时候我挺兴奋的,结果用了几次发现,本质上就是把节点图藏起来了而已。给客户交付确实方便了,但我自己调试的时候还是得切回完整模式。而且那个 ComfyHub 上的工作流质量参差不齐,很多都是半成品,下载下来还得自己改半天。
用扩散模型生成式放大图像、凭空补齐真实细节的 AI 放大器
用了回不去了,真香!
隐私优先、本地优先、可离线使用的极简写作与笔记空间
用了两天 Justwrite 最大的感受就是「轻」——打开就能写不用注册不用登录,这种感觉真的太爽了。之前用 Notion 每次都要等同步,没网就傻眼,这个离线也能用,飞机上写东西再也不怕了。作为一个经常出差的人,这点太重要了。
通过文字描述即可生成完整歌曲的AI音乐创作平台
Suno 最近生成的质量是不是下滑了,感觉同样的提示词,出来的东西不如前两个月好吧。
OpenAI 开发的第三代 AI 图像生成模型,与 ChatGPT 深度集成,支持对话式文本生成图像
上周赶一批电商详情页,二十张图给到 API,结果 DALL-E 3 单次只能十张,被迫分五批提交,总共等了快两分钟。更坑的是提示词里把一个专有名词拼错了一个字母,整批直接翻车重来,容错率是真的低。GPT-4o 那边同样的模板拼错都能给你脑补出合理结果,一次四十来秒二十张。DALL-E 3 在工程效率这块确实已经被自家新模型比下去了,除了 API 计费清楚这点还留着,别的真没什么非它不可的理由了。
AI 屏幕录制工具,录一遍即可用 AI 换口音、降噪音、做配音翻译,无需重录
Cadence 这次 ChipStack 的 Level-5 自主能力确实够炸,验证从五周压到一天,40 倍提速。但说真的,这种数字一看就是 vendor 选的最优场景,咱普通项目能不能跑到这个数还两说。
通过文字描述生成包含人声、歌词和完整制作的AI音乐创作平台,被誉为「音乐界的ChatGPT」
Suno 的 iMessage 集成太方便了,直接在聊天框里生成一首歌发给朋友,比发语音有意思多了!
谷歌 Nano Banana 图像家族的速度与成本双优轻量档,4 秒出 1K 图、单张约 0.034 美元,主攻高频批量生图
速度即正义,4 秒和 20 秒的差别决定一次试错做不做。
AI语音生成和处理平台,提供文本转语音、语音克隆和语音智能体服务
做了四个月的深度测试,从 v2 到 v3 到 v3.5 一路跟过来。v3 确实是个分水岭,加了情感标签之后终于可以在脚本里控制语气了。以前读什么都是一本正经的新闻腔,现在加 [whispering] 真的能做出悄悄话的感觉,加 [laughs] 也能笑出来。虽然偶尔还是不稳定,但已经比两年前强太多了。
AI 音乐生成平台最新一代能力,主打歌曲线级精修、多语种自然人声与专业母带级分轨导出
昨天试了一下 Suno V5.5,中文咬字比 V3 时期好太多了,虽然偶尔还是有点塑料感,但日常做短视频 BGM 完全够用。就是写中文 prompt 还是要用英文描述风格,Suno 对英文的理解明显比中文强一截。
面向游戏与创意团队的生成式 AI 平台,训练专属模型批量产出画风统一的游戏美术资产
最近试了 Scenario 的 PBR 贴图生成,瓷砖和木纹的重复性还行但金属材质的高光反射不太对。做 prototype 够用了,真要上线的话还是得美术手动调一下。另外训练时素材数量最好在 20-30 张之间,太少模型学不到特征,太多又容易过拟合变成复制粘贴。
谷歌DeepMind推出的AI视频生成模型,支持文本/图像生成视频和原生音频
从 Sora 关停之后基本全转 Veo 了。说真的 Veo 3.1 现在是活着的高端子里唯一原生音画的,Flow 工作区能把多个 8 秒片段拼成长弧,参考图保持角色一致也比 Veo 3 强太多。但别被 demo 骗了,复杂多人对话场景人物会 merge、声音分不清谁在说话,单人和双人还行,三人以上饭桌聊天基本翻车。我们做法是先用三张参考图锁人设、场景拆短、每镜单独出再剪,成片能看但工作量不小。综合
面向中小商家的 AI 内容营销智能体,一句话生成可发布的图文笔记、公众号长文与 AI 封面配图
新用户送了50积分跑完IP起号方案基本就见底了,剩10积分刚好还能做一次AI作图。这积分消耗确实挺快的,想深度用肯定不够,建议新手先想清楚要测什么功能再动手,不然50积分一下子就花完了,连改图的机会都没有。
免费浏览器扩展,让你在真实网站上实时检测、替换并预览字体,无需打开 DevTools 或改 CSS
太方便了!不用开 DevTools 就能直接换字体,在真实网页上即时看到效果,省了好多时间,做设计预览神器。
AI视频生成平台,Gen-4.5被评价为世界最佳视频模型
最近把 Runway 当成一个模型聚合器用了,Gen-4.5 出主镜头,Kling 3.0 和 Seedance 2.0 在 Workflows 里串在一起当备选。一个面板里调好几个模型真的省事,不用在七八个网站之间来回切。就是账单一算吓一跳,Gen-4.5 每秒 25 积分,几版迭代下来 Pro 档的 2250 分说没就没。
Meta 超级智能实验室首款自研文生视频模型,原生音频与画面一次生成
原生音频真的香,省了后期配乐那一步。
前Snap高管创立的AI视频生成平台,9个月实现2亿美元年收入
如果你只认准某一个模型比如 Seedance,其实没必要为聚合器付订阅费,直接按量付费更省。Higgsfield 的价值在于你真的会换着模型用。
开源AI图像生成模型,通过文本描述生成高质量图像
用了两年 SD 的感受就是,前期投入确实大,光显卡就花了五六千,装环境又搭进去一整天,但一旦跑通之后就是完全不一样的体验了。现在批量出图零成本,LoRA 自己训练角色一致性,ControlNet 精准控制构图,这些功能闭源工具根本给不了。唯一遗憾的是底模质量还是不如 Flux,得靠社区模型补。
基于 AI 的视频与音频转录工具,支持 99 种语言、说话人分离和多格式导出,采用按量付费模式
最近工作室接了个大单,要整理一百多小时的访谈素材。试了一圈工具,格镜的准确率和速度确实是最好的,10分钟视频90秒出完整文稿,中英混剪基本不用改。水印云也不错,长视频转写很稳定,两小时的会议录像一次跑完不卡顿。剪映我直接pass了,三十分钟以上的视频断句乱得没法看。
Meta 超级智能实验室首款自研图像生成模型,以智能体式工作流嵌入 Instagram 与 WhatsApp
免费的,先用着。
印象笔记推出的 AI 写作与模块化文档工具,主打灵感自动产生、文章一键生成
用了几天,发现最适合的场景还是那种重复性强、有明确成功标准的工作。比如每天整理竞品价格、每周出销售报告这类,扔给AI员工做比招实习生划算多了。但要是做创意类的、需要大量判断力的工作,目前还不是太放心交给它。
AI驱动的自动背景移除和生成工具,5秒内精准去除图片背景
免费版那个预览分辨率真的是毫无意义好吧,625x400能干啥,除了让你看一眼效果,完全没法用。想下载高清的就要花钱买积分,一张一块九毛九美金,偶尔用一两次还行,天天用的话钱包扛不住,建议按需购买更划算。
基于浏览器的轻量级截图美化工具,几秒把普通截图变成社媒吸睛配图
回不去了。
企业级生成式AI创意工具,支持文本转图像、视频生成、音频生成等商业安全功能
Firefly 的 Generative Fill 是真的牛,上周一张产品图背景穿帮了,框选一下打了「阳光木桌配绿植」,几秒就出来,光影还跟原图一致,省了起码俩小时修图。但那个积分系统真让人头大,25个免费积分,试几个功能就没了。
采用创新的二维画布交互模式,支持多线程创作和知识管理的 AI 生产力平台
用了一段时间 Neo,做研究报告确实省事。以前自己到处搜资料再整合,现在给它一个目标就能跑完整个流程。但积分烧得是真快,深度研究一次下来几百积分就没了。
用聊天代替分类浏览的 AI 原生插画故事书市场
给娃做了本 bedtime story,他超爱。
开口说,它自己归档——语音驱动的文章写作应用
终于找到一个懂我的录音应用。打开就录,不用点开始,这个设计太对了。以前用苹果自带录音,每次都要点一下,灵感就没了。
一站式 AI 图像与视频创作平台,集成 Pollo 2.5、Veo 3 等多款主流 AI 模型
用了一段时间 Pollo AI,发现积分真心不够用,Veo 3 一条 5 秒视频就烧掉 20 积分,Pro 套餐 800 积分也就够剪几十条,月底自动清零可太恶心了。
苹果生态专属的 Markdown 笔记应用,以顶级排版质感与极简书写体验著称
每年 30 刀还要啥自行车,比 Notion 便宜多了,纯个人写作这价格没话说。
CPG品牌的数字孪生平台,AI生成产品视觉内容
太强了,这才是开会神器!
面向学术论文的 AIGC 检测与降 AI 率工具,检测免费、改写基于 700 万篇学术语料训练
今天帮室友降了一篇工科论文,公式、表格和参考文献格式基本都保住了,AI率从91%直接掉到8%,他原本以为要重写,看到结果直接惊到,说比他之前试过的两个通用改写工具都稳,而且没有出现把专业名词改错的情况。
用对话来剪辑的浏览器端 AI 视频编辑器,把自然语言指令落到可继续编辑的真实时间轴上
它真正值钱的地方是把「对话式 Agent 加可编辑时间轴」做成了护城河。我用自然语言说「去掉冷场、加字幕、导出 9:16」,一条 prompt 就跑了转写、找高光、剪时间轴、压字幕全流程,导出还能走 XML 进 Premiere 接着精修,对长视频初剪是真能省大把时间的利器。
AI驱动的文字转视频创作工具,8分钟将文字链接转化为TikTok短视频
试了一下链接转视频功能,真的香!直接把博客文章链接贴进去,几分钟就生成了一个像模像样的短视频,省了不少功夫。
Skylum 出品的 AI 照片编辑软件,用一键式智能工具完成换天、人像精修与生成式创作,支持桌面独立运行与 Lightroom/Photoshop 插件
Bokeh AI 升级之后不只是人像了,拍静物也能做背景虚化,光斑还能选爱心星形,发朋友圈够用了。
晓语台推出的 AI 论文写作辅助平台,5-10 分钟生成数万字参考论文初稿
写论文人的福音吧~
AI视频生成工具,将文本脚本转化为配有逼真AI画外音的专业视频,支持80+语言和2000+语音
Fliki v5 升级后功能更完善了,AI Copilot 可以分层预览省了不少积分,还可以直接发布到 YouTube,省了下载再上传的步骤。但积分系统还是坑,改稿重渲染都烧积分,Standard 档做得勤一点月底就不够用,重度用户得上 Premium。
从 2022 年开源频谱图扩散模型到 Google Flow Music,Riffusion 是对话式 AI 音乐创作平台,用自然语言即可生成带人声与编曲的完整歌曲
被 Google 收了之后音质明显上了一个台阶,Lyria 3 Pro 出来的歌已经能直接当短视频 BGM 用了,省了我找曲库的时间。
一分钟内生成完整品牌识别系统的 AI 工具,自动产出 Logo 与全套视觉体系
一分钟出整套品牌,太猛了。
面向留学生与求职者的 AI 英文写作助手,模板化生成文书并逐句润色
申请季真的是被 WritingPal 墨宝救了,我是申美研的,套用它的文书模板把中文经历贴进去,十几分钟就能出一份结构像样的初稿,再自己改细节,效率比从空白页憋强太多了。就是免费版每月 2.5 万字有点紧,写两篇文书就见底,最后还是开了 35 块的专业版。
免费在线 AI PDF 语音朗读工具,支持 142 种语言和 470 种 AI 语音,采用本地优先架构处理文字解析
把两篇论文和一本教材的扫描版都丢进去试了一下。OCR识别率确实高,400多页的书解析完不到20秒。朗读速度调到2倍刚刚好,英文发音很标准,连学术术语都读对了。就是中文差点意思,有点机器味,希望后续能优化一下中文语音。
把长视频一键切成适配 TikTok、Reels、Shorts 的爆款竖屏短片
多人圆桌慎入,说话人经常跟丢。
AI驱动的社交媒体视频剪辑工具,自动将长视频转化为适配YouTube、TikTok、Instagram Reels的病毒式短视频
太强了!AI 自动识别精彩片段的功能太香了,5 分钟搞定以前要花 2 小时剪的短视频!
AI图像生成器,以业界领先的文字渲染能力著称,能够在图像中准确嵌入可读文字
做了一年多的AI生图工具对比。Midjourney审美最好,DALL-E理解力最强,但要做带文字的图,尤其是有排版要求的海报和社媒素材,Ideogram确实是最稳的。它4.0版的JSON式提示词可以把画面拆成背景、主体、文字区分别控制,这个设计思维在我看来比纯靠抽卡式的出图要靠谱。缺点是不做视频,对手Runway和Pika都能做了,它还停在纯图片。另外高峰期排队真的慢,付费了有时也要等。
实时生成可交互3D视频世界的AI世界模型
刚体验了一波 Odyssey,不得不说这个实时交互是真的香!50毫秒响应,玩起来基本感觉不到延迟,比之前用过的那些AI视频工具流畅太多了。
专为小说作者打造的 AI 写作助手,用自研 Muse 模型与 Story Engine 长文连续性追踪产出高质量虚构文本
Story Engine 真香,终于不用手动记人物关系了。
Google DeepMind 的任意模态输入、带对话式剪辑的原生多模态视频生成模型
回不去了,剪辑流程被它改写了。