基于ComfyUI工作流的AI创作工具
凌晨排队真的香,3090能跑满1.5小时,白天高峰期半小时就被挤下来了
基于ComfyUI工作流的AI创作工具
凌晨排队真的香,3090能跑满1.5小时,白天高峰期半小时就被挤下来了
AI写作与营销内容生成平台,拥有1700万用户和90+内容模板
We团队最近在试 Copy.ai 的 Content Agent Studio,上传了三封我们自己的营销邮件当样本,它居然真能把我们那种半正式半轻松的语气学出来,生成的 10 封培育邮件里大概 8 封改改就能发,品牌一致性比之前用纯 prompt 强太多。不过说实话还是得人工校一遍,长文还是不建议交给它。
阿里巴巴通义实验室推出的AI创意平台,支持文生图、图生图、文生视频、图生视频及图像编辑
本地部署真香,开源免费随便造。
Anthropic 公司推出的终端级 AI 编程助手、代理式编码工具
老实说踩过坑:长会话跑久了会自动压缩上下文,那之后明显变傻变慢,同一个任务手动贴给网页版 4.5 分钟搞定,它自己磨叽 18 分钟。社区的招数是别硬撑,直接开新会话。另外 MCP 那套很香但上下文税不低,后来开 Tool Search 把 51K 压到 8.5K 才舒服。整体还是目前最能打的终端 Agent,前提是你愿意花时间学它的套路(CLAUDE.md、子代理、hooks),当自动补全用必翻车
有记忆的开源 AI 智能体,越用越聪明
用了一周,感觉比 OpenClaw 更适合长期项目。记忆功能真的香,之前让 Agent 帮我优化 Python 脚本,下次再聊类似话题它还记得之前的需求背景,不用重复解释。
AI视频生成平台,Gen-4.5被评价为世界最佳视频模型
最近把 Runway 当成一个模型聚合器用了,Gen-4.5 出主镜头,Kling 3.0 和 Seedance 2.0 在 Workflows 里串在一起当备选。一个面板里调好几个模型真的省事,不用在七八个网站之间来回切。就是账单一算吓一跳,Gen-4.5 每秒 25 积分,几版迭代下来 Pro 档的 2250 分说没就没。
企业级生成式AI创意工具,支持文本转图像、视频生成、音频生成等商业安全功能
Firefly 的 Generative Fill 是真的牛,上周一张产品图背景穿帮了,框选一下打了「阳光木桌配绿植」,几秒就出来,光影还跟原图一致,省了起码俩小时修图。但那个积分系统真让人头大,25个免费积分,试几个功能就没了。
智谱AI发布的旗舰级开源大模型,全球首个实现8小时持续工作能力,编程能力超越Claude Opus 4.6
睡前把需求丢给它,早上起来活儿真干完了,中间自己规划自己debug,跨几十步还记得最初的约束,这个长程任务能力国产里确实是断档第一。
腾讯自研的多模态3D内容生成系统
腾讯云API按积分计费,0.375一个模型还送两百免费额度,拿来跑批量电商展示比自己搭管线划算太多,中小商家真该试试。
OpenAI 发布的文本到视频生成 AI 模型,可将文字描述直接转换为高清视频
Sora 停服快三个月了,回头看它确实是 AI 视频里写实度的天花板,尤其是「电影感」和物理模拟,国产里也就可灵勉强能打。可惜 OpenAI 说停就停,Plus 会员里那个入口直接灰了,之前攒的一堆概念片现在想再生成一模一样的根本做不到。做创意预演的时候它真的是神器,但没法长期当生产工具,这下连备选都没了。
腾讯公司全链路自研的通用与多模态大模型家族,覆盖文本、图像、视频、3D等模态
说个大部分人没注意的点,Hy3在WorkBuddy里其实有俩独立旋钮,一个是Max模式一个是思考强度,好多人压根没开过Max,白瞎了。我自己试下来,平时闲聊挂低档,唰一下就出结果快得像外卖;真遇到烧脑的动态规划题再拨到高档,它会闷头想个十几秒,过程写得跟老师板书似的基本不翻车。免费期内消耗倍率显示0x,随便造不扣额度,这波是真舍得。
字节跳动剪映团队推出的AI创作平台,支持文生图、图生视频、智能画布等功能
即梦是真的回不去了。
加密货币交易自动化平台,提供 DCA、网格和信号机器人帮助用户实现策略化自动交易
跟 Pionex 比过,Pionex 免费自带机器人但定制弱,3Commas 按月收费但 DCA 和 TradingView 信号深度甩它几条街。如果你本金过两万刀、自己有策略,3Commas 的订阅费摊下来其实划算;要是无脑开机即用,还是 Pionex 省心。
全球首个面向量子计算校准与纠错的开源AI模型系列
英伟达这波把量子AI做成了开源,格局是真大。
华为推出的AI智能眼镜,支持AI闪拍、小艺看世界、同声传译等功能,全天候舒适佩戴,起售价2499元
戴了三个月,结论是好用但有坑。35.5克真不是吹的,我平时戴十二小时鼻梁没压痕,同事还以为我新配了副普通眼镜。但续航是真扛不住,中度使用下午四点就剩十五,而且只有鸿蒙六以上才是完全体,我室友苹果手机借戴三天最后说不如耳机方便。如果你不是华为机主,这副眼镜基本就是个贵价蓝牙耳机。
360智脑是三六零集团自主研发的认知型通用大模型,以人为本、安全可信为核心特色
360智脑的AI搜索确实强,查资料直接给答案还带来源,不用一页页翻链接了。
千问推出的AI眼镜S1,支持双目显示、语音交互和AI实时作答等功能,现货发售中叠加限时优惠和国家补贴后最低到手价3499元
身边好几个朋友被我安利也入手了,大家反馈最一致的居然是「像眼镜」这件事——威灵顿方框没突兀电子感,重量分配合理,戴一天鼻梁不疼。之前智能眼镜吃灰的核心问题就是不像眼镜,千问S1算是把「眼镜本位」做对了,这也是它能占到国内五成多份额的原因吧。
一个能理解需求、独立完成各类开发任务的超级 AI 开发工程师
昨天体验了一下 TRAE 的 Builder 模式,太强了!描述需求后自动生成完整项目,只要90秒就搞定了一个鸿蒙元服务框架,比我自己写得快多了。
AI搜索引擎,通过引用来源回答问题,被称为「Google杀手」
用了一周 Comet 之后基本没再开过 Chrome 了。最让我服气的是跨标签页对比,研究两个 SaaS 定价方案时直接在地址栏旁边问一句,它同时读两个标签页三十秒出一张对比表,手动起码二十分钟的活。页面摘要也不是那种敷衍的「本文介绍了XXX」,能抓到关键论点还带原文引用。不过 Agent 自动填表比价我只敢让它做信息收集,涉及支付的一步都不让它碰。
字节跳动推出的零代码AI智能体开发平台,支持快速创建和部署智能对话机器人
字节数据的归属一直让我犹豫,敏感业务我是不敢往上面放的。
AI驱动的全球领先一体化客户增长平台,覆盖营销自动化、销售管理、客户服务和 CRM
HubSpot 真的很好用,我们公司全员都在用!
活在 Onshape 与 Fusion 内部的 AI CAD 副驾驶,用自然语言完成部件编辑、特征树清理与参数化重构
我们做消费电子,经常要在设计评审前把一堆乱七八糟的特征树理清楚。以前是资深工程师花半天手动重命名、合并冗余特征,现在丢给 Adam 出第一版,人再扫一遍。省下的时间不算特别多,但胜在每次都不用从头来,模型可维护性肉眼可见地好了,新人接手老模型也不再一头雾水。
开源免费的 AI 网关,用一个本地端点把 200 多家 AI 供应商接到 Claude Code、Cursor 等编码工具,自动回退、压缩省 token
迭代太快了,跟不动。
免费浏览器扩展,让你在真实网站上实时检测、替换并预览字体,无需打开 DevTools 或改 CSS
新版本加了 tinkerfont.com/go 短链分享,规则走作者托管的链接,隐私偏执党可能介意,不过只是配置不是浏览数据。
中国领先的AI创作平台,AI绘画原创模型分享社区
太强了!
AI 音乐生成平台最新一代能力,主打歌曲线级精修、多语种自然人声与专业母带级分轨导出
V5.5 的人声是真的顶,换气和情感过渡几乎听不出机器味了。
把 AI 智能体做进手机键盘,在任意输入框里长按即可取信息、跑动作、触发第三方工具,不必切 App
我在对话里用得最多的是取日历链接,比切 App 顺多了。
把散落在多个工具里的任务与日历统一到一个窗口、用时间块规划每一天的 AI 效率工作台
我起初很爱那个「收件箱即任务」的思路,后来发现信息一多就不好跟踪,想加点笔记或补充说明反而变复杂。拿来做 GTD 挺好,但缺高层视图和细节视图,重项目还是吃力。
Runway 旗下 AI 视频生成与世界模型产品线,当前官方在售旗舰为 Gen-4.5,Gen-5 尚未由官方正式发布
Explore Mode 说是无限生成,但高峰期一条等十分钟以上,真赶工的时候还是挺焦虑的。
把 LLM 供应商当交易场所的零加价推理路由与成本优化平台,平均省约 30% 推理成本
质量漂移是我最担心的点——同一模型不同供应商跑出来量化可能不一样。Auriko 这边模型目录用了真实身份标识,还能指定量化版本,路由只在同模型内选路径,算是把雷排了大半。但对外客户场景我还是建议自己设硬约束,别完全甩手。
免费开源、跨平台的视频编辑器,CapCut 的开源替代品,视频本地处理、无水印无订阅
终于不用每个月给剪映交会员费了。OpenCut 直接打开网页就能剪,导出 4K 不带水印,也没片尾广告,这种干净的感觉太爽了。
专注学术场景的AI论文降重降AI率助手,已服务超百万学者
我们实验室几个都用过,结论比较一致:中文论文降重是真能打,重复率压到学校线没问题;但医学那块的术语有时候会被它改得不太对味,得自己盯紧专业词。整体性价比比大厂那几个按年订阅的友好太多了。
Google DeepMind 于 2026 年 5 月发布的第四代旗舰多模态大模型,支持千万级 Token 上下文、原生多模态生成与 Agentic 自主工作流,搭载第七代 Ironwood TPU
刚升级了 Gemini 4 Ultra,200万上下文真的太夸张了,直接把整个项目代码库扔进去,它居然能跨文件分析依赖关系。
嵌入 Slack 与 iMessage 的 AI 协作同事,用自然语言驱动 3,000+ 工具端到端执行真实工作流
我们自己没自动化工程师,以前这些杂活要么堆人要么堆流程工具。Scarlett 等于把「一句话驱动跨系统」这件事门槛打到地板,对中小团队是实打实的杠杆。不需要会写代码,业务同学自己就能让它跑起一条流水线。
魔芯科技发布的全球首个高帧率交互式世界模型,纯国产 NPU 实现最高 50FPS 实时世界模拟
我们做数字孪生的,对几何一致性要求极高。MoWorld 宣传大尺度鸟瞰场景跨视角几何不漂移,这点如果属实会很香,室内重建直接出 3D 资产能省掉不少人工修模。但二次元和游戏动漫场景的画质到底怎么样,光看宣传片说服不了人。
用聊天代替分类浏览的 AI 原生插画故事书市场
给娃做了本 bedtime story,他超爱。
全球领先的前端部署平台,为开发者提供从代码到全球 edge 网络的一站式部署服务
用了快三年了,部署体验一直在线。以前自己配 Nginx 搭 CI/CD 折腾半天,现在 Git push 完几分钟就上线,Preview URL 对团队协作来说太实用了。免费版对个人项目来说完全够用,良心。
基于 AI 的视频与音频转录工具,支持 99 种语言、说话人分离和多格式导出,采用按量付费模式
今天试了一下 Video to Text,上传一个 40 分钟的采访录音,不到两分钟就出稿了,说话人分离也很准,记者党狂喜。
装在浏览器里、跳过界面直连网页 API 的 AI 操作代理,号称比 Claude 快 10 倍、省 10 倍 token
Chrome 商店页面显示才 9 个用户、1 个评分,版本 1.0.76 刚更,数据权限披露挺重(web history、user activity 都碰)。不是说它不安全,是提醒早期产品验证还薄,重要操作先小步试,别一上来就接核心流程。
AI智能直播平台,支持虚拟主播实时互动
用了两个月了,视频号小店凌晨的单基本都是妙播接的。数字人形象比想象中自然,客户基本看不出来是AI在播。晚上设好自动开播时间,第二天起来看数据,夜里跑了三千多块GMV,真香。
OpenAI 推出的 ChatGPT 内置自主工作智能体,由 GPT‑5.6 驱动,可跨应用与桌面执行长周期多步骤任务
定时任务救我狗命。
大麦娱乐联合阿里通义推出的全球首个潮玩创作者 AI 设计平台,用一句话即可完成潮玩 IP 从创意到生产文件的全链路创作
作为独立设计师,我看重它导出的三视图带精确尺寸和材质建议,能直接丢给工厂沟通。但我也担心一点:大家都用官方风格模板,平台里 IP 视觉会不会越来越像?同质化是这类工具迟早要面对的问题,原创度会被稀释。
Luma AI 旗下具备视觉推理能力的第三代文生视频模型,首创原生 16 位 HDR 与 EXR 导出
运动真稳,回不去了。
网易有道出品的论文一站式处理平台,查重查AI率、智能降重降AI,可将重复率与AI率降至10%以内
客观讲有槽点:我付费40块降AI,平台检测说45%后只改了不到一千字,剩下五分之四没动,客服解释检测逻辑和修改逻辑不同。黑猫投诉里也有类似反馈,说改写完语句不通、中英文混乱。所以别盲目全篇付费,先用免费额度自查,标红段落针对性处理更划算,不达标记得申请退款。
活在 Gmail 和 Outlook 内部、按你的语气代你处理邮件的 AI 助手
「无新应用可学」这点确实被低估了,少迁移才是真效率。
AI 屏幕录制工具,录一遍即可用 AI 换口音、降噪音、做配音翻译,无需重录
界面干净,不卡,老旧笔记本也能跑得很顺。
AWS 第三代自研多模态基础模型,延续前沿智能与极致性价比路线,深度集成 Bedrock 与 Agent 生态
老实说,前沿推理还是差 Claude 和 GPT 半档,复杂 agentic coding 我更信 Sonnet。
小米自研、面向智能体时代的开源大模型家族,开源可商用且 API 价格仅为闭源旗舰的几分之一
V2.5 原生全模态,图、视频、音频一把抓,1M 上下文撑长任务很稳,部署用 vLLM 配 FP8、八卡 H100 就能跑满,门槛虽高但日子越来越好过了。
用扩散模型生成式放大图像、凭空补齐真实细节的 AI 放大器
拿它把 Midjourney 小图拉成大图,细节直接封神。
腾讯视频出品的 AI 多模态创作者社区,聚合可灵、Seedance 等顶尖模型,打通从创作到腾讯视频分账的变现闭环
腾讯出品,界面是真的好看。
面向 macOS 的开源本地优先自动工作日志,用屏幕数据加 AI 把一天还原成可复盘的时间线与报告
回不去了,这玩意装上就戒不掉。
Spotify 为 Premium 用户打造的 AI 虚拟电台主播,按收听习惯实时生成个性化音乐混搭与语音解说
免费用户用不了,得开 Premium,本质还是留存的钩子。
住进你消息里的 AI 行政助理,主动处理收件箱、日程、会议准备和跟进
安卓暂时没原生体验,等不及了。
AI版支付宝的对话式生活办事助手,主打「你说,阿宝办」,一句话调用政务、出行、缴费等数千项生活服务
更新完右滑试了下,查公积金真的一句话就出来了,以前那套市民中心的路径我每次都得找半天。
国产 AI 驱动的一体化产研平台,用自然语言对话即可完成从需求、原型、文档到代码与测试的全流程开发
我不是理科生,代码和自动化测试基本用不上,主要用需求设计和专业文档。需求设计这块比创客贴简单,一段详细指令就能出海报和页面,改指令也能马上调;专业文档和kimi agent比起来差不多,但麦芽响应更快,整体清爽科技感也舒服。
从 2022 年开源频谱图扩散模型到 Google Flow Music,Riffusion 是对话式 AI 音乐创作平台,用自然语言即可生成带人声与编曲的完整歌曲
被 Google 收了之后音质明显上了一个台阶,Lyria 3 Pro 出来的歌已经能直接当短视频 BGM 用了,省了我找曲库的时间。
把搜索变成做事情的 AI 搜索引擎,用自然语言描述需求即生成可交互、可编辑、可分享的小应用
「keep forever」这句我存疑。翻了下公开条款,JustVibe 保留服务设计、代码、算法的知识产权,生成 app 按现状提供,关于导出、迁移、所有权边界没说太细。更像是你在它家厨房寄存了个饭盒,现在能打开,钥匙还在人家手里。
Vercel 出品的 AI 界面生成工具,可一次性导入你的设计系统并据此生成品牌一致的界面
设计系统一次性导入,太香了。
智源研究院推出的多模态表征世界模型,先学统一世界潜在表征再读出文本、图像与机器人动作
这条路要是走通,意义就不只是机器人了。
一个安静的稍后读空间,存文章、无干扰阅读、划线笔记、转语音听书并跨设备同步
标签页囤积者的福音,太需要了。
用对话来剪辑的浏览器端 AI 视频编辑器,把自然语言指令落到可继续编辑的真实时间轴上
它真正值钱的地方是把「对话式 Agent 加可编辑时间轴」做成了护城河。我用自然语言说「去掉冷场、加字幕、导出 9:16」,一条 prompt 就跑了转写、找高光、剪时间轴、压字幕全流程,导出还能走 XML 进 Premiere 接着精修,对长视频初剪是真能省大把时间的利器。
零门槛一站式 AI 内容创作平台,图文排版、生图、修图、动图与视频一键成片
免费版每天额度够我试两篇,先白嫖再说。
言笔AI旗下专注降低论文AIGC检测率并兼顾降重的中文学术写作辅助工具
字数基本没变,不用熬夜删减,好评。
免费在线 AI PDF 语音朗读工具,支持 142 种语言和 470 种 AI 语音,采用本地优先架构处理文字解析
把两篇论文和一本教材的扫描版都丢进去试了一下。OCR识别率确实高,400多页的书解析完不到20秒。朗读速度调到2倍刚刚好,英文发音很标准,连学术术语都读对了。就是中文差点意思,有点机器味,希望后续能优化一下中文语音。
将 AI Agent 深度集成到远程桌面协议的跨桌面私人AI助理,让 AI 替你操作电脑
用了两周ToDesk AI,最直观的感受就是以前得自己远程连电脑操作的事,现在跟AI说一声它就自己干了。不用部署环境不用写脚本,下载完就能用,这点真的很香。
大疆创新旗下的全球航拍及影像社交平台,也是全球规模最大的无人机摄影与视频分享社区之一
刚开始以为就是个相册,结果发现教育资源才是隐藏宝藏,教程和后期文章很全。再加上每周的赛事节奏,逼着自己保持输出,半年技术肉眼可见地涨了。
开口说,它自己归档——语音驱动的文章写作应用
终于找到一个懂我的录音应用。打开就录,不用点开始,这个设计太对了。以前用苹果自带录音,每次都要点一下,灵感就没了。
快手可灵 AI 的图像生成能力,主打文生图、图生图、多图参考与 2K/4K 直出的影视级一致性画质
国风和高美感的图确实不如即梦,整体风格有点偏「油腻版 MJ」,提示词理解也比即梦弱一些。
Cognition 基于 Kimi K2.7 Code 训练的软件工程智能体模型,逼近前沿、成本大降
坦白说我只关心一件事:它修的 bug 是不是根因级的。报告里说它比基座更会做根因修复、改动前先探查式阅读,这点比单纯分数更影响日常体验。我们之前用别的 agent 经常是改了表面、测试过了,结果隔壁模块因为同一个根因又炸,这种才是真浪费。
兼容 OpenAI 的 AI 预测 API,为真实未来事件返回校准概率,比前沿模型更准更便宜
校准概率这个角度真刁钻,比问通用大模型要个没依据的猜测靠谱多了。
面向 AI 代理的社交行为基础设施层,让对话代理像人一样轮流发言、读懂规范与情绪
社交信号能读打字停顿和删改反应,这点挺细,但也要小心别在敏感社区误读冒犯到人。
OpenAI GPT-5.6 系列均衡型模型,性能接近上代旗舰、价格仅其一半
Terra 真香,半价拿到接近 5.5 的体验。
Reka AI 第二代旗舰原生多模态模型,支持文本、图像、音频、视频理解,主打企业级可靠交付与 API 易用性
整体是能力扎实的企业级多模态模型,视频是长板,想要最全生态还是去抱 OpenAI。
茅茅虫平台旗下专注降低论文AIGC检测率的在线工具,基于MMC-去AI痕迹模型将AI文本改写为更自然的学术表达
整体算功能完整、降 AI 也达标的一档,就是价格偏贵。如果你只图快图便宜,小发猫、PaperBERT 可能更香;要是想一个平台从写作到答辩全打通、愿意为省心买单,茅茅虫还是挺稳的。
输入标题即可快速生成结构完整论文初稿的 AI 学术写作辅助工具
我用它写农村电商那篇,生成的初稿重复率本身就不高,自带的智能降重把「物流基础设施落后」改成「农村地区物流基础设施建设仍显滞后」,重复率从13.5%降到10.2%,顺利过学校15%的线。不过标红的政策引用还是得自己调语序,不能完全躺平。
免费 macOS 录屏工具,自动把点击变成平滑缩放的演示视频,全程无需手动剪辑
说真的有点慌,单人靠捐赠维护,万一作者哪天不更了,我整套演示流程就悬了,希望别是昙花一现。
腾讯零代码 AI 应用生成平台,用自然语言对话即可把想法生成可安装运行的手机 App
作为一个完全不懂代码的人,吐司让我第一次觉得自己也能「开发 App」。我给上小学的儿子做了个背单词的小应用,把课本里的单词表导进去就能生成每日默写和错题本,他居然愿意每天主动用,老母亲甚感欣慰。这种把想法变成东西的成就感,以前只有程序员才配拥有,现在普通人也能分一杯羹了。
下一代开源 MoE 大模型
我查了 HowAIWorks 的停运条目,人家专门辟谣了:DBRX 2 不存在,Databricks 从 2025 年底就只卖第三方模型了。
字节跳动 Seed 团队推出的专业级多模态图像创作模型,主打复杂信息可视化与交互式精准编辑
用了三天,最大价值是把「能画」变成「能返工」,圈选一块改材质不用重抽,迭代效率提升明显。对设计团队来说,这种局部可控比一次出大图更实用。建议把它当成会和 PS 混用的日常工具,而不是完全替代——需要精细到像素的活儿还是回 PS,但前期探索方向、出多版草案、快速换配色换材质,5.0 Pro 能砍掉一大半机械劳动,新人也能很快上手产出像样的成品。
基于 EverOS 自研记忆系统的深度自进化 AI Agent 框架,可重写自身代码
EverBrain 那个用户侧小模型能动态微调权重这个点很关键,等于记忆真正反哺了模型本身,而不是只在提示词里打补丁。
Anthropic 2026年5月发布的旗舰多模态推理模型,主打长程智能体编程、百万级上下文与更高诚实度
用 Opus 4.8 跑了一周生产代码,复杂多文件重构明显比 4.7 稳,少了很多「假装改完」的情况。
Linear 将原生 AI Agent 嵌入产品规划,把分散的上下文自动转化为结构化任务与可执行的代码
我们团队从 Jira 切到 Linear 三个月了,最大的体感就是快。Agent 能从 Slack 讨论自动建 Issue 这点太香了,省了我们 PM 大量机械劳动,现在更像是审阅 Agent 产出而不是自己写工单,协作税肉眼可见地降下来了。
必优科技推出的专注国内营销场景的 AI 一站式文案、配图与短视频生成工具
我们小团队做淘宝的,之前详情页描述全是复制同行改改,用快文CopyDone之后只要填入产品卖点关键词,几分钟就能出好几版风格不同的文案,效率确实上来了。不过原创度别太指望,发布前还是得自己揉一遍,不然跟别人撞车的概率不小。
北京创米文化推出的一站式 AI 学术写作与查重平台,可生成含封面摘要目录的中英文论文初稿
答辩 PPT 生成挺省事的,输入题目直接出结构,改改就能用。
让内容从「观看」变为「玩」的AI互动内容社区,被称为「可以玩的抖音」
真的停不下来!
OpenAI GPT-5.6 系列旗舰模型,主打复杂推理、代码开发与长时间自主智能体任务
Multi-agent 并发子智能体这个 beta 太适合我们做批量分析,一次请求跑几个子任务合成结果,效率起飞。
对话式 AI 智能体驱动的短视频广告生成器,一键把产品链接变成 Pixar、漫画或超写实风格的成片
给代理商同事安利了,客户多版变体几分钟交付,比我们之前排期等剪辑爽太多。
Adobe 面向企业的 AI 内容合规审核能力,多语言敏感信息一键过滤
Acrobat AI Assistant 那套两层内容过滤对金融合同文档很友好,敏感词加十二小时数据清除让合规部门终于点头了,之前他们一直卡着不让接任何文档 AI,现在我们敢把报销单和法务合同丢进去做摘要了。
小红书开源的长文本大模型推理加速引擎,沿注意力头拆分 KV 缓存与 FFN,在近乎无损精度下大幅降低长上下文预填充算力与首字延迟
按头拆 KV 这个思路确实比 token 级稀疏更贴合模型结构,点赞。
把 iPhone/iPad 变成开发工作站的遥控器,在手机上远程驱动 Claude Code、Codex 等编码 Agent、跑真实终端与 Git
语音输入驾驶 agent 这个细节不错,走路的时候直接说话让它跑个测试挺顺。
OpenAI GPT-5.6 系列中速度最快、成本最低的轻量档模型,专为高吞吐、低延迟的批量任务而生
不支持原生音频有点可惜,但纯文本高吞吐场景它也用不上音频。
OpenAI 全新一代全双工语音模型,让 ChatGPT 语音对话更自然、更聪明、更会倾听
从对讲机升级成电话,这个比喻很准。它不再死盯着我有没有沉默,停顿就是停顿,不再被背景噪音骗去抢话。
Sakana AI 发布的旗舰级多智能体编排基础模型,以单一 API 调度全球前沿模型、无需依赖单一供应商即可获得前沿性能
Fugu Ultra 输出 token 30 美金的单价不便宜,但多 Agent 并发只按最贵的那个计费、不叠加,算下来比想象中温和,比养一支编排工程团队便宜。
覆盖 Mac 上所有应用的本地隐私 AI 自动补全,按 Tab 补全整句,一次性买断
说实话刚买有点犹豫,但用下来发现它真正的价值是「不打断」——你还在原来的界面里,该回邮件回邮件、该写文档写文档,只是字自己冒出来了,这种无感融入比单独开一个 AI 聊天工具强太多。它不是一个新应用,而是给所有应用加了一层能力。
360 旗下的 AI PPT 生成工具,一句话主题即可产出结构完整、可演示的演示文稿
AI生成的内容还是得过一遍眼,有次会议纪要它把数字搞串了,正式汇报前一定人工校对。
面向企业团队的一站式生产级 AI 平台,集成智能体、工作流、知识库与界面,支持导出代码与私有化部署
免费档能用,不用绑卡。
按住一个键说话,文字(或译文)就落在光标处,免费、免账号、约 4 MB 的语音听写与实时翻译桌面应用
给 Cursor 下指令特别爽,以前打字会偷懒只写三句话,现在抱着说两分钟上下文,Claude 回来的东西明显更对路。这玩意儿最值钱的就是让我对 AI 不吝啬话。
在节点式创意画布上无代码把 AI 工作流变成可分享的应用、网站和游戏
节点画布太上头了,一玩就是一整天。
一分钟内生成完整品牌识别系统的 AI 工具,自动产出 Logo 与全套视觉体系
一分钟出整套品牌,太猛了。
支持五十余个平台的多形态视频下载工具,网页版、桌面端与浏览器插件一键抓取
断点续传挺实用,网络波动也不怕,几百个平台基本都能下,收藏控狂喜。