Hitoo
实时语音翻译视频通话平台,采用自研端到端AI模型AURIS,在保留说话者声音身份的前提下实现50+语言间的亚300毫秒实时翻译
Hitoo
实时语音翻译视频通话平台,采用自研端到端AI模型AURIS,在保留说话者声音身份的前提下实现50+语言间的亚300毫秒实时翻译
Meco
把新闻订阅从邮箱搬出来、用 AI 音频简报每天听重点的阅读应用
Kyutai Pocket-TTS
1 亿参数的开源端侧语音合成模型,CPU 实时运行、5 秒音频即可克隆任意声音
VocalVia
把 PDF、文章和笔记变成可编辑多角色播客的 AI 工作区
Doubao App 2.0
字节跳动旗下国民级 AI 智能 assistant,集文本, 图像, 视频, 语音 and 办公 Agent 于一体
EdgeTTS Online Dubbing
Based on 微软 Edge 神经语音的免费在线文字转语音 tool,免登录, 无广告, 同步generate SRT 字幕
FreeTTS Chinese TTS
永久免费, 无需注册的中文神经语音合成 tool,覆盖普通话, 粤语 and 台湾国语,一键导出 MP3 and SRT 字幕
ElevenLabs v4
ElevenLabs 预告的第四代 AI 语音模型,主打能低语、能吟唱、带情绪与口音的人类级表达
Murf 2
面向团队与企业的全栈式 AI 配音平台,把脚本、语音生成、视频同步与合规打包进一个工作室
Suno 3.0
AI 音乐生成平台最新一代能力,主打歌曲线级精修、多语种自然人声与专业母带级分轨导出
Spotify AI DJ 2.0
Spotify 为 Premium 用户打造的 AI 虚拟电台主播,按收听习惯实时生成个性化音乐混搭与语音解说
GPT-Live Voice
OpenAI next-generation 全双工语音模型,让 ChatGPT 语音对话更自然, 更聪明, 更会倾听
Read PDF Aloud
免费在线 AI PDF 语音朗读工具,支持 142 种语言和 470 种 AI 语音,采用本地优先架构处理文字解析
Video to Text
基于 AI 的视频与音频转录工具,支持 99 种语言、说话人分离和多格式导出,采用按量付费模式
VoiceDrop
开口说,它自己归档——语音驱动的文章写作应用
VibeVoice
微软开源的语音AI模型家族,支持90分钟超长音频生成
SoundView
讯飞旗下AI视频本地化创作 platform,专注视频翻译, 配音 and 跨境电商视频创作
Anylang.ai
AI视频翻译工具,保持原说话者音色和口型同步
Magicam
实时AI换脸与变声工具,支持直播视频通话中的面部替换
Yunmu Tongsheng
原声级AI视频翻译 tool,supports 20多种语言,98%还原音色 and 情绪,保留背景音乐
LPM 1.0
面向视频角色表演的170亿参数实时全双工对话AI模型
ElevenLabs
AI语音生成和处理平台,提供文本转语音、语音克隆和语音智能体服务
Speechify
AI文本转语音应用,将文档、网页转换为自然语音,支持60+语言和1000+语音
Dub AI
AI驱动的视频翻译与配音平台,帮助将视频内容快速本地化为30多种语言
Rask AI
AI驱动的视频本地化和配音平台,支持130+语言自动翻译
VozoAI
AI视频翻译配音口型同步工具,支持110+种语言
Vapi
面向开发者的语音AI平台,帮助快速构建、测试和部署语音代理
LobeChat
开源高性能聊天机器人框架,支持多模型、语音合成和多模态
iFlyTek Spark
科大讯飞launched 的认知large model,voice interaction and 教育领域优势突出
Whisper by OpenAI
For 语音recognize 的神经网络,An open-source game-changer in speech recognition