Hitoo
实时语音翻译视频通话平台,采用自研端到端AI模型AURIS,在保留说话者声音身份的前提下实现50+语言间的亚300毫秒实时翻译
Hitoo
实时语音翻译视频通话平台,采用自研端到端AI模型AURIS,在保留说话者声音身份的前提下实现50+语言间的亚300毫秒实时翻译
Meco
把新闻订阅从邮箱搬出来、用 AI 音频简报每天听重点的阅读应用
Kyutai Pocket-TTS
1 亿参数的开源端侧语音合成模型,CPU 实时运行、5 秒音频即可克隆任意声音
VocalVia
把 PDF、文章和笔记变成可编辑多角色播客的 AI 工作区
豆包 App 2.0
字节跳动旗下国民级 AI 智能助手,集文本、图像、视频、语音与办公 Agent 于一体
EdgeTTS オンライン吹替
ベースの微软 Edge 神经语音的免费在线文字转语音ツール,免登录、无广告、同步生成 SRT 字幕
FreeTTS 中国語音声合成
永久免费、无需注册的中文神经语音合成ツール,覆盖普通话、粤语と台湾国语,一键导出 MP3 と SRT 字幕
ElevenLabs v4
ElevenLabs 预告的第四代 AI 语音模型,主打能低语、能吟唱、带情绪与口音的人类级表达
Murf 2
面向团队与企业的全栈式 AI 配音平台,把脚本、语音生成、视频同步与合规打包进一个工作室
Suno 3.0
AI 音乐生成平台最新一代能力,主打歌曲线级精修、多语种自然人声与专业母带级分轨导出
Spotify AI DJ 2.0
Spotify 为 Premium 用户打造的 AI 虚拟电台主播,按收听习惯实时生成个性化音乐混搭与语音解说
GPT-Live 音声
OpenAI 次世代の全双工语音模型,让 ChatGPT 语音对话更自然、更聪明、更会倾听
Read PDF Aloud
免费在线 AI PDF 语音朗读工具,支持 142 种语言和 470 种 AI 语音,采用本地优先架构处理文字解析
Video to Text
基于 AI 的视频与音频转录工具,支持 99 种语言、说话人分离和多格式导出,采用按量付费模式
VoiceDrop
开口说,它自己归档——语音驱动的文章写作应用
VibeVoice
微软开源的语音AI模型家族,支持90分钟超长音频生成
SoundView
讯飞旗下AI视频本地化创作プラットフォーム,专注视频翻译、配音と跨境电商视频创作
Anylang.ai
AI视频翻译工具,保持原说话者音色和口型同步
Magicam
实时AI换脸与变声工具,支持直播视频通话中的面部替换
雲幕同声
原声级AI视频翻译ツール,対応20多种语言,98%还原音色と情绪,保留背景音乐
LPM 1.0
面向视频角色表演的170亿参数实时全双工对话AI模型
ElevenLabs
AI语音生成和处理平台,提供文本转语音、语音克隆和语音智能体服务
Speechify
AI文本转语音应用,将文档、网页转换为自然语音,支持60+语言和1000+语音
Dub AI
AI驱动的视频翻译与配音平台,帮助将视频内容快速本地化为30多种语言
Rask AI
AI驱动的视频本地化和配音平台,支持130+语言自动翻译
VozoAI
AI视频翻译配音口型同步工具,支持110+种语言
Vapi
面向开发者的语音AI平台,帮助快速构建、测试和部署语音代理
LobeChat
开源高性能聊天机器人框架,支持多模型、语音合成和多模态
iFlyTek Spark
科大讯飞リリース的认知大規模モデル,音声対話と教育领域优势突出
Whisper by OpenAI
のための语音認識的神经网络,音声認識を変革するオープンソースの革命