Heard
Lớp giọng nói cho macOS, biến đầu ra terminal của Claude Code, Codex và Cursor thành bản tóm tắt giọng nói thông minh
Heard
Lớp giọng nói cho macOS, biến đầu ra terminal của Claude Code, Codex và Cursor thành bản tóm tắt giọng nói thông minh
Hitoo
Nền tảng gọi video với dịch giọng nói thời gian thực, sử dụng mô hình AI AURIS độc quyền đầu cuối để dịch 50+ ngôn ngữ trong chưa đầy 300 ms, giữ nguyên nhận dạng giọng nói người nói
Meco
Ứng dụng đọc giúp đưa tin tức đăng ký ra khỏi hộp thư và tóm tắt bằng âm thanh AI mỗi ngày
Kyutai Pocket-TTS
Mô hình tổng hợp giọng nói mã nguồn mở 100 triệu tham số, chạy thời gian thực trên CPU, nhân bản bất kỳ giọng nói nào với 5 giây âm thanh
VocalVia
Không gian làm việc AI biến PDF, bài báo và ghi chú thành podcast nhiều nhân vật có thể chỉnh s��a
Doubao App 2.0
Trợ lý thông minh AI quốc dân của ByteDance, tích hợp văn bản, hình ảnh, video, giọng nói và tác tử văn phòng
EdgeTTS Online TTS
Công cụ chuy��n văn bản thành giọng nói trực tuyến miễn phí dựa trên giọng nói thần kinh của Microsoft Edge, không cần đăng nhập, không quảng cáo, tạo phụ đề SRT đồng thời
FreeTTS Chinese TTS
Công cụ tổng hợp giọng nói thần kinh tiếng Trung miễn phí vĩnh viễn, không cần đăng ký, hỗ trợ tiếng Phổ thông, Quảng Đông và Đài Loan, xuất MP3 và phụ đề SRT một chạm
ElevenLabs v4
Thế hệ thứ tư của mô hình giọng nói AI ElevenLabs, có thể thì thầm, ca hát, thể hiện cảm xúc và giọng địa phương ở cấp độ con người
Murf 2
Nền tảng lồng tiếng AI full-stack cho nhóm và doanh nghiệp
Suno 3.0
Khả năng tạo nhạc AI thế hệ mới nhất, với tinh chỉnh cấp bài hát, giọng hát tự nhiên đa ngôn ngữ và xuất đa track chất lượng mastering chuyên nghiệp
Spotify AI DJ 2.0
DJ radio ảo AI của Spotify dành cho người dùng Premium, tạo bản mix nhạc cá nhân hóa và bình luận giọng nói thời gian thực
GPT-Live Voice
Mô hình giọng nói full-duplex thế hệ mới từ OpenAI
Read PDF Aloud
Công cụ đọc PDF bằng giọng nói AI trực tuyến miễn phí
Video to Text
Công cụ phiên âm video và âm thanh dựa trên AI
VoiceDrop
Nói và nó tự lưu trữ: ứng dụng viết bài bằng giọng nói
VibeVoice
Dòng mô hình giọng nói AI mã nguồn mở từ Microsoft, hỗ trợ tạo âm thanh siêu dài 90 phút
SoundView
Nền tảng bản địa hóa video AI từ iFlyTek, chuyên dịch thuật video, lồng tiếng và tạo video cho thương mại điện tử xuyên biên giới
Anylang.ai
Công cụ dịch video AI, giữ nguyên âm sắc gốc và đồng bộ khẩu hình
Magicam
Real-time AI face swap and voice changer
Yunmu Tongsheng
Công cụ dịch video AI, 20+ ngôn ngữ, 98% độ chính xác
LPM 1.0
Mô hình hội thoại AI song công thời gian thực với 17 tỷ tham số dành cho diễn xuất nhân vật video
ElevenLabs
Nền tảng tạo và xử lý giọng nói AI cung cấp dịch vụ chuyển văn bản thành giọng nói, nhân bản giọng nói và tác nhân giọng nói
Speechify
Ứng dụng chuyển văn bản thành giọng nói AI chuyển đổi tài liệu và trang web thành giọng nói tự nhiên, hỗ trợ hơn 60 ngôn ngữ và 1000 giọng nói
Dub AI
Nền tảng dịch thuật và lồng tiếng video dựa trên AI, giúp bản địa hóa nhanh chóng nội dung video sang hơn 30 ngôn ngữ
Rask AI
Nền tảng bản địa hóa và lồng tiếng video bằng AI, hỗ trợ dịch tự động hơn 130 ngôn ngữ
VozoAI
Công cụ AI dịch video, lồng tiếng và đồng bộ khẩu hình, hỗ trợ hơn 110 ngôn ngữ
Vapi
Nền tảng AI giọng nói dành cho lập trình viên, giúp xây dựng, kiểm thử và triển khai tác nhân giọng nói nhanh chóng
LobeChat
Framework chatbot mã nguồn mở hiệu năng cao, hỗ trợ đa mô hình, tổng hợp giọng nói và đa phương thức
iFlyTek Spark
Mô hình nhận thức lớn của iFlyTek, nổi bật về tương tác giọng nói và lĩnh vực giáo dục