Heard
Sprachebene für macOS, die Terminal-Ausgaben von Claude Code, Codex und Cursor in intelligente Sprachzusammenfassungen verwandelt
Heard
Sprachebene für macOS, die Terminal-Ausgaben von Claude Code, Codex und Cursor in intelligente Sprachzusammenfassungen verwandelt
Hitoo
Videogesprächsplattform mit Echtzeit-Sprachübersetzung, verwendet das proprietäre End-to-End-KI-Modell AURIS zur Übersetzung zwischen 50+ Sprachen in unter 300 ms unter Beibehaltung der Sprecherstimme
Meco
Lese-App, die Newsletter aus dem Postfach holt und als tägliche KI-Audio-Zusammenfassungen aufbereitet
Kyutai Pocket-TTS
Open-Source-Sprachsynthese-Modell mit 100 Millionen Parametern, läuft in Echtzeit auf der CPU, klont jede Stimme mit 5 Sekunden Audio
VocalVia
KI-Arbeitsbereich, der PDFs, Artikel und Notizen in editierbare Multi-Charakter-Podcasts verwandelt
Doubao App 2.0
ByteDances nationaler KI-Intelligenzassistent, der Text, Bild, Video, Sprache und Produktivitätsagenten vereint
EdgeTTS Online TTS
Kostenloses Online-Text-zu-Sprache-Tool basierend auf Microsoft Edge neuronalen Stimmen, kein Login, keine Werbung, gleichzeitige SRT-Untertitelgenerierung
FreeTTS Chinese TTS
Kostenloses, registrierungsfreies chinesisches neuronales Sprachsynthese-Tool, deckt Mandarin, Kantonesisch und Taiwanesisch ab, MP3-Export und SRT-Untertitel mit einem Klick
ElevenLabs v4
Vierte Generation des KI-Sprachmodells von ElevenLabs, das flüstern, singen und Emotionen und Akzente auf menschlichem Niveau ausdrücken kann
Murf 2
Full-Stack-KI-Sprachplattform für Teams und Unternehmen
Suno 3.0
Neueste KI-Musikgenerierung mit Song-Feinabstimmung, mehrsprachigen natürlichen Stimmen und professionellem Mastering-Mehrspur-Export
Spotify AI DJ 2.0
Spotifys KI-gestützter virtueller Radio-DJ für Premium-Nutzer, der personalisierte Musikmixe und Sprachkommentare in Echtzeit generiert
GPT-Live Voice
Full-Duplex-Sprachmodell der nächsten Generation von OpenAI
Read PDF Aloud
Kostenloses Online-KI-PDF-Vorlesewerkzeug
Video to Text
KI-basiertes Video- und Audio-Transkriptionstool
VoiceDrop
Sprich und es archiviert sich selbst: sprachgesteuerte Artikel-Schreibanwendung
VibeVoice
Open-Source-KI-Sprachmodellfamilie von Microsoft, unterstützt 90-minütige Ultra-Lang-Audiogenerierung
SoundView
KI-Videolokalisierungsplattform von iFlyTek, spezialisiert auf Videobersetzung, Synchronisation und Videocreation für grenzüberschreitenden E-Commerce
Anylang.ai
KI-Videoübersetzungstool, das die originale Stimmlage und Lippensynchronisation beibehält
Magicam
Real-time AI face swap and voice changer
Yunmu Tongsheng
KI-Videoübersetzungstool, 20+ Sprachen, 98% Tonwiedergabe
LPM 1.0
Echtzeit-Voll duplex-KI-Dialogmodell mit 17 Milliarden Parametern für Video-Charakterdarstellung
ElevenLabs
KI-Sprachgenerierungs- und -verarbeitungsplattform mit Text-zu-Sprache, Sprachklonung und Sprachagenten-Diensten
Speechify
KI-Text-zu-Sprache-App, die Dokumente und Webseiten in natürliche Sprache umwandelt, kompatibel mit über 60 Sprachen und 1000 Stimmen
Dub AI
KI-gesteuerte Video-Übersetzungs- und Synchronisationsplattform zur schnellen Lokalisierung von Videoinhalten in über 30 Sprachen
Rask AI
KI-gestützte Plattform für Videolokalisierung und -vertonung mit automatischer Übersetzung in über 130 Sprachen
VozoAI
KI-Tool für Videoübersetzung, Vertonung und Lippensynchronisation, mit Unterstützung für über 110 Sprachen
Vapi
Sprach-KI-Plattform für Entwickler zum schnellen Erstellen, Testen und Bereitstellen von Sprachagenten
LobeChat
Hochperformantes Open-Source-Chatbot-Framework mit Unterstützung für mehrere Modelle, Sprachsynthese und Multimodalität
iFlyTek Spark
Kognitives Großmodell von iFlyTek mit herausragenden Stärken bei Sprachinteraktion und Bildung