Die KI-Spracherkennung nutzt das neuronale Netz Whisper von OpenAI, um gesprochene Sprache in Text umzuwandeln. Trainiert mit 680.000 Stunden mehrsprachiger Sprache, versteht sie über 90 Sprachen, Akzente und Hintergrundgeräusche besser als herkömmliche Systeme.
Alles läuft lokal in Ihrem Browser über ONNX Runtime - Ihre Aufnahmen verlassen nie Ihr Gerät. Beim ersten Mal wird ein ~250MB-Modell heruntergeladen und für die Wiederverwendung zwischengespeichert. Export als TXT oder SRT-Untertitel mit Zeitstempeln.
Ja - komplett kostenlos und unbegrenzt. Die KI läuft auf Ihrem eigenen Gerät.
Nein. Das Modell wird in Ihren Browser geladen und die gesamte Transkription erfolgt lokal.
Über 90, darunter Englisch, Chinesisch, Japanisch, Koreanisch, Spanisch, Französisch, Deutsch, Arabisch, Hindi, Thailändisch, Vietnamesisch, Indonesisch und Russisch.
Klartext (TXT) und SRT-Untertitel mit Zeitstempeln.
MP3, WAV, FLAC, OGG, M4A, WEBM und alle vom Browser dekodierbaren Formate.