La IA de voz a texto usa la red neuronal Whisper de OpenAI para convertir audio hablado en texto escrito. Entrenada con 680.000 horas de voz multilingüe, entiende más de 90 idiomas, acentos y ruido de fondo mejor que los sistemas tradicionales.
Todo se ejecuta localmente en tu navegador mediante ONNX Runtime: tus grabaciones nunca salen de tu dispositivo. La primera vez descarga un modelo de ~250MB, almacenado en caché para reutilizarlo al instante. Exporta como TXT o subtítulos SRT con marcas de tiempo.
Sí, completamente gratis y sin límites. La IA se ejecuta en tu propio dispositivo.
No. El modelo se descarga en tu navegador y toda la transcripción ocurre localmente.
Más de 90, incluyendo inglés, chino, japonés, coreano, español, francés, alemán, árabe, hindi, tailandés, vietnamita, indonesio y ruso.
Texto plano (TXT) y subtítulos SRT con marcas de tiempo.
MP3, WAV, FLAC, OGG, M4A, WEBM y cualquier formato que tu navegador pueda decodificar.