L'IA de parole en texte utilise le réseau neuronal Whisper d'OpenAI pour convertir la parole en texte écrit. Entraînée sur 680 000 heures de parole multilingue, elle comprend plus de 90 langues, accents et bruits de fond mieux que les systèmes traditionnels.
Tout s'exécute localement dans votre navigateur via ONNX Runtime - vos enregistrements ne quittent jamais votre appareil. La première utilisation télécharge un modèle de ~250 Mo, mis en cache pour une réutilisation instantanée. Exportez en TXT ou en sous-titres SRT horodatés.
Oui - entièrement gratuit et sans limites. L'IA s'exécute sur votre propre appareil.
Non. Le modèle est téléchargé dans votre navigateur et toute la transcription se fait localement.
Plus de 90, dont l'anglais, le chinois, le japonais, le coréen, l'espagnol, le français, l'allemand, l'arabe, l'hindi, le thaï, le vietnamien, l'indonésien et le russe.
Du texte brut (TXT) et des sous-titres SRT avec horodatage.
MP3, WAV, FLAC, OGG, M4A, WEBM et tout format décodable par votre navigateur.