AI स्पीच टू टेक्स्ट बोले गए ऑडियो को लिखित टेक्स्ट में बदलने के लिए OpenAI के Whisper न्यूरल नेटवर्क का उपयोग करता है। 680,000 घंटे की बहुभाषी वाणी पर प्रशिक्षित, यह पारंपरिक सिस्टम से बेहतर 90+ भाषाएँ, उच्चारण और पृष्ठभूमि शोर समझता है।
सब कुछ ONNX Runtime के ज़रिए आपके ब्राउज़र में लोकल चलता है - आपकी रिकॉर्डिंग कभी आपके डिवाइस से बाहर नहीं जाती। पहली बार ~250MB मॉडल डाउनलोड होता है, जो तुरंत पुनः उपयोग के लिए कैश रहता है। TXT या टाइमस्टैम्प वाली SRT सबटाइटल के रूप में एक्सपोर्ट करें।
हाँ - पूरी तरह मुफ़्त और असीमित। AI आपके अपने डिवाइस पर चलता है।
नहीं। मॉडल आपके ब्राउज़र में डाउनलोड होता है और पूरी ट्रांसक्रिप्शन लोकल होती है।
अंग्रेज़ी, चीनी, जापानी, कोरियाई, स्पेनिश, फ़्रेंच, जर्मन, अरबी, हिंदी, थाई, वियतनामी, इंडोनेशियाई और रूसी सहित 90+ भाषाएँ।
सादा टेक्स्ट (TXT) और टाइमस्टैम्प वाली SRT सबटाइटल।
MP3, WAV, FLAC, OGG, M4A, WEBM और कोई भी फ़ॉर्मेट जो आपका ब्राउज़र डिकोड कर सके।