AI 语音转文字使用 OpenAI 的 Whisper 神经网络把语音转换为文字。模型在 68 万小时多语言语音上训练,对 90+ 语言、口音和背景噪音的理解优于传统识别系统。
全部在浏览器本地运行(ONNX Runtime)——录音永不离开你的设备。首次下载约 250MB 模型并缓存,之后秒开。可导出纯文本 TXT 或带时间戳的 SRT 字幕。
是——完全免费无限制。AI 在你的设备上运行。
不会。模型下载到浏览器,全部转录本地完成。
90+ 种,包括英、中、日、韩、西、法、德、阿、印地、泰、越、印尼、俄等。
纯文本(TXT)和带时间戳的 SRT 字幕。
MP3、WAV、FLAC、OGG、M4A、WEBM 等浏览器可解码的格式。