AI chuyển giọng nói thành văn bản dùng mạng nơ-ron Whisper của OpenAI để biến âm thanh thành chữ. Được huấn luyện trên 680.000 giờ giọng nói đa ngôn ngữ, hiểu hơn 90 ngôn ngữ, giọng địa phương và tiếng ồn nền tốt hơn hệ thống truyền thống.
Mọi thứ chạy cục bộ trong trình duyệt qua ONNX Runtime - bản ghi của bạn không bao giờ rời khỏi thiết bị. Lần đầu tải mô hình ~250MB, được lưu cache để dùng lại ngay. Xuất dạng TXT hoặc phụ đề SRT có dấu thời gian.
Có - hoàn toàn miễn phí, không giới hạn. AI chạy trên chính thiết bị của bạn.
Không. Mô hình tải về trình duyệt và mọi phiên âm diễn ra cục bộ.
Hơn 90 ngôn ngữ gồm Anh, Trung, Nhật, Hàn, Tây Ban Nha, Pháp, Đức, Ả Rập, Hindi, Thái, Việt, Indonesia và Nga.
Văn bản thuần (TXT) và phụ đề SRT có dấu thời gian.
MP3, WAV, FLAC, OGG, M4A, WEBM và mọi định dạng trình duyệt giải mã được.