このツールは、Meta のオープンソース AI モデルである Demucs v4 (htdemucs) を使用しており、完全にブラウザーで実行されます。曲をアップロードすると、ボーカル、ドラム、ベース、その他の楽器という 4 つの独立したステムを取得できます。どのサーバーにも何もアップロードされません。
モデルは、最初の読み込み後にブラウザーにキャッシュされた 80 MB のモデル ファイルを使用して、ggml 推論エンジンの WebAssembly ビルドを通じて実行されます。分離速度はデバイスによって異なります。通常、3 分の曲はデスクトップ CPU で 1 ~ 3 分かかりますが、コアが多いマシンではより速くなります。
はい - 制限なしで完全に無料です。 AI モデルは自分のデバイス上で実行されるため、サーバーにコストがかかることはありません。
いいえ。ファイルがブラウザから離れることはありません。デコード、AI 推論、ステム レンダリングはすべてデバイス上でローカルに行われます。
DAW でステムをリミックスしたり、ボーカルを削除してカラオケ トラックを作成したり、サンプリング用にドラム ループを分離したり、バッキング トラックに合わせて楽器を練習したりできます。
3 分の曲は、一般的なデスクトップではおよそ 1 ~ 3 分かかります。 80 MB モデルは一度ダウンロードする必要があるため、最初の実行は遅くなります。
最高のパフォーマンスを得るには Chrome と Edge をお勧めします。他の最新のブラウザも動作しますが、速度が遅くなる可能性があります。モバイル デバイスは短いクリップを処理できますが、メモリには制限があります。