AI ステムスプリッタ
どんな曲でも、ボーカル、ドラム、ベース、その他の楽器などの個々のステムに分割します。音楽プロデュース、リミックス、練習のための最新のAIを搭載しています。
音楽トラックをアップロード
1曲3〜5クレジットどうやって働くのか
音声ステムとは何か?
オーディオステムは、曲を構成する個々の楽器やボーカルトラックである。プロの音楽は、通常、数十の個々のトラックからミックスされるが、ステムスプリットは、ミックスをリバースエンジニアリングし、主成分を抽出するためにAIを使用する。
モデルの詳細
声部 Mel-Band RoFormer
各スプリットで歌声を分離します。トランスフォーマーは時間とスペクトルグラムのメルスケール周波数帯域を通して動作し、インストゥルメンタルは歌声を除去したミックスです。50 MUSDB18 テストエクスポートで測定: 歌声 SDR 11.3 dB, インストゥルメンタル SDR 16.0 dB。
ドラムス SCNet
4ステムモードでインストゥルメンタルをドラム、ベース、その他の楽器に分割します。スペクトログラムを周波数サブバンドに分割し、ベースとキックドラムが入る低域をより詳細にします。
最高の結果を得るためのヒント
- クリーンな分離のために無損失入力 (WAV/FLAC) を使用
- ほとんどの音楽プロデュースのニーズに対して 4ステムはスウィートスポットです
- ギター、ピアノ、シンセは すべて「その他」ステムに着陸
- 明確な編曲(層化が少ない)の曲が良い結果をもたらす
- 編集のためにDAWにインポートする場合は WAV としてエクスポート
- 声のみの除去には 専門的な ボーカルリミッター
どうやって働くのか
ディープ学習モデルは音楽のスペクトルと時間パターンを解析し,個々の楽器グループを顕著な精度で分離する。
アップロード
通常のオーディオフォーマットの音楽ファイルをドラッグ&ドロップしてください。 MP3、WAV、FLAC、OGG、M4A のファイルは最大 50MB まで受け付けます。最良の結果を得るには、WAV または FLAC のような無損失フォーマットを使用してください。ファイルは GPU サーバで安全に処理され、1 時間以内に自動的に削除されます。
人工知能がそれぞれのステムを分離する
Mel‐Band RoFormerモデルは,時間とスペクトルグラムのmelスケール周波数帯域にわたるトランスフォーマントレーサ注意を用いて,最初にボーカルを分離し,4ステムの場合,SCNetモデルは残りの楽器をドラム,ベース,その他の楽器に分割する。
ステムのプレビューとダウンロード
抽出されたステムはそれぞれ独自のオーディオプレーヤーを持ち、それぞれの楽器を個別にプレイすることができます。特定のステムをソロまたはミュートして、それらがどのように相互作用するかを聞くことができます。各ステムを個別にダウンロードしたり、DAWにインポートする準備ができた便利なZIPアーカイブにすべてを収めました。
ステムスプリッティングユースケース
AIによるステムスプリッティングは音楽製作,教育,クリエイティブワークフローに革命をもたらしている。
音楽プロデュース・リミックス
個々のステムを抽出してリミックス、マッシュアップ、新しいアレンジを作成します。既存の録音からドラムパターン、ベースライン、ボイスフックをサンプリングします。異なる曲からステムをレイヤーしてユニークなプロダクションを作成します。レファレンストラックを使用したり、公式のリミックスを作成するプロデューサーにとって不可欠です。
パフォーマンス
ライブ DJ セッティングやパフォーマンスのためのステムを作成します。アカペラドロップ、独立したドラムブレイク、ベースのみのバージョンを作成して創造的なブレンドを作成します。トランジショントラックを作成して曲を円滑に結びつけます。一つのトラックのボーカルステムを他のトラックのインストゥルメンタルにミックスしてユニークなライブマッシュアップを作成します。
練習と研究
練習するための特定の楽器パートを隔離します。ドラマーはドラムトラックを無音にしてバンドの他のメンバーと共に演奏できます。ベーシストはテクニックを学ぶためにベースラインを隔離できます。ギターやキーボードプレーヤーは「その他」ステムをソロで使用して、ボーカル、ドラム、ベースなしでパートを聴くことができます。
音楽教育
音楽理論分析のために曲を構成要素に分解します。生徒がミックスの中でどのように楽器が相互作用するかを理解するのを助けます。各ステムが最終曲にどのように寄与するかを示して、編曲技術を示します。音楽クラスのためのカスタム練習トラックを作成します。
サンプリングとサウンドデザイン
すべての録音から新しいプロダクションに使用するクリーンサンプリングを抽出します。ワンショットドラムヒット、ベース音、ボーカルチャップ、音楽フレーズを分離します。既存の録音からサンプルパックとサウンドライブラリを作成します。エフェクトチェーンを通して個々のステムを処理してユニークなテクスチャを作成します。
映画・メディア・ポストプロダクション
映画やテレビのポストプロダクションのための音楽ステムを抽出します。サウンドトラックのミキシングにおけるボーカルと楽器のバランスを調整します。バックグラウンドに使用するライセンス音楽の楽器バージョンを作成します。ビデオプロダクションにおけるサウンドデザインとフォレーの仕事のための特定の要素を分離します。
カラオケ・カバー
ボーカルを削除してカラオケの完璧なバックトラックを作成します。オリジナルの楽器編成に自分のボーカルを録音します。ドラムとベースのステムをアコースティックパフォーマンスやバンドリハーサルのリズムセクションのバックトラックとして使用します。ライブショーのためのカスタムバックトラックを作成します。
オーディオ解析と転写
ステムを分離して正確な音楽転写を作成します。記譜目的のために個々の楽器パートを明瞭に聞くことができます。各ステムがどのように処理されているかを研究してミキシング技法を分析します。音楽学者、転写サービス、編曲分析に最適です。
ザ・モストパワフル・フリー・ステム・スプリッター・オンライン
2つの特殊モデル
分割の各部分は、その仕事に適したモデルを使用します。ボーカルは、50 個の MUSDB18 テストエッセイで 11.3 dB のボーカル SDR を測定した Mel-Band RoFormer モデルから来ています。これは、以前のエンジンより 3 dB 上です。4 ステムモードでは、SCNet モデルはドラム、ベース、その他の楽器をインストゥルメンタルから分離します。ギター、ピアノ、シンセサイザーは、「その他」ステムに一緒に残ります。
自由な 2ステム分割
2 ステム分離を無料で試してみてください。アカウントを作成したり文字を使わずにどんな曲でもボーカルとインストゥルメンタルに分割できます。フリースプリットはウォーターマークなしでアカウントスプリットと同じボーカルモデルを使用します。無料アカウントを作成してドラム、ベース、その他の楽器を 4 ステムモードでスプリットします。
GPU加速処理
ステムスプリットは計算量が大きい。TTS.aiは分離モデルを専用のNVIDIA GPUで実行します。処理時間は曲長と共に増加します。4つのステムは2つよりも長くなります。なぜなら、2番目のモデルが楽器上で実行されているからです。
バッチ処理用REST API
開発者APIを使ってプログラム的に全ての音楽ライブラリを処理します。自分のアプリケーション、音楽プロダクションツール、DJ準備ワークフローにステムスプリットを構築します。APIは2つと4つのステムをサポートします。モデルパラメータは互換性のためにdemucsとspliterを受け入れ、両方とも同じエンジンを実行します。APIアクセスは Python、JavaScript、cURL SDKを使ってすべてのプランに含まれています。
よくある質問
改善点は何ですか?フィードバックは問題を解決するのに役立ちます。