バグ/機能要求を報告

AI ステムスプリッタ

どんな曲でも、ボーカル、ドラム、ベース、その他の楽器などの個々のステムに分割します。音楽プロデュース、リミックス、練習のための最新のAIを搭載しています。

音楽トラックをアップロード

1曲3〜5クレジット

ファイルをここにドラッグ&ドロップするか、 ブラウズ

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

ファイル.mp3

0 MB

ステム分割の設定

Mel-Band RoFormerモデルからのボーカル、SCNetモデルからのドラム、ベースなど、無損失WAV出力、DAW用に準備済み。

自由に2ステム分割できる - 会計は必要ない。

どうやって働くのか

アップロード
人工知能がそれぞれのステムを分離する
ステムのプレビューとダウンロード
ステムを分割中...

トラックをステムに分割...

使用中 Mel-Band RoFormer + SCNet あなたは 4ステム
時間がかかりますか? 結果は 世代の歴史 準備ができたら
ステム分割完了

声部

0:00

ドラムス

0:00

ベース

0:00

その他

0:00
作成されたステム 4
曲の持続時間 4:12
処理時間 18.3s

音声ステムとは何か?

オーディオステムは、曲を構成する個々の楽器やボーカルトラックである。プロの音楽は、通常、数十の個々のトラックからミックスされるが、ステムスプリットは、ミックスをリバースエンジニアリングし、主成分を抽出するためにAIを使用する。

声部 歌、ラッピング、ハーモニー、バックボーカル、アドリブ
ドラムス キック、スネア、ハイハット、シンバル、トム、パーカッション
ベース ベースギター、シンセベース、サブベース、808s
その他 その他は全てギター、ピアノ、キーボード、弦、ブラス、シンセ、効果音

モデルの詳細

声部 Mel-Band RoFormer

各スプリットで歌声を分離します。トランスフォーマーは時間とスペクトルグラムのメルスケール周波数帯域を通して動作し、インストゥルメンタルは歌声を除去したミックスです。50 MUSDB18 テストエクスポートで測定: 歌声 SDR 11.3 dB, インストゥルメンタル SDR 16.0 dB。

ステム: 2, 4

ドラムス SCNet

4ステムモードでインストゥルメンタルをドラム、ベース、その他の楽器に分割します。スペクトログラムを周波数サブバンドに分割し、ベースとキックドラムが入る低域をより詳細にします。

ステム: 4

最高の結果を得るためのヒント

  • クリーンな分離のために無損失入力 (WAV/FLAC) を使用
  • ほとんどの音楽プロデュースのニーズに対して 4ステムはスウィートスポットです
  • ギター、ピアノ、シンセは すべて「その他」ステムに着陸
  • 明確な編曲(層化が少ない)の曲が良い結果をもたらす
  • 編集のためにDAWにインポートする場合は WAV としてエクスポート
  • 声のみの除去には 専門的な ボーカルリミッター

どうやって働くのか

ディープ学習モデルは音楽のスペクトルと時間パターンを解析し,個々の楽器グループを顕著な精度で分離する。

ステップ 1

アップロード

通常のオーディオフォーマットの音楽ファイルをドラッグ&ドロップしてください。 MP3、WAV、FLAC、OGG、M4A のファイルは最大 50MB まで受け付けます。最良の結果を得るには、WAV または FLAC のような無損失フォーマットを使用してください。ファイルは GPU サーバで安全に処理され、1 時間以内に自動的に削除されます。

ステップ 2

人工知能がそれぞれのステムを分離する

Mel‐Band RoFormerモデルは,時間とスペクトルグラムのmelスケール周波数帯域にわたるトランスフォーマントレーサ注意を用いて,最初にボーカルを分離し,4ステムの場合,SCNetモデルは残りの楽器をドラム,ベース,その他の楽器に分割する。

ステップ 3

ステムのプレビューとダウンロード

抽出されたステムはそれぞれ独自のオーディオプレーヤーを持ち、それぞれの楽器を個別にプレイすることができます。特定のステムをソロまたはミュートして、それらがどのように相互作用するかを聞くことができます。各ステムを個別にダウンロードしたり、DAWにインポートする準備ができた便利なZIPアーカイブにすべてを収めました。

ステムスプリッティングユースケース

AIによるステムスプリッティングは音楽製作,教育,クリエイティブワークフローに革命をもたらしている。

音楽プロデュース・リミックス

個々のステムを抽出してリミックス、マッシュアップ、新しいアレンジを作成します。既存の録音からドラムパターン、ベースライン、ボイスフックをサンプリングします。異なる曲からステムをレイヤーしてユニークなプロダクションを作成します。レファレンストラックを使用したり、公式のリミックスを作成するプロデューサーにとって不可欠です。

パフォーマンス

ライブ DJ セッティングやパフォーマンスのためのステムを作成します。アカペラドロップ、独立したドラムブレイク、ベースのみのバージョンを作成して創造的なブレンドを作成します。トランジショントラックを作成して曲を円滑に結びつけます。一つのトラックのボーカルステムを他のトラックのインストゥルメンタルにミックスしてユニークなライブマッシュアップを作成します。

練習と研究

練習するための特定の楽器パートを隔離します。ドラマーはドラムトラックを無音にしてバンドの他のメンバーと共に演奏できます。ベーシストはテクニックを学ぶためにベースラインを隔離できます。ギターやキーボードプレーヤーは「その他」ステムをソロで使用して、ボーカル、ドラム、ベースなしでパートを聴くことができます。

音楽教育

音楽理論分析のために曲を構成要素に分解します。生徒がミックスの中でどのように楽器が相互作用するかを理解するのを助けます。各ステムが最終曲にどのように寄与するかを示して、編曲技術を示します。音楽クラスのためのカスタム練習トラックを作成します。

サンプリングとサウンドデザイン

すべての録音から新しいプロダクションに使用するクリーンサンプリングを抽出します。ワンショットドラムヒット、ベース音、ボーカルチャップ、音楽フレーズを分離します。既存の録音からサンプルパックとサウンドライブラリを作成します。エフェクトチェーンを通して個々のステムを処理してユニークなテクスチャを作成します。

映画・メディア・ポストプロダクション

映画やテレビのポストプロダクションのための音楽ステムを抽出します。サウンドトラックのミキシングにおけるボーカルと楽器のバランスを調整します。バックグラウンドに使用するライセンス音楽の楽器バージョンを作成します。ビデオプロダクションにおけるサウンドデザインとフォレーの仕事のための特定の要素を分離します。

カラオケ・カバー

ボーカルを削除してカラオケの完璧なバックトラックを作成します。オリジナルの楽器編成に自分のボーカルを録音します。ドラムとベースのステムをアコースティックパフォーマンスやバンドリハーサルのリズムセクションのバックトラックとして使用します。ライブショーのためのカスタムバックトラックを作成します。

オーディオ解析と転写

ステムを分離して正確な音楽転写を作成します。記譜目的のために個々の楽器パートを明瞭に聞くことができます。各ステムがどのように処理されているかを研究してミキシング技法を分析します。音楽学者、転写サービス、編曲分析に最適です。

ザ・モストパワフル・フリー・ステム・スプリッター・オンライン

2つの特殊モデル

分割の各部分は、その仕事に適したモデルを使用します。ボーカルは、50 個の MUSDB18 テストエッセイで 11.3 dB のボーカル SDR を測定した Mel-Band RoFormer モデルから来ています。これは、以前のエンジンより 3 dB 上です。4 ステムモードでは、SCNet モデルはドラム、ベース、その他の楽器をインストゥルメンタルから分離します。ギター、ピアノ、シンセサイザーは、「その他」ステムに一緒に残ります。

自由な 2ステム分割

2 ステム分離を無料で試してみてください。アカウントを作成したり文字を使わずにどんな曲でもボーカルとインストゥルメンタルに分割できます。フリースプリットはウォーターマークなしでアカウントスプリットと同じボーカルモデルを使用します。無料アカウントを作成してドラム、ベース、その他の楽器を 4 ステムモードでスプリットします。

GPU加速処理

ステムスプリットは計算量が大きい。TTS.aiは分離モデルを専用のNVIDIA GPUで実行します。処理時間は曲長と共に増加します。4つのステムは2つよりも長くなります。なぜなら、2番目のモデルが楽器上で実行されているからです。

バッチ処理用REST API

開発者APIを使ってプログラム的に全ての音楽ライブラリを処理します。自分のアプリケーション、音楽プロダクションツール、DJ準備ワークフローにステムスプリットを構築します。APIは2つと4つのステムをサポートします。モデルパラメータは互換性のためにdemucsとspliterを受け入れ、両方とも同じエンジンを実行します。APIアクセスは Python、JavaScript、cURL SDKを使ってすべてのプランに含まれています。

ステムスプリットプラン

無料で始め、必要に応じてアップグレード

自由
  • 2ステムスプリット(ボーカル+インストゥルメンタル)
  • メルバンド・ロ元ヴォーカルモデル
  • 10分間の曲
  • アカウントが必要ありません
最も人気のある
無料アカウント
  • 4ステムスプリット(ボーカル・ドラム・ベース・その他)
  • SCNetドラム、ベースその他
  • ステムごとのダウンロード + ZIP
  • 15,000文字フリー
無料登録
プロ
  • アップロードは2GBまで
  • 長いオーディオファイル
  • バッチ処理
  • APIアクセス
アップグレード

よくある質問

ステムスプリットは、ミックスされたオーディオトラックを個々の構成要素 (ステム) に分割します。これはボーカル、ドラム、ベース、その他の楽器です。これは音楽プロデュース、リミックス、サンプリング、転写、カラオケにとって貴重です。

トラックを 2 つのステム (ボーカルとインストゥルメンタル) または 4 つのステム (ボーカル、ドラム、ベース、その他の楽器) に分割できます。ギター、ピアノ、シンセサイザーなど、ボーカル、ドラム、ベース以外のすべては「その他」ステムに残ります。

各スプリットでメルバンドRoFormerモデルで歌声を分離します。4ステムモードではSCNetモデルでドラム、ベース、その他の楽器を楽器から分離します。各レベルには1つのエンジンがあり、フリー2ステムスプリットはアカウントスプリットと同じ歌声モデルを使用します。

On 50 MUSDB18 test excerpts the vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR (signal-to-distortion ratio, higher is cleaner), about 3 dB better on both than the engine we used before. Some bleed-through between stems is normal, especially on heavily layered or compressed mixes.

処理時間はトラックの長さとステムの数に依存します。4ステムスプリットは2ステムスプリットよりも時間がかかります。なぜなら、2 番目のモデルがボーカルを除去した後にインストゥルメンタルを分離するからです。

有料プランで分離したステムは商用利用可能で、アップグレードはフリープランで作成したステムも含みます。フリープランの出力は個人的な非商用利用のみです。両方の分離モデルは商用利用を許可するライセンスでリリースされています。Mel-Band RoFormer ヴォーカルモデルは MIT ライセンス、SCNet モデルは Apache 2.0 ライセンスです。どちらの場合も、オリジナルオーディオの権利を持つ必要があります。著作権のある音楽を分離すると、個々のステムに対して新しい権利は与えられません。

ウェブインタフェースは一度に一つのトラックを扱い、すべてのステムの即時プレビューとダウンロードを行う。

独自のステムとしてではありません。4ステムモードでは、ギター、ピアノ、シンセサイザー、キーボード、その他の楽器を Other ステムに一緒に入れます。専用のギターやピアノステムはありません。

各ステムは別々のオーディオファイルとしてエクスポートされ、DAW (Ableton, Logic Pro, FL Studio など) にインポートしてリミックスできます。レベルを調整し、効果を追加したり、個々のステムを置き換えて新しいアレンジを作成できます。

ステムスプリットは処理されたトラックごとに 2,000 文字を使用します。無料アカウントは登録時に 15,000 文字を受け取ります。すべての有料プランには、定期的な使用に対して寛大な文字許容量が含まれています。

50MBまでの MP3、WAV、FLAC、OGG、M4A、WEBM ファイルを受け付けます。最良の分離品質のためには、無損失フォーマット (WAV、FLAC) をアップロードしてください。出力ステムは最高の品質を保つために WAV フォーマットで提供されます。

Our vocals come from a Mel-Band RoFormer model, a transformer architecture for music source separation, and the 4-stem split adds an SCNet model for drums, bass and other instruments. Rather than a ranking, we publish what we measured: 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts.
5.0/5 (1)

改善点は何ですか?フィードバックは問題を解決するのに役立ちます。

任意の曲を無料でステムに分割

TTS.aiを使って何千ものミュージシャンやプロデューサーに加わってください。無料の 2ステム分割が現在利用可能です。4ステムモードの無料アカウントで 15,000 文字を入手できます。