KI Vocal Remover

Trennen Sie Vocals von Instrumentals in jedem Song mit modernster KI. Erstellen Sie Karaoke-Tracks, Acapellas und Backing Tracks kostenlos.

Song zum Prozess hochladen

3.000 Zeichen pro Lied

Drag & Drop Ihre Datei hier, oder durchsuchen

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

Datei.mp3

0 MB
— oder von Ihrem Mikrofon aufnehmen —
00:00

Trennungseinstellungen

Beide Modi verwenden das gleiche Mel-Band RoFormer Modell.
Kostenlos mit einem kostenlosen Konto versuchen

Wie es funktioniert

Laden Sie Ihr Lied hoch
AI trennt die Tracks
Vorschau & Herunterladen
Vocals trennen...

Vocals von Instrumentals trennen...

Verwendung Mel-Band RoFormer bei Ausgewogen Qualität
Nehmen Sie eine Weile? Ihr Ergebnis wird in Ihrem erscheinen Erzeugungsgeschichte Wenn bereit.
Stimmtrennung vollständig

Gesang

0:00

Instrumentalgeräte

0:00
Trennungsqualität 8.2 dB SDR
Gesangsblutung < 2%
Songdauer 3:42
Bearbeitungszeit 12.4s

Trennmaschine

Modell Mel-Band RoFormer
Ausgabe Gesang + Instrumental
SZR-Gesang 11.3 dB
Instrumentelle SZR 16.0 dB

Gemessen an 50 MUSDB18 Testausschnitten. SDR ist das Signal-zu-Verzerrungsverhältnis: höher ist sauberer. Unser Vorgängermotor erzielte 8,4 dB (Gesang) und 13,1 dB (Instrumental).

Warum TTS.ai gegen Wettbewerber

Freie Ebene verfügbar

Versuchen Sie es mit einem kostenlosen Konto. Konkurrenten wie LALAL.AI, Moises und PhonicMind berechnen $5-25/Monat für die grundlegende Stimmentfernung.

Gemessene Trennungsqualität

Die Vocals sind durch ein Mel-Band RoFormer Modell getrennt. Auf 50 MUSDB18 Testausschnitten erzielte sie 11,3 dB Gesangs-SDR und 16,0 dB Instrumental-SDR, etwa 3 dB über unserem vorherigen Motor auf beiden.

Keine Wasserzeichen oder Qualitätskappen

Laden Sie die vollwertige Ausgabe in WAV, MP3 oder FLAC herunter. Keine Wasserzeichen, kein Trimmen, keine Bitratenbeschränkungen auf jeder Ebene.

API-Zugriff für Batch-Verarbeitung

Hunderte von Songs programmatisch über unsere REST API verarbeiten. Perfekt für Musikproduktionsfirmen und DJ-Pools.

Tipps für beste Ergebnisse

  • WAV- oder FLAC-Eingang für maximale Qualitätstrennung verwenden
  • Wählen Sie beide, um die Acapella und das Instrumental aus einem Upload zu erhalten
  • Studiomaster trennen sich sauberer als Live- oder Bootleg-Aufnahmen
  • Songs mit klarer Stereo-Trennung sorgen für beste Ergebnisse
  • Schwer komprimierte MP3s (128kbps oder niedriger) können die Trennungsqualität verringern
  • Für Multi-Stem-Splitting (Schlagzeug, Bass, etc.), verwenden Sie unsere Stem-Splitter

Wie es funktioniert

Tiefe neuronale Netzwerke analysieren das Audiospektrum Ihres Songs, identifizieren Gesangsfrequenzen und trennen sie sauber in drei Schritten von der instrumentalen Unterstützung.

Schritt 1

Laden Sie Ihr Lied hoch

Ziehen und lassen Sie jeden Song in MP3, WAV, FLAC, OGG oder M4A Format. Wir unterstützen Dateien bis zu 50MB und Songs bis zu 10 Minuten lang. Ihre Datei wird beim Hochladen verschlüsselt und auf isolierten GPU-Instanzen verarbeitet. Dateien werden automatisch innerhalb einer Stunde nach der Verarbeitung gelöscht.

Schritt 2

AI trennt die Tracks

Ein Mel-Band RoFormer-Modell wandelt Ihr Audio in ein Spektrogramm um, das in mel-skalierte Frequenzbänder aufgeteilt ist, und verwendet dann die Trafo-Betrachtung über Zeit und Frequenz hinweg, um den Gesangstrack zu schätzen. Instrumental ist der Originalmix mit dem entfernten Gesangstrack, so dass die beiden Tracks wieder zu Ihrem Song addieren.

Schritt 3

Vorschau & Herunterladen

Hören Sie sich die getrennten Gesangs- und Instrumentalspuren Seite an Seite mit unseren eingebauten Audioplayern an und laden Sie dann jeden Track in Ihrem bevorzugten Format herunter.

Vocal Remover Anwendungsfälle

KI-Gesangsentfernung eröffnet kreative Möglichkeiten für Musiker, DJs, Content Creators und Musikbegeisterte in einer Vielzahl von Anwendungen.

Karaoke

Erstellen Sie Karaoke-Versionen von jedem Song sofort. Entfernen Sie die Lead-Gesang zu singen zusammen mit der ursprünglichen instrumentalen Unterstützung. Perfekt für Karaoke-Nacht, Gesangspraxis, Gesangsaufwärmungen, Chorproben und Karaoke-Bars. Arbeitet mit jedem Genre von Pop zu Rock zu R&B.

Remixen von & Mashups

Extrahieren Sie isolierte Vocals oder Instrumentals für Remixe, Mashups und Bootleg-Edits. Kombinieren Sie Vocals aus einem Song mit dem Beat aus einem anderen. Layer Acapellas über Ihre eigenen Produktionen. Wesentlich für Produzenten, die offizielle und inoffizielle Remixe erstellen.

Musikproduktion

Sample Vocals und Instrumentalparts aus bestehenden Aufnahmen für den Einsatz in neuen Produktionen. Extrahieren Sie Vocal Hooks, Ad-Libs und Harmonien. Isolieren Sie Gitarrenriffs, Basslinien oder Synth Patches für kreatives Sampling. Beschleunigen Sie Ihren Produktionsablauf dramatisch.

DJ-Sets & Live-Performance

Erstellen Sie saubere Instrumentals und Acapellas für Live-DJ-Sets. Erstellen Sie Transition Tracks, erstellen Sie Mashup-ready Stems, und bereiten Vocal Drops für Live-Performance. Wesentlich für DJs, die einzigartige Mischungen wollen, die ihre Sets von der Konkurrenz abheben.

Musikunterricht

Isolieren Sie Vokalparts für Gesangsunterricht, Hörtraining und Musiktheorie-Studium. Üben Sie Harmonisieren mit isolierten Backing Tracks. Analysieren Sie Vokaltechniken durch das Hören des isolierten Vokaltracks. Erstellen Sie Übungstracks für Musikstudenten und Vokaltrainer.

Erstellung von Video & Inhalten

Extrahieren Sie Instrumentals für Hintergrundmusik in Videos, Podcasts und Social Media-Inhalten. Verwenden Sie vokale Versionen von beliebten Songs als Hintergrundtracks ohne lyrische Ablenkung. Erstellen Sie benutzerdefinierte Soundbeds für YouTube, TikTok und Instagram-Inhalte.

Cover-Songs

Erstellen Sie hochwertige Cover-Versionen mit authentischen Backing-Tracks. Perfekt für Sänger, die ihr Portfolio aufbauen, Demos aufnehmen oder Covers auf YouTube und Social Media veröffentlichen.

Transkription & Analyse

Isolieren Sie Gesang für genaue lyrische Transkription, vor allem für Songs mit komplexen Instrumentierung, die es schwer macht, die Worte zu hören. Analysieren Sie Stimmmelodien, Harmonien und Ad-libs in Isolation. Nützlich für Musikwissenschaftler und Musikjournalisten, die Vocal Performance studieren.

Die besten kostenlosen Vocal Remover Online

Powered von Mel-Band RoFormer

Die Stimmentfernung läuft mit einem Mel-Band RoFormer Modell, einem Transformator, der über die Zeit und über mel-skalierte Frequenzbänder des Spektrogramms hinweg besucht wird. Auf 50 MUSDB18 Testausschnitten wurden 11,3 dB SDR und 16,0 dB instrumental SDR gemessen (Signal-zu-Verzerrungsverhältnis, höher ist sauberer), bei beiden 3 dB besser als bei dem Motor, den wir vorher verwendet haben.

Ein Motor auf jeder Ebene

Freie und Kontotrennungen laufen dasselbe Modell, so dass ein freies Ergebnis keine Vorschau in geringerer Qualität ist. Der Modus, den Sie wählen, ändert, wie der Auftrag berechnet wird, nicht welches Modell läuft.

Keine Wasserzeichen, keine Einschränkungen

Im Gegensatz zu vielen konkurrierenden Vokalentfernungs-Tools, die Wasserzeichen hinzufügen, die Ausgabequalität auf freien Ebenen begrenzen oder Download-Formate einschränken, bietet TTS.ai Ihnen saubere, uneingeschränkte Ausgabedateien. Download in MP3, WAV oder FLAC in voller Qualität. Ihre getrennten Tracks sind sofort in jedem DAW oder Media Player ohne Nachbearbeitung erforderlich.

REST API für Entwickler

Integrieren Sie die Stimmentfernung in Ihre eigenen Anwendungen mit unserer entwicklerfreundlichen REST API. Verarbeiten Sie Lieder programmatisch, bauen Sie Vokalentfernungsfunktionen in Musik-Apps, erstellen Sie automatisierte DJ-Vorbereitungs-Workflows oder bauen Sie Tools für Musik-Bildungsplattformen. API-Zugriff auf jeden Plan enthalten. SDKs für Python, JavaScript und cURL Beispiele in der Dokumentation.

Stimmentfernungspläne

Starten Sie kostenlos, aktualisieren Sie, wenn Sie mehr benötigen

Frei
  • Mel-Band RoFormer Gesangsmodell
  • 10 Minuten Lieder
  • Gesang + Instrumental
  • MP3 & WAV-Ausgabe
  • Kein Konto erforderlich
Am beliebtesten
Kostenloses Konto
  • Gleiches Modell wie die freie Ebene
  • 4-Stem-Splits im Stem-Splitter
  • Schnelle / ausgeglichene / beste Modi
  • Alle Ausgabeformate
  • 15.000 freie Zeichen
Kostenlos anmelden
Pro
  • Längere Audiodateien
  • Stapeltrennung
  • API-Zugriff
  • Vorrangige Verarbeitung
Aktualisierung

Häufig gestellte Fragen

AI Vocal Removal verwendet ein Deep-Learning-Modell (Mel-Band RoFormer), das das Spektrogramm Ihres Songs über die Zeit und mel-skalierte Frequenzbänder analysiert. Es schätzt den Vocal Track, und das Instrumental ist der ursprüngliche Mix mit diesem Vocal Track entfernt, wodurch saubere Karaoke-Stil-Ausgabe.

Das Vokalmodell hat 11,3 dB SDR und 16,0 dB Instrumental SDR auf 50 MUSDB18 Testausschnitten gemessen, etwa 3 dB besser auf beiden als auf dem Motor, den wir zuvor verwendet haben. Der Instrumentalausgang ist typischerweise sauber genug für Karaoke oder Remix. Einige Durchblutungen können auf stark verarbeiteten oder komprimierten Tracks auftreten.

Ja! Sie erhalten sowohl den isolierten Gesang als auch den Instrumentaltrack. Dies ist nützlich für die Erstellung von Acapella-Versionen, Sampling-Gesang für Remixe oder Transkription von Texten aus komplexen Mixes.

Wir unterstützen MP3, WAV, FLAC, OGG, M4A und WEBM Dateien bis zu 50MB. Für beste Ergebnisse, verwenden Sie die höchste Qualität der verfügbaren Quelldatei (WAV oder FLAC bevorzugt gegenüber komprimierten MP3).

Ja, das Erstellen von Karaoke-Tracks ist eine der beliebtesten Anwendungen. Die Instrumentalausgabe ist sauber genug für Karaoke-Performances, Sing-along-Videos und Hintergrundmusik für Veranstaltungen.

Laden Sie den Song hoch und das Tool erzeugt automatisch sowohl den isolierten Gesangstrack (Acapella) als auch das Instrumental. Die Stimmextraktion funktioniert am besten auf gut gemischten Tracks mit klarem Gesang. Verwenden Sie WAV- oder FLAC-Quelldateien für die saubersten Ergebnisse.

Batch-Verarbeitung ist über unsere API verfügbar, so dass Sie mehrere Tracks für die Stimmentfernung in einem automatisierten Workflow. Die Web-Schnittstelle verarbeitet ein Lied zu einem Zeitpunkt mit sofortiger Vorschau und Download.

Unser Tool verwendet ein Mel-Band RoFormer-Modell zur Stimmtrennung. Auf 50 MUSDB18 Testausschnitten wurden 11,3 dB SDR und 16,0 dB instrumental SDR gemessen. So lässt die Transformer-basierte Trennung weniger Artefakte übrig als ältere spektrale Methoden.

Ja, aber die Ergebnisse variieren mit Live-Audio. Studioaufnahmen geben die beste Trennungsqualität. Liveaufnahmen mit Publikumsgeräuschen, Hall und überlappenden Instrumenten können mehr Durchblutung haben, obwohl das Modell immer noch brauchbare Ergebnisse liefert.

Die Vokalentfernung verwendet 2.000 Zeichen pro verarbeiteten Track. Kostenlose Konten erhalten 15.000 Zeichen auf Anmeldung. Das Tool ist auf allen bezahlten Plänen mit großzügigen Charakterzulagen für die regelmäßige Nutzung verfügbar.

Audio, das Sie auf einem kostenpflichtigen Plan trennen, kann kommerziell verwendet werden, und das Upgrade umfasst auch Audio, das Sie früher auf der freien Ebene getrennt haben; Freiraumausgabe ist nur für den persönlichen, nicht kommerziellen Gebrauch. Das Mel-Band RoFormer Vokalmodell wird unter der MIT-Lizenz veröffentlicht, so dass das Modell selbst keine Beschränkung der kommerziellen Nutzung setzt. In jedem Fall müssen Sie die Rechte an dem Originallied haben: Mit urheberrechtlich geschützter Musik ohne Erlaubnis können Urheberrechtsgesetze verletzt werden, unabhängig davon, wie das Audio verarbeitet wird.

Die Bearbeitungszeit hängt von der Länge des Tracks ab. Ein typischer 3-5-Minuten-Song dauert 15-45 Sekunden. Längere Tracks oder qualitativ hochwertigere Trennungsmodi können bis zu einer Minute dauern.
5.0/5 (1)

Was könnten wir verbessern? Ihr Feedback hilft uns, Probleme zu beheben.

Vocals von jedem Lied kostenlos entfernen

Begleiten Sie Tausende von Musikern und Schöpfern mit TTS.ai. Vocal Entfernung mit einem Mel-Band RoFormer Modell auf jeder Ebene. 15.000 freie Zeichen mit Anmeldung.