AI Vocal 移除器

使用最先进的 AI 制作卡拉OK 音轨、 acapellas 以及免费支持音轨。

上传歌曲到进程

每首歌3 000个字符

拖放您的文件到这里( D), 或者 浏览

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

文件. mp3

0 MB
- 或记录 从你的麦克风 -
00:00

离职设置

两种模式都使用相同的梅尔-班德罗弗默模式。
自由尝试使用自由账户

如何运作

上传您的歌
AI 分隔音轨
预览下载( D)
分开的声音...

将声响与工具分离...

使用 Mel-Band RoFormer 至 年 结余 质量
需要一段时间吗 你的结果会出现在你身上 新一代历史 准备就绪 。
口头离职完成

伏数

0:00

乐器

0:00
离职质量 8.2 dB SDR
vocal 热血 < 2%
时长( 时长) 时长( 时长) 时长( 时长) 3:42
处理时间 12.4s

隔离引擎

Mel-Band RoFormer
产出 Vocals+Servic +Servic +Vocals+Servic +Servic +Vocals+Servic +Vocals+Servic
特别提款权 11.3 dB
工具特别提款权 16.0 dB

Measured on 50 MUSDB18 test excerpts. SDR is the signal-to-distortion ratio: higher is cleaner. Our previous engine scored 8.4 dB (vocals) and 13.1 dB (instrumental).

为什么TTS.ai对竞争者

可用无闲分层

试一下免费账户。LALAL.AI、Moises和PronicMind等竞争者每月5-25美元的基本声波清除费用。

衡量的分离质量

沃卡尔斯被一个梅尔-班德罗福尔默模型分隔开来。 在50 MUSDB18测试节选中,它得分为11.3 dB 音调特别提款权 和 16.0 dB 工具特别提款权, 两者上方的引擎都比我们前方的引擎高出约3 dB。

没有水印或质量封盖

WAV、 MP3 或 FLAC 的完整质量下载输出。 没有水印, 没有修补, 没有位数限制 。

批量处理的API访问

通过我们的REST API, 以程序方式处理数百首歌曲。

最佳成果提示

  • 使用 WAV 或 FLAC 输入来达到最大质量分离
  • 选择从一个上传中获取 Acapella 和工具
  • 工作室主的分离比活或私用录音更干净
  • 有明确立立体分立声的歌曲产生最佳效果
  • 高压缩MP3(128kbps或更低)的MP3(128kbps或更低)可能降低了离职质量
  • 用于多音轨分离(drums、bass等),使用 音轨分离器

如何运作

深神经网络分析你的歌曲的音频频谱 识别声音频率 并将它们与工具支持分三步

步骤1

上传您的歌

拖放任何以 MP3 、 WAV、 FLAC、 OGG 或 M4A 格式制作的歌曲。 我们支持最多为 50MB 的文件, 最多为 10 分钟的歌曲。 您的文件在上传时加密, 并在孤立的 GPU 实例中处理。 文件在处理后一小时内自动删除 。

步骤2

AI 分隔音轨

梅尔- 班德 RoFormer 模型将您的音频转换成光谱, 分成了以梅标标标定的频带, 然后使用变压器的注意力来估计音轨的时间和频率。 工具是该音轨的原始组合, 并删除了音轨, 因此两轨可以重新加入您的歌曲 。

步骤3

预览下载( D)

听声带和工具道与我们内置音频播放器并肩并进, 然后下载每条音轨, 以你喜欢的格式。

Vocal 移除器使用案例

AI 语音删除为音乐家、DJs、内容创作者和音乐爱好者在多种应用中开辟了创造机会。

卡拉OK

立即创建任何歌曲的卡拉OK版本。 移除主声带, 与原始工具支持一起唱歌 。 适合卡拉OK 晚上、 唱歌练习、 声音加热、 唱诗班排练和卡拉OK 酒吧 。 从流行到摇滚到研究与研究组, 使用任何语言 。

混和和配制

提取孤立的声音或工具, 用于创建混音和私生子编辑 。 将一首歌的声音和另一首歌的节拍组合起来 。 将图层的角形与你自己的作品拼凑在一起 。 对于制作官方和非官方混音的生产商来说至关重要 。

音乐制作

从现有录音中提取声音和工具部件,用于新制作的作品。 提取语音钩、 ad-libs 和音响。 孤立的吉他 Riffs、 Bass 线或合成补丁, 用于创造性采样。 大大加快您的生产工作流程 。

DJ 设置和现场性能

为 DJ 现场设置创建干净的工具和卡普利亚 。 建立过渡轨道, 创建混凝土已准备就绪的音轨, 并为现场表演准备声带滴子。 对于想要与竞争分开的独特混合的 DJ 来说至关重要 。

音乐教育

用于歌唱课、 耳机训练、 音乐理论研究的单独声音部分 。 练习与孤立的后背轨道相协调 。 通过监听孤立的声轨来分析声学技术 。 为音乐学生和声导师建立练习轨道 。

视频和内容创建

在视频、播客和社交媒体内容中提取背景音乐工具。 使用流行歌曲的无声版作为背景曲目,不流言分散注意力。 为YouTube、 TikTok 和 Instagram 内容创建定制音床。

封面歌曲

将您自己的声音记录在任何歌曲的原始工具曲目上 。 创建高质量的封面版本, 并配有真实的支持曲目 。 最适合歌手建立自己的组合, 记录演示, 或者在YouTube和社交媒体上张贴封面 。

翻译和分析

用于准确歌词转录的孤立声音,特别是具有复杂乐器的歌曲,这使得很难听到这些词。 单独分析声乐、和谐音和专栏。 音乐学家和音乐记者研究声乐表演很有用。

最佳自由 Vocal 在线移除器

由梅尔班德罗佛瑞默 供电

沃卡尔清除运行了Mel-Band Roformer模型,该模型是一个变压器,可穿越时空和光谱中波段。在50 MUSDB18测试节录中,它测量到了11.3 dB声SDR和16.0 dB 工具SDR(信号对扭曲比率,更高者为清洁者),两者的比我们以前使用的发动机都高出3 dB。期望在密度或重压缩的混合中出现一些流血。

每个层的一引擎

自由和账户分离运行相同的模式, 所以自由结果不是一个低质量预览。 您选择的方式会改变任务如何被计费, 而不是哪个模式运行 。

无水印,无限制

与许多添加水印、限制自由层输出质量或限制下载格式的相互竞争的声带删除工具不同,TTS.ai为您提供了干净、不受限制的输出文件。以MP3、WAV或FLAC 完全质量下载。您的分隔音轨可以立即用于任何DAW或媒体播放器,无需任何后处理。

开发者REST API 开发者用 REST API 开发者用 API

将声音删除纳入您自己的应用程序中, 与我们开发者友好的 REST API 。 程序化地处理歌曲, 将声音删除功能建在音乐应用程序中, 创建自动 DJ 准备工作流程, 或为音乐教育平台建立工具 。 每个计划中都包含 API 访问 。 在文档中包含 Python、 JavaScript 的 SDK 和 cURL 示例 。

口头清除计划

开始免费, 需要时升级

自由
  • 梅尔班罗弗默音音模型
  • 10分钟歌曲
  • Vocals + 乐器
  • MP3 & WAV 输出
  • 不需要账户
最受欢迎的
自由帐户
  • 与免费级相同的模式
  • 音轨分离器中的 4 音轨分离
  • / 平衡/最佳模式
  • 所有输出格式
  • 15 000 个自由字符
签署自由
职业
  • 更长的音频文件
  • 批次分离
  • API 访问
  • 优先处理事项处理
升级

常问问题

AI 声带删除使用深层学习模型(Mel-Band Roformer)分析您歌的光谱和时间和Mel-Sandle频带。它估计音轨,工具是原声音带去除的混合,产生干净的卡拉OK式输出。

声学模型测量了50 MUSDB18测试节录中的11.3 dB声调特别提款权(SDR)和16.0 dB 工具特别提款权(SDR),两者的比我们以前使用的引擎都好3 dB。 工具输出通常足够干净,足以用于卡拉OK或重新混合。 某些血流可能发生在经过大量加工或压缩的轨道上。

是的! 您可以得到孤立的音响和工具的音轨。 这对于创建 Acapella 版本、 复制声音取样或从复杂混合中改写歌词非常有用 。

我们支持MP3、WAV、FLAC、OGG、M4A和WEBM文件,最多可达50MB。 最佳效果是,使用现有最高质量的源文件(WAV或FLAC偏爱压缩MP3而不是压缩MP3)。

是的,创建卡拉OK音轨是最受欢迎的用途之一。 工具输出为卡拉OK表演、长唱视频和背景音乐提供了足够干净的功能。

上传歌曲和工具自动生成孤立的音轨( acapella) 和工具。 声音提取在有清晰声音的混合音轨上最有效。 使用 WAV 或 FLAC 源文件来获取最清洁的结果 。

批处理可以通过我们的 API 进行, 允许您在自动工作流程中提交多个音轨, 以进行声带删除。 网络接口会一次处理一首歌, 并同时进行即时预览和下载 。

我们的工具使用梅尔-班德·罗福尔默(Mel-Band Roformer)模型进行声控分离。在50 MUSDB18测试节录中,它测量了11.3 dB声调SDR和16.0 dB 工具SDR。 以变形器为基础的分离比旧光谱法留下的文物更少。

是的,但结果随现场录音而异。 工作室录音提供最佳的分离质量。 现场录音有观众噪音、回动和重叠仪器,尽管模型仍然产生有用的结果,但流出率可能更高。

Vocal 移除使用每个已处理的音轨2,000个字符。 免费账户在注册时接收了 15,000个字符。 所有付费计划中都可以使用该工具,并有慷慨的性格津贴,供正常使用。

任何付费计划中的音频可以被商业使用,升级也包括您早些时候在免费级上分离的音频;自由级输出仅供个人使用,非商业性使用。Mel-Band RoFormer的声频模型根据麻省理工学院许可证发布,因此模型本身不限制商业使用。 在每一种情况下,你必须拥有对原歌的权利:未经许可使用版权音乐可能违反版权法,无论音频是如何处理的。

处理时间取决于音轨长度。 典型的 3-5 分钟歌曲需要15- 45 秒处理。 较长的音轨或更高质量的分离模式可能需要一分钟时间。 结果会立即在浏览器中播放 。
5.0/5 (1)

我们能改进什么?您的反馈帮助我们解决问题。

从任何歌曲中删除 Vocals 免费

与数千名音乐家和创作者一起使用 TTS.ai。 vocal 移除, 在每个级别上都使用 梅尔- 班德· 罗弗尔默模型。 15000 个免费字符, 并加号 。