Bộ xóa giọng nói AI

Tách giọng hát ra khỏi nhạc cụ trong bất kỳ bài hát nào bằng AI tiên tiến. Tạo các bản karaoke, acapella và các bản nhạc phụ miễn phí.

Tải bài hát lên tiến trình

3000 ký tự mỗi bài hát

Kéo và thả tập tin vào đây, hoặc duyệt

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB
— hoặc ghi âm từ micro của bạn —
00:00

Thiết lập phân cách

Cả hai chế độ sử dụng cùng một mô hình Mel-Band RoFormer.
Tự do thử nghiệm với tài khoản miễn phí

Nó hoạt động thế nào?

Tải lên bài hát của bạn
AI tách các đoạn
Xem thử & Tải về
Đang tách giọng...

Phân biệt giọng hát với nhạc cụ...

Sử dụng Mel-Band RoFormerCân bằng chất lượng
Kết quả của anh sẽ xuất hiện trong generation history Khi sẵn sàng.
Tự động

Giọng hát

0:00

Nhạc cụ

0:00
Chất lượng tách 8.2 dB SDR
Tắt âm < 2%
Chiều dài bài hát 3:42
Thời gian xử lý 12.4s

Bộ xử lý phân tách

Mô hình Mel-Band RoFormer
Xuất Giọng hát + nhạc cụ
Giọng SDR 11.3 dB
SDR 16.0 dB

Measured on 50 MUSDB18 test excerpts. SDR is the signal-to-distortion ratio: higher is cleaner. Our previous engine scored 8.4 dB (vocals) and 13.1 dB (instrumental).

Tại sao TTS.ai lại cạnh tranh với

Có tầng miễn phí

Các đối thủ cạnh tranh như LALAL.AI, Moises, và PhonicMind thu phí $5-25/tháng cho việc loại bỏ giọng nói cơ bản.

Chất lượng phân tách đo đạc

Trên 50 bài kiểm tra MUSDB18, nó đạt điểm 11.3 dB SDR giọng hát và 16.0 dB SDR nhạc cụ, khoảng 3 dB cao hơn so với động cơ trước đó của chúng tôi trên cả hai.

Không dấu nước hay hạn chế chất lượng

Tải về kết quả chất lượng đầy đủ thành WAV, MP3, hoặc FLAC. Không dấu nước, không cắt, không giới hạn tốc độ bit trên bất kỳ tầng nào.

Truy cập API cho xử lý hàng loạt

Xử lý hàng trăm bài hát theo lập trình qua API REST của chúng tôi. Hoàn hảo cho các công ty sản xuất âm nhạc và các nhóm DJ.

Gợi ý cho kết quả tốt nhất

  • Dùng đầu vào WAV hoặc FLAC để tách chất lượng tối đa
  • Chọn cả hai để lấy cả acapella và nhạc cụ từ một tải lên
  • Studio masters tách rời sạch sẽ hơn so với ghi âm trực tiếp hoặc bootleg
  • Các bài hát có sự tách biệt stereo rõ ràng sẽ cho kết quả tốt nhất
  • MP3 nén nặng (128kbps hoặc thấp hơn) có thể làm giảm chất lượng tách
  • Để chia nhiều thanh (trống, bass, v. v.), dùng Phần chia giọng

Nó hoạt động thế nào?

Mạng thần kinh sâu phân tích phổ âm thanh của bài hát của bạn, xác định tần số giọng nói, và tách chúng ra khỏi phần nhạc cụ hỗ trợ trong ba bước.

Bước 1

Tải lên bài hát của bạn

Kéo và thả bất kỳ bài hát nào theo định dạng MP3, WAV, FLAC, OGG, hoặc M4A. Chúng tôi hỗ trợ các tập tin lên đến 50MB và các bài hát lên đến 10 phút. Tập tin của bạn sẽ được mã hóa khi tải lên và xử lý trên các thực thể GPU cô lập. Tập tin sẽ tự động bị xóa trong vòng 1 giờ sau khi xử lý.

Bước 2

AI tách các đoạn

Mô hình RoFormer Mel- Band chuyển đổi âm thanh của bạn thành một phổ phân chia thành các dải tần số được quy mô hóa Mel, sau đó dùng sự chú ý của biến đổi qua thời gian và tần số để ước tính đoạn giọng. Phần nhạc cụ là đoạn phối gốc với đoạn giọng đã bị loại bỏ, vì vậy hai đoạn sẽ được thêm vào bài hát của bạn.

Bước 3

Xem thử & Tải về

Lắng nghe các ca khúc giọng hát và nhạc cụ tách biệt bên cạnh với trình phát âm thanh tích hợp của chúng tôi, sau đó tải xuống mỗi ca khúc trong định dạng bạn thích.

Tên người dùng:

Việc loại bỏ giọng nói AI mở ra các khả năng sáng tạo cho các nhạc sĩ, DJ, người tạo nội dung và những người hâm mộ âm nhạc trên một loạt các ứng dụng.

Karaoke

Tạo phiên bản karaoke của bất kỳ bài hát nào ngay lập tức. Xoá giọng hát chính để hát cùng với nhạc cụ ban đầu. Tốt cho đêm karaoke, luyện hát, luyện giọng, tập hợp hợp xướng, và quán karaoke. Làm việc với bất kỳ thể loại nào từ pop đến rock đến R&B.

Trộn lại & Mashups

Kéo giọng hát hay nhạc cụ tách biệt ra để tạo ra bản phối lại, mashup, và bản biên tập bootleg. Gộp giọng hát từ một bài hát với nhịp điệu từ bài hát khác. Lớp acapella trên sản phẩm của bạn. Nhu cầu cho các nhà sản xuất tạo ra bản phối lại chính thức và không chính thức.

Sản xuất âm nhạc

Lấy mẫu giọng hát và các phần nhạc cụ từ các bản thu hiện có để sử dụng trong các sản phẩm mới. Kéo ra các đoạn hook giọng hát, ad- libs và âm hòa. Điều khiển riêng rẽ các đoạn guitar riff, bass, hoặc patch synth để lấy mẫu sáng tạo. Tăng tốc quá trình sản xuất của bạn.

Bộ DJ và biểu diễn trực tiếpName

Tạo nhạc cụ sạch và acapella cho các bộ DJ trực tiếp. Tạo các đoạn chuyển tiếp, tạo các đoạn sẵn sàng mashup, và chuẩn bị các đoạn giọng cho trình diễn trực tiếp. Nhu cầu cho các DJ muốn những hỗn hợp độc đáo để tạo ra các bộ riêng biệt so với các đối thủ.

Giáo dục âm nhạc

Điều khiển giọng hát.

Tạo nội dung và phim

Thu thập các nhạc cụ cho âm nhạc nền trong video, podcast, và nội dung truyền thông xã hội. Dùng các phiên bản không có giọng hát của các bài hát nổi tiếng như các ca khúc nền mà không bị phân tâm bởi lời bài hát. Tạo các âm thanh tùy chỉnh cho nội dung YouTube, TikTok, và Instagram.

Bản nhạc bìa

Ghi âm giọng hát của chính bạn trên các đoạn nhạc cụ gốc của bất kỳ bài hát nào. Tạo các phiên bản cover chất lượng cao với các đoạn nhạc nền thật. Tốt cho các ca sĩ xây dựng tập hợp của họ, ghi âm bản demo, hoặc đăng các cover lên YouTube và mạng xã hội.

Phiên âm và phân tích

Điều khiển giọng hát riêng lẻ để có thể phiên âm chính xác lời bài hát, đặc biệt là cho những bài hát có nhạc cụ phức tạp khiến khó nghe được lời bài hát. Phân tích giai điệu giọng hát, âm hòa và ad- libs riêng lẻ. Có ích cho các nhà âm nhạc học và nhà báo âm nhạc nghiên cứu về giọng hát.

Phần mềm xóa giọng miễn phí tốt nhất trên mạngName

Được cung cấp bởi Mel-Band RoFormer

Vocal removal runs a Mel-Band RoFormer model, a transformer that attends across time and across mel-scaled frequency bands of the spectrogram. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR (signal-to-distortion ratio, higher is cleaner), about 3 dB better on both than the engine we used before. Expect some bleed on dense or heavily compressed mixes.

Một động cơ trên mỗi tầng

Sự tách biệt giữa miễn phí và tài khoản chạy cùng mô hình, vì vậy kết quả miễn phí không phải là xem trước chất lượng thấp. Chế độ bạn chọn thay đổi cách tính tiền cho công việc, không phải mô hình chạy nào.

Không dấu nước, không giới hạn

Không giống như nhiều công cụ xóa giọng nói cạnh tranh, chúng thêm dấu nước, hạn chế chất lượng xuất ra ở mức miễn phí, hoặc hạn chế định dạng tải xuống, TTS.ai cho bạn những tập tin xuất sạch, không giới hạn. Tải xuống MP3, WAV, hoặc FLAC với chất lượng đầy đủ. Các đoạn đã tách ra của bạn sẵn sàng để sử dụng ngay lập tức trong bất kỳ DAW hay trình phát phương tiện mà không cần xử lý sau.

API REST cho các nhà phát triểnName

Tạo các ứng dụng riêng của bạn với API REST thân thiện với người phát triển. Xử lý các bài hát theo chương trình, xây dựng các tính năng xóa giọng nói vào các ứng dụng âm nhạc, tạo các luồng công việc chuẩn bị DJ tự động, hoặc xây dựng các công cụ cho các nền tảng giáo dục âm nhạc. Truy cập API bao gồm trong mỗi kế hoạch. SDK cho Python, JavaScript, và ví dụ cURL trong tài liệu.

Kế hoạch xóa giọng nói

Bắt đầu miễn phí, nâng cấp khi cần nhiều hơn

Tự do
  • Mel- Band RoFormer vocal model
  • Bài hát 10 phút
  • Giọng hát + Nhạc cụ
  • Xuất MP3 & WAV
  • Không cần tài khoản
Nổi tiếng nhất
Tài khoản miễn phí
  • Cùng một mẫu như cấp độ miễn phí
  • 4- stem chia tách trong Stem Splitter
  • Nhanh / Cân bằng / Chế độ tốt nhất
  • Mọi định dạng xuất
  • 15.000 ký tự miễn phí
Đăng ký miễn phí
Tốt
  • Tập tin âm thanh dài
  • Phân tách hàng loạt
  • Truy cập API
  • Xử lý ưu tiên
Cập nhật

Câu hỏi thường gặp

Việc xóa giọng AI sử dụng mô hình học sâu (Mel- Band RoFormer) phân tích phổ của bài hát của bạn qua thời gian và các băng tần được quy đổi theo Mel. Nó ước tính đoạn giọng, và đoạn nhạc cụ là bản phối gốc với đoạn giọng đã xóa, tạo ra kết quả xuất rõ ràng theo kiểu karaoke.

The vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts, about 3 dB better on both than the engine we used before. The instrumental output is typically clean enough for karaoke or remixing. Some bleed-through may occur on heavily processed or compressed tracks.

Có! Bạn sẽ nhận được cả giọng hát cô lập và đoạn nhạc cụ. Điều này hữu ích cho việc tạo ra các phiên bản acapella, lấy mẫu giọng hát cho các bản phối lại, hoặc sao chép lời bài hát từ các bản phối phức tạp.

Chúng tôi hỗ trợ các tập tin MP3, WAV, FLAC, OGG, M4A, và WEBM lên đến 50MB. Để có kết quả tốt nhất, hãy dùng tập tin nguồn có chất lượng cao nhất (WAV hoặc FLAC được ưa thích hơn MP3 nén).

Có, tạo các bài hát karaoke là một trong những mục được sử dụng phổ biến nhất. Lưu lượng âm thanh của nhạc cụ đủ sạch để chơi karaoke, video hát cùng, và nhạc nền cho các sự kiện.

Tải lên bài hát và công cụ sẽ tự động tạo ra cả hai đoạn giọng hát cô lập (acapella) và đoạn nhạc cụ. Việc trích giọng hát hoạt động tốt nhất trên các đoạn được pha trộn tốt với giọng hát rõ ràng. Dùng tập tin nguồn WAV hoặc FLAC để có kết quả sạch nhất.

Quá trình xử lý hàng loạt có sẵn thông qua API của chúng tôi, cho phép bạn gửi nhiều bài hát để xóa giọng nói trong một luồng công việc tự động. Giao diện mạng xử lý một bài hát mỗi lần với xem trước và tải xuống ngay lập tức.

Our tool uses a Mel-Band RoFormer model for vocal separation. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR. Transformer-based separation like this leaves fewer artifacts than older spectral-based methods.

Có, nhưng kết quả thay đổi với âm thanh trực tiếp. Ghi âm phòng thu cho chất lượng tách biệt tốt nhất. Ghi âm trực tiếp với tiếng ồn khán giả, tiếng vang, và nhạc cụ chồng chéo có thể có nhiều sự chảy máu hơn, mặc dù mô hình vẫn tạo ra kết quả có thể sử dụng.

Việc xóa giọng hát dùng 2000 ký tự cho mỗi đoạn được xử lý. Tài khoản miễn phí nhận được 15000 ký tự khi đăng ký. Công cụ này có sẵn trên tất cả các gói trả phí với số ký tự hào phóng cho việc sử dụng thường xuyên.

Âm thanh bạn tách ra trên bất kỳ kế hoạch trả tiền nào có thể được sử dụng thương mại, và nâng cấp cũng bao gồm âm thanh bạn tách ra trước đó trên tầng miễn phí; xuất ra tầng miễn phí chỉ dành cho cá nhân, không dùng thương mại. Mô hình giọng hát Mel- Band RoFormer được phát hành theo giấy phép MIT, vì vậy bản thân mô hình không đặt bất kỳ hạn chế nào cho việc sử dụng thương mại. Trong mọi trường hợp, bạn phải có quyền của bài hát gốc: sử dụng nhạc có bản quyền mà không được phép có thể vi phạm luật bản quyền bất kể cách âm thanh được xử lý.

Thời gian xử lý phụ thuộc vào độ dài của các đoạn nhạc. Một bài hát 3- 5 phút tiêu chuẩn cần 15- 45 giây để xử lý. Các đoạn nhạc dài hơn hoặc các chế độ tách chất lượng cao có thể cần đến một phút. Kết quả sẽ được chơi lại ngay lập tức trong trình duyệt của bạn.
5.0/5 (1)

Chúng tôi có thể cải thiện gì? phản hồi của bạn giúp chúng tôi khắc phục vấn đề.

Xoá giọng hát khỏi bất kỳ bài hát nào miễn phí

Đăng ký với hàng ngàn nhạc sĩ và nhà sáng tạo sử dụng TTS.ai. Tắt giọng với một mẫu Mel-Band RoFormer trên mỗi cấp. 15.000 nhân vật miễn phí với đăng ký.