Pisahkan vokal, pembicara, dan musik
Gratis, online, dalam hitungan detik
Ada musik yang terputar saat perekaman? Derau yang tak diinginkan di latar? Letakkan file audio atau video apa pun di bawah ini, dan Perso Dubbing memisahkannya menjadi vokal, pembicara individual, dan musik latar, sehingga Anda bisa mendengar setiap trek sebelum mendaftar.
Tanpa pendaftaran · 60 detik pertama gratis · File tidak pernah disimpan
Klik atau seret & letakkan file Anda
Pemisahan langsung dimulai — tanpa akun (hingga 200MB)
Tidak ada file? Coba contoh:
Memisahkan trek audio...
Menganalisis frekuensi suara untuk memisahkan suara dari elemen latar belakang
Di workspace, Anda bisa mengedit skrip pembicara baris demi baris
Batas gratis hari ini sudah tercapai
Anda telah memakai 3 pemisahan gratis hari ini. Daftar gratis untuk melanjutkan.
Paket Starter menghapus batas harian.
Performa kelas dunia — diukur, bukan sekadar klaim
Tiga benchmark publik standar industri: MUSDB18 untuk pemisahan vokal, VoiceBank-DEMAND untuk penghilangan noise, dan Open ASR Leaderboard untuk transkripsi. Dataset yang sama dengan yang dipakai setiap paper riset, melawan engine ternama, dengan data per sampel yang dipublikasikan agar siapa pun bisa mengulang pengujiannya.
Pemisahan vokal tinggi = lebih baik
Menang di 44 dari 50 trek — dan saat kalah, selisihnya paling besar 0.66 dB.
Kualitas penghilangan noise tinggi = lebih baik
Spesialis DeepFilterNet3 unggul tipis (2.77 vs 2.64) — keduanya jauh di depan ElevenLabs.
Kejernihan ucapan tinggi = lebih baik
Dua teratas praktis imbang. ElevenLabs membuat ucapan lebih sulit dipahami di separuh sampel — kami memperbaikinya di 96%.
Fidelitas kloning suara tinggi = lebih baik
Pertama di kedua sistem kloning yang diuji — bahkan di dalam kloner milik ElevenLabs sendiri. Bilah bergaris adalah audio asli yang bersih: batas atas alami.
Akurasi transkripsi (WER) rendah = lebih baik
Secara keseluruhan imbang secara statistik dengan Scribe v2 — tapi di konten multi-pembicara seperti podcast, kami unggul (bilah lebih pendek = lebih sedikit kesalahan).
Bilah diperbesar ke rentang kompetitif agar selisih kecil tetap terlihat — yang menentukan adalah angka pasti di samping tiap bilah.
Apa yang sebenarnya diukur tes ini?
🎯 Pemisahan vokal (SI-SDR) Makin tinggi = makin baik
Seberapa bersih suara dan musik dipisahkan — seperti mengekstrak trek karaoke tanpa sisa suara sama sekali. Skor kami: 10.67 dB vs 8.36 dB milik HTDemucs — kebocoran antar-trek lebih sedikit, dan kami menang di 44 dari 50 lagu.
🔊 Penghilangan noise (PESQ · ESTOI) Makin tinggi = makin baik
Seberapa jernih dan alami suara ucapan setelah noise dihilangkan — metrik yang sama dengan penilaian kualitas panggilan telepon. Skor kami 2.64, tipis di belakang spesialis DeepFilterNet3 (2.77) dan jauh di depan ElevenLabs (2.38). Untuk kejernihan, kami berbagi posisi pertama.
📝 Akurasi transkripsi (WER) Makin rendah = makin baik
Dari 100 kata yang diucapkan, berapa banyak yang salah ditulis. 7.61% kami berarti sekitar 92 dari 100 kata benar — secara statistik setara dengan ElevenLabs Scribe v2 (7.52%), dan unggul di rekaman multi-pembicara seperti podcast.
🎤 Fidelitas kloning suara (cos_sim) Makin tinggi = makin baik
Setelah dibersihkan, apakah klon suara dari audio itu masih terdengar seperti orang yang sama? Dinilai 0 sampai 1 terhadap suara asli. Skor 0.674 kami menempati posisi pertama di kedua sistem kloning yang diuji — bahkan di dalam kloner milik ElevenLabs sendiri.
Catatan jujur: pemisahan vokal diukur pada set sampel MUSDB18 (pengujian ulang penuh MUSDB18-HQ sedang berjalan, diperkirakan dalam ±0.5 dB). DeepFilterNet3 unggul 0.15 di PESQ — kami imbang di kejernihan dan unggul di fidelitas gelombang (+18.66 vs +17.31 dB SI-SDR). MDX-Net dan LALAL.AI belum diuji, jadi kami tidak mengklaim mengalahkan semua pemisah. Diverifikasi Mei 2026.
Tiga langkah, kurang dari satu menit
Unggah file Anda
Seret dan lepas file audio atau video — MP3, WAV, M4A, MP4, MOV, atau WebM, hingga 200MB. Tanpa akun untuk 60 detik pertama.
Dengarkan trek yang dipisahkan
AI membagi file Anda menjadi tiap pembicara, musik latar murni, dan latar dengan reaksi. Putar setiap trek langsung di browser.
Ekspor mix Anda
Pilih trek yang Anda butuhkan dan ekspor sebagai satu file. Masuk untuk mengunduh, atau memproses file panjang secara utuh.
Lebih dari sekadar vocal remover
😂 Dua mode audio latar
BGM murni, atau BGM dengan tawa dan tepuk tangan tetap utuh. Tidak ada alat pemisah lain yang menawarkan keduanya dari satu unggahan.
👤 Pemisahan multi-pembicara
Bukan sekadar vokal vs musik — pemisahan pembicara memberi setiap orang dalam rekaman treknya sendiri, plus transkrip berlabel pembicara dalam 99+ bahasa.
🔒 Tidak ada yang disimpan
File percobaan diproses di penyimpanan sementara dan dihapus saat sesi berakhir. Tidak pernah disimpan, tidak pernah dipakai untuk pelatihan.
📝 Transkripsi 99+ bahasa
Setiap pemisahan menyertakan speech-to-text otomatis dengan label pembicara, tampil tepat di samping trek Anda. Deteksi bahasa berjalan otomatis — tanpa alat atau langkah tambahan.
🎬 Mendukung audio & video
Unggah MP3, WAV, M4A, MP4, MOV, atau WebM. Ekspor trek dengan subtitle tertanam atau file SRT terpisah.
🎚 Ekspor mix selektif
Gabungkan trek apa pun menjadi satu file — misalnya Musik Latar plus Pembicara 1. Tidak ada alat pemisah lain yang mengekspor mix kustom dalam satu langkah.
Dua cara menghapus musik latar atau derau dari video Anda
Tawa di podcast, reaksi penonton, batuk saat presentasi — kebanyakan vocal remover tak bisa membedakannya dari ucapan. Perso Dubbing memberi Anda kedua opsi dari satu unggahan.
Musik Latar
Menghapus semua suara manusia — ucapan, tawa, tepukan — menyisakan hanya suara latar. Ideal untuk BGM bebas hak cipta dan audio bed bersih untuk sulih suara ulang.
Latar dengan Reaksi
Hanya menghapus ucapan, mempertahankan tawa, tepuk tangan, dan energi penonton. Sempurna untuk podcast, acara langsung, dan variety show yang mengutamakan atmosfer.
Satu trek per suara — pemisahan pembicara untuk wawancara, podcast, dan rapat
Kebanyakan vocal remover berhenti pada dua stem: vokal dan musik. Pemisahan multi-pembicara Perso Dubbing melangkah lebih jauh — AI mendeteksi berapa banyak orang yang berbicara dan memecah rekaman menjadi trek pembicara individual, masing-masing dengan transkrip berlabel dalam 99+ bahasa.
Satu rekaman tercampur
Rekaman wawancara, podcast, atau rapat dengan beberapa orang berbicara di atas musik dan derau ruangan — diunggah sebagai satu file audio atau video.
Trek terpisah untuk setiap pembicara
Pisahkan pembicara dari audio dengan satu klik: ekspor trek satu pembicara, atau kombinasi apa pun yang Anda pilih — tanpa edit manual.
Siapa yang memakai pemisahan audio?
🛡 Penyelesaian hak cipta
Hapus BGM berhak cipta sambil menjaga dialog tetap utuh, ganti dengan musik bebas royalti, dan unggah ulang tanpa klaim.
🎙 Penyuntingan podcast
Potong kata pengisi dan ucapan yang tak diinginkan sambil membiarkan tawa penonton dan reaksi ambient tetap utuh.
🌍 Sulih suara video
Ekstrak trek BGM bersih tanpa bocoran ucapan, lalu tumpangkan voice-over baru dalam salah satu dari 99+ bahasa.
💼 Rapat & konferensi
Pisahkan pembicara dari audio rekaman Zoom atau Meet — setiap peserta mendapat treknya sendiri, lengkap dengan transkrip berlabel pembicara.
📱 Klip media sosial
Ganti BGM asli di video pendek dengan lagu yang sedang tren — tanpa menyentuh voice-over Anda.
🎤 Konser & fancam
Hilangkan riuh penonton dan gema venue dari klip live untuk mengisolasi suara artis atau musiknya.
📰 Jurnalisme & wawancara
Gunakan pemisahan multi-pembicara untuk mengambil suara tiap narasumber dari rekaman lapangan yang bising, dengan transkrip bersih untuk cek fakta.
♻️ Daur ulang konten
Satu unggahan menjadi audio podcast, BGM promosi, klip pembicara untuk media sosial, dan transkrip lengkap untuk blog Anda.
Lakukan lebih banyak di workspace Perso
Pertanyaan yang sering diajukan
Apakah Perso Dubbing Audio Separation gratis?
Apakah saya perlu akun untuk mencoba pemisahan audio?
Bagaimana jika file saya lebih dari 60 detik?
Apakah file saya disimpan di server Perso Dubbing?
Format dan ukuran file apa yang didukung?
Apa beda mode Musik Latar dan Latar dengan Reaksi?
Bisakah Perso Dubbing melakukan pemisahan multi-pembicara, bukan hanya vokal dan musik?
Seberapa akurat pemisahan audio Perso Dubbing dibanding alat lain?
Bisakah saya menghapus musik berhak cipta dari video saya?
Bagaimana cara menghapus musik latar dari video yang saya rekam sendiri?
Apa beda Perso Dubbing dengan LALAL.AI atau Moises?
Bisakah saya menggabungkan trek terpilih menjadi satu file?
Coba dengan file Anda sendiri — sekarang juga
60 detik pertama gratis. Tanpa daftar, tanpa file tersimpan, tanpa syarat tersembunyi.
↑ Unggah file
EN
KO
ES
PT
RU
ID
DE
TH
JP
TC