แยกเสียงร้อง ผู้พูด และดนตรี
ฟรี ออนไลน์ ในไม่กี่วินาที
มีเพลงดังตอนถ่ายทำไหม? มีเสียงรบกวนที่ไม่ต้องการอยู่ด้านหลังหรือเปล่า? วางไฟล์เสียงหรือวิดีโอใดก็ได้ด้านล่าง แล้ว Perso Dubbing จะแยกออกเป็นเสียงร้อง ผู้พูดแต่ละคน และดนตรีพื้นหลัง ให้คุณฟังได้ทุกแทร็กก่อนสมัครใช้งาน
ไม่ต้องสมัคร · 60 วินาทีแรกฟรี · ไม่มีการจัดเก็บไฟล์
คลิกหรือลากแล้ววางไฟล์ของคุณ
เริ่มแยกเสียงทันที — ไม่ต้องมีบัญชี (สูงสุด 200MB)
ไม่มีไฟล์? ลองใช้ตัวอย่าง:
กำลังแยกแทร็กเสียง...
กำลังวิเคราะห์ความถี่เสียงเพื่อแยกเสียงพูดออกจากเสียงแวดล้อม
ในเวิร์กสเปซ คุณแก้ไขสคริปต์ผู้พูดได้ทีละบรรทัด
คุณใช้สิทธิ์ฟรีของวันนี้ครบแล้ว
คุณใช้สิทธิ์แยกฟรี 3 ครั้งของวันนี้ครบแล้ว สมัครฟรีเพื่อใช้งานต่อ
แพ็กเกจ Starter ไม่มีขีดจำกัดรายวัน
ประสิทธิภาพระดับโลก — วัดผลจริง ไม่ใช่แค่คำกล่าวอ้าง
เบนช์มาร์กสาธารณะมาตรฐานอุตสาหกรรมสามรายการ: MUSDB18 สำหรับการแยกเสียงร้อง VoiceBank-DEMAND สำหรับการลดเสียงรบกวน และ Open ASR Leaderboard สำหรับการถอดเสียง ชุดข้อมูลเดียวกับที่งานวิจัยทุกฉบับใช้ เทียบกับเอนจินที่ระบุชื่อชัดเจน พร้อมเผยแพร่ข้อมูลรายตัวอย่างให้ใครก็ทดสอบซ้ำได้
การแยกเสียงร้อง สูง = ดีกว่า
ชนะ 44 จาก 50 แทร็ก — และเมื่อแพ้ ส่วนต่างไม่เกิน 0.66 dB
คุณภาพการลดเสียงรบกวน สูง = ดีกว่า
ผู้เชี่ยวชาญเฉพาะทาง DeepFilterNet3 นำเพียงเส้นยาแดง (2.77 ต่อ 2.64) — ทั้งคู่ทิ้งห่าง ElevenLabs
ความชัดเจนของเสียงพูด สูง = ดีกว่า
สองอันดับแรกแทบจะเสมอกัน ElevenLabs ทำให้เสียงพูดฟังยากขึ้นในครึ่งหนึ่งของตัวอย่าง — เราทำให้ดีขึ้นถึง 96%
ความเที่ยงตรงของการโคลนเสียง สูง = ดีกว่า
ที่หนึ่งในทั้งสองระบบโคลนที่ทดสอบ — แม้แต่ในระบบโคลนของ ElevenLabs เอง แถบลายคือต้นฉบับสะอาด: เพดานตามธรรมชาติ
ความแม่นยำการถอดเสียง (WER) ต่ำ = ดีกว่า
โดยรวมเสมอทางสถิติกับ Scribe v2 — แต่ในคอนเทนต์หลายผู้พูดอย่างพอดแคสต์ เรานำหน้า (แถบสั้นกว่า = ผิดพลาดน้อยกว่า)
แถบถูกซูมเข้าไปยังช่วงการแข่งขันเพื่อให้เห็นส่วนต่างเล็ก ๆ ได้ชัด — สิ่งที่นับจริงคือตัวเลขข้างแต่ละแถบ
การทดสอบเหล่านี้วัดอะไรกันแน่
🎯 การแยกเสียงร้อง (SI-SDR) ยิ่งสูง = ยิ่งดี
เสียงร้องกับดนตรีถูกแยกออกจากกันได้สะอาดแค่ไหน — เหมือนสกัดแทร็กคาราโอเกะที่ไม่มีเสียงร้องหลงเหลืออยู่เลย คะแนนของเรา: 10.67 dB เทียบกับ HTDemucs ที่ 8.36 dB — เสียงรั่วระหว่างแทร็กน้อยกว่า และเราชนะ 44 จาก 50 เพลง
🔊 การลดเสียงรบกวน (PESQ · ESTOI) ยิ่งสูง = ยิ่งดี
เสียงพูดชัดและเป็นธรรมชาติแค่ไหนหลังตัดเสียงรบกวน — เกณฑ์เดียวกับที่ใช้วัดคุณภาพสายโทรศัพท์ เราได้ 2.64 ตามหลังผู้เชี่ยวชาญเฉพาะทาง DeepFilterNet3 (2.77) เพียงนิดเดียว และนำ ElevenLabs (2.38) อยู่มาก ด้านความชัดเจน เราเสมอที่อันดับหนึ่ง
📝 ความแม่นยำการถอดเสียง (WER) ยิ่งต่ำ = ยิ่งดี
ในคำพูด 100 คำ มีกี่คำที่ถอดผิด 7.61% ของเราหมายถึงถูกต้องราว 92 จาก 100 คำ — เท่ากับ ElevenLabs Scribe v2 (7.52%) ในทางสถิติ และนำหน้าในการบันทึกแบบหลายผู้พูดอย่างพอดแคสต์
🎤 ความเที่ยงตรงของการโคลนเสียง (cos_sim) ยิ่งสูง = ยิ่งดี
หลังทำความสะอาดเสียงแล้ว โคลนเสียงที่สร้างจากออดิโอนั้นยังฟังเหมือนคนเดิมไหม ให้คะแนน 0 ถึง 1 เทียบกับเสียงต้นฉบับ คะแนน 0.674 ของเราครองอันดับหนึ่งในทั้งสองระบบโคลนที่ทดสอบ — แม้แต่ในระบบโคลนของ ElevenLabs เอง
หมายเหตุอย่างตรงไปตรงมา: การแยกเสียงร้องวัดจากชุดตัวอย่าง MUSDB18 (กำลังทดสอบซ้ำเต็มรูปแบบด้วย MUSDB18-HQ คาดว่าอยู่ในช่วง ±0.5 dB) DeepFilterNet3 นำเราใน PESQ อยู่ 0.15 — เราเสมอด้านความชัดเจน และนำด้านความเที่ยงตรงของคลื่นเสียง (+18.66 ต่อ +17.31 dB SI-SDR) MDX-Net และ LALAL.AI ยังไม่ได้ทดสอบ เราจึงไม่กล่าวอ้างว่าชนะทุกตัว ตรวจสอบเมื่อพฤษภาคม 2026
สามขั้นตอน ไม่ถึงหนึ่งนาที
อัปโหลดไฟล์
ลากแล้ววางไฟล์เสียงหรือวิดีโอ — MP3, WAV, M4A, MP4, MOV หรือ WebM สูงสุด 200MB ไม่ต้องมีบัญชีสำหรับ 60 วินาทีแรก
ฟังแทร็กที่แยกแล้ว
AI แบ่งไฟล์ของคุณเป็นผู้พูดแต่ละคน ดนตรีพื้นหลังล้วน และพื้นหลังพร้อมเสียงตอบรับ เล่นแต่ละแทร็กได้ในเบราว์เซอร์ทันที
ส่งออกมิกซ์ของคุณ
เลือกแทร็กที่ต้องการแล้วส่งออกเป็นไฟล์เดียว เข้าสู่ระบบเพื่อดาวน์โหลด หรือประมวลผลไฟล์ยาวแบบเต็มความยาว
มากกว่าเครื่องมือลบเสียงร้อง
😂 โหมดเสียงพื้นหลังสองแบบ
BGM ล้วน หรือ BGM ที่คงเสียงหัวเราะและเสียงปรบมือไว้ ไม่มีเครื่องมือแยกเสียงตัวไหนให้ทั้งสองแบบจากการอัปโหลดครั้งเดียว
👤 แยกผู้พูดหลายคน
ไม่ใช่แค่แยกเสียงร้องกับดนตรี — การแยกผู้พูดมอบแทร็กของตัวเองให้ทุกคนในบันทึก พร้อมทรานสคริปต์ระบุผู้พูดใน 99+ ภาษา
🔒 ไม่เก็บข้อมูลใด ๆ
ไฟล์ทดลองถูกประมวลผลในพื้นที่เก็บชั่วคราวและถูกลบเมื่อจบเซสชัน ไม่มีการเก็บและไม่ถูกใช้ฝึกโมเดล
📝 ถอดเสียง 99+ ภาษา
ทุกการแยกเสียงมาพร้อม speech-to-text อัตโนมัติพร้อมป้ายผู้พูด แสดงข้างแทร็กของคุณ ตรวจจับภาษาอัตโนมัติ — ไม่ต้องใช้เครื่องมือหรือขั้นตอนเพิ่ม
🎬 รองรับทั้งเสียงและวิดีโอ
อัปโหลด MP3, WAV, M4A, MP4, MOV หรือ WebM — ส่งออกแทร็กพร้อมซับไตเติลฝังในตัวหรือไฟล์ SRT แยก
🎚 ส่งออกมิกซ์แบบเลือกได้
รวมแทร็กใดก็ได้เป็นไฟล์เดียว — เช่น ดนตรีพื้นหลังบวกผู้พูด 1 ไม่มีเครื่องมือแยกเสียงตัวไหนส่งออกมิกซ์แบบกำหนดเองได้ในขั้นตอนเดียว
สองวิธีลบดนตรีพื้นหลังหรือเสียงรบกวนออกจากวิดีโอของคุณ
เสียงหัวเราะในพอดแคสต์ เสียงตอบรับของผู้ชม เสียงไอระหว่างพรีเซนต์ — เครื่องมือลบเสียงร้องส่วนใหญ่แยกสิ่งเหล่านี้จากเสียงพูดไม่ได้ Perso Dubbing ให้คุณทั้งสองตัวเลือกจากการอัปโหลดครั้งเดียว
ดนตรีพื้นหลัง
ลบเสียงมนุษย์ทั้งหมด — เสียงพูด หัวเราะ ปรบมือ — เหลือเพียงเสียงพื้นหลัง เหมาะกับ BGM ปลอดลิขสิทธิ์และพื้นเสียงสะอาดสำหรับพากย์ใหม่
พื้นหลังพร้อมเสียงตอบรับ
ลบเฉพาะเสียงพูด คงเสียงหัวเราะ ปรบมือ และพลังของผู้ชมไว้ เหมาะกับพอดแคสต์ งานสด และรายการวาไรตี้ที่บรรยากาศคือหัวใจ
หนึ่งแทร็กต่อหนึ่งเสียง — การแยกผู้พูดสำหรับสัมภาษณ์ พอดแคสต์ และการประชุม
เครื่องมือลบเสียงร้องส่วนใหญ่หยุดอยู่ที่สองสเต็ม: เสียงร้องกับดนตรี การแยกผู้พูดหลายคนของ Perso Dubbing ก้าวไปไกลกว่านั้น — AI ตรวจจับว่ามีกี่คนกำลังพูด แล้วแยกบันทึกออกเป็นแทร็กผู้พูดแต่ละคน พร้อมทรานสคริปต์ที่มีป้ายกำกับใน 99+ ภาษาในแต่ละแทร็ก
บันทึกที่ผสมกันหนึ่งไฟล์
บันทึกสัมภาษณ์ พอดแคสต์ หรือการประชุมที่มีหลายคนพูดพร้อมดนตรีและเสียงรบกวนในห้อง — อัปโหลดเป็นไฟล์เสียงหรือวิดีโอไฟล์เดียว
แทร็กแยกสำหรับผู้พูดแต่ละคน
แยกผู้พูดออกจากเสียงได้ในคลิกเดียว: ส่งออกแทร็กของผู้พูดคนเดียว หรือการผสมแบบใดก็ได้ที่คุณเลือก — ไม่ต้องแก้ไขด้วยมือ
ใครใช้การแยกเสียงบ้าง
🛡 แก้ปัญหาลิขสิทธิ์
ลบ BGM ติดลิขสิทธิ์โดยคงบทพูดไว้ครบ แทนที่ด้วยเพลงปลอดค่าลิขสิทธิ์ แล้วอัปโหลดใหม่แบบไร้เคลม
🎙 ตัดต่อพอดแคสต์
ตัดคำฟุ่มเฟือยและเสียงพูดที่ไม่ต้องการ โดยคงเสียงหัวเราะของผู้ฟังและบรรยากาศไว้เหมือนเดิม
🌍 พากย์เสียงวิดีโอ
สกัดแทร็ก BGM สะอาดไร้เสียงพูดรั่ว แล้ววางเสียงพากย์ใหม่ทับในภาษาใดก็ได้จากกว่า 99 ภาษา
💼 ประชุมและสัมมนา
แยกผู้พูดออกจากเสียงในบันทึก Zoom หรือ Meet — ผู้เข้าร่วมแต่ละคนได้แทร็กของตัวเอง พร้อมทรานสคริปต์ระบุผู้พูดในตัว
📱 คลิปโซเชียลมีเดีย
เปลี่ยน BGM เดิมในวิดีโอสั้นเป็นเพลงที่กำลังเป็นเทรนด์ — โดยไม่แตะเสียงบรรยายของคุณ
🎤 คอนเสิร์ตและแฟนแคม
ตัดเสียงฝูงชนและเสียงก้องของสถานที่ออกจากคลิปสด เพื่อแยกเสียงศิลปินหรือดนตรีให้เด่นชัด
📰 งานข่าวและสัมภาษณ์
ใช้การแยกผู้พูดหลายคนเพื่อดึงเสียงผู้ให้สัมภาษณ์แต่ละคนออกจากบันทึกภาคสนามที่มีเสียงรบกวน พร้อมทรานสคริปต์สะอาดสำหรับตรวจสอบข้อเท็จจริง
♻️ นำคอนเทนต์กลับมาใช้ใหม่
อัปโหลดครั้งเดียวได้ทั้งเสียงพอดแคสต์ BGM โปรโมต คลิปผู้พูดสำหรับโซเชียล และทรานสคริปต์ครบถ้วนสำหรับบล็อกของคุณ
ทำได้มากกว่าในเวิร์กสเปซของ Perso
คำถามที่พบบ่อย
Perso Dubbing Audio Separation ใช้ฟรีไหม
ต้องสร้างบัญชีเพื่อทดลองแยกเสียงไหม
ถ้าไฟล์ยาวเกิน 60 วินาทีจะเป็นอย่างไร
ไฟล์ของฉันถูกเก็บบนเซิร์ฟเวอร์ของ Perso Dubbing ไหม
รองรับไฟล์ฟอร์แมตและขนาดใดบ้าง
โหมดดนตรีพื้นหลังกับพื้นหลังพร้อมเสียงตอบรับต่างกันอย่างไร
Perso Dubbing แยกผู้พูดหลายคนได้ไหม ไม่ใช่แค่เสียงร้องกับดนตรี
การแยกเสียงของ Perso Dubbing แม่นแค่ไหนเทียบกับเครื่องมืออื่น
ลบเพลงติดลิขสิทธิ์ออกจากวิดีโอได้ไหม
จะลบดนตรีพื้นหลังออกจากวิดีโอที่ถ่ายเองได้อย่างไร?
Perso Dubbing ต่างจาก LALAL.AI หรือ Moises อย่างไร
รวมแทร็กที่เลือกเป็นไฟล์เดียวได้ไหม
ลองกับไฟล์ของคุณเอง — ได้เลยตอนนี้
60 วินาทีแรกฟรี ไม่ต้องสมัคร ไม่เก็บไฟล์ ไม่มีเงื่อนไขแอบแฝง
↑ อัปโหลดไฟล์
EN
KO
ES
PT
RU
ID
DE
TH
JP
TC