วิธีแยกเสียงคนสองคนจากไฟล์บันทึกเดียว

เครื่องมือแปลวิดีโอ AI การทำให้เข้าท้องถิ่น และการพากย์เสียง
ลองใช้งานฟรี
หากต้องการแยกเสียงสองคน ให้ใช้แทร็กต้นฉบับของแต่ละคนก่อนถ้ามี หากไม่มี ให้ลองแยกเสียงตามผู้พูดและตรวจสอบผลลัพธ์ทั้งสองก่อนตัดต่อ
แขกรับเชิญพอดแคสต์เสียงเบา ผู้สัมภาษณ์พูดแทรกคำตอบ หรือคุณอยากใช้คำพูดของคนเดียวในคลิปสั้น แต่เสียงทั้งคู่รวมอยู่ในไฟล์เดียว ขั้นตอนต่อไปขึ้นอยู่กับว่าคุณยังมีโปรเจกต์บันทึก แทร็กไมโครโฟนแยก หรือเหลือเพียงเสียงหรือวิดีโอที่ส่งออกแล้ว
คู่มือนี้ช่วยเลือกวิธี ตรวจสอบเสียงที่แยกแล้ว และนำเสียงที่ต้องการกลับไปตัดต่อ หากต้องการลบเพลงที่อยู่เบื้องหลังบทสนทนา ให้เริ่มจากคู่มือลบเพลงพื้นหลัง
01. เลือกวิธีให้เหมาะกับไฟล์
สิ่งที่มี | จุดเริ่มต้น | ข้อจำกัดหลัก |
|---|---|---|
แทร็กไมโครโฟนหรือการบันทึกต้นฉบับ | ฟังและส่งออกเฉพาะแทร็กของคนที่ต้องการ | ไมโครโฟนอาจรับเสียงอีกคนมาด้วย |
ไฟล์รวมที่พูดสลับกัน | ตัดหรือปิดเสียงช่วงที่ไม่ต้องการบนไทม์ไลน์ | แยกเสียงที่พูดพร้อมกันไม่ได้ |
ไฟล์รวมที่มีเสียงพูดทับกัน | ทดลองแยกตามผู้พูดด้วยช่วงสั้น ๆ | ต้องตรวจคำที่หายและเสียงอีกคนที่ยังหลงเหลือ |

แผนภาพสำหรับเลือกวิธี ไม่ใช่ภาพหน้าจอผลิตภัณฑ์หรือผลการวัดประสิทธิภาพ
กรณีที่ 1: มีแทร็กต้นฉบับ
เปิดโปรเจกต์บันทึกและฟังเฉพาะไมโครโฟนของคนที่ต้องการ ตรวจว่ามีเสียงอีกคนลอดเข้ามาหรือไม่ แล้วส่งออกแทร็กที่ใช้ได้ วิธีนี้ช่วยหลีกเลี่ยงการสร้างเสียงกลับจากไฟล์ที่ผสมเสร็จแล้ว
ไฟล์สเตอริโอมีสองช่อง แต่ไม่ได้หมายความว่าแต่ละช่องเป็นคนละคน ฟังช่องซ้ายและขวาแยกกันก่อนถือว่าเป็นเสียงผู้พูดที่แยกแล้ว
กรณีที่ 2: ผู้พูดผลัดกันพูด
ถ้าต้องการเพียงบางช่วง การตัดต่อบนไทม์ไลน์อาจเพียงพอ เก็บช่วงของคนที่ต้องการ แล้วลดหรือปิดเสียงช่วงอื่น รักษาต้นและท้ายคำไว้ และฟังทุกจุดตัดว่าเสียงบรรยากาศเปลี่ยนกะทันหันหรือไม่
ตัวอย่างเช่น หากทำคลิปเฉพาะแขกรับเชิญจากช่วงถามตอบ ให้ตัดคำถามเฉพาะเมื่อคำตอบยังเข้าใจได้ด้วยตัวเอง หากการตัดทำให้ความหมายเปลี่ยน ต้องคงบริบทไว้
กรณีที่ 3: ทั้งคู่พูดพร้อมกัน
การปิดเสียงช่วงที่ทับกันจะลบเสียงทั้งสองคน ให้ลองแยกตามผู้พูดด้วยคลิปสั้น แล้วเทียบแต่ละผลลัพธ์กับต้นฉบับตรงเวลาเดียวกัน
หากประโยคสำคัญหายไป ให้ใช้เทกอื่น ขอแทร็กไมโครโฟนต้นฉบับ หรือเลือกช่วงที่ไม่มีการพูดแทรก การได้สองแทร็กไม่ได้หมายความว่ากู้คืนทุกคำได้แล้ว
02. ป้ายผู้พูดต่างจากแทร็กเสียงที่แยกแล้ว
การระบุผู้พูดในบทถอดเสียงบอกว่าใครพูดเมื่อไร ตัวอย่างเช่น เอกสาร Google Cloud เรื่อง diarization อธิบายการผูกป้ายผู้พูดกับคำที่ระบบรู้จำ สิ่งนี้ไม่ได้สร้างไฟล์เสียงดาวน์โหลดที่มีเสียงคนเดียวโดยอัตโนมัติ
การแยกเสียงตามผู้พูดมีเป้าหมายเพื่อสร้างแทร็กเสียงแต่ละคน ก่อนเลือกเครื่องมือให้ตรวจผลลัพธ์จริง บทถอดเสียงที่ติดป้าย Speaker 1 และ Speaker 2 ช่วยแก้ข้อความได้ แต่เสียงต้นฉบับอาจยังผสมอยู่
แทร็กเสียงร้องหรือเสียงพูดรวมก็เป็นอีกแบบหนึ่ง อาจมีทั้งสองคนพร้อมเสียงพื้นหลังที่ลดลง อ่านเพิ่มเติมเรื่องความต่างระหว่างการลบเสียงร้องจากเพลงกับการแยกเสียงวิดีโอ
03. วิธีตรวจแทร็กผู้พูดใน Perso Dubbing
1. เลือกช่วงตัวอย่างที่เป็นตัวแทน
ใส่ประโยคชัด ๆ ของแต่ละคนและช่วงพูดแทรกถ้ามี เก็บต้นฉบับไว้เปรียบเทียบ ประโยคเปิดง่าย ๆ เพียงอย่างเดียวไม่บอกว่าช่วงที่ซับซ้อนที่สุดใช้ได้หรือไม่
2. อัปโหลดไฟล์
เปิด Perso Dubbing Audio Separation และใช้ส่วนอัปโหลด ตรวจข้อกำหนดไฟล์และเงื่อนไขทดลองที่แสดงอยู่ก่อนประมวลผล
3. หาผลลัพธ์ที่ต้องการ
หลังประมวลผล ให้ตรวจแทร็กที่มี หากต้องการเสียงคนเดียว ให้เลือกแทร็กผู้พูดรายบุคคล “All Speakers (Vocals)” คือเสียงรวมของผู้พูด ไม่ใช่คนเดียว
ฟังเพื่อระบุว่าแต่ละหมายเลขเป็นใคร อย่าสรุปว่า Speaker 1 เป็นพิธีกรเสมอ หรือแทร็กที่ตรวจพบพร้อมเผยแพร่ทันที
4. เปรียบเทียบช่วงที่ยาก
เล่นต้นฉบับและแต่ละแทร็กบริเวณที่พูดแทรก จากนั้นตรวจประโยคที่สงบและท้ายคำ ใช้รายการด้านล่างเพื่อตัดสินว่าเหมาะกับงานตัดต่อหรือไม่
5. ส่งออกและกลับไปยังโปรแกรมตัดต่อวิดีโอ
เมนูส่งออกมีไฟล์ WAV ของผู้พูด ในการตรวจวันที่ 29 กันยายน ข้อความดาวน์โหลดระบุว่าแผน Starter เปิดให้ดาวน์โหลดแทร็ก การสมัครบัญชีจึงไม่เท่ากับดาวน์โหลดฟรี ในพื้นที่ทำงานหลังเข้าสู่ระบบ Audio Export จะรวมแทร็กที่เลือกเป็นไฟล์เดียว หากต้องการคนเดียว ให้ยกเลิกแทร็กอื่นและตรวจว่า Selected แสดงเฉพาะผู้พูดนั้น นำเสียงเข้าโปรแกรมตัดต่อ จัดเวลาให้ตรงกับต้นฉบับ และปิดเสียงผสมเดิมเพื่อไม่ให้เสียงอีกคนกลับเข้ามา
ก่อนส่งออกวิดีโอ ตรวจการซิงก์ช่วงต้นและช่วงหลัง การแยกเสียงกับการส่งออกวิดีโอเป็นคนละขั้นตอน
04. สิ่งที่ควรฟังก่อนใช้ผลลัพธ์
ตรวจอะไร | ฟังหาอะไร | ทำอย่างไร |
|---|---|---|
คำที่ต้องการ | พยางค์หรือพยัญชนะหาย ความหมายเปลี่ยน | เทียบประโยคเดียวกับต้นฉบับ ไม่ใช้ผลลัพธ์ที่คำสำคัญหาย |
ผู้พูดอีกคน | เสียงที่สองยังอยู่ใต้เสียงที่เลือก | พิจารณาการตัดต่อแบบอื่นหรือไฟล์แยกต้นฉบับ |
การพูดแทรก | เสียงเบาลงหรือเพี้ยนเมื่อพูดพร้อมกัน | ตรวจช่วงทับกันแยกจากช่วงพูดผลัดกันที่ชัด |
ลักษณะเสียง | เสียงโลหะ การเปลี่ยนฉับพลัน ความดังไม่สม่ำเสมอ | ฟังด้วยหูฟังและอุปกรณ์ที่ผู้ชมใช้ |
เวลา | เสียงมาก่อนหรือหลังการขยับปาก | ตรวจการจัดแทร็กและจุดตัด |
การฟังช่วงที่สะอาดไม่ได้ยืนยันทั้งไฟล์ สำหรับบทสัมภาษณ์สั้น คำตอบที่เสียหายหนึ่งช่วงอาจสำคัญกว่าเสียงชัดหลายนาที
05. ข้อจำกัดที่ต้องตรวจเมื่อพูดทับกัน
ในการทดสอบภายใน เราประมวลผลไฟล์ประมาณ 19 วินาทีจากเสียงสังเคราะห์สองเสียง เสียงที่สองเริ่มที่ 6.5 วินาที พื้นที่ทำงานแสดงผู้พูดสองตัวเลือก บทถอดเสียงติดป้าย และ WAV สองไฟล์ที่ดาวน์โหลดได้ โดยมีความยาวใกล้เคียงต้นฉบับ
แต่ไฟล์ Speaker 2 เป็นความเงียบดิจิทัลตั้งแต่ 6.5 ถึง 10 วินาที ดังนั้นการมีไฟล์สองไฟล์ไม่ได้พิสูจน์ว่ากู้เสียงที่ทับกันได้ครบ เรายังไม่ได้ตรวจด้วยการฟังหรือยืนยันว่าเสียงใดตรงกับแทร็กใด นี่เป็นการสังเกตสัญญาณจากตัวอย่างสังเคราะห์หนึ่งชุด ไม่ใช่เกณฑ์วัดบทสัมภาษณ์จริงหรือการสาธิตการแยกเสียงที่สำเร็จ
ให้เทียบทุกประโยคที่ต้องการกับต้นฉบับ โดยเฉพาะช่วงพูดแทรก ไฟล์อาจยาวเท่าเดิมแต่มีคำพูดหายไปภายใน
06. หากยังได้ยินเสียงทับกัน
ประเมินผลจากไฟล์ของคุณเอง หากคำที่ต้องการหายหรือเสียงอีกคนยังรบกวน ให้พิจารณาช่วงอื่น ไฟล์ไมโครโฟนต้นฉบับ หรืออัดใหม่ถ้าทำได้ อย่านำประโยคที่เสียหายไปแสดงว่าเป็นบันทึกคำพูดที่ถูกต้อง
สำหรับบทถอดเสียงหรือพากย์ ให้ตรวจการระบุผู้พูดควบคู่กับเสียง แทร็กที่แยกแล้วไม่ได้รับรองว่าข้อความหรือคำแปลถูกต้อง คู่มือถอดเสียงหลายผู้พูด อธิบายการตรวจป้ายและสคริปต์
เมื่อแหล่งเสียงใช้ได้ จึงไปต่อที่การพากย์วิดีโอ แยกการตัดสินเรื่องผลแยกเสียงออกจากการตรวจสคริปต์แปล
07. คำถามที่พบบ่อย
ถาม: แยกเสียงสองคนที่พูดพร้อมกันได้ไหม?
ตอบ: สามารถลองการแยกตามผู้พูดกับไฟล์รวมได้ ตรวจช่วงทับกันในแต่ละผลลัพธ์ ป้ายสองป้ายไม่ได้พิสูจน์ว่าเสียงทั้งคู่คงอยู่ครบและชัด เก็บต้นฉบับไว้เทียบคำและเสียง
ถาม: เครื่องมือลบเสียงร้องแยกคนเดียวจากบทสัมภาษณ์ได้ไหม?
ตอบ: ตรวจว่าเครื่องมือหมายถึงอะไรเมื่อใช้คำว่า “vocals” ผลลัพธ์แยกเสียงคนกับเพลงอาจยังมีคนทั้งสองอยู่รวมกัน ให้หาแทร็กรายบุคคลและฟังแต่ละแทร็ก ป้ายในบทถอดเสียงไม่ใช่ไฟล์เสียงที่แยกแล้ว
ถาม: ดาวน์โหลดผลลัพธ์เป็นวิดีโอได้ไหม?
ตอบ: ไฟล์ผู้พูดที่อธิบายนี้เป็น WAV หากต้องการวิดีโอสำเร็จ ให้นำเสียงเข้าโปรแกรมตัดต่อ จัดให้ตรงภาพและปิดเสียงผสมเดิม ในการตรวจวันที่ 29 กันยายน ข้อความระบุว่าดาวน์โหลดแทร็กได้ในแผน Starter
ลองใช้ไฟล์ของคุณใน Audio Separation เปรียบเทียบช่วงที่ยากก่อนลงมือตัดต่อทั้งหมด
หากต้องการแยกเสียงสองคน ให้ใช้แทร็กต้นฉบับของแต่ละคนก่อนถ้ามี หากไม่มี ให้ลองแยกเสียงตามผู้พูดและตรวจสอบผลลัพธ์ทั้งสองก่อนตัดต่อ
แขกรับเชิญพอดแคสต์เสียงเบา ผู้สัมภาษณ์พูดแทรกคำตอบ หรือคุณอยากใช้คำพูดของคนเดียวในคลิปสั้น แต่เสียงทั้งคู่รวมอยู่ในไฟล์เดียว ขั้นตอนต่อไปขึ้นอยู่กับว่าคุณยังมีโปรเจกต์บันทึก แทร็กไมโครโฟนแยก หรือเหลือเพียงเสียงหรือวิดีโอที่ส่งออกแล้ว
คู่มือนี้ช่วยเลือกวิธี ตรวจสอบเสียงที่แยกแล้ว และนำเสียงที่ต้องการกลับไปตัดต่อ หากต้องการลบเพลงที่อยู่เบื้องหลังบทสนทนา ให้เริ่มจากคู่มือลบเพลงพื้นหลัง
01. เลือกวิธีให้เหมาะกับไฟล์
สิ่งที่มี | จุดเริ่มต้น | ข้อจำกัดหลัก |
|---|---|---|
แทร็กไมโครโฟนหรือการบันทึกต้นฉบับ | ฟังและส่งออกเฉพาะแทร็กของคนที่ต้องการ | ไมโครโฟนอาจรับเสียงอีกคนมาด้วย |
ไฟล์รวมที่พูดสลับกัน | ตัดหรือปิดเสียงช่วงที่ไม่ต้องการบนไทม์ไลน์ | แยกเสียงที่พูดพร้อมกันไม่ได้ |
ไฟล์รวมที่มีเสียงพูดทับกัน | ทดลองแยกตามผู้พูดด้วยช่วงสั้น ๆ | ต้องตรวจคำที่หายและเสียงอีกคนที่ยังหลงเหลือ |

แผนภาพสำหรับเลือกวิธี ไม่ใช่ภาพหน้าจอผลิตภัณฑ์หรือผลการวัดประสิทธิภาพ
กรณีที่ 1: มีแทร็กต้นฉบับ
เปิดโปรเจกต์บันทึกและฟังเฉพาะไมโครโฟนของคนที่ต้องการ ตรวจว่ามีเสียงอีกคนลอดเข้ามาหรือไม่ แล้วส่งออกแทร็กที่ใช้ได้ วิธีนี้ช่วยหลีกเลี่ยงการสร้างเสียงกลับจากไฟล์ที่ผสมเสร็จแล้ว
ไฟล์สเตอริโอมีสองช่อง แต่ไม่ได้หมายความว่าแต่ละช่องเป็นคนละคน ฟังช่องซ้ายและขวาแยกกันก่อนถือว่าเป็นเสียงผู้พูดที่แยกแล้ว
กรณีที่ 2: ผู้พูดผลัดกันพูด
ถ้าต้องการเพียงบางช่วง การตัดต่อบนไทม์ไลน์อาจเพียงพอ เก็บช่วงของคนที่ต้องการ แล้วลดหรือปิดเสียงช่วงอื่น รักษาต้นและท้ายคำไว้ และฟังทุกจุดตัดว่าเสียงบรรยากาศเปลี่ยนกะทันหันหรือไม่
ตัวอย่างเช่น หากทำคลิปเฉพาะแขกรับเชิญจากช่วงถามตอบ ให้ตัดคำถามเฉพาะเมื่อคำตอบยังเข้าใจได้ด้วยตัวเอง หากการตัดทำให้ความหมายเปลี่ยน ต้องคงบริบทไว้
กรณีที่ 3: ทั้งคู่พูดพร้อมกัน
การปิดเสียงช่วงที่ทับกันจะลบเสียงทั้งสองคน ให้ลองแยกตามผู้พูดด้วยคลิปสั้น แล้วเทียบแต่ละผลลัพธ์กับต้นฉบับตรงเวลาเดียวกัน
หากประโยคสำคัญหายไป ให้ใช้เทกอื่น ขอแทร็กไมโครโฟนต้นฉบับ หรือเลือกช่วงที่ไม่มีการพูดแทรก การได้สองแทร็กไม่ได้หมายความว่ากู้คืนทุกคำได้แล้ว
02. ป้ายผู้พูดต่างจากแทร็กเสียงที่แยกแล้ว
การระบุผู้พูดในบทถอดเสียงบอกว่าใครพูดเมื่อไร ตัวอย่างเช่น เอกสาร Google Cloud เรื่อง diarization อธิบายการผูกป้ายผู้พูดกับคำที่ระบบรู้จำ สิ่งนี้ไม่ได้สร้างไฟล์เสียงดาวน์โหลดที่มีเสียงคนเดียวโดยอัตโนมัติ
การแยกเสียงตามผู้พูดมีเป้าหมายเพื่อสร้างแทร็กเสียงแต่ละคน ก่อนเลือกเครื่องมือให้ตรวจผลลัพธ์จริง บทถอดเสียงที่ติดป้าย Speaker 1 และ Speaker 2 ช่วยแก้ข้อความได้ แต่เสียงต้นฉบับอาจยังผสมอยู่
แทร็กเสียงร้องหรือเสียงพูดรวมก็เป็นอีกแบบหนึ่ง อาจมีทั้งสองคนพร้อมเสียงพื้นหลังที่ลดลง อ่านเพิ่มเติมเรื่องความต่างระหว่างการลบเสียงร้องจากเพลงกับการแยกเสียงวิดีโอ
03. วิธีตรวจแทร็กผู้พูดใน Perso Dubbing
1. เลือกช่วงตัวอย่างที่เป็นตัวแทน
ใส่ประโยคชัด ๆ ของแต่ละคนและช่วงพูดแทรกถ้ามี เก็บต้นฉบับไว้เปรียบเทียบ ประโยคเปิดง่าย ๆ เพียงอย่างเดียวไม่บอกว่าช่วงที่ซับซ้อนที่สุดใช้ได้หรือไม่
2. อัปโหลดไฟล์
เปิด Perso Dubbing Audio Separation และใช้ส่วนอัปโหลด ตรวจข้อกำหนดไฟล์และเงื่อนไขทดลองที่แสดงอยู่ก่อนประมวลผล
3. หาผลลัพธ์ที่ต้องการ
หลังประมวลผล ให้ตรวจแทร็กที่มี หากต้องการเสียงคนเดียว ให้เลือกแทร็กผู้พูดรายบุคคล “All Speakers (Vocals)” คือเสียงรวมของผู้พูด ไม่ใช่คนเดียว
ฟังเพื่อระบุว่าแต่ละหมายเลขเป็นใคร อย่าสรุปว่า Speaker 1 เป็นพิธีกรเสมอ หรือแทร็กที่ตรวจพบพร้อมเผยแพร่ทันที
4. เปรียบเทียบช่วงที่ยาก
เล่นต้นฉบับและแต่ละแทร็กบริเวณที่พูดแทรก จากนั้นตรวจประโยคที่สงบและท้ายคำ ใช้รายการด้านล่างเพื่อตัดสินว่าเหมาะกับงานตัดต่อหรือไม่
5. ส่งออกและกลับไปยังโปรแกรมตัดต่อวิดีโอ
เมนูส่งออกมีไฟล์ WAV ของผู้พูด ในการตรวจวันที่ 29 กันยายน ข้อความดาวน์โหลดระบุว่าแผน Starter เปิดให้ดาวน์โหลดแทร็ก การสมัครบัญชีจึงไม่เท่ากับดาวน์โหลดฟรี ในพื้นที่ทำงานหลังเข้าสู่ระบบ Audio Export จะรวมแทร็กที่เลือกเป็นไฟล์เดียว หากต้องการคนเดียว ให้ยกเลิกแทร็กอื่นและตรวจว่า Selected แสดงเฉพาะผู้พูดนั้น นำเสียงเข้าโปรแกรมตัดต่อ จัดเวลาให้ตรงกับต้นฉบับ และปิดเสียงผสมเดิมเพื่อไม่ให้เสียงอีกคนกลับเข้ามา
ก่อนส่งออกวิดีโอ ตรวจการซิงก์ช่วงต้นและช่วงหลัง การแยกเสียงกับการส่งออกวิดีโอเป็นคนละขั้นตอน
04. สิ่งที่ควรฟังก่อนใช้ผลลัพธ์
ตรวจอะไร | ฟังหาอะไร | ทำอย่างไร |
|---|---|---|
คำที่ต้องการ | พยางค์หรือพยัญชนะหาย ความหมายเปลี่ยน | เทียบประโยคเดียวกับต้นฉบับ ไม่ใช้ผลลัพธ์ที่คำสำคัญหาย |
ผู้พูดอีกคน | เสียงที่สองยังอยู่ใต้เสียงที่เลือก | พิจารณาการตัดต่อแบบอื่นหรือไฟล์แยกต้นฉบับ |
การพูดแทรก | เสียงเบาลงหรือเพี้ยนเมื่อพูดพร้อมกัน | ตรวจช่วงทับกันแยกจากช่วงพูดผลัดกันที่ชัด |
ลักษณะเสียง | เสียงโลหะ การเปลี่ยนฉับพลัน ความดังไม่สม่ำเสมอ | ฟังด้วยหูฟังและอุปกรณ์ที่ผู้ชมใช้ |
เวลา | เสียงมาก่อนหรือหลังการขยับปาก | ตรวจการจัดแทร็กและจุดตัด |
การฟังช่วงที่สะอาดไม่ได้ยืนยันทั้งไฟล์ สำหรับบทสัมภาษณ์สั้น คำตอบที่เสียหายหนึ่งช่วงอาจสำคัญกว่าเสียงชัดหลายนาที
05. ข้อจำกัดที่ต้องตรวจเมื่อพูดทับกัน
ในการทดสอบภายใน เราประมวลผลไฟล์ประมาณ 19 วินาทีจากเสียงสังเคราะห์สองเสียง เสียงที่สองเริ่มที่ 6.5 วินาที พื้นที่ทำงานแสดงผู้พูดสองตัวเลือก บทถอดเสียงติดป้าย และ WAV สองไฟล์ที่ดาวน์โหลดได้ โดยมีความยาวใกล้เคียงต้นฉบับ
แต่ไฟล์ Speaker 2 เป็นความเงียบดิจิทัลตั้งแต่ 6.5 ถึง 10 วินาที ดังนั้นการมีไฟล์สองไฟล์ไม่ได้พิสูจน์ว่ากู้เสียงที่ทับกันได้ครบ เรายังไม่ได้ตรวจด้วยการฟังหรือยืนยันว่าเสียงใดตรงกับแทร็กใด นี่เป็นการสังเกตสัญญาณจากตัวอย่างสังเคราะห์หนึ่งชุด ไม่ใช่เกณฑ์วัดบทสัมภาษณ์จริงหรือการสาธิตการแยกเสียงที่สำเร็จ
ให้เทียบทุกประโยคที่ต้องการกับต้นฉบับ โดยเฉพาะช่วงพูดแทรก ไฟล์อาจยาวเท่าเดิมแต่มีคำพูดหายไปภายใน
06. หากยังได้ยินเสียงทับกัน
ประเมินผลจากไฟล์ของคุณเอง หากคำที่ต้องการหายหรือเสียงอีกคนยังรบกวน ให้พิจารณาช่วงอื่น ไฟล์ไมโครโฟนต้นฉบับ หรืออัดใหม่ถ้าทำได้ อย่านำประโยคที่เสียหายไปแสดงว่าเป็นบันทึกคำพูดที่ถูกต้อง
สำหรับบทถอดเสียงหรือพากย์ ให้ตรวจการระบุผู้พูดควบคู่กับเสียง แทร็กที่แยกแล้วไม่ได้รับรองว่าข้อความหรือคำแปลถูกต้อง คู่มือถอดเสียงหลายผู้พูด อธิบายการตรวจป้ายและสคริปต์
เมื่อแหล่งเสียงใช้ได้ จึงไปต่อที่การพากย์วิดีโอ แยกการตัดสินเรื่องผลแยกเสียงออกจากการตรวจสคริปต์แปล
07. คำถามที่พบบ่อย
ถาม: แยกเสียงสองคนที่พูดพร้อมกันได้ไหม?
ตอบ: สามารถลองการแยกตามผู้พูดกับไฟล์รวมได้ ตรวจช่วงทับกันในแต่ละผลลัพธ์ ป้ายสองป้ายไม่ได้พิสูจน์ว่าเสียงทั้งคู่คงอยู่ครบและชัด เก็บต้นฉบับไว้เทียบคำและเสียง
ถาม: เครื่องมือลบเสียงร้องแยกคนเดียวจากบทสัมภาษณ์ได้ไหม?
ตอบ: ตรวจว่าเครื่องมือหมายถึงอะไรเมื่อใช้คำว่า “vocals” ผลลัพธ์แยกเสียงคนกับเพลงอาจยังมีคนทั้งสองอยู่รวมกัน ให้หาแทร็กรายบุคคลและฟังแต่ละแทร็ก ป้ายในบทถอดเสียงไม่ใช่ไฟล์เสียงที่แยกแล้ว
ถาม: ดาวน์โหลดผลลัพธ์เป็นวิดีโอได้ไหม?
ตอบ: ไฟล์ผู้พูดที่อธิบายนี้เป็น WAV หากต้องการวิดีโอสำเร็จ ให้นำเสียงเข้าโปรแกรมตัดต่อ จัดให้ตรงภาพและปิดเสียงผสมเดิม ในการตรวจวันที่ 29 กันยายน ข้อความระบุว่าดาวน์โหลดแทร็กได้ในแผน Starter
ลองใช้ไฟล์ของคุณใน Audio Separation เปรียบเทียบช่วงที่ยากก่อนลงมือตัดต่อทั้งหมด
หากต้องการแยกเสียงสองคน ให้ใช้แทร็กต้นฉบับของแต่ละคนก่อนถ้ามี หากไม่มี ให้ลองแยกเสียงตามผู้พูดและตรวจสอบผลลัพธ์ทั้งสองก่อนตัดต่อ
แขกรับเชิญพอดแคสต์เสียงเบา ผู้สัมภาษณ์พูดแทรกคำตอบ หรือคุณอยากใช้คำพูดของคนเดียวในคลิปสั้น แต่เสียงทั้งคู่รวมอยู่ในไฟล์เดียว ขั้นตอนต่อไปขึ้นอยู่กับว่าคุณยังมีโปรเจกต์บันทึก แทร็กไมโครโฟนแยก หรือเหลือเพียงเสียงหรือวิดีโอที่ส่งออกแล้ว
คู่มือนี้ช่วยเลือกวิธี ตรวจสอบเสียงที่แยกแล้ว และนำเสียงที่ต้องการกลับไปตัดต่อ หากต้องการลบเพลงที่อยู่เบื้องหลังบทสนทนา ให้เริ่มจากคู่มือลบเพลงพื้นหลัง
01. เลือกวิธีให้เหมาะกับไฟล์
สิ่งที่มี | จุดเริ่มต้น | ข้อจำกัดหลัก |
|---|---|---|
แทร็กไมโครโฟนหรือการบันทึกต้นฉบับ | ฟังและส่งออกเฉพาะแทร็กของคนที่ต้องการ | ไมโครโฟนอาจรับเสียงอีกคนมาด้วย |
ไฟล์รวมที่พูดสลับกัน | ตัดหรือปิดเสียงช่วงที่ไม่ต้องการบนไทม์ไลน์ | แยกเสียงที่พูดพร้อมกันไม่ได้ |
ไฟล์รวมที่มีเสียงพูดทับกัน | ทดลองแยกตามผู้พูดด้วยช่วงสั้น ๆ | ต้องตรวจคำที่หายและเสียงอีกคนที่ยังหลงเหลือ |

แผนภาพสำหรับเลือกวิธี ไม่ใช่ภาพหน้าจอผลิตภัณฑ์หรือผลการวัดประสิทธิภาพ
กรณีที่ 1: มีแทร็กต้นฉบับ
เปิดโปรเจกต์บันทึกและฟังเฉพาะไมโครโฟนของคนที่ต้องการ ตรวจว่ามีเสียงอีกคนลอดเข้ามาหรือไม่ แล้วส่งออกแทร็กที่ใช้ได้ วิธีนี้ช่วยหลีกเลี่ยงการสร้างเสียงกลับจากไฟล์ที่ผสมเสร็จแล้ว
ไฟล์สเตอริโอมีสองช่อง แต่ไม่ได้หมายความว่าแต่ละช่องเป็นคนละคน ฟังช่องซ้ายและขวาแยกกันก่อนถือว่าเป็นเสียงผู้พูดที่แยกแล้ว
กรณีที่ 2: ผู้พูดผลัดกันพูด
ถ้าต้องการเพียงบางช่วง การตัดต่อบนไทม์ไลน์อาจเพียงพอ เก็บช่วงของคนที่ต้องการ แล้วลดหรือปิดเสียงช่วงอื่น รักษาต้นและท้ายคำไว้ และฟังทุกจุดตัดว่าเสียงบรรยากาศเปลี่ยนกะทันหันหรือไม่
ตัวอย่างเช่น หากทำคลิปเฉพาะแขกรับเชิญจากช่วงถามตอบ ให้ตัดคำถามเฉพาะเมื่อคำตอบยังเข้าใจได้ด้วยตัวเอง หากการตัดทำให้ความหมายเปลี่ยน ต้องคงบริบทไว้
กรณีที่ 3: ทั้งคู่พูดพร้อมกัน
การปิดเสียงช่วงที่ทับกันจะลบเสียงทั้งสองคน ให้ลองแยกตามผู้พูดด้วยคลิปสั้น แล้วเทียบแต่ละผลลัพธ์กับต้นฉบับตรงเวลาเดียวกัน
หากประโยคสำคัญหายไป ให้ใช้เทกอื่น ขอแทร็กไมโครโฟนต้นฉบับ หรือเลือกช่วงที่ไม่มีการพูดแทรก การได้สองแทร็กไม่ได้หมายความว่ากู้คืนทุกคำได้แล้ว
02. ป้ายผู้พูดต่างจากแทร็กเสียงที่แยกแล้ว
การระบุผู้พูดในบทถอดเสียงบอกว่าใครพูดเมื่อไร ตัวอย่างเช่น เอกสาร Google Cloud เรื่อง diarization อธิบายการผูกป้ายผู้พูดกับคำที่ระบบรู้จำ สิ่งนี้ไม่ได้สร้างไฟล์เสียงดาวน์โหลดที่มีเสียงคนเดียวโดยอัตโนมัติ
การแยกเสียงตามผู้พูดมีเป้าหมายเพื่อสร้างแทร็กเสียงแต่ละคน ก่อนเลือกเครื่องมือให้ตรวจผลลัพธ์จริง บทถอดเสียงที่ติดป้าย Speaker 1 และ Speaker 2 ช่วยแก้ข้อความได้ แต่เสียงต้นฉบับอาจยังผสมอยู่
แทร็กเสียงร้องหรือเสียงพูดรวมก็เป็นอีกแบบหนึ่ง อาจมีทั้งสองคนพร้อมเสียงพื้นหลังที่ลดลง อ่านเพิ่มเติมเรื่องความต่างระหว่างการลบเสียงร้องจากเพลงกับการแยกเสียงวิดีโอ
03. วิธีตรวจแทร็กผู้พูดใน Perso Dubbing
1. เลือกช่วงตัวอย่างที่เป็นตัวแทน
ใส่ประโยคชัด ๆ ของแต่ละคนและช่วงพูดแทรกถ้ามี เก็บต้นฉบับไว้เปรียบเทียบ ประโยคเปิดง่าย ๆ เพียงอย่างเดียวไม่บอกว่าช่วงที่ซับซ้อนที่สุดใช้ได้หรือไม่
2. อัปโหลดไฟล์
เปิด Perso Dubbing Audio Separation และใช้ส่วนอัปโหลด ตรวจข้อกำหนดไฟล์และเงื่อนไขทดลองที่แสดงอยู่ก่อนประมวลผล
3. หาผลลัพธ์ที่ต้องการ
หลังประมวลผล ให้ตรวจแทร็กที่มี หากต้องการเสียงคนเดียว ให้เลือกแทร็กผู้พูดรายบุคคล “All Speakers (Vocals)” คือเสียงรวมของผู้พูด ไม่ใช่คนเดียว
ฟังเพื่อระบุว่าแต่ละหมายเลขเป็นใคร อย่าสรุปว่า Speaker 1 เป็นพิธีกรเสมอ หรือแทร็กที่ตรวจพบพร้อมเผยแพร่ทันที
4. เปรียบเทียบช่วงที่ยาก
เล่นต้นฉบับและแต่ละแทร็กบริเวณที่พูดแทรก จากนั้นตรวจประโยคที่สงบและท้ายคำ ใช้รายการด้านล่างเพื่อตัดสินว่าเหมาะกับงานตัดต่อหรือไม่
5. ส่งออกและกลับไปยังโปรแกรมตัดต่อวิดีโอ
เมนูส่งออกมีไฟล์ WAV ของผู้พูด ในการตรวจวันที่ 29 กันยายน ข้อความดาวน์โหลดระบุว่าแผน Starter เปิดให้ดาวน์โหลดแทร็ก การสมัครบัญชีจึงไม่เท่ากับดาวน์โหลดฟรี ในพื้นที่ทำงานหลังเข้าสู่ระบบ Audio Export จะรวมแทร็กที่เลือกเป็นไฟล์เดียว หากต้องการคนเดียว ให้ยกเลิกแทร็กอื่นและตรวจว่า Selected แสดงเฉพาะผู้พูดนั้น นำเสียงเข้าโปรแกรมตัดต่อ จัดเวลาให้ตรงกับต้นฉบับ และปิดเสียงผสมเดิมเพื่อไม่ให้เสียงอีกคนกลับเข้ามา
ก่อนส่งออกวิดีโอ ตรวจการซิงก์ช่วงต้นและช่วงหลัง การแยกเสียงกับการส่งออกวิดีโอเป็นคนละขั้นตอน
04. สิ่งที่ควรฟังก่อนใช้ผลลัพธ์
ตรวจอะไร | ฟังหาอะไร | ทำอย่างไร |
|---|---|---|
คำที่ต้องการ | พยางค์หรือพยัญชนะหาย ความหมายเปลี่ยน | เทียบประโยคเดียวกับต้นฉบับ ไม่ใช้ผลลัพธ์ที่คำสำคัญหาย |
ผู้พูดอีกคน | เสียงที่สองยังอยู่ใต้เสียงที่เลือก | พิจารณาการตัดต่อแบบอื่นหรือไฟล์แยกต้นฉบับ |
การพูดแทรก | เสียงเบาลงหรือเพี้ยนเมื่อพูดพร้อมกัน | ตรวจช่วงทับกันแยกจากช่วงพูดผลัดกันที่ชัด |
ลักษณะเสียง | เสียงโลหะ การเปลี่ยนฉับพลัน ความดังไม่สม่ำเสมอ | ฟังด้วยหูฟังและอุปกรณ์ที่ผู้ชมใช้ |
เวลา | เสียงมาก่อนหรือหลังการขยับปาก | ตรวจการจัดแทร็กและจุดตัด |
การฟังช่วงที่สะอาดไม่ได้ยืนยันทั้งไฟล์ สำหรับบทสัมภาษณ์สั้น คำตอบที่เสียหายหนึ่งช่วงอาจสำคัญกว่าเสียงชัดหลายนาที
05. ข้อจำกัดที่ต้องตรวจเมื่อพูดทับกัน
ในการทดสอบภายใน เราประมวลผลไฟล์ประมาณ 19 วินาทีจากเสียงสังเคราะห์สองเสียง เสียงที่สองเริ่มที่ 6.5 วินาที พื้นที่ทำงานแสดงผู้พูดสองตัวเลือก บทถอดเสียงติดป้าย และ WAV สองไฟล์ที่ดาวน์โหลดได้ โดยมีความยาวใกล้เคียงต้นฉบับ
แต่ไฟล์ Speaker 2 เป็นความเงียบดิจิทัลตั้งแต่ 6.5 ถึง 10 วินาที ดังนั้นการมีไฟล์สองไฟล์ไม่ได้พิสูจน์ว่ากู้เสียงที่ทับกันได้ครบ เรายังไม่ได้ตรวจด้วยการฟังหรือยืนยันว่าเสียงใดตรงกับแทร็กใด นี่เป็นการสังเกตสัญญาณจากตัวอย่างสังเคราะห์หนึ่งชุด ไม่ใช่เกณฑ์วัดบทสัมภาษณ์จริงหรือการสาธิตการแยกเสียงที่สำเร็จ
ให้เทียบทุกประโยคที่ต้องการกับต้นฉบับ โดยเฉพาะช่วงพูดแทรก ไฟล์อาจยาวเท่าเดิมแต่มีคำพูดหายไปภายใน
06. หากยังได้ยินเสียงทับกัน
ประเมินผลจากไฟล์ของคุณเอง หากคำที่ต้องการหายหรือเสียงอีกคนยังรบกวน ให้พิจารณาช่วงอื่น ไฟล์ไมโครโฟนต้นฉบับ หรืออัดใหม่ถ้าทำได้ อย่านำประโยคที่เสียหายไปแสดงว่าเป็นบันทึกคำพูดที่ถูกต้อง
สำหรับบทถอดเสียงหรือพากย์ ให้ตรวจการระบุผู้พูดควบคู่กับเสียง แทร็กที่แยกแล้วไม่ได้รับรองว่าข้อความหรือคำแปลถูกต้อง คู่มือถอดเสียงหลายผู้พูด อธิบายการตรวจป้ายและสคริปต์
เมื่อแหล่งเสียงใช้ได้ จึงไปต่อที่การพากย์วิดีโอ แยกการตัดสินเรื่องผลแยกเสียงออกจากการตรวจสคริปต์แปล
07. คำถามที่พบบ่อย
ถาม: แยกเสียงสองคนที่พูดพร้อมกันได้ไหม?
ตอบ: สามารถลองการแยกตามผู้พูดกับไฟล์รวมได้ ตรวจช่วงทับกันในแต่ละผลลัพธ์ ป้ายสองป้ายไม่ได้พิสูจน์ว่าเสียงทั้งคู่คงอยู่ครบและชัด เก็บต้นฉบับไว้เทียบคำและเสียง
ถาม: เครื่องมือลบเสียงร้องแยกคนเดียวจากบทสัมภาษณ์ได้ไหม?
ตอบ: ตรวจว่าเครื่องมือหมายถึงอะไรเมื่อใช้คำว่า “vocals” ผลลัพธ์แยกเสียงคนกับเพลงอาจยังมีคนทั้งสองอยู่รวมกัน ให้หาแทร็กรายบุคคลและฟังแต่ละแทร็ก ป้ายในบทถอดเสียงไม่ใช่ไฟล์เสียงที่แยกแล้ว
ถาม: ดาวน์โหลดผลลัพธ์เป็นวิดีโอได้ไหม?
ตอบ: ไฟล์ผู้พูดที่อธิบายนี้เป็น WAV หากต้องการวิดีโอสำเร็จ ให้นำเสียงเข้าโปรแกรมตัดต่อ จัดให้ตรงภาพและปิดเสียงผสมเดิม ในการตรวจวันที่ 29 กันยายน ข้อความระบุว่าดาวน์โหลดแทร็กได้ในแผน Starter
ลองใช้ไฟล์ของคุณใน Audio Separation เปรียบเทียบช่วงที่ยากก่อนลงมือตัดต่อทั้งหมด
อ่านต่อ
เรียกดูทั้งหมด
ผลิตภัณฑ์
การถอดเสียงและคำบรรยาย
โซลูชัน
ธุรกิจ
นักพัฒนา
ทรัพยากร
ความช่วยเหลือและความน่าเชื่อถือ
เรียนรู้
องค์กร
โซลูชัน
ESTsoft Inc. 15770 Laguna Canyon Rd #250, Irvine, CA 92618
ผลิตภัณฑ์
การถอดเสียงและคำบรรยาย
โซลูชัน
ธุรกิจ
นักพัฒนา
ทรัพยากร
ความช่วยเหลือและความน่าเชื่อถือ
เรียนรู้
องค์กร
โซลูชัน
ESTsoft Inc. 15770 Laguna Canyon Rd #250, Irvine, CA 92618






