คู่มือ
การแยกผู้พูด: ใครพูดอะไรในการบันทึกของคุณ
สิงหาคม 2026 · อ่าน 5 นาที
คำตอบสั้น ๆ: การแยกผู้พูดแยกเสียงตามผู้ที่กำลังพูดและติดป้ายแต่ละบรรทัด (S1, S2, S3…) — และ AddSub ทำสิ่งนี้ สด ขณะที่คุณดู สัมภาษณ์ พอดแคสต์ และการประชุมกลายเป็นบันทึกที่คุณรู้เสมอว่าใครพูดอะไร
ทำไมป้ายผู้พูดถึงสำคัญ
บันทึกธรรมดาของการสัมภาษณ์สองคนคือกำแพงข้อความ — คุณบอกไม่ได้ว่าใครถามใครตอบ การแยกผู้พูดแก้ปัญหานี้โดยกำหนดเอกลักษณ์ผู้พูดแบบถาวรให้แต่ละส่วน เมื่อคุณเล่นการสัมภาษณ์ที่บันทึกไว้ พอดแคสต์หลายผู้จัด หรือการประชุมทีม AddSub ระบายสีแต่ละบรรทัดตามผู้พูด (S1, S2, S3…) เพื่อให้บทสนทนาอ่านเป็นธรรมชาติ
การแยกผู้พูดของ AddSub ทำงานอย่างไร
- การแยกเสียง — โมเดลแบ่งส่วนค้นหาจุดที่ผู้พูดเปลี่ยน
- การฝังเสียง (voice embeddings) — ลายนิ้วมือเสียงของแต่ละส่วน
- การจัดกลุ่ม — เสียงที่คล้ายกันถูกจัดกลุ่มเป็นเอกลักษณ์ผู้พูด
- การติดป้ายแบบถาวร — เอกลักษณ์ถูกจับคู่ตลอดเซสชัน S1 จึงคงเป็น S1
รายละเอียดสำคัญ: ป้ายของ AddSub เป็นแบบ ยืนยันครั้งเดียว — เมื่อระบุผู้พูดแล้ว ป้ายจะไม่สลับกลางเซสชัน บันทึกจึงคงที่ตลอดการบันทึกยาว
การได้ความแม่นยำสูงสุด
- รักษาเสียงรบกวนพื้นหลังให้ต่ำ — เสียงผู้พูดสองคนที่สะอาดให้การแยกที่เกือบสมบูรณ์แบบ
- ให้เวลาประมาณ 30 วินาที — ป้ายคงที่เมื่อจัดกลุ่มเสียงแล้ว สองสามบรรทัดแรกอาจยังปรับตัว
- เสียงที่แตกต่างช่วยได้ — เสียงที่คล้ายกันมาก (เช่น ผู้พูดเพศเดียวกันสองคนในเสียงโทรศัพท์) แยกยากกว่า
- ทำงานทั้งสดและออฟไลน์ — สตรีมแบบเรียลไทม์และบันทึกที่ส่งออกต่างมีป้ายผู้พูด
ติดป้ายทุกผู้พูด — ฟรี 7 วัน
ไม่ต้องชำระเงินเพื่อเริ่มต้น ดาวน์โหลดสำหรับ macOS