AddSubAddSub
Hướng dẫn

Phân tách người nói: Ai đã nói gì trong bản ghi của bạn

Tháng 8 năm 2026 · Đọc trong 5 phút

Câu trả lời ngắn gọn: Phân tách người nói tách âm thanh theo người đang nói và gắn nhãn cho từng dòng (S1, S2, S3…) — và AddSub thực hiện điều đó trực tiếp khi bạn xem. Phỏng vấn, podcast và cuộc họp trở thành bản ghi mà bạn luôn biết ai đã nói gì.

Vì sao nhãn người nói quan trọng

Một bản ghi thô của cuộc phỏng vấn hai người là một bức tường chữ — bạn không thể biết ai đang hỏi và ai đang trả lời. Phân tách người nói giải quyết điều đó bằng cách gán cho mỗi phân đoạn một danh tính người nói liên tục. Khi bạn phát lại một cuộc phỏng vấn đã ghi, một podcast nhiều người dẫn hoặc một cuộc họp nhóm, AddSub tô màu từng dòng theo người nói (S1, S2, S3…) để cuộc trò chuyện đọc tự nhiên.

Cách phân tách người nói của AddSub hoạt động

  1. Tách giọng nói — một mô hình phân đoạn tìm ra nơi người nói thay đổi.
  2. Nhúng giọng nói — giọng nói của mỗi phân đoạn được tạo dấu vân tay.
  3. Phân cụm — các giọng nói tương tự được nhóm thành danh tính người nói.
  4. Gắn nhãn liên tục — danh tính được khớp xuyên suốt phiên, nên S1 luôn là S1.

Chi tiết quan trọng: nhãn của AddSub là gắn một lần — khi một người nói đã được xác định, nhãn của họ không bị lật giữa phiên, nên bản ghi ổn định suốt các bản ghi dài.

Để đạt độ chính xác tốt nhất

  • Giữ tiếng ồn nền thấp — âm thanh hai người nói sạch cho khả năng tách gần hoàn hảo.
  • Cho nó khoảng 30 giây — nhãn ổn định khi giọng nói được phân cụm; vài dòng đầu có thể hội tụ.
  • Giọng nói khác biệt giúp ích — giọng nói rất giống nhau (ví dụ: hai người cùng giới trên âm thanh điện thoại) khó tách hơn.
  • Hoạt động trực tiếp và ngoại tuyến — luồng thời gian thực và bản ghi xuất ra đều mang huy hiệu người nói.

Gắn nhãn mọi người nói — miễn phí 7 ngày

Không cần thanh toán để bắt đầu. Tải xuống cho macOS.

Đọc mọi thứ. Xem mọi thứ.

Phụ đề và dịch thuật đa ngôn ngữ theo thời gian thực cho macOS. 100% xử lý trên thiết bị, hoàn toàn riêng tư.