AddSubAddSub
Mga Gabay

Speaker Diarization: Sino ang Nagsabi ng Ano sa Iyong mga Recording

Agosto 2026 · 5 minutong pagbasa

Ang maikling sagot: Ang speaker diarization ay naghihiwalay ng audio ayon sa kung sino ang nagsasalita at naglalagay ng label sa bawat linya (S1, S2, S3…) — at ginagawa ito ng AddSub nang live habang nanonood ka. Ang mga interview, podcast, at meeting ay nagiging mga transcript kung saan palagi mong alam kung sino ang nagsabi ng ano.

Bakit mahalaga ang speaker labels

Ang isang simpleng transcript ng two-person interview ay isang pader ng teksto — hindi mo masasabi kung sino ang nagtatanong at kung sino ang sumasagot. Nilulutas ito ng diarization sa pamamagitan ng pagtatalaga sa bawat segment ng permanenteng speaker identity. Kapag nag-play ka ng na-record na interview, isang podcast na may ilang host, o isang team meeting, kinukulayan ng AddSub ang bawat linya ayon sa speaker (S1, S2, S3…) para natural na basahin ang usapan.

Paano gumagana ang diarization ng AddSub

  1. Voice separation — isang segmentation model ang nakakahanap kung saan nagpapalit ng speaker.
  2. Voice embeddings — ang boses ng bawat segment ay na-fingerprint.
  3. Clustering — ang mga magkakatulad na boses ay pinapangkat sa mga speaker identity.
  4. Persistent labeling — ang mga identity ay pinagtutugma sa buong session, kaya ang S1 ay nananatiling S1.

Ang pangunahing detalye: ang mga label ng AddSub ay commit-once — kapag natukoy na ang isang speaker, hindi nagbabago ang kanyang label sa gitna ng session, kaya nananatiling stable ang mga transcript sa mahabang recording.

Pagkamit ng pinakamahusay na katumpakan

  • Panatilihing mababa ang background noise — ang malinis na two-speaker na audio ay nagbibigay ng halos perpektong paghihiwalay.
  • Bigyan ito ng ~30 segundo — nagpapatatag ang mga label habang kinaklaster ang mga boses; maaaring magtagpo ang mga unang linya.
  • Nakakatulong ang mga natatanging boses — ang magkatulad na boses (hal. dalawang same-sex speaker sa phone audio) ay mas mahirap paghiwalayin.
  • Gumagana nang live at offline — ang real-time stream at mga na-export na transcript ay parehong may speaker badge.

Lagyan ng label ang bawat speaker — libre sa loob ng 7 araw

Hindi kailangan ng bayad para magsimula. I-download para sa macOS.

Basahin ang anuman. Panoorin ang lahat.

Real-time na multilingual na subtitle at pagsasalin para sa macOS. 100% on-device, ganap na pribado.