AddSubAddSub
Guías

Diarización de hablantes: quién dijo qué en tus grabaciones

Agosto de 2026 · 5 min de lectura

La respuesta corta: La diarización de hablantes separa el audio según quién habla y etiqueta cada línea (S1, S2, S3…) — y AddSub lo hace en directo mientras miras. Las entrevistas, los pódcasts y las reuniones se convierten en transcripciones donde siempre sabes quién dijo qué.

Por qué importan las etiquetas de hablante

Una transcripción plana de una entrevista entre dos personas es un muro de texto: no puedes saber quién pregunta y quién responde. La diarización lo resuelve asignando a cada segmento una identidad de hablante persistente. Cuando reproduces una entrevista grabada, un pódcast con varios anfitriones o una reunión de equipo, AddSub colorea cada línea por hablante (S1, S2, S3…) para que la conversación se lea con naturalidad.

Cómo funciona la diarización de AddSub

  1. Separación de voces — un modelo de segmentación detecta dónde cambian los hablantes.
  2. Incrustaciones de voz — se toma la huella de la voz de cada segmento.
  3. Agrupación — las voces similares se agrupan en identidades de hablante.
  4. Etiquetado persistente — las identidades se emparejan a lo largo de la sesión, de modo que S1 sigue siendo S1.

El detalle clave: las etiquetas de AddSub son de confirmación única — una vez identificado un hablante, su etiqueta no cambia a mitad de sesión, así que las transcripciones se mantienen estables en grabaciones largas.

Cómo conseguir la mejor precisión

  • Mantén el ruido de fondo bajo — el audio limpio de dos hablantes da una separación casi perfecta.
  • Dale ~30 segundos — las etiquetas se estabilizan a medida que se agrupan las voces; las primeras líneas pueden converger.
  • Ayudan las voces distintas — las voces muy similares (p. ej. dos hablantes del mismo sexo en audio telefónico) son más difíciles de separar.
  • Funciona en directo y sin conexión — tanto la secuencia en tiempo real como las transcripciones exportadas llevan insignias de hablante.

Etiqueta a cada hablante — gratis 7 días

No hace falta pagar para empezar. Descargar para macOS.

Lee cualquier cosa. Míralo todo.

Subtítulos y traducción multilingüe en tiempo real para macOS. 100% en el dispositivo y totalmente privado.