# Detector de turnos de hablante

Marca cambios acústicos probables y exporta una línea de tiempo aproximada.

> Página canónica: https://elysiatools.com/es/tools/audio-speaker-turn-detector

- **Categoría:** Media

- **Palabras clave:** turnos, diarización, voz

## Descripción general

Compara ventanas por espectro, cruces por cero y nivel. No identifica personas ni realiza diarización real.

## Entradas

- **Archivo de audio** (file): Select dialogue or interview audio
- **Sensibilidad** (select)
- **Turno mínimo (s)** (number)
- **Formato de exportación** (select)

## Cuándo usarlo

- Al editar entrevistas o diálogos grabados y necesitar marcar rápidamente los momentos de transición entre voces.
- Para generar una estructura preliminar de subtítulos o transcripciones basada en los cambios de intervención acústica.
- Cuando se requiere segmentar un archivo de audio largo en bloques de conversación sin necesidad de realizar una diarización de identidad compleja.

## Cómo funciona

- Suba su archivo de audio en formato compatible y seleccione el nivel de sensibilidad acústica deseado.
- Defina la duración mínima en segundos para cada turno de habla para evitar falsos positivos por pausas breves.
- La herramienta analiza las variaciones de espectro, cruces por cero y volumen entre ventanas de audio adyacentes.
- Descargue la línea de tiempo resultante con las marcas de tiempo estimadas en formato JSON, CSV o SRT.

## Casos de uso

- Segmentación de entrevistas grabadas para facilitar el trabajo de transcripción manual posterior.
- Creación de plantillas de subtítulos SRT con marcas de tiempo preestablecidas para diálogos de podcasts.
- Análisis preliminar de grabaciones de reuniones para identificar la frecuencia de alternancia de voz.

## Preguntas frecuentes

### ¿Esta herramienta identifica quién está hablando?

No, la herramienta solo detecta cambios acústicos que sugieren un cambio de turno, pero no identifica ni etiqueta a personas específicas.

### ¿Qué formatos de exportación están disponibles?

Puede exportar la línea de tiempo de los turnos detectados en formatos JSON, CSV o como marcadores de subtítulos SRT.

### ¿Cómo influye el ajuste de sensibilidad?

La sensibilidad alta detecta cambios sutiles pero puede generar falsos positivos, mientras que la conservadora reduce los marcadores a cambios muy evidentes.

### ¿Qué es el parámetro de turno mínimo?

Es el tiempo mínimo en segundos que debe durar una intervención para ser considerada un nuevo turno, evitando fragmentar el audio por interrupciones cortas.

### ¿Requiere conexión a internet para procesar el audio?

Sí, el archivo de audio se procesa en nuestros servidores para analizar las propiedades acústicas y generar el archivo de salida.

## Herramientas relacionadas

- [Alineador de fase bombo-bajo](https://elysiatools.com/es/tools/audio-kick-bass-phase-aligner): Compara el tiempo y la fase de bombo y bajo en graves, informa del desfase y la polaridad, y exporta la pista corregida con alineación exacta por muestras.
- [Rescate de invitado remoto](https://elysiatools.com/es/tools/audio-remote-guest-rescue): Reduce eco de sala, ruido, resonancia y opacidad en grabaciones remotas.
- [Segmentación de actividad de voz](https://elysiatools.com/es/tools/audio-voice-activity-segmentation): Detecta actividad probable en banda de voz y exporta rangos de voz/no voz en JSON, CSV, SRT o lista FFmpeg.
- [Exportador de regiones de clipping](https://elysiatools.com/es/tools/audio-clipping-region-exporter): Detecta clipping digital y exporta regiones con tiempo para reparación o notas.
- [Insertar silencio](https://elysiatools.com/es/tools/audio-insert-silence): Inserta silencio en un momento específico
- [Igualador de nivel de entrevista](https://elysiatools.com/es/tools/audio-interview-level-matcher): Iguala la loudness entre pista de presentador e invitado (o dos tomas de voz) conservando la dinámica natural.
- [Cambio de tonalidad para cantantes](https://elysiatools.com/es/tools/audio-key-change-for-singers): Transporta una canción por tonalidad o semitonos sin cambiar duración ni velocidad.
- [Detector de clicks de boca](https://elysiatools.com/es/tools/audio-mouth-click-finder): Repara chasquidos de labios, saliva, ticks de boca y pequeños clicks de voz.

## Ejemplos

- [Muestras FLAC Sin Derechos de Autor](https://elysiatools.com/es/samples/flac-samples): Colección de audio FLAC sin pérdidas para pruebas y desarrollo, incluyendo sonidos de la naturaleza y música de meditación
- [Muestras MP3 Sin Derechos de Autor](https://elysiatools.com/es/samples/mp3-samples): Colección de muestras de audio sin derechos de autor para pruebas y desarrollo, incluyendo sonidos de la naturaleza, música de meditación y audio ambiental
- [Muestras WAV Sin Derechos de Autor](https://elysiatools.com/es/samples/wav-samples): Colección de audio WAV sin compresión para pruebas y desarrollo, incluyendo sonidos de la naturaleza y música de meditación
- [Muestras de voz, aprendizaje y seguridad](https://elysiatools.com/es/samples/audio-learning-safety-samples): Entradas WAV sintéticas deterministas para comparación, dictado, alertas y privacidad.

## Contenido relacionado

- [Grabacion, edicion y entrega de podcasts](https://elysiatools.com/es/hubs/podcast-recording-editing-delivery): Rescata voces remotas, limpia artefactos, organiza la edicion, masteriza la sonoridad y valida archivos de podcast antes de publicar.
