# Детектор смены говорящего

Помечает вероятные акустические смены и экспортирует приблизительную временную шкалу.

> Каноническая страница: https://elysiatools.com/ru/tools/audio-speaker-turn-detector

- **Категория:** Media

- **Ключевые слова:** смена говорящего, диаризация, голос

## Обзор

Сравнивает спектр, переходы через ноль и уровень. Не идентифицирует людей и не выполняет настоящую диаризацию.

## Входные данные

- **Аудиофайл** (file): Select dialogue or interview audio
- **Чувствительность** (select)
- **Минимальная реплика (с)** (number)
- **Формат экспорта** (select)

## Когда использовать

- При подготовке аудиозаписей интервью или подкастов к монтажу для быстрого поиска стыков реплик.
- Для создания черновых таймлайнов диалогов перед ручной расшифровкой или субтитрованием.
- При анализе записей телефонных звонков или переговоров для разделения реплик собеседников.

## Как это работает

- Загрузите аудиофайл в формате MP3, WAV или другом поддерживаемом аудиоформате.
- Настройте чувствительность алгоритма и укажите минимальную длительность реплики в секундах.
- Выберите желаемый формат экспорта: JSON, CSV или SRT.
- Запустите анализ, чтобы получить файл с временными метками переходов между говорящими.

## Сценарии использования

- Разметка аудиодорожки подкаста с двумя ведущими для последующего разделения каналов или монтажа.
- Подготовка временных меток для создания субтитров к видеоинтервью.
- Анализ записей фокус-групп для оценки частоты и продолжительности реплик участников.

## Частые вопросы

### Идентифицирует ли инструмент конкретных людей по голосу?

Нет, инструмент определяет только моменты смены акустических характеристик речи, но не распознает личности спикеров.

### Какие форматы файлов можно получить на выходе?

Результаты разметки можно экспортировать в форматы JSON, CSV или в виде субтитров SRT.

### Что делает параметр «Минимальная реплика»?

Он задает минимальную длительность реплики в секундах, исключая слишком короткие шумы или перебивания из результатов.

### Можно ли использовать этот инструмент для полноценной диаризации?

Инструмент выполняет лишь базовое акустическое разделение реплик и не заменяет сложные системы биометрической диаризации.

### Как чувствительность влияет на результат?

Высокая чувствительность находит больше мелких пауз и переходов, а консервативная — только явные и длительные смены спикеров.

## Связанные инструменты

- [Выравниватель фазы бочки и баса](https://elysiatools.com/ru/tools/audio-kick-bass-phase-aligner): Сравнивает тайминг и фазу бочки и баса в НЧ-диапазоне, сообщает смещение и полярность и экспортирует исправленную дорожку с точностью до сэмпла.
- [Восстановление удаленного гостя](https://elysiatools.com/ru/tools/audio-remote-guest-rescue): Снижает комнатное эхо, шум, гулкость и мутность в удаленных записях.
- [Сегментация речевой активности](https://elysiatools.com/ru/tools/audio-voice-activity-segmentation): Находит вероятную активность в речевой полосе и экспортирует речь/не-речь в JSON, CSV, SRT или список FFmpeg.
- [Экспорт областей клиппинга](https://elysiatools.com/ru/tools/audio-clipping-region-exporter): Находит цифровой клиппинг и экспортирует таймкоды плоских пиков.
- [Вставить тишину](https://elysiatools.com/ru/tools/audio-insert-silence): Вставляет тишину в указанное время
- [Согласование уровня интервью](https://elysiatools.com/ru/tools/audio-interview-level-matcher): Согласует громкость между дорожкой ведущего и гостя (или двумя дублями голоса), сохраняя естественную динамику.
- [Смена тональности для певцов](https://elysiatools.com/ru/tools/audio-key-change-for-singers): Транспонирует песню по тональности или полутонам без изменения длительности.
- [Поиск щелчков рта](https://elysiatools.com/ru/tools/audio-mouth-click-finder): Исправляет причмокивания, щелчки слюны, ротовые тики и короткие клики голоса.

## Примеры

- [FLAC Аудио Образцы Без Авторских Прав](https://elysiatools.com/ru/samples/flac-samples): Коллекция аудио FLAC без потерь для тестирования и разработки, включая звуки природы и медитативную музыку
- [MP3 Аудио Образцы Без Авторских Прав](https://elysiatools.com/ru/samples/mp3-samples): Коллекция аудио образцов без авторских прав для тестирования и разработки, включая звуки природы, медитативную музыку и фоновое аудио
- [WAV Аудио Образцы Без Авторских Прав](https://elysiatools.com/ru/samples/wav-samples): Коллекция аудио WAV без сжатия для тестирования и разработки, включая звуки природы и медитативную музыку
- [Образцы речи, обучения и безопасности](https://elysiatools.com/ru/samples/audio-learning-safety-samples): Детерминированные синтетические WAV для произношения, диктовки, тревог и приватности.

## Связанные материалы

- [Запись, монтаж и доставка подкаста](https://elysiatools.com/ru/hubs/podcast-recording-editing-delivery): Восстановите удаленные голоса, очистите речь, соберите выпуск, сделайте мастеринг громкости и проверьте файлы перед публикацией.
