# Segmentação de atividade de voz

Detecta provável atividade na faixa de voz e exporta intervalos de fala/não fala em JSON, CSV, SRT ou lista FFmpeg.

> Página canônica: https://elysiatools.com/pt/tools/audio-voice-activity-segmentation

- **Categoria:** Media

- **Palavras-chave:** atividade de voz, vad, segmentação de fala, silêncio, srt

## Visão geral

Este VAD determinístico analisa energia por janela, energia de banda vocal e cruzamentos por zero. É útil para temporização, cortes e legendas, mas não identifica palavras, pessoas ou idioma e não prova que um som seja fala humana.

## Entradas

- **Arquivo de áudio** (file): Select audio to segment
- **Sensibilidade** (select)
- **Fala mínima (s)** (number)
- **Silêncio mínimo (s)** (number)
- **Formato de exportação** (select)

## Quando usar

- Ao preparar a minutagem inicial de áudios longos para posterior edição ou legendagem.
- Quando precisar gerar uma lista de cortes automatizada para remover silêncios usando o FFmpeg.
- Para analisar a distribuição temporal de fala e silêncio em gravações de voz.

## Como funciona

- Faça o upload do arquivo de áudio que deseja analisar.
- Defina o nível de sensibilidade da detecção e configure os tempos mínimos de fala e silêncio.
- Selecione o formato de exportação desejado entre JSON, CSV, SRT ou lista de corte do FFmpeg.
- Processe o arquivo para obter o arquivo final com os segmentos de voz identificados.

## Casos de uso

- Remoção automatizada de silêncios em podcasts gerando uma lista de corte para o FFmpeg.
- Criação de marcações de tempo em formato SRT para sincronização inicial de legendas.
- Mapeamento de tempo de fala ativa em gravações de reuniões para análise de dados em JSON ou CSV.

## Perguntas frequentes

### Esta ferramenta transcreve o áudio em texto?

Não. Ela apenas detecta a presença de atividade de voz e gera marcações de tempo, sem realizar transcrição ou reconhecimento de palavras.

### Quais formatos de exportação são suportados?

Você pode exportar os resultados nos formatos JSON, CSV, SRT ou como uma lista de corte do FFmpeg.

### Como funciona o ajuste de sensibilidade?

A sensibilidade pode ser configurada como conservadora, equilibrada ou sensível para melhor se adaptar ao nível de ruído de fundo do áudio.

### A ferramenta identifica quem está falando?

Não. O algoritmo detecta apenas a atividade na faixa de voz, sem identificar palestrantes, idiomas ou provar que o som é fala humana.

### Qual é o limite de tamanho de arquivo suportado?

A ferramenta aceita arquivos de áudio com tamanho máximo de até 100 MB.

## Ferramentas relacionadas

- [Detector de progressão de acordes](https://elysiatools.com/pt/tools/audio-chord-progression-detector): Estima localmente os acordes de um áudio e reúne CSV, JSON, SVG e notas do método em um ZIP.
- [Mapa de Silencio](https://elysiatools.com/pt/tools/audio-silence-map): Saida de silencio em JSON/CSV
- [Detector de desbalanceamento e reamostragem](https://elysiatools.com/pt/tools/dataset-imbalance-detector-resampler): Detecta desbalanceamento de classes em datasets CSV ou JSON, compara estrategias e previsualiza uma saida balanceada
- [Visualizador de caminhos JSON](https://elysiatools.com/pt/tools/json-path-visualizer): Visualiza JSON ou JSONL como uma arvore expansivel e permite copiar expressoes JSONPath para cada no
- [Detector de conflitos de prefixo e abreviacao em mock data](https://elysiatools.com/pt/tools/mock-data-naming-conflict-detector): Detecta nomes de campo visualmente confusos e colisoes de prefixo em CSV, JSON ou schemas
- [Detector de anomalias em series temporais](https://elysiatools.com/pt/tools/time-series-anomaly-detector): Envia dados de serie temporal em CSV ou JSON, detecta anomalias com Z-Score e IQR e retorna um relatorio com grafico
- [Gerador PDF de treino fitness](https://elysiatools.com/pt/tools/fitness-workout-pdf-generator): Gera um PDF imprimivel de treino a partir de JSON ou CSV com tabelas, caixas de progresso e QR opcionais
- [Extrator de tabelas PDF para CSV/JSON](https://elysiatools.com/pt/tools/pdf-table-extractor-to-csv-json): Extrai tabelas de PDF com OpenDataLoader e exporta em JSON, CSV ou HTML

## Exemplos

- [Amostras de Áudio FLAC Livres de Direitos Autorais](https://elysiatools.com/pt/samples/flac-samples): Coleção de áudio FLAC sem perdas para testes e desenvolvimento, incluindo sons da natureza e música de meditação
- [Amostras de Áudio MP3 Livres de Direitos Autorais](https://elysiatools.com/pt/samples/mp3-samples): Coleção de amostras de áudio livres de direitos autorais para testes e desenvolvimento, incluindo sons da natureza, música de meditação e áudio ambiente
- [Amostras de Áudio WAV Livres de Direitos Autorais](https://elysiatools.com/pt/samples/wav-samples): Coleção de áudio WAV sem compressão para testes e desenvolvimento, incluindo sons da natureza e música de meditação
- [Amostras de voz, aprendizagem e segurança](https://elysiatools.com/pt/samples/audio-learning-safety-samples): Entradas WAV sintéticas determinísticas para pronúncia, ditado, alerta e privacidade.
