# Sprachaktivitäts-Segmentierung

Erkennt wahrscheinliche Aktivität im Sprachband und exportiert Sprach-/Nichtsprachbereiche als JSON, CSV, SRT oder FFmpeg-Liste.

> Kanonische Seite: https://elysiatools.com/de/tools/audio-voice-activity-segmentation

- **Kategorie:** Media

- **Schlagwörter:** sprachaktivität, vad, sprachsegmentierung, stille, srt

## Überblick

Dieser deterministische VAD analysiert Fensterenergie, Sprachbandenergie und Nulldurchgänge. Er hilft bei Timing, Schnittvorbereitung und Untertitelabgleich, erkennt aber keine Wörter, Sprecher oder Sprache und beweist keine menschliche Stimme.

## Eingaben

- **Audiodatei** (file): Select audio to segment
- **Empfindlichkeit** (select)
- **Mindestsprachdauer (s)** (number)
- **Mindeststille (s)** (number)
- **Exportformat** (select)

## Wann verwenden

- Zur Vorbereitung von Audioschnitten, um stille Passagen in Aufnahmen schnell zu identifizieren.
- Zur Erstellung von Timing-Markern für die präzise Ausrichtung von Untertiteln.
- Zur Bereinigung und Segmentierung von Audio-Datensätzen vor der Weiterverarbeitung.

## Funktionsweise

- Laden Sie Ihre Audiodatei hoch und wählen Sie die passende Empfindlichkeitsstufe für die Erkennung.
- Definieren Sie die Mindestdauer für Sprache sowie die Mindestdauer für Stille, um kurze Störgeräusche zu filtern.
- Das Tool analysiert die Signalenergie und Nulldurchgänge im Frequenzbereich der menschlichen Stimme.
- Exportieren Sie die erkannten Sprachsegmente im gewünschten Format wie JSON, CSV, SRT oder als FFmpeg-Schnittliste.

## Anwendungsfälle

- Automatisches Erzeugen von SRT-Timing-Markern für die spätere manuelle Untertitelung.
- Schnelles Auffinden und Entfernen von langen Schweigepausen in Podcast-Rohaufnahmen.
- Vorsegmentierung von Sprachaufnahmen für das Training von Machine-Learning-Modellen.

## Häufig gestellte Fragen

### Erkennt dieses Tool bestimmte Wörter oder Sprachen?

Nein, es analysiert ausschließlich Pegel und Frequenzen, um Sprachaktivität zu erkennen, ohne Text zu transkribieren.

### Welche Exportformate stehen zur Verfügung?

Sie können die Segmente als JSON-Zeitleiste, CSV-Zeitleiste, SRT-Aktivitätsmarker oder FFmpeg-Schnittliste herunterladen.

### Wie beeinflusst die Empfindlichkeit das Ergebnis?

Eine empfindliche Einstellung erfasst auch leise Laute, während eine konservative Einstellung Fehlalarme durch Rauschen minimiert.

### Kann das Tool menschliche Stimmen von Tiergeräuschen unterscheiden?

Nein, es filtert Frequenzen im typischen Sprachband, liefert jedoch keinen Beweis für eine menschliche Stimme.

### Wie verwende ich den FFmpeg-Export?

Die exportierte FFmpeg-Schnittliste enthält fertige Befehle, um die erkannten Sprach- oder Stillebereiche direkt per Kommandozeile zu schneiden.

## Ähnliche Tools

- [Akkordfolgen-Detektor](https://elysiatools.com/de/tools/audio-chord-progression-detector): Schätzt lokal die Akkorde einer Audiodatei und bündelt CSV, JSON, SVG und Methodennotizen in einer ZIP-Datei.
- [Stille-Karte](https://elysiatools.com/de/tools/audio-silence-map): Stille-Intervalle als JSON/CSV
- [Datensatz-Imbalance-Detektor und Resampler](https://elysiatools.com/de/tools/dataset-imbalance-detector-resampler): Erkennt Klassenungleichgewicht in CSV- oder JSON-Datensaetzen, vergleicht Strategien und zeigt ein balanciertes Ergebnis
- [JSON-Pfad-Visualizer](https://elysiatools.com/de/tools/json-path-visualizer): Visualisiert JSON oder JSONL als aufklappbaren Baum und kopiert JSONPath-Ausdruecke fuer jeden Knoten
- [Mock-Data-Praefix- und Abkuerzungs-Konfliktdetektor](https://elysiatools.com/de/tools/mock-data-naming-conflict-detector): Erkennt visuell verwirrende Feldnamen und Praefixkollisionen in CSV, JSON oder Schemas
- [Zeitreihen-Anomalie-Detektor](https://elysiatools.com/de/tools/time-series-anomaly-detector): Liest Zeitreihendaten aus CSV oder JSON ein, erkennt Anomalien per Z-Score und IQR und gibt einen Chart-gestuetzten Bericht aus
- [Fitness-Workout-PDF-Generator](https://elysiatools.com/de/tools/fitness-workout-pdf-generator): Erstellt einen druckbaren Trainingsplan als PDF aus JSON oder CSV mit Tabellen, Fortschrittsfeldern und optionalen QR-Codes
- [PDF-Tabellenextraktor zu CSV/JSON](https://elysiatools.com/de/tools/pdf-table-extractor-to-csv-json): Extrahiert Tabellen aus PDFs mit OpenDataLoader und exportiert sie als JSON, CSV oder HTML

## Beispiele

- [FLAC Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/flac-samples): Sammlung verlustfreier FLAC-Audios für Tests und Entwicklung, einschließlich Naturklänge und Meditationsmusik
- [MP3 Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/mp3-samples): Sammlung urheberrechtsfreier Audio-Beispiele zum Testen und Entwickeln, einschließlich Naturklänge, Meditationsmusik und Umgebungsgeräusche
- [WAV Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/wav-samples): Sammlung unkomprimierter WAV-Audios für Tests und Entwicklung, einschließlich Naturklänge und Meditationsmusik
- [Sprach-, Lern- und Sicherheitsbeispiele](https://elysiatools.com/de/samples/audio-learning-safety-samples): Deterministische synthetische WAV-Eingaben für Aussprache, Diktat, Alarm und Datenschutz.
