# Audio zu Multitrack-MIDI (Entwurf)

Trennt einen Mix in Stems (Drums/Bass/Sonstiges/Vocals) und transkribiert jeden in MIDI

> Kanonische Seite: https://elysiatools.com/de/tools/audio-to-multitrack-midi

- **Kategorie:** Media

- **Schlagwörter:** audio, midi, transkription, multitrack, demucs, basic-pitch, stems, musik

## Überblick

Nur zum Testen: Dieses ressourcenintensive Tool begrenzt jeden Stem-Modus auf Audioclips von höchstens 20 Sekunden. Es verwandelt einen Vollmix mit zwei neuronalen Netzen in einen Multitrack-MIDI-Entwurf: HT-Demucs FT (ONNX) trennt das Audio in Drums, Bass, andere Instrumente und Vocals; dann transkribiert Spotifys Basic Pitch (TensorFlow.js) jeden Stem in MIDI-Noten. Die Stems werden zu einer .mid-Datei mit je einer Spur pro Instrument zusammengefügt. Das ist ein Entwurf für menschliche Transkription, nicht perfekt: Es fehlen Noten, Zeitversatz und Instrument-Übersprechen sind möglich. Importieren Sie das Ergebnis in eine DAW und überarbeiten Sie es von Hand. Läuft in Node, ohne Python und GPU.

## Eingaben

- **Audiodatei** (file): Laden Sie eine MP3, WAV, FLAC, M4A, OGG oder AAC hoch (nur zum Testen; maximal 20 Sekunden)
- **Zu transkribierende Stems** (select)
- **Onset-Empfindlichkeit** (number)
- **Frame-Empfindlichkeit** (number)
- **Mindestnotenlänge (Frames)** (number)
- **Pitch Bend einschließen** (checkbox)

## Wann verwenden

- Wenn Sie aus einem kurzen Vollmix MIDI-Spuren für Drums, Bass, Melodie oder Vocals gewinnen möchten.
- Wenn Sie nur eine Gesangslinie oder andere einstimmige Melodie aus einem Audioclip transkribieren wollen.
- Wenn Sie einen schnellen MIDI-Entwurf für die weitere Transkription und Bearbeitung in einer DAW benötigen.

## Funktionsweise

- Laden Sie eine MP3-, WAV-, FLAC-, M4A-, OGG- oder AAC-Datei mit einer Länge von höchstens 20 Sekunden hoch.
- Wählen Sie alle Stems, nur Vocals, Melodie oder alles außer Drums zur Transkription aus.
- Das Tool trennt den Mix in Stems und erkennt daraus MIDI-Noten mit einstellbaren Schwellenwerten für Onsets, Frames und Mindestnotenlänge.
- Die ausgewählten Spuren werden in einer gemeinsamen .mid-Datei zusammengeführt; optional enthält sie Pitch-Bend-Daten.

## Anwendungsfälle

- Mehrspurige MIDI-Grundlage für die Analyse eines kurzen Musikmixes erstellen.
- Lead-Gesang oder einstimmige Melodien aus einem Audioclip als MIDI erfassen.
- Drums, Bass und weitere Instrumente für eine manuelle Transkription in getrennten Spuren vorbereiten.

## Häufig gestellte Fragen

### Welche Audiodateien werden unterstützt?

Unterstützt werden MP3, WAV, FLAC, M4A, OGG und AAC.

### Wie lang darf der Audioclip sein?

Der Audioclip darf höchstens 20 Sekunden lang sein.

### Welche MIDI-Spuren kann das Tool erzeugen?

Je nach Auswahl transkribiert es Drums, Bass, sonstige Instrumente und Vocals oder nur die Vocals beziehungsweise Melodie.

### Ist das Ergebnis eine perfekte Transkription?

Nein. Es handelt sich um einen MIDI-Entwurf mit möglichen fehlenden Noten, Zeitversatz und Instrumenten-Übersprechen.

### Was kann ich mit der erzeugten Datei tun?

Importieren Sie die .mid-Datei in eine DAW und überarbeiten Sie die erkannten Noten von Hand.

## Ähnliche Tools

- [Audio-Melodiekontur-Extraktor](https://elysiatools.com/de/tools/audio-melody-contour-extractor): Extrahiert die dominante Melodie und bündelt MIDI, Notenereignisse, Tonhöhenkontur, SVG und JSON in einer ZIP-Datei.
- [Batch-Audio-Konverter](https://elysiatools.com/de/tools/audio-batch-converter): Konvertieren Sie mehrere Audiodateien zwischen verschiedenen Formaten wie MP3, WAV, FLAC, AAC, OGG, Opus mit Qualitätseinstellungen und Stapelverarbeitung
- [Audio-Codec wechseln](https://elysiatools.com/de/tools/audio-codec-swap): Codec eines Audiofiles im gewählten Ausgabeformat ändern
- [Akkordfolgen-Detektor](https://elysiatools.com/de/tools/audio-chord-progression-detector): Schätzt lokal die Akkorde einer Audiodatei und bündelt CSV, JSON, SVG und Methodennotizen in einer ZIP-Datei.
- [Audio-zu-Text Transkriptor (KI)](https://elysiatools.com/de/tools/audio-to-text-transcriber): Transkribiert Sprache aus Audio (wav/mp3/m4a/flac/ogg/webm/aac) in Text, SRT, VTT oder JSON mit grok-stt. Bis 10 Min.
- [Audio-Format-Konverter](https://elysiatools.com/de/tools/audio-converter): Konvertieren Sie Audiodateien zwischen verschiedenen Formaten wie MP3, WAV, FLAC, AAC, OGG mit Qualitätseinstellungen und Lautstärkeanpassung
- [Audio-Resampling](https://elysiatools.com/de/tools/audio-resample): Ändere die Abtastrate des Audios
- [Audiokanäle anpassen](https://elysiatools.com/de/tools/audio-channel-resample): Kanäle ändern (Mono/Stereo), Format beibehalten

## Beispiele

- [FLAC Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/flac-samples): Sammlung verlustfreier FLAC-Audios für Tests und Entwicklung, einschließlich Naturklänge und Meditationsmusik
- [MP3 Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/mp3-samples): Sammlung urheberrechtsfreier Audio-Beispiele zum Testen und Entwickeln, einschließlich Naturklänge, Meditationsmusik und Umgebungsgeräusche
- [WAV Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/wav-samples): Sammlung unkomprimierter WAV-Audios für Tests und Entwicklung, einschließlich Naturklänge und Meditationsmusik
- [M4A Audio-Beispiele ohne Urheberrechte](https://elysiatools.com/de/samples/m4a-samples): Apple iTunes kompatible M4A-Audio-Beispiele, optimiert für Qualität-Dateigröße-Balance

## Verwandte Inhalte

- [Karaoke- und Stem-Separation-Tools](https://elysiatools.com/de/hubs/karaoke-and-stem-separation-tools): Trennen Sie Gesang und Begleitung, bereinigen Sie die Stems, stellen Sie die Balance ein und bereiten Sie eine Karaoke- oder Remix-Lieferung vor.
