# Audio a MIDI Multitrack (Borrador)

Separa una mezcla en stems (batería/bajo/otros/voces) y transcribe cada uno a MIDI

> Página canónica: https://elysiatools.com/es/tools/audio-to-multitrack-midi

- **Categoría:** Media

- **Palabras clave:** audio, midi, transcripción, multitrack, demucs, basic-pitch, stems, música

## Descripción general

Solo para pruebas: esta herramienta consume muchos recursos y limita cada opción de stems a clips de hasta 20 segundos. Convierte una mezcla completa en un borrador MIDI multitrack usando dos redes neuronales: HT-Demucs FT (ONNX) separa el audio en batería, bajo, otros instrumentos y voces; luego Basic Pitch de Spotify (TensorFlow.js) transcribe cada stem a notas MIDI. Los stems se ensamblan en un .mid con una pista por instrumento. Es un borrador para transcripción humana, no perfecta: habrá notas omitidas, desfase temporal y sangrado de instrumentos. Importa el resultado en una DAW y límpialo a mano. Corre en Node, sin Python ni GPU.

## Entradas

- **Archivo de audio** (file): Sube un MP3, WAV, FLAC, M4A, OGG o AAC (solo para pruebas; máximo 20 segundos)
- **Stems a transcribir** (select)
- **Sensibilidad de onset** (number)
- **Sensibilidad de frame** (number)
- **Longitud mínima de nota (frames)** (number)
- **Incluir pitch bend** (checkbox)

## Cuándo usarlo

- Cuando necesitas obtener una primera transcripción MIDI a partir de una mezcla de audio.
- Cuando quieres revisar por separado la batería, el bajo, la melodía o las voces.
- Cuando buscas un punto de partida para editar notas y tiempos manualmente en una DAW.

## Cómo funciona

- Sube un archivo MP3, WAV, FLAC, M4A, OGG o AAC de hasta 20 segundos.
- Elige si quieres transcribir todos los stems, solo las voces, la melodía o todo excepto la batería.
- La herramienta separa la mezcla y detecta notas MIDI en cada stem seleccionado.
- Descarga un archivo .mid con una pista por instrumento y corrígelo manualmente.

## Casos de uso

- Crear una base MIDI inicial para analizar una canción corta.
- Extraer una línea vocal o melódica y editarla en una DAW.
- Separar una mezcla breve en pistas de batería, bajo, otros instrumentos y voces para facilitar la transcripción.

## Preguntas frecuentes

### ¿Qué archivos de audio puedo subir?

Puedes subir archivos MP3, WAV, FLAC, M4A, OGG o AAC.

### ¿Cuál es la duración máxima del audio?

El clip puede durar como máximo 20 segundos.

### ¿Qué resultado genera la herramienta?

Genera un archivo .mid con una pista MIDI por cada instrumento o stem transcrito.

### ¿La transcripción es perfecta?

No. Es un borrador y puede contener notas omitidas, desfase temporal y sangrado entre instrumentos.

### ¿Puedo transcribir solo la voz?

Sí. Selecciona “Solo voces” para generar un MIDI centrado en la melodía vocal.

## Herramientas relacionadas

- [Extractor de contorno melódico de audio](https://elysiatools.com/es/tools/audio-melody-contour-extractor): Extrae la melodía dominante y exporta MIDI, eventos de notas, contorno tonal, SVG y JSON en un ZIP.
- [Conversor de Audio en Lote](https://elysiatools.com/es/tools/audio-batch-converter): Convierte múltiples archivos de audio entre diferentes formatos como MP3, WAV, FLAC, AAC, OGG, Opus con configuración de calidad y procesamiento por lotes
- [Cambiar códec de audio](https://elysiatools.com/es/tools/audio-codec-swap): Cambiar el códec dentro de un formato de salida elegido
- [Detector de progresiones de acordes](https://elysiatools.com/es/tools/audio-chord-progression-detector): Estima localmente los acordes de un audio y descarga CSV, JSON, SVG y notas del método en un ZIP.
- [Transcriptor de audio a texto (IA)](https://elysiatools.com/es/tools/audio-to-text-transcriber): Transcribe voz de audio (wav/mp3/m4a/flac/ogg/webm/aac) a texto, SRT, VTT o JSON con el modelo grok-stt. Hasta 10 min.
- [Convertidor de Formato de Audio](https://elysiatools.com/es/tools/audio-converter): Convierte archivos de audio entre diferentes formatos como MP3, WAV, FLAC, AAC, OGG con configuración de calidad y ajuste de volumen
- [Re-muestrear audio](https://elysiatools.com/es/tools/audio-resample): Cambia la frecuencia de muestreo (p.ej., 44.1kHz a 22.05kHz)
- [Reajuste de canales de audio](https://elysiatools.com/es/tools/audio-channel-resample): Cambiar número de canales (mono/estéreo) manteniendo el formato

## Ejemplos

- [Muestras FLAC Sin Derechos de Autor](https://elysiatools.com/es/samples/flac-samples): Colección de audio FLAC sin pérdidas para pruebas y desarrollo, incluyendo sonidos de la naturaleza y música de meditación
- [Muestras MP3 Sin Derechos de Autor](https://elysiatools.com/es/samples/mp3-samples): Colección de muestras de audio sin derechos de autor para pruebas y desarrollo, incluyendo sonidos de la naturaleza, música de meditación y audio ambiental
- [Muestras WAV Sin Derechos de Autor](https://elysiatools.com/es/samples/wav-samples): Colección de audio WAV sin compresión para pruebas y desarrollo, incluyendo sonidos de la naturaleza y música de meditación
- [Muestras M4A Sin Derechos de Autor](https://elysiatools.com/es/samples/m4a-samples): Colección de audio M4A compatible con Apple iTunes, optimizada para balance entre calidad y tamaño de archivo

## Contenido relacionado

- [Herramientas de karaoke y separación de pistas](https://elysiatools.com/es/hubs/karaoke-and-stem-separation-tools): Separa voz y acompañamiento, limpia las pistas, ajusta el balance y prepara una entrega para karaoke o remezcla.
