# 音频旋律轮廓提取器

从音频中提取主导旋律，并在一个 ZIP 中导出 MIDI、音符事件、音高轮廓、SVG 和 JSON。

> 标准页面: https://elysiatools.com/zh/tools/audio-melody-contour-extractor

- **分类:** Media

- **关键词:** 旋律提取, 音频转 MIDI, 音高轮廓, Basic Pitch, 音乐转录

## 概述

Spotify Basic Pitch 先生成复音候选音符，再由连续性路径算法选出最可信的主导旋律。若模型对明显单声部信号没有给出可用事件，则使用受限的 YIN/CMNDF 本地回退。混合录音仅能近似分析，独立人声或单一乐器录音最可靠。

## 输入项

- **音频文件** (file)
- **起音阈值** (number)
- **帧阈值** (number)
- **模型最短音符长度（帧）** (number)
- **选中音符最短时长（毫秒）** (number)
- **旋律偏好** (select)
- **包含弯音** (checkbox)

## 适用场景

- 需要把独立人声或单一乐器录音转成可编辑的主导旋律 MIDI 时
- 需要同时导出音符事件、音高轮廓、SVG 与 JSON，便于核对或二次编辑时
- 需要在较轻和声之上追踪一条连续、较可信的主旋律路径时

## 工作原理

- 上传音频文件（如 MP3、WAV、FLAC、M4A、AAC、OGG、OPUS、WebM），并设置起音阈值、帧阈值、模型最短音符长度（帧）和选中音符最短时长（毫秒）。
- Basic Pitch 生成复音候选音符后，连续性路径算法按旋律偏好（平衡、较高声部或较低声部）选出主导旋律；模型对明显单声部没有可用事件时，启用受限的 YIN/CMNDF 回退。
- 可选择是否在结果中包含弯音。完成后下载 ZIP，内含 MIDI、音符事件、音高轮廓、SVG 与 JSON。

## 使用案例

- 把独唱或哼唱草稿转成 MIDI，便于改音高与时值
- 从单一乐器乐句提取音符事件与音高轮廓，用于核对或乐谱草稿
- 在安静和声之上追踪主旋律，导出 SVG 与 JSON 做可视化核对

## 常见问题

### 支持哪些音频格式？

可上传 MP3、WAV、FLAC、M4A、AAC、OGG、OPUS、WebM 等常见音频，单文件上限为 100 MB。

### 下载的 ZIP 里有什么？

主导旋律 MIDI、音符事件、音高轮廓、SVG 与 JSON；示例结果中还包含 README。音符事件与音高轮廓以 CSV 形式提供。

### 混音或带伴奏的录音准吗？

混合录音只能近似分析。独立人声或单一乐器录音最可靠。

### 起音阈值和帧阈值怎么调？

提高起音阈值（默认 0.5）和帧阈值（默认 0.3）可减少弱起音与杂音；降低它们更容易检出轻柔音符。范围均为 0.05–0.95。

### 旋律偏好和弯音分别做什么？

「平衡」不偏向高低声部；「较高声部」或「较低声部」用于在和声中偏向某一音区。勾选「包含弯音」会把滑音写入结果；关闭后 MIDI 更紧凑、更易编辑。

## 相关工具

- [音频和弦进行检测器](https://elysiatools.com/zh/tools/audio-chord-progression-detector): 在本地估算音频中的和弦顺序，并以 ZIP 下载 CSV、JSON、SVG 时间线和方法说明。
- [音频转文字转录器 (AI)](https://elysiatools.com/zh/tools/audio-to-text-transcriber): 用 grok-stt AI 模型将语音(wav/mp3/m4a/flac/ogg/webm/aac)转录为文本、SRT、VTT 或 JSON。最长 10 分钟。
- [音频转多轨 MIDI(草稿)](https://elysiatools.com/zh/tools/audio-to-multitrack-midi): 把整曲混音拆分为鼓/贝斯/其他/人声,逐轨转成 MIDI——多轨扒谱的起点
- [批量音频转换器](https://elysiatools.com/zh/tools/audio-batch-converter): 批量转换多个音频文件格式，支持 MP3、WAV、FLAC、AAC、OGG、Opus，支持质量设置和批量处理
- [音频编码切换](https://elysiatools.com/zh/tools/audio-codec-swap): 在选定输出格式内更换音频编码
- [音频格式转换器](https://elysiatools.com/zh/tools/audio-converter): 在不同音频格式之间转换文件，如 MP3、WAV、FLAC、AAC、OGG，支持质量设置和音量调节
- [音频重采样](https://elysiatools.com/zh/tools/audio-resample): 修改音频采样率（如 44.1kHz 到 22.05kHz）
- [音频剪切工具](https://elysiatools.com/zh/tools/audio-cutter): 从音频文件中剪切和提取音频片段，支持精确的时间选择

## 示例

- [无版权FLAC音频样本](https://elysiatools.com/zh/samples/flac-samples): 用于测试与开发的 FLAC 无损音频样本集合，包含自然声音与冥想音乐
- [无版权MP3音频样本](https://elysiatools.com/zh/samples/mp3-samples): 免费使用和测试的无版权音频样本集合，包括自然声音、冥想音乐和环境音频，适用于测试和开发目的
- [无版权WAV音频样本](https://elysiatools.com/zh/samples/wav-samples): 用于测试与开发的未压缩 WAV 音频样本集合，包含自然声音与冥想音乐
- [无版权M4A音频样本](https://elysiatools.com/zh/samples/m4a-samples): Apple iTunes兼容的M4A音频样本集合，经过优化实现质量与文件大小的平衡

## 相关内容

- [音频编码与格式转换工具](https://elysiatools.com/zh/hubs/audio-convert): 在一个专题里比较音频格式转换、码率调整、采样率转换、编码切换和导出工具，适合交付与归档工作流。
- [JSON 交换与格式翻译工具](https://elysiatools.com/zh/hubs/json-convert): 在一个专题里比较 JSON 与 CSV、YAML、TOML、GraphQL、XML、Markdown、Excel、BSON、EDN 等结构化格式之间的转换工具。
- [音频编辑与清理工具](https://elysiatools.com/zh/hubs/audio-utility): 在一个专题中比较音频裁剪、静音处理、淡入淡出、混音和降噪工具，适合播客、配音和音乐清理流程。
- [JSON 检查、对比与转换工具](https://elysiatools.com/zh/hubs/json-utility): 把 JSON 格式化、差异对比、路径检查、Schema 校验、合并、转换和导出工具集中到一个专题中，适合 API 与数据处理流程。
