Media
将音乐混音分离为鼓、贝斯、其他、人声、吉他和钢琴,并下载一个 ZIP。
audio-stem-separation-proMedia
检测并调整人声相对伴奏的电平,并返回可解释的响度报告。
audio-vocal-instrumental-balanceMedia
按 preset/CRF/分辨率/帧率投影 SVT-AV1 输出大小、码率和近似 VMAF,并与 libaom、libx265 对比
av1-svt-av1-preset-quality-tunerMedia
把整曲混音拆分为鼓/贝斯/其他/人声,逐轨转成 MIDI——多轨扒谱的起点
audio-to-multitrack-midiMedia
移动音高、共振峰线索和动态,降低简单说话人识别线索并保持时长。
audio-voice-gender-privacy-filterMedia
将 SDR AVIF 的采样精度保存在经过验证的每通道 16 位 PNG 容器中。
avif-to-16bit-pngMedia
标记语音频段音频中可能的声学轮次变化,并导出近似时间线。
audio-speaker-turn-detectorMedia
按可靠静音及可选的带时间戳话题、掌声或音乐提示分割长布道和讲座。
audio-sermon-lecture-splitterMedia
通过电平、信噪分离、混响尾音、高频存在感、削波和语音频段能量估计语音清晰度。
audio-speech-intelligibility-scoreMedia
检测可能的语音频段活动,并将语音/非语音区间导出为 JSON、CSV、SRT 标记或 FFmpeg 剪切列表。
audio-voice-activity-segmentationMedia
按噪声、削波、节奏、时长和一致性对比多条录制,然后排名选出最佳。
audio-voiceover-take-selectorMedia
分析人声问题并建议处理链,同时输出清理前后的音频预览。
audio-voice-cleanup-assistant