Media
通过电平、信噪分离、混响尾音、高频存在感、削波和语音频段能量估计语音清晰度。
audio-speech-intelligibility-scoreMedia
检测可能的语音频段活动,并将语音/非语音区间导出为 JSON、CSV、SRT 标记或 FFmpeg 剪切列表。
audio-voice-activity-segmentationMedia
按 ACX/Audible 提交要求验证有声书章节或完整文件:RMS、峰值、本底噪声、时长、格式和章节。
audio-audiobook-acx-validatorMedia
为有声书章节添加 ACX 要求的开头/结尾静音和章节间环境音。
audio-audiobook-room-tone-inserterMedia
从旁白音频及其脚本生成句子或单词级时间戳提示,用于卡拉OK式跟读和语言学习。
audio-read-along-cue-generatorMedia
估算脚本口播时长,可选用语速校准样本。
audio-script-timing-estimatorMedia
匹配主持人/嘉宾(或任意两条人声)之间的响度,同时保留自然动态。
audio-interview-level-matcherMedia
向播客单集插入广告标记:可听提示音、ID3 章节标记和用于程序化广告插入的元数据标签。
audio-podcast-ad-marker-inserterMedia
用侧链压缩自动把音乐底噪压低到人声/对话下方,带片头/片尾淡入淡出模板。
audio-podcast-intro-outro-duckerMedia
从片头音乐、最多 5 个精彩片段、片段下音乐底噪和响度目标组装出短预告片。
audio-podcast-trailer-builderMedia
按噪声、削波、节奏、时长和一致性对比多条录制,然后排名选出最佳。
audio-voiceover-take-selectorMedia
从片段中提取背景环境音/房间底噪,生成任意长度的无缝循环。
audio-ambience-loop-generator