自动音频闪避

人声出现时自动压低音乐

通过 Sonilo 音频闪避 API 混合现有的人声音轨和背景音乐,自动完成以人声为主的混音。

音频闪避 API

用 API 混合现有人声和音乐音轨的工作流。需要 API 密钥和符合条件的 API 权限。

工具

POST /v1/audio-ducking 接收一条人声音轨和一条音乐音轨。通过 API 提交文件或公开 URL,再轮询 GET /v1/tasks/{task_id} 获取混音结果。

查看音频闪避 API 文档音频闪避 Python 示例

还没有音乐?

用文字生成音乐给视频配乐
时长匹配人声和音乐时长
模型版本Sonilo 音频闪避

时长

匹配前景和背景素材

提示词

音频闪避不需要

模型版本

Sonilo 音频闪避

输入格式

人声音频或视频,加音乐音频

使用步骤

你提供什么,得到什么

  1. 01

    获取 API 权限

    你提供
    一个具备 API 权限资格的 Sonilo 账号。
    你得到
    Sonilo 平台的 API 密钥。
  2. 02

    发送两条音轨

    你提供
    一条人声音轨和一条音乐音轨,以文件或公开 URL 发送到 POST /v1/audio-ducking。
    你得到
    这次混音的任务 ID。
  3. 03

    获取混音

    你提供
    用任务 ID 轮询 GET /v1/tasks/{task_id}。
    你得到
    一条混好的音轨,说话时音乐会压低。

示例

可直接播放的 Sonilo 生成结果

旁白背景音乐

提示词: 让人声保持在前面,句子之间音乐再起来。

一组可播放的闪避演示素材。

带旁白的产品演示混音

提示词: 旁白时压低背景音乐,揭晓时再恢复能量。

商业视频场景中以人声为主的音乐平衡。

教程背景音量平衡

提示词: 讲解时背景音乐仍能听到,但不抢话。

视频场景中围绕讲解自动闪避。

对比

原片、静音版与 Sonilo 生成版

原视频

原片保留原始拍摄声音,作为参考。

静音版

同一段视频的静音版,方便判断时间点和画面节拍。

Sonilo 生成版

一段完成的视频混音,音乐与人声和画面平衡好。

应用场景

为这类工作流打造

需要音乐自动退到人声下方的带旁白产品演示。
有旁白和背景音乐的播客片段、预告片和社交视频。
以对白清晰为先的教程、讲解视频和课程视频。
需要稳定、以人声为主混音的批量后期流程。
调用 POST /v1/audio-ducking 获取异步混音结果的开发者工作流。

常见问题

自动音频闪避

什么是自动音频闪避?+

自动音频闪避会在有人说话时压低背景音乐,在句子之间再把音乐升回来,让旁白始终清楚。

音频闪避会生成新音乐吗?+

不会。音频闪避混合的是现有的人声和音乐素材。要生成新的背景音乐,请用「文字生成音乐」或「视频配乐」。

能在视频的人声下自动压低音乐吗?+

Sonilo API 支持前景人声或对白输入,以及背景音乐输入,以异步方式完成闪避。

开发者在哪里调用自动闪避?+

调用 POST /v1/audio-ducking,然后轮询返回的任务,直到混音结果就绪。

不用手动打关键帧,也能让人声清楚。

已经有人声和音乐、需要自动混音时,用 Sonilo 音频闪避。