自動音訊閃避

人聲出現時自動壓低音樂

透過 Sonilo 音訊閃避 API,把現有的人聲音軌和背景音樂混音,自動完成以人聲為先的混音。

音訊閃避 API

用 API 為現有的人聲和音樂音軌混音。需要 API 金鑰及合資格的 API 存取權限。

工具

POST /v1/audio-ducking 接收一條人聲音軌和一條音樂音軌。透過 API 提交檔案或公開網址,然後輪詢 GET /v1/tasks/{task_id} 取得混音結果。

查看音訊閃避 API 參考文件Python 音訊閃避範例

需要先準備一條音樂?

用文字生成音樂為影片配樂
時長配合人聲及音樂時長
模型版本Sonilo 音訊閃避

時長

配合前景及背景素材

提示詞

音訊閃避不需要提示詞

模型版本

Sonilo 音訊閃避

輸入格式

人聲音訊或影片,加上音樂音訊

使用方法

你要提供甚麼,會得到甚麼

  1. 01

    取得 API 存取權限

    你提供
    一個具備合資格 API 存取權限的 Sonilo 帳戶。
    你得到
    Sonilo 平台的 API 金鑰。
  2. 02

    傳送兩條音軌

    你提供
    一條人聲音軌和一條音樂音軌,以檔案或公開網址傳送到 POST /v1/audio-ducking。
    你得到
    這次混音的任務 ID。
  3. 03

    取回混音

    你提供
    用任務 ID 輪詢 GET /v1/tasks/{task_id}。
    你得到
    一條在說話時壓低音樂的混音音軌。

範例

可即時播放的 Sonilo 成品

旁白背景音樂

提示詞: 讓說話聲保持在前,句與句之間讓音樂透透氣。

一組可播放的音訊閃避示範素材。

有旁白的產品示範混音

提示詞: 旁白時壓低背景音樂,到揭曉時再恢復氣勢。

以商業短片示範以人聲為先的音樂平衡。

教學影片背景平衡

提示詞: 講解時背景音樂仍然聽得到,但不會搶戲。

以影片示範圍繞講解內容的自動音訊閃避。

比較

原片、靜音版及 Sonilo 生成版

原片

原始短片保留相機收錄的原聲,作為參考。

靜音版

同一段片設為靜音,方便判斷時間點和畫面節拍。

Sonilo 生成版

完成的影片混音,音樂與說話聲和畫面取得平衡。

使用場景

為這類工作流程而設

音樂需要自動退到說話聲下面的產品旁白示範。
有旁白和背景音樂的 Podcast 短片、預告片和社交影片。
以對白清晰為首要的教學、解說和課程影片。
需要一致人聲優先混音的批量後期製作流程。
呼叫 POST /v1/audio-ducking 取得非同步混音結果的開發者流程。

常見問題

自動音訊閃避

甚麼是自動音訊閃避?+

自動音訊閃避會在有人說話時壓低背景音樂,句與句之間再把音樂調回,讓旁白保持清晰。

音訊閃避會生成新音樂嗎?+

不會。音訊閃避只為現有的人聲和音樂素材混音。要生成新音樂,請用文字生成音樂或影片配樂。

可以在影片人聲下壓低音樂嗎?+

Sonilo API 支援前景說話聲或對白輸入,以及背景音樂輸入,以非同步方式完成音訊閃避。

開發者在哪裡呼叫自動音訊閃避?+

使用 POST /v1/audio-ducking,然後輪詢返回的任務,直到混音結果準備好。

不用手動打關鍵影格,說話聲也清楚。

已有人聲和音樂、需要自動混音時,就用 Sonilo 音訊閃避。