自動オーディオダッキング

声の下で音楽を自動で下げる

Sonilo のオーディオダッキング API で既存の声のトラックと BGM をミックスし、声を優先したミックスを自動化します。

オーディオダッキング API

既存の声と音楽のトラックをミックスする API ワークフローです。API キーと、対象となる API アクセスが必要です。

ツール

POST /v1/audio-ducking は声のトラックと音楽のトラックを受け付けます。API でファイルまたは公開 URL を送信し、GET /v1/tasks/{task_id} をポーリングしてミックス結果を受け取ります。

オーディオダッキング API のリファレンスを開くPython によるオーディオダッキングのサンプル

先に音楽トラックが必要ですか?

テキストから音楽を生成動画から音楽を生成
長さ声と音楽の長さに合わせる
モデルバージョンSonilo オーディオダッキング

長さ

前景と背景の素材に合わせる

プロンプト

オーディオダッキングには不要

モデルバージョン

Sonilo オーディオダッキング

入力形式

声の音声または動画と、音楽の音声

使い方

用意するものと得られるもの

  1. 01

    API アクセスを取得

    用意するもの
    対象となる API アクセスがある Sonilo アカウント。
    得られるもの
    Sonilo プラットフォームの API キー。
  2. 02

    2つのトラックを送信

    用意するもの
    声のトラックと音楽のトラックを、ファイルまたは公開 URL として POST /v1/audio-ducking に送信。
    得られるもの
    ミックス用のタスク ID。
  3. 03

    ミックスを受け取る

    用意するもの
    タスク ID を使って GET /v1/tasks/{task_id} をポーリング。
    得られるもの
    話し声の下で音楽を下げた、1本のミックストラック。

作例

再生できる Sonilo の生成例

ナレーション用の BGM

プロンプト: 話し声は前に出したまま、セリフの合間で音楽に息をさせる。

再生できる、ダッキングのデモ素材のペア。

ナレーション付き製品デモのミックス

プロンプト: ナレーションの下で BGM を下げ、製品が登場する場面でエネルギーを戻す。

声を優先した音楽のバランスを見せる広告クリップ。

チュートリアルの背景バランス

プロンプト: 説明の間は、背景の音を聞こえる程度に控えめにする。

話し声による説明に合わせた、自動ダッキングを見せる動画。

比較

元の動画、無音、Sonilo の出力

元の動画

参考として、カメラで録った元の音声をそのまま残したクリップです。

無音バージョン

同じクリップを無音にしたもの。タイミングや映像の山場を判断しやすくなります。

Sonilo の出力バージョン

音楽が話し声と映像に合わせてバランスよく調整された、完成した動画のミックス。

活用シーン

こんなワークフローに

話し声の下に音楽を自動で収めたい、ナレーション付きの製品デモ。
ナレーションと BGM があるポッドキャストのクリップ、予告編、SNS 用の動画。
セリフの聞き取りやすさが最優先のチュートリアル、解説動画、講座動画。
声を優先したミックスを安定してつくりたい、一括処理のポストプロダクション。
POST /v1/audio-ducking を呼び出して非同期でミックスを出力する、開発者のワークフロー。

よくある質問

オーディオダッキング 自動

自動オーディオダッキングとは?+

話し声があるときに BGM を下げ、フレーズの合間で戻すことで、ナレーションを聞き取りやすく保つ仕組みです。

オーディオダッキングで新しい音楽は生成されますか?+

いいえ。オーディオダッキングは既存の声と音楽の素材をミックスします。新しい音楽を生成するには、「テキストから音楽」か「動画から音楽」を使ってください。

動画の声のトラックの下で音楽をダッキングできますか?+

Sonilo API は、前景の話し声やセリフと、背景の音楽を入力とする非同期のダッキングワークフローに対応しています。

開発者はどこで自動ダッキングを呼び出しますか?+

POST /v1/audio-ducking を使い、返されたタスクをミックス結果ができるまでポーリングしてください。

音量のキーフレームを手で打たずに、声をクリアに。

声と音楽がすでにあり、自動でミックスしたいときは、Sonilo のオーディオダッキングを使ってください。