靜音不是「音量歸零」,配樂也不是「把音樂疊上去」那麼簡單。兩條音頻混合時,人聲和音樂應該各自佔據哪個「音量層」?
視頻中的音頻軌道
一個視頻文件通常包含至少兩條數據流:視頻流和音頻流。音頻流記錄了視頻中的聲音資訊,包括語音、音樂、環境音等。理解音頻軌道的概念是進行音頻操作的基礎。
音頻軌道的基本屬性
| 屬性 | 說明 | 常見值 |
|---|---|---|
| 採樣率 | 每秒採集聲音樣本的次數 | 44100 Hz, 48000 Hz |
| 聲道數 | 音頻通道的數量 | 單聲道(1)、立體聲(2)、5.1環繞聲(6) |
| 位深度 | 每個樣本的精度 | 16-bit, 24-bit, 32-bit |
| 編碼格式 | 音頻壓縮算法 | AAC, MP3, Opus, FLAC |
靜音:去除視頻中的聲音
什麼是靜音?
靜音(Mute)是指將視頻中的音頻軌道完全移除,使輸出視頻只有畫面沒有聲音。這與將音量調為零不同——靜音是物理上刪除音頻數據,而音量調節只是降低播放響度。
為什麼要靜音?
- 替換音頻:去除原始聲音後,可以添加新的背景音樂或配音。
- 消除噪音:當原始音頻質量很差(風聲、環境噪音)時,直接移除比降噪更簡單有效。
- 社交媒體規範:部分平台自動播放視頻時預設靜音,主動靜音可避免尷尬內容被意外播放。
- 製作 GIF 式視頻:無聲短視頻在社交媒體上廣泛使用,適合純視覺表達。
- 版權規避:原始視頻中的音樂可能有版權問題,移除後可安全使用。
靜音對文件大小的影響
移除音頻軌道通常可以減少 10%-20% 的文件體積。對於碼率較低的視頻,音頻佔比可能更高,移除後體積減少更明顯。
添加音樂:為視頻注入靈魂
背景音樂的作用
音樂是視頻情感表達的核心元素。同一段畫面配上不同的音樂,可以傳達截然不同的情緒:
- 歡快的音樂 → 輕鬆愉快
- 緊張的鼓點 → 懸疑刺激
- 柔和的鋼琴 → 溫馨感人
- 史詩交響 → 宏大壯闘
音頻混合的概念
為視頻添加音樂時,原始視頻可能已有音頻(如語音、環境音)。這時需要將兩條音頻混合(Audio Mixing):
- 原始音頻:保留語音和環境音,音量通常保持不變或略微降低。
- 背景音樂:添加的音樂,音量通常調低至原始音頻的 10%-30%,作為陪襯不喧賓奪主。
混合時需要注意: - 音樂不應蓋過語音,人聲清晰度優先。 - 音樂的節奏和情緒應與畫面內容匹配。 - 音量變化應平滑過渡,避免突然的音量跳變。
音頻淡入淡出
- 淡入(Fade In):音樂從靜音逐漸增大到目標音量,避免突然出現的聲音衝擊。
- 淡出(Fade Out):音樂從目標音量逐漸減小至靜音,避免突然中斷。
淡入淡出的時長通常為 1-3 秒,具體取決於音樂的風格和節奏。
閃避(Ducking):自動的音量禮讓
在有人聲的視頻中,專業做法是閃避(Ducking,又稱側鏈壓縮):當檢測到語音出現時,自動把背景音樂壓低 6-12 dB;語音停頓時,音樂再緩緩回升。這樣既能保留音樂的氛圍感,又能讓人聲始終清晰可辨——是播客、Vlog、廣告配音的標準技巧。手動實現閃避,可以按語音段落把音樂切成若干段,分別設置較低的音量。
響度匹配:混音前的基本功
原始視頻的聲音和待添加的音樂往往「天生響度不同」:直接混合,不是音樂蓋過人聲,就是人聲顯得突兀。正確順序是:
- 先把兩條音頻的響度(而非峰值)調整到相近水平;
- 再按內容需要,把音樂相對人聲中下移(音樂約低 10-20 dB 作為陪襯);
- 最後整體檢查輸出響度是否符合目標平台標準(視頻平台參考約 -14 LUFS)。
響度與 LUFS 的詳細原理,可參閱本系列《音量、增益與響度》一文。
多軌混音的層次感
兩條以上音頻混合時,需要考慮聲音的前中後層次。一個典型的視頻音軌通常包含三層:
| 層次 | 內容 | 音量參考 | 作用 |
|---|---|---|---|
| 前景 | 人聲(配音/對白) | 0 dB(基準) | 傳遞核心資訊,最優先 |
| 中景 | 環境音/現場收音 | 約 -6 至 -12 dB | 營造臨場感,讓畫面「真實」 |
| 背景 | 背景音樂 | 約 -10 至 -20 dB | 烘托情緒,不引人注意 |
三層之間通過頻率錯開避免「打架」:人聲的中頻(約 300 Hz - 3 kHz)需要保持清晰,而背景音樂可以適度削減這個頻段(EQ 側鏈),讓人聲「穿透」過去。這也是專業混音中頻率遮蔽(Frequency Masking)的核心概念——當兩個聲音佔據相同的頻率範圍時,人耳難以同時分辨它們。
音頻時長與視頻時長的匹配
當添加的音樂比視頻長時,通常截取音樂的前段與視頻等長。當音樂比視頻短時,可以選擇:
- 循環播放音樂(可能產生明顯的重複感)
- 只在有音樂的時段播放,剩餘部分靜音
- 選擇更長的音樂素材
常見音頻格式
| 格式 | 特點 | 適用場景 |
|---|---|---|
| MP3 | 有損壓縮,兼容性極佳 | 通用背景音樂 |
| AAC | 有損壓縮,比 MP3 更高效 | 視頻內嵌音頻 |
| WAV | 無壓縮,音質最佳 | 專業音頻製作 |
| OGG | 開源有損格式 | Web 應用 |
| FLAC | 無損壓縮 | 高品質音樂存檔 |
| M4A | AAC 的容器格式 | Apple 生態 |
音樂版權實用指南
為視頻添加音樂時,版權是最容易被忽視但後果最嚴重的問題。以下是最實用的幾條原則:
什麼音樂能用
| 音樂類型 | 能否商用 | 是否需要署名 | 典型來源 |
|---|---|---|---|
| 公共領域(Public Domain) | ✅ 可以 | ❌ 不需要 | 古典音樂(貝多芬、莫札特等,注意錄音版本有獨立版權) |
| CC0(Creative Commons Zero) | ✅ 可以 | ❌ 不需要 | Free Music Archive、ccMixter |
| CC BY(署名許可) | ✅ 可以 | ✅ 需要註明作者 | 各類開放音樂平台 |
| 非商用許可(NC) | ❌ 不可以商用 | ✅ 需要註明 | 大量免費音樂網站 |
| 商用免版稅音樂 | ✅ 可以 | 視協議而定 | Epidemic Sound、Artlist、AudioJungle |
| 流行歌曲 | ❌ 不可以 | 不適用 | 需向版權方購買同步授權(Sync License) |
最常見的版權誤區
- 「在音樂平台買了就能用於視頻」:你購買的只是個人收聽權,不包含視頻配樂的同步授權(Sync License)。用 Spotify 上的一首歌作為視頻背景音樂,屬於侵權。
- 「只要標註出處就可以」:版權是「授權」問題,不是「署名」問題。未經許可使用,即使標註了來源,仍然侵權。
- 「YouTube 上有別人用的音樂我也可以用」:別人用不代表你可以用,且平台的內容識別系統(Content ID)會獨立檢測你的視頻。
- 「30 秒以內的片段沒關係」:法律上沒有「短片段免責」的規定,版權方仍可主張權利。
安全選擇建議
- 個人非盈利視頻:選擇 CC0 或 CC BY 許可的音樂
- 商業視頻:購買商用免版稅音樂庫訂閱(如 Epidemic Sound、Artlist),年費通常幾百元,遠低於一次侵權索賠
- 純語音內容(播客、教學):使用 AI 生成的背景音樂(如 Mubert、Soundraw)——這些服務生成的音樂版權歸你所有
- 最安全的選擇:自己創作或委託作曲
實用建議
- 靜音前備份:靜音操作不可逆,確保有原始文件備份。
- 音樂版權:優先使用 CC0 或商用免版稅音樂庫,不要使用流行歌曲。
- 音量平衡:添加音樂後試聽,確保語音清晰、音樂不突兀。人聲應始終是音軌中最突出的元素。
- 淡入淡出:始終為添加的音樂設置淡入淡出,提升聽感。淡入時長建議 1-2 秒,淡出 2-3 秒。
- 格式選擇:優先使用 AAC 或 MP3 格式添加音樂,確保兼容性。避免使用 WAV 等無損格式作為背景音樂——文件大小增加明顯,但音質收益在背景音樂中幾乎不可感知。
- 多平台檢查:在不同設備(手機外放、耳機、電腦音箱)上試聽混音效果。手機外放時背景音樂可能蓋過人聲,建議在手機外放環境下再驗證一次人聲清晰度。