前兩天我整理了為什麼開始研究音訊降噪,以及在做線上去除雜音之前,應該先判斷雜音從哪裡來。今天想記錄一個我自己踩過的坑:去除雜音不是越乾淨越好。
一開始我處理錄音時,心裡只有一個想法:背景聲越少越好。
但實際聽幾次之後會發現,如果降噪太重,人聲反而會變得不自然。
有時候聲音雖然乾淨了,卻像被壓扁一樣,尾音消失、呼吸感不見,甚至出現一點機械感。這種結果放在會議錄音可能還能接受,但如果是教學影片、訪談、Podcast 或旅行影片,就會讓人聽起來很累。
我以前以為音訊降噪的目標是「把背景聲全部消掉」。
後來才發現,比較合理的目標應該是:
讓人聲更清楚,但不要讓聲音失去自然感。
例如冷氣聲、電風扇聲、電腦風扇聲這類穩定底噪,可以適度降低。
但如果把所有環境聲都清得太乾淨,聲音會變得很空,聽起來反而不像真實錄音。
尤其是影片降噪時更明顯。
畫面裡如果人在咖啡廳、車站或街邊,背景完全沒有聲音,其實會有點奇怪。觀眾不一定說得出問題在哪裡,但會覺得聲音跟畫面不太搭。
現在我處理去雜音時,不會只聽「背景有沒有消失」,而是會多聽幾個地方。
很多降噪處理如果太重,最容易影響尾音。
例如一句話最後的「了」、「啊」、「嗯」,會突然變短或被切掉。
這種狀況在短片裡可能不明顯,但長時間聽會很不舒服。
如果處理後人聲變得很尖、很薄,通常代表降噪或 EQ 動得太重。
這時候即使背景變安靜,也不一定是比較好的版本。
我會把原始檔和處理後的檔案交替播放,不只比較雜音,也比較人聲厚度。
有些檔案處理過頭後,背景會出現類似水聲、抖動感,或人聲聽起來像壓縮過的 AI 聲。
這種狀況我通常會退一步,不追求完全安靜。
單獨聽音訊是一回事,放回影片裡又是另一回事。
如果畫面明明在戶外,但聲音像在錄音室,就會不自然。
所以做影片降噪時,我會保留一點環境感,只要不要蓋過人聲就好。
如果是一段需要整理的錄音或影片,我現在大概會這樣做:
我覺得這類工具最方便的地方,是不用先安裝一堆軟體,也不用一開始就理解複雜參數。對於會議錄音、教學影片、訪談素材、手機錄影這些日常檔案來說,先快速做一版線上去除雜音,會比較容易判斷這段素材還值不值得繼續修。
我目前覺得最適合的情境是:人聲本來就清楚,只是背景有干擾。
例如:
這些情況下,去除雜音保留人聲的效果通常比較明顯。
但如果原始人聲太小、距離太遠,或被其他聲音完全蓋住,後製能做的就有限。這時候不要把希望全部放在工具上,重錄或補錄旁白可能更快。
今天這篇想記錄的重點很簡單:去除雜音不是把聲音處理到完全安靜,而是讓人聲更容易被聽清楚。
音訊降噪和影片降噪都一樣,真正重要的是平衡。
背景聲可以少一點,但人聲不能壞掉;聲音可以乾淨一點,但不能失去自然感。
下一篇我想繼續整理:同一段音訊在處理前後,我會怎麼做 AB Test,避免只憑第一印象判斷效果。