跳至主要內容
2026-06-05 · 教學 · 8 分鐘閱讀

同時錄下螢幕、系統音訊與麥克風聲音

你按下錄影、逐步重現這個錯誤、一邊講解怎麼修——結果回放時,本該傳出應用程式聲音的地方卻一片寂靜。點按按鈕明明有聲音,你正在反應的影片明明有配樂,這些通通沒進到檔案裡。只剩你的旁白,飄在一片無聲的畫面上。

這是最常見的螢幕錄影問題,而且原因很明確:大多數免費錄影工具只會開啟你的 麥克風,卻從不擷取電腦實際正在播放的聲音。本指南會說明系統音訊與麥克風音訊的差別、為什麼在 Windows 上擷取系統聲音其實比想像中更困難,以及如何一次乾淨地錄下兩者——收進同一個檔案,完全不必額外安裝任何驅動程式。

系統音訊 vs. 麥克風:兩種完全不同的來源

當大家說「錄螢幕含聲音」時,其實通常同時指兩件不同的事,而錄影工具必須分別處理各自的來源:

  • 麥克風(輸入): 也就是你的聲音。這是簡單的一項。每款錄影工具都能開啟麥克風輸入,跟語音通話用的是同一個音訊串流。
  • 系統/桌面音訊(輸出): 電腦播放 出來 的每一種聲音——你正在示範的應用程式、你正在反應的 YouTube 影片、一通 Zoom 通話、一款遊戲、一聲通知提示音。這是傳向你喇叭或耳機的音訊串流。

麥克風是一種 輸入 裝置,而錄影工具天生就是設計來讀取輸入的。系統音訊則是一種 輸出 ——是離開電腦的聲音——而讀取輸出串流是本質上完全不同的操作。正是這種不對稱,讓「錄電腦聲音與螢幕」難倒了這麼多工具:它們是圍繞著輸入設計的,把輸出當成事後才補上的功能,甚至乾脆略過不做。

為什麼在 Windows 上擷取內部音訊這麼困難

要錄下電腦正在播放的聲音,軟體必須執行一種稱為 迴路(loopback)的操作:它不是去聽麥克風,而是去攫取音訊裝置的 播放(render) 串流——也就是即將送往喇叭、已混音完成的訊號——然後把它複製一份。長久以來,Windows 都把這件事搞得很麻煩。

多年來,唯一的內建選項是 Stereo Mix,這是某些音效卡提供的虛擬錄音裝置。它有時候能用,但許多現代筆電和 USB 耳機根本不提供這個選項。當沒有 Stereo Mix 時,人們就會轉而使用 虛擬音訊線 ——像 VB-Cable 這類軟體會建立一個假的輸出裝置,讓你把系統聲音導進去,再去錄 那個裝置。這方法可行,但要額外安裝,還多了一套你必須正確設定的音訊路由,而且很容易出錯:只要換了輸出裝置,錄影又會變回無聲。

現代而正確的做法是 WASAPI 迴路。WASAPI(Windows Audio Session API)能讓應用程式以迴路模式開啟現有的輸出裝置,直接讀取正在播放的原始音訊——不需要虛擬裝置、不必重新導向、使用者完全不用設定。這套底層機制早就內建在 Windows 裡;問題在於錄影工具必須真的去用它,而許多工具並沒有。

Maxisnap 如何免驅動同時錄下兩者

Maxisnap 會透過 WASAPI 迴路擷取系統音訊,同時錄下你的麥克風,並在預設情況下 將兩者混合成單一音軌 ,讓你聽到的一切——應用程式、影片和你的旁白——就像觀眾預期的那樣融為一體。不必啟用 Stereo Mix、不用安裝虛擬音訊線、不必到處找驅動程式。你一開始錄影,聲音就在那裡。

錄影本身很直覺。兩組快捷鍵,都可以重新設定:

  • Ctrl+Alt+4 ——錄製 全螢幕 (游標所在的螢幕)。
  • Ctrl+Alt+3 ——錄下 選取的區域 ,當你只想擷取部分畫面時使用。

畫面上會出現一個小小的錄影標記,讓你隨時知道正在錄——而且它刻意被排除在自己的擷取範圍之外,所以絕不會出現在影片裡。要停止時,再按一次快捷鍵、按一下 停止 標記上的按鈕,或使用系統匣圖示。

停止後,會開啟一個結果視窗,內含一個嵌入式播放器,還有 儲存複製上傳,以及 拖曳輸出 等按鈕。你可以修剪開頭和結尾,並匯出為 MP4AI 最佳化 MP4GIF,或 WebM ,並可選擇品質預設。在你的電腦支援時,編碼可使用硬體加速(NVENC、Intel QuickSync 或 AMD AMF),否則會自動退回軟體編碼——而且它 ffmpeg 就內建在安裝程式裡,不必再另外下載任何東西。

如果你比較想把人聲和系統聲音分開編輯,也可以把它們保留在 獨立音軌 上,而不混合在一起。對於處理回音、或是你之後想在旁白時壓低應用程式音量的情況,這是最乾淨的做法。

一軌還是兩軌:該怎麼選

預設做法——把系統音訊和麥克風混合成一軌——適合大多數人。它在任何地方都能正確播放、完全不用編輯,也正是你在快速示範、教學或錯誤回報時想要的效果。

選擇 獨立音軌 ,適合你打算把錄影檔匯入剪輯軟體、想要獨立掌控每一軌的情況:例如在你講話時調低應用程式音量、移除某個通知音,或修正同步問題。獨立音軌會讓你多一道步驟(之後要自行混音),換來的是完整的控制權。

常見的失敗狀況——以及如何解決

症狀 可能原因 解決方法
只錄到我的聲音錄影工具擷取了麥克風,卻沒有擷取系統迴路音訊改用支援 WASAPI 迴路擷取的錄影工具(Maxisnap 預設就會擷取——無需設定)
完全沒有聲音麥克風被靜音/選錯裝置,或錄影途中換了輸出裝置確認選對麥克風,並透過迴路直接錄製當前的輸出裝置,而不是使用虛擬音訊線
有系統聲音,卻沒有人聲選錯麥克風,或麥克風權限遭拒選擇正確的輸入裝置,並在 Windows 隱私權設定中授予麥克風存取權限
回音/聲音重疊喇叭播放聲音,麥克風又把它重新錄了一次戴上耳機,或將系統音訊與麥克風錄在獨立的音軌上
聲音逐漸不同步擷取過程中影格率或影音時間軸不一致以穩定的影格率擷取;必要時可在結果視窗中修剪並重新匯出
機械感/劈啪雜音取樣率不一致,或虛擬音訊線的處理鏈負載過重捨棄虛擬音訊線;迴路擷取能乾淨地讀取裝置的原生音訊串流

貫穿以上幾乎所有問題的共同點是:虛擬音訊線和 Stereo Mix 都會增加脆弱又容易出錯的環節。透過迴路直接讀取輸出裝置,就能排除「錄螢幕含內部音訊與麥克風」大部分可能出錯的地方。

關於 Mac 的簡短說明

在系統聲音這件事上,macOS 的情況正好相反。內建工具—— Cmd+Shift+5 和 QuickTime Player——能好好地錄下螢幕和你的麥克風,但它們 無法單靠自己擷取內部音訊。要錄下 Mac 正在播放的聲音,你仍需要 BlackHole 或 Soundflower 之類的驅動程式,並透過整合裝置或多重輸出裝置進行音訊路由。如果你使用的是 Mac,這份 免費 Mac 螢幕錄影指南 會完整說明該如何設定。Maxisnap 的錄影功能目前已在 Windows 上推出;原生 macOS 版本正在積極開發中,你可以要求接獲通知,請至我們的 聯絡頁面

最快錄出真正有聲音的影片的方法

如果你只是想要一段同時收錄應用程式聲音和你旁白的影片,以下就是在 Windows 上的完整流程:

  • 按下 Ctrl+Alt+4 (全螢幕)或 Ctrl+Alt+3 (區域)。
  • 一邊示範一邊講解——系統聲音和你的麥克風都會被錄下,並在預設情況下混合。
  • 再按一次快捷鍵停止。修掉開頭和結尾的空白靜音段落。
  • 匯出為 MP4——或選擇 AI 最佳化 MP4 (約 1280px、24fps、單聲道),得到一個可以直接丟進 ChatGPT、Claude 或 Gemini 的超小檔案。

沒有浮水印、沒有時間限制,而且錄影完全免費。這就是「一段無聲、得重錄的影片」和「一次就把話說清楚的影片」之間的差別。

常見問題

我要如何同時錄下螢幕、系統音訊與麥克風聲音?
使用一款能同時擷取系統迴路音訊和麥克風的錄影工具。在 Maxisnap 中,按下 Ctrl+Alt+4 (全螢幕)或 Ctrl+Alt+3 (區域);桌面音訊會透過 WASAPI 迴路擷取,與你的麥克風一起被錄下,並在預設情況下混合成單一音軌——不需要虛擬音訊線或額外的驅動程式。

為什麼我的錄影只錄到麥克風,卻沒錄到電腦的聲音?
因為那款錄影工具只開啟了麥克風輸入。要擷取電腦播放的聲音,必須對音訊裝置的輸出串流進行迴路錄製。Maxisnap 透過 WASAPI 做到這件事,因此桌面聲音能免驅動地與麥克風一起被錄下。

在 Windows 上,我需要 Stereo Mix 或虛擬音訊線嗎?
不需要。Stereo Mix 表現不穩定,而且在許多現代裝置上根本沒有,而虛擬音訊線則要額外安裝、還得維護音訊路由。Maxisnap 原生就能透過 WASAPI 讀取桌面迴路音訊,所以兩者都不需要。

為什麼我的錄影裡有回音?
因為同一個聲音被錄了兩次——你的喇叭播放它,而你的麥克風又把它收了進來。戴上耳機,或把系統音訊和麥克風錄在獨立的音軌上,這樣你就能在剪輯時把其中一軌靜音或對齊。

含聲音的錄影是免費的嗎?會不會有浮水印或時間限制?
是的——在 Windows 上,含系統音訊和麥克風的錄影是免費的,沒有浮水印、也沒有時間限制。只有當你透過 Maxisnap Cloud 分享錄影、且超出免費額度時,才會用到付費方案;你隨時都可以儲存在本機或自行架設空間。

想看不涉及音訊細節的完整錄影教學?請參閱 如何在 Windows 上免費錄製螢幕,或了解 螢幕錄影與螢幕截圖二合一工具 如何整合在同一款輕量應用程式中。

這次真的能錄下有聲音的螢幕畫面

系統音訊與麥克風一起錄下,不必安裝任何驅動程式。在 Windows 上免費使用。

免費下載 Maxisnap Windows 免費螢幕錄影工具

相關: 免費螢幕錄影工具 · 在 Windows 上錄影 · 在 Mac 上錄影 · 錄影 + 螢幕截圖工具