使用裝置端 AI 語音辨識自動產生字幕
了解如何使用 Recorded 的 AI 語音字幕功能,將旁白自動轉換為可編輯的樣式化字幕,全程無需上傳雲端。
使用裝置端 AI 語音辨識自動產生字幕
手動逐字輸入字幕是打磨螢幕錄製影片時最繁瑣的環節之一。Recorded 的 AI 語音字幕功能徹底消除了這種麻煩:它會聆聽你的麥克風旁白,自動產生帶時間軸的可編輯字幕——全部在本機裝置上處理,不會上傳到雲端。
本指南將介紹這項功能的運作原理、獲得最佳效果的方法,以及如何將它融入你的編輯流程。
AI 語音字幕能做什麼
只要在錄製時開啟麥克風,Recorded 就能將你的旁白轉錄為字幕片段,並直接以帶樣式的文字形式加入影片時間軸。由於轉錄完全在裝置端完成,你的音訊不會離開電腦——即使旁白中包含敏感或機密資訊,也可以放心使用。
前提條件:錄製時開啟麥克風音訊
AI 語音字幕轉錄的是你的麥克風音軌,而不是系統音訊或畫面上的文字。如果錄製時沒有開啟麥克風,字幕分頁會提示沒有可用的麥克風音訊,產生功能也會被停用。
重點: 如果你打算自動產生字幕,請務必在開始錄製前打開麥克風開關。
第一步:選擇 AI 模型
在編輯器中開啟你的錄影,切換到字幕分頁。你會看到兩個模型選項:
- 快速(Fast)——處理速度較快,適合初稿或較長的錄製內容
- 精準(Accurate)——轉錄準確率較高,適合最終發佈的字幕
首次使用某個模型時,需要先下載該模型才能進行轉錄。下載進度會即時顯示,下載完成後該模型會持續可用,之後錄製無需重複下載。
第二步:產生字幕
選好模型並完成安裝後,點擊產生字幕。Recorded 會在背景轉錄你的旁白,並顯示進度。完成後,你會看到一份字幕片段清單,每個片段都附有時間戳記與轉錄文字。
第三步:檢查並編輯片段
自動產生的轉錄文字是很好的起點,但很少是完美的——同音詞、產品名稱和專業術語常常是語音辨識容易出錯的地方。在套用字幕之前:
- 點擊任一片段即可就地編輯文字
- 刪除不需要的片段(例如贅詞或題外話)
- 留意標記為已排除的片段——這些片段位於你已經剪掉的影片區間內,Recorded 會自動將它們排除在最終結果之外
在套用前逐一檢查所有片段可能需要幾分鐘,但會讓成片的專業度明顯提升。
第四步:選擇套用模式
對字幕滿意後,決定它們應如何與時間軸上既有的文字互動:
- 取代(Replace)——移除所有現有文字疊加層,僅套用新的字幕
- 新增(Add)——保留現有文字疊加層,並將字幕加進去
如果你已經在文字分頁中新增了標題或說明文字,多數情況下新增是較穩妥的選擇。
第五步:設定字幕樣式
套用後,字幕會成為時間軸上的一般文字片段,因此你可以像調整其他文字疊加層一樣重新設定樣式。預設情況下,字幕使用簡潔、高對比的預設樣式(半透明深色背景配白色文字,置中顯示於畫面底部附近),但你可以在文字分頁中自由調整字型、大小、顏色、位置與背景,以符合你的品牌風格。
獲得更乾淨自動字幕的技巧
字幕品質直接取決於你的旁白,因此稍加準備就能大幅改善結果:
- 說話清晰、語速平穩。 語速過快或口齒不清是轉錄出錯最常見的原因。
- 降低背景噪音。 安靜的房間搭配一支還不錯的麥克風,就能顯著提升準確率。
- 在思路之間稍作停頓。 自然的停頓能幫助模型在合適的位置切分字幕。
- 最終匯出時使用精準模型。 編輯過程中的快速預覽則使用快速模型。
- 先剪輯,後產生字幕。 先剪掉失誤與靜音片段,再產生字幕,可減少需要檢查與捨棄的片段數量。
為什麼裝置端處理很重要
由於轉錄在本機完成,AI 語音字幕無需連網也能運作,並能保護你旁白的隱私。對於內部教育訓練影片、包含敏感帳戶資訊的客戶操作示範等,你可能不希望僅僅為了取得逐字稿而上傳到第三方服務,這項功能正好派上用場。
結語
Recorded 的 AI 語音字幕功能,把過去繁瑣耗時的手動步驟,變成產生、檢查、套用的快捷流程。搭配文字分頁的樣式設定功能,你無需離開編輯器,就能讓螢幕錄製影片更具無障礙性、也更吸引人。
祝錄製愉快!