使用设备端 AI 语音识别自动生成字幕

了解如何使用 Recorded 的 AI 语音字幕功能,将旁白自动转换为可编辑的样式化字幕,全程无需上传云端。

使用设备端 AI 语音识别自动生成字幕

手动逐字输入字幕是打磨屏幕录制视频时最繁琐的环节之一。Recorded 的 AI 语音字幕功能彻底消除了这种麻烦:它会聆听你的麦克风旁白,自动生成带时间轴的可编辑字幕——全部在本地设备上处理,不会上传到云端。

本指南将介绍这项功能的工作原理、获得最佳效果的方法,以及如何将它融入你的编辑流程。

AI 语音字幕能做什么

只要在录制时开启麦克风,Recorded 就能将你的旁白转录为字幕片段,并直接以带样式的文本形式添加到视频时间轴上。由于转录完全在本地设备上完成,你的音频不会离开电脑——即使旁白中包含敏感或机密信息,也可以放心使用。

前提条件:录制时开启麦克风音频

AI 语音字幕转录的是你的麦克风音轨,而不是系统音频或屏幕上的文字。如果录制时没有开启麦克风,字幕标签页会提示没有可用的麦克风音频,生成功能也会被禁用。

要点: 如果你打算自动生成字幕,请务必在开始录制前打开麦克风开关。

第一步:选择 AI 模型

在编辑器中打开你的录像,切换到字幕标签页。你会看到两个模型选项:

  • 快速(Fast)——处理速度更快,适合初稿或较长的录制内容
  • 精准(Accurate)——转录准确率更高,适合最终发布的字幕

首次使用某个模型时,需要先下载该模型才能进行转录。下载进度会实时显示,下载完成后该模型会一直可用,之后录制无需重复下载。

第二步:生成字幕

选好模型并完成安装后,点击生成字幕。Recorded 会在后台转录你的旁白,并显示进度。完成后,你会看到一份字幕片段列表,每个片段都带有时间戳和转录文本。

第三步:检查并编辑片段

自动生成的转录文本是很好的起点,但很少是完美的——同音词、产品名称和专业术语常常是语音识别出错的地方。在应用字幕之前:

  • 点击任意片段即可就地编辑文本
  • 删除不需要的片段(例如口头禅或题外话)
  • 留意标记为已排除的片段——这些片段位于你已经剪掉的视频区间内,Recorded 会自动将它们排除在最终结果之外

在应用前逐一检查所有片段可能需要几分钟,但会让成片的专业度明显提升。

第四步:选择应用模式

对字幕满意后,决定它们应如何与时间轴上已有的文字互动:

  • 替换(Replace)——移除所有现有文本叠加层,仅应用新的字幕
  • 添加(Add)——保留现有文本叠加层,并将字幕添加进去

如果你已经在文本标签页中添加了标题或说明文字,大多数情况下添加是更稳妥的选择。

第五步:设置字幕样式

应用后,字幕会成为时间轴上的普通文本片段,因此你可以像调整其他文本叠加层一样重新设置样式。默认情况下,字幕使用简洁、高对比度的预设样式(半透明深色背景配白色文字,居中显示在画面底部附近),但你可以在文本标签页中自由调整字体、大小、颜色、位置和背景,以匹配你的品牌风格。

获得更干净自动字幕的技巧

字幕质量直接取决于你的旁白,因此稍加准备就能大幅改善结果:

  1. 说话清晰、语速平稳。 语速过快或口齿不清是转录出错最常见的原因。
  2. 降低背景噪音。 安静的房间加上一支还不错的麦克风就能显著提升准确率。
  3. 在思路之间稍作停顿。 自然的停顿能帮助模型在合适的位置切分字幕。
  4. 最终导出时使用精准模型。 编辑过程中的快速预览则使用快速模型。
  5. 先剪辑,后生成字幕。 先剪掉失误和静默片段,再生成字幕,可以减少需要检查和丢弃的片段数量。

为什么设备端处理很重要

由于转录在本地完成,AI 语音字幕无需联网也能工作,并能保护你旁白的隐私。对于内部培训视频、包含敏感账户信息的客户操作演示等,你可能并不希望仅仅为了获取文字稿而上传到第三方服务,这项功能正好派上用场。

结语

Recorded 的 AI 语音字幕功能,把过去繁琐耗时的手动步骤变成了生成、检查、应用的快捷流程。搭配文本标签页的样式设置功能,你无需离开编辑器,就能让屏幕录制视频更具无障碍性、也更吸引人。

祝录制愉快!