使用设备端 AI 语音识别自动生成字幕
了解如何使用 Recorded 的 AI 语音字幕功能,将旁白自动转换为可编辑的样式化字幕,全程无需上传云端。
使用设备端 AI 语音识别自动生成字幕
手动逐字输入字幕是打磨屏幕录制视频时最繁琐的环节之一。Recorded 的 AI 语音字幕功能彻底消除了这种麻烦:它会聆听你的麦克风旁白,自动生成带时间轴的可编辑字幕——全部在本地设备上处理,不会上传到云端。
本指南将介绍这项功能的工作原理、获得最佳效果的方法,以及如何将它融入你的编辑流程。
AI 语音字幕能做什么
只要在录制时开启麦克风,Recorded 就能将你的旁白转录为字幕片段,并直接以带样式的文本形式添加到视频时间轴上。由于转录完全在本地设备上完成,你的音频不会离开电脑——即使旁白中包含敏感或机密信息,也可以放心使用。
前提条件:录制时开启麦克风音频
AI 语音字幕转录的是你的麦克风音轨,而不是系统音频或屏幕上的文字。如果录制时没有开启麦克风,字幕标签页会提示没有可用的麦克风音频,生成功能也会被禁用。
要点: 如果你打算自动生成字幕,请务必在开始录制前打开麦克风开关。
第一步:选择 AI 模型
在编辑器中打开你的录像,切换到字幕标签页。你会看到两个模型选项:
- 快速(Fast)——处理速度更快,适合初稿或较长的录制内容
- 精准(Accurate)——转录准确率更高,适合最终发布的字幕
首次使用某个模型时,需要先下载该模型才能进行转录。下载进度会实时显示,下载完成后该模型会一直可用,之后录制无需重复下载。
第二步:生成字幕
选好模型并完成安装后,点击生成字幕。Recorded 会在后台转录你的旁白,并显示进度。完成后,你会看到一份字幕片段列表,每个片段都带有时间戳和转录文本。
第三步:检查并编辑片段
自动生成的转录文本是很好的起点,但很少是完美的——同音词、产品名称和专业术语常常是语音识别出错的地方。在应用字幕之前:
- 点击任意片段即可就地编辑文本
- 删除不需要的片段(例如口头禅或题外话)
- 留意标记为已排除的片段——这些片段位于你已经剪掉的视频区间内,Recorded 会自动将它们排除在最终结果之外
在应用前逐一检查所有片段可能需要几分钟,但会让成片的专业度明显提升。
第四步:选择应用模式
对字幕满意后,决定它们应如何与时间轴上已有的文字互动:
- 替换(Replace)——移除所有现有文本叠加层,仅应用新的字幕
- 添加(Add)——保留现有文本叠加层,并将字幕添加进去
如果你已经在文本标签页中添加了标题或说明文字,大多数情况下添加是更稳妥的选择。
第五步:设置字幕样式
应用后,字幕会成为时间轴上的普通文本片段,因此你可以像调整其他文本叠加层一样重新设置样式。默认情况下,字幕使用简洁、高对比度的预设样式(半透明深色背景配白色文字,居中显示在画面底部附近),但你可以在文本标签页中自由调整字体、大小、颜色、位置和背景,以匹配你的品牌风格。
获得更干净自动字幕的技巧
字幕质量直接取决于你的旁白,因此稍加准备就能大幅改善结果:
- 说话清晰、语速平稳。 语速过快或口齿不清是转录出错最常见的原因。
- 降低背景噪音。 安静的房间加上一支还不错的麦克风就能显著提升准确率。
- 在思路之间稍作停顿。 自然的停顿能帮助模型在合适的位置切分字幕。
- 最终导出时使用精准模型。 编辑过程中的快速预览则使用快速模型。
- 先剪辑,后生成字幕。 先剪掉失误和静默片段,再生成字幕,可以减少需要检查和丢弃的片段数量。
为什么设备端处理很重要
由于转录在本地完成,AI 语音字幕无需联网也能工作,并能保护你旁白的隐私。对于内部培训视频、包含敏感账户信息的客户操作演示等,你可能并不希望仅仅为了获取文字稿而上传到第三方服务,这项功能正好派上用场。
结语
Recorded 的 AI 语音字幕功能,把过去繁琐耗时的手动步骤变成了生成、检查、应用的快捷流程。搭配文本标签页的样式设置功能,你无需离开编辑器,就能让屏幕录制视频更具无障碍性、也更吸引人。
祝录制愉快!