온디바이스 AI 음성 인식으로 자막 자동 생성하기
Recorded의 AI 음성 자막 기능으로 내레이션을 편집 가능한 스타일 자막으로 자동 변환하는 방법을 알아보세요. 클라우드 업로드는 필요 없습니다.
온디바이스 AI 음성 인식으로 자막 자동 생성하기
자막을 손으로 직접 입력하는 작업은 화면 녹화를 다듬을 때 가장 번거로운 부분 중 하나입니다. Recorded의 AI 음성 자막 기능은 이 번거로움을 완전히 없애줍니다. 마이크 내레이션을 듣고 시간이 맞춰진 편집 가능한 자막을 자동으로 생성하며, 모든 처리는 기기 내에서 이루어져 클라우드로 전송되는 데이터가 없습니다.
이 가이드에서는 이 기능이 어떻게 작동하는지, 최상의 결과를 얻는 방법, 그리고 편집 워크플로에 어떻게 통합할 수 있는지 알아봅니다.
AI 음성 자막이 하는 일
마이크를 켠 상태로 녹화하면 Recorded는 해당 내레이션을 자막 세그먼트로 전사하여 영상 타임라인에 스타일이 적용된 텍스트로 바로 추가할 수 있습니다. 전사가 전적으로 기기 내에서 이루어지므로 음성이 컴퓨터 밖으로 나가지 않아, 민감하거나 기밀 정보가 포함된 내레이션에도 안심하고 사용할 수 있습니다.
사전 조건: 마이크 오디오와 함께 녹화하기
AI 음성 자막은 마이크 트랙을 전사하며, 시스템 오디오나 화면 텍스트는 대상이 아닙니다. 마이크를 켜지 않고 녹화한 경우, 자막 탭에 마이크 오디오가 없다는 안내가 표시되며 생성 기능이 비활성화됩니다.
핵심: 자막을 자동 생성할 계획이라면 녹화를 시작하기 전에 마이크 토글이 켜져 있는지 확인하세요.
1단계: AI 모델 선택하기
에디터에서 녹화본을 열고 자막 탭으로 이동합니다. 두 가지 모델 옵션이 표시됩니다:
- 빠름(Fast) — 처리 속도가 빠르며, 초안 작업이나 긴 녹화에 적합
- 정확함(Accurate) — 전사 정확도가 높아 최종 배포용 자막에 적합
특정 모델을 처음 사용할 때는 전사를 실행하기 전에 모델을 다운로드해야 합니다. 다운로드 진행 상황이 화면에 표시되며, 완료되면 이후 녹화에서도 계속 사용할 수 있어 다시 다운로드할 필요가 없습니다.
2단계: 자막 생성하기
모델을 선택하고 설치를 마쳤다면 자막 생성 버튼을 클릭합니다. Recorded가 백그라운드에서 내레이션을 전사하며 진행 상황을 보여줍니다. 완료되면 타임스탬프와 전사된 텍스트가 포함된 자막 세그먼트 목록이 표시됩니다.
3단계: 세그먼트 검토 및 편집하기
자동 생성된 스크립트는 훌륭한 출발점이지만 완벽하지는 않습니다. 동음이의어, 제품명, 전문 용어는 음성 인식이 흔히 실수하는 부분입니다. 자막을 적용하기 전에 다음을 확인하세요:
- 세그먼트를 클릭하면 텍스트를 바로 편집할 수 있습니다
- 원하지 않는 세그먼트(예: 군더더기 표현이나 곁가지 이야기)는 삭제할 수 있습니다
- 제외됨으로 표시된 세그먼트를 확인하세요. 이미 잘라낸 영상 구간에 해당하는 세그먼트로, Recorded가 최종 결과물에서 자동으로 제외합니다
적용 전에 모든 세그먼트를 검토하는 데는 몇 분이 걸리지만, 완성된 영상의 완성도에서 눈에 띄는 차이를 만듭니다.
4단계: 적용 모드 선택하기
자막이 만족스럽다면 이미 타임라인에 추가한 텍스트와 어떻게 상호작용할지 결정합니다:
- 교체(Replace) — 기존 텍스트 오버레이를 모두 제거하고 새 자막만 적용
- 추가(Add) — 기존 텍스트 오버레이를 유지한 채 자막을 함께 추가
텍스트 탭으로 제목이나 설명 텍스트를 이미 추가했다면 대부분의 경우 추가가 더 안전한 선택입니다.
5단계: 자막 스타일 지정하기
적용된 자막은 타임라인의 일반 텍스트 세그먼트가 되므로, 다른 텍스트 오버레이와 똑같이 다시 스타일을 지정할 수 있습니다. 기본적으로 자막은 깔끔하고 대비가 높은 프리셋(반투명한 어두운 배경 위 흰색 텍스트, 화면 하단 중앙 정렬)을 사용하지만, 텍스트 탭에서 글꼴, 크기, 색상, 위치, 배경을 자유롭게 조정하여 브랜드에 맞출 수 있습니다.
더 깔끔한 자동 자막을 위한 팁
자막 품질은 내레이션에 직접적으로 좌우되므로 약간의 준비만으로도 결과가 크게 달라집니다:
- 명확하고 일정한 속도로 말하기. 서두르거나 웅얼거리는 내레이션은 전사 오류의 가장 흔한 원인입니다.
- 배경 소음 줄이기. 조용한 공간과 괜찮은 마이크만으로도 정확도가 크게 향상됩니다.
- 생각 사이에 잠깐 멈추기. 자연스러운 멈춤은 모델이 적절한 지점에서 자막을 나누는 데 도움이 됩니다.
- 최종 내보내기에는 정확함 모델 사용하기. 아직 편집 중이라면 빠른 미리보기에는 빠름 모델을 사용하세요.
- 먼저 자르고, 그다음 자막 생성하기. 실수와 무음 구간을 이미 잘라낸 뒤에 자막을 생성하면 검토하고 버릴 세그먼트가 줄어듭니다.
온디바이스 처리가 중요한 이유
전사가 로컬에서 이루어지므로 AI 음성 자막은 인터넷 연결 없이도 작동하며 내레이션의 프라이버시를 지켜줍니다. 내부 교육 영상, 민감한 계정 정보가 포함된 고객 안내 영상 등 스크립트를 얻기 위해 굳이 제3자 서비스에 업로드하고 싶지 않은 녹화에 유용합니다.
마치며
Recorded의 AI 음성 자막 기능은 수작업으로 시간이 오래 걸리던 단계를 생성-검토-적용의 빠른 워크플로로 바꿔줍니다. 텍스트 탭의 스타일 옵션과 결합하면 에디터를 벗어나지 않고도 화면 녹화를 더 접근하기 쉽고 더 매력적으로 만들 수 있는 손쉬운 방법입니다.
즐거운 녹화 되세요!