whisper가 영상의 음성을 받아써 자막 파일을 만듭니다. 언어는 자동으로 감지하거나 직접 지정할 수 있습니다.
자막 없는 외국어 영상은 결국 감으로 보게 됩니다.
외국어 영상에 자막이 없으면 내용을 놓치기 쉽습니다. 자막 파일을 따로 구하거나 영상을 외부 서비스에 올리는 대신, 음성을 내 PC에서 직접 자막으로 만들고 원하는 언어로 번역할 수 있습니다.
전사한 자막을 로컬 AI가 한국어를 포함한 13개 언어로 번역합니다. 전사와 번역 모두 기기 안에서 끝납니다.
엔진 설치부터 자막 생성까지
처음 한 번 whisper 엔진과 모델을 설치하고, 원본과 대상 언어를 정한 뒤 영상에 자막 생성을 실행합니다.
AI 자막 엔진을 설치합니다.
설정의 AI 자막 화면에서 whisper 실행 파일과 모델을 내려받습니다. large-v3(정확), medium, small(가벼움) 중 선택하고, GPU가 있으면 CUDA 빌드로 설치됩니다.
원본과 대상 언어를 정합니다.
원본 언어는 자동 감지가 기본이며, 무음이나 인트로에서 오검출이 잦으면 일본어처럼 직접 고정합니다. 대상 언어를 고르면 그 언어로 번역합니다(없음이면 전사만).
자막을 생성합니다.
영상이나 시리즈를 우클릭해 자막 생성을 실행합니다. 진행 화면에 시간, 전사, 번역이 실시간으로 흐르고, 완료되면 자막이 영상 옆에 저장됩니다.
AI 자막의 실제 동작
전사와 번역 모두 로컬 추론이라 Windows와 macOS 데스크톱에서 Pro 라이선스로 제공됩니다.
전사를 끝낸 뒤에 번역해서 whisper와 번역 AI가 GPU를 동시에 물지 않습니다.
번역을 하면 최종 자막은 번역본입니다. 번역 전 원문 자막은 자동으로 정리되고, 번역이 실패하면 원문을 남겨 다시 시도할 수 있습니다.
뷰어에서 자막 목록(시간과 자막)을 열어 원하는 줄을 클릭하면 그 위치로 바로 이동합니다. 재생 중에는 현재 자막이 강조됩니다.
자막은 whisper의 자동 인식 결과라, 음악이나 무음 구간에서는 실제와 다른 문장이 섞일 수 있습니다.
원본 언어 자동 감지는 대개 정확하지만, 도입부가 무음이거나 짧으면 언어를 잘못 잡을 수 있어 필요하면 직접 지정하세요.
시작하기 전에
궁금한 점
영상이 인터넷으로 전송되나요?
아니요. 전사와 번역 모두 내 PC에서 실행됩니다. 다만 whisper 엔진과 모델, 번역 엔진을 처음 설치할 때는 다운로드를 위한 인터넷 연결이 필요합니다.
어떤 whisper 모델을 골라야 하나요?
정확도가 중요하면 large-v3, 속도와 용량이 중요하면 medium이나 small을 권장합니다. GPU가 있으면 큰 모델도 실용적인 속도로 동작합니다.
번역 없이 원문 자막만 만들 수 있나요?
네. 대상 언어를 없음으로 두면 번역 없이 전사 자막만 만듭니다. 시작 언어와 대상 언어가 같아도 번역을 건너뜁니다.
자막 없는 영상,
내 PC에서 직접 만들어 보세요.
LibraryManager를 설치한 뒤 설정의 AI 자막 화면에서 엔진을 준비하고, 영상 우클릭으로 자막 생성을 실행할 수 있습니다.