자막 생성기
음성을 받아 적어 자막 파일을 만듭니다.
이 도구는 JavaScript로 작동합니다. 사용하려면 브라우저에서 JavaScript를 켜고 페이지를 새로 고치세요.
음성을 자막으로.
자막 생성기는 동영상이나 오디오 파일의 음성을 글로 바꿔 시간이 맞춰진 자막 파일로 내줍니다. SRT 출력은 플레이어, YouTube 업로드, 편집 프로그램에서 쓰이고 VTT 출력은 웹 플레이어(HTML5)에서 쓰입니다. 음성 인식에는 OpenAI의 공개 모델 Whisper가 서버에서 돌아갑니다. 터키어를 포함한 16개 언어를 고르거나 언어를 자동으로 감지하게 할 수 있습니다. 자막은 읽기 좋게 다시 나뉩니다. 최대 두 줄, 한 줄에 최대 42자, 최대 6초이며 문장이 끝나는 곳에서 끊깁니다.
녹음은 업로드한 파일에서만 가져오며, 링크나 동영상 주소를 붙여넣는 칸은 없습니다. 오디오는 서버에서 실행되는 Whisper 모델로 받아쓰기되며 외부 서비스로 보내지지 않고 작업이 끝나면 삭제됩니다. 언어를 알고 있으면 고르세요. 자동 감지는 처음 30초를 보므로 섞였거나 잡음이 많은 녹음에서는 틀릴 수 있습니다. “균형” 모델은 대부분의 녹음에 충분하며 작업은 녹음 길이만큼 걸립니다. “최고” 모델은 이름과 전문 용어를 더 정확히 잡지만 3–4배 느리고 10분까지의 녹음에 씁니다. 녹음은 최대 30분이며, 더 길면 먼저 “동영상 자르기” 또는 “오디오 잘라내기”로 나누세요. 결과는 화면에 나타나고 복사할 수 있으며 파일로 내려받습니다. 게시하기 전에 반드시 읽고 고치세요. 고유명사, 전문 용어, 잡음이 많은 부분에서 오류가 가장 많습니다.
처음부터 끝까지
- 동영상 또는 오디오 파일을 업로드하세요. MP4, MOV, MKV, WebM, MP3, WAV, M4A, FLAC… 길이를 읽습니다.
- 언어와 형식을 고르세요. 언어를 알면 선택. 대부분은 SRT, 웹 플레이어는 VTT. 모델: 균형.
- 자막을 내려받으세요. 큐가 화면에 나타나며 복사할 수 있습니다. 파일이 내려받아집니다. 읽고 고친 뒤 게시하세요.
자주 묻는 질문
SRT와 VTT 중 무엇을?
SRT는 가장 흔한 형식입니다. VLC, YouTube, Premiere, DaVinci Resolve 등 대부분의 플레이어가 읽습니다. VTT는 브라우저의 HTML5 video 태그가 요구하는 형식이며 웹사이트에 넣을 거면 VTT를 고르세요. 내용은 같고 표기만 다릅니다.
YouTube 등 링크를 줄 수 있나요?
아니요. 이 도구는 업로드한 파일로만 동작하며, 링크를 붙여넣는 칸은 일부러 없습니다. 다른 서비스의 콘텐츠를 내려받는 것은 그 서비스의 이용약관에 어긋납니다.
얼마나 정확한가요?
깨끗한 녹음(화자 한 명, 가까운 마이크)에서는 “균형” 모델이 대부분의 단어를 맞힙니다. 고유명사, 약어, 전문 용어는 섞일 수 있습니다. 잡음, 먼 마이크, 겹치는 말은 오류를 늘립니다. “최고” 모델은 눈에 띄게 정확하지만 느립니다. 결과를 초안으로 여기고 게시 전에 읽으세요.
파일이 서버에 남나요?
아니요. 파일은 처리를 위해서만 서버로 전송되고 작업이 끝나면 삭제됩니다. 결과 파일도 다운로드한 뒤 도구를 나가면 삭제됩니다. 계정, 이름, 이메일 주소는 필요 없으며 파일이 제3자 서비스로 전송되는 일은 없습니다. 이용은 무료입니다. 처리 횟수에 시간당·일일 한도가 없고, 처리 전에 광고를 볼 필요가 없으며, 결과물에 워터마크를 넣지 않습니다.
다른 오디오 도구
RUPO Studio