On-device STT

AI 자막 변환기

모델이란?음성을 글자로 바꿔 주는 AI입니다. 이 기기에서만 돌아가며, 모델마다 자막이 나올 때까지 걸리는 시간이 다릅니다. 정확도·최초 다운로드 크기도 함께 달라지고, 한번 받은 모델은 브라우저에 저장되어 다음부터는 더 빨리 열립니다.
자막 만드는 데 걸리는 시간이 보통입니다. 정확도와의 균형이 좋아, 대부분의 영상에 먼저 쓰기 좋습니다.
걸리는 시간보통
정확도보통~좋음
다운로드 크기~145MB
자막 품질은 「빠름」→「기본」→「고품질」순으로 높아집니다. 처음이시면 「기본」부터 시작해 보시면 됩니다.
영상 등록 (한 번에 1개)
영상을 여기로 끌어다 놓거나, 클릭하여 선택mp4 / webm 등 · 등록만 하고, 추출은 아래 버튼으로 시작합니다
[ 대기 ]
영상을 등록한 뒤 「자막 추출」을 눌러 주세요. 처음에는 모델 다운로드로 시간이 더 걸릴 수 있습니다.
  1. 1. 소리 꺼내기영상에서 음성만 분리해 인식용 형식으로 맞춥니다.
  2. 2. 인식 모델 준비처음이면 모델 파일이 받아지며, 다음부터는 저장된 모델을 씁니다.
  3. 3. 음성을 글자로영상 길이와 선택한 모델에 따라 수 분 이상 걸릴 수 있습니다.
  4. 4. 자막 준비미리보기·수정·SRT/VTT 다운로드가 가능합니다.