문서

자막 생성기 사용 가이드

오디오나 영상에서 시간 자막을 기기에서 생성·편집하고 여러 형식으로 내보냅니다.

미디어를 업로드하지 않고 오디오 또는 영상 파일 하나에서 편집 가능한 자막을 만드세요.

사용 방법

오디오 또는 영상 파일을 추가하고 음성 언어를 선택하거나 자동을 유지합니다.

한 줄 최대 글자 수를 설정하고 자막 생성을 선택합니다.

미디어를 재생하고 자막 위치로 이동해 텍스트와 시작·종료 시간을 편집합니다.

시간 오류가 없어질 때까지 자막을 추가, 분할, 병합, 삭제하거나 전체 시간을 이동합니다.

SRT, WebVTT, 일반 텍스트 또는 JSON으로 다운로드합니다.

지원 형식과 제한

  • 일반적인 WAV, MP3, M4A, AAC, OGG, Opus, FLAC, MP4, MOV, M4V, WebM 파일.
  • 파일당 최대 200MB, 60분.
  • 10분 단위로 처리하며 결과는 최대 자막 10,000개로 제한됩니다.

처음 실행할 때 로컬 FFmpeg, 음성 인식 모델, 음성 활동 감지 모델을 다운로드합니다. 탭을 열어 두세요. 다음 실행부터는 캐시된 자산을 다시 사용할 수 있습니다.

지원 범위와 문제 해결

지원 확장자라도 코덱에 따라 처리할 수 없을 수 있습니다. 디코딩이 실패하면 WAV 오디오나 더 짧은 파일로 시도하세요. FFmpeg 외에 음성 인식·음성 활동 감지 자산을 내려받을 수 있습니다. 자막과 시간 정보는 초안입니다. 겹치는 발화·무음·이름·숫자를 재생하며 확인하고, 잘못된 구간은 수정한 뒤 내보내세요. 자막 파일을 만드는 기능이며 영상에 자막을 입힌 새 동영상을 출력하지 않습니다.

개인정보와 초기 로딩

선택한 입력은 Aiviko 처리 서버로 업로드하지 않고 이 브라우저에서 처리합니다. 페이지·라이브러리·필요한 모델을 내려받을 때는 네트워크를 사용합니다. 캐시가 삭제될 수 있어 완전한 오프라인 실행을 보장하지 않습니다. 사이트의 다른 요청은 개인정보 처리방침을 확인하세요.

관련 도구

빠른 답변과 사양

핵심 작업은 이 브라우저에서 실행됩니다. 시작 전에 지원 형식, 공개된 한도와 필요한 모델 다운로드를 확인하세요.

입력
WAV, MP3, M4A, AAC, OGG, Opus, FLAC, MP4, MOV, M4V 및 WebM
출력
SRT, VTT, txt 및 JSON
처리 위치
이 기기의 브라우저
모델 지원 언어
100 개 언어 — 언어 선택 메뉴 참고
파일당 한도
200 MB
한 번에 처리
1
미디어 길이 한도
60 분
필요 시 모델 다운로드
99 MB
마지막 검증

화면 언어와 모델의 처리 언어는 다릅니다. 언어별 인식·발음 품질은 다르므로 결과를 확인하세요.

On this page