SUBLY

SUBLY는 영상과 음성에서 자막을 생성하고, 번역하고, 편집하거나 영상 속 텍스트를 추출하는 도구입니다.

이 미리보기는 WebGPU와 저장 기능을 지원하는 데스크톱 브라우저가 필요합니다.

도구 안내

음성을 자막으로 인식하고 다른 언어로 번역하거나, 기존 자막을 영상과 함께 확인하며 수정할 수 있습니다. 인식·번역에는 AI를 사용하고 수동 편집에는 사용하지 않습니다. 화면은 2초 간격으로 읽고 연속된 같은 내용은 합칩니다. 짧게 나타난 글자나 작은 글자는 빠질 수 있습니다. 화면 추출은 최대 512MB·2시간이며, 한국어·영어·중국어·일본어를 지원합니다.

자주 묻는 질문

파일과 자막이 서버로 전송되나요?

음성 인식과 번역은 이 브라우저에서 처리하며 영상·음성·자막 내용을 AI 서버로 업로드하지 않습니다. 처음 필요한 모델과 실행 파일을 내려받을 때는 외부 호스트에 연결하며, IP 주소 등 일반적인 접속 정보가 전달됩니다.

어떤 파일을 추가할 수 있고 몇 개까지 처리하나요?

영상 또는 음성 파일을 최대 10개까지 대기 목록에 추가하고 한 번에 하나씩 처리합니다. 파일 내부의 오디오 코덱을 브라우저가 읽을 수 있어야 합니다. 소리가 없는 영상이나 GIF만으로는 음성 자막을 만들 수 없습니다.

영상 언어와 자막 언어는 어떻게 선택하나요?

영상 언어에는 실제로 말하는 언어를, 자막 언어에는 원하는 출력 언어를 선택하세요. 원어 자막만 필요하면 ‘음성과 같은 언어’를 선택합니다. 설정은 대기 중인 작업에 함께 적용되며 두 항목을 선택해야 생성을 시작할 수 있습니다.

시작 버튼이 비활성화되는 이유는 무엇인가요?

파일과 두 언어 설정이 필요합니다. AI 생성은 WebGPU와 필요한 GPU 기능을 지원하는 브라우저·기기에서 실행됩니다. 다른 탭에서 SUBLY 작업 공간을 사용 중인 경우에도 작업할 수 없습니다. 화면의 지원 또는 작업 잠금 안내를 확인하세요.

어떤 AI 모델을 사용하나요?

웹 버전은 음성 인식에 Whisper Turbo, 자막 번역에 M2M100을 사용합니다. 두 모델은 각각 음성을 원어 자막으로 바꾸고, 그 자막을 선택한 언어로 번역하는 역할을 합니다. 네이티브 앱과는 사용하는 모델이 달라 결과도 다를 수 있습니다.

번역 결과는 얼마나 정확한가요?

언어, 발음, 배경 소음과 문맥에 따라 결과가 달라집니다. 음성 인식 오류가 번역에 영향을 줄 수 있으며, 이름·전문 용어·관용 표현이나 부정 표현을 잘못 옮길 수 있습니다. 완성된 자막을 영상과 함께 확인하고 필요한 부분을 수정해 주세요.

모델은 어디에 저장되며 얼마나 필요한가요?

이 컴퓨터의 현재 브라우저에 저장됩니다. 음성 인식은 약 600MB, 번역은 약 632MB로, 둘 다 사용하면 총 약 1.23GB를 다운로드합니다. 실행에 필요한 추가 파일과 작업 공간도 사용합니다. 저장된 모델은 재사용하지만 삭제하거나 브라우저가 저장 공간을 정리하면 다시 다운로드해야 합니다.

기존 자막을 수정하거나 다른 형식으로 저장할 수 있나요?

‘자막 편집’에서 영상·음성과 SRT 자막을 불러와 내용과 시간을 확인하고 수정할 수 있습니다. 편집한 자막은 SRT 또는 ASS로 저장할 수 있습니다. 자막을 영상에 영구적으로 입힌 MP4를 만드는 기능은 아직 제공하지 않습니다.

작업 중 페이지를 닫거나 새로고침해도 되나요?

필요한 자막을 먼저 저장해 주세요. 같은 탭에서 앱을 오가는 동안에는 작업을 유지하지만, 새로고침이나 페이지 재실행으로 원본 파일 연결이 끊기면 대기 목록과 복구 기록을 초기화합니다. 저장된 AI 모델과 작업 파일의 유지 여부는 서로 다릅니다.

MP4LY 결과를 바로 가져올 수 있나요?

MP4LY 변환 결과에서 다운로드 오른쪽의 ‘자막 생성하기’를 누르면 MP4 파일이 이 앱의 대기 목록에 추가됩니다. 언어를 선택한 후 생성을 시작하세요. 소리를 제거한 MP4나 GIF에서 만든 무음 MP4에는 음성 인식으로 만들 자막이 없습니다.