SUBLY

SUBLYは動画や音声から字幕を生成・翻訳・編集し、動画内の文字も抽出できるツールです。

WebGPUとローカル保存に対応するデスクトップブラウザーが必要です。

ツールについて

音声から字幕を生成・翻訳し、既存字幕を動画と一緒に確認・修正できます。AIは認識と翻訳に使用し、手動編集には使いません。 2秒間隔で画面を読み取り、連続する同じ内容をまとめます。短時間の表示や小さな文字は見落とす場合があります。画面抽出は最大512MB・2時間、韓国語・英語・中国語・日本語に対応します。

よくある質問

動画や字幕はサーバーに送信されますか?

音声認識と翻訳はこのブラウザー内で処理し、動画・音声・字幕をAIサーバーへアップロードしません。必要なモデルと実行ファイルを取得する際は外部ホストに接続し、IPアドレスなど通常の接続情報が送信されます。

どのファイルを何件追加できますか?

動画または音声を最大10件追加し、1件ずつ処理します。ファイル内の音声コーデックをブラウザーが読み取れる必要があります。無音の動画やGIFだけでは音声字幕を生成できません。

動画と字幕の言語はどう選びますか?

動画の言語には話されている言語、字幕の言語には出力したい言語を選びます。原語字幕は「音声と同じ言語」を選択してください。設定は待機中の作業に適用され、両方を選ぶと生成を開始できます。

開始ボタンが無効なのはなぜですか?

ファイルと2つの言語設定が必要です。AI生成にはWebGPUと必要なGPU機能に対応するブラウザー・機器も必要です。別タブがSUBLYの作業領域を使用中の場合も開始できません。対応状況やロックの案内を確認してください。

どのAIモデルを使っていますか?

ウェブ版はWhisper Turboで音声から原語字幕を生成し、M2M100で選択した言語に翻訳します。ネイティブ版とはモデルが異なるため、結果も異なる場合があります。

翻訳はどのくらい正確ですか?

言語、発音、雑音、文脈によって精度が変わります。音声認識の誤りが翻訳に影響するほか、名前、専門用語、慣用句、否定表現を誤訳する場合があります。動画と照らし合わせて確認し、必要に応じて修正してください。

モデルの保存先と容量は?

このコンピューターの現在のブラウザーに保存します。音声認識は約600MB、翻訳は約632MB、合計約1.23GBです。実行用ファイルと作業領域も使用します。保存済みモデルは再利用しますが、削除やブラウザーの保存領域整理後は再ダウンロードが必要です。

既存字幕の編集と形式の変更はできますか?

「字幕編集」で動画・音声とSRT字幕を読み込み、文章と時間を確認・修正できます。編集結果はSRTまたはASSで保存できます。字幕を映像に焼き込んだMP4の作成にはまだ対応していません。

作業中にページを閉じたり再読み込みできますか?

必要な字幕を先に保存してください。同じタブ内のアプリ切り替えでは保持しますが、再読み込みやページの開き直しで元ファイルとの接続が切れると、リストと復旧記録を初期化します。保存済みAIモデルと作業ファイルの保持は別です。

MP4LYの結果を直接読み込めますか?

MP4LYの結果でダウンロード右側の「字幕を生成」を押すと、MP4がこのアプリのリストに追加されます。言語を選んで生成を開始してください。音声を除いたMP4やGIFから作った無音MP4には認識する音声がありません。