SUBLY可從影片與音訊產生、翻譯和編輯字幕,也能擷取影片畫面中的文字。
同時選取影片與同名 SRT,即可連結字幕。若只載入影片,請再按「加入字幕」。
此預覽需要支援WebGPU與本機儲存的桌面瀏覽器。
工具說明
將語音辨識成字幕、翻譯字幕,或搭配影片檢查並修改現有字幕。AI用於辨識與翻譯,不用於手動編輯。 每2秒辨識一次畫面,合併連續相同的內容。短暫出現或過小的文字可能遺漏。畫面擷取支援最大512MB、2小時的影片,以及韓文、英文、中文和日文。
影片、音訊與字幕在瀏覽器處理,所需模型於首次使用時下載並儲存。速度依裝置與影片長度而異;專有名詞、雜音與重疊語音可能造成錯誤,請確認結果。
畫面OCR · 在瀏覽器中使用與READLY相同的模型。 PaddleOCR · Apache-2.0 · RapidOCR · Apache-2.0
每2秒辨識一次畫面,合併連續相同的內容。短暫出現或過小的文字可能遺漏。畫面擷取支援最大512MB、2小時的影片,以及韓文、英文、中文和日文。
AI模型儲存在此電腦目前的瀏覽器中。其他瀏覽器或電腦需要另外下載。依需要依序下載模型。產生原文字幕只需語音辨識,翻譯現有字幕只需翻譯模型。刪除模型或瀏覽器清理儲存空間後需重新下載。
- Whisper Turbo · 將語音轉成原文字幕 · 約600MB需要時下載
- M2M100 · 將字幕翻成所選語言 · 約632MB需要時下載
影片、音訊及字幕內容在此瀏覽器中處理,不會為了 AI 處理而上傳至伺服器。下載模型與執行檔時會連線至 Hugging Face 等外部主機,對方會收到 IP 位址等一般連線資訊。模型會儲存在瀏覽器中供後續使用。
- Whisper large-v3-turbo · OpenAI · 語音辨識 · MIT
- M2M100 418M · Meta / Facebook · 字幕翻譯 · MIT
- Transformers.js · Hugging Face · AI 程式庫 · Apache-2.0
- ONNX Runtime Web · Microsoft · 瀏覽器推論引擎 · MIT
以下模型與程式庫依各自的授權條款使用。這些授權並不賦予您所匯入影片、音訊或字幕的使用權。AI 結果可能有誤,請在儲存前確認。
常見問題
影音和字幕會上傳至伺服器嗎?
語音辨識與翻譯在此瀏覽器內處理,不會將影片、音訊或字幕內容上傳至 AI 伺服器。下載所需模型與執行檔時會連線至外部主機,對方會收到 IP 位址等一般連線資訊。
可加入哪些檔案,一次能處理幾個?
工作清單最多可加入 10 個影片或音訊檔,依序一次處理一個。瀏覽器必須能解碼檔案中的音訊。無聲影片或單獨的 GIF 無法產生語音字幕。
影片語言與字幕語言怎麼選?
影片語言請選實際說話的語言,字幕語言則選擇想輸出的語言。只需原文字幕時選「與語音相同」。設定會套用至等待中的工作,兩項都選好才能開始產生字幕。
為什麼開始按鈕無法使用?
需要檔案及兩項語言設定。AI 生成也需要支援 WebGPU 與必要 GPU 功能的瀏覽器和裝置。另一個分頁占用 SUBLY 工作空間時亦無法開始,請確認畫面上的支援或鎖定提示。
使用哪些AI模型?
網頁版使用Whisper Turbo將語音轉成原文字幕,再用M2M100翻成所選語言。原生版使用的模型不同,因此結果可能不同。
翻譯有多準確?
結果會受語言、發音、背景噪音和上下文影響。語音辨識錯誤也可能影響翻譯,姓名、專有名詞、慣用語及否定語氣可能翻錯。請搭配影片檢查字幕,並修改需要調整的部分。
模型儲存在哪裡?需要多少空間?
模型儲存在此電腦目前的瀏覽器中。語音辨識約600MB、翻譯約632MB,合計約1.23GB,另需執行檔案與工作空間。已儲存的模型會重用,但刪除或瀏覽器清理儲存空間後需要重新下載。
能編輯現有字幕及匯出其他格式嗎?
在「編輯字幕」載入影音與 SRT 字幕,即可檢查並修改文字與時間。編輯後可儲存為 SRT 或 ASS。目前尚不提供將字幕永久嵌入畫面的 MP4 輸出。
工作途中可以關閉或重新整理頁面嗎?
請先儲存需要保留的字幕。同一分頁內切換應用程式時會保留工作;重新整理或開啟頁面使原始檔連結中斷後,工作清單與復原記錄會重設。快取的 AI 模型與工作檔案的保留方式不同。
能直接接收 MP4LY 的結果嗎?
在 MP4LY 結果頁按下載右側的「產生字幕」,MP4 就會加入此應用程式的工作清單。請選擇語言後開始生成。移除聲音的 MP4,或從 GIF 製作的無聲 MP4,沒有可辨識的語音。

