別再手動對字幕了!6 項更新幫你省下無聊的剪輯苦力活
personJH LAI
calendar_today
為了解決上字幕這些打斷工作節奏的麻煩事,我們推出了這波更新。沒有空泛的技術名詞,只有 6 個能幫你早點下班的實用功能。
別再手動對字幕了!6 項更新幫你省下無聊的剪輯苦力活
剪片最耗損熱情的,往往是上字幕這件事。好不容易錄完一場 Podcast 或多人訪談,丟進編輯軟體後,面對一整串分不清誰是誰的語音辨識稿,只能一句句聽、手動標註角色,接著還要微調那差個幾毫秒就對不上的時間軸。
為了解決這些打斷工作節奏的麻煩事,我們推出了這波更新。沒有空泛的技術名詞,只有 6 個能幫你早點下班的實用功能:
語音辨識與音色處理
- 三個全新的 ASR 模型:我們加入了 Paraformer-zh、Nemotron 和 Qwen 3 ASR 1.7b。如果你常處理中英夾雜的術語,或是講者口齒不清、背景有雜音,這幾個模型能大幅減少你事後「人肉改錯字」的頻率。
- 音色轉換功能:如果覺得原始收音太乾,或是想在影片裡加入不同的旁白角色又請不到配音員,這個功能可以直接把現有的語音轉換成其他音質與語調。
字幕節奏與視覺化編輯
- 字數與字速 (CPS) 分割:傳統的自動字幕常常切出太長或太短的句子,觀眾根本來不及看。現在系統會根據每秒字速(Characters Per Second)自動計算,把字幕切分在視覺最舒適的節點上。
- 視覺化時間軸:不用再盯著「00:01:23.04」這種數字手動輸入微調了。我們把時間軌道視覺化,你想調哪一句,直接用滑鼠拖拉波形邊緣對齊就行,直覺很多。
多人協作與工作流
- 獨立的「演講者」管理:處理多人訪談時,我們幫你把講話的人獨立抽出來放到專屬分頁。你可以一眼看到 Speaker 1、Speaker 2,一鍵就能統一改名,不用在幾百行的文稿裡滑上滑下。
- 引導式工作流(先確認人名,再處理全文):以前整篇丟給 AI 翻譯或優化,最怕它「前一句寫 Gary,後一句翻成蓋瑞」。新的工作流會分兩步走:AI 先找出並鎖定整段音檔裡的「人名」,把這份名冊當作基準後,再去翻譯或優化全文。這能徹底解決長文本裡角色名字前後打架的死穴。
下次剪片,你可以這樣試試:
先把音檔丟進工作流,讓 AI 鎖定人名並把文稿優化好。接著到演講者分頁統一標註角色,並開啟 CPS 分割讓系統自動切好字幕節奏。最後,在時間軸上微調一下波形,套個喜歡的音色,收工。
打開軟體更新,試試看不用手動跟時間軸搏鬥的感覺吧。