字幕與逐字稿的標點符號及斷句分行有何分別?
Subanana 會因應你選用的處理模式,以不同方式整理文字。以下說明字幕(字幕生成)與逐字稿(逐字稿/會議總結)在標點符號及斷句分行上的處理邏輯,以及如何自行調整。
一、不同模式的文字整理方式不同
逐字稿(逐字稿模式):系統會輸出一段清晰易讀的文字,並支援講者辨識(diarization)。適合訪談、對話、研究錄音等需要完整閱讀的場景。
會議總結:在整理好的逐字稿之上,再加上 AI 撮要,抽取重點、決定及待辦事項。
字幕生成:系統會自動將影片/音訊轉成多語字幕,以「方便閱讀的字幕長度」為目標分行,而非以完整書面段落的形式呈現。
逐字稿與會議總結會自動執行一個整理步驟,把連續的語音歸納成段落,並還原標點符號,令文字更易閱讀;此步驟一律開啟,無需亦無法手動切換。字幕生成則不會執行這個段落歸納與標點還原的步驟,而是以字幕分行為主。
因此,同一段語音在「字幕」與「逐字稿」兩種模式下的呈現方式(包括分行、標點與文字整理)會有所不同,這是各模式設計上的分別,並非錯誤。
二、字幕為何會出現「兩句並成一句」的長行?
字幕生成在轉錄後會經過一個 AI 自動斷句分行流程,目的是把過長的句子切分成方便閱讀的字幕長度。
在大部分情況下,這個流程會把長句自動分成多行。
但這個流程屬於機率性處理,個別句子有機會分行失敗;遇到這情況時,系統會退回顯示未分行的原始結果——這就是你看到「明明是兩句、卻打成一句」的原因。
如何改善過長或未分行的字幕
重新轉錄:在該影片的編輯器中,透過評分提示選擇「不理想」→「字幕遺漏不少內容」,系統會用更適合的設定重新轉寫一次,並再次執行斷句分行流程。此重試不消耗額外時數,多數情況下能改善結果。
在編輯器內手動修改:若重試後個別句子仍未理想,你可以在 Subanana 編輯器內自行把該行拆分(或將相鄰兩行合併)。
請注意,斷句分行屬機率性處理,重試有實際改善機會,但不保證每次都能修正特定句子。
三、有沒有「限制每句字幕字數」的設定?
目前沒有讓你設定「每行字幕字數上限」或「每行秒數」的選項。字幕的分行由上述 AI 自動斷句分行流程處理。如需控制個別字幕行的長度,請在編輯器內自行拆分或合併該行。
四、上載的 SRT 檔案會自動補回標點嗎?
不會。標點還原是逐字稿與會議總結模式在「由音訊轉錄」時所執行的整理步驟,並不會套用於你上載的字幕檔。系統不會對使用者上載的 SRT 重新加上標點。如需為已有的字幕檔調整標點,請在編輯器內自行修改。
五、付費方案與引擎相關事項
免費方案只會生成每個檔案的首 15 分鐘(字幕生成、逐字稿、會議總結等檔案模式),其餘部分不會處理;升級後可在編輯器內以「繼續生成字幕/繼續生成逐字稿」處理同一檔案的餘下部分,只按餘下時長扣減額度,無需重新上載。(即時字幕翻譯的免費試用為一次性、另計的 5 分鐘上限,不會重置。)
若同一段內容的轉錄質素(包括遺漏或文句整理)反覆未如理想,可在建立項目時選用 「高精度」 轉錄引擎,其準確度可能較標準引擎高;此選項會以 1.5 倍 額度計算(影片時長 × 1.5)。
如以上方法仍未解決你的問題,歡迎在應用程式內與我們聯絡,或電郵至 hello@subanana.com,我們會在一個工作天內(星期一至五,香港時間)回覆。
