一集 Podcast 四十分鐘,對話自然、笑點密、題外話也多。聽覺上舒服,直接做成字幕卻容易變成「一行讀不完、兩行擋畫面」。Podcast 廣東話字幕的關鍵,是把長音檔切成可讀單位,而不是把整段逐字稿貼上影片版。
愈來越多節目同步上 YouTube 或做成短影音切片。沒有字幕,靜音預覽與無障礙都會吃虧;字幕太口語、太長,則閱讀體驗差。先定用途,再定密度。同一集音檔,服務三種產出時,切句規則也要分三種,不要幻想「一份 SRT 通吃」。
長音檔先服務哪一種產出
常見三種:
- 完整集數上影片平台 → 需要全長字幕軌,書面語通常較易跨地區閱讀。
- 做成文字稿/示筆記 → 可刪寒暄,保留論點與時間戳。
- 切 Shorts/Reels → 只要高潮三十秒,字幕必須極短。
同一音檔可以跑一次轉寫,再分岐:全長 SRT 走平台字幕;切片另存短句版本。短句規則見 Reels 字幕長度。YouTube 上載見 YouTube 廣東話字幕。
若節目同時發文章版,.txt 往往比硬讀字幕軌更易編輯。先有校對過的文字,再決定哪些段落值得做成影片章節。長集數也可先出一版「精簡章節字幕」,再按需要補全長軌,避免一開始就對四十分鐘逐句完美主義。
切句比選字體更重要
Podcast 語速不均:有人搶話、有人停頓想稿。自動分段若跟不住,會出現一句跨十五秒,或一秒跳三條。生成後應用「一個意念一條字幕」重聽難段,而不是只調字體。
口語助詞多是節目特色,但寫進字幕要克制。可保留招牌口頭禪,刪掉重覆的「即是」「然後」。風格見 廣東話口語轉書面語。嘉賓英文名、書名、品牌名放進詞庫,見 字幕自定義詞庫。
錄音品質同樣影響切句。兩支咪、距離遠近不一,遠端那一位的句段往往置信度較低——先改這些,再通讀笑點與金句。背景床音樂太大,也會拖累辨識;能分軌就分軌。
CantoSub AI 支援長音訊與影片,智慧分段並可口語轉書面語;Model 2.0 可控制填充詞與俚語。處理一小時大約十四分鐘。格式可出 .srt、.txt 等,方便影音平台或文稿。功能見 CantoSub 2.0。

從完整集數到短片的再利用
有了校對過的字幕,剪輯師較易按關鍵字找段落,而不必整集重聽。切片時不要沿用長片行長:重切、重斷句,再燒錄。中英夾雜討論科技或商業題時,規則見 中英夾雜字幕。
也可把字幕當「內容地圖」:標出可獨立成立的三至五個話題,每段做成一條短片,說明欄再連回完整集數。這樣字幕不只是無障礙配件,而是剪輯索引。
常見問題
問:只有音訊沒有影片可以做字幕嗎? 答:可以。先轉寫與校對,待影片版剪好再對時間碼;或先用音訊產生 SRT,再與畫面校準。
問:雙人節目要不要標講者? 答:對內文稿有用;燒錄字幕未必每句標名字,以免直式畫面更擠。可在章節或說明欄標明嘉賓。
問:一集要校對多久? 答:視音質與專有名詞密度而定。詞庫先做好、風格先選好,通常比逐字從零聽打快得多;難段仍建議人耳覆核。