廣東話字幕校對怎麼做:AI 出稿後先改這幾類

立即體驗 AI 字幕生成

使用 CantoSub AI 為您的影片自動生成專業級字幕

AI 已經把廣東話對白轉成字幕草稿,並不代表可以立刻匯出。真正決定觀眾信任感的,往往是之後那二十至四十分鐘的校對:品牌名有沒有寫錯、價錢有沒有聽錯、近音字有沒有「看起來像對」但其實不通。

許多香港創作者的痛點不是「不會生成」,而是生成後不知道先改哪一句。從頭聽到尾、逐行修文采,容易把時間花在填充詞與標點,卻漏掉訂單號或產品型號。廣東話字幕校對若沒有優先序,返工通常出現在出街之後——觀眾截圖指出錯字,才回頭重導 SRT。

本文整理一套可重複的校對流程:先救高代價錯誤,再調語體與斷行,最後才做靜音可讀性檢查。適合已有 AI 草稿、準備匯出進 YouTube、Reels 或剪輯軟件的人。生成步驟見 廣東話字幕生成器;時間軸細節另見 廣東話字幕時間軸

為何「看起來通順」仍不夠

廣東話辨識最常見的陷阱,不是整句亂碼,而是「同音近義、讀起來順口」的錯字。例如把品牌聽成另一個近音詞、把「十」聽成「四」、把英文產品名拆成無意義中文。這類錯誤在快速掃讀時很容易滑過,因為句子語法仍成立。

第二類陷阱是語體錯位。口語轉書面語之後,字面可能更正式,但若斷行仍按口語節奏切,畫面會出現「一句寫得長、觀眾讀不完」的情況。反之,短片若過度書面化,笑點與語氣會變硬。語體原則見 廣東話口語轉書面語

第三類是中英夾雜邊界。meetingdeadline、商場名、SKU 一出現,通用模型較易切錯或硬譯。校對時要把「該保留英文的詞」當成專有名詞同一等級,而不是事後才統一。見 中英夾雜字幕

因此,校對的目標不是把每一句改得像散文,而是:事實正確、用詞一致、靜音也可讀。文采可以後補;事實錯誤不能出街。

先建立優先序,不要線性聽打

有效的廣東話字幕校對,建議固定四層優先序:

  1. 專有名詞:品牌、人名、地名、產品型號、活動名稱。
  2. 數字與時間:價錢、日期、時段、數量、訂單/追蹤號碼。
  3. 近音與懶音:同音錯字、懶音造成的近音替換、整句「像對但不通」。
  4. 語體與斷行:書面語/俚語取捨、填充詞、一行字數與停留時間。

這個順序的原因很實際:前兩類出錯,會直接傷害信任或造成客服爭議;後兩類影響觀感,但仍可在事實正確後再收斂。若時間只夠改一次,應把人工放在前兩層,而不是先刪「呢啦啊」。

廣東話字幕校對優先序:專有名詞、數字與時間、近音懶音、語體斷行四步

若平台提供置信度或噪音標記,先只聽低信心句,再抽查高信心句的專有名詞——比由頭到尾線性聽打更快。CantoSub AI Model 2.0 可為段落提供置信度評分,並標記不清楚或有背景噪音的部分,方便把校對時間集中在真正不穩的句子。功能說明見 Model 2.0

第一輪:專有名詞與詞庫批次改

開校對前,先列一張「本集必對」清單:出場人名、品牌全稱與簡稱、產品型號、合作方名稱、常用英文詞。把清單對照草稿做一次搜尋,比逐句聽更有效率。同一品牌若出現三種寫法,先統一,再談其他。

更省事的做法,是在生成前就把這些詞放進自定義詞庫,讓模型優先採用正確寫法。生成後仍要抽查,但返工會少很多。維護節奏見 字幕自定義詞庫

系列片尤其要固定一份主詞庫,不要每集重新發明拼法。觀眾會記得你上集寫「XX Pro」,下集變成另一個近音字——這種錯比偶發標點更傷專業感。

街訪、直播精華、多人搶話時,人名最易錯。對不上的人名,寧可標「受訪者」或重聽該段,也不要留下一個「看起來像人名」的錯字在畫面上。

合作片另加一關:把客戶提供的產品名、禁用寫法、必須保留的英文商標,貼在清單最上方。客戶審片時最常指出的,往往不是標點,而是品牌書寫不一致。提早對齊,比成片後整條重導更省事。

第二輪:數字、價錢與時間戳

數字錯誤的殺傷力高於一般錯字。教學片把步驟「三」寫成「四」、評測片把價錢少一個零、客服培訓片把日期聽錯,都會令字幕失去可信度。這類位置必須對着原片或原音覆核,不要只靠語感。

實務上可這樣做:

  • 用搜尋找出含阿拉伯數字或「萬/千/百」的字幕行,逐條對畫面。
  • 價錢、折扣、限時,優先重聽原句;不确定就回原片畫面核對。
  • 會議或客服類內容,訂單號、電話、地址必須人工確認。電話音質差時,底稿可用,關鍵數字不可免審。相關場景見 廣東話語音轉文字

時間軸上的「時間」也分兩種:字幕進出點,以及對白裡提到的時鐘/日期。前者影響同步,後者影響事實。先鎖事實數字,再調進出點,較少來回改兩次。同步方法見 廣東話字幕時間軸

第三輪:近音、懶音與「通順假象」

完成專有名詞與數字後,才進入近音檢查。重點不是每個字都完美,而是找出「讀起來像、意思卻偏了」的句子。常見訊號包括:

  • 上下文突然不通,但單字都是常用字。
  • 同一概念前後用了兩個近音寫法。
  • 笑聲、音樂、重疊對白後,緊接一句異常華麗或異常空洞的字幕(可能是幻覺句)。

處理方法:把可疑句單獨重聽兩次;仍不穩就縮短字幕覆蓋,或改成較保守的書面表述。噪音環境下,整段硬轉不如先處理人聲再校對,見 廣東話語音轉文字遇噪音

懶音與口音差異會令「n/l」「ng 韻尾」一類對立變模糊。不要假設模型每次都猜對;以語境與系列用詞為準。若某句只是語氣助詞聽不清,短片可刪;長片教學則應重聽補齊關鍵動詞。

第四輪:語體、填充詞與靜音可讀

事實正確之後,才調風格。教學、品牌、企業片偏向書面語;本地娛樂、街訪可保留部分俚語。重點是整條頻道一致,而不是單句最「真」。填充詞「呢、啦、啊」在語音自然,逐字上畫面卻會拖慢閱讀——短片尤甚。取捨見 廣東話字幕填充詞

做完語體後,務必做一次靜音播放:關掉聲音,只看字幕能否跟上鏡頭與節奏。讀不完就切句或縮字;對白已完字幕仍留太久,就收短停留。口語轉書面後句子變長,幾乎一定要重看斷行,不要假設原時間軸仍然合適。

短片(Reels/TikTok/Shorts)額外檢查一行字數與畫面安全區;長片則檢查段落之間是否有過長空白字幕。平台差異見 軟字幕與燒錄字幕

創作者在筆電上校對廣東話字幕,旁邊筆記本寫着專有名詞到近音的檢查順序

何時自己校對夠用,何時应交字幕公司

自己用 AI 草稿加上述四輪校對,適合:單人對白清楚、系列用詞穩定、發佈節奏固定的 YouTube/短片創作者。成本主要是你的時間;品質上限取決於你是否願意覆核高代價錯誤。

較適合找專業字幕或製作公司的情況包括:多語言法務/醫療用語、大量多人搶話又要精準講者標記、客戶合約要求雙人校對、或你完全沒有時間做第二輪覆核。搜「字幕公司」時,重點應問清是否包含專有名詞核對與一次修改,而不是只比較每分鐘單價。

務實折衷是:AI 出母帶 → 你做專有名詞與數字關 → 重要商業片再交外部作語體與多語言。不要把「全交外包」與「全信 AI 免審」當成唯一兩極。

若你需要一條可匯出 SRT/FCPXML、並可調書面語與中英夾雜策略的廣東話工作流,可在 CantoSub 完成生成與初校,再回到 Premiere、Final Cut、CapCut 等軟件調樣式。格式取捨見 SRT 與 FCPXML;方案見 價格。註冊試用:app.cantosubai.com/signup

一套可複用的出街前清單

每次匯出前,用同一張清單過目,比憑感覺「再看一次」可靠:

  1. 本集專有名詞已對清單/詞庫,寫法全片一致。
  2. 價錢、日期、數量、型號已對原片或原音。
  3. 低信心/嘈雜段已重聽;不通順近音句已處理。
  4. 語體符合片種;填充詞已按短片或長片規則收斂。
  5. 靜音播放可讀完;短片一行不太長、長片無怪異長留。
  6. 匯出格式正確(軟字幕上 YouTube,短片多需燒錄)。

把這六步變成頻道 SOP 之後,新人也能接手校對,而不必每次重新發明流程。工具可以換,優先序不應每次重排。

若一星期要出多條短片,可把第一、二輪做成「批次關」:同一天內的幾條片共用詞庫與數字搜尋規則,先清完事實錯誤,再逐條做靜音可讀。語體則按系列模板一次設定,避免每條片重新決定要不要留俚語。直播回放類長素材,則應先切段再套同一清單,見 廣東話直播回放字幕

常見問題

問:AI 準確率標示很高,還需要逐句聽嗎? 答:不需要也不應該逐句同等力度。把力氣放在專有名詞、數字與低信心句;高信心且語境通順的段落抽查即可。標示準確率不能取代你對本集事實的覆核。

問:口語轉書面語之後,要不要整條重對時間軸? 答:至少要靜音重看斷行與停留。書面語通常比口語長,原時間軸常會偏緊。詳細做法見 廣東話字幕時間軸

問:中英夾雜詞應不應該全部譯成中文? 答:按觀眾與片種決定,但同一條片必須一致。品牌與產品英文名通常保留;校對時把它們當專有名詞處理。見 中英夾雜字幕

問:校對要用字幕編輯器還是剪輯軟件? 答:改字與統一用詞,在字幕工具或純文字/SRT 編輯器通常更快;樣式、燒錄、與畫面構圖,才回剪輯軟件。避免在時間軸上逐格改近音字。

問:多長的片子適合一次校對完? 答:按你的專注力切段亦可。先完成高代價錯誤關,再做語體;不要為了「一次過完一小時」而在後半放棄數字核對。

本文由 CantoSub 團隊編寫/審閱;撰稿過程使用 AI 輔助,事實與產品說明以官網為準。

準備開始製作 AI 字幕了嗎?

立即體驗 CantoSub AI,輕鬆為您的影片添加專業級廣東話字幕,讓內容創作更簡單、更有效率。

✨ 無需信用卡 • 30 分鐘免費試用

廣東話字幕校對怎麼做:AI 出稿後先改這幾類 | CantoSub AI Blog