廣東話訪談字幕怎麼做:重疊對白先切開再標講者名

立即體驗 AI 字幕生成

使用 CantoSub AI 為您的影片自動生成專業級字幕

廣東話訪談字幕最怕一句對白找不到主人。茶餐廳裡兩支領夾咪同時亮紅燈:主持人剛問完「所以你當時怎樣決定?」嘉賓搶着說「不是決定,是被逼」。後期把成片丟去自動字,畫面卻出現一句誰都像說過的書面語:「所以你當時不是決定而是被逼」。關聲觀眾截圖轉發時,這句會變成嘉賓的立場,也可能變成主持人的誘導。

廣東話訪談字幕要處理的,不是把口語變得比較像文章,而是先把重疊對白切開,再決定要不要標講者。人名、機構、金句歸屬錯一次,比漏一個「呢」嚴重得多。訪談錄音轉成文稿的做法見廣東話語音轉文字;那篇服務寫稿與質檢。這篇專門服務要上畫面的對談字幕:誰說了哪一句、打斷怎麼標、街訪要不要寫真名。

讀完你應能判斷:這段是附和、打斷還是兩句都要保留;以及 YouTube 軟字幕為什麼不能靠「兩條字幕同一段時碼」來假裝分左右。

廣東話訪談字幕跟會議紀要、Podcast 長音檔差在哪

會議錄音轉文字 要的是決議與待辦,寒暄可以刪。Podcast 廣東話字幕 要的是把四十分鐘切成讀得完的單位。公開訪談還多一層:觀眾會把字幕當引言來源。節目介紹、新聞轉載、品牌合作說明欄,常常直接抄字幕裡那句「金句」。

因此校對順序跟教學片相反。教學片先鎖術語;訪談先鎖歸屬。

高代價錯誤通常只有四類。第一是兩人合成一句:模型把交叉發言焊成通順書面,主語消失。第二是講者標籤張冠李戴:聲線接近、電話延遲、或畫面切到聽的人,字幕仍跟錯嘴。第三是打斷被抹平:嘉賓沒說完的半句被「補完」,聽障或關聲觀眾以為那是完整主張。第四是街訪真名上字幕:口頭同意出鏡,不等於同意把全名寫在可搜尋的軟字幕裡。

驗收標準很具體:靜音重播時,每一句都找得到是誰在說;重疊處不會讀成第三人的總結。聽障友善若還要標笑聲與現場聲,見廣東話無障礙字幕;那是下一層,不要在歸屬未穩時先加一堆方括號。

搶話先分成三類,不要一律「兩行一起出」

現場廣東話對談很少輪流舉手。後期卻常把所有重疊當成同一種技術問題。先分類,切法才不會打架。

附和。 「係呀」「真的」「吓?」不推動話題、也不改對方句子的意思。公開字幕多數可刪,或只在對方句尾留半拍空白,讓節奏仍在。這與填充詞不同:填充詞長在同一人句子裡,見廣東話字幕填充詞;附和是另一張嘴。刪附和時不要把「不是這個意思」一類否定也當附和清掉。

打斷。 一人句子未完,另一人插入新資訊。書面習慣可用省略號表示被截斷,下一條才出插入句。不要把兩半焊成「我本來想說……但其實你說得對」這種模型愛寫的和解句——現場可能根本沒和解。

同時把兩句講完。 兩人資訊都要留(例如同時報價、同時否認)。這時才考慮並排顯示。並排不是預設。直式短片一行空間不夠時,寧可先出鏡頭對準的人、再出另一句,並把第二句的入點貼在第一句讀得完之後。時間軸可讀性見廣東話字幕時間軸

遠端視像訪問再加一條:嘉賓聲比畫面慢半拍時,以聽到的波形對時,不要以嘴型。字幕跟錯嘴,關聲觀眾會以為是主持人代講。

兩人在香港茶餐廳對談,桌上放領夾咪與筆記型電腦,螢幕顯示字幕時間軸

不要用重疊時碼假裝「兩人同時出字」

廣播級字幕可以用左右位置或分色分開講者。YouTube、多數手機播放器,以及你交給客戶的 .srt,行為沒那麼浪漫。

SRT 沒有穩定的多軌規範。兩條字幕時碼重疊時,有的播放器只顯示較後的一條,有的疊在同一位置變成雙行打架,有的在燒錄時後蓋前。你在字幕編輯器預覽「左右分家」,匯出後觀眾只看到一句,這不是檔案壞了,是格式本來就不可靠。WebVTT 的定位標籤在 Studio 上載後也不保證跟桌面播放器一致。

較穩的公開訪談做法:

  1. 一條時碼只服務一個講者的一個意念。 需要兩句都留,就做成先後兩條,中間留極短間隙,避免閃爍。
  2. 講者切換用新的一條,不要在同一條裡塞兩個冒號。 「主持:…… 嘉賓:……」在直式畫面一定讀不完。
  3. 被打斷的半句用省略號收尾,插入句另起。 中文用「……」即可,不必模仿英文字幕的破折號美學;若頻道已用「——」表換人,全片只准一套。
  4. 燒錄精華也不要靠分色當唯一線索。 色弱觀眾與被轉載成靜音截圖的畫面,都讀不到「黃色等於嘉賓」。

客戶若堅持「左右分家」的廣播規格,那是另一份交付、另一個格式(常見是 ASS/特定 VTT 工作流),不要跟 YouTube 軟字幕混成一個檔交差。格式取捨見 SRT 與 FCPXML

三欄圖解:附和可刪、打斷用省略號另起、同時發言改為先後兩條字幕

講者名:畫面已有名牌,街訪先考慮不要寫真名

不是每句都要「陳大文:」。標太多,直式畫面被名字吃掉;標太少,背鏡、電話聲、三人桌會亂。

實用規則:

  • 固定雙人、畫面有名牌、聲線差明顯: 換人時改字幕內容即可,不必每句冠名。新觀眾進場的頭十秒,可標一次角色(「主持」「嘉賓」),其後靠鏡頭。
  • 三人以上、圓桌、觀眾提問: 每次換人標角色或已核對的稱呼。用他們自己報的名字,不要用你場記上的暱稱,除非頻道已公開用那暱稱。
  • 電話、Zoom 入鏡、聲畫不同步: 字幕必須標,因為觀眾無法靠嘴型。
  • 街訪、個案、未成年人: 預設寫「受訪者」或對方同意的化名。口頭「可以拍」不是「可以寫全名進可下載的 SRT」。軟字幕能被搜尋、能被下載,比燒進畫面更難事後抽走。

詞庫只放已確認的寫法:嘉賓全名、機構官方中文、他們要求保留的英文名。不要把「可能是這個字」的近音寫進詞庫——錯一次會全片複製。做法見字幕自定義詞庫

中英夾雜在訪談極常見:「我當時 reject 了那個 offer」。歸屬清楚之後,才套頻道的保留英文或轉中文規則,見中英夾雜字幕。不要為了書面漂亮,把嘉賓堅持用的英文職銜譯走,然後在說明欄又寫回英文——兩套寫法會變成兩個人。

口語轉書面語同樣要等歸屬穩定。半句口語被「補完」成完整書面主張,是訪談最危險的潤飾。風格取捨見廣東話口語轉書面語。金句若要用在封面,必須能對回某一條已校對、已標講者的字幕,而不是後期想出來的摘要。

長訪談軟字幕與精華短片:同一句歸屬,兩種密度

完整集數上 YouTube,用校對過的中文軟字幕,語言標成你頻道慣用的香港/繁中項。上載步驟見YouTube 廣東話字幕。長片可以容忍偶爾標一次講者;關聲觀眾有時間看鏡頭切換。

精華短片、Reels、Shorts 相反:十五秒裡兩次搶話,名字會佔掉賣點。短片策略通常是——只留推動這段高潮的那一張嘴;附和全刪;打斷只留插入後真正被引用的那句。行長見 Reels 字幕長度。不要為了短片「更衝」而改寫嘉賓沒說過的保證或指控;說明欄也要跟母帶同一歸屬。

長短共用一份文字母帶(誰、原意、專名),再分叉顯示層。軟字幕與燒錄的一般取捨見軟字幕與燒錄字幕。精華燒錄前再靜音播一次:字有沒有擋住名牌、有沒有把兩人焊成一句。

轉寫時,能分軌就只丟人聲軌。茶餐廳底噪、杯碟、隔壁桌,會把附和放大成「另一句對白」。嘈雜處理見廣東話語音轉文字遇噪音。模型若提供低信心標記,先聽搶話段,不要從片頭逐句改語氣。出片前用三條問題自檢即可:這句能不能指回畫面裡的一張嘴?被打斷的半句有沒有被模型補完?街訪那一行寫的是角色還是對方沒同意公開的全名?三條都過,才值得調字級與描邊。

CantoSub 可把已確認的嘉賓名與機構名寫進詞庫,並在風格設定處理填充詞與口語轉書面;難段仍要人耳對波形確認是誰在說。功能見 Model 2.0,配額見 收費方案,試用在 註冊頁

常見問題

問:字幕一定要標真名嗎? 答:固定公開嘉賓、對方已在片頭自我介紹,可以用他們報出的名字。街訪、求助個案、未簽署公開姓名的訪問,用角色或化名。軟字幕可被搜尋,比畫面名牌更難事後收回。

問:兩人同時說話,能不能做左右兩行? 答:廣播級或你能控制播放器時可以。YouTube 軟字幕與多數 .srt 流程不要依賴重疊時碼。改成先後兩條,或只保留鏡頭對準的一句。

問:嘉賓一直「係呀」要不要全刪? 答:不改對方意思的附和,公開字幕可刪。若「係呀」其實是在確認一條法律或金錢句子,就要留,並確保歸屬在嘉賓。

問:電話訪問只有一個聲道怎麼辦? 答:先按語意切開,再標「主持」「電話嘉賓」。不要假裝模型能穩定分講者。延遲造成的搶話,以波形為準,不以畫面點頭為準。

問:精華片能不能把兩人的話合成一句更順的文案? 答:不要。合成句會變成第三人轉述,轉發時卻長得像引言。要順,用剪接刪掉其中一句,而不是在字幕裡改寫成沒人說過的句子。

本文由 CantoSub 團隊編寫/審閱;撰稿過程使用 AI 輔助,事實與產品說明以官網為準。

準備開始製作 AI 字幕了嗎?

立即體驗 CantoSub AI,輕鬆為您的影片添加專業級廣東話字幕,讓內容創作更簡單、更有效率。

✨ 無需信用卡 • 30 分鐘免費試用

廣東話訪談字幕怎麼做:重疊對白先切開再標講者名 | CantoSub AI Blog