如何把一堂講座做成雙語字幕與學習手冊

當講座逐字稿裡的每一句話都能帶你回到原本的錄音時刻,它才真正適合繼續利用。一旦這條連結消失,翻譯、學習筆記和搜尋介面即使看起來很精緻,也可能已經悄悄偏離原意。

可靠的做法不是「轉錄、請模型摘要、輸出 PDF」,而是先建立一份小而穩定的事實來源,校對好,再從它產生每一種格式。

先建立來源帳本

轉錄之前,先記下日後很難補回的資料:

  • 原始檔名與檔案雜湊;
  • 時長、語言、講者,以及已知的錄製日期;
  • 錄音由誰擁有,可以如何再利用;
  • 每一份衍生檔案所用的工具與設定;
  • 需要人工確認的人名、引文、公式與專業詞彙。

把原始錄音設為唯讀。逐字稿、翻譯、字幕、預覽片和書籍放在獨立的衍生資料目錄。這樣修改可以回溯,也不會讓某個重新命名的輸出檔意外變成「原件」。

Video2Book 已用這種結構處理實際的講座資料:影音產生帶時間戳的字幕,字幕產生結構化筆記,完成的筆記再產生一般尺寸或口袋版 PDF。重點不在階段有多少,而在每一階段都保留回到來源的路徑。

先校對逐字稿,再翻譯

自動轉錄只能當初稿。顯示時間戳,從頭聽一遍,先把來源語言校正。特別留意:

  • 人名、書名、引文與技術詞彙;
  • 會顛倒論點的否定詞與短詞;
  • 口述的數字、單位、公式與符號;
  • 因停頓而切錯的句子邊界;
  • 講者對前一句所做的修正或限定。

聽不清楚的字先標為待確認,不要用一個看似自信的猜測代替。如果有投影片或講稿,可以用來核對拼寫,但不要悄悄補進講者從未說過的內容。

逐字稿應該好讀,但仍然要是一份逐字稿。改寫過的文章是另一種成果。

按片段對齊語言,不要按段落硬湊

翻譯校對完成的片段,同時保留穩定的片段編號與時間範圍。目標語句可以比原文長或短,但不能只為了讓文字更順,就把下一位講者的意思併進來。

最小的對齊記錄可以只是普通資料:

{
  "segment_id": "seg-0042",
  "start": "00:03:18.240",
  "end": "00:03:24.880",
  "source": "A measurement is not the same thing as an explanation.",
  "target": "測量結果並不等同於解釋。",
  "review": "checked",
  "terms": ["measurement", "explanation"]
}

這份小小的資料契約,比一開始就綁定大型出版系統更有價值。它可以產生 SRT 或 VTT 字幕、雙語網頁、學習手冊,日後也能建立搜尋索引,而不必維護四份彼此分離的文字。

讓字幕和學習手冊共用同一份來源

字幕品質既是編輯問題,也是觀看體驗問題。把字幕放回影片,以正常速度看一遍。翻譯即使文法完美,如果閃得太快、擋住關鍵圖表,或在講者已經換題後才出現,仍然不是好字幕。

LazyEdit 處理帶時間的影音部分;書籍部分則由 PocketPolyglot 把對齊的多語資料轉成小型 TeX 與 PDF 版本。修正內容後,兩種成果都應從已審核的片段資料重新產生,不能各自變成手工修改的分支。

實用的口袋手冊不必重現每一幀畫面。它可以包含:

  • 依講座順序排列的雙語逐字稿;
  • 附時間位置的簡短提綱;
  • 人名與重複詞彙的詞表;
  • 視覺證據重要時選取的少量畫面;
  • 來源與權利說明。

筆記要和講者原話清楚分開。編者新增的定義或解釋,就標成筆記。

只有在證據連結仍然存在時,才加入知識圖譜

片段穩定後,「measurement」這類概念可以擁有翻譯、別名、詞根、定義,以及與其他概念的關係。但最有用的邊往往最簡單:

概念 → 出現於 → 講座片段 → 確切時間範圍

這就是學習包與本地知識庫之間的橋。Local Knowledge Terminal 會把來源編號與位置資訊放在證據旁邊,而不是把生成的卡片當成來源本身。

不要因為已有逐字稿,就推斷出一張龐大的圖。先處理學習者真的會搜尋的詞,並在每一個翻譯或規範化形式旁保留原文。

用「反向跳回去」做品質檢查

最後的檢查很機械,也很有效。從目標語言挑幾個詞,試著逐層往回走:

  1. 在雙語頁面或手冊中搜尋;
  2. 打開相符片段;
  3. 跳到錄音中的那一秒;
  4. 聽見來源語句;
  5. 確認翻譯與筆記仍然表達相同意思。

用人名、數字、否定詞與最重要的主張重複測試。還要查看第一條與最後一條字幕、快速段落、長停頓,以及所有難以辨聽的片段。最後在手冊原本要服務的小螢幕上打開 PDF。能成功編譯的書,不一定就適合閱讀。

一個小型的實際範例

LazyingArt 帶時間文字範例 使用專案自行控制的 30 秒場景,不含客戶素材。它有 15 個帶時間的來源片段、對齊的日文、英文與中文軌、可下載字幕,以及能回到確切秒數的已審核概念連結。來源清單記錄了影音雜湊、時長、各語言軌用途與這份範例的限制。

規模更大的 Leonard Susskind 講座資料庫 則透過字幕、逐字稿、筆記、TeX 與 PDF,展示同一套來源優先方法如何用於整門課程。它是免費教育資料庫,不是客戶成果。

如果你擁有一堂英文講座,想要一份邊界清楚的成品,雙語講座學習包以 USD 250 處理一位主要講者、最長 20 分鐘,以及繁體中文或日文其中一種目標語言。頁面列出實際範例、交付檔案與不包含的範圍;在上傳來源檔或付款之前,會先確認是否適合。

耐用的順序很簡單:保存來源、校正文字、對齊片段、產生格式,並讓每個有用的概念都能找到回到錄音的路。

Leave a Reply