先區分劇本的前置資料與正文,再建立劇場字幕初稿

為何劇場字幕軟體應先解析劇本,再使用 AI


劇場字幕系統若把角色表誤讀成台詞,問題不會留在解析器裡。錯誤會進入排練,令操作人員無所適從,甚至讓不該出現的文字在現場演出中登上螢幕。

因此,劇場字幕軟體不應先把劇本壓成純文字,再交由 AI 逐行分類。劇本是一份結構化文件;縮排、間距、大小寫、標點與格式,往往與文字本身同樣承載結構。

2026 年 3 月,我們曾從技術角度說明劇本格式為何影響劇場字幕的製作。本文延續這個問題,整理 SurtitleLive 從劇本走向字幕初稿的現行方向。

此後,SurtitleLive 的解析器持續朝更確定、可重現的方式發展。

這一點很重要,因為劇場字幕並不是為靜態文件而生;它們會成為現場操作的字幕提示。解析器若把角色表當成台詞,或把舞台指示當成說出口的文字,錯誤便可能一路進入排練審閱與操作流程。

目前的方向因而十分明確:先讀取文件結構,只在有需要時使用 AI,並隨著更多劇本格式納入測試,持續觀察解析器的表現。

以簡化方式表示,流程如下:

DOCX -> 結構擷取 -> 段落線索 -> 區塊分組 -> 格式類型辨識 -> 正文分區 -> 選擇性 AI 審閱 -> 可編輯的字幕初稿

為何先採用確定性解析

AI 可以協助處理模稜兩可的情況,但現場字幕的準備工作需要可重現性。同一份劇本在同一版本的系統裡,應得到相同的結構判斷;除非系統本身經過有意識的修改。

確定性解析提供了這條基準。它先讀取劇本格式,再把真正困難的區域交給 AI 協助判斷。

對劇場團隊而言,流程不再只是「上傳劇本,期望模型自行理解」。系統會先尋找具體線索:

  • 角色標示
  • 縮排規律
  • 段落間距
  • 舞台指示的格式
  • 冒號、破折號、句點及定位點等分隔方式
  • 扉頁、角色表及製作筆記等前置資料

線索足夠明確時,解析器不必經過 AI 審閱,也能對該區塊作出分類。

一個簡單例子:角色表,還是字幕提示?

請看劇本開頭的一段文字:

角色

哈姆雷特
奧菲莉亞

第一幕

哈姆雷特
    生存,還是毀滅。

逐行交由 AI 判斷時,兩處 哈姆雷特 都可能被看成角色標示。然而,角色表裡的 哈姆雷特 是前置資料;到了劇本正文,它才是引出台詞與字幕提示的角色名。

差別不在這個詞,而在它所處的文件區段。

這正是正文優先分區的價值。解析器會先嘗試把前置資料與可演出的正文分開,再於預期包含台詞的區域套用對白規則,降低角色表、扉頁或製作筆記被誤製成排練字幕的風險。

從劇本走向字幕:現行解析方向

解析器採用分階段流程,而不是把所有工作交給一次 AI 分類。實作細節仍會演進,但幾個核心階段已有清楚原則。

1. 擷取文件結構

處理 .docx 時,SurtitleLive 會讀取結構化文件資料,而不只依賴純文字。這樣可以保留縮排、段落對齊、間距、繼承自 Word 的樣式,以及斜體或粗體等文字片段格式。

這些資訊之所以重要,是因為許多劇本以排版構成文法。置中且全大寫的一行可能是角色名;縮排的一行可能是台詞;斜體的一行可能是舞台指示。先轉成純文字,便可能抹去這些線索。

2. 將段落整理成結構線索

每個段落會整理成一組結構線索,包括該行是否帶有角色前綴、是否置於括號內、是否使用常見於舞台指示的格式,以及大小寫對目前的書寫系統是否具有參考價值。

系統不會把所有劇本都當作英文劇本。若某種書寫系統沒有大小寫之分,相關規則便會降低權重或停用,以免製造虛假的信心。

3. 建立劇本區塊

接著,系統把段落組成劇本區塊。一個區塊可能是說出口的台詞、角色名與其後的台詞、舞台指示、標題,或仍需人工確認的區域。

這一步根據版面與結構,不是文學詮釋。

4. 辨識劇本的版面類型

劇本沒有唯一格式。有些採用 角色:台詞,有些把角色名獨立成行、台詞排在下方;也有些使用句點或破折號,甚至在同一份文件裡混用不同慣例。

因此,SurtitleLive 會先辨識可能的版面類型,再套用相應的解析規則。常見例子包括:

版面類型 常見格式
冒號式台詞 HAMLET: To be張三:今天下雨
角色名獨立成行 HAMLET 下方接一行縮排台詞
句點分隔角色名 AMLETO. Essere o non essere
混合版式 同一劇本的不同區段採用不同慣例
未知或線索不足 前置資料、附錄或難以判定的區域

如此一來,文件若在中途轉換格式,解析器便不必勉強以同一套規則處理全文。

5. 將前置資料與正文分開

許多劇本以扉頁、角色表、註記或製作資訊開頭。即使這些內容不屬於演出正文,在結構上仍可能與台詞相似。

SurtitleLive 透過正文優先分區降低這項風險。解析器嘗試辨認可演出的正文從何處開始,避免前置資料干擾台詞辨識。

6. 只在界線不明的區域使用 AI

AI 仍有其角色。當確定性線索薄弱或互相衝突時,它最能發揮作用。

設計目標並不是從流程中移除 AI,而是不讓 AI 重複判斷已有清楚結構線索的內容。需要 AI 審閱時,應把注意力放在真正難以界定的區域;條件允許時,也應參考同一份文件裡較明確的例子。

從前後次序檢視與修復

有些錯誤只有放回區塊次序裡才會浮現。標題後再接標題,在前置資料中可能合理;在台詞密集的場景裡卻未必如此。只出現一次的角色名,也可能要與反覆出現的角色標示採取不同處理。

SurtitleLive 會從序列層級重新檢視這些判斷。內部的解碼與平滑邏輯會一併考慮相鄰區塊、文件區段及角色線索,而不是把每個段落孤立處理。

這與單純的逐行解析有本質差異。劇本是一份有前後關係的文件;周遭結構往往能幫助判斷某一行是台詞、角色提示、標題,還是應留待審閱的內容。

如何檢查解析器的變更

解析器的變更會先通過精選劇本樣本與迴歸案例,才被視為可以採用。目的很實際:改善一種版式的修改,不應在無聲無息間破壞另一種版式。

檢查會聚焦於這些問題:

  • 原本確認的角色行,是否仍被辨認為角色行?
  • 舞台指示是否仍未混入字幕清單?
  • 前置資料是否仍與可演出的正文分開?
  • 多語言及非英文標點是否仍按預期處理?
  • 難以判定的區塊是否仍可供審閱,而非被過度分類?

這不代表每一份劇本都能一次解析完美。排練稿、掃描後重新輸入的材料、大幅改編文本及格式不一致的文件,彼此可能相差甚遠。人工審閱始終是準備流程的一部分。

這對使用者有何意義

對製作團隊而言,先採用確定性解析,是為了讓劇本準備更可預期。無論是 AI 輔助的劇場字幕、歌劇字幕,或多語言字幕初稿,結構誤判都會增加後續審閱工作。

這套方向有助於 SurtitleLive:

  • 保留 Word 劇本中的版面線索
  • 辨識常見的劇場台詞格式
  • 在結構已清楚時,減少不必要的 AI 詮釋
  • 讓難以判定的區域保持可見,留待審閱
  • 更審慎地處理多語言劇本慣例

實際目標不是全自動化,而是一份較清楚的初稿,讓人能在演出前審閱、修正、翻譯並排練。

對操作人員而言,這意味著減少可避免的錯誤字幕,也讓排練交接更清楚。

對製作人而言,團隊可以少花一些時間在人工重排格式,更早開始檢視字幕初稿。

對無障礙與語言工作者而言,較穩定的劇本結構能提供更清楚的核對基礎,讓翻譯及面向觀眾的字幕在現場傳遞前接受審閱。

這套架構不代表什麼

這套架構有其界線。

它不代表每份劇本第一次都能正確解析。

它不代表系統永遠不使用 AI。

它不代表不同語言、版式或排練稿都具有相同的解析信心。

它也不能取代演出前的人工審閱。

系統更不會停留在目前形態。劇本解析仍是 SurtitleLive 持續密切觀察的部分;隨著更多真實劇本、版式與語言慣例納入測試,規則、審閱門檻、迴歸案例及 AI 交接方式仍會在證據支持下調整。

我們的方向:讓 AI 協助審閱,而非包辦解析

整體架構可以整理如下:

項目 早期方向 現行方向 對使用者的價值
劇本線索 版面分群與 AI 分類 結構化文件擷取,加上確定性線索 劇本匯入結果更可預期
版式處理 以整份文件作較廣泛的假設 按區段與版面類型解析 更能處理混合格式
前置資料 較容易與台詞混淆 先分離正文,再辨識字幕內容 減少角色表或扉頁誤成字幕
AI 的角色 在分類中較為核心 選擇性審閱難以判定的區域 減少不必要的 AI 詮釋
可靠性工作 以啟發式方式修補 迴歸檢查與序列層級審閱 讓解析器的演進更可控

這是一條刻意審慎的路。文件結構已提供較強線索時,現場字幕系統不應只依賴 AI 的信心分數。

AI 很有用,卻不是整個解析器。對 SurtitleLive 而言,更可靠的組合是確定性的劇本結構、針對性的 AI 審閱、人工準備,以及持續觀察解析器的實際表現。

若團隊仍以人工把劇本製成一頁頁投影片,或在排練前逐行重建劇場字幕,SurtitleLive 可以協助把結構化劇本整理成可編輯的字幕初稿,供團隊審閱並用於現場傳遞。進一步資料請見 SurtitleLive 功能頁面從 AI 劇本到劇場字幕


常見問題

問:什麼是確定性劇本解析?
答: 確定性解析依照文件結構套用固定規則,例如縮排、間距、標點與格式。在輸入與解析器版本相同時,應得到相同的結構結果。

問:為何不讓 AI 判斷每一行?
答: AI 可以協助處理界線不明的區域,但許多劇本判斷關乎結構,而非語意。若格式已清楚標示角色、台詞或舞台指示,確定性規則通常更容易重現。

問:AI 能自動製作劇場字幕嗎?
答: AI 可以協助準備初稿;製作團隊仍應在演出前檢查字幕結構、翻譯選擇、時機及觀眾端的傳遞方式。SurtitleLive 把 AI 視為準備流程的一部分,而不是演出審閱的替代品。

問:SurtitleLive 如何把劇本整理成字幕提示?
答: SurtitleLive 讀取文件結構、辨認劇本區塊與可能的版面規律、分開前置資料與可演出的正文,再建立可供審閱的字幕初稿;界線不明的區域可以接受選擇性的 AI 協助。

問:為何 DOCX 格式對劇場字幕重要?
答: 許多劇本以格式表達結構。角色標示、台詞、標題與舞台指示可能透過縮排、間距、大小寫或斜體加以區分;保留這些線索有助於辨認字幕內容。

問:什麼是劇本版面類型?
答: 這是反覆出現的版面規律,例如角色名獨立成行、冒號式台詞,或以句點分隔角色名。辨認這些規律,可以協助解析器為不同區段選擇合適規則。

問:這是否不再需要人工審閱?
答: 不是。SurtitleLive 的目標是提供更清楚的審閱初稿,而非全自動產生最終演出檔案。團隊仍應在演出前審閱字幕、翻譯、時機及觀眾端的傳遞方式。

問:SurtitleLive 會如何持續改善這套系統?
答: 我們會透過迴歸案例、真實劇本格式及製作回饋觀察解析器表現。若出現反覆的不確定性或可避免的錯誤,便可據此調整解析規則、審閱門檻與 AI 交接方式。

相關詞彙