
為何劇場字幕軟體應先解析劇本,再使用 AI
劇場字幕系統若把角色表誤讀成台詞,問題不會留在解析器裡。錯誤會進入排練,令操作人員無所適從,甚至讓不該出現的文字在現場演出中登上螢幕。
因此,劇場字幕軟體不應先把劇本壓成純文字,再交由 AI 逐行分類。劇本是一份結構化文件;縮排、間距、大小寫、標點與格式,往往與文字本身同樣承載結構。
2026 年 3 月,我們曾從技術角度說明劇本格式為何影響劇場字幕的製作。本文延續這個問題,整理 SurtitleLive 從劇本走向字幕初稿的現行方向。
此後,SurtitleLive 的解析器持續朝更確定、可重現的方式發展。
這一點很重要,因為劇場字幕並不是為靜態文件而生;它們會成為現場操作的字幕提示。解析器若把角色表當成台詞,或把舞台指示當成說出口的文字,錯誤便可能一路進入排練審閱與操作流程。
目前的方向因而十分明確:先讀取文件結構,只在有需要時使用 AI,並隨著更多劇本格式納入測試,持續觀察解析器的表現。
以簡化方式表示,流程如下:
DOCX -> 結構擷取 -> 段落線索 -> 區塊分組 -> 格式類型辨識 -> 正文分區 -> 選擇性 AI 審閱 -> 可編輯的字幕初稿
為何先採用確定性解析
AI 可以協助處理模稜兩可的情況,但現場字幕的準備工作需要可重現性。同一份劇本在同一版本的系統裡,應得到相同的結構判斷;除非系統本身經過有意識的修改。
確定性解析提供了這條基準。它先讀取劇本格式,再把真正困難的區域交給 AI 協助判斷。
對劇場團隊而言,流程不再只是「上傳劇本,期望模型自行理解」。系統會先尋找具體線索:
- 角色標示
- 縮排規律
- 段落間距
- 舞台指示的格式
- 冒號、破折號、句點及定位點等分隔方式
- 扉頁、角色表及製作筆記等前置資料
線索足夠明確時,解析器不必經過 AI 審閱,也能對該區塊作出分類。
一個簡單例子:角色表,還是字幕提示?
請看劇本開頭的一段文字:
角色
哈姆雷特
奧菲莉亞
第一幕
哈姆雷特
生存,還是毀滅。逐行交由 AI 判斷時,兩處 哈姆雷特 都可能被看成角色標示。然而,角色表裡的 哈姆雷特 是前置資料;到了劇本正文,它才是引出台詞與字幕提示的角色名。
差別不在這個詞,而在它所處的文件區段。
這正是正文優先分區的價值。解析器會先嘗試把前置資料與可演出的正文分開,再於預期包含台詞的區域套用對白規則,降低角色表、扉頁或製作筆記被誤製成排練字幕的風險。
從劇本走向字幕:現行解析方向
解析器採用分階段流程,而不是把所有工作交給一次 AI 分類。實作細節仍會演進,但幾個核心階段已有清楚原則。
1. 擷取文件結構
處理 .docx 時,SurtitleLive 會讀取結構化文件資料,而不只依賴純文字。這樣可以保留縮排、段落對齊、間距、繼承自 Word 的樣式,以及斜體或粗體等文字片段格式。
這些資訊之所以重要,是因為許多劇本以排版構成文法。置中且全大寫的一行可能是角色名;縮排的一行可能是台詞;斜體的一行可能是舞台指示。先轉成純文字,便可能抹去這些線索。
2. 將段落整理成結構線索
每個段落會整理成一組結構線索,包括該行是否帶有角色前綴、是否置於括號內、是否使用常見於舞台指示的格式,以及大小寫對目前的書寫系統是否具有參考價值。
系統不會把所有劇本都當作英文劇本。若某種書寫系統沒有大小寫之分,相關規則便會降低權重或停用,以免製造虛假的信心。
3. 建立劇本區塊
接著,系統把段落組成劇本區塊。一個區塊可能是說出口的台詞、角色名與其後的台詞、舞台指示、標題,或仍需人工確認的區域。
這一步根據版面與結構,不是文學詮釋。
4. 辨識劇本的版面類型
劇本沒有唯一格式。有些採用 角色:台詞,有些把角色名獨立成行、台詞排在下方;也有些使用句點或破折號,甚至在同一份文件裡混用不同慣例。
因此,SurtitleLive 會先辨識可能的版面類型,再套用相應的解析規則。常見例子包括:
| 版面類型 | 常見格式 |
|---|---|
| 冒號式台詞 | HAMLET: To be 或 張三:今天下雨 |
| 角色名獨立成行 | HAMLET 下方接一行縮排台詞 |
| 句點分隔角色名 | AMLETO. Essere o non essere |
| 混合版式 | 同一劇本的不同區段採用不同慣例 |
| 未知或線索不足 | 前置資料、附錄或難以判定的區域 |
如此一來,文件若在中途轉換格式,解析器便不必勉強以同一套規則處理全文。
5. 將前置資料與正文分開
許多劇本以扉頁、角色表、註記或製作資訊開頭。即使這些內容不屬於演出正文,在結構上仍可能與台詞相似。
SurtitleLive 透過正文優先分區降低這項風險。解析器嘗試辨認可演出的正文從何處開始,避免前置資料干擾台詞辨識。
6. 只在界線不明的區域使用 AI
AI 仍有其角色。當確定性線索薄弱或互相衝突時,它最能發揮作用。
設計目標並不是從流程中移除 AI,而是不讓 AI 重複判斷已有清楚結構線索的內容。需要 AI 審閱時,應把注意力放在真正難以界定的區域;條件允許時,也應參考同一份文件裡較明確的例子。
從前後次序檢視與修復
有些錯誤只有放回區塊次序裡才會浮現。標題後再接標題,在前置資料中可能合理;在台詞密集的場景裡卻未必如此。只出現一次的角色名,也可能要與反覆出現的角色標示採取不同處理。
SurtitleLive 會從序列層級重新檢視這些判斷。內部的解碼與平滑邏輯會一併考慮相鄰區塊、文件區段及角色線索,而不是把每個段落孤立處理。
這與單純的逐行解析有本質差異。劇本是一份有前後關係的文件;周遭結構往往能幫助判斷某一行是台詞、角色提示、標題,還是應留待審閱的內容。
如何檢查解析器的變更
解析器的變更會先通過精選劇本樣本與迴歸案例,才被視為可以採用。目的很實際:改善一種版式的修改,不應在無聲無息間破壞另一種版式。
檢查會聚焦於這些問題:
- 原本確認的角色行,是否仍被辨認為角色行?
- 舞台指示是否仍未混入字幕清單?
- 前置資料是否仍與可演出的正文分開?
- 多語言及非英文標點是否仍按預期處理?
- 難以判定的區塊是否仍可供審閱,而非被過度分類?
這不代表每一份劇本都能一次解析完美。排練稿、掃描後重新輸入的材料、大幅改編文本及格式不一致的文件,彼此可能相差甚遠。人工審閱始終是準備流程的一部分。
這對使用者有何意義
對製作團隊而言,先採用確定性解析,是為了讓劇本準備更可預期。無論是 AI 輔助的劇場字幕、歌劇字幕,或多語言字幕初稿,結構誤判都會增加後續審閱工作。
這套方向有助於 SurtitleLive:
- 保留 Word 劇本中的版面線索
- 辨識常見的劇場台詞格式
- 在結構已清楚時,減少不必要的 AI 詮釋
- 讓難以判定的區域保持可見,留待審閱
- 更審慎地處理多語言劇本慣例
實際目標不是全自動化,而是一份較清楚的初稿,讓人能在演出前審閱、修正、翻譯並排練。
對操作人員而言,這意味著減少可避免的錯誤字幕,也讓排練交接更清楚。
對製作人而言,團隊可以少花一些時間在人工重排格式,更早開始檢視字幕初稿。
對無障礙與語言工作者而言,較穩定的劇本結構能提供更清楚的核對基礎,讓翻譯及面向觀眾的字幕在現場傳遞前接受審閱。
這套架構不代表什麼
這套架構有其界線。
它不代表每份劇本第一次都能正確解析。
它不代表系統永遠不使用 AI。
它不代表不同語言、版式或排練稿都具有相同的解析信心。
它也不能取代演出前的人工審閱。
系統更不會停留在目前形態。劇本解析仍是 SurtitleLive 持續密切觀察的部分;隨著更多真實劇本、版式與語言慣例納入測試,規則、審閱門檻、迴歸案例及 AI 交接方式仍會在證據支持下調整。
我們的方向:讓 AI 協助審閱,而非包辦解析
整體架構可以整理如下:
| 項目 | 早期方向 | 現行方向 | 對使用者的價值 |
|---|---|---|---|
| 劇本線索 | 版面分群與 AI 分類 | 結構化文件擷取,加上確定性線索 | 劇本匯入結果更可預期 |
| 版式處理 | 以整份文件作較廣泛的假設 | 按區段與版面類型解析 | 更能處理混合格式 |
| 前置資料 | 較容易與台詞混淆 | 先分離正文,再辨識字幕內容 | 減少角色表或扉頁誤成字幕 |
| AI 的角色 | 在分類中較為核心 | 選擇性審閱難以判定的區域 | 減少不必要的 AI 詮釋 |
| 可靠性工作 | 以啟發式方式修補 | 迴歸檢查與序列層級審閱 | 讓解析器的演進更可控 |
這是一條刻意審慎的路。文件結構已提供較強線索時,現場字幕系統不應只依賴 AI 的信心分數。
AI 很有用,卻不是整個解析器。對 SurtitleLive 而言,更可靠的組合是確定性的劇本結構、針對性的 AI 審閱、人工準備,以及持續觀察解析器的實際表現。
若團隊仍以人工把劇本製成一頁頁投影片,或在排練前逐行重建劇場字幕,SurtitleLive 可以協助把結構化劇本整理成可編輯的字幕初稿,供團隊審閱並用於現場傳遞。進一步資料請見 SurtitleLive 功能頁面及從 AI 劇本到劇場字幕。
常見問題
問:什麼是確定性劇本解析?
答: 確定性解析依照文件結構套用固定規則,例如縮排、間距、標點與格式。在輸入與解析器版本相同時,應得到相同的結構結果。
問:為何不讓 AI 判斷每一行?
答: AI 可以協助處理界線不明的區域,但許多劇本判斷關乎結構,而非語意。若格式已清楚標示角色、台詞或舞台指示,確定性規則通常更容易重現。
問:AI 能自動製作劇場字幕嗎?
答: AI 可以協助準備初稿;製作團隊仍應在演出前檢查字幕結構、翻譯選擇、時機及觀眾端的傳遞方式。SurtitleLive 把 AI 視為準備流程的一部分,而不是演出審閱的替代品。
問:SurtitleLive 如何把劇本整理成字幕提示?
答: SurtitleLive 讀取文件結構、辨認劇本區塊與可能的版面規律、分開前置資料與可演出的正文,再建立可供審閱的字幕初稿;界線不明的區域可以接受選擇性的 AI 協助。
問:為何 DOCX 格式對劇場字幕重要?
答: 許多劇本以格式表達結構。角色標示、台詞、標題與舞台指示可能透過縮排、間距、大小寫或斜體加以區分;保留這些線索有助於辨認字幕內容。
問:什麼是劇本版面類型?
答: 這是反覆出現的版面規律,例如角色名獨立成行、冒號式台詞,或以句點分隔角色名。辨認這些規律,可以協助解析器為不同區段選擇合適規則。
問:這是否不再需要人工審閱?
答: 不是。SurtitleLive 的目標是提供更清楚的審閱初稿,而非全自動產生最終演出檔案。團隊仍應在演出前審閱字幕、翻譯、時機及觀眾端的傳遞方式。
問:SurtitleLive 會如何持續改善這套系統?
答: 我們會透過迴歸案例、真實劇本格式及製作回饋觀察解析器表現。若出現反覆的不確定性或可避免的錯誤,便可據此調整解析規則、審閱門檻與 AI 交接方式。