如果你的網路研討會聽眾橫跨多個語言市場,單一語言字幕會逼你做出取捨:要嘛用英文上字幕、讓非母語者吃力地跟,要嘛錄製三套不同語言版本、卻失去即時互動。多語言即時字幕避開了這個兩難。一場網路研討會以英文進行,每位與會者在自己的裝置上,從主辦者為該場工作階段設定好的語言中選一種來閱讀字幕。Subanana 的即時工作階段可以承載一個來源語言加上最多五個翻譯目標,因此單一場工作階段就能照顧到好幾個語言族群(作法在下文說明)。
本文會走過完整的設定流程:事前設定、當天操作、事後存檔,並附上 Zoom、Google Meet 與 Microsoft Teams 的平台注意事項。

你實際需要的東西
多語言網路研討會字幕最精簡而可行的組合有三項:
- 一個用來開會的網路研討會平台(Zoom、Google Meet、Teams、Riverside、StreamYard 等)
- 一項處理即時語音辨識與翻譯的即時字幕與翻譯服務
- 一個獨立於研討會用戶端之外、供與會者觀看即時字幕的畫面。每位與會者在其中閱讀該場工作階段已設定的其中一種語言
多數網路研討會平台把第一項做得很好,第二項也處理得還不錯(Zoom 內建字幕尤其堪用)。但第三項通常付之闕如:標準的網路研討會工具並未內建可分享的多語言與會者字幕畫面。
第三項正是 Subanana 即時字幕這類專用工具派上用場的地方。
事前設定
1. 確認聽眾的語言
一切從這裡開始。查看報名資料或過往活動分析,或者直接問:「如果我們提供字幕,你會選哪一種語言?」一題式的行前問卷就足以蒐集到需要的資料。
如果問卷不可行,全球型 B2B 網路研討會合理的起手式大致是英文、西班牙文、中文、法文與日文;面向消費者或特定市場的研討會,就依此收斂範圍。Subanana 的即時工作階段一次可承載五個翻譯目標,因此這份清單同時也是判斷「單一場工作階段能否涵蓋全部聽眾」的依據:來源語言之外,五種閱讀語言就是工作階段設定畫面的上限。
2. 決定講者的來源語言
單一來源語言是最單純的組合。多數即時字幕工具允許活動進行中切換來源語言,但切換會帶來摩擦。如果能訂一個來源語言並貫徹到底,就這麼做。
挑選來源語言時的考量:
- 採用講者最流利的語言。語音辨識準確度在非母語講者身上會明顯下降
- 若是由不同語言的講者組成的座談,即使個別講者偶爾會切換,也要事先議定一個來源語言
3. 選擇字幕與翻譯工具
選項分成三類:
- 網路研討會內建字幕:Zoom 與 Teams 的企業方案在較高階的層級提供多語言選項;Google Meet 在部分地區與方案提供即時翻譯
- 企業級活動平台(Wordly、Interprefy、KUDO):為活動而生、在大型場合穩定可靠,但價格是企業合約(通常每場數千美元)
- 自助式活動字幕(例如 Subanana):採訂閱制、註冊後即可使用,並以 QR code 提供與會者分享連結。Subanana 的即時字幕屬於 Max 方案功能,每個工作空間都有一次五分鐘的即時試用,可以在付費前把整套設定走過一遍
對於規模不到企業級高峰會的多數網路研討會來說,第三類是務實的預設選擇,本文接下來也以這條路徑為準。(三類選項更完整的背景,可參考多語言活動的即時字幕一文。)
4. 活動前把音訊路徑完整跑一次
活動前一天做一次五分鐘的彩排:
- 講者使用與當天相同的麥克風、相同環境、相同平台
- 確認字幕服務確實收得到聲音(視工具而定,可能是系統音訊擷取或研討會平台整合)
- 用手機開啟與會者畫面,確認字幕即時出現
- 開啟與會者畫面,逐一切換你設定的翻譯目標語言,確認每一種都會顯示
開播前五分鐘才發現音訊擷取有問題,是最常見的營運失誤之一。一次五分鐘的行前測試,通常就能抓出典型問題:選錯麥克風、字幕服務未獲准加入會議、瀏覽器擴充套件衝突。
當天在 Subanana 的設定(實際操作)
使用 Subanana 的流程如下。

步驟 1:建立即時轉錄工作階段
在 Subanana 建立一個新的即時工作階段。把來源語言設為講者的語言,並在同一場工作階段中加入聽眾需要的翻譯目標語言,最多五個(選擇器不會接受第六個)。即時分鐘數不論目標數量多寡,都只依音訊長度扣一次,因此加上第四、第五種閱讀語言並不會讓這場工作階段更貴。即時字幕屬於 Max 方案功能;若想先試跑設定,每個工作空間都有一次五分鐘的即時試用。
步驟 2:接上音訊
即時字幕採用直接音訊輸入,通常是送進執行 Subanana 即時工作階段那台瀏覽器的麥克風音訊或系統音訊。主辦者在自己的筆電上跑即時工作階段,並把音訊來源餵進去。
依網路研討會平台不同,常見作法如下:
- Zoom、Google Meet、Microsoft Teams、Riverside、StreamYard 以及其他任何網路研討會平台:在主辦者的筆電上,與研討會用戶端並行執行 Subanana。透過虛擬音訊線(Mac 用 BlackHole,Windows 用 VB-Cable)把研討會的音訊輸出送進 Subanana。Subanana 的即時轉錄接住送入的音訊,並把字幕推送到與會者分享連結。
- 實體加遠端的混合場:講者在現場時,把麥克風直接接到執行 Subanana 的那台筆電;同一台筆電也可以當作研討會的一個參與端,向遠端與會者播送。
關於會議機器人的重要說明:Subanana 也透過行事曆整合提供 Google Meet 與 Teams 的會議機器人,但這個機器人僅供事後製作的轉錄之用。它會錄下會議,並在會議結束後建立專案,而不是在會議進行中顯示即時字幕。即時字幕請一律採用上述的直接音訊輸入作法。
步驟 3:產生與會者分享連結
Subanana 會為每一場即時工作階段產生一組網址與 QR code。把 QR code 放在研討會開場前的投影片、寫進報名確認信,或釘在研討會聊天室裡。與會者用手機掃描 QR code,經過語言選擇畫面,在這裡各自從你為該場工作階段設定的語言中挑一種顯示語言。個人裝置上顯示的就是那一種語言。要把兩種語言並列在同一個畫面,屬於會場螢幕的投影功能:可以用子母畫面的字幕視窗,或是把不帶裝飾的網址放進 OBS、vMix、ProPresenter,把雙語並列的投影訊號送上會場螢幕。
步驟 4:向講者交代注意事項
在營運上,有兩件事值得先告訴講者:
- 口齒清楚、速度適中,句與句之間留下自然的停頓。講得太快或毫不停頓,字幕準確度會下降;停頓讓系統有時間產出字幕,也讓聽眾有時間閱讀。
- 容易被聽錯的專有名詞與術語(產品名、品牌名、人名)先行解釋。講者可以在首次提到時補上一句簡短說明,正在讀字幕的聽眾會很感激這份體貼。
步驟 5:活動進行中
字幕會以每位與會者所選的那一種語言,在他們的裝置上以大約一到兩秒的延遲即時顯示。Subanana 會自動錄下整場工作階段的活動音訊。講者專心講、你專心顧研討會,字幕在背後持續運作。
如果字幕停住或準確度下滑,請檢查:
- 先看麥克風訊號。即時字幕的問題多半是上游的音訊問題。
- 檢查來源語言設定。若講者轉用了另一種語言,主辦者可以在活動進行中變更工作階段的來源語言;變更會套用到之後的音訊,先前已產生的字幕行則維持原本的語言。
事後存檔
研討會結束後:
-
逐字稿要從錄音來,而不是從即時畫面來。每一場工作階段都會自動錄下活動音訊並保存在工作空間,那份錄音就是通往文字檔的入口。用 Subanana 的檔案上傳轉錄重新處理,它會以一個全新專案執行,為整份檔案選定一個來源語言,並使用轉錄分鐘數。這個專案可以匯出 SRT,也就是你要為研討會錄影上字幕時所需的格式,可直接放進影片剪輯軟體的字幕軌,或上傳到 YouTube 當作 CC 字幕軌。文件用的 Word/Excel/Markdown 版逐字稿,同樣從這個專案匯出。
-
把字幕壓進錄影。如果錄影要發佈到 YouTube、LinkedIn 或自家網站,SRT 可以直接上傳到 YouTube 作為 CC 字幕軌,或在剪輯軟體(Premiere Pro、Final Cut Pro、DaVinci Resolve、CapCut)中壓進影片。若音訊是粵語,Subanana 另提供口語轉書面中文(口語→書面語)的輸出選項,壓出來的字幕會更好讀。
-
把逐字稿寄給與會者。許多與會者想要一份文字記錄。重新處理後的專案會先以檔案的來源語言產出逐字稿,再加上翻譯軌,就能為各語言族群匯出對應版本,用在活動後的信件裡。翻譯過的逐字稿特別受非母語與會者歡迎。
-
把逐字稿再利用成內容。一場 60 分鐘研討會的逐字稿通常有 8,000 到 10,000 字,足以支撐兩到四篇部落格文章、五到十則 LinkedIn 貼文、一份 Podcast 腳本,或一封長篇電子報。這套匯出與再利用的循環,正是研討會投資報酬會隨時間累積的原因之一。
常見問題與處理方式
| 問題 | 可能原因 | 處理方式 |
|---|---|---|
| 字幕延遲超過五秒 | 音訊擷取延遲(尤其使用虛擬音訊線時) | 調低虛擬音訊線的緩衝大小;同時檢查研討會平台本身的上游延遲 |
| 活動進行到一半字幕消失 | 音訊來源中斷(USB 麥克風被拔掉、虛擬音訊線重置) | 檢查麥克風與音訊線的實體連接;重新啟動擷取裝置 |
| 翻譯出來的內容文不對題 | 來源語言設定錯誤,或講者換了語言 | 在活動中更新工作階段的來源語言;變更會套用到之後的音訊,先前已產生的字幕行維持原本的語言 |
| 部分與會者看不到字幕 | 沒有掃描 QR code,或瀏覽器擋下了分享連結 | 在 QR code 旁一併附上網址;並在研討會聊天室釘一份作為備援 |
| 術語辨識準確度偏低 | 產業特有詞彙不在模型的一般訓練範圍內 | 事先解釋關鍵詞;並在工作階段開始前,把講者姓名、產品名與術語加進 Subanana 的詞彙表 |
各網路研討會平台的注意事項
Zoom
Zoom 內建字幕處理講者的來源語言相當不錯。要翻成聽眾語言,則需要 Zoom 的企業方案(語言配對有限)或第三方整合。對沒有企業預算的多語言研討會來說,把 Zoom 的音訊輸出送進自助式字幕工具是務實的路徑。
Google Meet
Google Meet 在部分方案與地區提供即時翻譯字幕,但各語言配對的涵蓋範圍參差不齊。若你要在 Meet 上開會、同時讓與會者裝置看到多語言即時字幕,請在主辦者的電腦上透過虛擬音訊線,把 Meet 的系統音訊送進 Subanana 的即時工作階段。
(Subanana 也透過行事曆整合提供 Google Meet 機器人,但那個機器人是事後製作轉錄用的:它錄下會議,並在結束後建立專案,不會在會議進行中顯示即時字幕。)
Microsoft Teams
Teams 在 Teams Premium 中支援翻譯字幕。若 Teams 研討會需要在與會者裝置上顯示多語言即時字幕,作法相同:在主辦者的電腦上執行 Subanana,把 Teams 的系統音訊送進即時工作階段。
(Subanana 的 Teams 機器人與 Google Meet 機器人一樣,處理的是事後製作的錄影,而不是即時字幕。)
Riverside、StreamYard 等研討會工具
近年的網路研討會平台多半和 Zoom 一樣會把講者音訊以串流輸出,用虛擬音訊線接收的作法對這些平台都適用。部分平台另提供給字幕服務的直接 webhook 整合,請查閱你所用工具的說明文件。
常見問答
研討會與會者需要安裝什麼嗎?
不需要。與會者畫面就是一個網頁連結。與會者用手邊任何裝置掃描 QR code(或點一下網址),就能在瀏覽器裡看即時字幕。每個人從主辦者為該場工作階段設定的語言中挑一種顯示語言,在自己的畫面上閱讀那一種語言。不必裝 App,也不必註冊。
一場活動可以同時使用幾種語言?
Subanana 底層的翻譯涵蓋 95+ 種語言,而單一場即時工作階段可承載一個來源語言加上最多五個翻譯目標,全部由主辦者事先設定。換句話說,中文讀者、韓文讀者與西班牙文讀者可以在同一場工作階段的同一個時刻,各自在自己的手機上讀各自的那一種語言。與會者無法自行新增語言,能挑的只有這場工作階段已經承載的語言:如果有位韓文使用者參加活動,而韓文不在翻譯目標之列,他就無法在分享連結上看到韓文字幕。
由此可以推出兩件事。第一,同一時刻需要六種以上閱讀語言的聽眾,已經超出單一場工作階段所設想的形態。第二,把兩種語言並列在同一個畫面上,屬於會場螢幕的投影功能,由會場螢幕用的無裝飾網址送出,而不是與會者在自己手機上設定的東西。
如果講者在研討會中途換語言怎麼辦?
在國際型座談中,能說多種語言的講者很常見。最佳作法是事先議定一個來源語言。講者中途切換時,在來源語言設定跟上之前,新語言的字幕品質會下降。在 Subanana 的即時字幕工作階段中,主辦者可以在活動進行中變更來源語言,變更會套用到之後的音訊,先前已產生的字幕行則維持原本的語言。如果活動本來就以語言區塊劃分(前半英文、後半粵語),這個作法會很俐落:在交界處切換來源語言即可。若講者會在同一段回答裡難以預測地來回跳,就別依賴中途切換,而要以語言區塊來設計議程。
與會者可以在研討會開始前進入字幕畫面嗎?
可以。分享連結從你建立工作階段的那一刻起就有效。與會者可以在研討會開始前先開著,字幕一開始就會直接即時顯示。許多活動主辦者會把 QR code 放在開場前的等待投影片上,方便早到的與會者。
這會如何影響研討會的效能與延遲?
擷取音訊並串流給字幕服務,會多出大約一到兩秒的延遲。研討會本身對與會者而言仍以原本的速度進行,字幕則會有大約一到兩秒的時間差才從講者抵達與會者的裝置。
遲到或錯過活動的與會者,事後的無障礙取用怎麼辦?
活動音訊會自動錄下並留在工作空間。文字記錄要從這份錄音來,而不是從即時畫面來:用檔案上傳轉錄重新處理,把產出的逐字稿放進後續信件分享,並從該專案匯出錄影用的 SRT。SRT 可以上傳到 YouTube 當作 CC 字幕軌,或在剪輯軟體中壓進影片。
延伸閱讀
- 多語言活動的即時字幕:以三大類別切入即時字幕選項的完整指南
- Subanana AI 即時語音字幕產品頁:功能細節與方案價格
- 大學課堂的即時字幕:多語言設定與工具比較
結語
多語言網路研討會字幕曾經是企業級活動平台的地盤,動輒五位數美元的合約。如今這個類別已經成熟,中型研討會(社群分享會、B2B 產品展示、大學課堂、公司內部活動)也能以自助方式跑起即時的多語言字幕。設定的重心落在上游的音訊架構上,語言的分流交給字幕工具處理就好。
設定一次、跑五分鐘測試、向講者交代注意事項,剩下的就會很順。