大學的即時字幕有兩個很具體的需求,而多數現成的會議轉錄工具都處理得不好:一是聽障學生的無障礙支援(在許多地區是法規要求,不是加分項),二是國際學生族群的語言近用——講者說一種語言,台下卻需要以好幾種語言閱讀。
大學早就在用的課堂錄製系統,像 Panopto、Echo360、Zoom for Education、Microsoft Stream,其實解決了其中一半:它們會替課後重播的錄影自動上字幕。真正沒被解決的是 講課當下的即時翻譯顯示——後排說華語的學生用手機讀中文字幕,需要無障礙支援的英語學生在自己手機上讀原文字幕,聽障學生則要一份斷句清楚的即時逐字內容。(各家工具在「一個工作階段能承載幾種語言」以及「這個選擇有多少能交到每位學生自己的螢幕上」這兩點差異很大,那也正是後面比較的重點。)
這篇文章談大學對即時字幕工具真正的需求、上課當天的設定流程,以及幾個實際可行的選項各自適合誰——包含我經營的 Subanana、Wordly,還有你原本就有的課堂平台原生字幕。

大學真正需要的是什麼
我談過的學校,反覆出現的需求有三個:
- 講課當下學生就看得到的即時字幕,而且涵蓋學生族群真正需要的語言。 不只是替錄影上字幕。因為無障礙或語言因素而需要字幕的學生,需要的是課堂進行當下的字幕,不是 24 小時後才有。(一個工作階段就能涵蓋多種目標語言,或必須每種語言各開一個工作階段,是實際存在的差異——見下方比較。)
- 音訊來源要有彈性。 有些課是實體授課,用領夾麥克風接擴音系統;有些是混合式,講者在現場、部分學生在 Zoom 上;有些則完全線上。字幕工具必須能接得上這堂課實際使用的音訊來源。
- 學生端不能有「請先安裝 App」的摩擦。 要求 200 個大學部學生在每堂課前安裝一個 App 或登入一個帳號,現實上行不通。以連結或 QR Code 在瀏覽器顯示字幕,是大班唯一可行的分發方式。
視學校情況而定的附加條件:
- 針對聽障學生的無障礙法規遵循(美國 Section 508、歐盟 EAA、英國 BS 8878)。
- 與既有課堂錄製系統(Panopto、Echo360)的銜接,讓即時字幕的內容最後也進得了錄影檔。
- 與學生族群規模相稱的多語言支援——小班可能只需要一種目標語言,大型國際學程可能需要四種。
- 課程專有名詞的詞彙表支援(講者的專業術語、人名機構名、技術縮寫)。
實務上行得通的三種設定型態
最常見的設定有三種。選哪一種取決於課堂形式(實體/混合/線上)、視聽設備,以及有沒有資訊人力支援。
型態一:實體課堂、領夾麥克風、瀏覽器即時字幕
適用於講者人在教室、使用領夾或手持麥克風、聽眾也在現場。
- 音訊輸入。 把麥克風訊號導進跑字幕工具的筆電,最省事的做法是用一個 USB 音訊介面,接在視聽系統的輔助輸出上。如果教室的視聽設備沒有乾淨的輔助輸出,備案是在主麥克風之外再戴一支領夾麥克風,走自己的 USB 接收器。
- 字幕工具跑在筆電上。 以 Subanana 來說,筆電用瀏覽器開啟即時工作階段畫面,主持端(通常是視聽團隊)在上課前設定來源語言,再加上最多五種翻譯目標語言,然後開始工作階段。需要同時多種語言的班級,就由那一台筆電上的那一個工作階段涵蓋,因為目標語言是設定在工作階段裡面,不必為每種語言另開平行的工作階段。
- 學生端取用。 把 QR Code 投影在螢幕上(或事先公告在課程系統裡),學生用手機瀏覽器掃碼即可開啟字幕頁。接著每位學生在自己手機上挑一種要讀的語言:原文,或主持端為這個工作階段設定的任何一種目標語言。
- 課後產出。 每個即時工作階段都會自動錄下現場音訊並保存在工作空間裡。要拿到字幕檔,視聽團隊需把那份錄音再透過 Subanana 的檔案上傳轉錄重新處理一次——那會另開一個新專案並計入轉錄分鐘數——再把匯出的 SRT 掛到 Panopto 或 Echo360 的錄影上,作為長期的無障礙覆蓋。
型態二:混合式課堂,遠端部分走 Zoom 或 Teams
適用於講者在現場,但部分學生透過 Zoom/Teams/Meet 遠端參與。
- 音訊輸入。 送進 Zoom 或 Teams 的那一路麥克風訊號,同時也送進字幕工具。最省事的做法是用虛擬音訊線(Mac 上的 BlackHole、Windows 上的 VB-Cable)把筆電的系統音訊導進字幕工具,字幕工具聽到的就是 Zoom 聽到的。
- 字幕工具跑在第二台裝置上。 建議用一台專責筆電跑字幕,才不會和講者的 Zoom 搶系統資源。
- 學生端取用。 現場學生掃 QR Code;遠端學生則從 Zoom 聊天室或課程系統拿到字幕連結。
- 課後產出。 與型態一相同:把工作階段的錄音再透過檔案上傳轉錄重新處理,再將該專案的 SRT 掛到課堂錄影上。
型態三:全線上課堂,只用瀏覽器
適用於講者與聽眾都在遠端。
- 音訊輸入。 講者的麥克風訊號同時進入授課平台(Zoom/Teams/Meet)與字幕工具。如果講者只有一台電腦,就用虛擬音訊線把 Zoom 的輸出繞回字幕工具。
- 學生端取用。 字幕連結透過課程系統與 Zoom 聊天室發送。不需要 QR Code,因為每個人本來就對著螢幕。
- 課後產出。 路徑與型態一相同:把工作階段的錄音透過檔案上傳轉錄重新處理,再把 SRT 掛到課堂錄影上。
工具選項比較(以公開文件為準)
大學實際會考慮的三個選項,各有取捨:
選項 A:課堂平台原生字幕(Panopto、Echo360、Zoom 即時轉錄)
優點: 不必新增廠商關係,本來就在你的系統裡,字幕也會自動掛到課堂錄影上。
缺點: 平台內建字幕的設計重點,是替錄影加上講者所說語言的字幕。至於是否提供翻譯字幕、涵蓋哪些語言,會因平台、授權等級與加購項目而不同,所以在把多語言學生族群的需求押在它身上之前,請先確認貴校的授權實際包含哪些項目。
適合: 用講者所說語言的字幕就足以滿足需求的課堂,或是你已確認現有授權本來就涵蓋學生要讀的翻譯語言。
選項 B:Wordly
優點: 專為活動打造的企業級即時翻譯;3,000 種以上語言配對;與 Zoom、Teams、Meet、WebEx 的深度整合;有專人協助導入與活動現場支援;可加購 MP3 語音配音輸出翻譯語音;企業方案提供單一登入與可設定的資料儲存位置。
缺點: 計價方式以預付時數包為主。Wordly 公開的起始價格約為 1,500 美元的 10 小時方案,這些時數可在 12 個月內以任意單位使用,實際價格則視你需要多少時數而定;你可以按單場活動購買,也可以一次買足整年。對一所每學期跨多個系所要辦 50 場以上課程的大學而言,這代表必須先估算並買下足夠的時數。而若只是想小規模驗證(「能不能先在一門課試用,再決定要不要全校導入?」),預付一整包時數會比月訂閱更難跨出第一步。
適合: 有中央視聽或無障礙團隊、有專門採購預算,且活動量足以支撐預先購買時數的大型研究型大學。→ 深入比較:Subanana 與 Wordly 比較(2026)。
選項 C:Subanana
優點: 公開標示的月訂閱價格(不需預付時數包);每個工作空間提供一次性的 5 分鐘即時字幕試用,供初步確認;主持端可在單一工作階段裡設定一種來源語言加上最多五種翻譯目標語言,而且不論目標語言有幾種,即時分鐘數都只依音訊時長計費一次,因此系所可以自助導入、不必走中央採購;學生端是瀏覽器字幕,不需安裝 App;支援 95+ 種來源語言,依語言挑選表現最好的模型,並可用詞彙表鎖定講者姓名、系所名稱與課程專有名詞。
缺點: 一個工作階段最多承載五種翻譯目標語言,因此同一時間必須服務超過五種閱讀語言的課堂就不在它的守備範圍(Wordly 在單一工作階段內原生支援更多目標語言);在學生自己的手機上,字幕頁一次只顯示一種語言,兩種語言並排屬於會場大螢幕投影的做法,不是個人裝置上的設定;即時字幕是 Max 方案的功能,並非所有付費方案都包含;即時字幕沒有與 Zoom/Teams/WebEx 的逐一深度整合(流程是以麥克風或虛擬音訊線為基礎的音訊輸入);沒有翻譯文字的 MP3 語音配音(只有文字字幕);目前公開的功能列表中沒有企業單一登入,也沒有可設定的資料存放區域;語言配對廣度也不及 Wordly 的 3,000 種以上。若你想要 SRT,或逐字稿的 DOCX/XLSX/Markdown,需於課後再透過 Subanana 的檔案上傳轉錄重新處理錄音。那會是一個新的轉錄專案,並計入轉錄分鐘數。
適合: 課程場次量較小的大學或個別系所、想先驗證即時字幕是否合用再投入的單位,或是需要涵蓋 Wordly 主力情境之外語言的團隊。拿不到中央企業合約預算的系所,可以自行訂閱一個 Max 方案的工作空間。
→ 產品頁:Subanana——多語言即時字幕。
實務流程:為一門固定開設的課程設定 Subanana
假設一個系所有一門固定開設的課程,授課用一種語言,而學生需要另一種語言的字幕(或是兩三種,全部由同一個工作階段承載),實務流程如下:

- 一次性設定(第一堂課前約 30 分鐘)。 視聽團隊把音訊路由接進字幕筆電(從視聽輔助輸出接 USB 介面,或用虛擬音訊線)。系所行政建立一個 Subanana 工作空間,預先設定好來源語言,以及班級需要的翻譯目標語言,最多五種,全部放在同一個工作階段裡。
- 課前(約 5 分鐘)。 視聽團隊開啟即時工作階段,確認音量,產生 QR Code,印在課堂投影片上或在開場時投影出來。同時把字幕連結預先公告在課程系統,供遠端或遲到的學生使用。
- 上課中。 字幕在背景執行,講者不需要操作它。想看字幕的學生掃 QR Code 或點課程系統的連結即可。
- 課後。 工作階段的錄音已經存在工作空間裡。視聽團隊把那份錄音透過檔案上傳轉錄重新處理一次,這是一次全新的轉錄、計入轉錄分鐘數,匯出其 SRT,再上傳到課堂錄製系統(Panopto/Echo360),讓字幕軌長期附在錄影上。
- 整個學期。 設定好的來源語言與翻譯目標語言會逐個工作階段沿用,不必每次重新設定。若課程內容中途換了語言(以英語為主的課程中,某週有一位以華語授課的客座講者),主持端只要在那堂課前於即時工作階段畫面改掉來源語言,之後再改回來即可。
常見問題
Subanana 能與大學的課堂錄製系統整合嗎?
Subanana 的即時字幕走的是音訊輸入式的銜接,而非逐一平台的深度整合:它從主持端的麥克風、系統音訊或虛擬音訊線取得音訊。課後把工作階段的錄音透過檔案上傳轉錄重新處理,該專案匯出的 SRT 可上傳到 Panopto 或 Echo360,成為錄影的字幕軌,這是多數大學實際可行的整合型態。
Subanana 能滿足無障礙法規(Section 508、EAA)嗎?
法規是否滿足,取決於貴校無障礙單位要求你為聽障學生提供什麼——通常是課堂當下的即時字幕軌,加上錄影上一份經過校對的字幕軌。這兩種型態 Subanana 都涵蓋:課堂當下的即時字幕,以及課後由工作階段錄音經檔案上傳轉錄重新處理而來的字幕軌。是否符合你所適用的特定法規架構,要看貴校的政策。Subanana 目前並未發布正式的 Section 508 或 EAA 符合性文件,因此在合規要求嚴格的情境下,請先與貴校無障礙單位確認。
聽眾端的語言選擇是怎麼運作的?
主持端在工作階段開始前設定一種來源語言(講者本身就多語時可用自動偵測),再加上最多五種翻譯目標語言。每位掃描 QR Code 或開啟分享連結的聽眾,接著為自己挑 一種顯示語言:原文,或主持端設定的任一種目標語言。因此同一個工作階段可以同時服務讀中文的、讀韓文的與讀英文的三位學生,各自看自己的手機,各自讀一種語言。聽眾只能從主持端設定好的語言中選擇,所以班級需要哪些語言,要在工作階段設定時就決定。至於兩種語言同時並排顯示,那屬於會場大螢幕投影的做法(子母畫面視窗,或把純瀏覽器來源網址放進 OBS、vMix、ProPresenter 去驅動場地螢幕),不是個別學生能在自己手機上設定的。
即時字幕需要什麼樣的音訊品質?
乾淨的領夾麥克風訊號(靠近講者嘴部、遠離擴音喇叭)是字幕準確度最關鍵的單一因素。天花板上的環境麥克風通常會讓字幕明顯變差,因為會收進空間殘響與空調噪音。如果字幕品質重要,優先處理領夾或手持麥克風,不要依賴教室原有的環境麥克風陣列。
學生可以下載字幕來複習嗎?
路徑是走課堂錄音,而不是即時字幕畫面。每個工作階段都會自動錄下音訊並保存在主持端的工作空間裡。主持端接著把那份錄音透過 Subanana 的檔案上傳轉錄重新處理——那是針對這堂課的一次全新轉錄,計入轉錄分鐘數,並為該檔案指定一種來源語言——再匯出 SRT(或逐字稿的 DOCX、XLSX、Markdown)。大學通常會把 SRT 掛到 Panopto 或 Echo360 的課堂錄影上,讓學生以錄影字幕軌的形式取用,也方便搜尋複習。若講者願意,直接把檔案給學生也可以。
Subanana 的價格如何擴展到整個系所或全校?
Subanana 公開的計價是以工作空間為單位——一個系所層級的工作空間,涵蓋在其中開設工作階段的講者,而即時字幕屬於 Max 方案,因此那就是要開設工作階段的系所應訂閱的方案。若要全校導入,正常路徑是討論工作空間結構與用量。Subanana 賣的不是以場次時數包計價的模式(例如 Wordly 的做法);如果貴校採購流程就是需要那種計價型態,Wordly 本來就是為此而生。
延伸閱讀
- Subanana 與 Wordly 比較(2026):即時字幕對照
- 多語言活動即時字幕(2026):實務指南
- 如何為網路研討會設定多語言即時字幕(2026)
- 2026 最佳 AI 會議轉錄工具:以公開文件為準的總覽