AI會議逐字稿與摘要工具

將影片或音訊拖曳到這裡
MP4、MOV、MP3、WAV、M4A,最大 2 GB。

繁體中文(台灣)跟隨來源

上載音訊或影片檔案,或貼上公開連結,Subanana 會輸出分講者、已加標點及分段的逐字稿,而不是一團未分段的文字。支援 95+ 種語言,平均準確率 98%,可匯出 SRT, VTT, TXT, DOCX, XLSX, Markdown,每條檔案首 15 分鐘免費預覽。

不需信用卡。前 15 分鐘免費預覽。

  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush
  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush

一段錄音,如何變成一份逐字稿

訪談錄音

M4A · 58:12 · 已上傳

上傳檔案、貼上連結,或在瀏覽器直接錄音支援 95+ 種語言,句中夾雜外語也能辨識

逐字稿

00:12

我們把上線日期移到六月第一週。

00:47

可以——但定價頁必須在那之前定稿。

逐字稿

TXT · DOCX · XLSX · Markdown

字幕檔

SRT · VTT

翻譯

95+ 種語言

摘要

重點 · 待辦事項

提問

直接向逐字稿發問

為什麼團隊把錄音交給 Subanana

這不是功能清單——而是決定一份逐字稿能否直接使用、不必重聽的那些事。

一份讀得下去的逐字稿

  • 講者自動分開每一句都標明是誰說的,自動辨識。
  • 標點與分段自動還原標點與段落,文字讀起來是文章,不是一整面牆。
  • 文字已整理語助詞會被清掉,意思保持原樣。
  • 向逐字稿發問在編輯器裡向錄音提問,答案以實際說過的內容為根據。

準確度來自工程,不是口號

  • 逐語言挑最佳模型持續評測語音模型,每個檔案交給該語言表現最好的一個。
  • 幻覺偵測可疑輸出會被攔下,交由另一個引擎重新處理後才交給你。
  • 專有名詞照你的寫法把人名、產品名和行話存進詞彙表,套用到你的專案。
  • 先建議、後確認AI 校對會建議修正聽錯的字;你核准之前不會有任何更動。

誰在這裡把說話變成文字

流程相同——差別在交付物:逐字稿、會議記錄、字幕還是摘要。

會議與通話

企業團隊

逐字稿之上再有摘要、決議與待辦——趁會議記憶猶新就分享出去。

影片與 Podcast

內容創作者

同一份逐字稿產出字幕、節目筆記與金句,每個發布平台都用得上。

訪談

記者與研究人員

引述必須逐字精確、標明講者——而且要趕在截稿之前完成。

課堂與講座

學生與教學

長錄音自動產生摘要、可搜尋,複習直接從重點開始。

如何將語音轉成文字?

上載、選擇語言、AI 自動轉寫,最後檢查及匯出——全部在瀏覽器完成。

  1. 上載檔案或貼上連結手機錄音、會議室錄音、訪談音檔均可直接上載,所有計劃單一檔案最長 8h、最大 30GB。公開的 YouTube、Instagram、Facebook 連結亦可直接貼上。
  2. 選擇語言及輸出模式選定來源語言,再決定輸出逐字稿或會議記錄。同一工作可加選翻譯目標語言。
  3. AI 自動轉寫每種語言都會配對評測表現最佳的語音辨識模型,並自動辨識講者、還原標點及段落。
  4. 檢查、提問、匯出在編輯器核對內容,可直接向 AI 查詢重點,然後匯出 SRT, VTT, TXT, DOCX, XLSX, Markdown。

每份逐字稿包含甚麼?

具體規格,方便你與現時使用的工具直接比較。

輸入
音訊及影片檔案,或公開的 YouTube/Instagram/Facebook 連結
準確率
平均 98%
語言
95+ 種,包括句中中英夾雜
結構
自動辨識講者、還原標點及分段
匯出格式
SRT, VTT, TXT, DOCX, XLSX, Markdown
免費計劃
每條檔案首 15 分鐘,每月 3 條

每週開會卻寫不完逐字稿?

「會開完了,逐字稿還沒整理」— 這是知識工作者的長期痛點。手動聽打太花時間、人寫的摘要品質不一、共享時點又拖延。Subanana 的 AI 會議逐字稿工具,把這整套流程自動化。

兩種輸入方式:機器人加會議 vs 檔案上傳

Google Meet 與 Microsoft Teams 支援透過行事曆連結,讓 Subanana 機器人自動加入。事前綁定行事曆後,排定時間的會議一到,機器人就會進入、錄音、轉文字、產生摘要。會議結束數分鐘內,逐字稿草稿就準備好了。

如果你不想用機器人,也能直接上傳錄音檔(.mp4/.mov/.m4a/.mp3 等格式,最大 30 GB/8 小時)。訪談、研討會錄音、Podcast 素材,凡是事後處理的場景都涵蓋。

講者分離與好讀的逐字稿

會議逐字稿最重要的是「誰說了什麼」。Subanana 的講者分離(diarization)會自動識別多位發言者,產生依人物排版的逐字稿。講者數可以手動設定或交給 AI 自動判斷。

而且在逐字稿模式下,標點符號與段落會自動加上 — 輸出就是好讀的書面語,能直接複製貼上到 Slack 或 Notion,不用再手動潤稿。

摘要用什麼 LLM 你來挑

Subanana 的特色是「不綁定單一模型」。摘要這一步可以選 Gemini 3.1 Pro、Gemini 2.5 Pro、GPT-5.2、Grok 4 等高階 LLM,或是速度更快的 Gemini Flash、DeepSeek。新的高性能模型上市時會被評估後加入名單。重要的經營會議用 Pro 模型、每日站立會議用 Flash 模型,依場景搭配。

你會拿到什麼

- 整理過的逐字稿(含標點、分段、講者識別) - 會議重點、決議、待辦事項的摘要 - 任意語言的翻譯(支援 95+ 種語言) - 編輯器內 AI 對話 — 直接問「第二個議題決定了什麼」、「誰負責了哪個項目」,AI 會根據逐字稿給答案

這個「直接問逐字稿」的功能,把單份會議紀錄升級成可搜尋的會議知識庫。

與其他逐字稿工具的差異

其他工具靠「支援多少種會議軟體」競爭(Otter 涵蓋 Zoom、Fireflies 支援更多平台)。Subanana 走的是另一條路 — 模型品質與持續評估、辨識錯誤的自動 fallback、字幕與翻譯整合在同一平台。

大家常問的問題常見問題

平均準確率達 98%。錄音清晰度、背景噪音及專業術語都會影響結果,上載自訂詞彙表可明顯改善專有名詞。

所有計劃單一檔案最長 8h、最大 30GB。免費計劃可預覽每條檔案首 15 分鐘,每月 3 條。

可以。系統自動辨識講者並在逐字稿全程標示,講者數目可手動指定,亦可由系統判斷。

可以。輸出及翻譯的目標語言都可以指定繁體中文,亦可選擇簡體中文。

SRT, VTT, TXT, DOCX, XLSX, Markdown,或一次過下載包含全部格式的 ZIP。訪談逐字稿常用 DOCX,需要排序或篩選的資料則用 XLSX。

不會。無論任何處理模式,錄音及逐字稿都不會用於訓練模型。資料以加密方式儲存,關鍵資訊會去識別化,每次存取都有紀錄。

更新於 2026-05-08

別再把說過的話重新打一次。

把語音變成可以直接交付的成品。

免費開始