語音轉文字 · Speech to Text

語音轉文字 — AI 將錄音及影片自動轉成文字.

語音轉文字(Speech-to-Text)是利用 AI 語音辨識技術,將說話內容自動轉換成可編輯、可搜尋文字的過程。Subanana 支援廣東話(包括中英夾雜及口語轉書面語)以及 95+ 種語言,準確率達 98%。

免費開始免費預覽 15 分鐘 · 無須信用卡

字幕與翻譯

創作者 · 課程 · Podcast

創作者在家庭工作室對著鏡頭揮手CC

English

Let’s dive right in.

ENESFRDEPT+101
了解更多

會議與記錄助手

產品團隊 · 銷售團隊 · 學校 · 非牟利機構

✦ AI

每週同步會 — 筆記

Jul 25
MAK
已分享

支援平台

Google MeetGoogle MeetZoomZoomTeamsTeams
了解更多

即時字幕與活動

網絡研討會 · 課堂 · 現場活動

LIVE

Captions appear as people speak.

EN ES場內屏幕觀眾手機
了解更多

訪談與研究

用戶研究 · 學術研究 · 口述歷史

“”12 個結果

00:41:22 Maya ……真正的洞察在第二週才出現……

01:12:08 Alex ……那個洞察改變了我們的路線圖……

01:38:47 Priya ……同樣的洞察在三場訪談中出現……

02:05:19 Sam ……我們把每個洞察按主題標記……

了解更多
  • HKU
  • HKTV
  • BEA
  • HKSTP
  • Hong Kong Disneyland
  • HK01
  • Snapask
  • Sky Post
  • USC
  • Greenpeace
  • HKU
  • HKTV
  • BEA
  • HKSTP
  • Hong Kong Disneyland
  • HK01
  • Snapask
  • Sky Post
  • USC
  • Greenpeace

它是怎樣運作的?

產品規劃會議

M4A · 58:12 · 已上載

上載檔案、貼上連結,或在瀏覽器錄音廣東話、普通話、英語混講都可以

逐字稿

00:12

我哋今季重點係 retention,唔係新客。

00:19

五月個 churn 高咗,要搵原因。

00:27

呢個 action 我跟,下星期三覆返大家。

一次輸出

口語 · 繁書面語 · 繁書面語 · 簡English

逐字稿

TXT · DOCX · XLSX · Markdown

字幕檔

SRT · VTT

翻譯

95+ 種語言互譯

會議記錄

摘要 · 待辦事項

向錄音提問

金句、重點、答案

一小時錄音,不用重聽一次的九個理由。

這不是功能清單——而是決定逐字稿可不可以直接使用的那些事。

任何來源的聲音都能匯入

  • 上載檔案或貼上連結MP3、M4A、WAV 或 MP4——又或者一條 YouTube、Instagram、Facebook 連結。
  • 在瀏覽器直接錄會議或訪問當下開錄,毋須另外安裝軟件。
  • 電話與錄音筆檔案常見格式都讀得懂,語音備忘也可以。
  • 沿用已完成的項目同一段媒體之後可再輸出字幕,不另收費。

廣東話與 95+ 種語言,一次選定

  • 開始前一次選齊混合語言可自動辨識,超過 95 種可供選擇。
  • 廣東話四種輸出口語/書面語 × 繁體/簡體——在語言選項中選定。
  • 原文始終作準修正原文後,變更會套用到所有譯文,不用逐份重做。
  • 之後也可新增語言只會處理新增的部分;已完成的不會改動。

你的專有名詞不會被寫錯

  • 把詞彙標為全域人名、產品名和行話,每個項目都照這個寫法出現。
  • 或者逐種語言指定某個市場用另一個名,就只為那種語言設定。
  • 工作區詞彙表按語言自動套用,之後開的每個項目都適用。
  • 匯入或自動抽取由 CSV 或 XLSX 載入,或讓 AI 從 PDF 抽出候選詞。

需要字幕時,同一份文字直接出

  • 兩種字幕樣式外框加陰影,或者一個可調透明度的背景色塊。
  • 逐條字幕軌設定樣式主要與次要語言各自設定,雙語一樣看得清楚。
  • 字級自動調整長句會留在畫面之內,不會衝出邊緣。
  • 在畫面上即時預覽字型、大小、顏色、對齊和留白,邊調邊看。

影片版本也一併出,最高 4K

  • 最高 4K720P、1080P、2K 或 4K,樣式與你設定的完全一樣。
  • 雙語一併燒錄主要與次要語言排在同一個畫面,樣式各自設定。
  • 用你的浮水印,或者不要可以完全隱藏預設那個,也可以換成你自己的。
  • 在背景算圖你可以繼續編輯;算圖用的是按下按鈕那一刻的版本。

在任何人看到之前先校對

  • 100 分為滿分的評分建議按類別分組,通常十至三十秒內出結果。
  • 逐組批准你同意的那幾組才套用,其餘原封不動。
  • 時間碼絕不移動斷行和標點會修好,時間不會跟著跑掉。
  • 完全可以不用未按下按鈕之前不會有任何改動,想跳過也可以。

摘要與文案一併附上

  • 會議摘要與待辦30 種以上範本,決定事項與負責人自動抽出。
  • 章節與金句長錄音自動分段;訪問的引述直接可用。
  • 翻譯過的摘要製作其他語言版本時,摘要也會一併翻譯。
  • 每句都有出處每個答案都指回它出自哪一句,你可以逐句核對。

憑空生成的字句,不會混進你的逐字稿

  • 兩重偵測,不只一重每一段音訊都會經過靜音偵測和引擎端檢查,可疑的字句在哪裡出現,就在哪裡標記。
  • 自動重新處理被標記的片段會交由另一個引擎重跑,不會就這樣寫進你的檔案。
  • 靜默就是靜默停頓就是停頓,不會變成模型想像出來的一句話。

平台要哪個檔,就交哪個

  • 字幕檔SRT 與 VTT,單語或雙語。
  • 文字與表格DOCX、XLSX、TXT、Markdown——發言者與時間戳一併帶出。
  • 一次打包多種格式可一次過下載 ZIP。
  • 分享連結傳給同事看結果,對方無須開設帳戶。

把說話變成可以直接使用的文字——四種場景,同一個流程。

會議、訪問、課堂、創作——分別只在輸出:逐字稿、會議記錄、字幕還是摘要。

會議與客戶通話

公司團隊

逐字稿之上再要摘要、決定事項和待辦——會後直接分享給同事跟進。

影片與 Podcast

內容創作者

同一份文字稿出字幕、簡介和金句,口語可轉成書面語入文。

訪問與發布會

記者與研究人員

引述必須逐字準確、標明發言者,還要快——截稿不等人。

課堂與講座

學生與教學

長錄音自動分章節、出摘要,重溫時毋須逐分鐘拖進度條。

其餘的功能。

以下沒有一項是你轉用的理由,但每逢要交出結果,它們都在。

上載檔案貼上連結瀏覽器錄音發言者辨識自訂詞彙表口語/書面語輸出繁簡輸出尋找與取代含聲波的時間軸AI 摘要會議範本向錄音提問SRT · VTT 匯出DOCX · XLSX 匯出TXT · Markdown 匯出一次打包下載分享連結免登入工作區角色切換項目類型

細節在產品裡——開一個免費工作區大約需要一分鐘。

在產品中看看

開始之前大家都會問的問題

Subanana 的準確率達 98%。實際表現受錄音清晰度、背景噪音及專業術語影響;上載自訂詞彙表及背景資料(例如議程、簡報)可進一步提升專有名詞的辨識準確度。

支援。廣東話是 Subanana 的核心語言,並非附帶功能;一句話內粵英混用的內容亦能準確辨識,無需預先將中英文分開處理。

可以。在輸出或翻譯目標語言中選擇「書面語」即可,繁體及簡體均可選——例如「佢哋而家搞掂咗」會輸出為「他們現在處理好了」。

可以。免費計劃無需先付款,可上載檔案並預覽每條檔案首 15 分鐘的轉寫結果(每月 3 條檔案、合共 1 小時)。匯出 DOCX、SRT 等文字檔案屬付費計劃功能。

支援常見音訊及影片檔案,付費計劃單一檔案最長 3 小時、最大 15 GB;亦可直接貼上公開的 YouTube、Instagram 或 Facebook 連結轉寫,無需下載檔案。

安全。關鍵資訊會作去識別化處理,你的內容不會用於訓練 AI 模型,資料以加密方式儲存及保護。