採訪與訪談錄音
記者與文字工作者
截稿時間是固定的,但引述一個字都不能錯,還要交代誰在什麼時候說的。
錄音檔也好,會議錄音也好,影片也好——上傳或貼上公開連結,AI 就會自動把語音轉成文字。分好講者、補回標點與分段,拿到手就能讀的逐字稿。支援 95+ 種語言,平均準確率 98%。不必安裝軟體,每個檔案前 15 分鐘可以免費先看結果。

這次改版會把申請流程從三個步驟縮成一個步驟。
現在平均要填五次資料,之後填一次就好了。
三月試營運的時候,完成率從六成拉到八成五。
正式上線預計排在下個月十五號。
























週會錄音_0721.m4a
M4A · 43:18 · 已上傳
轉成文字
今天先把整個時程分成三個階段跟大家說明。
第一個階段是上傳檔案,大概兩分鐘就結束了。
第二個是確認,匯出是第三個階段。
文字格式
TXTDOCXXLSXMarkdown逐字稿
TXT · DOCX · XLSX · Markdown
字幕檔
SRT · VTT
翻譯後的文字
95+ 種語言
摘要
30+ 範本 · 決議 · 待辦
向逐字稿提問
答案指回出處
從上傳錄音檔、轉成文字、校對,到匯出——要做的事情在同一個地方做完。
四種現場,同一個問題——一小時的錄音,用手聽打要花掉好幾個小時。
採訪與訪談錄音
截稿時間是固定的,但引述一個字都不能錯,還要交代誰在什麼時候說的。
課堂與研究訪談錄音
一整個學期的錄音檔堆在那裡,可是沒有人有時間為了找一段引文重聽一次。
會議與專案討論錄音
轉成逐字稿之後,後來決定了什麼、誰要負責,之後用搜尋就找得回來。
節目與 Podcast
一份轉好的文字,可以拿去寫說明欄、寫部落格、寫貼文,不必從頭再聽一遍。
以下沒有一項是你會為它換工具的理由,但每次要把一段語音變成文字,它們都在。
細節在產品裡——開一個免費工作區大約一分鐘。
在產品中看看可以免費開始。用免費帳號上傳檔案,每個檔案可以看到前 15 分鐘的轉寫結果,每月 3 個檔案,不需要綁信用卡。把文字或字幕匯出成檔案是付費方案的功能——也就是說,免費方案是讓你先確認自己的音檔究竟能被轉得多準,再決定要不要付費。
可以。MP3、M4A、WAV 等音訊檔,以及 MP4、MOV、WEBM 等影片檔,都可以直接從瀏覽器上傳,不必安裝軟體。單一檔案最長 8 小時、最大 30 GB,這個上限所有方案都一樣。
可以。錄音筆的檔案、手機的語音備忘錄、會議室裡錄下來的音訊,都不必先轉檔,直接上傳就好。錄音時離講話的人越近、背景越安靜,準確率就越高。
是的。這是在瀏覽器裡開啟的網頁服務,沒有要安裝的軟體。上傳、轉文字、確認、匯出,全部在網站裡完成。貼上 YouTube、Instagram、Facebook 的公開連結,也可以不下載影片就直接轉。
平均 98%。準確率會隨音質、背景雜音、專業術語多寡而上下,把公司名與人名登錄進詞彙表,專有名詞的寫法會明顯改善。系統依語言自動分配到評測成績最好的模型,所以不會被單一家模型的強弱綁住。
每一份轉寫結果都會做品質檢查。出現與音訊對不上的內容時,那一段會自動換另一個模型重新處理,不會就這樣寫進逐字稿。靜音就是靜音,不會變成模型想像出來的一句話。內部換模型重跑不會額外扣除額度,扣的只有那一個檔案的份量。
講者會自動辨識並標記,人數也可以自己指定。標點與分段也會自動補回來,不會變成一長串沒有斷句的文字。匯出有 TXT、DOCX、XLSX、Markdown,字幕則是 SRT 與 VTT,也可以一次打包成 ZIP(不支援 PDF 匯出)。
可以。支援 95+ 種語言,中文句子裡夾英文產品名、公司名的說話方式也處理得來。轉寫完成後,還可以再拿到翻譯成另一種語言的文字。
可以免費開始。用免費帳號上傳檔案,每個檔案可以看到前 15 分鐘的轉寫結果,每月 3 個檔案,不需要綁信用卡。把文字或字幕匯出成檔案是付費方案的功能——也就是說,免費方案是讓你先確認自己的音檔究竟能被轉得多準,再決定要不要付費。
可以。MP3、M4A、WAV 等音訊檔,以及 MP4、MOV、WEBM 等影片檔,都可以直接從瀏覽器上傳,不必安裝軟體。單一檔案最長 8 小時、最大 30 GB,這個上限所有方案都一樣。
可以。錄音筆的檔案、手機的語音備忘錄、會議室裡錄下來的音訊,都不必先轉檔,直接上傳就好。錄音時離講話的人越近、背景越安靜,準確率就越高。
是的。這是在瀏覽器裡開啟的網頁服務,沒有要安裝的軟體。上傳、轉文字、確認、匯出,全部在網站裡完成。貼上 YouTube、Instagram、Facebook 的公開連結,也可以不下載影片就直接轉。
平均 98%。準確率會隨音質、背景雜音、專業術語多寡而上下,把公司名與人名登錄進詞彙表,專有名詞的寫法會明顯改善。系統依語言自動分配到評測成績最好的模型,所以不會被單一家模型的強弱綁住。
每一份轉寫結果都會做品質檢查。出現與音訊對不上的內容時,那一段會自動換另一個模型重新處理,不會就這樣寫進逐字稿。靜音就是靜音,不會變成模型想像出來的一句話。內部換模型重跑不會額外扣除額度,扣的只有那一個檔案的份量。
講者會自動辨識並標記,人數也可以自己指定。標點與分段也會自動補回來,不會變成一長串沒有斷句的文字。匯出有 TXT、DOCX、XLSX、Markdown,字幕則是 SRT 與 VTT,也可以一次打包成 ZIP(不支援 PDF 匯出)。
可以。支援 95+ 種語言,中文句子裡夾英文產品名、公司名的說話方式也處理得來。轉寫完成後,還可以再拿到翻譯成另一種語言的文字。
別再把說過的話重新打一次。