逐字稿產生器:標好講者與時間碼,一份可引用、可存檔的文字紀錄.

將影片或音訊拖曳到這裡
MP4、MOV、MP3、WAV、M4A,最大 2 GB。

繁體中文(台灣)跟隨來源

逐字稿是一份交得出去的文件:每一句都標好是誰說的、說在第幾分幾秒,標點與分段自動補回,訪談、會議或演講的內容從此可以逐句引用。做好的稿子可以匯出成文字檔、表格或字幕檔,直接放進報告、會議紀錄或引註裡。支援 95+ 種語言,平均準確率 98%,不必安裝軟體。

不需信用卡。前 15 分鐘免費預覽。

  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush
  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush

一份錄音,最後會變成什麼?

訪談錄音_0826.wav

WAV · 1:12:40 · 已上傳

MP3·M4A·WAV 音訊、MP4·MOV 影片,或公開連結單檔最長 8 小時、30 GB,所有方案相同

整理成逐字稿

1:11:08

所以現在還是回到人工核對這條路。

1:11:24

如果這件事能自動化,一個月大概能多出三天。

1:11:41

那就先從月底那一版的資料開始試。

講者辨識講者 1講者 2時間碼保留

文字格式

TXTDOCXXLSXMarkdown

逐字稿

TXT · DOCX · XLSX · Markdown

字幕檔

SRT · VTT

譯文

再選一種語言 · 95+ 種可選

摘要與決議

30+ 範本 · 待辦事項

逐字稿問答

答案附上時間碼出處

一份交得出去的逐字稿,九個理由。

每一句都標著講者和時間碼,要查證的時候找得回原句。校對、翻譯、摘要,都在同一份稿子上接著做。

錄音檔從哪裡來都可以

  • 上傳音訊檔或影片檔MP3、M4A、WAV、MP4、MOV、WEBM——錄音檔或影片檔直接拖進瀏覽器就開始轉錄。
  • 或者貼上一條連結公開的 YouTube、Instagram、Facebook 連結,不必先把影片下載下來。
  • 長檔不用先剪開單一檔案最長 8 小時、最大 30 GB,所有方案相同。
  • 錄音筆與手機錄音直接用會議室錄下來的音訊、手機的語音備忘錄,不必先轉檔。

要哪一種文字檔,就有哪一種

  • 文字與表格TXT、DOCX、XLSX、Markdown——講者與時間戳會一併帶出來。
  • 字幕檔SRT 與 VTT,單語或雙語都可以。
  • 一次打包多種格式一次下載成 ZIP。
  • 分享連結傳給同事看結果,對方不必另外開帳號。

憑空生出來的句子,不會寫進你的逐字稿

  • 兩重偵測每一份轉寫結果都會做品質檢查,與音訊對不上的字句當場標記。
  • 自動換引擎重跑被標記的片段交給另一個引擎重新處理,不會就這樣寫進檔案。
  • 靜音就是靜音停頓就是停頓,不會變成模型想像出來的一句話。

交出去之前,先過一次校對

  • 100 分為滿分的評分建議會按類別分組,通常十到三十秒內出結果。
  • 逐組核准聽錯的字、同音字、標點——你同意的那幾組才會套用,其餘原封不動。
  • 時間碼不會動校對只改文字,時間軸維持原樣。
  • 完全可以略過在你按下按鈕之前,不會有任何改動。

內容講什麼語言都認得

  • 95+ 種語言先選定原始語言,系統會依那個語言挑選評測成績最好的辨識模型。
  • 中英夾雜照樣準「這個 quarter 的 target」轉出來不會亂寫,英文詞會保留原文。
  • 繁簡都輸出得了中文的輸出可以是繁體或簡體,在語言選項裡選定。
  • 同時要譯文也可以同一段語音,逐字稿可以再加一種翻譯語言一併拿到。

人名與專有名詞不會被寫錯

  • 工作區詞彙表人名、產品名、行業術語存起來,之後每個檔案都照你的寫法。
  • 逐項套用詞彙可以設定全域套用,或只用在某幾個專案。
  • 匯入你已經有的從 CSV 或 XLSX 批次載入,或讓 AI 從 PDF 抽出候選詞。
  • 套用前先看報告哪些詞被統一了寫法,一眼就看得到。

同一份逐字稿,還能再長出好幾樣

  • 摘要與重點30 種以上範本,長檔的重點自動抽出來。
  • 決議與待辦會議記錄範本會把決定了什麼、誰要做什麼分開列。
  • 章節與金句長檔自動分段,值得引用的句子直接可以用。
  • 向逐字稿提問直接問 AI 助理,每個答案都指回出處那一句。

要順便出字幕,樣式也調得動

  • 兩種樣式底外框加陰影,或是可以調透明度的背景色塊。
  • 字級自動調整長句會自動縮排,不會衝出畫面邊緣。
  • 雙語各自設定原文與譯文兩條軌的樣式互不干擾,同時出現也看得清楚。
  • 邊調邊預覽字型、大小、顏色、對齊、留白,在真實畫面上即時看。

要連字幕一起的成品影片,也可以

  • 最高 4K720P、1080P、2K 或 4K,樣式與預覽完全一致。
  • 雙語一併燒錄兩種語言排在同一個畫面,各自有自己的樣式。
  • 浮水印你決定預設的浮水印可以完全隱藏,或者換成你自己的。
  • 背景算圖算圖期間可以繼續編輯,輸出用的是按下按鈕那一刻的版本。

手上有錄音,但真正要的是一份能存檔、能引用的文件。

四種現場,同一個要求——引述要對得上原話,還要說得出是誰、在第幾分鐘說的。

人物專訪與採訪錄音

記者與編輯

引述一個字都不能改,出處還要交代得出來。訪談逐字稿先出來,稿子才寫得下去。

質性訪談與田野錄音

研究者與研究生

論文要引的那句話埋在兩小時的音檔裡。有了逐字稿,編碼與引註直接在文字上做,不必反覆倒帶。

會議與說明會的正式紀錄

公司團隊

會議逐字稿留成紀錄之後,誰答應了什麼、決定是哪一天改的,用搜尋就查得回來。法遵或稽核要回頭確認時,也有原話可以對。

節目、Podcast 與線上課程

影音創作者

整集的逐字稿可以當腳本回頭修,也可以挑出精華段落改寫成貼文與說明欄——每一段都指得回原本在第幾分鐘。

其餘的功能。

以下沒有一項是你會為它換工具的理由,但每次要把一段語音變成文字,它們都在。

上傳音訊檔上傳影片檔貼上公開連結講者辨識自訂講者人數自訂詞彙表背景資料參考繁簡輸出尋找與取代含聲波的時間軸AI 校對建議AI 摘要會議記錄範本章節標記向逐字稿提問SRT · VTT 匯出DOCX · XLSX 匯出TXT · Markdown 匯出一次打包下載分享連結免登入

細節在產品裡——開一個免費工作區大約一分鐘。

在產品中看看

動手之前常見問題

可以先免費做。註冊之後上傳檔案,每個檔案都會免費產出前 15 分鐘的逐字稿,每個月 3 個檔案,不必綁信用卡。把逐字稿或字幕下載成檔案是付費方案的功能——先看過前 15 分鐘、確認準確度符合你的要求,再決定要不要付費。

MP3、M4A、WAV 這類音訊檔,還有 MP4、MOV、WEBM 這類影片檔,都可以直接從瀏覽器上傳。單一檔案最長 8 小時、最大 30 GB,免費和付費方案的上限一樣。錄音檔轉逐字稿之前不必自己先轉檔或壓縮,原本錄成什麼就上傳什麼。

可以。錄音筆的 WAV、手機的語音備忘錄、會議室桌上放著錄的音檔,上傳完就會開始處理。麥克風離說話的人越近、環境越安靜,音檔轉逐字稿的結果就越乾淨;現場人多的時候,把收音的裝置放在桌子中間,講者之間也分得比較開。

不必安裝任何軟體,整個流程都在瀏覽器裡完成:上傳、產出逐字稿、確認內容、匯出。手上沒有檔案、只有網址的話,貼上 YouTube、Instagram、Facebook 的公開連結也可以,不必先把影片下載下來。

平均準確率 98%。實際表現會隨錄音品質、背景雜音和專業術語的密度浮動;先把人名、公司名和專案代號加進詞彙表,這些寫法會穩定很多。系統會持續評測各家語音辨識模型,再依語言把檔案分配給表現最好的那一個,不會被單一模型的強弱綁住。

不會讓它就這樣寫進稿子。每一段轉寫都會和音訊比對,只要對不起來,那一段就自動換另一個模型重跑,而不是把猜出來的句子留在逐字稿裡。沒有人說話的地方就是空白,不會被填成台詞。重跑不額外扣額度,計費只算這個檔案本身的長度,而且只算一次。

講者會自動辨識並標上編號,如果你已經知道現場有幾個人,也可以直接指定人數。標點和分段同樣會自動補回來,不會拿到一整片沒有斷句的文字。匯出的文字格式有 TXT、DOCX、XLSX、Markdown,字幕是 SRT 和 VTT,這六種也可以一次打包成 ZIP 下載(不支援 PDF 匯出)。

可以。支援 95+ 種語言,中文句子裡夾著英文產品名、職稱或技術詞的說法也處理得來。語音檔轉逐字稿完成之後,還可以把整份稿子再翻成另一種語言——逐字稿模式一份工作指定一個翻譯語言。

別再把說過的話重新打一次。

把語音變成可以直接交付的成品。

免費開始