人物專訪與採訪錄音
記者與編輯
引述一個字都不能改,出處還要交代得出來。訪談逐字稿先出來,稿子才寫得下去。
逐字稿是一份交得出去的文件:每一句都標好是誰說的、說在第幾分幾秒,標點與分段自動補回,訪談、會議或演講的內容從此可以逐句引用。做好的稿子可以匯出成文字檔、表格或字幕檔,直接放進報告、會議紀錄或引註裡。支援 95+ 種語言,平均準確率 98%,不必安裝軟體。
不需信用卡。前 15 分鐘免費預覽。
























訪談錄音_0826.wav
WAV · 1:12:40 · 已上傳
整理成逐字稿
所以現在還是回到人工核對這條路。
如果這件事能自動化,一個月大概能多出三天。
那就先從月底那一版的資料開始試。
文字格式
TXTDOCXXLSXMarkdown逐字稿
TXT · DOCX · XLSX · Markdown
字幕檔
SRT · VTT
譯文
再選一種語言 · 95+ 種可選
摘要與決議
30+ 範本 · 待辦事項
逐字稿問答
答案附上時間碼出處
每一句都標著講者和時間碼,要查證的時候找得回原句。校對、翻譯、摘要,都在同一份稿子上接著做。
四種現場,同一個要求——引述要對得上原話,還要說得出是誰、在第幾分鐘說的。
人物專訪與採訪錄音
引述一個字都不能改,出處還要交代得出來。訪談逐字稿先出來,稿子才寫得下去。
質性訪談與田野錄音
論文要引的那句話埋在兩小時的音檔裡。有了逐字稿,編碼與引註直接在文字上做,不必反覆倒帶。
會議與說明會的正式紀錄
會議逐字稿留成紀錄之後,誰答應了什麼、決定是哪一天改的,用搜尋就查得回來。法遵或稽核要回頭確認時,也有原話可以對。
節目、Podcast 與線上課程
整集的逐字稿可以當腳本回頭修,也可以挑出精華段落改寫成貼文與說明欄——每一段都指得回原本在第幾分鐘。
以下沒有一項是你會為它換工具的理由,但每次要把一段語音變成文字,它們都在。
細節在產品裡——開一個免費工作區大約一分鐘。
在產品中看看可以先免費做。註冊之後上傳檔案,每個檔案都會免費產出前 15 分鐘的逐字稿,每個月 3 個檔案,不必綁信用卡。把逐字稿或字幕下載成檔案是付費方案的功能——先看過前 15 分鐘、確認準確度符合你的要求,再決定要不要付費。
MP3、M4A、WAV 這類音訊檔,還有 MP4、MOV、WEBM 這類影片檔,都可以直接從瀏覽器上傳。單一檔案最長 8 小時、最大 30 GB,免費和付費方案的上限一樣。錄音檔轉逐字稿之前不必自己先轉檔或壓縮,原本錄成什麼就上傳什麼。
可以。錄音筆的 WAV、手機的語音備忘錄、會議室桌上放著錄的音檔,上傳完就會開始處理。麥克風離說話的人越近、環境越安靜,音檔轉逐字稿的結果就越乾淨;現場人多的時候,把收音的裝置放在桌子中間,講者之間也分得比較開。
不必安裝任何軟體,整個流程都在瀏覽器裡完成:上傳、產出逐字稿、確認內容、匯出。手上沒有檔案、只有網址的話,貼上 YouTube、Instagram、Facebook 的公開連結也可以,不必先把影片下載下來。
平均準確率 98%。實際表現會隨錄音品質、背景雜音和專業術語的密度浮動;先把人名、公司名和專案代號加進詞彙表,這些寫法會穩定很多。系統會持續評測各家語音辨識模型,再依語言把檔案分配給表現最好的那一個,不會被單一模型的強弱綁住。
不會讓它就這樣寫進稿子。每一段轉寫都會和音訊比對,只要對不起來,那一段就自動換另一個模型重跑,而不是把猜出來的句子留在逐字稿裡。沒有人說話的地方就是空白,不會被填成台詞。重跑不額外扣額度,計費只算這個檔案本身的長度,而且只算一次。
講者會自動辨識並標上編號,如果你已經知道現場有幾個人,也可以直接指定人數。標點和分段同樣會自動補回來,不會拿到一整片沒有斷句的文字。匯出的文字格式有 TXT、DOCX、XLSX、Markdown,字幕是 SRT 和 VTT,這六種也可以一次打包成 ZIP 下載(不支援 PDF 匯出)。
可以。支援 95+ 種語言,中文句子裡夾著英文產品名、職稱或技術詞的說法也處理得來。語音檔轉逐字稿完成之後,還可以把整份稿子再翻成另一種語言——逐字稿模式一份工作指定一個翻譯語言。
可以先免費做。註冊之後上傳檔案,每個檔案都會免費產出前 15 分鐘的逐字稿,每個月 3 個檔案,不必綁信用卡。把逐字稿或字幕下載成檔案是付費方案的功能——先看過前 15 分鐘、確認準確度符合你的要求,再決定要不要付費。
MP3、M4A、WAV 這類音訊檔,還有 MP4、MOV、WEBM 這類影片檔,都可以直接從瀏覽器上傳。單一檔案最長 8 小時、最大 30 GB,免費和付費方案的上限一樣。錄音檔轉逐字稿之前不必自己先轉檔或壓縮,原本錄成什麼就上傳什麼。
可以。錄音筆的 WAV、手機的語音備忘錄、會議室桌上放著錄的音檔,上傳完就會開始處理。麥克風離說話的人越近、環境越安靜,音檔轉逐字稿的結果就越乾淨;現場人多的時候,把收音的裝置放在桌子中間,講者之間也分得比較開。
不必安裝任何軟體,整個流程都在瀏覽器裡完成:上傳、產出逐字稿、確認內容、匯出。手上沒有檔案、只有網址的話,貼上 YouTube、Instagram、Facebook 的公開連結也可以,不必先把影片下載下來。
平均準確率 98%。實際表現會隨錄音品質、背景雜音和專業術語的密度浮動;先把人名、公司名和專案代號加進詞彙表,這些寫法會穩定很多。系統會持續評測各家語音辨識模型,再依語言把檔案分配給表現最好的那一個,不會被單一模型的強弱綁住。
不會讓它就這樣寫進稿子。每一段轉寫都會和音訊比對,只要對不起來,那一段就自動換另一個模型重跑,而不是把猜出來的句子留在逐字稿裡。沒有人說話的地方就是空白,不會被填成台詞。重跑不額外扣額度,計費只算這個檔案本身的長度,而且只算一次。
講者會自動辨識並標上編號,如果你已經知道現場有幾個人,也可以直接指定人數。標點和分段同樣會自動補回來,不會拿到一整片沒有斷句的文字。匯出的文字格式有 TXT、DOCX、XLSX、Markdown,字幕是 SRT 和 VTT,這六種也可以一次打包成 ZIP 下載(不支援 PDF 匯出)。
可以。支援 95+ 種語言,中文句子裡夾著英文產品名、職稱或技術詞的說法也處理得來。語音檔轉逐字稿完成之後,還可以把整份稿子再翻成另一種語言——逐字稿模式一份工作指定一個翻譯語言。
別再把說過的話重新打一次。