文字起こし · Transcription

音声・録音・動画を、AI で文字起こし.

音声ファイルも、ボイスレコーダーの録音も、動画も——アップロードするか公開リンクを貼るだけで、AI が自動で文字起こしします。話者を分け、句読点と段落を戻した、そのまま読めるテキストになって返ってきます。95+ 言語に対応し、平均精度は 98%。インストールは不要で、各ファイル最初の 15 分は無料で試せます。

無料ではじめる各ファイル 15 分まで無料 · カード不要
A still lake at first light
plus.subanana.com
文字起こし
話者 100:14:02

今回の改定で、申請の手順を三段階から一段階に減らします。

話者 200:14:11

いまは平均で五回の入力が必要ですが、以降は一回で済みます。

話者 100:14:20

三月の試験運用では、完了率が六割から八割五分まで上がりました。

話者 200:14:31

正式な公開は来月十五日を予定しています。

  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush
  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush

どう動くのか

営業定例_0715.m4a

M4A · 42:07 · アップロード済み

MP3・M4A・WAV の音声、MP4・MOV の動画、または公開リンク1 ファイル最長 8 時間・最大 30 GB、どのプランでも同じ

文字起こしする

00:12

本日はまず、全体の流れを三つの段階に分けて説明します。

00:21

第一段階はファイルのアップロードで、二分ほどで終わります。

00:29

第二段階が確認、書き出しは第三段階です。

話者の判別話者 1話者 2句読点と段落を復元

テキスト形式

TXTDOCXXLSXMarkdown

文字起こし

TXT · DOCX · XLSX · Markdown

字幕ファイル

SRT · VTT

翻訳したテキスト

95+ 言語

要約

30+ テンプレート · 決定事項 · ToDo

文字起こしに質問

答えは発言に紐づく

手で聞き起こさなくてよくなる、九つの理由。

音声ファイルを渡すところから、文字起こし、校正、書き出しまで——文字起こしに必要な作業が、一か所で終わります。

音声も録音も動画も、そのまま持ち込める

  • ファイルをアップロードするMP3、M4A、WAV の音声も、MP4、MOV、WEBM の動画も、ブラウザにドラッグするだけです。
  • 公開リンクを貼るYouTube、Instagram、Facebook の公開リンクなら、動画を手元に落とさずに取り込めます。
  • 長い録音も分けなくていい1 ファイル最長 8 時間・最大 30 GB。どのプランでも同じ上限です。
  • 会議はボットに録らせるGoogle Meet と Microsoft Teams なら、ボットが予定どおり参加して録音し、終了後に文字起こしします。

必要な形式で、そのまま書き出せる

  • 文書にも表にもTXT、DOCX、XLSX、Markdown — 話者とタイムスタンプを付けたまま書き出せます。
  • 字幕ファイルもSRT と VTT。単一言語でも、二言語をまとめた形でも。
  • まとめて受け取るすべての形式を ZIP に固めて一度にダウンロードできます。
  • 書き出しは有料プランから無料プランは結果を確かめるところまで。テキストや字幕をファイルとして持ち出せるのは有料プランです。

聞こえていない一文が、文字起こしに混ざらない

  • 検知は二重にかけるAI ハルシネーション検知とエンジン側のチェックを全区間にかけ、疑わしい箇所に印をつけます。
  • 印のついた区間は別のエンジンへそのまま文字起こしに反映させず、自動で別のモデルで処理し直します。
  • 無音は無音のまま間は間であって、モデルが想像した一文ではありません。
  • やり直しに追加料金はない内部で何度モデルを替えても、消費するのはファイル 1 本ぶんだけです。

人に見せる前に、AI に校正させる

  • 100 点満点のスコア聞き違いや句読点など、直したほうがよい箇所を種類別に提案します。
  • グループ単位で承認する採用したグループだけが反映され、残りはそのままです。
  • タイムコードは動かない校正が変えるのは文言だけで、時間軸には触れません。
  • 使わなくてもいいボタンを押すまで、文字起こしは一文字も変わりません。

日本語も、英語が混ざった話し方も聞き分ける

  • 95+ 言語に対応元の言語を選ぶと、その言語のベンチマークで最も成績のよいモデルへ自動で振り分けられます。
  • 文の途中で言語が変わっても日本語の文に英語の製品名や社名が混ざる話し方にも対応します。
  • そのまま翻訳もできる同じ音源から、別の言語に翻訳したテキストも受け取れます。
  • 選ぶのは最初の一度だけアップロードのときに元の言語と出力を決めれば、あとは待つだけです。

固有名詞と専門用語が、正しい表記で出てくる

  • ワークスペース用語集社名、人名、社内用語を一度登録すれば、以降のファイルはすべてその表記に揃います。
  • 全体にも、案件ごとにもワークスペース全体に効かせるか、特定のプロジェクトだけに紐づけるかを選べます。語ごとに全言語共通か言語別かも指定できます。
  • 手元の一覧を取り込むXLSX や CSV の用語リストをそのまま読み込めます。
  • 背景資料も一緒に渡すPDF、DOCX、スライド、URL を参考資料として渡すと、その文脈を踏まえて処理します。

同じ文字起こしから、文字起こし以上のものが出てくる

  • 要約テンプレートは 30 種類以上会議、講演、ビジネス、医療、法務など、目的別のテンプレートから選べます。
  • 決まったことと、次にやること議論の要点、決定事項、担当と次の行動を抜き出します。
  • 要約に使うモデルは自分で選ぶ要約だけは、使う AI モデルをご自身で選べます(ほかの処理は自動で振り分けます)。
  • 文字起こしに直接聞く「何が決まったか」と尋ねれば、根拠になった発言を示しながら答えます。

字幕も要るなら、見た目まで決めておける

  • スタイルはテンプレートにして使い回す字幕の見た目をワークスペースのテンプレートとして保存し、どのプロジェクトにも適用できます。
  • 既定にしておけば何もしなくていいワークスペースの既定に設定すれば、次の動画から同じ見た目で仕上がります。
  • 二言語をひとつの字幕に元の言語と翻訳を一本の SRT にまとめた二言語字幕を書き出せます。
  • 実際のフレームで確かめる字幕がどう乗るかは、プレビューを見ながら決められます。

テキストではなく、字幕入りの動画がほしいときは

  • 有料プランなら最大 4Kプレビューで見たとおりの字幕のまま書き出せます。
  • 二言語を焼き込む元の言語と翻訳、両方を画面に載せた動画も出せます。
  • 透かしは有料プランで消える無料プランで書き出した動画には透かしが入ります。
  • 無料でも仕上がりは確かめられる無料プランでは最初の 5 分・720p まで、透かし入りの動画を書き出せます。

録音は手元にある。足りないのは、それを読めるテキストにする時間。

四つの現場、同じ問題——手で聞き起こせば、一時間の録音に何時間もかかります。

取材とインタビューの音源

ライター・記者

締め切りは迫っているのに、引用は一言一句正確でなければならず、誰がいつ言ったかまで示さなければなりません。

講義と調査インタビューの録音

研究者・学生

一学期分の録音が溜まり、引用する段になって、聞き直す時間はもう残っていません。

会議と打ち合わせの録音

会社のチーム

文字起こしにしておけば、何が決まって、誰が担当することになったのかを、あとから検索で見つけられます。

配信とポッドキャスト

動画クリエイター

一本の文字起こしから、概要文も記事も投稿文も書けます。もう一度通しで見返す必要はありません。

そのほか、ひととおり。

どれも乗り換える理由にはなりませんが、誰かに渡す段になると全部必要になります。

ファイルのアップロード公開リンクの取り込みGoogle Meet ボットMicrosoft Teams ボットカレンダー連携話者の自動判別話者数の指定句読点と段落の復元ワークスペース用語集背景資料の読み込み要約テンプレート 30+文字起こしへの質問AI 校正の提案SRT・VTT 書き出しDOCX・XLSX 書き出しTXT・Markdown 書き出しZIP で一括ダウンロード二言語字幕と焼き込み

細かい部分は実際の製品でご確認ください。無料のワークスペースは 1 分ほどで作れます。

製品を見る

はじめる前によくある質問

できます。無料アカウントでファイルをアップロードし、各ファイル最初の 15 分ぶんの文字起こしを、月 3 ファイルまで確認できます。カードの登録は不要です。テキストや字幕をファイルとして書き出すのは有料プランの機能です——つまり無料プランは、自分の音源でどこまで正しく起こせるかを先に確かめるための枠だと考えてください。

使えます。MP3、M4A、WAV などの音声と、MP4、MOV、WEBM などの動画を、そのままブラウザからアップロードできます。ソフトのインストールは不要です。1 ファイル最長 8 時間・最大 30 GB で、この上限はどのプランでも同じです。

できます。IC レコーダーの録音、スマートフォンのボイスメモ、会議室で録った音声を、変換せずにそのままアップロードしてください。話者に近く、静かな場所で録った音源ほど精度は上がります。

できます。公開されている YouTube、Instagram、Facebook のリンクを貼れば、Subanana が取り込んで文字起こしします。動画を手元にダウンロードする必要はありません。なお Subanana が返すのは文字起こしであって、他サイトの動画ファイルそのものではありません。

平均で 98% です。音の明瞭さ、背景の雑音、専門用語の多さで上下し、用語集に社名や人名を登録すると固有名詞の表記がはっきり改善します。言語ごとにベンチマークで最も成績のよいモデルへ自動で振り分けているので、一社のモデルの得手不得手に縛られません。

全区間に AI ハルシネーション検知とエンジン側のチェックをかけ、疑わしい箇所には印をつけて、そのまま文字起こしに反映させず、別のモデルで処理し直します。無音は無音のままで、想像した一文にはなりません。内部でモデルを替えて処理し直しても追加で消費されることはなく、消費するのはファイル 1 本ぶんだけです。

話者は自動で判別してラベルが付き、人数を手で指定することもできます。句読点と段落も自動で戻るので、切れ目のない一続きの文章にはなりません。書き出しは TXT、DOCX、XLSX、Markdown、字幕なら SRT と VTT、まとめて ZIP でも受け取れます(PDF での書き出しには対応していません)。

対応しています。95+ 言語に対応し、日本語の文中に英語の製品名や社名が混ざる話し方も扱えます。文字起こしのあとに、別の言語へ翻訳したテキストを受け取ることもできます。