ボイスメモ · Voice Memo

ボイスメモを、そのまま読めるテキストに.

スマートフォンで録ったボイスメモを、ブラウザにドラッグするだけ。iPhone のボイスメモが書き出す .m4a も、Android の録音アプリの .m4a/.mp3/.opus も、変換せずにそのまま文字起こしします。話者を分け、句読点と段落を戻した、検索できるテキストになって返ってきます。95+ 言語に対応し、平均精度は 98%。各ファイル最初の 15 分は無料で試せます。

無料ではじめる各ファイル 15 分まで無料 · カード不要
Pines standing in quiet morning light
plus.subanana.com
文字起こし
話者 100:03:12

まず、今の体制になった経緯から伺えますか。

話者 200:03:21

三年前に、二人で始めたのが最初です。

話者 100:03:35

その頃から、記録は残していたのですか。

話者 200:03:44

打ち合わせは、ほとんど録音していました。

  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush
  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush

どう動くのか

取材メモ_0810.m4a

M4A · 27:41 · アップロード済み

iPhone のボイスメモの .m4a、Android の .m4a・.mp3・.opus、そのまま1 ファイル最長 8 時間・最大 30 GB、どのプランでも同じ

文字起こしする

00:08

録音したまま聞き返していないメモが、かなり溜まっています。

00:17

まず今週の分だけ、文字にして読めるようにします。

00:26

見出しを付けたら、必要なところだけ拾えます。

話者の判別話者 1話者 2句読点と段落を復元

テキスト形式

TXTDOCXXLSXMarkdown

文字起こし

TXT · DOCX · XLSX · Markdown

字幕ファイル

SRT · VTT

翻訳したテキスト

95+ 言語から 1 つ

要約

30+ テンプレート · 決定事項 · ToDo

文字起こしに質問

答えは発言に紐づく

録音したまま溜まっていくのを、やめる九つの理由。

ボイスメモを渡すところから、文字起こし、校正、書き出しまで——アプリを入れ替えずに、一か所で終わります。

音声も録音も動画も、そのまま持ち込める

  • ファイルをアップロードするMP3、M4A、WAV の音声も、MP4、MOV、WEBM の動画も、ブラウザにドラッグするだけです。
  • 公開リンクを貼るYouTube、Instagram、Facebook の公開リンクなら、動画を手元に落とさずに取り込めます。
  • 長い録音も分けなくていい1 ファイル最長 8 時間・最大 30 GB。どのプランでも同じ上限です。
  • 会議はボットに録らせるGoogle Meet と Microsoft Teams なら、ボットが予定どおり参加して録音し、終了後に文字起こしします。

必要な形式で、そのまま書き出せる

  • 文書にも表にもTXT、DOCX、XLSX、Markdown — 話者とタイムスタンプを付けたまま書き出せます。
  • 字幕ファイルもSRT と VTT。単一言語でも、二言語をまとめた形でも。
  • まとめて受け取るすべての形式を ZIP に固めて一度にダウンロードできます。
  • 書き出しは有料プランから無料プランは結果を確かめるところまで。テキストや字幕をファイルとして持ち出せるのは有料プランです。

人に見せる前に、AI に校正させる

  • 100 点満点のスコア聞き違いや句読点など、直したほうがよい箇所を種類別に提案します。
  • グループ単位で承認する採用したグループだけが反映され、残りはそのままです。
  • タイムコードは動かない校正が変えるのは文言だけで、時間軸には触れません。
  • 使わなくてもいいボタンを押すまで、文字起こしは一文字も変わりません。

聞こえていない一文が、文字起こしに混ざらない

  • 検知は二重にかけるAI ハルシネーション検知とエンジン側のチェックを全区間にかけ、疑わしい箇所に印をつけます。
  • 印のついた区間は別のエンジンへそのまま文字起こしに反映させず、自動で別のモデルで処理し直します。
  • 無音は無音のまま間は間であって、モデルが想像した一文ではありません。
  • やり直しに追加料金はない内部で何度モデルを替えても、消費するのはファイル 1 本ぶんだけです。

同じ文字起こしから、文字起こし以上のものが出てくる

  • 要約テンプレートは 30 種類以上会議、講演、ビジネス、医療、法務など、目的別のテンプレートから選べます。
  • 決まったことと、次にやること議論の要点、決定事項、担当と次の行動を抜き出します。
  • 要約に使うモデルは自分で選ぶ要約だけは、使う AI モデルをご自身で選べます(ほかの処理は自動で振り分けます)。
  • 文字起こしに直接聞く「何が決まったか」と尋ねれば、根拠になった発言を示しながら答えます。

日本語も、英語が混ざった話し方も聞き分ける

  • 95+ 言語に対応元の言語を選ぶと、その言語のベンチマークで最も成績のよいモデルへ自動で振り分けられます。
  • 文の途中で言語が変わっても日本語の文に英語の製品名や社名が混ざる話し方にも対応します。
  • そのまま翻訳もできる同じ音源から、別の言語に翻訳したテキストも受け取れます。
  • 選ぶのは最初の一度だけアップロードのときに元の言語と出力を決めれば、あとは待つだけです。

固有名詞と専門用語が、正しい表記で出てくる

  • ワークスペース用語集社名、人名、社内用語を一度登録すれば、以降のファイルはすべてその表記に揃います。
  • 全体にも、案件ごとにもワークスペース全体に効かせるか、特定のプロジェクトだけに紐づけるかを選べます。語ごとに全言語共通か言語別かも指定できます。
  • 手元の一覧を取り込むXLSX や CSV の用語リストをそのまま読み込めます。
  • 背景資料も一緒に渡すPDF、DOCX、スライド、URL を参考資料として渡すと、その文脈を踏まえて処理します。

字幕も要るなら、見た目まで決めておける

  • スタイルはテンプレートにして使い回す字幕の見た目をワークスペースのテンプレートとして保存し、どのプロジェクトにも適用できます。
  • 既定にしておけば何もしなくていいワークスペースの既定に設定すれば、次の動画から同じ見た目で仕上がります。
  • 二言語をひとつの字幕に元の言語と翻訳を一本の SRT にまとめた二言語字幕を書き出せます。
  • 実際のフレームで確かめる字幕がどう乗るかは、プレビューを見ながら決められます。

テキストではなく、字幕入りの動画がほしいときは

  • 有料プランなら最大 4Kプレビューで見たとおりの字幕のまま書き出せます。
  • 二言語を焼き込む元の言語と翻訳、両方を画面に載せた動画も出せます。
  • 透かしは有料プランで消える無料プランで書き出した動画には透かしが入ります。
  • 無料でも仕上がりは確かめられる無料プランでは最初の 5 分・720p まで、透かし入りの動画を書き出せます。

録音ボタンは押した。あとは、それを読めるようにするだけ。

四つの場面、同じ詰まり方——手で聞き起こすと、30 分のメモに何時間もかかります。

取材をスマートフォンで録る

記者・ライター

手元にあるのは .m4a が並んだ一覧だけ。締め切りは近く、引用は一言一句正確でなければなりません。

講義とゼミの録音

学生・研究者

一学期分のボイスメモが溜まり、レポートを書く段になって、通しで聞き直す時間はもう残っていません。

会議室で机に置いたスマートフォン

打ち合わせの多い仕事

文字起こしにしておけば、何が決まって誰が持ち帰ったのかを、あとから検索で見つけられます。

移動中に吹き込む思いつき

ひとりで動く人

歩きながら話した数分が、そのまま記事の下書きにも、企画書の材料にもなります。

そのほか、ひととおり。

どれも乗り換える理由にはなりませんが、誰かに渡す段になると全部必要になります。

ファイルのアップロード公開リンクの取り込みGoogle Meet ボットMicrosoft Teams ボットカレンダー連携話者の自動判別話者数の指定句読点と段落の復元ワークスペース用語集背景資料の読み込み要約テンプレート 30+文字起こしへの質問AI 校正の提案SRT・VTT 書き出しDOCX・XLSX 書き出しTXT・Markdown 書き出しZIP で一括ダウンロード二言語字幕と焼き込み

細かい部分は実際の製品でご確認ください。無料のワークスペースは 1 分ほどで作れます。

製品を見る

はじめる前によくある質問

四つの手順です。(1) ボイスメモのファイルをブラウザにドラッグしてアップロードする。(2) 話されている言語を選ぶ。(3) AI が文字起こしし、話者を判別して句読点と段落を戻す。(4) 内容を確認し、必要なら書き出す。アプリのインストールも、ファイルの変換も要りません。各ファイル最初の 15 分は無料で結果を確認できます。

そのまま使えます。iPhone のボイスメモが書き出すのは .m4a で、Subanana が対応している音声形式のひとつです。ほかに MP3、WAV、OGG、AAC、FLAC、OPUS も、MP4、MOV、M4V、WEBM、MKV、MPEG の動画も、変換せずにブラウザからアップロードできます。

できます。Mac のボイスメモアプリから書き出したファイルも、iPhone で録ったものと同じように、変換せずにそのままアップロードできます。Android の録音アプリがよく出力する .m4a/.mp3/.opus も、IC レコーダーの録音も同じです。Subanana はブラウザで動くので、Mac でも Windows でも手順は変わりません。

無料アカウントでファイルをアップロードし、各ファイル最初の 15 分ぶんの文字起こしを、月 3 ファイルまで確認できます。カードの登録は不要です。テキストや字幕をファイルとして書き出すのは有料プランの機能なので、無料プランは「自分の録音がどこまで正しく起こせるか」を先に確かめるための枠だとお考えください。

できます。1 ファイル最長 8 時間・最大 30 GB で、この上限はどのプランでも同じです。二時間の講義をそのまま 1 本で渡しても、途中で切る必要はありません。

平均で 98% です。音の明瞭さ、背景の雑音、専門用語の多さで上下するので、話し手に近い位置に置き、静かな場所で録るほど結果は良くなります。用語集に社名や人名を登録しておくと、固有名詞の表記がはっきり改善します。95+ 言語に対応し、言語ごとにベンチマークで最も成績のよいモデルへ自動で振り分けています。

文字起こしの結果は全区間で品質チェックにかけ、音声と合っていない箇所は、そのまま反映させずに別のモデルで処理し直します。無音は無音のままで、想像した一文にはなりません。内部でモデルを替えて処理し直しても追加で消費されることはなく、消費するのはファイル 1 本ぶんだけです。仕上げに AI の校正をかけることもできますが、変更するかどうかは提案を見て承認してから決めます。

話者は自動で判別してラベルが付き、人数を手で指定することもできます。句読点と段落も自動で戻るので、切れ目のない一続きの文章にはなりません。書き出しは TXT、DOCX、XLSX、Markdown、字幕なら SRT と VTT、まとめて ZIP でも受け取れます(PDF での書き出しには対応していません)。文字起こしのあとに、別の言語へ翻訳したテキストを 1 言語ぶん受け取ることもできます。