
ボイスメモをテキストに変換する:使えるすべての方法
Summarize this article with:
ボイスメモをテキストに変換する最速の方法は、お使いのデバイスによって異なります。iOS 18以降のiPhoneでは、録音を開いて三点リーダーメニューから「書き起こしを表示」を選べば、端末内で即座に結果が得られます。Google Pixelでは、Recorderアプリがリアルタイムで文字起こしし、.txtファイルとしてエクスポートしたりGoogleドキュメントに送信したりできます。どのデバイスでも、専用の文字起こしツールに音声ファイルをアップロードすれば、より豊富なエクスポート形式と、長時間や騒がしい録音での高い精度が得られます。
最短ルート:ボイスメモを開き、三点リーダーメニューをタップして「書き起こしを表示」を探します。 iOS 18以降のiPhoneでは、この組み込みの手順は約5秒で完了します。Androidの場合は、お使いの機種によって答えが変わります。このガイドでは、すべてのプラットフォーム、ネイティブ機能の実際の限界、そして専用ツールへのアップロードが理にかなう場面について解説します。
ボイスメモの「変換」とは実際には何か
ボイスメモは単なる音声ファイルです。テキストに変換するということは、読める書き起こしを生成する音声認識エンジンに通すことを意味します。そのエンジンは端末内(Appleのオンデバイスモデル、Google RecorderのオフラインAI)にあることもあれば、クラウド上(Deepgram、AssemblyAI、その他文字起こしサービスを支えるプロバイダ)にあることもあります。オンデバイスは開始が速いものの、対応言語やエクスポート形式に制限があります。クラウドベースのツールは、長いファイル、話者ラベル、構造化された出力を扱えます。
iPhoneのボイスメモをテキストに変換する方法
方法1:iOS組み込みの書き起こしを使う(iOS 18以降、iPhone 12以降)
AppleはiOS 18でボイスメモのオンデバイス文字起こしを追加しました。アップロード不要で、端末上でローカルに動作します。
- ボイスメモアプリを開きます。
- 読みたい録音をタップします。
- 録音名の横にある三点リーダーメニュー(...)をタップします。
- 「書き起こしを表示」をタップします。
- テキストをコピーするには、書き起こし画面の上部にある「書き起こしをコピー」をタップします。
書き起こしは端末内で生成され、オフラインでも動作します。 iOS 26時点で対応している言語は、英語(すべての地域版)、スペイン語、ポルトガル語、イタリア語、フランス語、ドイツ語、日本語、韓国語、簡体字中国語、繁体字中国語です。Appleのサポートドキュメントによると、この機能にはiPhone 12以降が必要で、一部の国では利用できない場合があります。
主な制限:iOSにはテキストファイルへワンタップでエクスポートする機能がありません。書き起こしをコピーして、メモ、メール、その他のアプリに貼り付けることになります。短いメモ1件ならそれで十分ですが、10件の録音をまとめて処理するとすぐに面倒になります。

方法2:音声ファイルを書き出して文字起こしツールにアップロードする
こちらはより多くのエクスポート形式(SRT、TXT、DOCX互換)、話者ラベル、タイムスタンプ管理が可能です。
- ボイスメモアプリを開き、録音をタップします。
- 三点リーダーメニューをタップして「共有」を選びます。
- 「ファイルに保存」をタップし、iCloud Driveまたはローカルフォルダを選択します。
- Safariを開いて音声をテキストに変換にアクセスします。
- 「アップロード」をタップし、ファイルアプリから.m4aファイルを選択し、言語を選んで「文字起こし」をタップします。
- 希望の形式で書き起こしをダウンロードします。
iPhoneのボイスメモはM4A形式で保存されており、主要な文字起こしツールはすべて変換なしで対応しています。
方法3:AirDropでMacに送り、デスクトップからアップロードする
確認や編集には大きめの画面がよい場合:
- iPhoneでボイスメモを開きます。
- 録音を選択し、「共有」をタップしてMacにAirDropします。
- ブラウザで音声をテキストに変換にアクセスします。
- .m4aファイルをアップロードエリアにドラッグ&ドロップします。
- 文字起こしし、確認して、エクスポートします。
Androidの録音をテキストに変換する方法
Androidには主に2つの方法があり、デバイスメーカーによって大きく異なります。
Google Pixel:リアルタイム文字起こし対応のRecorderアプリ
PixelスマートフォンのGoogle Recorderは、オフラインで端末内リアルタイム文字起こしを行います。書き起こしは話しながら更新され、録音終了後も残ります。 アクセスとエクスポートの手順:
- Recorderアプリを開き、録音をタップします。
- 「書き起こし」タブをタップします(まだ表示されていない場合)。
- 共有アイコンをタップします。
- エクスポートオプションを選択します:
- 「書き起こし(.txt)」でプレーンテキストファイルとして保存
- 「書き起こしをGoogleドキュメントに共有」でDriveに直接送信
- 「書き起こしをNotebookLMに共有」でノートブックに送信
基本的なユースケースはこれで十分カバーできます。ただし、SRT、DOCX、話者ラベル付きのネイティブエクスポートはありません。それらが必要な場合は、音声ファイルを書き出して別途アップロードしてください。
注意: Google Recorderの文字起こしはPixelデバイス限定です。他のAndroidスマートフォンでGoogle Recorderを使っても、オンデバイス文字起こしは利用できません。
Samsung Galaxy:Galaxy AIのTranscript Assist
One UI 6.1以降(Android 14以上)を搭載したSamsung Galaxyデバイスには、Galaxy AIによる「Transcript Assist」機能があります。リアルタイムではなく、録音を停止した後にアプリが処理します。
- Samsungのボイスレコーダーを開き、録音を選択します。
- 「文字起こし」ボタンをタップします(録音完了後に利用可能)。
- エクスポートするには:三点リーダーメニューをタップして「共有」を選びます。
- 音声を共有する場合は「音声ファイル」を、書き起こしを共有する場合は「テキストファイル」を選択します。
- 「Samsung Notesに追加」をタップしてNotesアプリに移すこともできます。
Transcript Assistは、英語、スペイン語、フランス語、ドイツ語、韓国語、日本語などを含む幅広い言語に対応しています。Samsungのサポートページによると、一部の言語はダウンロードが必要です。
その他のAndroidデバイス
Pixel RecorderやSamsung Transcript Assistがないスマートフォンの場合:
- 録音アプリ(Google Recorderまたはメーカーの標準アプリであることが多い)を開きます。
- 「共有」をタップし、音声ファイルをGoogle Driveまたはローカルストレージに保存します。
- Chromeを開いて音声をテキストに変換にアクセスします。
- ファイルをアップロードし(M4AとOGGの両方に対応)、文字起こしします。
デスクトップの録音をテキストに変換する方法
Windowsサウンドレコーダー、macOSボイスメモ、Audacity、その他DAWからのデスクトップ録音は、シンプルなアップロード手順で処理できます。
ファイルの場所:
| アプリ | デフォルトの保存場所 | 形式 |
|---|---|---|
| Windows サウンドレコーダー | C:\Users\[username]\Documents\Sound recordings(またはOneDrive\Documents\Sound recordings) | .m4aまたは.wav(2026年時点でWindows 11は両方に対応) |
| macOS ボイスメモ | ボイスメモアプリからアクセス可能。iCloudと同期 | .m4a |
| Audacity | プロジェクトを書き出した場所 | .mp3、.wav、.flac(ユーザーが選択) |
| GarageBand | ~/Music/GarageBand/ | .m4a |
ファイルが見つかったら:
- 音声をテキストに変換にアクセスします。
- ファイルをアップロードエリアにドラッグするか、クリックして選択します。
- 話されている言語を選択します。
- 文字起こしを開始して待ちます。5分のメモは通常30秒以内で処理されます。
- 確認・編集し、希望の形式でエクスポートします。
ネイティブ vs. アップロード:簡単な比較
| プラットフォーム | ネイティブ文字起こし | オフライン | 対応言語 | エクスポートオプション |
|---|---|---|---|---|
| iPhone(iOS 18以降、iPhone 12以降) | あり | あり | 10言語 | コピー&ペーストのみ |
| Google Pixel(Recorderアプリ) | あり | あり | 英語(中心) | .txt、Googleドキュメント、NotebookLM |
| Samsung Galaxy(One UI 6.1以降) | あり | なし(クラウド処理) | 10言語以上 | テキストファイル、Samsung Notes |
| Windows / macOS | ネイティブ機能なし | 該当なし | 該当なし | アップロードが必要 |
| サードパーティアップロードツール | あり | なし | 50言語以上 | .txt、.srt、.vtt、Word互換 |
私の見解:iPhoneとPixelのネイティブ機能は、さっと読む用途や短いメモには本当に優れています。しかし、話者ラベル、動画字幕用のSRTエクスポート、一括処理が必要になった瞬間に限界が来ます。サードパーティへのアップロードは一手間増えるだけで、これらすべてをストレスなく処理できます。
ボイスメモの文字起こし精度を上げるコツ
スマートフォンを口から15〜30cm離して持ちます。 腕を伸ばした距離での録音は環境騒音を大幅に拾いやすく、精度を下げます。2025年の音声認識に関する研究では、65dBを超える環境騒音があると、静かな環境での約96%から83%未満まで精度が落ちることがわかりました。30秒かけて持ち方を工夫する価値は十分にあります。
静かな場所で録音します。 食洗機の稼働音、カフェ、走行中の車などは、どの文字起こしモデルも完璧には処理できない背景ノイズをもたらします。大事なメモなら静かな部屋に移動しましょう。
完全な文で話します。 意識の流れのままのボイスメモも正確に文字起こしされますが、編集に手間のかかるテキストになります。ひとつの考えにつき意図的な一文を話すことで、後の修正時間を節約できます。
一括文字起こしの前にファイル名をつけます。 「Recording 47」では2週間後には何の録音かわかりません。まとめてアップロードする前に、日付とトピックでファイル名を変更しておきましょう。
文字起こしされたボイスメモの実用的な使い道
ボイスメモをテキストに変換すると、音声だけでは実現できない使い方が広がります。いくつか紹介します:
- フィールドノートと調査ログ。 観察内容を音声で記録する研究者は、打ち直すことなく検索可能な文章アーカイブを作れます。より深いワークフローについてはインタビュー録音の文字起こし方法をご覧ください。
- ミーティングのフォローアップ。 通話後の30秒の音声まとめを文字起こしすれば、Slackやタスク管理ツールに貼り付けられる整ったアクションリストになります。ミーティング文字起こしツールは、話者ラベル付きで長い通話録音も処理できます。
- ナレッジマネジメント。 文字起こしされたメモはObsidian、Notion、Roamに自然に取り込めます。ワークフローの詳細は文字起こしとObsidian/Notionで解説しています。
- 個人ジャーナリング。 音声日記をテキスト化すれば検索でき、時間を経てから振り返りやすくなります。音声は記録が速く、テキストは検索が速いのです。
複数のボイスメモを一括変換する
何十件ものメモがたまっていて、一度にすべて文字起こししたい場合:
- AirDrop、iCloud同期、またはUSBですべてのファイルをコンピュータに転送します。
- アップロード前にわかりやすい名前に変更します(「2026-06-30-client-call.m4a」は「recording.m4a」よりはるかに便利です)。
- 順番にアップロードして文字起こしするか、1回のセッションで複数ファイルの一括処理ができるProプランを利用します。
アカウント登録なしできれいな書き起こしだけが必要なら、ConvertAudioToTextなら短いファイルであれば登録不要ですぐにアップロードして文字起こしできます。
大量の一括処理向けに作られたツール間で料金がどう比べられるかについては、文字起こし料金比較をご覧ください。
よくある質問
iPhoneのボイスメモはどんな形式で保存されますか?
iPhoneのボイスメモはM4A形式(MPEG-4 Audio)で保存されます。ほぼすべての文字起こしツールが対応しているため、アップロード前にファイル形式を変換する必要はありません。Spatial Audioマイクを搭載したiOS 26のデバイスでは.qtaコンテナが表示される場合がありますが、標準のM4Aエクスポートは共有メニューから引き続き利用できます。
ボイスメモをどこにもアップロードせずに文字起こしできますか?
はい。端末内文字起こしに対応したデバイスであれば可能です。iOS 18以降のiPhone 12以降では、音声をサーバーに送ることなくローカルで書き起こしが生成されます。Google PixelのRecorderアプリもオフラインで動作します。どちらも該当しない場合は、文字起こしサービスでの処理が必要です。利用するサービスのプライバシーポリシーを確認し、音声がどのように・どのくらいの期間保存されるのかを把握しておきましょう。
ボイスメモの文字起こし精度はどのくらいですか?
静かな環境でスマートフォンを口元近くに置いた状態では、最新のAI音声認識は明瞭な英語の音声に対して約96〜97%の単語レベル精度を達成します。背景ノイズがあると大きく低下します。テスト条件下では、65dBを超える環境騒音により精度が83%未満に落ちることがあります。使用するツールよりも、録音品質の方が大きな要因です。
英語以外の言語で録音したボイスメモも文字起こしできますか?
はい。iOSのネイティブ文字起こしは、スペイン語、フランス語、ドイツ語、日本語、韓国語、中国語(簡体字・繁体字)など10言語に対応しています。SamsungのTranscript Assistも同程度の範囲をサポートしています。DeepgramやAssemblyAIなどのクラウドモデルを使うサードパーティツールは、通常数十言語に対応しています。最良の結果を得るには、自動検出だけに頼らず、文字起こし前に話されている言語を選択してください。
ボイスメモの文字起こしにはどのくらいの時間がかかりますか?
端末内処理(iPhoneやPixel)では、録音終了後数秒で書き起こしが表示されることが多いです。アップロードファイルの場合、クラウド文字起こしサービスでは5分のメモに通常15〜30秒ほどかかります。30分の録音なら通常1〜2分で完了します。処理時間はおおむね音声の長さに比例します。
参考資料
- Appleサポート「iPhoneでボイスメモの書き起こしを表示する」: https://support.apple.com/guide/iphone/view-a-transcription-iph00953a982/ios
- Appleサポート「iPhoneでボイスメモの録音をファイルに書き出す」: https://support.apple.com/guide/iphone/export-a-recording-to-files-iph831c37815/ios
- Google Pixelヘルプ「録音と書き起こしの保存と共有」: https://support.google.com/pixelphone/answer/16267696
- Samsungサポート「Galaxy AIでボイスレコーダーを使う」: https://www.samsung.com/us/support/answer/ANS10000942/
- Microsoft Learn「サウンドレコーダーのリリースノート」: https://learn.microsoft.com/en-us/windows-insider/release-notes/apps/sound-recorder
- Tom's Guide「iOS 18、ついにボイスメモに文字起こし機能が追加」: https://www.tomsguide.com/phones/iphones/ios-18-finally-adds-transcription-to-voice-memos-heres-how-to-use-it
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles
How to Add Timestamps to a Transcript
Learn how to add timestamps to a transcript with an audio-to-text tool, then export timestamped SRT or VTT subtitle files for easy navigation and editing.
How to Transcribe a Conference Talk to Text
Learn how to transcribe a conference talk or keynote to text, label speakers, and export SRT, VTT, or TXT using a straightforward upload or URL workflow.