
オンラインコースの文字起こし:制作側の視点
Summarize this article with:
コース制作の視点
オンラインコースを制作しているなら、文字起こしなしで公開する録画の一つひとつが、収益とリーチを取りこぼしていることになります。文字起こしは、アクセシビリティ対応、多言語ローカライズ、検索可能なコースライブラリ、マーケティング素材のパイプラインを、一つの制作工程から引き出します。この記事はコース制作者向けのワークフローガイドであり、受講生向けの学習ガイドではありません(そちらは講義をノート用に文字起こしする方法で扱っています)。
なぜ今、文字起こしがコース制作の一部なのか
アクセシビリティへの圧力は現実のものであり、期限も定まっています。 米国司法省が更新したADA Title II規則のもと、州立大学を含む公立機関は、2026年4月24日までにすべての動画・音声コースコンテンツをWCAG 2.1 Level AAに準拠させる必要があります。つまり、事前収録されたすべての動画には字幕を、音声のみのコンテンツには文字起こしを用意しなければなりません。大規模な公共機関は2026年4月の期限が適用され、小規模な自治体は2027年まで猶予があります。
UdemyやTeachableなどのプラットフォームで活動する独立系クリエイターの場合、Title IIは直接適用されません。民間企業を規律するのはTitle IIIの判例法であり、民間コースプラットフォーム向けに固定されたWCAGの期限は定められていません。それでも、アクセシブルなコースはプラットフォーム検索で上位に表示され、聴覚に違いのある受講生にとって利用しやすく、排除による評判コストを避けられます。これは回避すべき規制ではなく、組み込む価値のある制作基準です。
より詳しいコンプライアンスの全体像については、オンラインコースのアクセシビリティの記事で法的枠組みを完全に解説しています。
注:上記は適用される規制の要約であり、法的助言ではありません。公立機関の場合は、所属機関のデジタルアクセシビリティ担当部署に相談してください。
コース制作者の制作ワークフロー
以下は、ほとんどの制作者に有効な手順です。
ステップ1:クリーンな音声トラックで録音する
文字起こしの精度は、まず音声品質に左右されます。柔らかい家具のある部屋、適切なUSBマイク、一定の話すペースがあれば、最初のパスで95〜99%の精度が得られます。専門用語の修正は、悪い音声よりも時間がかかります。
画面収録のコース(コーディング、デザイン、ソフトウェアチュートリアル)では、ノートパソコン内蔵マイクではなく、専用マイク入力でナレーションを録音してください。ポスト編集時間の差は大きいです。
ステップ2:録画全体を文字起こしする
少なくとも最初のパスでは、プラットフォームの自動字幕に頼らず、自分で文字起こしを行ってください。 プラットフォームの自動字幕(Udemyではコースページに「自動生成」と表示され、Courseraではコースによって異なり話者ラベルがないことが多く、edXの品質は機関によって異なります)は、特に専門用語で一貫性がありません。
録画したMP4または音声ファイルを、自分が管理できるツールにアップロードします。ConvertAudioToTextの動画文字起こしツールは、音声抽出と文字起こしを1ステップで処理し、タイムスタンプ付きの編集可能なトランスクリプトを生成し、SRTまたはVTTとして直接書き出せます。

SRTファイルは、プラットフォームにアップロードするクローズドキャプションのソースになります。プレーンテキストのトランスクリプトは、他のすべての出発点になります。
ステップ3:専門用語の正確性のために編集する
自動文字起こしは会話的な音声をうまく処理しますが、ドメイン固有の用語はあまり確実に処理できません。公開前に、以下を編集してください:
- 固有名詞と製品名
- 技術的な略語(AIモデルはしばしば音声どおりに綴ります)
- 読み上げられたコードスニペットや数式
編集済みトランスクリプトを一通り確認することは、プルーフリスニングにもなります。録音セッションで残ってしまったペースの問題、フィラー語、不明瞭な説明に気づけるでしょう。
ステップ4:動画に字幕を付ける
動画を公開する際に、修正済みのSRTファイルをアップロードします。主要なコースプラットフォームはすべてSRTアップロードに対応しています:
| プラットフォーム | 字幕アップロード | 自動生成字幕 | 講師による字幕差し替え |
|---|---|---|---|
| Coursera | 可 | あり(品質はばらつき) | 可 |
| edX | 可(SRT/TXT) | あり(「自動」表示) | 可 |
| Udemy | 可 | あり(「自動生成」表示) | 可 |
| LinkedIn Learning | 可 | あり(ほとんどのコンテンツで高精度) | パートナー/パブリッシャーのみ |
| Teachable | 可 | なし | 可 |
アップロードした字幕は、特に専門的な内容では、プラットフォームの自動生成よりも常に正確です。Udemyの自動生成字幕はデフォルトで講師側の操作を必要としませんが、修正済みのSRTに差し替えることは、公開済みコースに施せる最も費用対効果の高い編集の一つです。
ステップ5:コース検索レイヤーを構築する
各講義のプレーンテキストのトランスクリプトは、コースライブラリを検索可能にする最速の方法です。 ほとんどのLMSプラットフォーム(Teachable、Thinkific、Kajabi)は動画コンテンツをインデックスしません。動画と一緒に公開するか、テキスト要約ブロックに埋め込んだトランスクリプトは、検索エンジンとプラットフォームの内部検索にインデックス対象を提供します。
10を超えるモジュールを持つコースライブラリでは、この効果はすぐに大きくなります。機械学習コース内で「勾配降下法」を検索する受講生は、空白の検索結果ページではなく、正しいモジュールにたどり着くべきです。
最小限のバージョンは、講義の説明欄にトランスクリプトテキストを貼り付けることです。完全なバージョンは、編集済みトランスクリプトと抜粋引用を含む専用の「ノート」ページをモジュールごとに公開することです。どちらも、何もしないよりは優れています。
ステップ6:より多くの市場に向けてローカライズする
トランスクリプトはローカライズの入力であり、完成品ではありません。 クリーンな英語トランスクリプトがあれば、翻訳サービスやAIツールで外国語の字幕ファイルを生成できます。翻訳プロセスにはソーステキスト(あなたのSRT)が必要です。それがなければ、翻訳者に動画から作業してもらうことになり、時間も費用もかかります。
Udemyでスペイン語とポルトガル語のコースを公開する制作者は、Udemyで2番目と3番目に大きな受講生市場にリーチできます。1つのローカライズ版から得られる追加収益は、1か月で文字起こしの時間コストを上回ることもあります。
公開後に受講生がコンテンツをどのように活用しているかを知りたい場合は、MOOCと自己ペースコースの文字起こしの記事で、コーストランスクリプトの受講生側の使い方を解説しています。
ステップ7:マーケティング用にトランスクリプトを再利用する
各講義のトランスクリプトは、以下の素材の下書きになります:
- ブログ記事やニュースレターのセクション(300〜500語の記事につき、トランスクリプトの段落をおよそ1つ)
- ソーシャルメディア向けの抜粋(特定の定義や実例を抜き出す)
- メール講座やウェルカムシーケンス
- 有料コミュニティ向けのドキュメントやFAQページ
トランスクリプトがブログ記事を書いてくれるわけではありません。しかし、編集の出発点となる素材を提供してくれるため、白紙から書くよりも10倍速く作業できます。コンテンツマーケティングも行う講師にとって、このステップがトランスクリプトを「高くつく」ものではなく「実質無料」に感じさせるのです。
制作者向けプラットフォーム別メモ
Udemyは、公開済みコースに対して英語とその他数言語で字幕を自動生成します。自動生成ラベルはコースページで受講生に表示されます。講師は自分のSRTファイルをアップロードして、自動生成版を差し替えることができます。コースに専門用語が多い場合や、話者に非ネイティブのアクセントがある場合は、自分でアップロードする方が20分の投資に見合う価値があります。
Courseraでは、動画プレーヤー画面からトランスクリプトをテキストファイルとしてダウンロードできます。最近のプラットフォーム更新により、モバイルでもトランスクリプトを利用できます。大学との提携を通じて公開している場合は、WCAG対応がプラットフォーム側で処理されるのか、コンテンツ制作者側に求められるのかを所属機関に確認してください。
TeachableとThinkificは字幕を自動生成しません。すべての動画にSRTファイルを用意する責任はあなたにあります。公開後の後付けではなく、制作段階で計画に組み込んでください。
LinkedIn Learningは、ほとんどのコースでトランスクリプトを公開しています。あなたが(他のプラットフォームの個人クリエイターではなく)LinkedIn Learningのパブリッシャーであれば、プラットフォームが自社の制作パイプラインで処理します。
追加ツールなしで字幕ファイルを入手する方法
完全な文字起こしパイプラインを構築せずに、1つのコースモジュール用の字幕ファイルだけが必要な場合は、ConvertAudioToTextの字幕ジェネレーターが、アップロードした音声または動画ファイルからSRTとVTTを直接出力します。無料枠では10分の文字起こしが利用でき、毎月ではなくサインアップ時に一度だけ付与されます。Proプランは月額9.99ドルで、あらゆる制作量に対応します。
教室環境で録音する教師向けには、教師のための文字起こしの記事で、商業的なコース制作ではなく、教育機関での授業に特有の録音許可とワークフローの問題を扱っています。
FAQ
独立系クリエイターの場合、オンラインコースに文字起こしは必要ですか?
UdemyやTeachableなどのプラットフォームで活動する個人のコース制作者には、連邦政府が定めるWCAGの期限はありません。ADA Title IIの2026年4月のコンプライアンス要件は、公立機関(州立大学や地方政府)に適用されます。独立系クリエイターはADA Title IIIの判例法の対象となり、固定された技術基準はまだ確立されていません。とはいえ、ほとんどのプラットフォームはアクセシビリティと発見性のために字幕と文字起こしを推奨しており、Udemyの受講生検索では、一部の市場で字幕付きコースが上位に表示されます。
コース動画を字幕ファイルにするにはどうすればよいですか?
動画またはその音声をSRTやVTTを書き出せる文字起こしツールにアップロードし、専門用語の正確性を高めるために出力を編集し、選択したプラットフォームで公開する際にそのファイルを字幕ソースとしてアップロードします。ほとんどのプラットフォームはSRTに対応しています。15分の講義であれば、編集作業を含めて通常20〜30分で完了します。
プラットフォームが自動生成した字幕を使ってもよいですか、それとも自分で用意すべきですか?
プラットフォームの自動生成字幕は一般的な会話コンテンツには使えますが、専門用語、非ネイティブのアクセント、専門的な用語を扱うコースでは信頼性が低くなります。ソフトウェア開発、医療、法律、その他ニッチな分野のコースでは、自分で修正した字幕の方が自動生成よりも明らかに正確です。Udemyの講師はSRTファイルをアップロードして自動生成字幕を差し替えることができ、CourseraやedXも講師提供の字幕ファイルを受け付けています。
文字起こしがあると、コースの検索順位は上がりますか?
外部検索エンジンでは効果があります。コースページに埋め込まれた文字起こしテキストは、Googleがインデックスできる情報になります。プラットフォーム内検索では、効果はプラットフォームによって異なります。Udemyの検索はコースタイトルと説明文を確実にインデックスし、一部の市場では字幕が検索順位に影響します。TeachableとThinkificは動画コンテンツがインデックスされないため、内部検索ではテキスト説明文に大きく依存します。講義の説明欄に文字起こしテキストを公開するのが、最も手間をかけずにインデックスを改善する方法です。
出典
- Courseraのトランスクリプトダウンロード: https://www.coursera.support/s/article/learner-000001476
- edXのトランスクリプトと字幕ヘルプ: https://help.edx.org/edxlearner/s/article/Do-edX-course-videos-have-transcripts-or-captions
- Udemyの自動生成字幕FAQ: https://support.udemy.com/hc/en-us/articles/115010239888
- ADA Title IIデジタルアクセシビリティ要件(OSUの要約): https://ascode.osu.edu/news/new-ada-title-ii-regulations-what-you-need-know
- Section 508コンプライアンス概要: https://www.section508.gov/
- 動画コンテンツに関するWCAG 2.1 AA要件: https://gotranscript.com/public/title-ii-video-accessibility-what-wcag-21-aa-requires
- LinkedIn Learningのトランスクリプトヘルプ: https://www.linkedin.com/help/linkedin/answer/71911/linkedin-learning-video-transcripts
- ConvertAudioToTextの料金: https://convertaudiototext.com/pricing
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles
How to Add Timestamps to a Transcript
Learn how to add timestamps to a transcript with an audio-to-text tool, then export timestamped SRT or VTT subtitle files for easy navigation and editing.
How to Transcribe a Conference Talk to Text
Learn how to transcribe a conference talk or keynote to text, label speakers, and export SRT, VTT, or TXT using a straightforward upload or URL workflow.