ウミノの40歳からのAI活用塾
ウミノの40歳からのAI活用塾 › 最新版オンラインコースの作り方

最新版オンラインコースの作り方

オンラインコースを作るとき、いまわたしが自分の手でやっているのは、ほぼ録音だけ。リサーチも台本も音声とスライドの編集もAIです。今日はわたしのオンラインコースの制作過程を共有します。

✦ この記事のポイント

いまのコースづくりで自分でやっている作業は何か?

  • 自分で手を動かす作業は、ほぼ録音だけに絞られた状態
  • リサーチ・構成・スライド・台本づくりは全部AIに任せる
  • スライドは見た目にこだわるので、まだ自分でも手直しする

AI音声ではなく自分の声で録るのはなぜか?

  • AI音声で作られたUdemyコースは非常に評判が悪いから
  • ElevenLabsやGeminiのTTSモデルのレベルはすでにかなり高い
  • 半年後にはTTSに切り替えている可能性も十分にある

音声とスライドの編集はどのようにAIに任せているか?

  • 録音した音声・スライドのPNG・台本の3つをClaudeに渡す
  • 台本には何枚目のスライドで何を言うかまで書いておく
  • スライドの切り替えはほぼ完璧で、仕上がりは約9割完成

AI編集で残っている課題は何か?

  • GroqもWhisperも言い直した部分を省略して文字起こしする
  • 文字に残らない言い間違いは、カット対象から漏れてしまう
  • 次の一手はGeminiの文字起こし機能で言い直しを拾う検証

アサーティブコミュニケーションの基本は何か?

  • 相手も自分も大切にする、攻撃的と受け身の真ん中の伝え方
  • 「わたし」を主語にして気持ちと事実を伝えるアイメッセージ
  • 描写・表現・提案・結果と選択の順に伝えるDESC法
この記事のもとになったエピソード
ウミノの40歳からのAI活用塾
最新版オンラインコースの作り方
· 15分32秒
聴きながら読むSpotifyAppleYouTube

わたしが自分でやっているのは録音だけ

いまのわたしのオンラインコースづくりで、自分の手でやっている作業は基本的に録音だけです。

リサーチ、構成、スライド、台本づくりは全部AIに任せています。わたしは目を通して直すだけです。

ただ、カリキュラムとスライドはけっこう手を入れています。もう少しAIが進化したら、ここも全部任せられそうだと思っています。

AI音声に切り替えないのは品質担保のため

実は録音も、いまの時点でAIに任せることはできます。それでも自分の声で録っているのは、フルAI音声のUdemyコースの評判がすこぶる悪いので、フルAIはまだ早いかなと思っています。

📝 TTS ── Text to Speechの略で、文章を読み上げ音声に変換するAIモデルのことです。

だから、下手なしゃべりでも生の声でやっています。

正直に言うと、ElevenLabsやGoogle GeminiのTTSモデルはめちゃめちゃすごいらしいので、早く試してみたいです。

わたし自身はFish Audioという会社のモデルで、自分の声をクローンしたことがありますが、かなり精度がよかったです。でもまだ多少不自然さが残るかな。

ウミノ「本当にね、めちゃめちゃレベル高いんですよ」

自分で録音するのは大変ですし、わたしはしゃべりがうまくないので言い間違いもめちゃめちゃします。

半年もしたら今の不自然さも消えるでしょうし、わたしもUdemyコースをTTSで作っている可能性は十分にあります。

スライドはAIが読みやすいMarpで作る

オンラインコースの中身は動画です。わたしはそのスライドをMarpで作っています。

📝 Marp ── マークダウンという見出しと本文で組み立てる書き方のテキストを、スライドに変換する技術です。

Marpを選んでいる理由は、AIが読みやすいからです。編集まで自動化できたのも、AIが読みやすいMarpで書いているおかげだと思っています。

Marpでスライドを作ったら、それに合わせてAIが台本を作り、基本はその台本を自分で読んで音声を録っています。

手作業だった音声とスライドの合体をAIに任せた

最後に、録音した音声とスライドの画像をガッチャンコする動画編集の工程があります。これを、いままで手作業でやっていました。

動画編集ソフトで言い直しをカットして、「ここからここまでは1枚目のスライド」と判断して、PNGに書き出したスライドを1枚ずつ貼り付けていく作業です。

これがまぁ、非常にめんどうくさい。 でも、もしかしてこれもAIに任せられるかもと思って、やらせてみました。

ウミノ「そしたら、できたんですよね。できた」

スライドの切り替えは完璧です。いまはClaude Opus 5.5に音声とスライド画像を渡して、「編集して」とお願いするだけで仕上げてくれます。 (画像化もお願いできるので今後はそうします)

噛んだところだけはカットしきれない

ちょっとだけ足りないのが、言い間違いのカットです。

ウミノ「私、本当に噛むんですよね」

人間なら噛んだところをきれいにカットできます。ところが、わたしが試した文字起こしモデルのGroqとWhisperは、言い直した部分を省略して文字起こししてしまいます。

AIは文字起こしの結果を見てカットする場所を判断するので、文字に残らない言い間違いはそもそもカットのしようがないんですよ。

正直なところ、わたしみたいに噛みやすい人の生声の修正には、ちょっと向いていないと感じました。

残った部分は自分でカットするか、「何分何秒のところで〜と言い間違えているので切ってください」と細かく指示して、なんとかやっています。

ただ、今日調べたところGeminiの新しいモデルだと言い間違いも残して文字起こししてくれるそうなので、今度試してみたいと思っています。

アサーティブは相手も自分も大切にする伝え方

ここで少しだけお知らせです。Udemyに、アサーティブコミュニケーションの講座を出しました。

アサーティブコミュニケーションは、ひとことで言うと、相手も自分も大切にする伝え方のことです。コミュニケーションには3つのスタイルがあると言われています。

1つ目は攻撃的なスタイル。強い言い方で押し切る、自分は大切にしても相手は大切にしない伝え方です。レストランで料理が傷んでいたときに怒り出すのがこれです。

2つ目は受け身のスタイル。不満を飲み込んで黙って食べるか残して、あとでぐちぐち思ってしまう伝え方です。相手は大切にしていても、自分のことは後回しです。

3つ目がアサーティブ。「こちらの料理が傷んでいます。交換してください」と、相手の立場も尊重しながら正直に伝えるスタイルです。

職場で言いたいことが言えない悩みも、逆に言い方がきつくなってしまう悩みも、どちらもよく聞くじゃないですか。アサーティブは、そのちょうど真ん中を目指す考え方です。

アイメッセージとDESC法で練習する

アサーティブに伝える練習法は2つあります。基本になるのがアイメッセージで、「わたし」を主語にして話す方法です。

締め切りを過ぎても資料が出てこない同僚に「なんであなたはいつも遅れるんですか」と言うと、主語が「あなた」のユーメッセージになります。言われた側は責められている感じがしてしまいます。

これを「資料がまだ届いていなくて、わたしは会議の準備に間に合うか心配なんです」と言い換えると、伝えているのは自分の気持ちと事実だけになります。相手も少し受け取りやすくなります。

もう1つがDESC法です。4つのステップで伝えます。

DESC法の流れ
1
D ディスクライブ(描写する)
客観的な事実を伝えます(例:資料の締め切りは昨日でした)
2
E エクスプレス(表現する)
事実について自分がどう感じているかを、アイメッセージで伝えます(例:会議に間に合うか心配です)
3
S スペシファイ(提案する)
具体的にどうしてほしいかを提案します(例:今日の15時までにいただけますか)
4
C コンセクエンス/チューズ(結果・選択)
相手の反応ごとに次の手を考えておきます(例:15時までにいただけると役員会議に間に合って助かります)

15時は外出していると言われたら、「次回からわからないことがあれば前日までに聞いてください」と伝えます。相手も声をかけやすくなります。

講座では、このDESCで伝える流れを、いろんな場面の37のワークで練習します。

Udemyのアサーティブコミュニケーション講座は、メルマガに登録してくださった先着100名の方に無料クーポンをお配りしています。気になる方は、こちらのリンクからメルマガに登録して受け取ってください。

https://newsletter.umino-ai.com/assertive-communication

Cowork 7日間無料メール講座

AIに仕事を任せる7日間の無料メール講座。毎日の繰り返し作業をAIに任せる方法を、1日1通でお届けします。

    登録は無料です。いつでも1クリックで解除できます。

    講座の詳細を見る