Noah
記事一覧へ戻るAI活用・業務効率化約9分で読めます

約1時間の動画を5分以内に|AI動画編集の裏側

パソコン画面で実際に操作しながら解説した収録動画は、手順を丁寧に見せられる反面、そのままでは約1時間になり、最後まで見てもらいにくくなります。
今回、その長い動画をAIで編集し、説明の流れを残したまま5分以内へまとめました。

ただ一律に早送りしたわけではありません。
話している場面は、声の高さを変えずに聞き取れる速さへ調整し、保存や読み込みを待つ場面は、経過だけが分かるように大幅に高速化しています。
テロップも文字数で機械的に切らず、話の意味がまとまる場所と、次の操作へ移る場所に合わせました。

先日公開した動画編集のBefore/After記事では、初稿から完成版へどう直したかを紹介しましたが、その編集自体もAIと一緒に行っています。
この記事では完成動画を見ながら、実際にどんな指示を渡したのか、AIが裏側で何を処理したのか、どこを人が判断すると仕上がりが良くなるのか、手直しをゼロからやり直さないために何を残したのかまで解説します。

約1時間の収録動画を5分以内にまとめた完成動画

▶ 完成動画を再生する(5分以内)

長い動画を短くする時に大切なのは、全体へ同じ倍速をかけることではありません。
「理解してほしい発話」と「経過だけ見せたい操作待ち」を分け、それぞれに違う編集ルールを与えることです。
この境界を決められると、AIは1時間を超える素材でも、一度の本番出力までまとめて処理できるようになります。

「AIで一発生成」の意味を、先に揃えておきたい

今回の「一発生成」は、曖昧な一言だけで完成したという意味ではありません。
人が先に完成時間、残す音声、見せたい場面、テロップの基準を決め、AIが全編の解析、時間設計、合成、検査をまとめて進めたという意味です。

完成条件がないまま「いい感じに5分にして」と頼むと、大切な説明まで削られたり、発話が速くなりすぎたりします。
反対に、何を守り、何を圧縮してよいかが分かれば、AIは長尺動画を細かい区間へ分け、全体の時間予算に収められます。

今回の編集で、実際に何をしたのか

元動画は約1時間13分、完成版は5分以内です。
動画全体を209区間へ分け、話している105区間と、操作待ちなどの104区間を別々に処理しました。

話している区間は、元の約6分半を約4分半へ圧縮しています。
速さは全体の時間に収まるよう約1.5倍を基準に調整し、声の高さが変わらないようにピッチを保ちました。

ピッチとは、声の高い・低いを表す言葉です。
普通に動画を早送りすると声まで高くなりがちですが、今回は話す速さだけを上げ、本人の声らしさは残しています。

操作待ちの区間は、合計1時間以上あったものを約30秒へ圧縮しています。
短い待ちは10倍ほど、長い待ちは600倍以上まで高速化し、聞く必要のない音はミュートしました。

テロップは54ブロックです。
文字数だけで機械的に区切らず、一つの意味が終わる場所と、次の画面や操作へ移る場所を切り替えの基準にしました。

今回は隠すべき個人情報が映っていなかったため、モザイクは入れていません。
「念のため広く隠す」のではなく、必要性を確認して不要な工程を外すことも、短時間で仕上げるための判断です。

AIは、動画の裏側で何をしているのか

完成動画だけを見ると、AIが最初から最後まで一気に早送りしたように見えるかもしれません。
実際には、長い動画を小さな区間へ分け、区間ごとに役割を判定してから、もう一度一本の動画へ組み直しています。

裏側の処理を、普段の言葉へ置き換えると次の順番です。

  1. 音声から話している場所を見つける
  2. 説明として残す区間と、経過だけ見せる区間へ分ける
  3. 5分以内へ収めるため、それぞれの速さを計算する
  4. 区間をつなぎ直し、意味のまとまりでテロップを付ける
  5. 最後まで再生し、映像、音声、テロップの欠けやズレを検査する

編集ソフトで動画を並べる横長の作業面は「タイムライン」と呼ばれます。
今回は、区間の順番と時刻をデータとして残し、どこを何倍速にしたのか後からたどれるようにしました。

長い動画を短くする5つの判断

1. 最初に、動画の完成条件を決める

今回の完成条件は、5分以内、説明の音声は残す、倍速しても声の高さは変えない、長い操作待ちは大幅に圧縮する、テロップは意味段落で切る、不要なモザイクは入れない、の6点でした。
編集を始める前にこの条件を固定すると、AIは「どこを短くしてよいか」を判断できます。

目標時間は、最後に削って合わせる数字ではありません。
最初に決めて、発話と待ち時間へ何秒ずつ使えるかを逆算するための時間予算です。

2. 発話と操作待ちを分ける

画面収録には、説明している時間と、読み込みや保存を待っている時間が混ざっています。
この二つを同じルールで処理すると、説明は聞きづらくなり、待ち時間は十分に縮まりません。

そこで、音声の有無だけでなく、前後のつながりも見ながら区間を分けます。
話し始めと語尾へ少し余白を残すことで、倍速区間へ移る境目でも言葉が切れにくくなります。

3. 音声を残す区間は、ピッチを保って倍速する

通常の早送りでは、速度と一緒に音の高さも上がり、声が不自然に聞こえることがあります。
今回は時間だけを縮め、声の高さは元のままに保つ処理を使いました。

一方で、長い操作待ちは音を聞かせる意味がありません。
音を消して大幅に高速化し、視聴者には「処理が進んでいる」という経過だけを見せています。

4. テロップを、文字数ではなく意味で切る

テロップが読みにくくなる原因は、誤字だけではありません。
話の途中で次のテロップへ切り替わったり、次の場面の言葉が前の画面へ残ったりすると、視聴者は小さな違和感を覚えます。

今回も、一つの主張が終わる場所、画面操作が次へ進む場所、息継ぎが入る場所を見ながら54ブロックへ分けました。
テロップの切り替えを話し手の思考と揃えると、倍速した動画でも内容を追いやすくなります。

5. 完成動画と、直せる中間素材を分けて残す

AIで早く作れても、修正のたびに元動画からやり直していては効率が上がりません。
今回は、区間の設計、文字起こし、テロップの文言と時刻、合成前の編集マスター、完成版を分けて管理しました。

テロップだけを直すなら、カットや倍速の設計はそのまま使えます。
倍速の境目を直す場合も、文字起こしからやり直す必要はありません。
速さだけでなく、戻りやすさまで設計しておくと、手戻りのコストを小さくできます。

自分の動画をAIで短くしたい時に、先に渡すもの

同じ方法を使うなら、編集ソフトの操作より先に、次の6点を言葉にしておくと進めやすくなります。

  • 元動画の場所と長さ
  • 目標とする完成時間
  • 絶対に残したい説明や場面
  • 大幅に高速化してよい待ち時間や操作
  • 音程、テロップ、モザイクに関する基準
  • 修正に備えて残したい中間素材

依頼文にすると、次のようになります。

この画面収録を5分以内へ短くしてください。
説明している箇所は、音の高さを変えずに聞き取れる速さで倍速してください。
無音や操作待ちは、経過が分かる範囲で大幅に高速化し、不要な音はミュートしてください。
テロップは意味の段落ごとに改行し、次の場面へ移るタイミングで切り替えてください。
モザイクは必要な箇所だけにし、今回は対象がなければ入れないでください。
修正が出ても、カットや文字起こしからやり直さなくてよい中間素材を残してください。

ここまで具体的なら、AIが勝手に編集の正解を想像する範囲が小さくなります。
どのソフトを使うかより、完成条件と判断の境界を渡せているかの方が、仕上がりへ大きく影響します。

最初から専門的な編集指示を書く必要はありません。
「ここは聞かせたい」「ここは経過だけでよい」「この言葉のまとまりで画面を変えたい」と、視聴者にどう受け取ってほしいかを普段の言葉で伝えれば、AI側で処理の条件へ置き換えられます。

この方法が向いている動画、向いていない動画

今回の方法は、パソコンの操作説明、Webサービスの使い方、制作過程、設定作業、資料を作る様子など、説明と操作待ちが混ざる動画に向いています。
話している部分には情報があり、待っている時間は経過さえ分かればよいため、区間ごとの役割を分けやすいからです。

反対に、対談やインタビュー、感情を伝えるスピーチでは、沈黙や間そのものに意味があることがあります。
その場合は無音を一律に高速化せず、相手の反応や考える時間を残す基準が必要です。

AIで短くできるかどうかは、動画の長さだけでは決まりません。
何を理解してほしい動画なのか、どの時間に意味があるのかを先に言葉にできるかで決まります。

AIが得意なのは処理、人が担うのは意味の判断

1時間を超える動画から音声を検出し、区間を切り、時間予算に合わせ、テロップを合成する処理はAIが得意です。
一方で、この説明は残したい、この待ち時間は一瞬でよい、この言葉のまとまりで画面を切り替えたい、という判断には人の意図が必要です。

人が全区間を手作業で切るのでも、AIへ丸投げするのでもありません。
人が完成条件と意味を決め、AIが全編へ一貫して適用する分担にすると、速さと品質を両立しやすくなります。

先日の動画編集のBefore/After記事では、AIが作った初稿へ人が違和感を伝え、その判断を次回も使えるSkillへ残した過程を紹介しています。
今回の記事と合わせて読むと、長い動画を短くする初回の設計と、完成度を上げる修正の両方が分かります。

AIへ仕事を任せる時の前提から整理したい方は、AIに仕事を任せる時は、プロンプトより完了条件を渡すも続けて読んでみてください。
今回の動画編集で最初に6つの条件を決めたのも、同じ考え方です。

話した素材を、見てもらえる形へ変える

長い画面収録は、そのままでは見てもらいにくい素材です。
しかし、説明として残す部分と、経過だけ見せる部分を分ければ、1時間を超える素材でも5分以内の動画へ変えられます。

AI動画編集の価値は、編集作業を全部なくすことではありません。
人が毎回行っていた区間分け、時間計算、テロップ合成、全編検査を再現できる工程へ変え、話した内容を発信まで運びやすくすることです。

ただし、動画を作って発信できるようになっても、その先で相手との対話が進まなければ仕事にはつながりません。
動画を見て相談へ来てくれた人との向き合い方は、個別相談の成約率を上げる5つのステップ──売り込む前に整えたい相談設計で整理しています。

Practice Program

この記事を実践に変えるプログラム

記事で見えた課題を、知識として読むだけで終わらせず、自分の仕事の仕組みとして実装したい方へ。

Obsidian×Codex/Claude Code 自分専用AI業務システム構築・全5回実践講座

AI活用・業務効率化価格 ¥98,000

ObsidianとCodexまたはClaude Codeをつなぎ、自分の情報・知識・発信・制作・日々の業務をAIと一緒に回せる仕組みを、全5回で実装する実践講座です。

11レッスン総時間 5時間10分
この実践プログラムを見る

この記事をシェア

役立ちそうな方へ、記事のリンクを送れます。

コメントをする

関連記事

まだ他の記事で学びたい方は、今のテーマを一段深める記事からどうぞ。

コメント

まだコメントはありません。

ログインせずに投稿できます。投稿者名は「匿名」と表示されます。

0 / 1,000文字