動画生成AIとは?Sora登場で変わった動画づくりの常識
目次
「動画生成AI」って結局どんな技術なのか
SNSを見ていると、実写にしか見えないのに現実には存在しない映像が流れてくることがある。「これ、どうやって撮ったんだろう」と思ったら、実は撮影すらしていない、AIが一から作った動画だった――そんな場面に出くわす人が増えている。
その正体が「動画生成AI」だ。文章や画像を入力すると、AIが自動で映像を作ってくれる仕組みで、これは「生成AI」と呼ばれる技術の一種にあたる。生成AIとは、文章・画像・音声・動画といったコンテンツを、人間の代わりに一から作り出すAIの総称だと考えるとわかりやすい。ChatGPTが文章を作るように、動画生成AIは映像を作る。担当している中身が「文章」から「映像」に変わっただけで、根っこの考え方は同じだ。
入力する指示文のことは「プロンプト」と呼ぶ。「夕暮れの海辺を歩く犬、波打ち際、映画のような雰囲気」といった具体的な文章を打ち込むと、それに沿った数秒から数十秒の動画が生成される。絵コンテを描く代わりに、言葉で映像の設計図を渡すイメージに近い。
Soraの登場で何が変わったと言われているのか
この分野で大きな話題になったのが、ChatGPTを開発しているOpenAI社が発表した動画生成AI「Sora」だ。文章から映像を作るという発想自体は以前からあったが、Sora以降に急速に注目度が上がった理由は、映像のリアルさと安定感が大きく進んだからだと言われている。
以前の動画生成AIは、静止画を無理やりつなげたような不自然な動きになったり、数秒でキャラクターの顔や背景が崩れてしまったりすることが多かった。重力で物が落ちる、水面に波紋が広がる、といった物理的な現象を再現するのも苦手だった。Soraをはじめとする最近の動画生成AIは、こうした自然な動きの再現度が上がり、一つの映像の中で人物や背景の一貫性が保たれやすくなった点が評価されている。
OpenAI以外にも、Googleが発表した動画生成AIや、映像制作向けに開発が進められているサービスなど、複数の企業が同じ分野に力を入れている。技術の進化はまだ続いている途中で、できることの範囲は今後も変わっていく可能性が高い。
何が変わったのか、動画作りのハードルで比べてみる
以前は、数十秒のオリジナル映像を用意しようと思うと、カメラで撮影するか、CGソフトを使って一から作り込むか、写真素材を編集ソフトでスライドショーにするしかなかった。どの方法も、機材や専門ソフトの操作、それなりの制作時間が必要だった。
動画生成AIが変えたのは、この「準備の量」だ。カメラや役者、撮影場所を用意しなくても、文章を打ち込むだけで映像のたたき台ができる。もちろん今のところ、狙った通りの映像が一発で出てくるとは限らず、何度かプロンプトを調整し直す作業は発生する。それでも、企画の初期段階で「こんな雰囲気の映像にしたい」というイメージを映像として素早く形にできるようになった意味は大きい。
たとえば、動画の完成イメージを関係者に共有するための仮映像、SNS投稿用の短い映像素材、企画のアイデア出しの段階で使う参考映像といった用途で、試しに使ってみる人が増えている。実際の商用映像制作の現場でも、ラフな試作段階でこうしたツールを組み込む動きが出てきている。
実際に何ができて、何が苦手なのか
得意なこととして挙げられるのは、抽象的なイメージを短時間で映像化できる点だ。「夜の街を走る車のヘッドライト」「雪が降る山小屋」のような、写真や動画素材を探すのが難しいシーンでも、文章で説明すればそれらしい映像が出てくる。
一方で、まだ苦手な部分も残っている。人の手や指の動き、細かい文字、複雑な物の重なりなどは不自然になりやすい。数十秒を超える長い映像になると、途中で人物の服装や背景が微妙に変わってしまうこともある。また、狙った通りの構図やカット割りを細かく指定するのは今のところ簡単ではなく、何パターンか生成して良いものを選ぶ、という使い方が現実的だ。
試してみたい場合の一般的な流れは次のようになる。
- 提供元の公式サイトにアクセスする
- アカウントを作成する(現時点では利用に審査や順番待ち、有料プランが必要なサービスもある)
- 作りたい映像の内容をプロンプトとして入力する
- 生成されるまで待ち、出てきた映像を確認する
- 気に入らなければプロンプトを直して作り直す、良ければダウンロードして活用する
利用できる範囲や料金体系は変わりやすい分野なので、実際に使う際は公式サイトで最新の案内を確認してから進めるのが安心だ。
プロンプトを書くときのコツ
同じ動画生成AIでも、プロンプトの書き方次第で仕上がりの印象はかなり変わる。ポイントは、頭の中にある映像を「被写体」「動き」「場所や背景」「雰囲気やカメラワーク」の4つに分けて言葉にすることだ。漠然と「かっこいい動画」とだけ書くよりも、要素を具体的に並べたほうがイメージに近い映像が出やすい。
たとえば、そのままコピーして使える例としてはこんな書き方になる。
- 「夕方の商店街を歩く白い猫、ゆっくりとしたカメラワーク、あたたかい光、ノスタルジックな雰囲気」
- 「雨上がりの都市の夜景、ネオンの反射が水たまりに映る、ドローンで上空から見下ろすような視点」
- 「木製のカップにコーヒーを注ぐシーン、湯気が立ちのぼる、静かで落ち着いた朝の雰囲気、接写」
一発で理想通りにならなくても、「もう少しカメラを引いて」「動きをゆっくりに」のように部分的に言葉を足したり変えたりして作り直すのが基本のやり方だ。文章生成AIに指示を出すときと同じで、最初から完璧な指示文を書こうとするより、出てきた結果を見ながら少しずつ言葉を調整していくほうが、結果的に早く理想に近づける。
使うときに気をつけておきたいこと
動画生成AIには、画像生成AIと共通する注意点がある。画像生成AIとは?Midjourney・Stable Diffusionでできることでも触れているように、AIが作った映像の著作権が誰に属するのか、商用利用にどんな条件が付くのかは、サービスや国によって扱いが分かれている。気になる場合は利用規約を確認してから使う必要がある。この点はAIが作った文章や画像は誰のもの?著作権の基本の考え方でも整理している。
もう一つ意識しておきたいのが、実在の人物に似せた映像を無断で作ってしまう問題だ。本人が話していないことを話しているように見せる映像は「ディープフェイク」と呼ばれ、悪用されると誤解や信用の毀損につながる。動画生成AIの精度が上がったことで、こうした映像を作ること自体は以前より簡単になっている。だからこそ、実在の人物や企業を扱う映像を作るときは、それが誤解を招かないか、公開してよい内容かを一度立ち止まって考える姿勢が求められる。
さらに、AIが作った映像だからといって内容が正確とは限らない点も覚えておきたい。史実に基づいた映像を作らせても、細部が事実と異なる映像になることがある。教育目的や情報発信で使う場合は、内容を鵜呑みにせず、事実確認を別途行うことが欠かせない。
まとめ
動画生成AIは、文章を打ち込むだけで映像を作れる技術で、Soraのようなサービスの登場によって、映像の自然さと一貫性が大きく前進した分野だ。撮影や専門ソフトが無くても映像のたたき台を作れるようになった一方、細部の不自然さや長尺での崩れ、著作権やディープフェイクといった課題もまだ残っている。
まずは無理に高度な使い方を狙わず、短いプロンプトで試しに一本映像を作ってみて、得意な部分と苦手な部分を自分の目で確かめてみるのがいちばんの近道だ。技術の進化が速い分野なので、数か月単位でできることが変わっていく前提で、気軽に触れてみるくらいの距離感がちょうどいい。生成AI全体の変化をもう少し広い視点でつかんでおきたい人は、『生成AIで世界はこう変わる』要約ー今井翔太が示す変化の輪郭も参考になる。
「動画編集AI 入門 本」を探している方へ
この記事で紹介した選び方を参考に、実際の製品ラインナップを見比べてみてください。
Amazonで動画編集AI 入門 本の価格を見る 楽天市場で動画編集AI 入門 本を見る「動画編集AI 入門 本」を探している方へ
この記事で紹介した選び方を参考に、実際の製品ラインナップを見比べてみてください。
Amazonで動画編集AI 入門 本の価格を見る 楽天市場で動画編集AI 入門 本を見る