オルタナティブ・ブログ > まあまあ元気になる話 >

IT業界での少し気分がアップする出来事、心持ち役立つこと、ややイイ話

中国ショートドラマにはまったので、生成AIで全8話作ってみました

»

ここのところ、SNSを見ているとよく流れてくる、中国のショートドラマにはまっています。
「見下されていた主人公が、実はとんでもない大物だった」といったやつです。
1話がとても短く、展開もかなり大げさ。設定も分かりやすいものが多いのですが、これが意外とクセになります。
「続きが見たい」→「どこで見られる?」→「ここから有料か......」などとやっているうちに、最近は生成AIを使って制作されたショートドラマも結構あることに気がつきました。
それなら、自分でも一度作ってみようかと。
そこで、企画、脚本、人物設定、画像、動画、音声まで生成AIや身近なソフトを組み合わせ、中国ショートドラマ風の縦型ドラマを作ってみました。
30秒×全8話。タイトルは『帰還した令嬢の正体』。
本格的な映像制作というより、「今使える生成AIを組み合わせて、追加課金をほとんどせず、個人でどこまで作れるのか」を試してみる実験です。

第1話s.jpg
(Youtubeショート)『帰還した令嬢の正体』第1話

今回使ったツール
制作工程と使用したツールは次のようになりました。

工程 使用ツール
企画・構想相談 ChatGPT、Gemini
脚本・絵コンテ支援 ChatGPT、補助的にGemini
基準ビジュアル・絵コンテ画像生成 ChatGPT
動画生成 Google Flow
女性キャラクターの音声収録 Windows サウンドレコーダー
女性音声の加工・男性音声の読み上げ CapCut
動画編集・テロップ VideoProc Vlogger

BGMや効果音については、生成AIとは関係なく、これまで動画を作るときと同じようにフリー素材を使用しました。今回は生成AIを使った制作工程を中心に書きたいので、その部分は省きます。

1.企画・構想――生成AIは「一緒に考える相手」に向いている
最初にChatGPTとGeminiに相談したのは、「どんな話にするか」でした。こちらから条件を伝えると、いくつもの案をすぐに出してくれます。こちらが考えた案について、「この構成ならこうした方が伝わりやすい」と評価してもらうこともできます。
一人でゼロから考えるより、アイデアが形になるまでが圧倒的に速い。
ただし、実際にやってみてより強く感じたのは、生成AIに企画を丸投げするだけでなく、自分が何を作りたいのかをきちんと伝える必要がある、ということです。
今回は、「中国ショートドラマらしい話にしたい」だけでなく、「せっかく大学教員が作るので、所属している情報社会学科で学ぶIT・経営・デザインにもつなげたい」、「初めて作る練習作品なので、制作しやすいものにしたい」という条件も加えました。
その結果、登場人物や場所を増やしすぎず、また、異世界や後宮を舞台にしたものではなく、現代を舞台にした「令嬢もの」になりました。
幼い頃に家を離れた本物の令嬢が実家に戻ってくる。養女に見下されるものの、実はデザイン、IT、経営の力を持っている――という設定です。

2.脚本・絵コンテ――8話分は一瞬で出る。でも、そのままでは使えない
大まかな設定が決まれば、全8話の構成そのものはChatGPTがかなり短時間で作ってくれます。これは非常に便利です。
ただし、出てきたものをそのまま映像化できるわけではありません。
例えば、「30秒の回なのに明らかにセリフが多すぎる」「視聴者が理解するために必要な説明が抜けている」「内容を盛り込みすぎて、全8話では消化しきれない」といったことです。こうした点はかなり手直ししました。
また、今回意識したのは、毎回何か問題が起き、その回では完全には解決せず、最後に次回へのクリフハンガーを置くことです。
さらに、1話30秒に収めるためには、一つ一つのセリフをかなり短くし、「自然な会話」と「短時間で設定を説明すること」を両立しなくてはいけません。このあたりは、AIに候補をもらったりして、何度もやりとりしながら、詰めました。

3.基準ビジュアルと絵コンテ画像――「それらしい1枚」と「同じ世界の次の1枚」は違う
人物や背景については、最初はGeminiとChatGPTの両方で画像を作っていました。最終的には、自分がイメージしていた人物像やドラマの雰囲気にChatGPTの画像生成の方が近かったため、途中からChatGPTに一本化しました。
ここで一番苦労したのが、連続性です。
1枚だけなら、非常にそれらしい画像ができます。ところが次のカットになると、「髪型が少し変わる」「服のボタンの数が変わる」「襟なしのジャケットに、いつの間にか襟が付いている」といったことが起きます。
また、カメラ位置や構図の維持がさらに難しく、「右に座っていたはずの人物が左に移動する」「反対側から撮った途端、窓とテーブルの位置関係がおかしくなる」、さらに複数人になると、「手前から父、莉奈(養女)、澪(主人公)の順に座らせたい」という程度の指定でも、なかなか思い通りになりません。
登場人物ごとに、「基準ビジュアル」を決め、顔、髪型、服装、年齢感を固定。さらに、場所についても、会議室ならテーブル、窓、大型モニターなどの位置を決めた画像を予め用意し、新しいカットを作るたびに、それらを参照させることにしました。それでも完全には一致しません。
今回使った方法では、1枚の画像そのものはかなりイメージに近いものを作ることができました。一方で、前のカットとの整合性を保ちながら次の画像を作るところでは、何度も試行錯誤することになりました。

4.動画生成――一度にたくさん動かそうとしない
静止画ができたら、Google Flowで動画化しました。基本的には、作成した絵コンテ画像を読み込ませ、静止画を数秒の動画にしています。ここでも、欲張るとうまくいきません。少なくとも今回の制作では、一つのカットに多くの動きを入れようとすると、思った通りにならないことが増えました。
例えば、「立ち上がる→歩く→相手を見る→タブレットを差し出す」まで一度にやらせようとすると、途中で人物や服装が変わったり、不自然な動きになったりします。ジャケットの色が途中から変わることもありました。
また、「こちらは人物を見せたいだけなのに、意味もなくカメラがアップになる」「正面を見ていてほしいのに、途中から別の方向を向く」といったことが起きます。
そこで、なるべく1カット=1つの動作になるようにしました。カメラは固定、というのもプロンプトでしっかり指定します。視線も「カメラより少し右」など、かなり細かく指示しました。
もう一つ戸惑ったのが、生成途中でポリシー違反の警告が出て、生成が途中で止まることがあったことです。普通の会議室で人物が話しているだけの場面でも、画像やプロンプトの組み合わせによっては生成できないことがありました。その場合は、プロンプトの文章を変えたり、元画像を少しトリミングしたりして対応しました。

5.音声――AI読み上げだけでは、意外とうまくいかなかった
音声は当初、すべてCapCutの読み上げで済ませるつもりでした。ところが実際に試してみると、同じキャラクターの音声を指定しても、別々に生成すると声質が少し変わることがあります。それなら、同じ人物のセリフを全部まとめて一度に生成すればよい、となりますが、そうは上手くいきません。今度は、個々のセリフで思ったような抑揚がつかなかったり、イントネーションが不自然になったり。そこで、セリフの多い、女性キャラクターについては、別の方法を採りました。
自分でセリフを読み、それをCapCutで女性の声に加工する方法です。
元の演技は自分で付けられるので、「大袈裟に言う」「少しためらう」「語尾だけ柔らかくする」といったニュアンスをコントロールできます。まあ、私自身は声優ではないので、たかが知れていますが。一方、男性キャラクターも同じ方法で試したのですが、こちらは自分の声からあまり印象が変わりませんでした。そこで男性については、CapCutの音声読み上げを使用しました。
結果として、
•女性=自分で演技して録音 → AIで声質を変更
•男性=AI音声読み上げ
という、少し変則的な方法に落ち着きました。
AIを使えば全部自動でできる、というより、AIと自分の得意なところを組み合わせた方が結果がよかった、という一例です。

6.編集――最後は普通の動画編集
生成した短い動画、音声、テロップをつなぐ最終編集には、VideoProc Vloggerを使用しました。
ここは、従来の動画制作とあまり変わりません。

7.結局、どのくらいお金がかかったのか
ChatGPTとGeminiは、もともと日常的に使用している有料プラン(ChatGPT Plus:20ドル/月、Google AI Pro:2900円/月)を利用しました。今回のドラマ制作のために、画像生成や脚本作成で追加料金を支払ったわけではありません。 (ちなみに、ChatGPTは無料版でも画像生成を利用できますが、利用上限はプランや時期によって変わります。)
Google Flowについても、契約中のGoogle AI Proで付与されるクレジットの範囲で制作しました。今回の制作時には、9:16、360p、4秒または6秒の動画を1回につき2本生成し、良い方を採用。私が使用した設定では1回8クレジット程度で、試行錯誤を含め、全8話で合計368クレジットを使用しました。現在は、Google AIのサブスクリプションを契約していないユーザーにも1日50クレジットが付与されています。日を分けて少しずつ制作するのであれば、同程度の規模を無料枠で試してみることもできそうです。(ただし、クレジットの付与条件や生成時の消費量は変更される可能性があります。)
CapCutは今回使用した音声加工・読み上げを無料機能の範囲で利用し、録音にはWindows標準のサウンドレコーダーを使用しました。最終編集に使用したVideoProc Vloggerも無料で、出力時間や解像度、機能の制限やウォーターマークはありません。
つまり、普段から使っている生成AI環境を除けば、今回の制作のために新たに支払った費用は、実質的には「ほぼゼロ」でした。
※料金や無料枠、クレジットの条件は2026年10月時点のものです。

8.全8話作ってみて思ったこと
今回、生成AIに手伝ってもらったのは、企画のアイデア、脚本のたたき台、画像、短い動画、音声など、制作工程のさまざまな部分です。
その一方で、「どの案を採用するか」「どこを直すか」「どのカットを使うか」「何秒見せるか」「どういう作品として完成させるか」は、その都度、自分で判断しました。
もちろん、これは今回、私が使ったツールと作り方での体験です。今話題のSeedance、ElevenLabsといった別のサービスや、もっと高度な制作環境を使えば、違った作り方になるでしょう。実際のAIショートドラマ制作の現場では、もっと高度な方法が使われているかもしれません。
ただ、どれだけ技術が進歩しても、少なくとも自分の名前で何かを世に出す以上、最終的な成果に責任を持つのは自分です。そう考えると、「どのAIを使うか」以上に、「何をAIに任せ、何を自分で判断するのか」を考えることは、これからも付いて回るのではないかと思います。
今回は、中国ショートドラマにはまったことをきっかけに、そんなことを考えながら、生成AIを組み合わせて30秒×全8話の『帰還した令嬢の正体』を作ってみました。
先日、第1話「その服、どこの安物?」をYouTubeショートに投稿しました。30秒ほどですので、技術検証のサンプルがてら、息抜きにどうぞ。
▼ 第1話「その服、どこの安物?」(YouTubeショート)
https://youtube.com/shorts/dQ9-wqWNpY8?si=a6zBeLwnB0b7x0UH
これから初期反応を見守りつつ、毎週土曜日に1話ずつ公開していく予定です。
実際に視聴者がどう反応したのか、完結後にまたご報告できればと思います。

緊迫の役員会議室プレゼン.png

Comment(0)