AIショート動画用の固定キャラクターを作る―fal.ai登録からFLUX LoRA学習まで
fal.aiの登録直後の初期設定、クレジット購入、FLUX LoRAへの学習画像投入、Trigger Word設定、学習、Run Inferenceでの確認までを、実際の作業画面を使って記録する。月島弥生と一条睦月の2人をAIショート動画用の固定キャラクターにした。

AIショート動画で同じ主人公を何カットも出したいのに、生成するたびに顔や髪型が変わる。今回の短編制作では、この問題を先に処理するため、fal.aiのFLUX LoRAで男女2人を固定キャラクターとして学習させました。
登録直後の初期設定から、クレジット購入、学習用画像の準備、Trigger Wordの設定、LoRA学習、Run Inferenceでの生成確認まで、実際に操作した順番で記録します。作業中に保存した実画面と、今回のために生成した月島弥生・一条睦月の画像もそのまま使います。
今回作るのは「未確認怪異記録 No.001 赤い傘の女」#
今回始めたのは、70~90秒程度のYouTube Shorts / TikTok向け短編シリーズ。
題材は**「未確認怪異記録 No.001 赤い傘の女」**。ドキュメンタリー風ホラーとして、女性調査員が現地へ入り、男性調査員が監視室から警告する構成にした。
固定キャラクターは2人。
- 女性調査員:月島 弥生(つきしま やよい)
- 男性調査員:一条 睦月(いちじょう むつき)
弥生は黒髪ボブ、黒カーディガン+白系トップ。睦月は黒髪、丸い細フレーム眼鏡、ネイビーのパーカー+白Tシャツを基本仕様にした。
ショート動画では、駅へ到着するカット、聞き込み、監視室、ホーム、怪異を見つけた後の表情など、同じ人物を何度も別構図で出す。1枚の完成画像だけを持っていても、次の画像生成で顔が変わると連続した映像に見えにくい。
そこで、動画化へ進む前に人物固定を先に終わらせることにした。
先に月島弥生と一条睦月の基準画像を作る#
弥生は正面、斜め、横顔、上半身、全身、表情違いを含む複数画像を作った。

採用した基本イメージは、黒髪ボブ、黒カーディガン、白系トップ。

睦月も同様に、正面、斜め、横顔、上半身、全身、表情違いを用意した。

睦月は眼鏡を固定する。基準画像も、黒髪、丸い細フレーム眼鏡、ネイビーのパーカー、白Tシャツでそろえた。

この2人をLoRAへ学習させ、後のカット生成で呼び出せるようにする。
fal.aiへ登録する#
fal.aiへアカウントを作成してログインすると、最初に用途を選ぶ画面が表示された。
画面にはWho are you signing up for?とあり、For myselfとFor my companyの2択。今回は個人でAI生成を試すため、For myselfを選択した。

次にHow did you hear about fal?と聞かれる。画面上にもoptionalと表示されていた。
Google、AI search、Social media、Blog、Event、Billboard、Word of mouth、Otherから選べる。

この初期設定を抜けるとDashboardへ入った。
登録直後はCreditsが0ドル#
登録直後のDashboardにはGetting startedが表示されている。
- Create an account
- Add a payment method
- Add credits
- Generate your first media
アカウント作成だけが完了していて、支払い方法とクレジットはまだ未設定。

右上のCreditsを開くと、Available credits $0.00、Out of creditsと表示された。

LoRA学習は有料なので、ここでクレジットを追加する。
10ドル分のCreditsを購入する#
Buy creditsを押すと金額選択が表示された。
今回の画面では、$10、$25、$50、$100。まず試すために**$10**を選んだ。

続いてBilling addressを登録する。

住所情報を保存するとAddress savedと表示される。

購入画面はStripeへ移った。作業時は10ドル分のFal Creditsが1,633円と表示され、画面上の換算は1 USD = 163.300 JPY。
これは今回の決済画面に表示された値で、将来の購入時も同額になるという意味ではない。

決済後にfal.aiへ戻ると、Creditsが**$10.00**へ変わった。

ここまででLoRA学習を実行できる状態になった。
FLUX LoRAの学習画面へ進む#
Dashboardには画像、動画、音声系のモデルが並んでいる。

今回使ったのはFLUX LoRAの学習機能。まず月島弥生から学習した。
月島弥生の学習用ZIPとTrigger Wordを準備する#
弥生の学習画像をZIPにまとめた。
yayoi_tsukishima_lora_images.zip
Trigger Wordは、
yayoi_tsukishima
とした。
Trigger Wordは、学習後にこの人物を生成プロンプトから呼び出すために使う。
弥生のFLUX LoRA設定#
学習画面でZIPを指定し、Trigger Wordへyayoi_tsukishimaを入力。

今回確認した設定はこうなった。
| 項目 | 設定 |
|---|---|
| Trigger Word | yayoi_tsukishima |
| Is Style | OFF |
| Create Masks | ON |
| Steps | 1000 |
| 学習料金の画面表示 | $2 / training run |
Is StyleはOFF。今回は画風の固定より、人物を複数カットで再利用するための学習を優先した。
ZIPを選ぶと学習データが追加される。

設定を確認してStartを押した。
Training historyで学習状態を確認する#
開始すると右側のTraining historyへジョブが追加される。

処理が終わるとCompletedへ変わった。履歴にはtrigger_word yayoi_tsukishimaとsteps 1000も表示されている。

ここからRun Inferenceへ進んだ。
Trigger Wordだけでは狙った実写風にならなかった#
Run Inferenceを開くと、学習済みLoRAのPathが設定済みで、PromptへTrigger Wordを入れられる。
最初は、
yayoi_tsukishima
だけで確認した。

右側の結果はアニメ調。ここは予想していた見え方と違った。
LoRA自体の学習完了は確認できているので、次は生成側のPromptへ人物と写真表現を具体的に入れた。
実写風の月島弥生として生成する#
生成時はTrigger Wordに加えて、若い日本人女性、黒髪ボブ、黒カーディガン、白系トップ、実写写真、自然な肌、スタジオ撮影といった条件を追加した。
LoRA Scaleは1。
生成し直すと、動画制作へ使う弥生の方向に近づいた。

髪型は最初の生成より少しボリュームを抑え、若い印象に調整。顔はこの方向で固定することにした。
生成画面には$0.035 per megapixelという料金表示も出ていた。これは作業時点で実際に画面へ表示された単価。
一条睦月も別のLoRAとして学習する#
続いて一条睦月。
学習用ZIPのTrigger Wordは、
mutsuki_ichijo
Is StyleはOFF。弥生と同じ流れで学習を開始した。

学習後にRun Inferenceへ進むと、睦月のLoRA PathとScale 1が設定された。

人物確認用には、黒髪、丸い細フレーム眼鏡、ネイビーパーカー、白Tシャツ、実写写真という条件を入れた。
最終確認では、顔、髪型、眼鏡、年齢感、服装とも、このまま固定で進めることにした。
2人のTrigger Wordが決まった#
今回作った固定キャラクターはこの2人。
月島 弥生
Trigger Word: yayoi_tsukishima
一条 睦月
Trigger Word: mutsuki_ichijo
今後は弥生が登場するカットでyayoi_tsukishima、睦月が登場するカットでmutsuki_ichijoを使う。
駅、ホーム、聞き込み、監視室など背景が変わっても、人物側は同じLoRAを基準に生成できる。
今回の画面で確認できた費用#
| 内容 | 作業時に確認した料金 |
|---|---|
| 購入したFal Credits | $10 |
| 決済時の円表示 | 1,633円 |
| FLUX LoRA学習 | $2 / training run |
| Run Inference画像生成 | $0.035 / megapixel |
弥生と睦月でLoRA学習を1回ずつ実行しているので、人物学習だけで2回分。さらに確認用の画像生成料金が加わる。
料金や為替は変わる可能性があるため、同じ作業を行う場合は実行時の画面表示を確認した方がよい。
次は「赤い傘の女」の12カットを作る#
固定キャラクターの準備が終わったので、次は本番用の静止画へ進む。
現在考えている12カットは、
- オープニング
- 夜の駅へ到着
- 監視室の睦月
- 無人の駅構内を調査
- 男性駅員への聞き取り
- 駅員の背後に赤い傘
- 駅員の異変
- 睦月から強い警告
- ホーム奥に赤い傘の女
- 怪異の姿を見せる
- 弥生が撤退
- 後日ニュース
という流れ。
この時点ではKlingによる本番動画化、TTS、リップシンク、CapCut編集、YouTube Shorts / TikTokへの公開はまだ実施していない。
次の作業は、学習済みLoRAを使って12カットの静止画を作るところから始める。


