今回は、nijijourneyで作成したアニメの1カットに対して細かく動きの指示を与え、どこまで精密にアクションを再現できるのかを試しました。
再現したかった流れは、以下のような一連のアクションです。
・少女が剣を振り上げる
・ドラゴンが口に炎を溜める
・剣を振り下ろすと同時に炎を吐く
・カメラはその動きに追従する
5秒という短い尺ではありますが、この一連の流れをひとつのカットとしてどこまで成立させられるかを検証しています。
今回見たかったこと
今回の検証で注目したのは、静止画として完成している1枚のアニメビジュアルに対して、動画生成AIがどこまで連続したアクションとして意味のある動きを与えられるかという点です。
単にイラストを動かすのではなく、複数の主体がそれぞれ別のタイミングで動き、さらにそれがひとつの攻防として成立するかを見てみたかった、というのが主な目的です。
少女の剣の動作、ドラゴンの予備動作、そして攻撃が交差する瞬間をひとつの流れとして設計することで、動画生成AIが時間軸の中でどの程度アクションの因果関係を保てるのかを確認しました。
生成された動画について
出力結果を見ると、剣を振り上げるタイミングで一瞬だけ形状が不安定になる場面はありましたが、その後の流れはかなり素直に成立しました。
特に印象的だったのは、剣の振り下ろしとドラゴンのブレスがほぼ同時に発生し、その交差するタイミングにしっかり見せ場が生まれていたことです。さらにカメラの追従も大きく破綻せず、5秒の短い映像の中でもアクションの山場を感じられる仕上がりになりました。
静止画1枚からここまで動きの前後関係を持たせられるという点では、かなり再現性の高い結果だったと思います。