SPICYFRAME · 実践ガイド
写真から動画 AI:1 枚の写真を動くシーンに
写真から動画を作る AI のしくみ、仕上がりを左右するポイント、1 枚の写真を音声付きの 5・10・30 秒クリップにする方法を解説します。
更新日
写真から動画 AI が実際にしていること
画像から動画を生成するモデルは、写真を最初のビジュアル参照として読み取り、文章のプロンプトに沿って新しいフレームを生成します。顔を向ける、数歩進む、風に揺れる髪、ゆっくりしたカメラのプッシュインなど。写真をテンプレートにはめ込むのではなく、動きそのものを生み出すため、わかりやすい写真と同じくらい、わかりやすいプロンプトが大切です。SpicyFrame はすべてのレンダリングに、ByteDance の画像から動画モデル Seedance 2.5 を使っています。
SpicyFrame なら 3 ステップ
使用許可のある参照画像を 1〜12 枚追加し、シーンを 1〜2 文で書いて、5・10・30 秒と標準 480p または高画質 720p を選びます。料金はお支払い前に表示されます。仕上がりは、ネイティブの環境音付きの縦型 9:16 MP4 です。
一発で決まるプロンプト
@Image 1 で主語を指定し、メインの動き、カメラワーク、ムードを 1 つずつ入れます。「@Image 1 がカメラに向かってゆっくり歩く、背景に街の灯り、穏やかな手持ちのプッシュイン、暖かな夕方の光、衣装はそのまま」。短いクリップに、関係のない動きをいくつも並べるのは避けましょう。
よく動く写真の条件
シャープで明るく、被写体の全体が見える写真が最適です。顔がとても小さい、フィルターが強い、極端なクロップ、ごちゃごちゃした集合写真は、動きが不安定になりがちです。手や腕がフレームで切れていると、モデルがそこを補わなければならず、崩れが出やすくなります。
まずは短く、それから長く
動きを試すなら、5 秒の標準画質($1.07 から)を使いましょう。動きが決まったら、同じプロンプトで 10 秒や 30 秒、または高画質 720p でレンダリングします。各レンダリングは、それぞれ料金とステータスを持つ別の注文です。