
GPT-6が写真を3Dワールドに変換。そして映画を作ろう
Sep 2026
X上で話題のGPT-6とSeedance 2.5のワークフローは、映画制作における馴染みのあるアイデアを新しい文脈に置き換えています。空間を構築し、アクションを配置し、ショットを生成する、というものです。
映画制作者にとって、魅力的なのはコントロールです。カメラはどこから始まるのか?キャラクターはいつ部屋を横切るのか?次のアングルは何を見せるのか?
Flickでは、1枚の写真から始めて、そのような演出を可能にします。
リファレンス画像を入れると、編集可能な3Dセットが生成され、どのように撮影したいかをエージェントに伝えることができます。撮影したテイクはキャンバス上のクリップになり、AI動画生成の準備が整います。
私たちが構築しているワークフローと、GPT-6からSeedanceへのデモとの比較をご紹介します。

写真を3Dセットに変換
ロケハンの写真、映画のスチル、または思い描いているシーンのビジュアルリファレンスから始めます。

Flickはその画像から3Dセットを構築します。オブジェクトには名前が付けられ、選択可能で、関連する要素はグループ化されています。リファレンスの視点をフレーミングするために、カメラはすでに配置されています。

これにより、演出を始める場所が得られます。出入り口、部屋の向こう側までの距離、または2つの建物の間のスペースを見て、ショットに何が必要かを判断できます。
セットはグレーで、プレビジュアライゼーションのために主要な形状と空間関係が配置されています。最終的なルックに取り組む前に、構図、動き、カバレッジを検討しています。
Blenderのセットアップは不要です。カメラムーブをテストする前に、ロケーションを一つ一つ構築する必要もありません。
ショットを説明すれば、エージェントが構築します。
遠くに出入口がある路上写真を想像してください。通りの上から始めて、降下しながら入口に向かって移動したいとします。
指示はこれほどシンプルで構いません:
クレーンダウンしてから出入口へドリーイン。
エージェントがセット内でカメラの動きを構築します。動きは連結されます:ドリーはクレーン移動が終わる位置から始まるため、複数のビートを持つショットを設計できます。
オービット、ドリーズーム、パンスイープ、または固定カメラを要求できます。被写体を追跡したり、カメラがシーンを飛び抜けるパスを描いたりできます。
創造的な決定はあなたに委ねられています。動きが出入口を早く見せすぎていないか?ワイドショットを保持すれば、接近がより緊張感を持って感じられるか?これらの質問に答えながら、セットとカメラを使って作業できます。
アクションを望む場所に配置
カメラの動きはショットの半分に過ぎません。その中を誰かが動く必要があります。
Flickのプロトタイプには47のキャラクターアニメーションが含まれています。床にパスを描いて、キャラクターを歩かせたり、ジョギングさせたり、走らせたりできます。他のオブジェクトもアニメーション可能です:ドアが開く、何かが落ちる、椅子が揺れるなど。
路上シーンでは、カメラが近づくのと同時にキャラクターを入口に向かわせることができます。これでアクションとフレーミングがどのように連携するかを確認できます。
これがAIプリビズの有用な部分です:変更がまだ容易な段階で、演出を可視化できることです。
カバレッジを同時に撮影
セットに複数のカメラを配置し、すべてを一度に記録します。
ワイドショットが通りを確立します。サイドアングルが接近を追います。別のカメラが出入口を監視します。1つのパフォーマンスで各アングルをテイクとして取得できます。
同じアクションに対するカバレッジを比較し、どの視点が最もストーリーを伝えるかを決定できます。キャラクターが入口に到達する瞬間が、複数の位置から検証できる対象になります。
プレビズから直接AI動画へ
記録されたテイクはすべてFlickキャンバス上にクリップとして配置され、そこで使用する動画モデルへ直接入力できます。
提案されたフローはシンプルです:
リファレンス写真 → 編集可能な3Dセット → カメラとブロッキング → 記録されたテイク → AI動画。
プレビズは演出とカメラ動きを次のステップに引き継ぎます。ビジュアルリファレンスと動画ディレクションで、作りたいルックを確立します。
ショットの計画から生成まで、Flick内で完結します。途中でシーンを個別にエクスポートする必要はありません。
私たちのBlenderによる映画制作ガイドでは、ラフな3Dアニメーションがどのようにして AI動画ショットを導くかをすでに説明しています。画像から3Dへの変換により、シーン構築とショット記録が同じワークスペースに統合されます。
GPT-6からSeedance 2.5への投稿が実際に示すもの
これらのデモは評価に値します。すでに動画に到達するワークフローを実証しており、生成前のシーンに対する意味のあるコントロールを備えています。
2026年9月3日、Higgsfieldは美術館シーケンスについて説明しました。そこではGPT-6 Astraがロケーション、キャスト、ショットリストを計画しました。ブロッキングはビューポート内に留まり、Seedance 2.5がセットアップを生成しました。Xで美術館ワークフローを見る。
9月5日、Higgsfieldはより完全なチェーンを投稿しました:剣戟のストーリーを開発し、Blenderでプレビズを作成し、Seedance 2.5でショットを生成し、最終編集を組み立てる。投稿によれば、このワークフローはキャラクターとロケーションを保持しました。Xで剣戟ワークフローを見る。
9月3日のカメラデモでは、スマートフォンをBlenderのビューポートにリンクさせてハンドヘルドの動きを制御する方法も説明されました。Xでハンドヘルドワークフローを見る。
これらの投稿はワークフローが何を達成したかを説明していますが、プロンプト、リトライ、介入の完全な記録は提供していません。比較対象として有用な例を示していますが、すべてのクリエイターがどれだけの作業を想定すべきかは確立していません。
Flickにとっての問題は、すでに手元にあるリファレンス画像から、このプロセスをどのようにアクセス可能にするかです。
| ワークフローの部分 | 参照されたGPT-6 / Seedanceワークフロー | Flickの画像から3Dへ |
|---|---|---|
| 開始地点 | 美術館と剣戟の例でのシーン計画またはストーリー概要 | 1枚のリファレンス写真 |
| シーンとブロッキング | ビューポートベースの演出; 剣戟の例でのBlenderプレビズ | Flick内の編集可能なセット |
| カメラディレクション | ハンドヘルドの例でのスマートフォン連動Blenderカメラ動き | 自然言語による動き、接続された動き、描画されたパス |
| カバレージ | 美術館の例での生成されたセットアップ | 複数カメラからの同時記録 |
| 動画への移行 | Seedance生成; 剣戟の例での最終編集 | 記録されたテイクが動画生成のためFlickキャンバスに到達 |
Blenderへの引き継ぎを簡素化する方法はすでに存在します。たとえば、Dreaminaはレンダリングとリファレンスクリップのアップロードを組み合わせたClay Rendererプラグインを文書化しています。Dreaminaのワークフローを参照してください。
Flickのアプローチは、写真ベースのシーン作成、ショット演出、録画されたテイクを一箇所にまとめます。フレーミングとブロッキングで考える方なら、それらの決定から始めることができます。
カメラを通した視界を中心に構築
実用的なセットは、撮影する予定の角度からまとまりを保つ必要があります。
Flickは、配置したカメラを通して再構築を確認し、そのカメラの焦点距離を使用します。結果の画像をレビューし、最大3回のパスにわたって修正を行うことができ、パスが変更を生成しなかった場合は早めに停止します。
このチェックは、あなたの構図に紐付いています。通りの端にある欠けた形状は、ほとんどの建物が存在していても、フレーム全体を変えてしまう可能性があります。
Flickはまた、視界を閉じる特徴を特定し、それを最初に構築します。路地の先にある寺院を想像してみてください。写真では小さくても、視線が向かう中心となります。
これらの詳細により、リファレンスはショットの出発点として有用になります。その後、その中で何が起こるかを演出できます。
次のセットは1枚の写真から始まる
写真を用意し、アクションをブロッキングし、カメラの動きを試し、カバレージを録画する。そしてキャンバス上でAI映画制作へと続けます。
私たちは、思い描いたショットを試すことにより多くの時間を費やしたい映画製作者のためにこれを構築しています。完成するまでの間、Flickを探索して、次のシーンのリファレンスを整理できます。
Flickの画像から3Dへの機能は無料になります。まもなく登場します。現在は動作中のプロトタイプであり、リリース日は未発表です。無料提供は画像から3Dをカバーし、ビデオモデル生成は別です。
よくある質問
AIは写真を3Dシーンに変換できますか?
はい。Flickの画像から3Dへのプロトタイプは、1枚の画像から編集可能なプレビズセットを構築し、選択可能なオブジェクトとリファレンスビューの周りに配置されたカメラを備えています。
Blenderや他の3Dソフトウェアの知識は必要ですか?
いいえ。私たちが構築しているワークフローはFlick内で実行されます。エージェントがセットを構築し、平易な言葉でのショット演出に応答します。
カメラを動かしたり、人物をアニメーションさせたりできますか?
はい。プロトタイプは接続されたカメラの動き、描画されたパス、キャラクターアニメーションをサポートしています。また、同じパフォーマンスのカバレージのために複数のカメラを同時に録画することもできます。
3Dシーンをどのようにして動画に変換しますか?
テイクを録画してください。それはFlickキャンバス上のクリップとなり、他のリファレンスや指示と一緒に動画生成の入力として使用できます。
3Dシーンはフォトリアルですか?
空間、フレーミング、動きを計画するためのグレーのプレビズセットです。最終的なビジュアル処理はAI動画の段階で行われます。
どのような画像から始められますか?
ロケハン写真、映画のスチル、またはシーンのビジュアルリファレンスです。このワークフローは1枚の画像から始まり、そのリファレンスビューを中心にセットを構築します。