Skip to content
ai news

AI映画が劇場公開へ、Flux 3が登場

プロのワークフローを強化することを目的とした、新しい20秒間のAI動画モデルが発表されました。一方、AI生成映画が本格的な劇場公開を迎え、クリエイターにとっての新たな時代の幕開けとなります。

Jonah Park
AI映画が劇場公開へ、Flux 3が登場

Black Forest LabsがFlux 3をリリース

Black Forest Labsは、2024年8月のFlux 1発表時に予告されていた待望の動画生成モデル「Flux 3」をリリースしました。この新しいイテレーションは、動画生成の一般的な制限を20秒に倍増させ、創作の可能性を大幅に広げます。この延長された時間は、多くの初期のAI動画ツールで一般的だった10秒という制限を超え、ユーザーの主要な要望に直接応えるものです。

Flux 3は、多様な入力を受け入れて複雑なクリエイティブワークフローを推進する、堅牢なマルチモーダルモデルとして機能します。ユーザーは最大10個のリファレンスを統合でき、静止画、オーディオトラック、既存の動画セグメントを組み合わせることが可能です。この強力な機能により、複雑な編集、高度なリミックス、生成コンテンツの精密な制御が可能になり、高度な制作タスクを効率化します。

現在、Flux 3は720pの解像度で動画を生成しますが、Black Forest Labsは近い将来に1080pの展開を予定しています。このモデルは、縦型の9:16から映画のような21:9まで、すべての標準的なアスペクト比を包括的にサポートしており、プラットフォーム間での適応性を確保しています。重要な点として、Flux 3には統合されたオーディオ生成機能が含まれており、視覚出力と同期したサウンドスケープを生成します。

パフォーマンス:動きよりも一貫性を重視

Flux 3は推論型動画モデルとして動作し、高度なプロンプトの一貫性を実証しています。このモデルは複雑な物語の要求を正常に実行し、20秒の生成制限の中で一貫したプロット要素とキャラクターの行動を維持する出力を生成します。この機能により、テキストプロンプトから直接、より複雑なストーリーテリングが可能になります。

そのパフォーマンスは、急速な視覚的ダイナミズムに最適化されたモデルとは対照的です。Flux 3は、一部の競合他社の出力に見られるような、素早いカメラワークやトリックショットを特徴とする「ハイパーポップな運動エネルギー」や高速アクションシーケンスを優先しません。その代わり、ドラマチックなシーンの生成に優れており、特に「ギルモア・ガールズ」のペースを上回ると評される、広範囲で矢継ぎ早の対話を特徴とするシーンでその真価を発揮します。

Black Forest Labsは、Flux 3をC-danceのような確立されたソリューションを完全に置き換えるものではなく、プロのワークフローを強化するためのツールとして位置づけています。同社は、より広範な統合とカスタマイズを促進するため、将来的にモデルのオープンウェイトをリリースする計画を確認しています。生成コストは現在の市場の代替手段よりも低くなると予測されており、クリエイターのアクセシビリティが向上します。

AI映画が銀幕で迎える画期的な瞬間

Gossip Goblinとして知られるZach Londonは、自身のAI生成長編映画の劇場公開により、業界の重要なマイルストーンを打ち立てました。このイベントは、AI主導の映画制作にとって現在までで最も重要な配給の成果であり、実験的なオンライン公開から主流の興行へとテクノロジーを移行させるものです。これにより、Londonは進化するデジタル映画制作の風景において重要な存在として確立されました。

Londonの成功は、クリエイター主導のイニシアチブが長編物語制作のために生成AIツールを活用するという高まりつつあるトレンドを強調しています。この発展は、独立系映画製作者が従来の配給を実現するための実行可能な道筋を確立し、AI生成コンテンツが商業映画業界の品質とストーリーテリングの要求を満たせることを証明しています。これは、機械生成アートの限界に関する長年の思い込みに挑戦するものです。

AI生成映画の劇場公開は、複雑な物語構築におけるテクノロジーの能力を証明するものです。達成可能な物語の質についての洞察として、Londonによる30分の短編映画「Pomegranate」が説得力のある例となります。この短編は洗練されたストーリーテリングとキャラクター開発を示しており、現在のAIモデルを使用して堅牢な映画体験を生み出す可能性を示唆しています。Flux 3などの高度な動画生成モデルに関する詳細な技術仕様は、FLUX 3 - Real World Models: Towards Multimodal Flow Models as the Backbone of Visual Intelligence. | Black Forest Labsで確認できます。

この記事が気に入ったら、毎朝同じようなものをメールで受け取れます。

1日1通 · 2クリックで解除 · サードパーティのトラッキングなし

Gossip Goblinのワークフローの舞台裏

Gossip Goblinとして知られるZach Londonは、最近劇場公開された自身のAI生成長編映画において、高度に制御された2段階のプロセスを導入しました。基礎段階では、Midjourney内で細心の注意を払って初期画像の生成が行われました。この重要な第一歩では、特定のパーソナライゼーションとS-refコードを活用し、各シーンの正確な視覚的基盤を確立しました。

画像作成後、Londonはワークフローにおいて重要な決断を下しました。それは、ファーストフレーム・イメージ・トゥ・ビデオ(first-frame image-to-video)変換のみを適用することです。この戦略では、各シーケンスに対して事前に設計された単一の画像のみを動画生成モデルに入力します。特筆すべきは、このアプローチが、複数の画像や動画クリップを使用してAIの出力をガイドする一般的な手法であるマルチリファレンスを意図的に完全に回避している点です。

この厳格な手法を採用したLondonの論理的根拠は、絶対的な創造的コントロールを維持することにあります。AIの参照を最初の静止画のみに限定することで、その後のアニメーションシーケンスに対して正確な指揮を執ることができました。これにより、カメラの動き、フレーミング、ショット構成を極めて具体的に指示することが可能となり、最終的な視覚的物語が自身の芸術的ビジョンに厳密に従うことを保証しました。より自動化されたマルチリファレンス技術からのこの逸脱は、AI映画制作における監督の監視に対するこだわりを強調するものです。

よくある質問

Black Forest LabsのFlux 3とは何ですか?

Flux 3は、最大20秒のクリップを作成できる新しいマルチモーダルAI動画生成モデルです。画像、音声、または動画の参照を受け入れ、独自の音声を生成します。

Gossip Goblinの映画が重要な理由は何ですか?

Zach London(Gossip Goblin)によるこの映画は、AI生成の長編映画として劇場公開されたという点で重要であり、AI映画制作における大きなマイルストーンを刻みました。

Gossip GoblinのAI映画ワークフローのユニークな点は何ですか?

彼のワークフローはMidjourneyでの画像生成から始まり、次にファーストフレーム・イメージ・トゥ・ビデオ生成を使用します。これにより、マルチリファレンスを回避し、正確なカメラ制御を維持しています。

Flux 3はC-danceのようなモデルを置き換えることが期待されていますか?

当初、Flux 3は既存のワークフローを置き換えるのではなく、補完するツールとして位置付けられています。ドラマチックなシーンにおけるプロンプトの一貫性には優れていますが、非常に激しいアクションにはあまり適していない可能性があります。

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only