
読みやすいテキストを含む画像
ポスター、商品写真、ソーシャルグラフィックを、多様なスタイルとアスペクト比で、画像内に直接配置されたクリーンで読みやすいテキストで作成します。
画像と動画のための単一モデルで、動画内に直接サウンドを生成。テキストから画像、画像から動画、ネイティブオーディオまで、すべてを1箇所で実現します。
創作を始めようFlux 3 をこのサイトに導入中です。今すぐ作成するには、以下のライブモデルをご利用ください。
画像、動画、オーディオを横断する単一モデルで、真のクリエイティブワークのために構築されています。
多様なスタイル、アスペクト比、解像度で画像を生成・編集し、複数の言語で正確なテキストを画像内にレンダリングできます。
ダイアログ、効果音、環境音付きで最大20秒の動画を生成。同一プロセスで作成され、アクションにマッチします。
テキストから動画へ、静止画のアニメーション化、クリップの継続、またはキーフレームを設定して最初から最後まで動きを制御できます。
画像、動画、オーディオは単一モデルから生成されるため、それらを横断してもスタイルやキャラクターの一貫性が保たれます。
Flux 3は、人間の表情、画面上の出来事と音のマッチング、そして多言語での対話に優れています。
複数のショットを繋ぎ合わせて、単一のクリップをはるかに超えるシーンを構築します。
画像生成、サウンド付き動画、そしてショット間で一貫したキャラクター。

ポスター、商品写真、ソーシャルグラフィックを、多様なスタイルとアスペクト比で、画像内に直接配置されたクリーンで読みやすいテキストで作成します。

プロンプトや静止画を、セリフ、効果音、環境音がすでに配置され、アクションと同期した短いビデオに変換します。

あるショットから次のショットまで、同じキャラクター、ライティング、スタイルを維持したり、複数のショットを繋ぎ合わせてより長いシーンを作成したりできます。
サウンド付きの画像と動画を3つのステップで作成。
作成したいものを選び、シーン、スタイル、ムードを簡単な言葉で記述します。
アスペクト比を選択し、ビデオの場合は長さと音声を含めるかどうかを選択します。
ブラウザで生成し、結果をプレビューし、音声が組み込まれた画像またはビデオをダウンロードします。
Flux 3の機能、ビデオ、オーディオ、およびその使用方法に関する一般的な質問。
Flux 3は、単一のアーキテクチャ内で画像、ビデオ、オーディオを生成するマルチモーダルAIモデルです。AI画像およびビデオジェネレーターとして、静止画を超えて音声付きの完全なシーンを生成し、単一のプロンプトから画像や、音声と同期した短いクリップを作成できます。以前のFlux画像モデルを基盤とし、ビデオとネイティブサウンドを追加しています。
はい。Flux 3は、同じパスで生成されたネイティブオーディオを含む最大20秒のビデオを作成します。これにより、セリフ、効果音、環境音が画面上の出来事と同期します。オーディオとビデオが一緒に作成されるため、衝撃音は適切なフレームに着地し、音声は唇の動きに追従するため、別途オーディオ編集は不要です。
Flux 3は、テキストからビデオ、画像からビデオ、要素の一貫性を保ったビデオからビデオ、およびガイド付きトランジションのためのキーフレーム制御をサポートしています。テキストからビデオはプロンプトのみから機能し、画像からビデオは静止画をアニメーション化し、キーフレームを使用するとショットの開始と終了を設定できます。ショットは、より長いマルチショットシーケンスに連結することもできます。
Flux 3はまだこのサイトでは利用できません。現在早期アクセスで展開されており、サポートされる統合が準備でき次第、こちらで生成を有効にします。それまでは、当社のライブAI画像およびビデオジェネレーターで作成できます。
その主な利点は、ビデオとは別のステップで追加されるのではなく、ビデオと一緒に作成されるネイティブオーディオです。1つのモデルが画像、ビデオ、オーディオにまたがるため、サウンド、スタイル、キャラクターがシーン全体で一貫性を保ちます。他の多くのツールはまず無音のクリップを生成し、後でオーディオを追加または同期させる必要があります。
早期評価では音声付きの10秒720pクリップが使用されましたが、Flux 3は最大20秒のクリップを生成でき、幅広いアスペクト比をサポートしています。ここでの最終的な解像度と長さのオプションは、展開の進行に伴い変更される可能性があります。