証拠は 2026 年 7 月 25 日 (UTC) に確認されました。 この FLUX 3 完全ガイドでは、Black Forest Labs が実際に発表した内容、現在利用可能なもの、ロードマップに残っているものについて説明します。 FLUX 3 は、画像、ビデオ、オーディオ全体でトレーニングされた統合マルチモーダル基礎モデルであり、関連する動作予測も含まれています。 FLUX 3 Video は限定的な早期アクセスであり、ネイティブ オーディオで最大 20 秒のクリップを生成できます。 FLUX 3 Image のデモは行われていますが、Black Forest Labs によると、早期アクセス段階は数週間以内に開始される予定です。公開価格、安定したモデル ID、一般的な API ドキュメント、およびオープンウェイトはリリースされていません。 Veemo AI は現在、検証済みの FLUX 3 生成ルートを提供していません。
FLUX 3のリリースステータスが一目でわかる
この FLUX 3 完全ガイドで最も重要なのは、モデルファミリーの発表と一般提供製品を区別することです。Black Forest Labs は 2026 年 7 月 23 日に FLUX 3 を発表し、Early Access で提供すると説明しました。公式発表では、機能ごとに展開時期が分けられています。動画は申請制の限定 Early Access、画像の Early Access は今後数週間以内の開始予定です。アクション分野は一部の研究・商用パートナーに限られ、オープンウェイトへのアクセスは将来の提供計画に含まれます。
| 能力 | 現在の公開状況 | 確認されていること | まだ公開されていないもの |
|---|---|---|---|
| FLUX 3 Video | 限定的早期アクセス | テキストからビデオ、画像からビデオ、ビデオからビデオ、ビデオ/オーディオの継続、キーフレーム、ネイティブ オーディオ、および最大 20 秒のクリップ | API の一般的な可用性、公開価格、安定したエンドポイント、スループット、およびサービス制限 |
| FLUX 3 Image | 今後数週間で早期アクセスが発表される | 画像の合成と編集プレビュー、複数のスタイルと解像度、BFL が主張するプロンプトと多言語テキストの処理の改善 | 公開発売日、価格、エンドポイント、出力制限、および一般提供される製品へのアクセス |
| FLUX 3 Action / FLUX-mimic | 選ばれたパートナー | 模倣ロボティクスによる行動予測業務とAudiを伴うテスト・導入業務 | 一般的なクリエイター製品、パブリック アクション API、またはセルフサービス アクセス |
| FLUX 3 Dev | 計画済み | BFLは、オープンウェイトのマルチモーダルバックボーンをリリースするつもりだと述べている | 重み、ライセンス、ハードウェア要件、リリース日、および参照推論コード |
このステータス テーブルにより、3 つの一般的なエラーが防止されます。まず、「早期アクセス」とは、すべてのアカウントがモデルを使用できることを意味するものではありません。プログラム条件では、アクセスは制限付き、取り消し可能、容量管理され、バッチで配信される可能性があると説明されています。第二に、画像サンプルの存在は、FLUX 3 Image がすでにオープンしていることを意味するものではありません。ローンチポストでは、早期アクセスフェーズがその後に続くと明示的に述べています。第三に、計画されたオープンウェイト エディションは、既知のライセンスに基づいてダウンロード可能なウェイトと同じものではありません。 BFL がファイルと条件を公開するまでは、ローカル展開に関する主張は推測にすぎません。
FLUX 3 と FLUX.2 の違いは何ですか?
FLUX.2 は、プロダクション イメージの生成およびイメージ編集ファミリーです。 FLUX 3 は範囲を変更します。Black Forest Labs は、画像、ビデオ、オーディオから共同学習する 1 つの基礎モデルを説明します。同社は、空間的な外観、時間の経過に伴う動き、物理的な出来事によって引き起こされる音は、同じ世界の異なる観察であると主張しています。それらを一緒にトレーニングすることは、各メディアを独立したパイプラインとして扱うのではなく、何かがどのように見え、動き、そして聞こえるかを結び付ける表現を生成することを目的としています。
アーキテクチャの方向性は、バージョン番号の比較よりも重要です。この FLUX 3 完全ガイドでは、このモデルを単に「画質が向上した FLUX.2」とは説明していません。また、現在の証拠は従来の並列スコアカードをサポートしていません。 FLUX.2 には、画像のエンドポイント、メガピクセルベースの価格、モデルのバリエーション、再現性のガイダンスが文書化されています。 FLUX 3 は、予備評価があり、アクセスが制限されている新興マルチモーダル ファミリです。購入者は、生産の準備状況を能力の目標とは別に比較する必要があります。
公式リリースの投稿では、FLUX 3 を Self-Flow にリンクしています。これは、マルチモーダルな生成と理解を 1 つのアーキテクチャ内で効率的に調整することを目的としたアプローチです。 BFL は、画像、ビデオ、オーディオのトレーニングを同時に拡張したと述べています。完全な FLUX 3 技術レポート、パラメータ数、トレーニング コーパス、推論要件、または独立したベンチマーク パッケージはまだ公開されていません。したがって、責任ある FLUX 3 完全ガイドでは、再現可能な技術的証拠が利用可能になるまで、アーキテクチャの説明をベンダーの位置付けとして扱います。
FLUX 3 Video の機能と制限
この FLUX 3 完全ガイドでは、ビデオが発表の中でクリエイター向けの最も具体的な部分です。 BFL によると、最大 20 秒のクリップに対してネイティブ オーディオを含むビデオを生成できるという。文書化された入力およびワークフローのカテゴリには、テキストからビデオへ、開始フレームまたはビジュアル参照を使用した画像からビデオへ、参照クリップからのビデオからビデオへ、ビデオとオーディオからの生成継続、およびキーフレームからビデオへのトランジションが含まれます。ローンチポストでは、多言語ダイアログ、さまざまなスタイルとアスペクト比、アニメーション化されたタイポグラフィー、およびより長いマルチショット シーケンスへのクリップのエージェント チェインについても言及しています。
「ネイティブ オーディオ」とは、ビジュアルのレンダリング後に個別に生成されたサウンドトラックを添付するのではなく、モデルがサウンドとビジュアルを一緒に生成するものとして提示されることを意味します。これにより、対話、インパクト、雰囲気、機械的なイベントの同期作業が軽減される可能性があります。完璧なリップシンク、著作権保護された音楽、きれいな音声、正確な物理学、またはすべてのプロンプトにわたる一貫したサウンドを証明するものではありません。チームは音声と画像を別々に、または一緒に採点する必要があります。
BFL は、いくつかのビデオ モデルに対する予備的な優先結果を報告します。ローンチ記事によると、FLUX 3 は、Grok Imagine Video との比較で最大 69%、Kling v3 Pro との比較で 60%、Happy Horse v1 との比較で 59%、Happy Horse 1.1 との比較で 57%、Seedance 2.0 と Gemini Omni Flash の両方に対して 52%、Runway Gen-4.5 との比較で 77%、そして Runway Gen-4.5 との比較で 93% 優先されたと述べています。 Luma Ray 3.2。これらはベンダーによって報告された初期評価です。公開投稿では、完全な研究を再現するのに十分な情報が提供されていません。プロンプトセット、サンプル数、評価者、信頼区間、モデル設定、失敗処理、および正確な比較プロトコルは完全には開示されていません。これらのパーセンテージを普遍的な品質ランキングに変換しないでください。
早期アクセスの評価では、実際の成果物を表すコンパクトなテスト セットを作成します。ダイアログ、クリアなサウンドによる物理的なインタラクション、リファレンス キャラクター ショット、キーフレーム トランジション、動きのあるタイポグラフィ、従来の映画のような映像の枠を超えたスタイルなどです。要求された継続時間、返された継続時間、解像度、アスペクト比、再試行回数、レンダリング時間、オーディオ アーティファクト、ビジュアル アーティファクト、アイデンティティ ドリフト、および使用可能な出力の決定を記録します。洗練されたショーケース用リールでは、これらの操作上の質問に答えることはできません。
FLUX 3 Image: 発表された内容
この FLUX 3 完全ガイドには、Black Forest Labs がこのモデルはさまざまなスタイル、アスペクト比、解像度にわたって画像を合成および編集できると記載されています。複雑なプロンプトの処理の改善と、複数の言語での正確なテキストが強調表示されます。ただし、同じ公式ページには、これらの画像結果は予備的な中間トレーニング評価から得られたものであり、FLUX 3 Image 早期アクセスは数週間以内に公開されると記載されています。この記事の証拠日の時点では、その文言はオープンなセルフサービス画像アクセスを確立していません。
これにより、FLUX 3 Image が発表されたという理由だけで、コミットされたイメージ作成スケジュールを一時停止しないという実際的な決定ルールが作成されます。 BFL がアクセス、モデル ID、価格、制限、条件、アカウントとリージョンの作業パスを公開するまで、検証済みの利用可能なイメージ ワークフローを使用し続けます。アクセスがオープンしたら、FLUX.2 が自動的に置き換えられると想定するのではなく、新しい候補としてテストします。
将来の有用な画像評価では、複数の言語でのテキストのレンダリング、参照の保存、オブジェクトの詳細な関係、編集の精度、製品の色、障害回復、および受け入れられた出力ごとのコストをカバーする必要があります。例がプレビュー エンドポイント、固定エンドポイント、プレイグラウンド、プライベート ウェイト、または別の環境からのものであるかどうかを明らかにする必要があります。 BFL が詳細を提供したら、記事を更新する必要があります。
Audio、行動予測、FLUX-mimic
この FLUX 3 完全ガイドの音声セクションは、共有トレーニング ストーリーと FLUX 3 Video 出力内にあります。 BFL では、ビデオとオーディオの生成、既存のビデオとオーディオからの継続、物理的イベントに関連するサウンド、および多言語対話について説明します。スタンドアロンの音楽ジェネレーター、スピーチAPI、音声クローン製品、または個別のオーディオモデルの価格は発表されていない。 「音声によるトレーニング」を、会社が文書化していない機能に拡張すべきではありません。
アクション予測は、同じ世界モデルの方向性を別個に適用したものです。 BFL では、ネイティブ アクション予測を FLUX 3 に追加することと、事前トレーニングされたビデオ バックボーンを特殊なアクション モデルの基盤として使用することの 2 つのパスについて説明します。 FLUX-mimic は名前付きのサンプルで、器用な操作と実稼働展開のために模倣ロボット工学を使用して構築されています。 BFL と模倣は、この作品を使用するロボットが Audi でテストおよび展開されたと述べています。これはパートナー ロボット プログラムの証拠であり、一般ユーザーが一般的なロボット制御エンドポイントをプロンプトできるという証拠ではありません。
以下のパートナービデオでは FLUX-mimic を紹介しています。これは、BFL が視聴覚世界のモデリングを物理的なアクションに結び付ける理由を理解するのに役立ちます。これは、FLUX 3 Video の中立的なベンチマークではなく、公開されている API の可用性、クリエイターの価格設定、画質、または Veemo AI の統合を実証するものではありません。
デモを表示するときは、FLUX 3 から派生した表現、特殊な FLUX-mimic モデル、ロボット ハードウェアと制御システム、および操作環境の 4 つのレイヤーを分離します。 1 つのパートナーの導入が成功しても、遅延、安全性、転送可能性、トレーニング データ、または一般的なアクション モデルの信頼性は明らかになりません。ビジネス プランニングの場合、アクション予測は、ビデオ ジェネレーターと同じ購入チェックリストではなく、より長期的な研究トラックに属します。
FLUX 3 価格、API アクセス、およびオープンウェイト
現在の BFL 価格表には FLUX 3 の公開価格はありません。公開価格ページには FLUX.2 製品がリストされていますが、FLUX 3 の発表では、興味のあるチームが早期アクセスをリクエストするよう指示されています。早期アクセス条件では、該当する NDA に基づいて、モデルの機能、API 仕様、価格、および出力が機密になる可能性があると規定されています。したがって、この FLUX 3 完全ガイドでは、1 秒あたり、ビデオごと、画像ごと、クレジット、またはサブスクリプションのコストを見積もることはありません。
この FLUX 3 完全ガイドでは、一般的なイメージの API ドキュメントに公開された安定した FLUX 3 API エンドポイントも見つかりませんでした。次のようなエンドポイント名を推測しないでください。 /flux-3, /flux-3-video、 または /flux-3-pro。承認された早期アクセス参加者が資格情報または仕様を受け取った場合、それらの詳細はプログラム規約に従って処理する必要があり、自動的に公開することはできません。
BFL の立ち上げ計画には、API とプライベート ウェイト アクセスを通じたビデオとオーディオの生成と編集、API とプライベート ウェイト アクセスを通じた画像の合成と編集、そして最終的には FLUX 3 Dev と呼ばれるマルチモーダル バックボーンへのオープンウェイト アクセスが含まれます。 「オープンウェイト アクセス」はオープンソース ライセンスを確立するものではありません。ローカル展開の推奨を行う前に、実際のモデル ファイル、ライセンス テキスト、推論コード、ハードウェア ガイダンス、安全性文書、商用利用の境界を待ってください。
早期アクセスを評価するチームは、見積価格が機密である場合でも、総コストのワークシートを作成する必要があります。成功および失敗したリクエスト、再試行、出力期間、ストレージ、レビュー時間、ポストプロダクション、オーディオクリーンアップ、アップスケーリング、モデレーション、配信が承認された出力の割合を追跡します。請求書の価格は、使用可能出力コストの 1 つの構成要素にすぎません。
商用利用、プライバシー、早期アクセス条件
この FLUX 3 完全ガイドの契約レビューには、成熟した公共サービスよりも注意が必要です。 BFL の現在のプログラム規約では、アクセスは制限付き、取り消し可能、非独占的、容量管理型として説明されています。また、非公開モデルの機能、ロードマップ情報、API 仕様、パフォーマンス ベンチマーク、価格設定、フィードバック、およびプログラム出力は、NDA に基づいて機密となる可能性があるとも述べています。参加者は、クライアントの資料をアップロードしたり、結果を公開したりする前に、社内の法的およびセキュリティに関するレビューを受ける必要があります。
この規約では、BFL とそのサービス プロバイダーは、プログラムの操作、ポリシーの適用、問題の診断、モデルの改善またはトレーニングを行うために、プログラムの入力と出力にアクセス、保存、処理、および使用することができると規定されています。チームが規定の規定に基づいてトレーニングに特定の入力を使用することを望まない場合、規約により、それらの入力を送信しないように指示されます。そのため、別の書面による条件で問題が解決されない限り、一部の機密資料、禁輸品、生体認証資料、規制対象資料、またはクライアント所有の資料には早期アクセスが適していません。
FLUX.2 や将来のオープンウェイト プランから商用利用の許可を一般化することはできません。制御契約は、早期アクセス、ホスト型 API、プライベート ウェイト、および最終的な FLUX 3 Dev リリースの間で異なる場合があります。正確なサービス、アカウント契約、モデル識別子、日付、すべての入力に対する権利、同意の証拠、出力に適用されたレビューを記録します。これは一般的な運用情報であり、法的アドバイスではありません。
証拠を誇張せずにFLUX 3を評価する方法
書面による請求マトリックスから始めます。すべての記述について、「公式に発表された」、「当社の管理されたアクセスで観察された」、「独立して複製された」、または「製造が検証された」というラベルを付けます。 FLUX 3 完全ガイドでは、ベンダーのサンプルを独立したテストであるかのように使用してはなりません。早期アクセスがない場合は、製品の適合性と契約の準備状況を評価できますが、世代の品質は評価できません。
- アクセス範囲を確認します。 招待状があるかどうか、どの機能が有効になっているか、どの地域と環境が適用されるか、何が開示される可能性があるかを確認します。
- テスト概要を凍結します。 出力を確認する前に、実際の成果物のカテゴリと客観的な受け入れ基準を使用してください。
- 正確な状態を記録します。 プロンプト、参照、期間、アスペクト比、解像度、シードまたはコントロール (利用可能な場合)、タイムスタンプ、再試行、および返されたモデル ID を保持します。
- オーディオとビデオを別々にスコアリングします。 音声、雰囲気、衝撃、連続性、時間的アーチファクト、同一性、即時遵守、および同期をチェックします。
- 失敗も含めて。 最良のサンプルのみを選択するのではなく、拒否された世代、安全性の拒否、タイムアウト、使用できないオーディオ、および修復作業を報告します。
- 使用可能な出力コストを計算します。 プロバイダー料金と再試行、人によるレビュー、編集、保管、配信作業を組み合わせます。
- 購入前に再確認してください。 早期アクセスの動作、期間、エンドポイント、可用性、および価格はすぐに変更される可能性があります。
FLUX 3 は Veemo AI で利用できますか?
いいえ。この FLUX 3 完全ガイドの Veemo 可用性チェックでは、2026 年 7 月 25 日時点で、Veemo AI に FLUX 3 カタログ エントリ、登録された生成フォーム、プロバイダー ルート、価格設定ルール、または検証済みのエンドツーエンド生成パスがないことが判明しました。したがって、Veemo AI は「FLUX 3 を試す」ボタンを表示したり、Veemo の価格を提示したり、ユーザーが早期アクセス モデルにアクセスできると主張したりすることはありません。
今すぐビデオを制作する必要がある場合は、Veemo AI 生成フォームで利用可能なモデルを使用し、有料プロジェクトの前に現在の設定を確認してください。の Veemo AI テキストからビデオへのワークフロー 独立したマルチモデル製品ルートです。ここにリンクしても、FLUX 3 のサポートを意味するものではありません。この記事のアクセス ステートメントは、実際のカタログ エントリ、プロバイダーの統合、クレジット ルール、フォーム、およびプロダクション生成がすべて検証された後にのみ更新する必要があります。
最終的な推奨事項
この FLUX 3 完全ガイドの実際的な判断は、FLUX 3 を、一般に入手可能なすべての画像またはビデオ モデルの代替としてではなく、本格的だが初期のマルチモーダル プラットフォームとして扱うことです。 FLUX 3 Video は、限定されたプログラムを介した最も明確なアクセス パスと、公開されている最も強力な機能の詳細を備えています。 FLUX 3 Image、FLUX 3 Action、および FLUX 3 Dev は、依然として異なる発表段階またはパートナー段階にあります。価格と安定した公開 API 仕様はまだ入手できません。
ネイティブのオーディオビジュアル生成、リファレンス主導のビデオ、多言語対話、またはマルチモーダル研究がロードマップに実質的に適合し、チームが機密保持と仕様の変更を受け入れることができる場合は、早期アクセスを申請してください。コミットされた運用作業の場合は、自分のアカウント、条件、テスト セット、予算が準備が整っていることが示されるまで、利用可能なフォールバックを維持してください。 BFL がイメージ アクセス、公開価格、API ドキュメント、モデル ID、重量、またはライセンスを公開する場合は、このガイドを再参照してください。
よくある質問
FLUX 3 は一般公開されていますか?
この FLUX 3 完全ガイドで説明されているように、FLUX 3 Video は無制限の一般提供ではなく、限定的な早期アクセスを通じて提供されます。 BFL によると、FLUX 3 Image 早期アクセスは数週間以内に開始される予定です。アクションアクセスはパートナー重視であり、FLUX 3 Dev オープンウェイトは後で計画されています。
FLUX 3 は音声付きのビデオを生成できますか?
BFL によると、FLUX 3 はネイティブ オーディオを含むビデオを生成し、最大 20 秒のクリップをサポートします。テキスト、画像、ビデオ、オーディオ継続、およびキーフレーム入力またはワークフローがリストされます。公開されている生産制限と価格はまだ文書化されていません。
FLUX 3 は画像ジェネレーターですか?
BFL は画像の合成と編集を示しており、FLUX 3 Image アクセスが続くと述べています。証拠の時点では、同社自身の文言は、オープンで一般に入手可能な画像製品を確立していません。
FLUX 3の価格はいくらですか?
現在の BFL 価格ドキュメントには、FLUX 3 の公開価格は記載されていません。早期アクセスの価格と仕様は機密である場合があります。 BFL が価格を公開するか、アカウントの条件を提示するまでは見積もりを避けてください。
FLUX 3 の重量は利用可能ですか?
公開されている FLUX 3 の重み、ライセンス、推論要件、リリース日は検証されていません。 BFL は、FLUX 3 Dev と呼ばれるオープンウェイト マルチモーダル バックボーンを計画していますが、計画されたアクセスは現在利用可能ではありません。
FLUX 3出力は商用利用できますか?
商業権は、正確な早期アクセス契約または将来のサービス契約によって決まります。 FLUX.2 の条件を FLUX 3 に適用しないでください。資格のある弁護士とともに、管理契約、入力の権利、機密保持、使用ポリシー、および出力の義務を確認します。
FLUX 3 を Veemo AI で使用できますか?
現在、Veemo AI で利用できる検証済みの FLUX 3 ルートはありません。 Veemo の既存のビデオ ツールは、他の登録済みモデルを使用しています。直接の FLUX 3 CTA は、実際の統合が運用テストされた後にのみ表示されます。
