画像生成が「お願い」から「配置設計」へ――FLUX 3 Imageは箱で構図を固定して直せる

画像生成が「お願い」から「配置設計」へ――FLUX 3 Imageは箱で構図を固定して直せる

シン@AI統制&マルチエージェント

シン@AI統制&マルチエージェント

画像生成で、かなり厄介なのが「絵は良いのに、見出しを置く場所がない」「人物を少し右へ動かしたいだけなのに、全体が別物になる」という問題です。

Black Forest Labs(BFL)の FLUX 3 Image は、ここに「バウンディングボックス」という設計図を持ち込みました。人物や商品、文字を置く余白などを箱で指定し、箱ごとに内容を説明します。生成後も、選んだ箱だけを説明し直したり移動したりできます。

これは単なる画質競争より、制作のやり直しを減らす方向の進化です。

何が変わったのか

BFLの公式ページによると、FLUX 3 Imageは画像の生成と編集を担うモデルです。通常の文章プロンプトだけでも使えますが、特徴は構図を次の2層で渡せることです。

1. 画像全体を説明するキャプション

2. 各要素のID・座標・説明を並べたJSON形式の要素表

キャンバスは縦横とも 0〜1000 の座標系で、箱は [y_min, x_min, y_max, x_max] の順に記述します。アスペクト比が変わっても同じ座標系を使えるため、レイアウトを機械的に扱いやすい設計です。

自分で箱を描かなくても、1行の依頼とアスペクト比からLLMにレイアウト案を作らせ、あとで箱を動かすこともできます。つまり、AIが構図を提案し、人が位置関係だけを直してから生成へ渡す流れです。

「全部やり直し」ではなく「ここだけ直す」

公式ページでは、複数の箱を同時に再説明・置換・移動でき、触らなかった領域はその位置を保つと説明されています。また、ユーザーが描いた箱はプロンプト拡張処理を通っても、同じID・同じ座標のままモデルへ渡るとしています。

この設計が効きそうなのは、記事のサムネイル、雑誌風レイアウト、コラージュ、パネル分割、商品と人物を厳密に配置した広告などです。BFLは最大10枚の参照画像を組み合わせられ、2K・4Kのネイティブ生成にも対応すると案内しています。

ただし、「触っていない場所がどの程度そのまま残るか」「日本語の文字をどれだけ正確に出せるか」は、公式の性能主張です。この記事では実機検証や独立ベンチマークを行っていません。

MORIの制作とどうつながるか

MORIのニュース制作では、1つのテーマからサムネイルと本文図解を作り、複数媒体へ展開します。ここで重要なのは、一枚の美しさだけではなく、見出し余白・主役の位置・図版の比率を崩さずに直せることです。

FLUX 3 Imageの仕組みなら、たとえば次のような工程が考えられます。

・左側を見出し余白として固定する

・右側の商品や人物だけを差し替える

・媒体ごとに箱を動かして縦長・横長へ再配置する

・人が構図を承認し、AIに局所修正だけを任せる

これは記事制作だけでなく、商品画像、サービス紹介、SNS告知の再利用にも向きます。とくに、AIエージェントが最初のレイアウト案を作り、人が箱を確認してから生成させる形は、「丸投げ」ではなく検証可能な制作フローに近づきます。

どこまで今すぐ使えるのか

2026年10月2日時点で、公式ページからPlaygroundとBFL APIへの導線を確認できました。APIは従量課金で、サブスクリプションや席単位料金はないと案内されています。ただし公式料金計算機はモデル選択が動的で、取得できた表示だけではFLUX 3 Imageの解像度別単価を安全に特定できなかったため、ここでは具体額を記載しません。

また、FLUX 3 Image自体は企業向けの商用ウェイト提供があります。一方、一般向けのオープンウェイトとして予告されているのは別枠の FLUX 3 Dev で、現時点では「coming soon」です。「FLUX 3 Imageがすでにオープンウェイト化された」とは言えません。

まとめ

FLUX 3 Imageの面白さは、画像生成を「うまくお願いする作業」から「要素を置き、選んで直す作業」へ近づけた点にあります。

構図を座標で固定でき、局所編集を反復できるなら、AIは一発勝負の画像メーカーではなく、記事や商品の制作工程に組み込みやすい道具になります。実際の保持精度や日本語文字品質はまだ検証が必要ですが、MORIのように一つの内容を複数媒体へ展開する制作では、かなり相性の良い方向です。

出典

・Black Forest Labs「FLUX 3 Image: Maximum control over every pixel」

https://bfl.ai/models/flux-3-image

・Black Forest Labs「Pricing」

https://bfl.ai/pricing

・Black Forest Labs「FLUX 3 - Real World Models: Towards Multimodal Flow Models as the Backbone of Visual Intelligence」(2026年7月23日)

https://bfl.ai/blog/flux-3


あなたも記事の投稿・販売を
始めてみませんか?

Tipsなら簡単に記事を販売できます!
登録無料で始められます!

Tipsなら、無料ですぐに記事の販売をはじめることができます Tipsの詳細はこちら
 

この記事の販売者

シン@AI統制&マルチエージェント

人とAIの役割を組み立て、構想を使える成果物へ。教育・営業・接客・介護・事務の経験を背景に、個人プロジェクト「Human OS」で複数AIとの協働を設計・実践しています。教材・記事制作では企画、役割分担、品質の確認、改善を担当。課題を整理し、進め方を見直しながら形にする力を、業務改善・AI活用・プロジェクト推進へ広げていきます。

この販売者が書いた他の記事

  • xAI、新モデル「Grok 4.7」を発表 長時間タスク向けの強化学習や自己点検機能を強化

  • GLM-5.3は「攻撃を組み立てるAI」の敷居を下げたのか――AnthropicとNISTの検証を読む

  • ロボットは仕事の34%を「できる」――でも人間より安いのは0.3%

関連のおすすめ記事

  • ゼロから3日で始動|AIコンサル大全

    ¥124,800
    1 %獲得
    (1,248 円相当)
    水口一星

    水口一星

  • 【AI自動化・マネタイズ実例書】たった2週間〜機械オンチなママでもできた全作業過程

    ¥37,800
    1 %獲得
    (378 円相当)
    みお

    みお

  • 【5年更新型コンテンツ】AIを最大活用するためのリテラシー強化バイブル

    ¥59,800
    1 %獲得
    (598 円相当)
    こはく

    こはく