FLUXとはどんなAI?開発したBlack Forest Labsは何者か
FLUXは何ができる画像生成AIなのか
室谷代表取締役FLUXは、ドイツのBlack Forest Labsが開発している画像と動画の生成AIモデル群なんですよね。本社はフライブルクで、サンフランシスコにも拠点を置いています。
テキトー教師DotAI 認定講師名前だけ先に聞く人、けっこう多いんですよ。「Midjourneyと何が違うんですか」って最初に戸惑うのがまさにそこなんです。
画像を作るだけでなく、同じ会社のモデルで動画まで扱う流れになっているのが特徴ですね。
画像を作るだけでなく、同じ会社のモデルで動画まで扱う流れになっているのが特徴ですね。
室谷代表取締役業界構造で見ると、画像生成のモデルを持っている側が、そのまま動画や別の領域に広がっていく流れの代表例なんですよ。モデルを自前で持つ会社と、それを使ってサービスを作る会社が分かれ始めている。
テキトー教師DotAI 認定講師たしかに。ツールを1個覚えるというより、この会社のモデルがどこに組み込まれているかを見たほうが、後々ラクなんですよね。
開発元Black Forest Labsはどんな会社か
室谷代表取締役で、そのBlack Forest Labsなんですけど、設立を発表したのが2024年8月1日。画像生成の基盤モデルを専門に作る会社としてスタートしています。
テキトー教師DotAI 認定講師会社名だけ聞くと「聞いたことない」となるんですけど、出しているものはもうかなり広い場所で使われているんですよ。名前と製品が頭の中で一致していない、というのが最初のつまずきなんです。
室谷代表取締役ここは経営目線でもおもしろくて、モデルそのものを提供する会社と、その上に体験を作る会社が分業していく形なんですよね。日本の制作現場だと、後者だけが見えていることが多いんですよ。
テキトー教師DotAI 認定講師なるほど。発注する側も、裏でどのモデルが動いているかを気にし始めてますね。
Stable Diffusionの開発チームが創業した経緯と資金調達
室谷代表取締役創業チームが、Stable DiffusionやStable Diffusion XL、Stable Video Diffusion、VQGAN、Latent Diffusionといった研究を手がけてきた人たちなんですよ。つまり突然出てきた会社ではないんですよね。
テキトー教師DotAI 認定講師これ、知ると見え方が変わるんですよね。最初は「後発の一ツール」に見えるのに、中身は画像生成AI研究の本流から来ている。
出自を知らないと、同じモデルでも評価がずれてしまうんです。
出自を知らないと、同じモデルでも評価がずれてしまうんです。
室谷代表取締役設立時にAndreessen Horowitzが主導するシリーズシードで3,100万ドルを調達していて、General CatalystやMätchVCも追加で出資しています。この段階でこの規模が付くのは、技術の出自と人材がそのまま評価されている証拠なんですよ。
テキトー教師DotAI 認定講師資金の話まで押さえると、その後のモデルの広がりも「なるほど」とつながりますね。
FLUXの種類と進化:FLUX.1からFLUX.2まで何が違う?
FLUX.1のpro・dev・schnellはそれぞれ何に向くのか
室谷代表取締役FLUX.1が発表されたのは2024年8月1日で、最初からpro・dev・schnellの3グレードに分かれてたんですよね。この時点で「クラウドで最高品質を出す」と「手元で動かす」を最初から線引きしているのが、その後の展開を考えると上手いなと。
テキトー教師DotAI 認定講師初めて触る人が一番迷うのがそこなんですよ。名前だけ見てもどれが上なのか分からない。
実際は性能の上下というより、置き場所が違うイメージなんです。
実際は性能の上下というより、置き場所が違うイメージなんです。
室谷代表取締役そう、proはAPI経由で最高品質・最速、devはHuggingFaceで重みが配布されるオープンウェイト、schnellはローカルや個人利用向けの最速モデル。schnellはApache 2.0なので、その範囲なら商用もいける。
devは非商用がデフォルトで、商用には別途ライセンスが要る。この構造がそのままコスト設計を左右するんですよね。
devは非商用がデフォルトで、商用には別途ライセンスが要る。この構造がそのままコスト設計を左右するんですよね。
テキトー教師DotAI 認定講師現場でよく聞くのは「devの重みをそのまま事業に使っていいのか」という不安です。ここを最初に押さえておかないと、後から話がややこしくなりますから。
FLUX1.1[pro]と画像編集のFLUX.1 Kontextの位置づけ
室谷代表取締役そのあとにFLUX1.1[pro]という高速版が出て、さらにFLUX.1 Kontextという画像編集のモデルが来るんですよね。KontextはAdobe Photoshopに組み込まれていて、AdobeやMetaといった企業が使っている。
生成単体で勝負するんじゃなく、既存の編集ワークフローの中に入り込んだのが大きいわけです。
生成単体で勝負するんじゃなく、既存の編集ワークフローの中に入り込んだのが大きいわけです。
テキトー教師DotAI 認定講師これ、現場感覚だと「生成」と「編集」って別の作業なんですよ。写真を1枚直すのに生成AIを開き直すより、いつもの編集ソフトの中で完結する方が圧倒的に早い。
室谷代表取締役業界構造で見ても、モデルの性能競争というより「どの作業画面に座るか」の争いになってきてる。ユーザーの動線を取った方が強いんですよ。
テキトー教師DotAI 認定講師たしかに。ただ、Photoshop経由で呼ぶのかAPIから直に叩くのかで課金の考え方も変わりますから、そこは自分の使い方に合わせて確認した方がいいですね。
FLUX.2の4モデル(pro・flex・dev・klein)の役割分担
室谷代表取締役で、2025年11月25日にFLUX.2が発表されて、ここで一気に整理された感じなんですよ。Mistral-3 24BのVLMとrectified flow transformerを組み合わせた構成で、最大10枚の参照画像を同時に指定できる。
最大4MPでの高解像度編集もできる。
最大4MPでの高解像度編集もできる。
テキトー教師DotAI 認定講師参照画像を複数入れられるの、地味に大きいんですよ。現場だと「この商品をこの構図で」みたいな指定が増えるので、1枚しか渡せないと毎回プロンプトで説明する羽目になる。
室谷代表取締役ラインアップはpro、flex、dev、kleinの4つ。proは最高品質で速度とコストのバランスも取れている、flexはステップ数やguidance scaleを細かく制御したい開発者向け、devは320億パラメータのオープンウェイトで商用は別ライセンス、kleinはApache 2.0の軽量版。
ここまで来ると、選ぶ基準は品質じゃなくて「自社環境に置くか、APIで借りるか」なんですよね。
ここまで来ると、選ぶ基準は品質じゃなくて「自社環境に置くか、APIで借りるか」なんですよね。
テキトー教師DotAI 認定講師まさに。最初に戸惑うのがdevとkleinの違いです。
「軽い方でいい」で選ぶと、商用の条件が違って後から困る。品質重視ならpro系、自社で抱えるならdev・klein系、という軸で見るといいと思います。
「軽い方でいい」で選ぶと、商用の条件が違って後から困る。品質重視ならpro系、自社で抱えるならdev・klein系、という軸で見るといいと思います。
進化の流れを一本にすると、今どれを選ぶのか
FLUXの進化:FLUX.1からFLUX.2、そしてFLUX 3へ
- 2024年8月1日FLUX.1発表pro・dev・schnellの3グレード。proはAPI経由で最高品質・最速、devはオープンウェイト(非商用がデフォルト、商用は別ライセンス)、schnellはApache 2.0のローカル・個人向け最速モデル
- (FLUX.1の後)FLUX1.1[pro]高速版として登場
- (FLUX1.1[pro]の後)FLUX.1 Kontext画像編集モデル。Adobe Photoshopに組み込まれ、AdobeやMetaなどが使用
- 2025年11月25日FLUX.2発表Mistral-3 24BのVLMとrectified flow transformerを組み合わせ。最大10枚の参照画像を同時指定、最大4MPの高解像度編集。pro・flex・dev・kleinの4モデルに整理
- 2026年7月23日FLUX 3発表画像・動画・音声・ロボットの行動予測まで1つの基盤で扱う。段階的に提供中
室谷代表取締役流れを一本にすると、FLUX.1で3グレードに分かれ、FLUX1.1[pro]で速度が上がり、Kontextで編集に入り、FLUX.2で4モデルに整理された、という順番なんですよ。で、2026年7月23日には画像・動画・音声・ロボットの行動予測まで1つの基盤で扱うFLUX 3が発表されて、今も段階的に出てきている最中なんですよね。
テキトー教師DotAI 認定講師そうなると「常に最新を追えばいい」とはならないのが現場の悩みです。使いたい機能がまだ提供されていないこともあるので、まず自分の用途が画像1枚なのか、動画まで含むのかで選ぶ。
提供状況や単価は公式で確認するのが確実です。
提供状況や単価は公式で確認するのが確実です。
室谷代表取締役経営目線で言うと、モデル選びは「一番すごいもの」を選ぶ話じゃなくて、どの工程をどれに任せるかという配置の話なんですよ。そこを間違えると、性能は高いのにコストだけ膨らむ。
最新のFLUX3とは?画像・動画・音声・ロボットを1つで扱う新基盤
何を1つのアーキテクチャにまとめたのか
室谷代表取締役FLUX 3、これまでの画像モデルの延長線上じゃないんですよね。画像・動画・音声、それにロボットの行動予測まで、単一のアーキテクチャで学習させる基盤モデルとして2026年7月に発表されていて。
テキトー教師DotAI 認定講師初めて触る人がまず戸惑うのがそこです。「画像生成AIの新バージョンでしょ」と思って入ると、話がまったく別の方向に飛んでいくので。
室谷代表取締役構造で見ると、画像モデル各社が動画に広げてる流れの、もう一段先なんですよ。1つの基盤で複数のモダリティを扱えると、事業側からするとモデルごとに開発リソースを割かなくて済むし、学習データの使い回しも効いてくる。
技術の話というより、開発体制の話なんですよね。
技術の話というより、開発体制の話なんですよね。
テキトー教師DotAI 認定講師現場感覚で言うと、「別々のツールを繋ぐ手間が消えるかもしれない」という期待のされ方をされてますね。ただ、今すぐ全部が同じように使えるわけではないので、そこは分けて考える必要があります。
動画の生成時間・解像度と、導入しているサービス
室谷代表取締役FLUX 3 Videoは最長20秒、最大4K、しかも音声も同時に生成される。この「音声込み」が実務だと効くんですよね。
映像と音を別々に作って後から合わせる工程、地味にコストがかかるので。
映像と音を別々に作って後から合わせる工程、地味にコストがかかるので。
テキトー教師DotAI 認定講師これまで動画生成って映像だけ出して、音は後から載せるのが普通でしたから、そこが一段変わるという話なんですね。
室谷代表取締役導入事例としてPicsart、Magnific、Envato、Burda Mediaの名前が挙がっていて、制作系のサービスが自分の機能として組み込み始めてる。単体ツールとして売るんじゃなく、既存プロダクトの中に入っていく形なんですよ。
この入り方は、画像生成のときのKontextがPhotoshopに入った流れと同じで。
この入り方は、画像生成のときのKontextがPhotoshopに入った流れと同じで。
テキトー教師DotAI 認定講師利用者の側からすると「知らないうちに使ってた」が起きやすいパターンですね。
今すぐ使えるのか、段階的な提供状況
室谷代表取締役ここが一番聞かれるところで。提供は一気にではなく段階的で、2026年7月の時点ではEarly Access、10月時点でFLUX 3 Imageの提供が始まっている、という進み方なんです。
テキトー教師DotAI 認定講師機能ごとに状況が違うので、「FLUX 3が使えるか」をひと括りで判断すると、実際に試したときにズレるんですよ。動画なのか画像なのかを分けて確認したほうがいい。
室谷代表取締役ロボット向けのFLUX 3 Actionはmimic roboticsとの協業で提供という段階。つまり全部が同じタイミングで開くわけじゃない。
この順番で来ると読めると、先に何を検証しておくかの判断もしやすいんですよね。
この順番で来ると読めると、先に何を検証しておくかの判断もしやすいんですよね。
テキトー教師DotAI 認定講師なので、自分の用途がどの機能に当たるかを先に決めてから、公式の最新状況を見に行くのが早いですね。
FLUXの料金はいくら?無料で試すことはできる?
サブスクなしの従量課金:解像度ごとの単価の考え方
室谷代表取締役FLUXの料金、月額サブスクじゃなくて1枚・1本ごとの従量課金なんですよね。しかも解像度のティアで単価が変わる。
FLUX 3 Imageだと768×768で1枚0.041ドル、1Kで0.048ドル、1.5Kで0.07ドル、2Kで0.10ドル、4Kで0.607ドル。4Kだけ一段跳ねるのが面白いところです。
FLUX 3 Imageだと768×768で1枚0.041ドル、1Kで0.048ドル、1.5Kで0.07ドル、2Kで0.10ドル、4Kで0.607ドル。4Kだけ一段跳ねるのが面白いところです。
テキトー教師DotAI 認定講師そこ、最初に戸惑う人が多いんですよ。「同じプロンプトなのにサイズを変えただけで請求が全然違う」って。
現場感覚だと、SNS用の1Kと印刷用の4Kを同じノリで量産して、後から数字を見て驚くパターンです。
現場感覚だと、SNS用の1Kと印刷用の4Kを同じノリで量産して、後から数字を見て驚くパターンです。
室谷代表取締役経営目線だと、この形は判断しやすいんですよね。固定費が乗らないから、テスト段階でガンガン試しても損しない。
参照画像を足しても追加課金なし、プロンプトが長くなっても追加なし、モデレーションで弾かれたら課金されない。ここは素直に助かります。
参照画像を足しても追加課金なし、プロンプトが長くなっても追加なし、モデレーションで弾かれたら課金されない。ここは素直に助かります。
テキトー教師DotAI 認定講師あと公式に料金シミュレーターがあって、解像度とモデルを選ぶと単価が出ます。単価は動くので、見積もりはそこで取るのがいちばん確実です。
提携先API(fal.ai)経由の価格との違い
FLUXの料金体系:公式従量課金 vs 提携先API(fal.ai)
公式(従量課金)
- 月額サブスクなし・1枚/1本ごとの従量課金
- 解像度ティアで単価が変わる
- FLUX 3 Image:768×768=0.041ドル
- 1K=0.048ドル/1.5K=0.07ドル/2K=0.10ドル
- 4K=0.607ドル(一段跳ねる)
- 参照画像の追加課金なし
- 長いプロンプトでも追加なし
- モデレーションで弾かれたら課金なし
- 公式の料金シミュレーターあり
提携先API(fal.ai)
- 公式とは別の価格体系
- FLUX1.1[pro]:1枚0.05ドル
- 高解像度ultra:0.06ドル
- 公式のFLUX 3 Imageとはモデル世代が違う
- 単純比較はできない
- 比較軸は「同じモデルか」「同じ解像度か」
室谷代表取締役提携先のAPI経由だと、また価格が別なんですよ。fal.aiだとFLUX1.1[pro]が1枚0.05ドル、高解像度のultraで0.06ドル。
公式のFLUX 3 Imageとはモデルの世代が違うので単純比較はできないんですけど・・・
公式のFLUX 3 Imageとはモデルの世代が違うので単純比較はできないんですけど・・・
テキトー教師DotAI 認定講師たしかに。比べる軸が「同じモデルか」「同じ解像度か」で変わりますからね。
名前だけ見て安い高いを判断すると、解像度が落ちてた、みたいなことが起きます。
名前だけ見て安い高いを判断すると、解像度が落ちてた、みたいなことが起きます。
室谷代表取締役逆に言うと、どの経路で叩くかで単価が変わるので、プロダクトに組み込む人はそこを先に決めたほうがいい。時給換算で考えると、比較に半日かけるより、公式の単価で見積もって一度走らせたほうが早いんですよね。
公式Playgroundで無料で試すときの注意点
テキトー教師DotAI 認定講師で、「無料で試せるのか」が気になるところですよね。公式のPlayground、bfl.ai/playからブラウザで触れます。
アカウント作成は必要です。
アカウント作成は必要です。
室谷代表取締役無料枠の枚数上限って、公式に明記がないんですよね。だから「1日これだけ」みたいな数字を前提に組み立てるのは危ない。
テキトー教師DotAI 認定講師そうなんです。初めて触る人は「無料でどこまで使えるの?」で止まりがちですが、まずPlaygroundで出力の質感を確かめて、本番はAPIに切り替える、という順番が現実的です。
プロンプトの効き方をつかむだけなら無料枠で足ります。
プロンプトの効き方をつかむだけなら無料枠で足ります。
室谷代表取締役料金も無料枠も更新が早い領域なので、数字は公式で確認する前提で。ここは「今いくらか」を暗記するより、確認する場所を知っておくほうが価値があるんですよね。
FLUXは商用利用できる?ライセンスの階層と注意点
API経由とオープンウェイトで商用利用の条件はどう違うのか
FLUXの商用利用ルート分岐
FLUXを商用利用する場合、どこで動かす?
YES / API経由
- 従量課金のみ
- 商用権が使い方に含まれる
- pro系・flex系も同じ扱い
- 自社サービスに組み込んで課金OK
NO / オープンウェイト(自社で重みを動かす)
- dev系はデフォルト非商用→商用にはライセンス契約が必要
- schnell・kleinはApache 2.0の範囲なら追加契約なしで商用OK
- 自社基盤向けライセンスは4段階(Builder・Platform・Professional・Enterprise)
室谷代表取締役商用利用って、ひとことで言うと「APIで呼ぶか、重みを自社で動かすか」で条件が別物なんですよ。ここを混ぜたまま議論してる話をよく見るんですけど、実際は入口で全然違います。
テキトー教師DotAI 認定講師最初に戸惑うのがまさにそこですね。同じFLUXでも入口が違うだけで条件が変わるので、現場でも「じゃあどっちで契約すればいいのか」で止まる人が多いんですよ。
室谷代表取締役API経由なら従量課金だけで、その使い方に商用権が含まれてます。pro系もflex系も同じ扱いなので、普通に自社サービスに組み込んで課金して問題ないんですよね。
テキトー教師DotAI 認定講師反対に、オープンウェイトのdev系を自社サーバーに持ってきて回す場合はデフォルトが非商用です。商用にしたいならライセンス契約が必要という切り分けになります。
schnellやkleinはApache 2.0の範囲なら、追加契約なしで商用利用できます。
schnellやkleinはApache 2.0の範囲なら、追加契約なしで商用利用できます。
4段階のライセンス(Builder・Platform・Professional・Enterprise)の違い

室谷代表取締役自社基盤で動かす前提のライセンスが4段階あって、月間の生成枚数とドメイン数で区切られてるんですよ。まとめるとこうです。
| 区分 | 想定 | 使えるモデル | 月間生成枚数 | ドメイン |
|---|---|---|---|---|
| Builder | 開発者・スタートアップ | FLUX.2[klein]系 | 1万枚 | 1 |
| Platform | SaaS・プロダクトチーム | FLUX.2[klein] 9B+FLUX.2[dev] | 10万枚 | 1 |
| Professional | 代理店・制作会社 | FLUX.2[dev] | 10万枚 | 最大3(クライアント3社分込み) |
| Enterprise | 大企業・個別契約 | 全モデル・新モデル追従 | カスタム | 複数 |
テキトー教師DotAI 認定講師BuilderにファインチューニングとLoRAの権利が付いているのが、個人で作り込む人にはけっこう大きいんですよね。
室谷代表取締役PlatformとProfessionalは同じ10万枚で、違うのはドメイン数とクライアント分が込みかどうか。ここが代理店にとっての分岐点なんですよ。
個人開発者・SaaS・制作会社・大企業はどこを選ぶのか
テキトー教師DotAI 認定講師個人で試すなら、そもそも契約が要らないルートから入るのが自然ですよね。kleinやschnellはそのまま商用に使えますし。
室谷代表取締役SaaSでプロダクトに組み込むならPlatformが候補になります。ただ経営目線で言うと、最初から固定費を積まずにAPIで従量課金から始めたほうが、失敗したときの損が読めるんですよね。
契約も見積もりも要りませんし。
契約も見積もりも要りませんし。
テキトー教師DotAI 認定講師制作会社はクライアント3社分が込みのProfessionalが効いてきます。案件ごとに判断するより、まとめて枠を持っていたほうが現場はラクなので。
室谷代表取締役大企業は複数ドメイン・カスタム量のEnterprise。全モデルに追従できることと、商用利用の制限が少ないことが要る規模ですね。
なお各段階の最新条件は更新が早いので、契約前に公式のライセンスページで確認してください。
なお各段階の最新条件は更新が早いので、契約前に公式のライセンスページで確認してください。
FLUXの使い方:Web・API・ローカル環境それぞれの始め方
公式Playground(Web版)で生成する流れ
まずは一番手軽な入口から。公式のWeb版は次の流れで使えます。
- ブラウザで
bfl.ai/playを開く - アカウントを作成してログインする
- プロンプトを入力する(画像をアップロードして編集させる使い方も可)
- 解像度やモデルを選んで生成する
室谷代表取締役ハードルが低いのはここなんですよね。インストールもGPUの用意もいらなくて、ブラウザだけで完結する。
まず品質を自分の目で確かめたいとき、これ以上楽な入口はないです。
まず品質を自分の目で確かめたいとき、これ以上楽な入口はないです。
テキトー教師DotAI 認定講師最初に戸惑うのが「無料でどこまで試せるのか」なんですよ。公式に無料枠の枚数が明記されているわけではないので、そこは公式サイトで確認してもらうのが確実です。
室谷代表取締役触って感触を掴むのと、成果物を本番の仕事に回すのは別の判断なんですよね。まず前者に割り切ると、変に身構えずに済みます。
テキトー教師DotAI 認定講師なるほど。まず1枚出してみる、でいいんですね。
APIとして自社サービスに組み込む方法
- BFLの公式APIのキーを取得する
- もしくは提携先サービス側で契約してエンドポイントを叩く
- 画面から呼び出して、生成結果を受け取る
室谷代表取締役プロダクトに組み込む段階になると、話が変わってくるんですよ。自前でGPUを抱えるより、APIで叩くほうが現実的なケースが圧倒的に多い。
テキトー教師DotAI 認定講師呼び出し先は公式だけじゃなくて、fal.ai や Replicate、TogetherAI、DeepInfra、Runware、Verda、Cloudflare といった提携先経由でも使えるんですよね。ここは選択肢が多い。
室谷代表取締役ここは調達の話で、MYUUUでも同じ判断をするんですけど、公式直か提携先経由かで単価もレイテンシも変わります。まず小さく検証して、必要になったら乗り換える、くらいの身軽さでいいんですよ。
テキトー教師DotAI 認定講師従量課金なので、PoCの段階でもコストの見通しが立てやすいのは助かりますよね。使った分だけ、というのは稟議も通しやすい。
HuggingFaceやComfyUIでローカル実行するときの前提
- HuggingFaceから重みを取得する([dev]・[schnell]・[klein]が配布されている)
- GitHubの推論コード、または ComfyUI にセットアップする
- 手元の環境で生成を実行する
テキトー教師DotAI 認定講師ローカルは3つ目の入口ですね。自社データでファインチューニングしたい人はここに来ます。
ただ、最初に戸惑うのが重みを落とすだけでは終わらない点なんですよ。動かす土台まで揃える必要があります。
ただ、最初に戸惑うのが重みを落とすだけでは終わらない点なんですよ。動かす土台まで揃える必要があります。
室谷代表取締役そこはGPUのコストが効いてくるんですよね。NVIDIAと共同で最適化したfp8版ならGeForce RTXのような民生GPUでも動くので、検証だけなら手元で回せる範囲が広がっています。
テキトー教師DotAI 認定講師逆に本番で回し続けるなら、マシンの確保と電気代を考えたほうがいいです。クラウドのAPIと比べる分岐点はそこになりますね。
室谷代表取締役そう、自社データを外に出したくない、独自の絵柄を学習させたい、みたいな理由がないなら無理にローカルにしなくていいんですよ。入口は浅いほうから順に試すのが結局一番速い。
FLUXと他の画像生成AIは何が違う?
閉じたAPIか、自社で握れるか
室谷代表取締役画像生成AIの比較って、だいたい画質の話で終わるじゃないですか。でも構造で見ると全然違うんですよね。
MidjourneyやOpenAIのモデルはAPIを借りる形で、重みは手元に来ない。FLUXはそこが根本的に違うんですよ。
MidjourneyやOpenAIのモデルはAPIを借りる形で、重みは手元に来ない。FLUXはそこが根本的に違うんですよ。
テキトー教師DotAI 認定講師たしかに。初めて触る人は「画質がいいかどうか」だけを見ちゃいますけど、実際に業務で回し始めると「自社のデータで寄せられるか」の方が効いてくるんですよ。
室谷代表取締役オープンウェイトで配布されてるので、自社の基盤に載せて自社データでファインチューニングできる。経営目線で言うと、これは調達先を自分で選べるってことなんですよね。
ベンダーロックのリスクが構造的に下がる。
ベンダーロックのリスクが構造的に下がる。
テキトー教師DotAI 認定講師そこは大きいですね。閉じたAPIだけだと、料金体系が変わっても従うしかない。
重みがあれば自社でホストする選択肢が残るので、交渉材料にもなる。
重みがあれば自社でホストする選択肢が残るので、交渉材料にもなる。
MidjourneyやDALL·Eと何が違うのか
室谷代表取締役FLUX.1の発表時点で、画質・プロンプト追従・タイポグラフィ・出力の多様性でMidjourney v6.0やDALL·E 3 (HD)、SD3-Ultraを上回るというベンチマークを出してるんですよね。まあ自社発表の数字なので、そこは割り引いて見る必要ありますけど。
テキトー教師DotAI 認定講師そうなんですよ、ここ誤解されがちで。ベンチマークは出した側の条件で測ってるので、そのまま鵜呑みにするより「選択肢が一段増えた」と捉える方が現場感覚に近いです。
室谷代表取締役ただ、タイポグラフィが強いのは実務で効くんですよ。バナーに文字を乗せる案件だと、文字が崩れるだけで作り直しになる。
そこが安定するかどうかで工数がまるで変わるんですよね。
そこが安定するかどうかで工数がまるで変わるんですよね。
テキトー教師DotAI 認定講師あー、それは現場でよく聞きます。画像生成で一番揉めるの、実は文字なんですよ。
ポスター系の依頼が来ると毎回そこが勝負になる。
ポスター系の依頼が来ると毎回そこが勝負になる。
Stable Diffusionとはどういう関係なのか
室谷代表取締役FLUXを開発してるBlack Forest Labsの創業チームは、Stable DiffusionやSDXL、Latent Diffusionを手がけてきた人たちなんですよね。だから系譜としてはStable Diffusionの延長線上にいる。
テキトー教師DotAI 認定講師兄弟みたいなものですね。Stable Diffusionがオープンで広がったからこそ、派生モデルやLoRAの文化が根付いた。
FLUXも同じ土俵にいるので、その流儀がそのまま活かせるんですよ。
FLUXも同じ土俵にいるので、その流儀がそのまま活かせるんですよ。
室谷代表取締役で、FLUX.1の[schnell]はApache 2.0で配布され、[dev]はHuggingFaceで重みが配られてる。この「重みが手元に来る」設計が、閉じたサービスとの決定的な分かれ目なんですよね。
テキトー教師DotAI 認定講師最初に戸惑うのがまさにそこなんです。APIで呼ぶだけに慣れてると、重みを自分で動かすという発想が出てこない。
でもそこを押さえると、できることの幅が一段変わるんですよ。
でもそこを押さえると、できることの幅が一段変わるんですよ。
FLUXはビジネスでどう活用されている?
広告・ECサイトの制作フローに入り始めている
FLUXのビジネス活用3領域
広告・ECサイト制作
バナー生成や商品画像の量産に活用。検証本数を増やすほどROIが良いと判断される現場も
Photoshop統合
画像編集モデルFLUX.1 KontextがAdobe Photoshopに統合。AdobeやMetaが使用と公式発表
動画制作ツール組み込み
FLUX 3 Videoは最長20秒・最大4K・音声同時生成。Picsart、Magnific、Envato、Burda Mediaが自社サービスに組み込み
室谷代表取締役FLUXって個人が遊ぶAIアートのイメージがまだ強いんですけど、実際は広告やECの現場で制作基盤として入り始めてるんですよね。Black Forest Labsが挙げている用途でも、バナー生成や商品画像の量産は想定ユースとして入ってます。
テキトー教師DotAI 認定講師たしかに。現場でよく聞くのは「毎月のバナー枚数が多すぎて外注が回らない」という声です。
ブランドのガイドラインに寄せた画像をまとめて出せるなら、そこはかなり変わるんですよ。
ブランドのガイドラインに寄せた画像をまとめて出せるなら、そこはかなり変わるんですよ。
室谷代表取締役クリエイティブの本数が売上に直結する商売だと、1枚あたりの単価より「何本テストできるか」の方が効いてくるんですよね。MYUUUの現場でも、検証本数を増やす方がROIがいいという判断になります。
テキトー教師DotAI 認定講師ゲームのコンセプトアートやWebデザインのラフ出しにも使われてますね。ゼロから描き込むより、方向性を何案か見てから絞る方が圧倒的に早いんですよ。
Adobe Photoshopに統合された画像編集モデル
室谷代表取締役ここが結構インパクトあるんですけど、画像編集モデルのFLUX.1 KontextがAdobe Photoshopに統合されてるんですよね。AdobeやMetaといった企業が使っていると、公式の発表でも言及されています。
テキトー教師DotAI 認定講師あ、それは初めて触る人が一番驚くところです。「Photoshopの中にFLUXがいる」という感覚なので、写真の一部を指示で変える編集が既存の作業フローにそのまま乗るんですよ。
室谷代表取締役デザイナーが新しいツールを覚え直さなくていい、というのが導入のハードルを一段下げるんですよね。ツールが増えると現場の習熟コストがじわじわ効いてくるので、そこは大きい。
テキトー教師DotAI 認定講師現場感覚で言うと、普段の編集作業の延長で使えるかどうかが分かれ目なんですよ。別アプリを行き来すると、結局使われなくなるケースも多いので。
動画制作ツール側に組み込まれている
室谷代表取締役動画も同じ流れなんですよ。FLUX 3 Videoは最長20秒・最大4Kで音声も同時に生成できる仕様で、PicsartやMagnific、Envato、Burda Mediaあたりが自社サービスに組み込んでいます。
テキトー教師DotAI 認定講師個人がモデルを直接叩くより、普段使ってるツールの中に入ってる方が届くスピードは速いんですよね。初めて触る人は、FLUXが動いてると気づかないまま使ってる可能性もあります。
室谷代表取締役モデル単体の性能競争より、どの制作ツールに組み込まれるかの方が事業インパクトは大きいんですよ。B2Bの組み込みは契約が積み上がるので、収益の読みやすさが全然違います。
テキトー教師DotAI 認定講師ただFLUX 3は段階的に提供が広がっている途中なので、動画・画像・ロボット向けで使える範囲が違うんですよ。導入を検討するなら、まず公式で現在の提供状況を確認しておくのが無難です。
よくある質問
Q1. 日本語のプロンプトでも意図どおりに生成できる?
テキトー教師DotAI 認定講師最初に戸惑うのがここで。長い情景説明だと、日本語のニュアンスが抜けやすいんですよね。
英語にすると意図が通りやすい場面はまだあります。
英語にすると意図が通りやすい場面はまだあります。
室谷代表取締役日本語で書いてから翻訳を挟む、っていう1工程が増えるわけですね。制作フローに乗せるなら、そこは最初から織り込んでおいたほうがいい。
テキトー教師DotAI 認定講師ただ、短い指示なら日本語のままでも十分いけます。凝った一枚は英語、ラフな確認は日本語。
そのくらいの使い分けで考えると気が楽ですよ。
そのくらいの使い分けで考えると気が楽ですよ。
Q2. 画像の中に日本語の文字を入れるのは得意?
室谷代表取締役バナーを作る立場だと、これが一番気になるんですよね。画像の中に文字を入れるやつ。
テキトー教師DotAI 認定講師画像生成AI全体に言えることですが、文字の描画は苦手な領域です。まして日本語の漢字やひらがなは崩れやすい。
室谷代表取締役じゃあ文字は別で乗せる前提で組んだほうが早い、と。
テキトー教師DotAI 認定講師そのほうが現実的ですね。背景や素材までを作って、文字はデザインツール側で乗せる。
役割を分けたほうが仕上がりも安定します。
役割を分けたほうが仕上がりも安定します。
Q3. 思ったとおりの画像が出ないときは、どう試せばいい?
テキトー教師DotAI 認定講師初めて触る人が最初にぶつかるのがここです。1回で決めようとして、指示をどんどん盛りすぎて収拾がつかなくなるパターンが多い。
室谷代表取締役プロンプトも工数ですからね。1発で当てにいくより、安く何回も回したほうが結果的に速いんですよ。
テキトー教師DotAI 認定講師まず主語と構図だけ決めて、あとは1要素ずつ足していく。同じ指示で複数枚出して選ぶ。
この順番のほうが崩れにくいですよ。
この順番のほうが崩れにくいですよ。
Q4. 入力したプロンプトや画像はAIの学習に使われる?
室谷代表取締役企業で使うなら真っ先に確認する項目です。法務から必ず聞かれるやつ。
テキトー教師DotAI 認定講師ここは契約やプランによって扱いが変わる部分なので、断定できないんですよね。無料枠と有料枠で扱いが違うこともあります。
室谷代表取締役無料で試して、そのまま業務データを流してしまう。あれが一番危ない。
テキトー教師DotAI 認定講師そういう流れは本当に多いので、業務に使う前に設定画面と規約を一度見ておく。それだけで事故の芽をかなり減らせます。
Q5. チームで使うとき、管理で気をつけることは?
室谷代表取締役チーム導入で必ず出るのが、誰のアカウントで誰が使うのか問題です。個人で試している分には見えないやつ。
テキトー教師DotAI 認定講師現場でよく聞くのは、個人アカウントのまま業務に流用してしまうパターンです。あとから権限や請求を整理するのが大変になります。
室谷代表取締役最初から組織のアカウントで発行して、費用は一箇所に集める。地味ですが、後の運用コストがまるで違います。
テキトー教師DotAI 認定講師あとはAPIキーをコードに直書きしない、共有メモに貼らない。この基本だけでも、リスクはかなり下がります。
まとめ
室谷代表取締役というわけで、FLUXは画像だけのツールから、画像・動画・音声まで1つで見る方向に動いてるんですよね。ここ数年で一番振れ幅が大きい領域だと思います。
テキトー教師DotAI 認定講師そうですね。ただ、全部を追いかける必要はなくて。
まずは今の自分の作業、バナー1枚でもいいので、1回FLUXに投げてみる。そこで体感が変わったら次のステップを考えればいいと思います。
まずは今の自分の作業、バナー1枚でもいいので、1回FLUXに投げてみる。そこで体感が変わったら次のステップを考えればいいと思います。
室谷代表取締役MYUUUの現場でも、いきなり全業務に入れるより、1タスクだけ試して効果を見る、という進め方が結局一番早いんですよ。
テキトー教師DotAI 認定講師最初に戸惑うのが料金とライセンスのところなので、そこだけ先に確認してから触り始めると安心です。モデル名の数字が増えても、考え方の軸はそこまで変わらないので。
室谷代表取締役あと、公式の情報は更新が早いので、契約前に一度自分の目で確認する。これだけやっておけば、迷っても戻ってこれます。
