


FLUX 3 API は、Black Forest Labs の最新の基盤モデルをあなたのスタックにもたらします。画像、動画、音声を共同で学習した単一の Self-Flow アーキテクチャです。多言語の会話、効果音、環境音を含む最大 20 秒のクリップを 1 回の実行で生成したり、正確なタイポグラフィで text-to-image 作品をレンダリングしたりできます。Atlas Cloud は、従量課金のコール単位料金と Day-0 アクセスにより、1 つの OpenAI 互換キーでこれを提供します。
FLUX 3 は Black Forest Labs が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。
Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。
5 つの動画エンドポイントが 1 つの FLUX 3 API サーフェスの背後にあり、下の表では、それぞれが何を入力として受け取り、何を返し、1 秒あたりいくらかかるのかを示しています。
| モダリティ | 説明 |
|---|---|
| FLUX 3 T2V API(Text to Video) | テキストプロンプトから 5〜20 秒のクリップを生成し、generate_audio はデフォルトで有効なため、同じ処理内で音声も生成されます。出力は 720p または 1080p で、21:9 から 9:16 までの 7 つの固定アスペクト比に加えて auto オプションに対応し、seed 値を指定すればどの結果も再現できます。料金は生成動画 1 秒あたり $0.17 です。 |
| FLUX 3 I2V API(Image to Video) | PNG、JPEG、または WebP 画像を 1 枚指定すると、モデルがそのフレームから先をアニメーション化し、プロンプトから動きやテンポを反映します。長さは 5〜20 秒の範囲で選択でき、すでに所有しているアートワークをもとにした商品カット、キャラクター紹介、SNS 向け短尺編集に適しています。課金は生成動画 1 秒あたり $0.17 です。 |
| FLUX 3 Keyframes API(Keyframes to Video) | ショットで特定のタイミングを正確に合わせる必要がある場合、最大 10 枚のキーフレーム画像を 24 fps のタイムライン上の正確なフレーム位置に固定できます。各 frame_index は duration に 24 を掛けた範囲内に収める必要があり、ストーリーボードや previz のチームは、何をいつ表示するかを直接制御できます。料金は他の生成エンドポイントと同じく、生成動画 1 秒あたり $0.17 です。 |
| FLUX 3 FLF API(First and Last Frame to Video) | クリップを指定した終了画像にぴったり合わせる必要がありますか?start_image_url と end_image_url を渡すと、ショットの両端が固定され、その間の動きはモデルが補完します。ロゴのリビール、変形シーケンス、前後の映像に合わせる必要があるシーンの受け渡しに適しており、料金は生成動画 1 秒あたり $0.17 です。 |
| FLUX 3 Extend API(Video Extension) | このエンドポイントでは、既存の映像からストーリーを続きを生成できます。50 MB 未満かつ 15 秒未満の MP4 を、プロンプトに従って最終フレームから継続します。映像と並行して音声も生成され、同じく 720p または 1080p の出力と 5〜20 秒の範囲が適用されます。Extension の料金は生成動画 1 秒あたり $0.41 です。 |
Black Forest Labs が 1 つのマルチモーダルバックボーン上で構築した FLUX 3 API は、対話、効果音、環境音を同じ生成工程で載せた最大20秒の HD または Full HD 動画を返し、ショット、キーフレーム、言語、画面内テキストまでその場で指定できます。
1回の呼び出しで、同じ生成工程内で音声も一緒に生成された 5〜20 秒の動画を返し、後から吹き替えることはありません。対話、効果音、環境音はイベントが起きるまさにそのフレームに乗り、出力は 720p HD または 1080p Full HD で届きます。このタイミングの精度が、フライパンが勢いよく熱せられる音や強く閉まるドアを、寄せ集めではなく実写のように見せます。
カットを指定すれば、モデルがそのまま反映します。シーンやカメラアングルは1回の生成の中で変わりつつ、同じキャラクター、衣装、ライティングのロジックが全ショットを通して維持されます。長尺の素材はエージェント型クリップ連結で作成でき、個別の生成をつなげて数分単位のシーケンスにします。これまで4回のレンダリングと編集が必要だった絵コンテも、1本の連続した映像として戻ってきます。
テキストのみ、1枚の静止画、最初と最後のフレームのペア、タイムライン上に配置したキーフレーム、または続きから始める既存クリップ。5つすべての入力方法に対応しています。キーフレームで何がいつ起こるかを固定し、継続では既存素材の続きから生成できます。ブランド用の静止画や未完成のカットを抱えているスタジオなら、すべてをゼロから説明するのではなく、それらの素材からそのまま始められます。
ネイティブな対話は、英語の各方言、中国語、スペイン語、フランス語、ドイツ語、日本語、ポルトガル語、ロシア語、イタリア語、インドネシア語、トルコ語、ヒンディー語、パンジャブ語などに対応し、求めた言語に合わせて口の動きも同期します。タイポグラフィもシーンの一部として描画されるため、看板やタイトルは後から合成するのではなく、フレームの中に最初から収まります。1つのプロンプトで、文字まで配置済みのローカライズスポットをそのまま納品できます。
Atlas Cloud は、カタログ全体を支える統合エンドポイントから FLUX 3 を提供するため、1つのキーで動画、画像、言語モデルにアクセスでき、別の統合は不要です。課金はサブスクリプションも席数課金もない従量課金で、実際に実行した生成分だけ支払います。モデルの切り替えは文字列を1つ変えるだけ。今すぐ開発を始めましょう。
下の各行では、同一のプロンプトを Atlas Cloud 上の FLUX 3 API とほか2つの動画モデルで実行しています。厳選されたデモではなく同じ条件で、動きの連続性、ショットの切り替え、ネイティブ音声を評価できます。
シネマティックな実写。雨に濡れた夜の東京の裏路地。小さな黄色いレインコートを着た柴犬がスケートボードに乗り、水たまりや湯気の立つ排気口の間を縫うように路地を下っていく。冒頭はローアングルのトラッキングショットで、ボードのすぐ後ろから濡れた路面すれすれを滑るように進み、ネオンの反射が流れていく。犬が積み上げられた紙提灯にかすってぶつかり、提灯が空中に弾け飛ぶ。ホイップパンで、回転しながらラーメン屋台へ転がっていく提灯の1つを追う。ドローンショットにカットし、上昇しながら後退する視点で、柴犬が前足を踏み込み、ボードをスピンさせて急停止し、笑っているラーメン職人に一声吠える。職人がチャーシューを一切れ弾き飛ばし、犬が空中でキャッチする。冷たいネオンに対して屋台の暖かな光、逆光で照らされた水しぶき。Audio: 雨のしゅうしゅうという音、石畳をうなるウレタンホイール、ジュージュー鳴る中華鍋、鋭い一声の吠え声、頭上のどこかを通過する電車。16:9 aspect ratio。
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
手描きアニメ調。果てしない雲海の上、明るい真昼。十代の空釣り師が木造の飛行船の甲板で踏ん張り、長い釣り糸を雲海へ投げ込む。冒頭は手すり越しの一人称視点で、糸がしなって飛び出し、白い雲の中へ消えていく。釣り竿がぴんと張り、カメラは甲板の周囲を高速で旋回するショットに切り替わる。彼女は板張りの上を引きずられ、ロープが手袋の中で煙を上げ、片方のブーツが艤装のロープの輪に引っかかる。彼女が手すりに足をかけて力いっぱい引き戻した瞬間、鯨ほどの大きさの鯉が背後の雲を突き破って跳ね上がり、鱗が帆いっぱいに虹色の光を投げかける。最後はローアングルのヒーローショット。乗組員が歓声を上げ、雲のしぶきが画面を漂う。絵画的なセルシェーディング、暖かなリムライト、目に見える筆の質感。Audio: 吹き抜ける風、きしむロープ、高まっていくオーケストラの盛り上がり、跳ね上がる瞬間の深く水っぽい轟音。16:9 aspect ratio。
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
ネイティブ音声付きの20秒ソーシャルクリップ、キーフレーム指定のストーリーボード、ローカライズ済み広告カット、最終レンダリング前の素早いドラフト確認まで、FLUX 3 API は Atlas Cloud 上で従量課金と Day-0 アクセスにより幅広く対応します。
1つのテキストプロンプトから最大20秒の動画を生成し、フレームと同時にスピーチ、効果音、環境音も作成します。ソーシャルチームは、別途音声制作を行わずに完成したクリップを得られます。
順序付けされたキーフレームにより、FLUX 3 API は定義された各瞬間に沿ってシーンを展開し、1回の生成内でカメラアングルや設定を切り替えられます。ストーリーボードアーティストは、撮影を手配する前にシーケンス全体をプレビューできます。
生成されたシーン内でタイポグラフィが正確にレンダリングされ、多言語テキスト処理も従来の FLUX 世代より向上しています。パッケージモックアップ、タイトルカード、ローカライズ済みバナーを、1回の呼び出しでレビュー可能な状態にできます。
同じ広告を6つの市場向けに展開する必要がありますか?FLUX 3 API は動画と同期した多言語ダイアログを生成するため、各カットに吹き替え工程なしでローカライズされた音声トラックを付与できます。
既存の映像を新しい文脈へ移行し、マッチする音声で延長したり、中心となる要素を保ったまま作り替えたりできます。代理店は追加撮影を発注する代わりに、過去のキャンペーン素材を再活用できます。
ドラフトモードでは低コストで高速な HD プレビューを返し、承認されたショットは FLUX 3 API を通じて HD または FHD で再レンダリングできます。コンセプトに20回の試行が必要な場合でも、反復作業を手頃なコストに抑えられます。
クリップ長、出力解像度、ネイティブ音声、1秒あたりのコストを比較して、FLUX 3 API が優位な点と、別の Atlas Cloud モデルのほうがパイプラインに適している場面を見極めましょう。
| モデル | 最大クリップ長 | 最大出力解像度 | ネイティブ音声 | 1秒あたりの料金 |
|---|---|---|---|---|
| FLUX 3 Video (テキストから動画) | 20 s | FHD, up to 2 MP per frame | √ 対話、SFX、環境音 | $0.17 HD / $0.29 FHD |
| FLUX 3 Video (Video-to-Video) | 20 s | FHD, up to 2 MP per frame | √ 対話、SFX、環境音 | $0.41 HD / $0.53 FHD |
| Seedance 2.0 テキストから動画 | 15 s | 4K (3840 x 2160) | √ 既定でオン | $0.112 |
| Kling V3.0 Turbo テキストから動画 | 15 s | 1080p | √ オプション、既定でオフ | $0.112 |
| Wan-2.7 テキストから動画 | 15 s | 1080p native, 1440p-SR | √ SFX、音楽、環境音 | $0.10 |
| Veo3.1 テキストから動画 | 8 s | 1080p | √ 同期音声 | $0.20 |
数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。
atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。
高度なFLUX 3モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。
低レイテンシ:
リアルタイム推論のためのGPU最適化推論。
統合API:
1つの統合でFLUX 3、GPT、Gemini、DeepSeekを実行。
透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。
開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。
信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。
セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。
FLUX 3 は Black Forest Labs のマルチモーダル基盤モデルです。別々のシステムをつなぎ合わせるのではなく、画像、動画、音声、アクション予測を横断して共同学習されています。FLUX 3 API は Atlas Cloud 経由でこのモデルを提供するため、1 回のリクエストで同期された音声付き動画を返せます。OpenAI互換の 1 つのキーで、カタログ内の他のすべてのモデルとあわせて利用でき、使用量に応じて課金されます。
一般提供されている機能は動画です。テキストから動画、画像から動画、キーフレームでガイドするショット、既存クリップの継続生成に対応し、それぞれネイティブ音声を任意で付けられます。Black Forest Labs はこのファミリーを段階的にリリースしているため、FLUX 3 Image と FLUX 3 Action は動画エンドポイントと同時ではなく、その後に提供されます。
アカウントを作成し、API キーを生成して、既存のクライアントを FLUX 3 API エンドポイントに向けるだけです。リクエストは Atlas Cloud カタログ全体で使われている OpenAI互換のパターンに従うため、新しい SDK を覚える必要はなく、後からベンダーロックインを解消する手間もありません。課金は生成ごとの従量課金で、最初にサブスクリプション契約を結ぶ必要はありません。今すぐ開発を始められます。
はい。しかも 2 つ目のモデルを通すのではなく、同じ生成パス内で行われるため、会話、効果音、環境音を映像に合わせたまま保てます。FLUX 3 は英語、中国語、スペイン語、日本語、ヒンディー語など、12 を超える言語でリップシンク付きの音声を扱えます。無音の映像だけが必要な場合は、リクエストごとに音声をオフにできます。
生成は 5〜20 秒に対応し、出力は HD 720p、コストよりディテールを重視する場合は Full HD 1080p も利用できます。ワイド、正方形、縦型のフレーミングにすべて対応しているため、同じプロンプトをランディングページのヒーロー動画にもモバイルフィードにも向けられます。長いストーリーは、過大な 1 回のリクエストではなく、制御しやすい複数のクリップを組み合わせて構成するのが最適です。
開始画像を指定すればモデルがそれをアニメーション化できます。また、ショットで特定の瞬間を決まった順序で押さえる必要がある場合は、キーフレームを固定できます。既存の映像を継続生成することもでき、入力クリップ末尾の動きやフレーミングを引き継げます。ただし、延長を重ねるたびに前の結果を土台にするため、視覚的な一貫性は徐々にずれていきます。継続生成の連鎖は控えめに使ってください。
Draft mode は低コストの HD プレビューを返すため、最終レンダリングに支払う前に構図、テンポ、音声を確認できます。まずここでプロンプトを反復し、最も良いプロンプトをリクエスト構造を変えずに standard HD または Full HD で再実行します。多くのバリエーションを出荷するチームほど、このループから大きな価値を得られます。
動画は出力秒数ごとの課金です。そのため短いクリップは長いクリップの数分の一のコストで済み、実際に生成した分だけ支払います。料金は解像度によって決まり、Full HD は standard HD より高く、Draft mode はそのどちらよりも低くなります。Atlas Cloud では、追加のサブスクリプション、シート料金、最低利用額はありません。今日から始められます。
まだです。FLUX 3 Video がこのファミリーでリリース済みの部分で、FLUX 3 Image は段階的ロールアウト中です。また、オープンウェイトの FLUX 3 Dev バリアントは後日提供予定として発表されています。Atlas Cloud は新しい FLUX 3 エンドポイントがリリースされ次第追加するため、画像生成が利用可能になっても同じキーをそのまま使えます。
共同モデルにより、つなぎ合わせの工程が不要になります。口の動きに声のタイミングを合わせるための 2 回目の処理や、完成したカットの下に環境音を重ねる作業は必要ありません。これは会話シーンで特に重要です。トラック間のずれは視聴者にすぐ見えてしまうからです。パイプラインは複数サービスから 1 回の呼び出しに縮小され、監視すべき障害点も少なくなります。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。