Seedance 2.0 Mini & Fast APIを世界最安値で — 公式価格から最大68%オフ
Hero background 1Hero background 2Hero background 3

FLUX 3 API: 20-Second Video With Native Audio

FLUX 3 API は、Black Forest Labs の最新の基盤モデルをあなたのスタックにもたらします。画像、動画、音声を共同で学習した単一の Self-Flow アーキテクチャです。多言語の会話、効果音、環境音を含む最大 20 秒のクリップを 1 回の実行で生成したり、正確なタイポグラフィで text-to-image 作品をレンダリングしたりできます。Atlas Cloud は、従量課金のコール単位料金と Day-0 アクセスにより、1 つの OpenAI 互換キーでこれを提供します。

FLUX 3 は Black Forest Labs が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

すべての FLUX 3 API エンドポイントをモダリティ別に解説

5 つの動画エンドポイントが 1 つの FLUX 3 API サーフェスの背後にあり、下の表では、それぞれが何を入力として受け取り、何を返し、1 秒あたりいくらかかるのかを示しています。

モダリティ説明
FLUX 3 T2V API(Text to Video)テキストプロンプトから 5〜20 秒のクリップを生成し、generate_audio はデフォルトで有効なため、同じ処理内で音声も生成されます。出力は 720p または 1080p で、21:9 から 9:16 までの 7 つの固定アスペクト比に加えて auto オプションに対応し、seed 値を指定すればどの結果も再現できます。料金は生成動画 1 秒あたり $0.17 です。
FLUX 3 I2V API(Image to Video)PNG、JPEG、または WebP 画像を 1 枚指定すると、モデルがそのフレームから先をアニメーション化し、プロンプトから動きやテンポを反映します。長さは 5〜20 秒の範囲で選択でき、すでに所有しているアートワークをもとにした商品カット、キャラクター紹介、SNS 向け短尺編集に適しています。課金は生成動画 1 秒あたり $0.17 です。
FLUX 3 Keyframes API(Keyframes to Video)ショットで特定のタイミングを正確に合わせる必要がある場合、最大 10 枚のキーフレーム画像を 24 fps のタイムライン上の正確なフレーム位置に固定できます。各 frame_index は duration に 24 を掛けた範囲内に収める必要があり、ストーリーボードや previz のチームは、何をいつ表示するかを直接制御できます。料金は他の生成エンドポイントと同じく、生成動画 1 秒あたり $0.17 です。
FLUX 3 FLF API(First and Last Frame to Video)クリップを指定した終了画像にぴったり合わせる必要がありますか?start_image_url と end_image_url を渡すと、ショットの両端が固定され、その間の動きはモデルが補完します。ロゴのリビール、変形シーケンス、前後の映像に合わせる必要があるシーンの受け渡しに適しており、料金は生成動画 1 秒あたり $0.17 です。
FLUX 3 Extend API(Video Extension)このエンドポイントでは、既存の映像からストーリーを続きを生成できます。50 MB 未満かつ 15 秒未満の MP4 を、プロンプトに従って最終フレームから継続します。映像と並行して音声も生成され、同じく 720p または 1080p の出力と 5〜20 秒の範囲が適用されます。Extension の料金は生成動画 1 秒あたり $0.41 です。

単一の FLUX 3 API 呼び出しで動画、音声、演出指示を一括処理

Black Forest Labs が 1 つのマルチモーダルバックボーン上で構築した FLUX 3 API は、対話、効果音、環境音を同じ生成工程で載せた最大20秒の HD または Full HD 動画を返し、ショット、キーフレーム、言語、画面内テキストまでその場で指定できます。

1回の生成で20秒の映像と音声

1回の呼び出しで、同じ生成工程内で音声も一緒に生成された 5〜20 秒の動画を返し、後から吹き替えることはありません。対話、効果音、環境音はイベントが起きるまさにそのフレームに乗り、出力は 720p HD または 1080p Full HD で届きます。このタイミングの精度が、フライパンが勢いよく熱せられる音や強く閉まるドアを、寄せ集めではなく実写のように見せます。

1回の生成の中でシーンとカメラを切り替え

カットを指定すれば、モデルがそのまま反映します。シーンやカメラアングルは1回の生成の中で変わりつつ、同じキャラクター、衣装、ライティングのロジックが全ショットを通して維持されます。長尺の素材はエージェント型クリップ連結で作成でき、個別の生成をつなげて数分単位のシーケンスにします。これまで4回のレンダリングと編集が必要だった絵コンテも、1本の連続した映像として戻ってきます。

FLUX 3 API への5つの入力方法

テキストのみ、1枚の静止画、最初と最後のフレームのペア、タイムライン上に配置したキーフレーム、または続きから始める既存クリップ。5つすべての入力方法に対応しています。キーフレームで何がいつ起こるかを固定し、継続では既存素材の続きから生成できます。ブランド用の静止画や未完成のカットを抱えているスタジオなら、すべてをゼロから説明するのではなく、それらの素材からそのまま始められます。

13言語で自然に決まる対話

ネイティブな対話は、英語の各方言、中国語、スペイン語、フランス語、ドイツ語、日本語、ポルトガル語、ロシア語、イタリア語、インドネシア語、トルコ語、ヒンディー語、パンジャブ語などに対応し、求めた言語に合わせて口の動きも同期します。タイポグラフィもシーンの一部として描画されるため、看板やタイトルは後から合成するのではなく、フレームの中に最初から収まります。1つのプロンプトで、文字まで配置済みのローカライズスポットをそのまま納品できます。

1つの Atlas Cloud キーの裏側にある FLUX 3 API

Atlas Cloud は、カタログ全体を支える統合エンドポイントから FLUX 3 を提供するため、1つのキーで動画、画像、言語モデルにアクセスでき、別の統合は不要です。課金はサブスクリプションも席数課金もない従量課金で、実際に実行した生成分だけ支払います。モデルの切り替えは文字列を1つ変えるだけ。今すぐ開発を始めましょう。

1つのプロンプト、3つのモデル:FLUX 3 API 横並び比較

下の各行では、同一のプロンプトを Atlas Cloud 上の FLUX 3 API とほか2つの動画モデルで実行しています。厳選されたデモではなく同じ条件で、動きの連続性、ショットの切り替え、ネイティブ音声を評価できます。

プロンプト

シネマティックな実写。雨に濡れた夜の東京の裏路地。小さな黄色いレインコートを着た柴犬がスケートボードに乗り、水たまりや湯気の立つ排気口の間を縫うように路地を下っていく。冒頭はローアングルのトラッキングショットで、ボードのすぐ後ろから濡れた路面すれすれを滑るように進み、ネオンの反射が流れていく。犬が積み上げられた紙提灯にかすってぶつかり、提灯が空中に弾け飛ぶ。ホイップパンで、回転しながらラーメン屋台へ転がっていく提灯の1つを追う。ドローンショットにカットし、上昇しながら後退する視点で、柴犬が前足を踏み込み、ボードをスピンさせて急停止し、笑っているラーメン職人に一声吠える。職人がチャーシューを一切れ弾き飛ばし、犬が空中でキャッチする。冷たいネオンに対して屋台の暖かな光、逆光で照らされた水しぶき。Audio: 雨のしゅうしゅうという音、石畳をうなるウレタンホイール、ジュージュー鳴る中華鍋、鋭い一声の吠え声、頭上のどこかを通過する電車。16:9 aspect ratio。

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

プロンプト

手描きアニメ調。果てしない雲海の上、明るい真昼。十代の空釣り師が木造の飛行船の甲板で踏ん張り、長い釣り糸を雲海へ投げ込む。冒頭は手すり越しの一人称視点で、糸がしなって飛び出し、白い雲の中へ消えていく。釣り竿がぴんと張り、カメラは甲板の周囲を高速で旋回するショットに切り替わる。彼女は板張りの上を引きずられ、ロープが手袋の中で煙を上げ、片方のブーツが艤装のロープの輪に引っかかる。彼女が手すりに足をかけて力いっぱい引き戻した瞬間、鯨ほどの大きさの鯉が背後の雲を突き破って跳ね上がり、鱗が帆いっぱいに虹色の光を投げかける。最後はローアングルのヒーローショット。乗組員が歓声を上げ、雲のしぶきが画面を漂う。絵画的なセルシェーディング、暖かなリムライト、目に見える筆の質感。Audio: 吹き抜ける風、きしむロープ、高まっていくオーケストラの盛り上がり、跳ね上がる瞬間の深く水っぽい轟音。16:9 aspect ratio。

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

チームが FLUX 3 API を活用する場面

ネイティブ音声付きの20秒ソーシャルクリップ、キーフレーム指定のストーリーボード、ローカライズ済み広告カット、最終レンダリング前の素早いドラフト確認まで、FLUX 3 API は Atlas Cloud 上で従量課金と Day-0 アクセスにより幅広く対応します。

音声まで一体で生成されるソーシャルクリップ

1つのテキストプロンプトから最大20秒の動画を生成し、フレームと同時にスピーチ、効果音、環境音も作成します。ソーシャルチームは、別途音声制作を行わずに完成したクリップを得られます。

FLUX 3 API によるマルチショットのストーリーボード

順序付けされたキーフレームにより、FLUX 3 API は定義された各瞬間に沿ってシーンを展開し、1回の生成内でカメラアングルや設定を切り替えられます。ストーリーボードアーティストは、撮影を手配する前にシーケンス全体をプレビューできます。

フレーム内のタイポグラフィとテキスト

生成されたシーン内でタイポグラフィが正確にレンダリングされ、多言語テキスト処理も従来の FLUX 世代より向上しています。パッケージモックアップ、タイトルカード、ローカライズ済みバナーを、1回の呼び出しでレビュー可能な状態にできます。

FLUX 3 API によるローカライズ済み広告カット

同じ広告を6つの市場向けに展開する必要がありますか?FLUX 3 API は動画と同期した多言語ダイアログを生成するため、各カットに吹き替え工程なしでローカライズされた音声トラックを付与できます。

既存映像に第二の用途を

既存の映像を新しい文脈へ移行し、マッチする音声で延長したり、中心となる要素を保ったまま作り替えたりできます。代理店は追加撮影を発注する代わりに、過去のキャンペーン素材を再活用できます。

FLUX 3 API で低コストなドラフト生成

ドラフトモードでは低コストで高速な HD プレビューを返し、承認されたショットは FLUX 3 API を通じて HD または FHD で再レンダリングできます。コンセプトに20回の試行が必要な場合でも、反復作業を手頃なコストに抑えられます。

Atlas Cloud 上で FLUX 3 API を他の動画モデルと並べて比較

クリップ長、出力解像度、ネイティブ音声、1秒あたりのコストを比較して、FLUX 3 API が優位な点と、別の Atlas Cloud モデルのほうがパイプラインに適している場面を見極めましょう。

モデル最大クリップ長最大出力解像度ネイティブ音声1秒あたりの料金
FLUX 3 Video (テキストから動画)20 sFHD, up to 2 MP per frame√ 対話、SFX、環境音$0.17 HD / $0.29 FHD
FLUX 3 Video (Video-to-Video)20 sFHD, up to 2 MP per frame√ 対話、SFX、環境音$0.41 HD / $0.53 FHD
Seedance 2.0 テキストから動画15 s4K (3840 x 2160)√ 既定でオン$0.112
Kling V3.0 Turbo テキストから動画15 s1080p√ オプション、既定でオフ$0.112
Wan-2.7 テキストから動画15 s1080p native, 1440p-SR√ SFX、音楽、環境音$0.10
Veo3.1 テキストから動画8 s1080p√ 同期音声$0.20

Atlas Cloud で FLUX 3 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでFLUX 3を使用する理由

高度なFLUX 3モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でFLUX 3、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

開発者向け FLUX 3 API のよくある質問と回答

FLUX 3 は Black Forest Labs のマルチモーダル基盤モデルです。別々のシステムをつなぎ合わせるのではなく、画像、動画、音声、アクション予測を横断して共同学習されています。FLUX 3 API は Atlas Cloud 経由でこのモデルを提供するため、1 回のリクエストで同期された音声付き動画を返せます。OpenAI互換の 1 つのキーで、カタログ内の他のすべてのモデルとあわせて利用でき、使用量に応じて課金されます。

一般提供されている機能は動画です。テキストから動画、画像から動画、キーフレームでガイドするショット、既存クリップの継続生成に対応し、それぞれネイティブ音声を任意で付けられます。Black Forest Labs はこのファミリーを段階的にリリースしているため、FLUX 3 Image と FLUX 3 Action は動画エンドポイントと同時ではなく、その後に提供されます。

アカウントを作成し、API キーを生成して、既存のクライアントを FLUX 3 API エンドポイントに向けるだけです。リクエストは Atlas Cloud カタログ全体で使われている OpenAI互換のパターンに従うため、新しい SDK を覚える必要はなく、後からベンダーロックインを解消する手間もありません。課金は生成ごとの従量課金で、最初にサブスクリプション契約を結ぶ必要はありません。今すぐ開発を始められます。

はい。しかも 2 つ目のモデルを通すのではなく、同じ生成パス内で行われるため、会話、効果音、環境音を映像に合わせたまま保てます。FLUX 3 は英語、中国語、スペイン語、日本語、ヒンディー語など、12 を超える言語でリップシンク付きの音声を扱えます。無音の映像だけが必要な場合は、リクエストごとに音声をオフにできます。

生成は 5〜20 秒に対応し、出力は HD 720p、コストよりディテールを重視する場合は Full HD 1080p も利用できます。ワイド、正方形、縦型のフレーミングにすべて対応しているため、同じプロンプトをランディングページのヒーロー動画にもモバイルフィードにも向けられます。長いストーリーは、過大な 1 回のリクエストではなく、制御しやすい複数のクリップを組み合わせて構成するのが最適です。

開始画像を指定すればモデルがそれをアニメーション化できます。また、ショットで特定の瞬間を決まった順序で押さえる必要がある場合は、キーフレームを固定できます。既存の映像を継続生成することもでき、入力クリップ末尾の動きやフレーミングを引き継げます。ただし、延長を重ねるたびに前の結果を土台にするため、視覚的な一貫性は徐々にずれていきます。継続生成の連鎖は控えめに使ってください。

Draft mode は低コストの HD プレビューを返すため、最終レンダリングに支払う前に構図、テンポ、音声を確認できます。まずここでプロンプトを反復し、最も良いプロンプトをリクエスト構造を変えずに standard HD または Full HD で再実行します。多くのバリエーションを出荷するチームほど、このループから大きな価値を得られます。

動画は出力秒数ごとの課金です。そのため短いクリップは長いクリップの数分の一のコストで済み、実際に生成した分だけ支払います。料金は解像度によって決まり、Full HD は standard HD より高く、Draft mode はそのどちらよりも低くなります。Atlas Cloud では、追加のサブスクリプション、シート料金、最低利用額はありません。今日から始められます。

まだです。FLUX 3 Video がこのファミリーでリリース済みの部分で、FLUX 3 Image は段階的ロールアウト中です。また、オープンウェイトの FLUX 3 Dev バリアントは後日提供予定として発表されています。Atlas Cloud は新しい FLUX 3 エンドポイントがリリースされ次第追加するため、画像生成が利用可能になっても同じキーをそのまま使えます。

共同モデルにより、つなぎ合わせの工程が不要になります。口の動きに声のタイミングを合わせるための 2 回目の処理や、完成したカットの下に環境音を重ねる作業は必要ありません。これは会話シーンで特に重要です。トラック間のずれは視聴者にすぐ見えてしまうからです。パイプラインは複数サービスから 1 回の呼び出しに縮小され、監視すべき障害点も少なくなります。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスを用いた生成に対応するMiniMaxの動画モデルファミリーです。5〜15秒のクリップを作成し、オプションの最終フレームで動きを誘導したり、リファレンス画像の被写体を維持したりできます。生成音声がワークフローに適している場合は、H3 Developerを選択できます。Atlas Cloudでは、H3、H3 Fast、H3 Max、H3 Developerを1つのAPIワークフローに統合して利用でき、標準料金は1秒あたり$0.038からです。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索