Seedance 2.5 が提供開始 — Atlas Cloud で先行リリース

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへ押し上げるために開発されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしているため、Wan 3.0は同じ統合キーを使用し、個別の設定なしで機能します。公開初日に早期アクセスを取得してください。スクロールしてショーケースをご覧いただき、Wan 3.0で作成可能なコンテンツをいち早くご確認ください。

Wan 3.0 は Alibaba が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

近日公開

モデル間もなく公開

このコレクションの最終調整中です — その間、下記の類似コレクションをご覧ください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

MiniMax H3

MiniMax H3 API は、MiniMax の汎用マルチモーダル動画モデルを利用できる API です。テキスト、画像、動画、音声を個別のタスクとしてではなく、ひとつのコンテキストとして扱います。クリップは 24 FPS で 5〜15 秒、アスペクト比は 21:9 から 9:16 まで対応し、1 つのプロンプトでキャラクターの差し替え、背景の置換、台詞の書き換え、参照クリップからの音声クローン作成が可能です。Atlas Cloud は、これらすべてを 1 つの OpenAI-compatible endpoint 経由で提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0 APIは、ByteDanceのマルチモーダルビデオモデルへのプロダクションアクセスを提供します。これには、クアッドモーダル入力(テキスト、画像、ビデオ、オーディオ)と、ショット間で構図、カメラワーク、キャラクターのアクションを固定する業界最高水準の「Universal Reference」システムが含まれます。1回のAPIコールでディレクターレベルの制御を統合でき、一律$0.09/秒、即時キー発行、順番待ちリストなしで利用可能です。これらはエンタープライズクラスの稼働率とコンプライアンスによって裏付けられています。Seedance 2.0 Native 4Kが提供開始されました!

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni API は、Google I/O 2026 で発表された Google DeepMind のマルチモーダル動画生成・編集モデルを、あなたのスタックで利用可能にします。Gemini Omni は Gemini の推論エンジンと生成メディアを融合し、テキスト・画像・動画・音声を自由に組み合わせた入力から、一貫性があり知識に裏付けられた出力を生成します。自然な対話で結果を磨き上げましょう。オブジェクトの差し替え、シーンの書き換え、スタイルの変更を行っても、物理法則、キャラクター、連続性はそのまま保たれます。Atlas Cloud は、テキストからの動画生成、最大 7 枚の参照画像に対応した画像からの動画生成、そして参照ベースの動画生成という Gemini Omni Flash の全ラインアップを、単一の統合 API で提供します。料金は $0.112 からの秒単位の透明な従量課金で、サブスクリプションは不要です。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

Alibaba

Atlas Cloudは、Alibabaの全モデルラインナップを単一のAPIに統合します。言語および画像タスク用のQwen、最大1080pの動画生成用のWanが利用可能です。すべてのモデルはサブスクリプション不要の従量課金制(pay-as-you-go)でアクセスできます。Alibaba APIは、既存のOpenAI互換クライアントを使用し、単一のベースURLを介して利用可能です。

ファミリーを表示

OpenAI

Atlas Cloudは、画像生成用のGPT Image 2から動画用のSora 2まで、OpenAI APIの全ラインナップへのアクセスを提供します。すべてのモデルは、月額の固定コミットメントなしの従量課金制でご利用いただけます。OpenAI互換APIを使用し、ベースURLを一つ変更するだけで簡単に組み込むことができます。

ファミリーを表示

Wan 3.0 の実践

マルチリファレンスのブランドフィルムから30秒の長回しまで、1回の Wan 3.0 リクエストで生成できるものを示す6つの主要機能。

マルチリファレンス・ブランドフィルム

Omniモードは、最大20点の参考資料、10枚の画像、5つのクリップ、5つのオーディオトラックに加え、1つのソースドキュメントまたはウェブページを読み込むことができるため、完全なブランドキットを一度の処理でブランドイメージに合った1つの動画に変換します。

30秒のワンカットストーリー

ネイティブの30秒出力により、短いクリップでは表現できない連続したカメラワークやワンショットシーケンスを保持し、物語に展開の余地を与えます。インテリジェントなデュレーション機能により、モデルが各シーンのペースを自律的に調整できます。

ピクセルレベルの参照一貫性

顔、製品、微細なディテールが、すべてのフレームにおいてピクセルレベルの忠実度で再現されます。制作チームは、繰り返し登場するキャラクターや正確なブランドアセットに求められる、確実な納品を実現できます。

没入型サウンドとリアリズム

リアリズム、画像のテクスチャ、そしてネイティブオーディオが同期して向上しているため、生成されたシーンは無音の映像ではなく、マッチした音声と共に提供されます。その結果、真のオーディオビジュアルのインパクトをもたらします。

指示とリファレンスの編集

精密な編集では、書面による指示や参照クリップに基づいて既存の映像を再加工し、ビデオ全体を再生成することなく被写体、スタイル、または特定の瞬間を変更できます。

ドキュメントとウェブページを動画に

テキスト、画像、音声、動画にとどまらず、Wan 3.0はdoc、xls、ppt、pdf、mdファイルやライブウェブページを読み込み、レポートやスライドデッキを直接完成したクリップに変換します。

同一プロンプト内での動画比較

Wan 3.0、Seedance 2.5、および Wan 2.7 モデルによって生成されたビデオプレゼンテーションをご覧ください。

プロンプト

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

プロンプト

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - 実際のクリエイティブパイプライン向けに構築

Wan 3.0のアップグレードは実際の業界のニーズに由来しており、ショートドラマから企業向け動画まで、以下の制作ワークフローに直接組み込まれています。

映画、テレビ、ショートドラマ & MV

ネイティブの30秒テイクと実景復元技術により、AI映画、ショートドラマ、音楽MVは物理的な撮影の大部分を省略できます。ピクセルレベルの一貫性が頻繁に登場する主役の姿を維持し、ネイティブオーディオはすべてのカットに正確に同期して生成されます。

アニメーション、ブランド&IP

単一のモデル内で実写からアニメまであらゆるスタイルを制御し、ピクセルレベルの一貫性によりマスコット、ロゴ、またはIPキャラクターをすべてのフレームで固定します。煩雑な制作プロセスを必要とせずに、完全なブランドアニメーションをレンダリングします。

広告および企業プロモーション

オムニクリエイションは、家電、美容、自動車、FMCG(日用消費財)、アパレルブランドにおいて、テキストと画像の限界を打ち破ります。製品ページや企業レポートを直接入力するだけで、製品デモから企業のブランドムービーまで、あらゆるコンテンツを構築できます。

ソフトウェア&プロダクトデザイン

製品のUIウォークスルー、機能アニメーション、またはデータ視覚化を入力すると、Wan 3.0 は元の美しさを保ちながら、ストーリー主導のモーション作品に変換します。面倒なアニメーションのステップはなくなります。

教育

ドキュメント入力機能は、PDF、PPT、またはWebページを直接読み取るため、個別のスクリプトなしで、レッスンや調査レポートがわかりやすい解説動画になります。複雑な資料もワンステップで視覚化されます。

文化観光

実景復元技術は、大規模な撮影を行うことなく風景、遺産、郷土料理を再現するため、都市PR動画や文化のデジタル化を低コストで完了させることができます。遠く離れた場所が、視聴者の目の前にリアルに現れます。

Atlas Cloud で Wan 3.0 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでWan 3.0を使用する理由

高度なWan 3.0モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でWan 3.0、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Wan 3.0 API よくあるご質問

Wan 3.0は、Alibabaの次世代オールインワン動画モデルであり、現在パブリックベータ版として提供されています。1つのリクエストで、テキスト、画像、動画、音声、ドキュメント、またはウェブページを最大30秒の動画に変換でき、このモデルはその幅広い入力とピクセルレベルの一貫性、正確な編集、そしてネイティブ生成された音声を組み合わせます。

Atlas Cloudは、AlibabaがWan 3.0 APIをリリースし次第、追加する予定であり、Day-0アクセスの提供を目標としています。ご登録いただくと、提供開始日に通知を受け取ることができます。

Wan 3.0は、このシリーズにおいて最も広範なリリースとなります。ネイティブの再生時間を30秒に引き上げ、オムニリファレンスモードでは最大20の混在する参照資料に加えてドキュメントやWebページを受け付けます。また、最初と最後のフレームモードを追加し、ネイティブオーディオによるピクセルレベルの一貫性を追求しています。Atlas Cloud上の以前のWanバージョンは、より短く、より焦点を絞ったテキストからの動画生成(text-to-video)および画像からの動画生成(image-to-video)の作業において、引き続き強力な選択肢となります。

Wan 3.0 は、プロンプト以上のものをソース素材として扱います。1回のリクエストで、最大20個の複合リファレンス、10枚の画像、合計15秒の5つのビデオクリップ、合計15秒の5つのオーディオクリップを利用できるほか、単一のドキュメント(doc、xls、ppt、pdf、またはmd)やウェブページを添付でき、テキストプロンプト自体の長さは最大20,000文字まで対応可能です。

クリップはネイティブで最大30秒間実行されます。テキストまたは画像の入力リクエストは2〜30秒の間で生成されますが、動画を含むリクエストでは入力と出力の合計時間が30秒以内に保たれます。また、インテリジェントデュレーション機能により長さを自動的に設定することも可能です。解像度は480p、720p、1080pに対応しており、アスペクト比は16:9、9:16、4:3、3:4、1:1、およびインテリジェント比率が利用可能です。

一貫性はピクセルレベルで処理されるため、シーンが切り替わったり被写体が動いたりしても、顔、服装、製品、または細かなリファレンスのディテールがその外観を維持します。同じキャラクターや正確なブランドアセットを再利用する制作工程において、その安定性が毎回の納品を予測可能なものにします。

はい、指示と参照の両方を通じて可能です。テキストによる指示やサンプルクリップを使用して、被写体のスタイル変更、照明の調整、または単一セグメントの置き換えを行うことができ、変更したくない要素は編集プロセス全体を通じてそのまま保持されます。

はい。Atlas Cloud はすでに Wan 2.7、2.6、2.5 を1つの統合キーで提供しており、Wan 3.0 も同じキーに追加されます。新しいアカウントの作成、エンドポイントの変更、個別のセットアップは不要です。すでに Wan ファミリーを呼び出しているチームは、Wan 3.0 が公開され次第、モデル名を変更するだけでアクセスできます。

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索