Seedance 2.0 Mini & Fast APIを世界最安値で — 公式価格から最大68%オフ

Baidu Models on Atlas Cloud | ERNIE

Atlas Cloudは、Baidu APIの下でERNIE ImageおよびERNIE Image Turboをホストしており、どちらも従量課金制です。各モデルは、英語および中国語のテキストレンダリングにおいてオープンソースをリードしています。

Baidu は Baidu が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

AI Image Models by Baidu

Atlas Cloud の最先端 AI 画像生成モデルを使い、プロンプトと参照画像から、そのまま実用できる息をのむようなビジュアルを生み出します。

すべてのモデルを見る

Baidu Models API Pricing Details

Compare standard vs. our pricing across every Baidu model.

ModelStandard Price (USD)Our Price (USD)Discount
Baidu ERNIE Image Turbo Text-to-image
Start fromFree
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Atlas Cloud 上で構築できる Baidu API のユースケース

ERNIE Image は、生成された画像内のテキストが可読でなければならないワークフローのために構築されています。チームはこれを使用して、デザインチームなしで、バイリンガルなアセット、構造化されたレイアウト、およびテキストを多用するクリエイティブを大規模に制作できます。

バイリンガルマーケティングポスター生成

マーケティングチームは ERNIE Image を使用し、単一の API コールで読みやすい英語と中国語のテキストを含むキャンペーンポスターを生成し、同じプロンプト構造から両方の市場をターゲットにしています。このモデルは両方の言語を 0.96 以上の精度でレンダリングするため、見出しや本文はポストプロダクションの修正なしで綺麗に仕上がります。Atlas Cloud の従量課金制により、アセットごとのデザインコストをかけることなく、キャンペーンごとに数十のバリエーションを生成することが実用的になります。

クロスマーケットブランド向け製品パッケージング

中国市場に参入するブランドは、印刷生産に移行する前に、ERNIE Imageを使用して正確なバイリンガルテキストを含む製品ラベルとパッケージのモックアップを生成します。このモデルは、ラベルや成分表の小さな文字を含め、簡体字中国語、繁体字中国語、英語を同じレイアウトで処理します。1024×1024の出力解像度では、モックアップはクライアントの承認や規制当局への提出に使用するのに十分な本番レベルの品質を備えています。

コミックおよび多コマレイアウト制作

出版社やコンテンツスタジオは、ERNIE Imageを使用して、中国語または英語で正確な吹き出し、キャプションボックス、およびパネルテキストを備えたコミックパネルを生成しています。このモデルは、この種の構造化された画像内テキスト出力に特化したLongTextBenchで0.96以上のスコアを記録しています。Atlas Cloud上のERNIE Image Turboは無料であるため、イテレーション段階での大量のパネルのドラフト作成がコストゼロで行えます。

自動インフォグラフィック生成

データチームは、ERNIE Imageのテキストレンダリング精度を活用して、構造化データをラベル付きのインフォグラフィック画像に変換するパイプラインを構築します。チャートのラベル、吹き出し、セクションのヘッダーは、単一のプロンプトから両方の言語で正確にレンダリングされ、データ出力から視覚化までの手作業による設計ステップを排除します。組み込みの Prompt Enhancer は、短いデータの説明を詳細なレイアウト指示に自動的に書き換えます。

大規模なローカライズ広告クリエイティブ

パフォーマンスマーケティングチームは、同一のキャンペーンブリーフから中国語圏および英語圏の市場向けにローカライズされた広告クリエイティブを生成します。ERNIE Imageのバイリンガルサポートを利用して、単一のパイプラインで両方の言語バリアントを制作します。各クリエイティブには正確な画像内テキストが含まれており、生成された画像を編集または再組版する必要がなくなります。Atlas Cloudの無料Turboティアにより、チームがどのクリエイティブバリアントをスケールするかを評価する間のテストコストをゼロに抑えることができます。

UIモックアップコピー生成

製品およびデザインチームはERNIE Imageを使用して、英語または中国語で正確にレンダリングされたリアルなプレースホルダーテキストを含むUIモックアップのスクリーンショットを生成します。このモデルは、ボタンのラベル、ナビゲーションテキスト、フォームフィールド、およびモーダルのテキストを高忠実度で処理し、テキストレイヤーを手動で編集することなく、モックアップをプレゼンテーションでそのまま使用できるようにします。これにより、ワイヤーフレームのコンセプトからステークホルダー向けの視覚資料が完成するまでの時間が、数時間から数分に短縮されます。

Atlas Cloud AI

営業に問い合わせる

Baiduに関するよくある質問

ERNIE Image は、中国語テキストのレンダリングにおいて LongTextBench で0.96以上のスコアを記録しており、オープンウェイトのテキストから画像への生成モデルの中で最高となっています。競合するオープンソースモデルの多くは中国語テキストのシナリオにおいて0.3を大きく下回るスコアにとどまっており、生成された画像内に可読性の高い中国語を必要とするワークフローにおいて信頼性に欠けます。出力において正確な中国語テキストが必須要件である場合、ERNIE Image が実用的な選択肢となります。

はい。ERNIE Imageは、単一の生成呼び出しで両方の文字を処理し、それぞれ独立して高い精度を維持します。これは、同じレイアウト内で両方の言語を読みやすくする必要があるバイリンガルのポスター、パッケージ、およびマーケティング資料に有用です。英語と中国語の両方のLongTextBenchスコアは0.96を超えています。

ERNIE Imageには軽量なPrompt Enhancerが組み込まれており、短い入力プロンプトを拡散モデルに渡す前に、より豊富で構造化された記述に自動的に書き換えます。これにより、大規模なプロンプトエンジニアリングを行わずとも、短いプロンプトを送信するだけで、より詳細で正確な出力結果を得ることができます。このPrompt Enhancerは、API呼び出しのたびに生成パイプラインの一部として実行されます。

ERNIE Image Turboは、DMD(拡散モデル蒸留)と強化学習を使用して、推論を50ステップから8ステップに圧縮し、6倍以上の速度向上を実現します。TurboはAtlas Cloudで無料で利用でき、迅速なイテレーションやドラフト生成に適しています。標準モデルは最高画質で動作し、商業用ポスターやエディトリアルグラフィックなどの最終成果物に適しています。

はい。ERNIE ImageはApache 2.0ライセンスの下で公開されており、商用利用、改変、および再配布が許可されています。生成された画像は、広告、パッケージ、出版物、およびその他の商用アプリケーションに使用できます。特定の条件については、ERNIE ImageのGitHubリポジトリでライセンスの全条項をご確認ください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスを用いた生成に対応するMiniMaxの動画モデルファミリーです。5〜15秒のクリップを作成し、オプションの最終フレームで動きを誘導したり、リファレンス画像の被写体を維持したりできます。生成音声がワークフローに適している場合は、H3 Developerを選択できます。Atlas Cloudでは、H3、H3 Fast、H3 Max、H3 Developerを1つのAPIワークフローに統合して利用でき、標準料金は1秒あたり$0.038からです。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0 APIは、ByteDanceのマルチモーダルビデオモデルへのプロダクションアクセスを提供します。これには、クアッドモーダル入力(テキスト、画像、ビデオ、オーディオ)と、ショット間で構図、カメラワーク、キャラクターのアクションを固定する業界最高水準の「Universal Reference」システムが含まれます。1回のAPIコールでディレクターレベルの制御を統合でき、一律$0.09/秒、即時キー発行、順番待ちリストなしで利用可能です。これらはエンタープライズクラスの稼働率とコンプライアンスによって裏付けられています。Seedance 2.0 Native 4Kが提供開始されました!

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

Alibaba

Atlas Cloudは、Alibabaの全モデルラインナップを単一のAPIに統合します。言語および画像タスク用のQwen、最大1080pの動画生成用のWanが利用可能です。すべてのモデルはサブスクリプション不要の従量課金制(pay-as-you-go)でアクセスできます。Alibaba APIは、既存のOpenAI互換クライアントを使用し、単一のベースURLを介して利用可能です。

ファミリーを表示

おすすめ記事

Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。