Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1は、テキスト、元フレーム、またはビジュアルリファレンスから動画を生成する開発者向けのAlibabaの動画生成ファミリーです。プロンプトから動画クリップを作成したり、選択した最初のフレームを追加ガイダンス付きでアニメーション化したり、1~9枚のリファレンス画像を使ってビジュアルを細かく指定したりできます。Atlas Cloudを利用すれば、これらのワークフローを透明性の高い従量課金制で1つの統合環境にまとめられます。今すぐ開発を始めましょう。

Happyhorse 1.1 は Alibaba が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

HappyHorse 1.1 ビデオ生成モードの比較

各ビデオをどのようにガイドしたいかに応じて、テキスト、画像、リファレンス入力から選択できます。

モダリティ説明
HappyHorse 1.1 T2V API (Text to Video)テキストプロンプトから、480P、720P、1080Pのビデオを、柔軟なアスペクト比と3〜15秒の長さで生成します。ソース画像なしでコンセプトの可視化、ソーシャルコンテンツ、ビデオ制作を行う場合に、このエンドポイントを使用します。
HappyHorse 1.1 I2V API (Image to Video)最初のフレーム画像を起点に、任意のプロンプトによるガイダンスを加えながら、480P、720P、1080Pの出力で3〜15秒のビデオを生成します。既存の構図をもとにした製品アニメーション、キャラクターの動き、ビジュアルストーリーテリングに適しています。
HappyHorse 1.1 R2V API (Reference to Video)1〜9枚のリファレンス画像とテキストプロンプトを使ってビデオ生成をガイドし、480P、720P、1080Pの出力、柔軟なアスペクト比、3〜15秒の長さを選択できます。リファレンス主導のシーン、キャラクター中心のクリップ、より強いビジュアルディレクションが必要なプロジェクトに適しています。

3つの入力に対応するHappyHorse 1.1ツールキット

HappyHorse 1.1は、プロンプト、最初のフレーム、または最大9枚の参照画像から、3~15秒の動画を生成します。出力解像度は480P、720P、1080Pに対応し、テキストモードと参照モードでは9種類のアスペクト比、シード制御、Atlas Cloud経由の従量課金アクセスを利用できます。

HappyHorse 1.1 Text-to-Video

最大2,500文字のテキストプロンプトから、画像入力なしで完成した動画クリップを生成します。HappyHorse 1.1は480P、720P、1080Pの出力に対応し、動画の長さを3~15秒に設定できます。ワイドスクリーン、縦型、正方形、ポートレート、ウルトラワイド向けに、9種類のアスペクト比から選択できます。コンセプトの可視化、広告、短編ナラティブシーンに適したワークフローです。

First-Frame Animation

1枚の最初のフレーム画像を動画に変換し、任意のプロンプトで動き、スタイル、シーンのディテールを指定できます。image-to-videoエンドポイントは、最大20 MBで、縦横どちらの辺も300ピクセル以上のJPEG、JPG、PNG、WEBPファイルを受け付けます。480P、720P、1080Pのいずれかと、3~15秒の動画時間を選択できます。商品ショット、ポートレート、ストーリーボードのキーフレームに適しています。

HappyHorse 1.1 Reference Control

1~9枚の参照画像と必須のテキストプロンプトを使って、新しい動画を作成します。JPEG、JPG、PNG、WEBPの各参照画像は最大20 MBまで対応し、短辺は400ピクセル以上である必要があります。出力の解像度、動画時間、アスペクト比、シードを設定できます。このモードでは、キャラクター、商品、アートディレクションのワークフローで、より多くの素材を活用できます。

あらゆる用途に対応するフォーマット

テキストまたは参照画像を使った生成を用途に合わせて構成できます。対応するアスペクト比は、16:9、9:16、1:1、4:3、3:4、4:5、5:4、9:21、21:9の9種類です。解像度は480P、720P、1080P、動画時間は3~15秒に対応します。これらの設定を組み合わせれば、エンドポイントを変更せずに、モバイルフィード、Webプレーヤー、正方形の掲載枠、ポートレート、ウルトラワイドの構図向けクリップを作成できます。

HappyHorse 1.1 Seed Control

生成入力をより細かく制御したい場合は、プロンプト、解像度、アスペクト比、動画時間の設定と併せてseedパラメータを使用します。HappyHorse 1.1は-1~2,147,483,647のseed値を受け付け、-1を指定するとランダムなシードが生成されます。反復テストでは、その他の設定も明示的に指定してください。このパラメータ化されたワークフローにより、開発者はクリエイティブなテストを整理し、一貫したリクエスト構造でバリエーションを比較できます。

1つのキー、3つのワークフロー

OpenAI互換の1つのキーと従量課金で、Atlas CloudからHappyHorse 1.1の3つのワークフローすべてにアクセスできます。標準料金は1秒あたり$0.07からで、サブスクリプションではなく利用量に応じて課金されます。同じ統合パターンを維持したまま、text-to-video、image-to-video、reference-to-videoのモデルパスを切り替えられます。個別のプロバイダーアカウントを用意せずに、複数モードの動画プロダクトを構築したい開発者に適した構成です。

3つのモデルによるプロンプト対決におけるHappyHorse 1.1

HappyHorse 1.1と、比較対象となる2つの動画モデルが、同じプロンプトをどのように解釈するかを、シネマティックなアクションとスタイライズド・ファンタジーのストーリーテリングで見比べます。

プロンプト

激しいアルプスの吹雪の中を疾走する食堂車を舞台にした、8–10秒の連続したフォトリアルなキネティック・フードシネマ映像。熟練した列車のシェフが、車両の激しい左右の揺れに自然に身を合わせながら朝食を調理する。片手で薄く黄金色に焼けたクレープを高くひっくり返し、狭い通路を滑るように移動して空いた手で転がるオレンジを受け止め、続いてパンの縁で落下してくるクレープを打ち、開いた車両間のドアを通って、物理的に正確で美しい弧を描くように次の車両へ飛ばす。轟々と燃えるコンロの炎、ジュッと音を立てる生地、磨かれたスチールに飛び散る熱いバターのしずくを横から追う極端なクローズアップで始まり、シェフがすべての衝撃に対して体勢を釣り合わせる様子を捉えながら、素早いハーフオービットで周囲を回り込む。コートとエプロンはリアルに反応する。その後、飛翔するクレープに正確にロックオンしたフォローショットでドアを駆け抜け、たわむ連結部を越えて次の車両へ進み、ウェイターをかすめるように避けながら、驚いた乗客の朝食プレートに完璧に着地する。着地の瞬間、列車が逃げ切るその外側を巨大な雪崩が窓の向こうで押し寄せ、鋭いビジュアル・クライマックスを生み出す。暖かなタングステンランプとオレンジ色の炎が、雪の筋が走る窓越しの冷たい青い夜明けとぶつかり合う。重なり合うオレンジとゴールドの料理の色調、シルバーグレーの金属、冷たい青の荒野。深く狭い中央パースペクティブ、ドア枠が連続する入れ子構造、強いパララックス、わずかな手持ちカメラの振動、鮮明なモーション表現、両方の車両にまたがるシームレスな被写体の連続性と空間的一貫性、リアルなバランス、流動的な飛沫、布の慣性、衝突、投射物の物理挙動。同期したサウンドデザイン:レールの走行音と車両の軋みがリズムを作り、パンの hiss 音とバターの弾ける音が速度を上げ、オレンジが金属的なクリック音と同期して転がり、パンが打ち当たる瞬間に明るいパーカッシブなビートが入り、その後に柔らかなプレートへの着地音と轟音の雪崩の音が続く。スローモーションなし、静止した埋め草なし、画面、インターフェース、ダッシュボード、プログレスバー、チャート、キャプション、字幕、ロゴ、目に見えるテキストなし。プレミアムなシネマティック・リアリズム、ダイナミックなフード・コマーシャル、没入感のあるワンテイク錯視、16:9アスペクト比。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

プロンプト

夕暮れのコンテナターミナルを舞台にした、高彩度でグラフィカルな3Dアニメーションによる9-secondのアクションシーケンス。珊瑚色の赤いグランドピアノが外れてスチール製の積み込みランプを猛スピードで滑り落ち、小さなキャスターが確かな重量感を伴ってガタつき、跳ね返る。その後を、コバルトブルーの作業服を着たフォークリフト運転手が追いかけ、マスタードイエローのクレーンと、絶えず上げ下げされて一時的に変化する緊急通路を形作る輸送コンテナの間を縫うように走る。回転する車輪と激しく揺れるピアノの脚の数インチ脇から追跡する極端なローアングルショットで始まり、火花と金属同士の衝突音をサウンドと完全に同期させる。急速にクレーンアップして俯瞰に移り、珊瑚色の赤、コバルトブルー、マスタードイエローの色ブロックによる幾何学的な迷路として追跡ルートを見せる。その後、ウィップパンとオービットで疾走するフォークリフトの正面へ回り込み、距離を詰めていく様子を捉える。埠頭の端で、運転手は最後の瞬間にフォークをピアノの下へ突き入れ、その重い本体を持ち上げ、力強く1回転させ、深く同期した金属音とともに安全に着地させる。慣性で蓋が跳ね上がり、最後のビートでカモメが鍵盤の上に降り立ち、澄んだ最後の1音を鳴らす。高密度で連続する動き、物理的に説得力のある運動量、衝突、サスペンションの跳ね、荷重の変化、全編を通じて安定したキャラクターとオブジェクトの同一性。エッジの立った影、大胆な幾何学的構図、スタイライズドなシネマティック3Dアニメーション、鮮明な夕暮れのリムライト。車輪の騒音、油圧音、コンテナの衝突音、エンジンの負荷音、カモメの羽音、最後のピアノ音で構成されたリズミカルな工業系パーカッション。スローモーションなし、アイドルショットなし、空間的連続性を損なうカットなし、画面、ソフトウェアインターフェース、ダッシュボード、プログレスバー、チャート、キャプション、ラベル、ロゴ、ウォーターマーク、説明テキストなし。16:9アスペクト比。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 クリエイティブワークフロー全体での活用

キャンペーンのコンセプトや製品アニメーションから、リファレンス画像に基づくブランド動画、開発者向けツールまで、HappyHorse 1.1はプロンプトと画像を柔軟に活用できる短尺動画コンテンツへと変換します。

HappyHorse 1.1 キャンペーンコンセプト

文章で書かれたコンセプトを、480P、720P、1080Pと柔軟なアスペクト比の動画に変換できます。クリエイティブチームは、素材映像や撮影なしで、キャンペーンのコンセプト、ソーシャル投稿、ストーリー案を制作できます。

動きのある静止画

最初のフレームとなる画像から始め、オプションのプロンプトで3〜15秒のアニメーションを指定できます。プロダクトマーケターは、静止画アセットをローンチ動画、ディスプレイ動画、カタログ用モーションに変換できます。

リファレンス画像に基づくブランドバリエーション

1〜9枚のリファレンス画像を使用し、提供されたビジュアル入力をもとに最大1080Pの動画を生成できます。ブランドチームは、承認済みのキャラクター、製品、環境画像を基に、キャンペーンのバリエーションを展開できます。

マルチフォーマットコンテンツパイプライン

柔軟なアスペクト比と3段階の解像度から選択し、1つの生成ワークフローでさまざまな掲載先向けのクリップを準備できます。開発者は、コンテンツ製品やキャンペーン全体で、縦型、横型などのレイアウトに対応できます。

HappyHorse 1.1 クリッププランニング

ストーリーボードの短い一場面が必要ですか。それとも、より長い製品の見せ場が必要ですか。3〜15秒の長さに対応しているため、クリエイティブツール上で、迅速なコンセプト作成、プロモーション用クリップ、簡潔なビジュアルシーケンスを1つのインターフェースで実現できます。

柔軟な動画アプリ入力

テキスト、最初のフレーム画像、複数のリファレンス画像を、1つのモデルファミリーで利用する動画アプリを構築できます。ユーザーは、各ワークフローのアイデア出し、アニメーション、ブランドガイド付き制作に最適な開始素材を選択できます。

動画生成におけるHappyHorse 1.1の比較

対応入力、クリップ長、解像度、参照容量、表示ベース価格の観点から、HappyHorse 1.1の生成モードと主要なAtlas Cloud動画モデルを比較します。

モデル対応入力出力時間解像度最大参照画像数表示ベース価格
HappyHorse-1.1 Text-to-videoテキストプロンプト3〜15秒480P、720P、1080P-$0.07、単位記載なし
HappyHorse-1.1 Image-to-video最初のフレーム画像と任意のプロンプト3〜15秒480P、720P、1080P-$0.07、単位記載なし
HappyHorse-1.1 Reference-to-videoテキストプロンプトと参照画像3〜15秒480P、720P、1080P9$0.07、単位記載なし
Wan-3.0 Reference-to-videoテキスト、画像、動画、音声、ドキュメント、またはWebページの参照2〜30秒またはスマート尺480P、720P、1080P10$0.05、単位記載なし
Seedance 2.5 Reference-to-Videoテキスト、画像、動画、音声の参照最大30秒-30$0.167、単位記載なし
MiniMax H3 Reference-to-Videoテキスト、画像、動画、音声の参照4〜15秒デフォルト768p、最大2K9$0.038/秒

Atlas Cloud で Happyhorse 1.1 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでHappyhorse 1.1を使用する理由

高度なHappyhorse 1.1モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でHappyhorse 1.1、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

HappyHorse 1.1で開発する:よくある質問

HappyHorse 1.1は、Atlas Cloudで利用できるAlibabaの動画生成モデルです。テキスト、最初のフレーム、または参照画像から短い動画クリップを生成できます。このファミリーには、text-to-video、image-to-video、reference-to-video用の個別エンドポイントが用意されています。

テキストプロンプトからシーンを生成したり、静止画像をアニメーション化したり、複数の視覚的な参照素材を使って新しいクリップの内容を指定したりできます。プロンプトのみで生成する動画、最初のフレームからのアニメーション、参照画像に基づくコンテンツに対応しています。

Atlas Cloud APIキーを作成し、選択したモデルIDと必須入力を指定して、認証済みのPOSTリクエストを /api/v1/model/generateVideo に送信します。レスポンスにはタスクIDが含まれており、出力の準備が整うまで予測ステータスを確認できます。

プロンプトベースの生成には alibaba/happyhorse-1.1/text-to-video、最初のフレームのアニメーション化には alibaba/happyhorse-1.1/image-to-video、複数画像によるガイダンスには alibaba/happyhorse-1.1/reference-to-video を選択します。各モードには独自の入力スキーマがあります。

text-to-videoとreference-to-videoでは、480p、720p、1080pのいずれか、3秒から15秒までの長さ、対応する9種類のアスペクト比から選択できます。image-to-videoも同じ解像度と長さの範囲に対応し、アップロードした画像を最初のフレームとして使用します。

reference-to-videoでは、1~9個の画像URLと、画像をどのように結果に反映させるかを説明するプロンプトを指定します。JPEG、JPG、PNG、WEBPファイルに対応しており、1画像あたりの上限は20 MB、短辺の最小サイズは400ピクセルです。

Atlas Cloudでは、HappyHorse 1.1の3つのエンドポイントすべてに対して、標準料金として1秒あたり$0.07と案内しています。従量課金制のため、生成料金は指定したクリップの長さに応じて変動します。

生成のランダム性を制御したい場合は、text-to-videoまたはreference-to-videoでseedパラメータを使用します。Atlas Cloudでは、明示的な整数値、またはランダムシードを使用する場合の-1を指定できます。

各リクエストで生成できるクリップの長さは3~15秒です。image-to-videoでは最初のフレーム画像を1枚使用し、reference-to-videoでは参照画像を9枚まで指定できます。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omniは、Google DeepMindによるネイティブなマルチモーダル動画ファミリーです。プロンプトによる生成・編集に対応し、テキストからの生成、静止画のアニメーション化、任意のビジュアルリファレンスを使った既存映像の編集を、変更していない部分を保持しながら行えます。解像度、アスペクト比、動画の長さを柔軟に設定でき、さまざまな制作ワークフローに対応します。Atlas Cloudは、透明性の高い従量課金でアクセスを一元化します。今日から開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索