


HappyHorse 1.1は、テキスト、元フレーム、またはビジュアルリファレンスから動画を生成する開発者向けのAlibabaの動画生成ファミリーです。プロンプトから動画クリップを作成したり、選択した最初のフレームを追加ガイダンス付きでアニメーション化したり、1~9枚のリファレンス画像を使ってビジュアルを細かく指定したりできます。Atlas Cloudを利用すれば、これらのワークフローを透明性の高い従量課金制で1つの統合環境にまとめられます。今すぐ開発を始めましょう。
Happyhorse 1.1 は Alibaba が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。
Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。
各ビデオをどのようにガイドしたいかに応じて、テキスト、画像、リファレンス入力から選択できます。
| モダリティ | 説明 |
|---|---|
| HappyHorse 1.1 T2V API (Text to Video) | テキストプロンプトから、480P、720P、1080Pのビデオを、柔軟なアスペクト比と3〜15秒の長さで生成します。ソース画像なしでコンセプトの可視化、ソーシャルコンテンツ、ビデオ制作を行う場合に、このエンドポイントを使用します。 |
| HappyHorse 1.1 I2V API (Image to Video) | 最初のフレーム画像を起点に、任意のプロンプトによるガイダンスを加えながら、480P、720P、1080Pの出力で3〜15秒のビデオを生成します。既存の構図をもとにした製品アニメーション、キャラクターの動き、ビジュアルストーリーテリングに適しています。 |
| HappyHorse 1.1 R2V API (Reference to Video) | 1〜9枚のリファレンス画像とテキストプロンプトを使ってビデオ生成をガイドし、480P、720P、1080Pの出力、柔軟なアスペクト比、3〜15秒の長さを選択できます。リファレンス主導のシーン、キャラクター中心のクリップ、より強いビジュアルディレクションが必要なプロジェクトに適しています。 |
HappyHorse 1.1は、プロンプト、最初のフレーム、または最大9枚の参照画像から、3~15秒の動画を生成します。出力解像度は480P、720P、1080Pに対応し、テキストモードと参照モードでは9種類のアスペクト比、シード制御、Atlas Cloud経由の従量課金アクセスを利用できます。
最大2,500文字のテキストプロンプトから、画像入力なしで完成した動画クリップを生成します。HappyHorse 1.1は480P、720P、1080Pの出力に対応し、動画の長さを3~15秒に設定できます。ワイドスクリーン、縦型、正方形、ポートレート、ウルトラワイド向けに、9種類のアスペクト比から選択できます。コンセプトの可視化、広告、短編ナラティブシーンに適したワークフローです。
1枚の最初のフレーム画像を動画に変換し、任意のプロンプトで動き、スタイル、シーンのディテールを指定できます。image-to-videoエンドポイントは、最大20 MBで、縦横どちらの辺も300ピクセル以上のJPEG、JPG、PNG、WEBPファイルを受け付けます。480P、720P、1080Pのいずれかと、3~15秒の動画時間を選択できます。商品ショット、ポートレート、ストーリーボードのキーフレームに適しています。
1~9枚の参照画像と必須のテキストプロンプトを使って、新しい動画を作成します。JPEG、JPG、PNG、WEBPの各参照画像は最大20 MBまで対応し、短辺は400ピクセル以上である必要があります。出力の解像度、動画時間、アスペクト比、シードを設定できます。このモードでは、キャラクター、商品、アートディレクションのワークフローで、より多くの素材を活用できます。
テキストまたは参照画像を使った生成を用途に合わせて構成できます。対応するアスペクト比は、16:9、9:16、1:1、4:3、3:4、4:5、5:4、9:21、21:9の9種類です。解像度は480P、720P、1080P、動画時間は3~15秒に対応します。これらの設定を組み合わせれば、エンドポイントを変更せずに、モバイルフィード、Webプレーヤー、正方形の掲載枠、ポートレート、ウルトラワイドの構図向けクリップを作成できます。
生成入力をより細かく制御したい場合は、プロンプト、解像度、アスペクト比、動画時間の設定と併せてseedパラメータを使用します。HappyHorse 1.1は-1~2,147,483,647のseed値を受け付け、-1を指定するとランダムなシードが生成されます。反復テストでは、その他の設定も明示的に指定してください。このパラメータ化されたワークフローにより、開発者はクリエイティブなテストを整理し、一貫したリクエスト構造でバリエーションを比較できます。
OpenAI互換の1つのキーと従量課金で、Atlas CloudからHappyHorse 1.1の3つのワークフローすべてにアクセスできます。標準料金は1秒あたり$0.07からで、サブスクリプションではなく利用量に応じて課金されます。同じ統合パターンを維持したまま、text-to-video、image-to-video、reference-to-videoのモデルパスを切り替えられます。個別のプロバイダーアカウントを用意せずに、複数モードの動画プロダクトを構築したい開発者に適した構成です。
HappyHorse 1.1と、比較対象となる2つの動画モデルが、同じプロンプトをどのように解釈するかを、シネマティックなアクションとスタイライズド・ファンタジーのストーリーテリングで見比べます。
激しいアルプスの吹雪の中を疾走する食堂車を舞台にした、8–10秒の連続したフォトリアルなキネティック・フードシネマ映像。熟練した列車のシェフが、車両の激しい左右の揺れに自然に身を合わせながら朝食を調理する。片手で薄く黄金色に焼けたクレープを高くひっくり返し、狭い通路を滑るように移動して空いた手で転がるオレンジを受け止め、続いてパンの縁で落下してくるクレープを打ち、開いた車両間のドアを通って、物理的に正確で美しい弧を描くように次の車両へ飛ばす。轟々と燃えるコンロの炎、ジュッと音を立てる生地、磨かれたスチールに飛び散る熱いバターのしずくを横から追う極端なクローズアップで始まり、シェフがすべての衝撃に対して体勢を釣り合わせる様子を捉えながら、素早いハーフオービットで周囲を回り込む。コートとエプロンはリアルに反応する。その後、飛翔するクレープに正確にロックオンしたフォローショットでドアを駆け抜け、たわむ連結部を越えて次の車両へ進み、ウェイターをかすめるように避けながら、驚いた乗客の朝食プレートに完璧に着地する。着地の瞬間、列車が逃げ切るその外側を巨大な雪崩が窓の向こうで押し寄せ、鋭いビジュアル・クライマックスを生み出す。暖かなタングステンランプとオレンジ色の炎が、雪の筋が走る窓越しの冷たい青い夜明けとぶつかり合う。重なり合うオレンジとゴールドの料理の色調、シルバーグレーの金属、冷たい青の荒野。深く狭い中央パースペクティブ、ドア枠が連続する入れ子構造、強いパララックス、わずかな手持ちカメラの振動、鮮明なモーション表現、両方の車両にまたがるシームレスな被写体の連続性と空間的一貫性、リアルなバランス、流動的な飛沫、布の慣性、衝突、投射物の物理挙動。同期したサウンドデザイン:レールの走行音と車両の軋みがリズムを作り、パンの hiss 音とバターの弾ける音が速度を上げ、オレンジが金属的なクリック音と同期して転がり、パンが打ち当たる瞬間に明るいパーカッシブなビートが入り、その後に柔らかなプレートへの着地音と轟音の雪崩の音が続く。スローモーションなし、静止した埋め草なし、画面、インターフェース、ダッシュボード、プログレスバー、チャート、キャプション、字幕、ロゴ、目に見えるテキストなし。プレミアムなシネマティック・リアリズム、ダイナミックなフード・コマーシャル、没入感のあるワンテイク錯視、16:9アスペクト比。
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
夕暮れのコンテナターミナルを舞台にした、高彩度でグラフィカルな3Dアニメーションによる9-secondのアクションシーケンス。珊瑚色の赤いグランドピアノが外れてスチール製の積み込みランプを猛スピードで滑り落ち、小さなキャスターが確かな重量感を伴ってガタつき、跳ね返る。その後を、コバルトブルーの作業服を着たフォークリフト運転手が追いかけ、マスタードイエローのクレーンと、絶えず上げ下げされて一時的に変化する緊急通路を形作る輸送コンテナの間を縫うように走る。回転する車輪と激しく揺れるピアノの脚の数インチ脇から追跡する極端なローアングルショットで始まり、火花と金属同士の衝突音をサウンドと完全に同期させる。急速にクレーンアップして俯瞰に移り、珊瑚色の赤、コバルトブルー、マスタードイエローの色ブロックによる幾何学的な迷路として追跡ルートを見せる。その後、ウィップパンとオービットで疾走するフォークリフトの正面へ回り込み、距離を詰めていく様子を捉える。埠頭の端で、運転手は最後の瞬間にフォークをピアノの下へ突き入れ、その重い本体を持ち上げ、力強く1回転させ、深く同期した金属音とともに安全に着地させる。慣性で蓋が跳ね上がり、最後のビートでカモメが鍵盤の上に降り立ち、澄んだ最後の1音を鳴らす。高密度で連続する動き、物理的に説得力のある運動量、衝突、サスペンションの跳ね、荷重の変化、全編を通じて安定したキャラクターとオブジェクトの同一性。エッジの立った影、大胆な幾何学的構図、スタイライズドなシネマティック3Dアニメーション、鮮明な夕暮れのリムライト。車輪の騒音、油圧音、コンテナの衝突音、エンジンの負荷音、カモメの羽音、最後のピアノ音で構成されたリズミカルな工業系パーカッション。スローモーションなし、アイドルショットなし、空間的連続性を損なうカットなし、画面、ソフトウェアインターフェース、ダッシュボード、プログレスバー、チャート、キャプション、ラベル、ロゴ、ウォーターマーク、説明テキストなし。16:9アスペクト比。
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
キャンペーンのコンセプトや製品アニメーションから、リファレンス画像に基づくブランド動画、開発者向けツールまで、HappyHorse 1.1はプロンプトと画像を柔軟に活用できる短尺動画コンテンツへと変換します。
文章で書かれたコンセプトを、480P、720P、1080Pと柔軟なアスペクト比の動画に変換できます。クリエイティブチームは、素材映像や撮影なしで、キャンペーンのコンセプト、ソーシャル投稿、ストーリー案を制作できます。
最初のフレームとなる画像から始め、オプションのプロンプトで3〜15秒のアニメーションを指定できます。プロダクトマーケターは、静止画アセットをローンチ動画、ディスプレイ動画、カタログ用モーションに変換できます。
1〜9枚のリファレンス画像を使用し、提供されたビジュアル入力をもとに最大1080Pの動画を生成できます。ブランドチームは、承認済みのキャラクター、製品、環境画像を基に、キャンペーンのバリエーションを展開できます。
柔軟なアスペクト比と3段階の解像度から選択し、1つの生成ワークフローでさまざまな掲載先向けのクリップを準備できます。開発者は、コンテンツ製品やキャンペーン全体で、縦型、横型などのレイアウトに対応できます。
ストーリーボードの短い一場面が必要ですか。それとも、より長い製品の見せ場が必要ですか。3〜15秒の長さに対応しているため、クリエイティブツール上で、迅速なコンセプト作成、プロモーション用クリップ、簡潔なビジュアルシーケンスを1つのインターフェースで実現できます。
テキスト、最初のフレーム画像、複数のリファレンス画像を、1つのモデルファミリーで利用する動画アプリを構築できます。ユーザーは、各ワークフローのアイデア出し、アニメーション、ブランドガイド付き制作に最適な開始素材を選択できます。
対応入力、クリップ長、解像度、参照容量、表示ベース価格の観点から、HappyHorse 1.1の生成モードと主要なAtlas Cloud動画モデルを比較します。
| モデル | 対応入力 | 出力時間 | 解像度 | 最大参照画像数 | 表示ベース価格 |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | テキストプロンプト | 3〜15秒 | 480P、720P、1080P | - | $0.07、単位記載なし |
| HappyHorse-1.1 Image-to-video | 最初のフレーム画像と任意のプロンプト | 3〜15秒 | 480P、720P、1080P | - | $0.07、単位記載なし |
| HappyHorse-1.1 Reference-to-video | テキストプロンプトと参照画像 | 3〜15秒 | 480P、720P、1080P | 9 | $0.07、単位記載なし |
| Wan-3.0 Reference-to-video | テキスト、画像、動画、音声、ドキュメント、またはWebページの参照 | 2〜30秒またはスマート尺 | 480P、720P、1080P | 10 | $0.05、単位記載なし |
| Seedance 2.5 Reference-to-Video | テキスト、画像、動画、音声の参照 | 最大30秒 | - | 30 | $0.167、単位記載なし |
| MiniMax H3 Reference-to-Video | テキスト、画像、動画、音声の参照 | 4〜15秒 | デフォルト768p、最大2K | 9 | $0.038/秒 |
数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。
atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。
高度なHappyhorse 1.1モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。
低レイテンシ:
リアルタイム推論のためのGPU最適化推論。
統合API:
1つの統合でHappyhorse 1.1、GPT、Gemini、DeepSeekを実行。
透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。
開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。
信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。
セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。
HappyHorse 1.1は、Atlas Cloudで利用できるAlibabaの動画生成モデルです。テキスト、最初のフレーム、または参照画像から短い動画クリップを生成できます。このファミリーには、text-to-video、image-to-video、reference-to-video用の個別エンドポイントが用意されています。
テキストプロンプトからシーンを生成したり、静止画像をアニメーション化したり、複数の視覚的な参照素材を使って新しいクリップの内容を指定したりできます。プロンプトのみで生成する動画、最初のフレームからのアニメーション、参照画像に基づくコンテンツに対応しています。
Atlas Cloud APIキーを作成し、選択したモデルIDと必須入力を指定して、認証済みのPOSTリクエストを /api/v1/model/generateVideo に送信します。レスポンスにはタスクIDが含まれており、出力の準備が整うまで予測ステータスを確認できます。
プロンプトベースの生成には alibaba/happyhorse-1.1/text-to-video、最初のフレームのアニメーション化には alibaba/happyhorse-1.1/image-to-video、複数画像によるガイダンスには alibaba/happyhorse-1.1/reference-to-video を選択します。各モードには独自の入力スキーマがあります。
text-to-videoとreference-to-videoでは、480p、720p、1080pのいずれか、3秒から15秒までの長さ、対応する9種類のアスペクト比から選択できます。image-to-videoも同じ解像度と長さの範囲に対応し、アップロードした画像を最初のフレームとして使用します。
reference-to-videoでは、1~9個の画像URLと、画像をどのように結果に反映させるかを説明するプロンプトを指定します。JPEG、JPG、PNG、WEBPファイルに対応しており、1画像あたりの上限は20 MB、短辺の最小サイズは400ピクセルです。
Atlas Cloudでは、HappyHorse 1.1の3つのエンドポイントすべてに対して、標準料金として1秒あたり$0.07と案内しています。従量課金制のため、生成料金は指定したクリップの長さに応じて変動します。
生成のランダム性を制御したい場合は、text-to-videoまたはreference-to-videoでseedパラメータを使用します。Atlas Cloudでは、明示的な整数値、またはランダムシードを使用する場合の-1を指定できます。
各リクエストで生成できるクリップの長さは3~15秒です。image-to-videoでは最初のフレーム画像を1枚使用し、reference-to-videoでは参照画像を9枚まで指定できます。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。