Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 是阿里巴巴面向开发者的视频生成模型系列,支持从文本、源帧或视觉参考生成视频。它可以将提示词转化为视频片段,基于可选引导对指定首帧进行动画处理,还支持使用 1 至 9 张参考图像进行精准的视觉控制。Atlas Cloud 将这些工作流整合到一次接入中,并提供透明的按量付费定价。立即开始构建。

Happyhorse 1.1 由 Alibaba 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。

探索领先模型

Atlas Cloud 为您提供最新的行业领先创意模型。

比较 HappyHorse 1.1 视频生成模式

根据你希望采用的引导方式,在文本、图像和参考输入之间进行选择。

模态描述
HappyHorse 1.1 T2V API(文本转视频)将文本提示词转换为视频,支持 480P、720P 或 1080P,以及灵活的宽高比和 3 到 15 秒的时长。无需源图像即可使用此端点进行概念可视化、社交媒体内容创作和视频制作。
HappyHorse 1.1 I2V API(图像转视频)以首帧图像为基础,此端点可生成 3 到 15 秒的视频,并支持可选的提示词引导以及 480P、720P 或 1080P 输出。适用于基于现有构图制作的产品动画、角色动作和视觉叙事。
HappyHorse 1.1 R2V API(参考图像转视频)结合一到九张参考图像和文本提示词引导视频生成,支持选择 480P、720P 或 1080P 输出、灵活的宽高比以及 3 到 15 秒的时长。适用于参考图像主导的场景、以角色为重点的片段,以及需要更强视觉指导的项目。

三种输入,一套 HappyHorse 1.1 工具包

HappyHorse 1.1 可将提示词、首帧图像或最多九张参考图像转换为时长 3 至 15 秒的视频,支持 480P、720P 和 1080P 输出,为文本和参考图模式提供九种画面比例,并支持种子控制和通过 Atlas Cloud 按量付费使用。

HappyHorse 1.1 文生视频

输入最多 2,500 个字符的文本提示词,无需图像即可生成完整视频片段。HappyHorse 1.1 支持 480P、720P 或 1080P 输出,并可将时长设置为 3 至 15 秒。你可以从九种画面比例中选择,适用于宽屏、竖屏、方形、肖像或超宽屏内容。这一工作流适合概念可视化、广告和短篇叙事场景。

首帧动画

将一张首帧图像转换为动态视频,并可选用提示词来引导动作、风格或场景细节。图生视频端点支持 JPEG、JPG、PNG 或 WEBP 文件,文件大小不超过 20 MB,且图像的两个尺寸均至少为 300 像素。你可以选择 480P、720P 或 1080P,以及 3 至 15 秒的视频时长。它适用于产品展示、肖像和分镜关键帧。

HappyHorse 1.1 参考图控制

通过一至九张参考图像和必填的文本提示词,引导生成全新视频。每张 JPEG、JPG、PNG 或 WEBP 参考图的大小均可达 20 MB,且短边必须至少为 400 像素。你可以设置输出的分辨率、时长、画面比例和种子。这一模式为角色、产品和艺术指导工作流提供更多素材支持。

适用于各种目的地的格式

使用九种画面比例为文本或参考图驱动的生成任务匹配目标平台:16:9、9:16、1:1、4:3、3:4、4:5、5:4、9:21 和 21:9。分辨率支持 480P、720P 和 1080P,时长范围为 3 至 15 秒。组合使用这些控制项,即可生成适用于移动端信息流、网页播放器、方形版位、肖像或超宽屏构图的视频片段,无需更换端点。

HappyHorse 1.1 种子控制

当你需要更精细地控制生成输入时,可将种子参数与提示词、分辨率、画面比例和时长设置结合使用。HappyHorse 1.1 接受 -1 至 2,147,483,647 范围内的种子值,其中 -1 表示请求随机种子。迭代测试时,请明确指定其他设置。这种参数化工作流有助于开发者组织创意测试,并在保持请求结构一致的情况下比较不同变体。

一个密钥,三种工作流

通过 Atlas Cloud,使用一个兼容 OpenAI 的密钥和按量付费模式访问全部三种 HappyHorse 1.1 工作流。标准价格从每秒 $0.07 起,费用根据使用量计算,无需订阅。你可以在文生视频、图生视频和参考图生视频模型路径之间切换,同时保持相同的集成模式。这种配置适合构建多模式视频产品、无需分别管理不同服务商账号的开发者。

HappyHorse 1.1 三模型提示词对决

看看 HappyHorse 1.1 与另外两款同类视频模型,如何诠释相同提示词中的电影化动作与风格化奇幻叙事。

提示词

一段 8–10 秒、连续且逼真的动感美食电影片段:场景位于一节在猛烈高山暴风雪中疾驰的餐车内。一名技艺娴熟的列车厨师随着车厢剧烈的左右摇摆自然晃动,同时准备早餐:他单手将一张薄薄的金黄色可丽饼高高抛起,沿狭窄过道滑步追上滚动的橙子并用空闲的手接住,随后用锅沿击打正在下落的可丽饼,使其沿着干净且符合物理规律的弧线,穿过敞开的车厢连接门飞出。开场为极近距离横向跟拍镜头,贴着轰鸣的炉火、滋滋作响的面糊,以及飞溅在抛光钢面上的热黄油液滴;镜头快速绕厨师半圈,他在每一次颠簸中调整重心保持平衡,外套与围裙做出逼真的动态反应;随后镜头冲过门口,以精准的跟拍锁定空中的可丽饼,看着它穿过不断弯曲的连接通道进入下一节车厢,险险掠过一名服务员,最终完美落在一位惊讶乘客的早餐盘中。就在落盘的精准瞬间,车外窗边一场巨大的雪崩呼啸而过,列车从中逃脱,形成强烈的视觉高潮。温暖的钨丝灯与橙色火光,与透过被雪痕划过的车窗洒入的冰蓝色黎明交汇;画面由橙金色食物色调、银灰色金属与冰冷蓝色的荒野构成;深邃狭窄的中央透视,层层重复的门框,强烈的视差,细微的手持震动,清晰的运动细节;两节车厢之间保持无缝的主体连续性与空间连贯性,并真实呈现平衡、液体飞溅、织物惯性、碰撞与抛射物理效果。同步声音设计:铁轨撞击声与车厢呻吟声建立节奏,锅中嘶嘶声与黄油爆裂声令节奏加速,橙子伴随金属碰撞声同步滚动,锅击中可丽饼时落下一记明亮的打击节拍,随后是柔和的餐盘拍击声与震耳欲聋的雪崩轰鸣;不要慢动作,不要静态填充镜头,不要屏幕、界面、仪表盘、进度条、图表、说明文字、字幕、标志或任何可见文字。高端电影级写实风格,动感美食广告,沉浸式一镜到底幻觉,16:9 宽高比。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

提示词

一段高饱和度、图形化 3D 动画风格的 9 秒动作片段,场景位于黄昏时分的集装箱码头:一架珊瑚红色三角钢琴挣脱束缚,沿钢制装卸坡道疾冲而下,小型脚轮在可信的重量感下不断 rattling and bouncing;一名身穿钴蓝色工装的叉车司机紧追其后,在芥末黄色起重机与不断升降的集装箱之间穿梭,而这些集装箱短暂地组成一条不断变化的紧急通道。开场为极低机位跟拍镜头,距离旋转的脚轮与剧烈颠簸的钢琴支腿仅几英寸,火花与金属撞击声和声音完美同步;镜头快速升至俯视角度,展现由珊瑚红、钴蓝色与芥末黄色色块构成的几何迷宫般追逐路线;随后快速甩镜并绕行至高速叉车前方,展现它逐渐追上钢琴。到达码头边缘时,司机将货叉猛地插入钢琴下方,在最后一刻抬起沉重的琴身,强力旋转一圈,并伴随低沉且同步的金属 clang 将钢琴稳稳放下。琴盖因惯性突然弹开;最后一个节拍中,一只海鸥落在琴键上,敲出清脆的最后一个音符。全程保持高密度运动,真实可信的动量、碰撞、悬挂回弹与负载变化,以及稳定的角色和物体身份连续性;硬朗阴影、大胆的几何构图、风格化电影级 3D 动画、锐利的黄昏轮廓光,以及由车轮喧响、液压嘶鸣、集装箱撞击、发动机负荷声、海鸥振翅声和最后的钢琴音符构成的节奏感工业打击乐。不要慢动作,不要空镜,不要破坏空间连续性的剪辑,不要屏幕、软件界面、仪表盘、进度条、图表、说明文字、标签、标志、水印或解释性文字。16:9 宽高比。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 覆盖创意工作流

从营销活动构思、产品动画,到参考图引导的品牌视频和开发者工具,HappyHorse 1.1 可将提示词和图像转化为灵活多变的短视频内容。

HappyHorse 1.1 营销活动构思

将文字构思转化为 480P、720P 或 1080P 视频,并支持灵活的画面比例。创意团队无需源素材或实地拍摄,即可制作营销活动概念、社交媒体帖子和故事提案。

让静态图像动起来

以首帧图像作为起点,再通过可选提示词引导动画效果,生成时长为 3 至 15 秒的视频。产品营销人员可以将静态素材转化为发布预热视频、展示视频或目录动效。

参考图引导的品牌变体

使用 1 至 9 张参考图,模型可围绕提供的视觉输入生成最高 1080P 的视频。品牌团队可以根据获批的角色、产品或环境图像,开发不同的营销活动版本。

多格式内容流水线

选择灵活的画面比例和三档分辨率,通过单一生成工作流为不同投放位置准备视频片段。开发者可以在内容产品和营销活动中提供竖屏、横屏及其他布局的视频。

HappyHorse 1.1 视频片段规划

需要快速呈现一个分镜节拍,还是更完整的产品展示片段?3 至 15 秒的时长选择,让创意工具能够在单一界面中支持快速构思、推广视频和简洁的视觉序列。

灵活的视频应用输入

通过同一模型系列,围绕文本、首帧图像和多参考图输入构建视频应用。针对每种工作流,用户可以选择最适合创意构思、动画制作或品牌引导创作的起始素材。

HappyHorse 1.1 视频生成能力对比

从支持的输入、片段时长、分辨率、参考内容容量和列示基础价格等方面,对比 HappyHorse 1.1 的生成模式与 Atlas Cloud 领先的视频模型。

模型支持的输入输出时长分辨率最多参考图像数列示基础价格
HappyHorse-1.1 Text-to-video文本提示词3 至 15 秒480P、720P、1080P-$0.07,未列明单位
HappyHorse-1.1 Image-to-video首帧图像和可选提示词3 至 15 秒480P、720P、1080P-$0.07,未列明单位
HappyHorse-1.1 Reference-to-video文本提示词和参考图像3 至 15 秒480P、720P、1080P9$0.07,未列明单位
Wan-3.0 Reference-to-video文本、图像、视频、音频、文档或网页参考内容2 至 30 秒或智能时长480P、720P、1080P10$0.05,未列明单位
Seedance 2.5 Reference-to-Video文本、图像、视频和音频参考内容最长 30 秒-30$0.167,未列明单位
MiniMax H3 Reference-to-Video文本、图像、视频和音频参考内容4 至 15 秒默认 768p,最高 2K9$0.038/秒

如何在 Atlas Cloud 上使用 Happyhorse 1.1

几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。

创建 Atlas Cloud 账户

在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。

为何在 Atlas Cloud 使用 Happyhorse 1.1

将先进的 Happyhorse 1.1 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。

性能与灵活性

低延迟:
GPU 优化推理,实现实时响应。

统一 API:
一次集成,畅用 Happyhorse 1.1、GPT、Gemini 和 DeepSeek。

透明定价:
按 Token 计费,支持 Serverless 模式。

企业与规模

开发者体验:
SDK、数据分析、微调工具和模板一应俱全。

可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。

安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。

使用 HappyHorse 1.1 构建:常见问题

HappyHorse 1.1 是阿里巴巴的视频生成模型,可在 Atlas Cloud 上将文本、首帧或参考图像转换为短视频片段。该模型系列提供独立的文生视频、图生视频和参考图生视频 endpoint。

你可以根据文本提示词生成场景、让静态图像动起来,或通过多张视觉参考图引导生成新的视频片段。这些工作流涵盖纯提示词视频、首帧动画和参考图引导内容。

创建 Atlas Cloud API key,并向 /api/v1/model/generateVideo 发送经过身份验证的 POST 请求,同时提供所选模型 ID 和必需的输入参数。响应中会包含 task ID,你可以使用它持续查询预测状态,直到输出就绪。

选择 alibaba/happyhorse-1.1/text-to-video 进行基于提示词的生成,选择 alibaba/happyhorse-1.1/image-to-video 生成首帧动画,或选择 alibaba/happyhorse-1.1/reference-to-video 使用多图引导。每种模式都有各自的输入 schema。

对于文生视频和参考图生视频,你可以选择 480p、720p 或 1080p,设置 3 到 15 秒的视频时长,并从九种受支持的宽高比中选择一种。图生视频支持相同的分辨率和时长范围,并使用上传的图像作为首帧。

参考图生视频支持传入 1 到 9 个图像 URL,以及描述这些图像应如何引导生成结果的提示词。支持 JPEG、JPG、PNG 和 WEBP 文件,每张图像大小上限为 20 MB,较短边至少为 400 像素。

Atlas Cloud 对三个 HappyHorse 1.1 endpoint 均列出 $0.07/秒的标准价格。计费方式为按用量付费,因此生成费用会随请求的视频时长增加而增加。

如果需要控制生成的随机性,可以在文生视频或参考图生视频中使用 seed 参数。Atlas Cloud 接受明确的整数值;如果希望使用随机 seed,也可以传入 -1。

每次请求生成的视频片段时长为 3 到 15 秒。图生视频使用一张首帧图像,而参考图生视频最多接受 9 张参考图像。

探索更多系列

Seedance 2.5

Seedance 2.5 API 现已在 Atlas Cloud 上线!它为开发者提供了 ByteDance 最新的视频模型。该模型可通过文本、单张图像或多达 50 个多模态参考,一次性生成长达 30 秒的原生视频,并包含同步音频和画面内的多语言文本。在 Atlas Cloud 上,您可以通过单个密钥访问它,其主体一致性和改进的物理特性能够保持长镜头的连贯性。

查看系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 视频系列的下一代产品,旨在将长视频生成、多参考控制和音视频质量推向新的高度。Atlas Cloud 已经托管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 使用相同的统一密钥运行,无需额外设置。立即开始构建吧。向下滚动至展示区,查看 Wan 3.0 的创作能力。

查看系列

MiniMax H3

MiniMax H3 是 MiniMax 的多模态视频系列,支持文本、图像和参考内容引导创作。在支持的路由中,它能够保留参考媒体中的主体,提供灵活的宽高比,并通过 H3 Developer 将生成的声音与画面结合;输出配置则由 endpoint 选择。Atlas Cloud 通过一个 OpenAI 兼容密钥统一接入整个系列,并提供透明的按量付费定价,标准费率为每秒 $0.038。立即开始构建。

查看系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 为开发者在 Atlas Cloud 上提供了字节跳动的可控图像编辑模型。它通过锚点和坐标精确定位编辑,将图像分离为可编辑图层,融合多个参考,并精准匹配颜色和材质,支持 2K 和 3K 分辨率的多语言文本。在 Atlas Cloud 上,您只需一个密钥即可访问!

查看系列

Seedance 2.0

Seedance 2.0 是 ByteDance 面向生产环境的视频模型,专用于精准镜头创作。将提示词转换为视频,使用首帧图像生成动画并可选用尾帧引导,或结合参考媒体和可选的联网搜索来塑造结果。Atlas Cloud 将这些工作流整合到统一的 API 中,提供透明的按量付费定价和一个兼容 OpenAI 的密钥。立即开始构建。

查看系列

GPT Image 2.5

OpenAI 的 gpt-image-2.5 系列为开发者提供 Flare 和 Sunburst 两种选择,满足生产级图像工作流需求。支持最高 3840x2160 的任意分辨率渲染,并提供包括 xhigh 和 max 在内的五档质量等级,以匹配特定的输出要求。Atlas Cloud 提供开箱即用的 REST 推理服务,无冷启动,每次生成起价 $0.004,采用标准定价。立即开始构建。

查看系列

GPT Image 2

GPT Image 2 API 为开发者提供了访问 OpenAI 最新图像模型的途径,它是 GPT Image 1.5 的继任者。该模型可生成和编辑图像,能够在拉丁和 CJK 文字上实现准确的文本渲染,并在海报、样机和信息图表方面具备强大的排版能力。在 Atlas Cloud 上,您可以通过一个统一的 API 与 300 多个模型一起访问它,并享受免费额度、99.99% 的正常运行时间,且无需 OpenAI 组织验证。

查看系列

Gemini Omni Flash

Gemini Omni 是 Google DeepMind 原生多模态视频系列,支持通过提示词引导创作与编辑。可从文本生成视频、让静态图像动起来,或在可选视觉参考的辅助下修改现有素材,同时保留未改动的内容。灵活的分辨率、宽高比和时长控制,满足多样化的制作流程。Atlas Cloud 通过透明的按需付费定价模式,统一提供访问能力。立即开始构建。

查看系列

Grok Imagine

Grok Imagine API 涵盖 xAI 的图像、视频和语音模型,包括 Image 2.0、Video 1.5 和 xAI TTS v1。支持生成跨 14 种宽高比的 1K 或 2K 静帧、生成最长 15 秒的 1080p 视频、通过最多 7 张参考图像引导镜头、或用 20 种语言进行配音。Atlas Cloud 在单一端点上运行所有功能,采用按量计费,起价为每张图像 $0.02、每秒 $0.05。立即开始使用。

查看系列

Google

Google最强大的创意模型现已在Atlas Cloud上全面可用。Veo 3.1提供电影级别的视频生成,Nano Banana 2支持高保真图像创建,而Gemini为每个工作流带来多模态智能。通过单一API key即可访问完整的Google模型套件,提供Day-0可用性和按需付费(pay-as-you-go)定价。

查看系列

Seedance 2.0 Mini

Seedance 2.0 Mini 将 ByteDance 的多模态视频生成技术引入到对速度和成本要求极高的工作流中。它以更轻量的占用空间提供 Seedance 2.0 的核心能力——更快的生成速度、更低的单条视频成本,并且使用您现有的同款 API 集成。对于运行高吞吐量流水线或进行大规模原型设计的团队来说,Mini 是最实用的默认选择。

查看系列

ByteDance

从电影级视频生成到高保真图像创建,ByteDance 最强大的模型现已在 Atlas Cloud 上线。以最低的推理定价和零基础设施开销,大规模运行 Seedance 和 Seedream。

查看系列

一个 API,畅享全模态 AI。

探索全部模型