


HappyHorse 1.1 是阿里巴巴面向开发者的视频生成模型系列,支持从文本、源帧或视觉参考生成视频。它可以将提示词转化为视频片段,基于可选引导对指定首帧进行动画处理,还支持使用 1 至 9 张参考图像进行精准的视觉控制。Atlas Cloud 将这些工作流整合到一次接入中,并提供透明的按量付费定价。立即开始构建。
Happyhorse 1.1 由 Alibaba 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。
Atlas Cloud 为您提供最新的行业领先创意模型。
根据你希望采用的引导方式,在文本、图像和参考输入之间进行选择。
| 模态 | 描述 |
|---|---|
| HappyHorse 1.1 T2V API(文本转视频) | 将文本提示词转换为视频,支持 480P、720P 或 1080P,以及灵活的宽高比和 3 到 15 秒的时长。无需源图像即可使用此端点进行概念可视化、社交媒体内容创作和视频制作。 |
| HappyHorse 1.1 I2V API(图像转视频) | 以首帧图像为基础,此端点可生成 3 到 15 秒的视频,并支持可选的提示词引导以及 480P、720P 或 1080P 输出。适用于基于现有构图制作的产品动画、角色动作和视觉叙事。 |
| HappyHorse 1.1 R2V API(参考图像转视频) | 结合一到九张参考图像和文本提示词引导视频生成,支持选择 480P、720P 或 1080P 输出、灵活的宽高比以及 3 到 15 秒的时长。适用于参考图像主导的场景、以角色为重点的片段,以及需要更强视觉指导的项目。 |
HappyHorse 1.1 可将提示词、首帧图像或最多九张参考图像转换为时长 3 至 15 秒的视频,支持 480P、720P 和 1080P 输出,为文本和参考图模式提供九种画面比例,并支持种子控制和通过 Atlas Cloud 按量付费使用。
输入最多 2,500 个字符的文本提示词,无需图像即可生成完整视频片段。HappyHorse 1.1 支持 480P、720P 或 1080P 输出,并可将时长设置为 3 至 15 秒。你可以从九种画面比例中选择,适用于宽屏、竖屏、方形、肖像或超宽屏内容。这一工作流适合概念可视化、广告和短篇叙事场景。
将一张首帧图像转换为动态视频,并可选用提示词来引导动作、风格或场景细节。图生视频端点支持 JPEG、JPG、PNG 或 WEBP 文件,文件大小不超过 20 MB,且图像的两个尺寸均至少为 300 像素。你可以选择 480P、720P 或 1080P,以及 3 至 15 秒的视频时长。它适用于产品展示、肖像和分镜关键帧。
通过一至九张参考图像和必填的文本提示词,引导生成全新视频。每张 JPEG、JPG、PNG 或 WEBP 参考图的大小均可达 20 MB,且短边必须至少为 400 像素。你可以设置输出的分辨率、时长、画面比例和种子。这一模式为角色、产品和艺术指导工作流提供更多素材支持。
使用九种画面比例为文本或参考图驱动的生成任务匹配目标平台:16:9、9:16、1:1、4:3、3:4、4:5、5:4、9:21 和 21:9。分辨率支持 480P、720P 和 1080P,时长范围为 3 至 15 秒。组合使用这些控制项,即可生成适用于移动端信息流、网页播放器、方形版位、肖像或超宽屏构图的视频片段,无需更换端点。
当你需要更精细地控制生成输入时,可将种子参数与提示词、分辨率、画面比例和时长设置结合使用。HappyHorse 1.1 接受 -1 至 2,147,483,647 范围内的种子值,其中 -1 表示请求随机种子。迭代测试时,请明确指定其他设置。这种参数化工作流有助于开发者组织创意测试,并在保持请求结构一致的情况下比较不同变体。
通过 Atlas Cloud,使用一个兼容 OpenAI 的密钥和按量付费模式访问全部三种 HappyHorse 1.1 工作流。标准价格从每秒 $0.07 起,费用根据使用量计算,无需订阅。你可以在文生视频、图生视频和参考图生视频模型路径之间切换,同时保持相同的集成模式。这种配置适合构建多模式视频产品、无需分别管理不同服务商账号的开发者。
看看 HappyHorse 1.1 与另外两款同类视频模型,如何诠释相同提示词中的电影化动作与风格化奇幻叙事。
一段 8–10 秒、连续且逼真的动感美食电影片段:场景位于一节在猛烈高山暴风雪中疾驰的餐车内。一名技艺娴熟的列车厨师随着车厢剧烈的左右摇摆自然晃动,同时准备早餐:他单手将一张薄薄的金黄色可丽饼高高抛起,沿狭窄过道滑步追上滚动的橙子并用空闲的手接住,随后用锅沿击打正在下落的可丽饼,使其沿着干净且符合物理规律的弧线,穿过敞开的车厢连接门飞出。开场为极近距离横向跟拍镜头,贴着轰鸣的炉火、滋滋作响的面糊,以及飞溅在抛光钢面上的热黄油液滴;镜头快速绕厨师半圈,他在每一次颠簸中调整重心保持平衡,外套与围裙做出逼真的动态反应;随后镜头冲过门口,以精准的跟拍锁定空中的可丽饼,看着它穿过不断弯曲的连接通道进入下一节车厢,险险掠过一名服务员,最终完美落在一位惊讶乘客的早餐盘中。就在落盘的精准瞬间,车外窗边一场巨大的雪崩呼啸而过,列车从中逃脱,形成强烈的视觉高潮。温暖的钨丝灯与橙色火光,与透过被雪痕划过的车窗洒入的冰蓝色黎明交汇;画面由橙金色食物色调、银灰色金属与冰冷蓝色的荒野构成;深邃狭窄的中央透视,层层重复的门框,强烈的视差,细微的手持震动,清晰的运动细节;两节车厢之间保持无缝的主体连续性与空间连贯性,并真实呈现平衡、液体飞溅、织物惯性、碰撞与抛射物理效果。同步声音设计:铁轨撞击声与车厢呻吟声建立节奏,锅中嘶嘶声与黄油爆裂声令节奏加速,橙子伴随金属碰撞声同步滚动,锅击中可丽饼时落下一记明亮的打击节拍,随后是柔和的餐盘拍击声与震耳欲聋的雪崩轰鸣;不要慢动作,不要静态填充镜头,不要屏幕、界面、仪表盘、进度条、图表、说明文字、字幕、标志或任何可见文字。高端电影级写实风格,动感美食广告,沉浸式一镜到底幻觉,16:9 宽高比。
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
一段高饱和度、图形化 3D 动画风格的 9 秒动作片段,场景位于黄昏时分的集装箱码头:一架珊瑚红色三角钢琴挣脱束缚,沿钢制装卸坡道疾冲而下,小型脚轮在可信的重量感下不断 rattling and bouncing;一名身穿钴蓝色工装的叉车司机紧追其后,在芥末黄色起重机与不断升降的集装箱之间穿梭,而这些集装箱短暂地组成一条不断变化的紧急通道。开场为极低机位跟拍镜头,距离旋转的脚轮与剧烈颠簸的钢琴支腿仅几英寸,火花与金属撞击声和声音完美同步;镜头快速升至俯视角度,展现由珊瑚红、钴蓝色与芥末黄色色块构成的几何迷宫般追逐路线;随后快速甩镜并绕行至高速叉车前方,展现它逐渐追上钢琴。到达码头边缘时,司机将货叉猛地插入钢琴下方,在最后一刻抬起沉重的琴身,强力旋转一圈,并伴随低沉且同步的金属 clang 将钢琴稳稳放下。琴盖因惯性突然弹开;最后一个节拍中,一只海鸥落在琴键上,敲出清脆的最后一个音符。全程保持高密度运动,真实可信的动量、碰撞、悬挂回弹与负载变化,以及稳定的角色和物体身份连续性;硬朗阴影、大胆的几何构图、风格化电影级 3D 动画、锐利的黄昏轮廓光,以及由车轮喧响、液压嘶鸣、集装箱撞击、发动机负荷声、海鸥振翅声和最后的钢琴音符构成的节奏感工业打击乐。不要慢动作,不要空镜,不要破坏空间连续性的剪辑,不要屏幕、软件界面、仪表盘、进度条、图表、说明文字、标签、标志、水印或解释性文字。16:9 宽高比。
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
从营销活动构思、产品动画,到参考图引导的品牌视频和开发者工具,HappyHorse 1.1 可将提示词和图像转化为灵活多变的短视频内容。
将文字构思转化为 480P、720P 或 1080P 视频,并支持灵活的画面比例。创意团队无需源素材或实地拍摄,即可制作营销活动概念、社交媒体帖子和故事提案。
以首帧图像作为起点,再通过可选提示词引导动画效果,生成时长为 3 至 15 秒的视频。产品营销人员可以将静态素材转化为发布预热视频、展示视频或目录动效。
使用 1 至 9 张参考图,模型可围绕提供的视觉输入生成最高 1080P 的视频。品牌团队可以根据获批的角色、产品或环境图像,开发不同的营销活动版本。
选择灵活的画面比例和三档分辨率,通过单一生成工作流为不同投放位置准备视频片段。开发者可以在内容产品和营销活动中提供竖屏、横屏及其他布局的视频。
需要快速呈现一个分镜节拍,还是更完整的产品展示片段?3 至 15 秒的时长选择,让创意工具能够在单一界面中支持快速构思、推广视频和简洁的视觉序列。
通过同一模型系列,围绕文本、首帧图像和多参考图输入构建视频应用。针对每种工作流,用户可以选择最适合创意构思、动画制作或品牌引导创作的起始素材。
从支持的输入、片段时长、分辨率、参考内容容量和列示基础价格等方面,对比 HappyHorse 1.1 的生成模式与 Atlas Cloud 领先的视频模型。
| 模型 | 支持的输入 | 输出时长 | 分辨率 | 最多参考图像数 | 列示基础价格 |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | 文本提示词 | 3 至 15 秒 | 480P、720P、1080P | - | $0.07,未列明单位 |
| HappyHorse-1.1 Image-to-video | 首帧图像和可选提示词 | 3 至 15 秒 | 480P、720P、1080P | - | $0.07,未列明单位 |
| HappyHorse-1.1 Reference-to-video | 文本提示词和参考图像 | 3 至 15 秒 | 480P、720P、1080P | 9 | $0.07,未列明单位 |
| Wan-3.0 Reference-to-video | 文本、图像、视频、音频、文档或网页参考内容 | 2 至 30 秒或智能时长 | 480P、720P、1080P | 10 | $0.05,未列明单位 |
| Seedance 2.5 Reference-to-Video | 文本、图像、视频和音频参考内容 | 最长 30 秒 | - | 30 | $0.167,未列明单位 |
| MiniMax H3 Reference-to-Video | 文本、图像、视频和音频参考内容 | 4 至 15 秒 | 默认 768p,最高 2K | 9 | $0.038/秒 |
几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。
在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。
将先进的 Happyhorse 1.1 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。
低延迟:
GPU 优化推理,实现实时响应。
统一 API:
一次集成,畅用 Happyhorse 1.1、GPT、Gemini 和 DeepSeek。
透明定价:
按 Token 计费,支持 Serverless 模式。
开发者体验:
SDK、数据分析、微调工具和模板一应俱全。
可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。
安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。
HappyHorse 1.1 是阿里巴巴的视频生成模型,可在 Atlas Cloud 上将文本、首帧或参考图像转换为短视频片段。该模型系列提供独立的文生视频、图生视频和参考图生视频 endpoint。
你可以根据文本提示词生成场景、让静态图像动起来,或通过多张视觉参考图引导生成新的视频片段。这些工作流涵盖纯提示词视频、首帧动画和参考图引导内容。
创建 Atlas Cloud API key,并向 /api/v1/model/generateVideo 发送经过身份验证的 POST 请求,同时提供所选模型 ID 和必需的输入参数。响应中会包含 task ID,你可以使用它持续查询预测状态,直到输出就绪。
选择 alibaba/happyhorse-1.1/text-to-video 进行基于提示词的生成,选择 alibaba/happyhorse-1.1/image-to-video 生成首帧动画,或选择 alibaba/happyhorse-1.1/reference-to-video 使用多图引导。每种模式都有各自的输入 schema。
对于文生视频和参考图生视频,你可以选择 480p、720p 或 1080p,设置 3 到 15 秒的视频时长,并从九种受支持的宽高比中选择一种。图生视频支持相同的分辨率和时长范围,并使用上传的图像作为首帧。
参考图生视频支持传入 1 到 9 个图像 URL,以及描述这些图像应如何引导生成结果的提示词。支持 JPEG、JPG、PNG 和 WEBP 文件,每张图像大小上限为 20 MB,较短边至少为 400 像素。
Atlas Cloud 对三个 HappyHorse 1.1 endpoint 均列出 $0.07/秒的标准价格。计费方式为按用量付费,因此生成费用会随请求的视频时长增加而增加。
如果需要控制生成的随机性,可以在文生视频或参考图生视频中使用 seed 参数。Atlas Cloud 接受明确的整数值;如果希望使用随机 seed,也可以传入 -1。
每次请求生成的视频片段时长为 3 到 15 秒。图生视频使用一张首帧图像,而参考图生视频最多接受 9 张参考图像。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。