




Youchuan API 现已覆盖 V8.1 和 V8.2 两代能力,涵盖静态图像与动态视频。由提示词驱动的模式一次返回四个变体,图像以原生 2K HD 渲染,无需上采样处理;混合模式最多可融合五个参考;单张静态图像可生成 480p 或 720p 的五秒视频片段。Atlas Cloud 通过一个兼容 OpenAI 的密钥提供服务,支持 Day-0 访问,按次调用计费低至 $0.086。立即开始构建。
Atlas Cloud 为您提供最新的行业领先创意模型。
在一个视图中并排比较 Youchuan API 产品线中的所有模态,涵盖 V8.1 和 V8.2 端点、输出数量、分辨率以及标准单次调用价格。
| 模态 | 说明 |
|---|---|
| Youchuan T2I API(Text to Image) | 输入文本提示词,即可返回四张成图;每次运行都可选择原生 2K HD、风格参考,并支持 aspect-ratio、stylize、chaos 和 weird 控制。V8.1 和 V8.2 端点的价格均为每次调用 $0.086,适合概念艺术、营销活动视觉和快速情绪板。 |
| Youchuan I2I API(Image to Image) | 已经有一张值得继续创作的画面?该端点会在文本提示词的引导下重新演绎输入图像,并返回四个变体,同时保留原生 2K HD、风格参考以及相同的 stylize、chaos 和 weird 控制。V8.1 和 V8.2 的价格均为每次调用 $0.086,因此迭代版式或测试不同艺术方向都很经济。 |
| Youchuan I2V API(Image to Video) | 一张静态图像可生成四段五秒视频,分辨率可选 480p 或 720p。每次运行提供四个版本,让你可以保留真正适合镜头的动态效果,适用于社交媒体循环视频、电影预演,以及为静态关键视觉添加运动。两个版本的价格均为每次调用 $0.086。 |
| Youchuan Blend API(Multi-Image Fusion) | 提供两到五张源图像,模型会将它们融合为四个原生 2K HD 的组合结果,并可使用可选提示词来引导混合方向。合成、氛围混搭,以及把分散的参考素材整合到同一画面中,都适合使用此端点;V8.1 和 V8.2 的价格同样为每次调用 $0.086。 |
| Youchuan Style Transfer API(Image Retexture) | Retexture 会在保持输入图像构图不变的同时重写其艺术风格,并返回四个重设风格的变体。两个版本的价格均为每次调用 $0.129,适合品牌焕新、艺术方向测试,以及为一组风格混杂的照片统一视觉风格。 |
| Youchuan Remove Background API(Background Removal) | 背景移除是该系列中最直接的调用,可将任意输入图像处理为单个结果,并以透明背景隔离主体。产品列表图、营销版式和合成流程都可以直接使用该输出;V8.1 和 V8.2 的价格均为每次调用 $0.086。 |
文本生成图像、图像生成图像、融合、重纹理、背景移除以及五秒动画,都可通过同一个 Youchuan API key 运行;现已覆盖 V8.1 与 V8.2 两个 checkpoint,支持原生 2K HD、九种宽高比,以及按调用计费的 stylize、chaos 和 weird 控制项。
每个最长 1024 字符的 prompt 都会在一次调用中返回四张渲染图,均保留该系列标志性的高饱和色彩与戏剧化构图。艺术总监可先比较多个强方向,再锁定最终画面。
stylize 范围为 0 到 1000,chaos 最高 100,weird 最高 3000,quality 可在 1 到 4 之间切换,并可锁定 seed 以保证可复现。品牌安全的输出与大胆实验,都来自同一个 endpoint。
开启 HD flag 后,Youchuan API 会以基础费率的 1.5 倍,在从 1:1 到 21:9 的九种宽高比下渲染原生 2K。无需插值,因此细腻纹理也能经受大幅面印刷。
Blend 可将两到五张源图像融合成四个连贯结果,支持原生 2K,并可选用 prompt 来引导色彩、光照和主体的组合方式。概念团队可以把分散的参考图整合成一张符合品牌调性的画面。
retexture 会锁定构图不变,将一张图像重塑为四个变体,只根据 prompt 调整色彩、纹理和氛围。每次调用 $0.129,一个已获批的版式即可适配多个 campaign 主题。
提供一张静态图和一段简短的 motion prompt,即可生成四段五秒视频,分辨率为 480p 或 720p,motion 可设为 low 或 high。静态 key art 可快速转化为社交媒体预告或镜头预览。
下面的每组对比都将同一个提示词分别提交给 Youchuan API 以及 Atlas Cloud 上另外两个图生视频模型,因此运动表现、场景连贯性和视觉风格的差异会直接体现在生成画面中,而不是停留在规格表上。
一名骑着 fixed-gear 的自行车快递员穿梭在雨后的香港夜市,霓虹招牌的光晕在湿漉漉的柏油路面上流淌。他擦碰到一个水果摊,橙子四散滚落、到处弹跳,摊主举起双手惊呼;快递员侧向打滑,单脚撑地,猛力蹬出,从两辆驶过的电车之间的狭窄空隙中冲过,身后铁轨溅起火花。开场是低机位跟拍镜头,追着后轮穿过积水;随后快速甩镜捕捉半空中翻滚的橙子;再切到无人机镜头,从夜市屋顶上方升起,俯拍自行车从另一端冲出,驶上空荡的道路。体积感霓虹光,每个水坑里都有镜面反射,浅景深,粗粝的电影级写实风格。环境音包括夜市人声、电车铃声,以及一段在逃脱时逐渐高涨的强劲合成器脉冲。16:9 aspect ratio。
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Kling v3.0 Pro on Atlas Cloud
Generated with seedance 2.0 Mini on Atlas Cloud
一名年轻的天空水手紧握一艘小型木制飞艇的索具,在金色时刻俯冲穿越由漂浮岛屿组成的峡谷。一群水晶翼鸟在船首前方惊散,其中一只突然折返,直接从她手中叼走黄铜罗盘。她沿着帆桁扑过去,抓住那只鸟的一根尾羽,两人一起从甲板上翻落;就在此时,她的滑翔翼猛然展开,她急转绕过一道倾泻入开放天空的瀑布。开场以环绕飞艇的宏大运镜展开,切到她沿帆桁扑下时的第一人称 POV,然后转为低机位仰拍,滑翔翼在阳光前展开。手绘赛璐璐阴影的绘画感 anime 风格,天空采用丰润的水彩质感。呼啸的风声、木结构的吱呀声,以及滑翔翼展开瞬间高昂铺陈的管弦乐。16:9 aspect ratio。
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Seedance 2.0 Mini on Atlas Cloud
Generated with Grok Imagine Video on Atlas Cloud
营销活动主视觉、产品抠图、预可视化帧、风格重塑素材,以及 5 秒社交媒体短片,都可以通过同一个 Youchuan API 生成;无论你是从零开始输入提示词,还是为已审批的静态图添加动画。
一个提示词即可返回四张渲染图,HD 标记会将其提升到原生 2K,而 stylize、chaos 和 aspect ratio 则用于把控整体氛围。营销团队进入评审时,可以带来多个方向,而不是只有一个方案。
当产品图需要适配任意背景时,Remove Background 会将主体分离到透明背景上,每次调用 $0.086。店铺页面和 marketplace feed 无需手动蒙版,也能获得一致的抠图效果。
向 Blend 输入二到五张参考图,模型会在可选提示词的引导下,将它们融合成四张风格统一的 2K 画面。美术团队可以在真正制作之前,先完整呈现一个世界。
Style Transfer 会在保持构图不变的同时,将已审批图片重绘为四个变体,每次调用 $0.129。这样,同一份素材就能呈现夏季风、节日风,以及介于两者之间的各种风格。
一个已经接近可用的版式,为什么要从头再来?Image-to-Image 可根据文本提示词和可选风格参考,将你的草稿转化为四个更精细的变体,让设计师在保留有效部分的同时探索更多方向。
任何静态图都可以生成四段 5 秒短片,分辨率为 480p 或 720p,运动幅度可设为低或高,并通过简短提示词描述镜头运动。社交团队可以持续产出更受动态内容青睐的信息流素材。
将 Youchuan API 与 Kling、Seedance、Veo 和 Grok Imagine 在支持的输入、分辨率、片段时长、音频和标价方面并排比较,然后选择最适合你所需镜头的端点。
| 模型 | 支持的输入 | 分辨率 | 片段时长 | 原生音频 | Atlas Cloud 标价 |
|---|---|---|---|---|---|
| Youchuan V8.2 Image-to-Video | 一张起始图像,可选附加运动提示,例如镜头移动 | 480p 或 720p,其中 720p 的费用为 480p 费率的 3x | 单次调用会返回四个 5 秒片段 | - | $0.086 |
| Youchuan V8.1 Image-to-Video | 与 V8.2 相同:起始图像搭配可选提示 | 480p 或 720p,高阶档位同样按 3x 比例计费 | 每次请求同样返回四个 5 秒版本 | - | $0.086 |
| Kling V3.0 Turbo Image-to-Video | 一个最大 10MB 的 JPG 或 PNG 起始帧,由正向提示引导 | 720p 或 1080p,默认 1080p | 3 到 15 秒不等 | - | $0.112 |
| Seedance 2.0 Fast Image-to-Video | 首帧、可选末帧,以及运动提示 | 480p 和 720p,并可提升到 720p-SR、1080p-SR 和 1440p-SR | 4 到 15 秒,或设为 -1 让模型自行选择 | √ | $0.09 |
| Veo3.1 Fast Image-to-video | 起始图像、可选结束帧、提示和负向提示 | 720p、1080p 或 4K 输出 | 4、6 或 8 秒,但 1080p 和 4K 要求 8 秒 | √ | $0.08 |
| Grok Imagine Video v1.5 Image-to-Video | 起始帧 HTTPS URL 或 data URI,并附自然语言提示 | 480p、720p 或 1080p | 1 到 15 秒,默认 8 秒 | - | $0.08 |
几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。
在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。
将先进的 Youchuan 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。
低延迟:
GPU 优化推理,实现实时响应。
统一 API:
一次集成,畅用 Youchuan、GPT、Gemini 和 DeepSeek。
透明定价:
按 Token 计费,支持 Serverless 模式。
开发者体验:
SDK、数据分析、微调工具和模板一应俱全。
可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。
安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。
Youchuan API 让开发者通过一个 Atlas Cloud key,以编程方式访问 Youchuan——Midjourney 的官方中国平台。它涵盖 V8.1 和 V8.2 两代模型,共六种生成模式,包括文生图、图生图、图生视频、多图融合、风格迁移和背景移除。计费方式为按次调用即用即付,因此在发起第一个请求前无需签订订阅。
该系列提供六种模式,每种模式都同时支持 V8.1 和 V8.2。文生图、图生图和 blend 每次运行返回四个候选结果;style transfer 会在保留输入构图的同时重新绘制图像;image-to-video 可将静态图像生成四段五秒视频;background removal 返回一张透明背景抠图。blend 单次调用可接受两到五张源图像。
V8.1 于 2026 年 4 月 30 日发布,是该产品线中速度最快的模型,比早期版本大约快四到五倍,并通过 hd 标志引入原生 2K 渲染。V8.2 于 2026 年 7 月 27 日推出,重点提升美学表现与图像质量:渲染效果更大胆、更精致,低质量异常结果出现的频率也大幅降低。两个版本都仍可调用,因此你可以固定使用 V8.1 以保持与现有作品的一致性,也可以切换到 V8.2 获得更新的视觉风格。
创建 Atlas Cloud 账号,生成一个 API key,然后发送请求,并指定所需模式和版本的 model ID,例如 youchuan/v8.2/text-to-image。价格透明,并按次调用收费;Day-0 access 意味着每个新版本一上线即可调用。现在就可以开始构建。
图像模式默认使用 1:1,并支持九种宽高比,从正方形到电影感的 21:9,再到竖向 9:21。将 hd 设置为 true 会生成原生 2K 输出,而不是执行放大处理,费用按基础费率的 1.5x 计费。在动态生成方面,image-to-video 会返回四段五秒视频,可选择 480p 或 720p,并可将 motion 设置为 low 或 high。
由 prompt 驱动的模式提供 Midjourney 用户熟悉的控制项:aspect_ratio、0 到 1000 的 stylize、最高 100 的 chaos、最高 3000 的 weird,以及取值为 1 或 4 的 quality。prompt 最多支持 1024 个字符;可选的 sref 图像 URL 可引导审美风格,但不会决定构图。style transfer 和 background removal 刻意保持更简单:前者接收一张输入图像和一个目标风格 prompt。
生成过程是异步的。调用会返回 request_id,轮询 prediction endpoint 可查看状态,状态值包括 created、processing、completed 或 failed;任务完成后,outputs 数组中会包含结果 URL。如果你更希望直接在响应中接收 payload,而不是获取托管文件,请将 enable_base64_output 设置为 true。
Youchuan API 上大多数模式的价格为每次调用 $0.086,涵盖 text-to-image、image-to-image、blend、background removal 和 image-to-video;style transfer 的价格为每次调用 $0.129。在这些费率之上还有两个倍率:hd 图像按基础费率的 1.5x 计费,720p 视频按 480p 费率的 3x 计费。所有内容都不捆绑到套餐中,因此你只需为实际发起的调用付费。
可以。将 seed 固定为某个特定整数,并使用相同的 prompt 和相同设置,即可精确复现该渲染结果;默认值 -1 则会让每次运行随机化。若要在一组营销素材中保持统一视觉风格,可传入一张 sref 参考图像,保持 stylize 值稳定,只改变 prompt。
输出形态是固定的:视频片段时长为五秒,blend 最多接收五张图像,prompt 最多 1024 个字符。style transfer 不提供 aspect ratio、hd 或 stylize 参数,因此分辨率和画面构图会跟随输入图像。由于任务采用排队和轮询机制,而不是流式返回,请在流水线中构建状态检查和重试逻辑,不要期待同步响应。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。