两个浏览器标签页,一条提示词,一张参考肖像,一个秒表。Flash 标签页在 27.9 秒内完成了一位火星夜市宇航员。Pro 标签页处理同一张 2816×1584 画面则需要 56.9 秒。这个差距用一个数字概括了 Seedream 5.0 Flash 对比 Pro 的全部问题,也解释了为什么字节跳动作为入门档位推出的模型值得认真对待,而不只是耸耸肩。
本指南通过真实运行将两者并排对比:生成时间、规格表、API、两者共用的图层分解端点,以及决定一批任务实际成本的计费规则。读完后你将了解哪些任务 Flash 可以直接胜任,哪些任务仍然值得使用 Pro 更慢、质量优先的流程。

关键要点
- Seedream 5.0 Flash 是 Pro 的兄弟型号,而不是改名的 Lite:同样最多 10 张参考图、同样的图层分解、同样的像素范围,仅支持标准提示词模式。
- 在我们的 Playground 运行中,一张 2816×1584 的 Flash 图像在 18 到 28 秒内完成,从纯文生图到单参考图编辑都是如此,并且每个预设都按相同的统一价格计费。
- 图层分解从单个照片级真实场景中返回一张基础图像加 7 个命名的 PNG 图层,每个图层都带有 z-index 和边界框。
- 当单图质量或其快速优化模式比吞吐量更重要时,继续使用 Pro。
- 承载 3K 和 4K 输出以及连续生成的是 Lite,而不是 Flash。
Seedream 5.0 Flash 有哪些变化
Seedream 5.0 Flash 于 2026 年 9 月下旬推出,没有发布公告。字节跳动以 ID doubao-seedream-5-0-flash-260915 和 dola-seedream-5-0-flash-260915 将其加入两个云平台,文档本身就已说明一切。BytePlus 关于该系列的教程用一句话描述 Flash:它“生成图像更快、成本更低,适合对延迟和成本敏感的场景”,而 Pro 则更适合追求更高图像质量的情况。
Flash 有趣之处在于它保留了多少 Pro 的能力。请求契约相同。两者都接受最多 10 张参考图,都提供带坐标和标记的精准编辑,并且都开放图层分解模式,可将成品图像拆分为基础层加最多 16 个 PNG 图层。像素范围也一致:总像素在 921,600 到 4,624,220 之间的任意尺寸,宽高比从 1:16 到 16:1。
被削减的部分很容易列出。Flash 仅在标准模式下运行提示词优化,因此这里没有 Pro 的快速模式。它不支持连续图像生成、流式输出或网络搜索。这些都不是质量开关。它们是工作流功能;如果你的流程在 Pro 上从未用到它们,那么 Flash 并没有去掉你会用到的任何东西。
字节跳动已经将 Flash 视为默认选项,而不是事后补充。一篇关于豆包应用新创意设计测试版的产品社区文章报道称,Flash 是其背后的图像模型,并且可在同一画布中一键拆分图层。各渠道的行为仍有所不同,因此我们在 Seedream 5.0 Pro 渠道指南 中提到的水印默认设置和审核关卡同样适用于 Flash。

Seedream 5.0 Flash 对比 Pro:规格表并排比较
Lite 在 2 月发布时被普遍认为是快速且低价的档位,因此 Flash 这个名字容易引起混淆。当把三个档位并排放在一起时,字节跳动的文档清楚地划出了界限。Flash 和 Pro 几乎共享一切。Lite 是例外。
| Seedream 5.0 Flash | Seedream 5.0 Pro | Seedream 5.0 Lite | |
|---|---|---|---|
| 输出预设 | 1.5K 和 2K 级别,在 Atlas Cloud 上最高 2816×1584 | 相同范围,外加 1024×1024 | 2K、3K 和 4K |
| 参考图像 | 最多 10 张 | 最多 10 张 | 最多 14 张 |
| 图层分解 | 是,基础层加最多 16 个图层 | 是 | 否 |
| 带坐标的精准编辑 | 是 | 是 | 否 |
| 提示词优化 | 仅标准 | 标准和快速 | 标准 |
| 连续生成、流式输出、网络搜索 | 否 | 否 | 是 |
参考图上限和功能划分来自字节跳动的 图像生成 API 参考,其中说明 Pro 和 Flash 最多接受 10 张参考图,而 Lite、4.5 和 4.0 接受 14 张。一些第三方列表把 14 这个数字照搬到了 Flash 上。官方文档并非如此。
关于尺寸有一条实用说明。Atlas Cloud 上的 Flash 预设选择器列出了 16 个预设,从 1536×1536 到 3136×1344,分为 2K、1.5K 级组,以及一个标记为 3K 但仍处于字节跳动 4,624,220 像素上限内的组。该列表中没有 1024×1024 预设。按像素数选择,而不是按标签。
在 Atlas Cloud 上运行 Seedream 5.0 Flash
本文顶部的头图来自 Atlas Cloud 上的 Flash Edit Playground,一次通过,仅用一条文本提示词加一张参考肖像,没有调整提示词,也没有重试。Flash 系列下有三个端点:文生图、最多 10 张参考图的编辑,以及图层分解。它们共用一个账户、一个密钥和一种请求形式,因此将任务从生成切换到图层提取只需更改模型字符串。
方法 1:在 Playground 中使用 Seedream 5.0 Flash
打开 Seedream 5.0 Flash 文生图 Playground 并登录。表单有四个控件:提示词框、尺寸选择器、在 jpeg 和 png 之间切换的输出格式开关,以及 Run 按钮,它会在你确认前显示每次运行的价格。
- 粘贴你的提示词。架构建议保持在 600 个英文单词以内,模型页面列出了除中文和英文之外的 14 种提示词语言,从阿拉伯语到越南语。
- 选择尺寸预设。默认是 2816×1584 的 16:9 预设,选择器会按像素级别对其余选项分组。
- 选择 jpeg 用于网络交付,或选择 png 用于设计交接,然后按 Run。
结果会出现在输出面板中,带有 Download 和 Share 控件;根据该标签页顶部的通知,Request History 标签页会将每次运行保留 14 天。我们的运行从点击到出现 Completed 标签耗时 18 到 22 秒。

方法 2:三步使用 Seedream 5.0 Flash API
第 1 步:获取你的 API 密钥。 在 Atlas Cloud 控制台中创建一个密钥,并将其保存在环境变量中,而不是放在客户端代码里。

第 2 步:查看 API 文档。 端点、参数和身份验证都在 API 文档 中。
第 3 步:发出你的第一个请求。 提交任务:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateImage \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedream-v5.0-flash/text-to-image", 6 "prompt": "Editorial sci-fi photograph: a young woman astronaut in a white and orange EVA suit at a neon-lit night market inside a Mars colony dome, helmet tucked under one arm, cinematic 35mm look", 7 "size": "2816*1584", 8 "output_format": "jpeg" 9 }'
响应会返回一个预测 ID。轮询它,直到状态显示为 completed:
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
完成的响应会包含托管的图像 URL。在发布前值得了解的一个细节:API 默认尺寸是 2048*2048,即 2K 档位,因此如果你想要 Playground 使用的宽幅预设,请显式传入 size。请求形式是长期收益所在。Atlas Cloud 在整个平台上运行同一套 API,因此相同的密钥、相同的请求头和相同的提交并轮询循环即可覆盖 Pro、编辑端点和图层分解。切换模型只意味着更改模型字符串,别无其他。
Seedream 5.0 Flash 有多快?相同提示词下与 Pro 的计时对比
Atlas Cloud 模型页面称,一张 2K Flash 图像“通常在 10–20 秒内完成”。字节跳动没有发布自己的延迟数据,所以我们进行了计时。两条提示词,分别从 Playground 以相同设置发送到 Flash Edit 和 Pro Edit 端点:使用同一张参考肖像作为唯一输入图像、2816×1584 预设、jpeg 输出、提示词优化保持默认。计时从点击 Run 开始,到 Completed 标签出现时停止,每秒轮询一次。
第一条提示词是火星夜市。Flash 用时 27.9 秒返回,Pro 用时 56.9 秒。第二条是一位身穿全息夹克的女街头赛车手,腋下夹着头盔,倚靠在一辆悬浮摩托车上,背景是雨水浸湿的东京小巷。Flash 用时 23.0 秒返回,Pro 用时 79.0 秒。两次运行中,Flash 的速度都快了 2 到 3.5 倍。不带参考图的纯文生图在 Flash 上还要更快,为 18 到 21 秒,这与模型页面声称的范围相符。

两个模型用相同文字做出的结果,和计时一样说明问题。两者都保留了参考图中的脸、深色刘海和蓝色眼睛。Flash 将她正对镜头取景,背景是刺眼的霓虹招牌。Pro 拉远镜头,展示了更多穹顶、摊位以及更柔和的钨丝灯光晕。两者都保留了宇航服的橙色镶边和腋下的头盔。两者都不需要第二次尝试。

四次运行只是一个样本,而不是基准测试,任何一天的队列状况都会改变这些数字。比例才是有用的部分。如果一项活动需要在午餐前产出 200 个变体,Flash 可将相同分辨率下大约四小时的 Pro 队列缩短到约一个半小时。
Seedream 5.0 Flash 图层分解:一张基础图像加 16 个图层
当 Pro 在 7 月发布时,r/singularity 发布帖中反复出现的实际抱怨之一就是关于图层。一位原本期待可编辑输出的评论者写道,“就 API 提供商而言,它只是输出一张单一实心图像,就像所有其他图像生成模型一样”。这个差距已经弥合。图层分解现在是一个专用端点,Flash 按 Flash 费率运行它。
我们向它输入了一个由 Flash 生成的照片级真实场景:一位女宇航员在火星机库内手拿头盔、一辆六轮漫游车、一架在她上方悬停的无人机、堆叠的货箱,以及两块全息面板。Seedream 5.0 Flash 图层分解端点 在 92.0 秒内返回了一张基础图像和 7 个透明 PNG 图层。
图层名称以简明英文返回:"Woman in spacesuit"、"Handheld spacesuit helmet"、"Six-wheeled rover"、"Floating drone"、"Stacked storage crates"、"Left holographic panel" 和 "Right holographic panel"。Playground 会在编辑器中堆叠它们,你可以拖动任意图层,用方向键微调,并看到背景在其后方填充。

对于任何基于它构建的人来说,结构比图片更重要。每个输出都带有 z_index,基础层为 0,更高的值堆叠在上方,还带有绝对像素和 0 到 1000 归一化单位两种形式的边界框、名称和描述。按其边界框内 z 顺序升序合成图层,就能重建原始图像。
该端点只接受一个至少 512×512、最大 30 MB 的 PNG 或 JPEG,接受一个可选提示词,可用坐标标签引导拆分,除 1K、1.5K 和 2K 选项外,默认使用自动尺寸设置。如果任何一个图层失败,整个请求都会失败,而不会返回部分结果。
通过 API 调用时,它与文生图一样是提交并轮询循环,模型字符串设置为 bytedance/seedream-v5.0-flash/layer-decomposition,并使用图像 URL 而不是提示词。
计费是需要重点规划的部分:Playground 估算显示最多 17 张图像,而实际收费是每返回一个文件按一张图像计费。我们的运行被计费为 8 张。这些图层是否能作为设计资产站得住脚,以及该系列的分层输出与竞品相比如何,是我们在 Seedream 5.0 Pro 对比 Nano Banana 2 中探讨的问题。
Seedream 5.0 Flash 定价:什么会计费,什么不会
Flash 定价足够简单,规则可以放进一张表,而规则正是它与 Pro 的不同之处。每张图像的确切价格见下方 FAQ。以下是其机制。
| 规则 | Seedream 5.0 Flash | Seedream 5.0 Pro |
|---|---|---|
| 输出尺寸 | 所有预设统一费率。Atlas Cloud 架构说明“每张图像无论尺寸都按相同的统一价格计费” | 按总像素分为两档:1.5K 档及以下,以及以上 |
| 参考图像 | 免费,最多 10 张 | 第一张免费,每增加一张图像会收取少量附加费 |
| 图层分解 | 按返回图像计费,基础层加各图层 | 按图层计费,采用相同的两个像素档位 |
| 被审核或失败的输出 | 不计费 | 不计费 |
其中两行让批量计算朝着有利于 Flash 的方向改变。10 张参考图的编辑与 1 张参考图的编辑成本相同,因此将产品图、风格帧和场景参考堆叠到一个请求中不会有额外代价。而且由于输出尺寸不会改变价格,没有理由为了省钱而以更小的预设运行宽幅 16:9 草稿。
审核规则直接来自 BytePlus 定价页面,其中指出“因内容审核等原因未能成功输出的图像不计费”。图层规则值得读两遍。r/generativeAI 上的一位买家在 8 月报告称,字节跳动自家云上的 Pro 图像包不覆盖图层请求,图层请求按每个图层单独计量。在按量付费模式下,账单就是文件数量,正如上方 8 张图像的运行所示。
何时继续使用 Seedream 5.0 Pro
Flash 覆盖草稿、变体、UGC 流程,以及任何必须在几秒内响应的助手。Pro 保留三类任务。
第一类是最终质量工作,其中单张头图会在全尺寸下被仔细审视,而一批五张图中四分钟的差异无关紧要。字节跳动自己的教程将延迟敏感的工作指向 Flash 或 Seedream 5.0 Pro 的快速提示词优化模式,这是 Flash 没有的中间设置。

第二类任务是人们容易搞错的。如果你需要 3K 或 4K 输出、连续生成或基于网络的提示词,那么 Flash 和 Pro 都不是答案。这些属于 Seedream 5.0 Lite 和 4.x 模型,它们用更大的画布和组输出换取了图层分解和精准编辑。在考虑价格之前,先根据你需要的功能匹配档位。
第三类是自问自答的预算问题。1.5K 档的 Pro 渲染标价相当于可购买两次半 Flash 渲染。在 2K 档,可购买五次。如果你在迭代,这个比例意味着 Flash 用 Pro 花费在一张上的时间和金钱探索五个方向。一旦方向确定,将最终稿转到 Pro 只需在请求中改一个词。
常见问题
Seedream 5.0 Flash 每张图像多少钱?
在 Atlas Cloud 上,截至 2026 年 10 月,所有 Seedream 5.0 Flash 的文生图、编辑和图层分解运行均标价为每张图像 $0.018,参考图像不收取附加费,价格也不随尺寸变化。Seedream 5.0 Pro 在 1.5K 档及以下标价为每张图像 $0.045,以上为 $0.09;截至撰写时,两个 Pro 端点均显示 20% 限时折扣。
Pro 每张图像实际成本的完整拆分见我们的 Seedream 5.0 Pro 价格指南。对于 1,000 张草稿的批次,这一差异就是一次下午实验与一项需要有人审批的预算项目之间的差距。
Seedream 5.0 Flash 和 Seedream 5.0 Lite 一样吗?
不一样。Lite 于 2026 年 2 月作为独立模型发布,拥有自己的功能集:3K 和 4K 输出、最多 14 张参考图像、连续生成、流式输出和网络搜索,但没有图层分解,也没有精准编辑。Flash 于 9 月下旬推出,是 Pro 更快、更便宜的兄弟型号,功能集与 Pro 相同,只是没有快速优化模式。如果你的工作流依赖图层或坐标编辑,Flash 是正确的低价档位,而 Lite 则不合适。
Seedream 5.0 Flash 支持 4K 吗?
字节跳动为 Flash 记录了 1K、1.5K 和 2K 档位,自定义尺寸上限为总像素 4,624,220。该上限允许 2816×1584 和 3136×1344 等宽幅预设,但达不到真正的 4K 画面,后者需要约 830 万像素。对于该尺寸的海报或印刷品,可在 Flash 中生成构图并放大所选画面,或将那一项任务转到 Lite。
Seedream 5.0 Flash 会添加水印吗?
字节跳动的 API 有一个默认开启的水印参数,会在右下角加上“AI generated”标记。各渠道决定如何设置它。我们为本文在 Atlas Cloud 上生成的图像在右下角没有可见标记,因此在构建假定角落干净的流程之前,请先检查你在所用平台上的首次输出。
Seedream 5.0 Flash 接受多少张参考图像?
编辑端点每个请求最多接受 10 张参考图像,图层分解端点只接受一张。每张参考图可以是 PNG、JPEG、WebP 或类似文件,最大 30 MB。由于 Flash 上参考图免费,实际限制是一致性而不是成本:三到四张精心挑选的参考图通常比十张关联松散的参考图更能引导编辑。
结论
Seedream 5.0 Flash 之所以占有一席之地,是因为它保留了几乎所有让 Pro 有用的能力,同时把时间还给了你。参考图上限、精准编辑、图层分解和像素范围都原封不动。你放弃的是快速提示词优化模式和 Pro 质量优先的流程,换来的是在我们的参考图编辑运行中快 2 到 3.5 倍的渲染,以及没有尺寸档位、没有参考图附加费的计费模式。
实际分工很明确。在 Flash 上起草、探索和批量生产。将 Pro 留给会在全尺寸下被评判的画面,并将 3K 和 4K 任务交给 Lite。如果你一直在为生产流程权衡 Seedream 5.0 Flash 与 Pro,请用你自己的提示词各运行一次,记下时间,让那个数字来做决定。






