Seedance 2.5 现已上线 — 首发 Atlas Cloud

Wan 3.0 逼真人脸:3个看起来像真人的提示词

Wan 3.0 真实人脸:提示词、设置、验证测试

最新更新: Wan 3.0 已于 2026 年 8 月 24 日正式上线。

AI 视频首先会通过人脸被评判。不是镜头运动,也不是背景。而是人脸。

如果眼睛漂移、皮肤变得蜡质、或者嘴巴开始出现那种橡皮筋般的 AI 效果,那么浏览就结束了。这就是为什么 Wan 3.0 逼真面容 是创作者制作 UGC 广告、短片、推荐视频和社交片段时真正的生产测试。

有用的答案很简单:逼真面容不是美颜设置,而是一个导演问题。你需要稳定的参考、微小的真人动作、清晰的镜头规则以及严格的失败约束。

本指南以 Atlas Cloud 作为浏览器工作区,因为你可以在一处测试 Wan-3.0 文本转视频、图像转视频和参考转视频,查看运行状态,并在提交前确认可见成本。

关键要点

  • 真实面部质量意味着身份、皮肤、目光、嘴巴和动作连续性。
  • 当特定人脸很重要时,图像转视频通常更安全。
  • 提示语要强调肌肉活动与微动作,而不仅仅是情绪标签。
  • 在付费制作 24 秒或 30 秒压力测试前,先用 8 秒草稿。
  • 在 Atlas Cloud 上,Wan-3.0 模式起价为 $0.05/秒。

AI 视频生成界面,显示一位哭泣的毕业生

Wan 3.0 逼真面容展示:毕业典礼特写提示卡、已完成运行证据及面部稳定性帧

展示:毕业典礼特写案例使用单一人脸、细微表情、目光移动,以及一段 30.07 秒的手册片段来测试逼真面容的连续性。

案例 1 动作证明:一位年轻黑人女性身穿蓝色毕业礼服,在 30.07 秒的 Wan 3.0 手册片段中保持单一人脸特写表演。

为什么 Wan 3.0 逼真面容很火,但大多数尝试却失败

先下结论:人脸失败是因为提示语只要求一种氛围,而模型需要的是方向。

Wan 3.0 带来了更大的画布:最长 30 秒片段、1080P 输出、原生视听生成以及广泛的参考输入。阿里巴巴的发布说明也提到了多模态输入以及人脸与微表情的视觉连续性(阿里云社区,2026 年 8 月)。官方 Model Studio 页面将此次发布定位为 30 秒叙事、1080P 电影级画质、原生 A/V 以及全参考输入(阿里云 Model Studio,2026 年 8 月)。

这听起来很震撼。确实如此。

但创作者面临的实际问题更具体:“这个人能眨眼、说话、犹豫,并且保持同一个人吗?”

常见的失败模式如下:

  • 眼睛漂移:目光没有明确目标。
  • 橡胶皮肤:毛孔消失,脸颊像硅胶一样移动。
  • 骨骼漂移:颧骨和下颌形状在帧之间变化。
  • 假笑:嘴巴在笑,但眼睛没有。
  • 嘴巴闪烁:说话时牙齿和嘴唇脉冲式抖动。
  • 镜头触发的身份丢失:平移或转身后脸部变化。

这不仅仅是发布时的炒作。在较早的 Wan 工作流中,用户报告过图像转视频运行中的人脸不一致和恐怖谷效果,包括人脸不再与原始图像保持一致(ComfyUI GitHub 讨论,2025 年 4 月)。

问题是:你如何围绕这一点进行导演?

在 Atlas Cloud 上使用 Wan 3.0 逼真面容的工作流概览

使用最简单的模式,同时给予你足够的控制权。

如果你没有参考人物,从文本转视频开始。如果特定人脸很重要,使用带有强首帧的图像转视频。如果你有身份、动作和音频参考,则使用参考转视频。

你可以从 Atlas Cloud 主页 开始,打开 Wan 3.0 模型页面,粘贴提示语,选择时长和分辨率,然后在一个浏览器标签中运行测试。实际优势不仅仅是访问权限,而是提示语、设置、输出面板和报价成本在迭代过程中一直可见。

需求Atlas Cloud 模型运行位置用途验证价格
从纯文本提示开始Wan-3.0 文本转视频Wan 3.0 文本转视频游乐场通用演员或场景从 $0.05/秒
将首帧动画化Wan-3.0 图像转视频同一 Wan 3.0 系列,图像转视频模式稳定人脸、肖像 UGC从 $0.05/秒
跨动作锁定参考Wan-3.0 参考转视频同一 Wan 3.0 系列,参考转视频模式身份、动作、语音、场景参考从 $0.05/秒

Atlas Cloud models/all 当前列出 Wan-3.0 文本转视频、图像转视频和参考转视频,起价 $0.05/秒。阿里巴巴官方页面也显示其自有平台基于分辨率的价格,因此在提交前,请将可见的“运行”按钮成本视为最终依据。

第 1 步:选择 Wan 3.0 逼真面容模式

从符合你风险的工作流开始。

没有参考人脸?使用文本转视频。需要一个稳定的演员?使用图像转视频。需要已知身份加上动作、语音或之前的片段?使用参考转视频。

当你只需要快速检查模式时,复制这个提示语:

Plain
116:9, 8 秒, 逼真电影级特写。一个人坐在窗边,在柔和的日光下,自然地说出一句短句,嘴唇自然移动,眼睛轻微转动,呼吸放松。在整个片段中保持相同的脸、肤色、发际线、服装、灯光和背景模糊。避免面部漂移、蜡质皮肤、扭曲的眼睛、多余的牙齿、跳切和背景中的人脸。

要选择的设置:

设置推荐值为什么重要
宽高比文章测试用 16:9,竖屏社交用 9:16人脸比例和裁切会改变失败模式
分辨率最终版用 1080P,草稿可用 720P更高分辨率有助于皮肤和眼睛细节
时长8 秒草稿,24 秒到 30 秒压力测试长镜头会暴露身份漂移
音频除非测试对话,否则用环境音保持人脸测试的专注

无句号?

Atlas Cloud Wan 3.0 逼真面容模式设置,包含已完成运行和可见输出面板

第 1 步:Atlas Cloud Wan 3.0 模式设置,在完成运行后截图,以便输入和输出同时可见。

第 2 步:运行案例 1,一个 Wan 3.0 逼真面容特写

这是最难的一个。

特写消除了所有隐藏空间。观众可以看到嘴角、眉毛张力、目光目标和皮肤纹理。案例 1 使用一段 Wan 3.0 手册片段:一位年轻黑人女性身穿蓝色毕业礼服,框定为特写,安静地说话,目光下垂。

复制此提示语:

Plain
116:9, 8 秒, 逼真电影级特写。一位年轻黑人女性身穿蓝色毕业礼服,站在室内柔和的仪式灯光下,画面从头部到上胸部。左侧边缘有一个完全模糊的第二人形状。她对着镜头外的人低声说话,嘴巴自然移动,眉毛皱起,眼睛微微湿润但未哭泣。在镜头中,她的目光逐渐从眼睛水平高度移向自己的手。相机固定,但有轻微的呼吸式手持晃动。自然皮肤纹理,可见毛孔,柔和的顶光,浅景深。在整个片段中保持相同的脸、礼服、肤色、眼形和背景模糊。避免塑料皮肤、变化的颧骨、多余的牙齿、夸张的笑容、扭曲的眼睛和跳切。

要选择的设置:

设置选择
模型如果有首帧则用 Wan-3.0 图像转视频,否则用 Wan-3.0 文本转视频
时长草稿用 8 秒,长镜头证明用 30 秒
分辨率可用的话用 1080P,否则 720P
比例16:09
音频除非测试对话,否则只使用环境音

AI 视频生成器界面,显示输入设置和生成的视频输出

Wan 3.0 逼真面容案例 1 毕业典礼特写提示的已完成运行截图

第 2 步:案例 1 毕业典礼特写逼真面容测试的运行证据。请参阅上方展示片段以查看完整动作证明。

第 3 步:运行案例 2,一个 Wan 3.0 逼真面容 UGC 电话

UGC 的人脸失败方式不同。

镜头不像美颜特写那么紧,但说话、手的位置和柔和的窗光会很快暴露人脸变形。此案例使用雨天的公寓电话:一位年轻女子坐在窗边,接听电话,最后露出一丝微笑。

复制此提示语:

Plain
116:9, 8 秒, 自然 UGC 风格逼真视频。一位长直黑发的年轻女子坐在一张木桌旁,旁边是下雨的公寓窗户,手里拿着智能手机贴在耳边。窗外霓虹城市灯光模糊。她倾听,然后用平静低沉的声音回答;嘴唇轻柔移动,眼睛向下看了一拍,最后露出一个淡淡的微笑。相机是桌子对面的稳定中景,50mm 镜头效果,柔和的窗光洒在她脸的一侧,背景中有一盏温暖的实际灯。保持她的脸、发际线、鼻形、手的位置、手机、桌子、窗上的雨和灯光一致。避免过度美颜的皮肤、蜡质脸颊、不匹配的嘴唇动作、面部变形、多余的手指和背景中的人脸。

要选择的设置:

设置选择
模型通用演员用 Wan-3.0 文本转视频,锁定人脸用图像转视频
时长8 秒草稿
分辨率优先 1080P
比例16:09
音频仅测试语音时开启原生音频,否则用轻柔雨声和环境音

AI 视频生成器界面,显示输入设置和生成的视频

Wan 3.0 逼真面容案例 2 雨窗电话的已完成运行截图

第 3 步:案例 2 雨窗电话人脸测试的运行证据。

微笑女子在雨窗旁打电话

案例 2 雨窗电话人脸测试的动作证明 GIF

案例 2 动作证明 GIF:15.04 秒的 Wan 3.0 手册片段测试了说话、眼睛移动、手与手机的一致性以及柔和的室内灯光。

第 4 步:运行案例 3,一个 Wan 3.0 逼真面容竖屏社交片段

现在缩小人脸。

竖屏片段很隐蔽。人脸较小,但观众仍然会注意到眼睛是否变形、腿部是否扭曲、或者镜子里的反射是否变成另一个人。本案例测试带镜子的全身动作、服装细节和放松的微笑。

复制此提示语:

Plain
19:16, 8 秒, 逼真竖屏社交视频。一位年轻女子身穿白色刺绣衬衫、白色百褶裙、黑色腰带和白色厚底运动鞋,站在光线柔和的公寓里干净的落地镜前。她调整了一下袖子,自然地将重心转移,从镜子看向镜头,露出一个放松的淡淡微笑。全身构图,固定稳定的相机,自然日光,无重度美颜滤镜,逼真的织物纹理和身体比例。在整个镜头中保持相同的脸、服装、发型、镜子位置和房间布局。避免面部漂移、玩偶般的皮肤、变化的眼形、扭曲的腿部、多余的反射和跳切。

要选择的设置:

设置选择
模型Wan-3.0 文本转视频或图像转视频
时长8 秒草稿
分辨率优先 1080P
比例9:16
音频无音乐,仅轻柔环境音

AI 视频生成器界面,显示文本提示和生成的视频

Wan 3.0 逼真面容案例 3 竖屏时尚镜子片段的已完成运行截图

第 4 步:案例 3 竖屏全身人脸一致性测试的运行证据。

女子身穿白色刺绣衬衫和百褶裙站在厨房里

案例 3 竖屏时尚人脸一致性的动作证明 GIF

案例 3 动作证明 GIF:15.04 秒的 Wan 3.0 手册片段测试了较小的人脸是否稳定,同时身体、服装和镜子保持连贯。

第 5 步:在重新生成前审计 Wan 3.0 逼真面容

不要因为片段“感觉不对”就重新生成。先命名失败原因。

此清单可保持审查客观:

检查项通过信号需重新生成的情况
身份相同的眼距、鼻子、颧骨人脸看起来像另一个人
皮肤保留毛孔和柔软纹理蜡质、塑料、过度平滑
嘴巴说话感觉微小且真实下巴像橡胶或牙齿闪烁
眼睛目光有明确目标眼睛漂浮或交叉
动作一个连续的动作跳切或身体突然移动
背景模糊保持为背景随机人脸变清晰

评估 Wan 3.0 逼真面容的审计检查表表格

Wan 3.0 逼真面容审计检查表,以清晰表格形式呈现身份、皮肤、嘴巴、眼睛、动作和背景检查

第 5 步:一个在再次运行前可使用的人脸真实度审计表。

在构建自己的测试时,使用此可重用模板:

Plain
1[宽高比], [时长], 逼真电影级视频。 [具有稳定身份锚点的主体] 在 [具体场景和灯光中]。 [可见动作链:面部、眼睛、嘴巴、手和姿势做什么]。 相机:[景别大小、镜头感觉、运动]。 音频:[环境音 / 对话 / 氛围]。 保持 [脸、肤色、服装、道具、背景]。 避免 [面部漂移、蜡质皮肤、扭曲的眼睛、糟糕的牙齿、跳切、多余的手指]。

Wan 3.0 逼真面容变体尝试

在 3 个核心测试通过后,尝试这些:

变体简短提示语开头测试内容
创始人推荐视频中年创始人在安静办公室用 8 秒解释一个产品结果可信的 UGC,无美颜滤镜皮肤
演员反应镜头演员听到意外消息,笑容逐渐消失成沉默微表情控制
产品试穿面部镜头人物戴上眼镜、涂口红或护肤,同时微微转身人脸加产品稳定性
纪录片采访手持特写,自然皮肤,柔和背景,无美颜滤镜逼真的不完美

在 Atlas Cloud 上 Wan 3.0 逼真面容的成本

使用快速公式:

成本 = 秒数 x 模型每秒钟价格 x 分辨率等级(如适用)

截至 2026 年 8 月,Atlas Cloud models/all 列出三种 Wan-3.0 视频模式起价 $0.05/秒。这为你提供了规划底线:

测试时长使用原因估计底线
人脸草稿8 秒快速检查提示语从 $0.40
UGC 广告片段12 秒社交剪辑从 $0.60
长特写30 秒完整的 Wan 3.0 压力测试从 $1.50

对于最终交付,请在提交前检查可见的运行成本。1080P 在某些平台或层级上的成本可能高于底线,“运行”按钮才是你实际要支付的。

Wan 3.0 逼真面容的法律说明

对于真实的员工、创作者、客户和可识别的肖像,请使用同意书。不要暗示真实人物说过他们没有说过的话。对于广告、推荐视频、医疗声明、财务声明或政治内容,请保持严格的披露和审核。

这是成熟的答案。有趣的部分仍然是创意指导,但负责任的部分保证你可以发布。

常见问题解答

Wan 3.0 能制作逼真的人脸吗?

可以,但最佳结果来自有指导性的提示语和强参考。要求稳定的身份锚点、微小的面部运动、清晰的目光目标以及具体的失败约束。

为什么人脸有时仍然看起来恐怖谷?

因为人脸会暴露微小的错误。眼睛方向、牙齿、颧骨、嘴唇时机和皮肤纹理必须同时保持连贯。像“悲伤的女人在说话”这样的宽泛提示语为漂移留下了太多空间。

文本转视频还是图像转视频?

当任何可信的演员都可以时,使用文本转视频。当特定人脸、品牌演员、创作者或首帧很重要时,使用图像转视频。

说话人脸的最佳 Wan 3.0 提示语是什么?

最佳提示语描述一个连续的动作链:人物看哪里,嘴巴如何移动,手做什么,以及必须保持不变的内容。然后添加“避免”术语,如塑料皮肤、扭曲的眼睛、糟糕的牙齿和面部变形。

在 Atlas Cloud 上需要多少成本?

Atlas Cloud models/all 当前列出 Wan-3.0 文本转视频、图像转视频和参考转视频,起价 $0.05/秒。8 秒草稿大约从 $0.40 起,30 秒压力测试大约从 $1.50 起,高于任何更高分辨率层级的费用。

我可以将 Wan 3.0 逼真面容用于广告或 UGC 吗?

可以,但需要正常的创意和法律纪律。对肖像使用同意书,避免虚假推荐,并在披露规则或客户政策要求时标注合成 UGC。

最新模型

一个 API,畅享全模态 AI。

探索全部模型