MiniMax H3 Developer 现已上线 — 官方定价 4 折,低至 $0.02/秒

我写了40个头像提示,才有一个看起来像真人。

大多数AI头像提示词因措辞模糊而失败。一个五槽公式、可直接复制使用的LinkedIn示例,以及一次运行在三种编辑模型下的成本。

我写的第一条提示词只有七个词:专业女性头像,办公室背景。返回的图像皮肤无毛孔,牙齿白得过了头,西装外套和背后的椅子融为一体。经过三十九次修改,我终于得到了一张值得放在领英上的照片,也清楚记录了哪些词起了作用。这份记录就是本文:一份可复用的专业头像AI提示词公式,而非一堆零散示例。

同一张自拍生成的两张AI头像,一张来自模糊的七词提示,皮肤塑料感明显;另一张来自结构化提示,呈现真实纹理和影棚灯光。

关键要点

  • 一个有效的专业头像提示词需明确填写五个要素:姿态、着装、灯光、背景、镜头构图。如果不填,模型会填入训练数据的平均值,而平均值看起来塑料感十足。
  • 要生成自己的头像,应使用以自拍为参考的图像编辑模型,并加上禁止修图的身份保护条款。文生图模型会凭空生成一张脸,而编辑模型会保留你的脸。
  • 改变风格通常不需要重写提示词。只需替换着装或背景条款,其余部分保持不变。
  • 模型仍会更改提示词未提及的内容,包括发线。解决方法是明确指定必须保留的特征,直至雀斑。
  • 完全跳过公式也是一种选择:Atlas Cloud的免费AI头像生成器为每个账户提供一次免费生成,无需积分,无需订阅。

专业头像对于图像模型意味着什么

对于模型而言,“专业头像”是训练数据中所有标注该短语的图像的统计平均值:海军蓝西装、白色虚空背景、宽大的对称微笑、浓重的影棚光泽。仅输入这两个词,返回的就是这个平均值。塑料感皮肤并非故障,而是模型在执行未充分指定的提示词时所做的猜测,其猜测倾向于美化,很可能是因为该类别中修图照片占主导地位。

还有一个比任何措辞都更重要的决定。文生图模型输入“红发女性专业头像”会生成一张令人信服的专业面孔和一张虚构的脸。要得到自己的照片,应使用图像到图像的编辑模型:上传自拍作为参考,提示词描述脸周围的变化,而非描述脸本身。本文中的每个示例都针对这种编辑工作流编写。

对比图:文生图模型在相同头像提示词下生成一张新面孔,而编辑模型则保留上传者的脸。

Atlas Cloud通道:免费头像工具,完整提示词控制

在公式之前,先介绍捷径。Atlas Cloud 将其免费工具集合在一个AI工具页面,其中的免费AI头像生成器为每个账户提供一次完整生成,无需信用卡,无需积分余额。上传正面自拍,工具会将着装和背景重新设计为商务风格,并返回高清下载。没有可配置的样式菜单。该工具编辑你的实际照片,而非生成陌生人。免费使用次数用完后,后续照片按每次生成从充值余额中扣费,每张$0.045。

Atlas Cloud免费AI头像生成器界面,包含上传区域和说明:每个账户可免费生成一次,之后按张收费。

默认样式覆盖了常见情况。但它无法接受指令:特定颜色西装、客户品牌背景、窗光而非影棚光。这种控制存在于模型游乐场中,本文示例所调优的模型是Seedream v5.0 Pro Edit,它是Seedream 5.0 Pro系列中的编辑变体。其模型页面描述其设计重点是保留身份、光线和色调,这正是头像编辑的全部工作。它最多可接受10张参考图像,定价按输出像素分为两档:较小预设每张$0.045,输出超过约2.6百万像素时每张$0.09。

有效头像提示词背后的五要素公式

我最终保留的每个可靠头像提示词都有相同的骨架:开头是身份保护条款,然后按固定顺序填充五个要素。对于编辑模型,身份保护条款是强制性的,因为它们的默认行为是美化脸部,而美化正是让头像不再像你的原因。

Plain
1头部和肩部专业头像,参考图像中的人物。
2保持面部照片一致:相同的脸型、眼睛、鼻子、皮肤纹理、发际线。
3不修图、不瘦脸、不美化。
4[姿态] 身体微微侧转,脸朝向镜头,眼睛注视镜头,平静的闭口微笑。
5[着装] 海军蓝西装外套,内搭纯白衬衫,不打领带。
6[灯光] 柔和的正面左侧主光,右侧轻微补光,无硬阴影。
7[背景] 纯中灰色影棚背景,轻微失焦。
8[镜头] 类似85mm人像镜头,f/2.8光圈,浅景深。

使用单张参考自拍运行上述模板,效果如下:

使用完整五要素模板提示词生成的AI头像,显示海军蓝西装外套、纯白衬衫、轻微模糊的中灰色影棚背景,以及自然的未修图皮肤纹理。

Seedream v5.0 Pro Edit 游乐场运行一次,花费$0.09。

每个要素回答一个模型原本会替你回答的问题。姿态设定角度和表情;闭口微笑避免牙齿渲染。着装是大多数风格变更发生的地方。从摄影中借用的灯光术语(主光、补光、柔光箱)能可靠地起作用,很可能是因为这些术语在模型训练的图片标题中大量出现。背景保持简洁,除非有特殊理由。镜头条款是简写:85mm f/2.8倾向于拉近构图并模糊背景,如同人像摄影师的实际拍摄方式,但它指导的是构图而非模拟真实光学。

AI头像身份保护条款和五要素提示词速查表,显示每个要素控制的视觉元素,以及每个要素的可复制示例短语。

按风格分类的AI头像提示词示例

公式不变,要素可替换。以下三个示例系列,每个都是可直接粘贴到编辑游乐场的有效提示词(需附上自拍)。

适合领英的企业级头像提示词

企业版本保持一切保守:低调着装、简洁背景。以下指令正是我们8月3日游乐场测试中使用的原版,未编辑。对照公式,两个要素缺失:灯光和镜头未提及,模型用默认的柔和影棚灯光填充了这两个空缺。身份保护、姿态、着装和背景独立完成了任务。

Plain
1人物必须正面面对相机,正面姿态,眼睛注视镜头。
2除姿态变化外,面部必须与图像1完全一致:
3相同的脸型、鼻子、眼睛、皮肤纹理、发际线。
4不得以任何方式修图、瘦脸或美化面部。仅将
5服装改为炭灰色西装外套内搭白衬衫,背景改为
6均匀的浅灰色影棚背景。头部和肩部构图,方裁切。

输入是一张车内自拍,拍摄对象甚至未面向镜头。

输入车内手机自拍,以及使用企业提示词从该自拍生成的AI头像,显示炭灰色西装外套、白衬衫和灰色影棚背景。

在Seedream v5.0 Pro Edit游乐场以1536×1536分辨率运行一次,花费$0.045;截至2026年8月18日,同一端点报价为$0.045。

在任何地方上传结果之前,有两个领英特定细节值得注意:根据领英的上传规范,个人资料照片必须为400×400至7680×4320像素之间的PNG或JPG格式,且小于8MB。大多数编辑模型默认输出在此范围内,但过度裁剪的导出可能低于下限。

适合创意行业的休闲头像提示词

两个要素的替换将相同的骨架变得更温暖。着装去掉西装外套,背景增加深度,灯光改为窗光:

Plain
1图像1中人物的头部和肩部头像,放松自然的
2闭口微笑,眼睛注视镜头。保持面部照片一致,不修图,
3保留自然皮肤纹理。深绿色圆领毛衣。明亮的
4左侧窗光,阴影柔和。模糊的暖色调影棚室内背景,
5远距离失焦,类似50mm镜头构图。

50mm构图比85mm更宽、更不正式。对于创意行业,这种风格显得平易近人,而不像度假照片。

休闲AI头像,深绿色毛衣,柔和窗光,温暖失焦的室内背景,由休闲提示词示例生成。

行业特定提示词变体

只有着装和背景要素在不同行业间变化。三个可替换的示例:

Plain
1[医疗]  白色诊所白大褂,内搭纯色刷手服,浅蓝色无缝背景,
2        均匀无阴影灯光。
3[法律]  深炭灰色西装,带细微纹理,深中性灰色背景,
4        经典主光从上方略微倾斜。
5[创业]  纯黑色圆领T恤,浅混凝土灰色背景,通透高调灯光,
6        极简阴影。

着装条款之前的所有内容,包括身份保护,都逐字相同。这是要素结构带来的实际好处:任何规模的团队都可以标准化一个骨架,每个部门只需更改两行。

同一人物由医疗、法律、创业提示词变体生成的三个AI头像:分别显示白色白大褂、炭灰色西装和黑色T恤。

头像提示词失败之处:手、眼睛、皮肤纹理

有些失败是任何措辞都无法完全避免的。手是最有据可查的:多指、指节融合。可靠的解决方法是完全避免渲染它们,“头部和肩部”已经做到了这一点;如果提示词说半身,手就会进入画面,失败率也随之增加。眼睛的失败更隐蔽。输出可能带有呆滞的目光,添加“眼睛注视镜头”和“每只眼睛一个眼神光”会推动结果向有神的方向发展,但并非每次运行都成功。

皮肤是默认值抵抗最激烈的领域。在我们的8月3日测试中,同一张自拍通过两个基于预设的免费工具和一个提示词导向的运行进行了处理。一个预设工具完全抹去了拍摄对象的雀斑和腮红;另一个恰好保留了它们。这种差异是真正的发现:在预设下,纹理的保留取决于你抽到的工具。提示词导向的运行保留了雀斑和腮红,因为指令要求如此,但它将拍摄对象的发线重新分成了近乎完美的对称,这并非提示词任何部分的要求。

四格图:输入自拍和三个AI头像输出,其中一个预设工具的结果显示皮肤平滑,而提示词导向的运行保留了雀斑,但发线被重新分成了对称。

结论具有普遍性:身份保护只保护它明确命名的内容,其他一概不管。如果发线、疤痕、胎记或不对称的眉毛很重要,请明确命名。“保留原始发线”只需六个字,并且比任何通用的“不要改变”指令能存活更多次运行。

同一个头像提示词在三个模型上的表现

相同的提示词根据底层引擎的不同会产生不同的效果,费用也不同。Atlas Cloud上的三个编辑模型使比较具体化,所有价格均于2026年8月18日从平台的定价端点获取,当天无促销折扣。

Seedream v5.0 Pro Edit 分为上述两个像素档次,选择的宽高比并不能决定你落在哪个档次。其3:4选项存在两次:1328×1776为$0.045,1728×2304为$0.09。相同形状,费用翻倍,因此请阅读尺寸字符串,而不是比例标签。

GPT Image 2 Edit 按token计费,这使得质量成为主要杠杆:1024×1536的肖像运行在低质量下为$0.00974,中等质量为$0.04616,高质量为$0.16964。其方形选项是异类,在相同质量下比更高画面更贵,中质量为$0.05768对$0.04616,因为token公式按短边与长边之比加权。这些数字仅涵盖输出。上传的自拍在顶部增加输入token,这就是为什么实际3:4中运行在游乐场中约为$0.049而非$0.04616。运行按钮会在提交前显示最终总价。

Nano Banana 2 Edit 是这里唯一完全忽略形状的模型,仅按分辨率定价:1K为$0.08,2K为$0.12,4K为$0.16,无论输出是方形还是3:4。其页面有一条值得在上传肖像前阅读的说明:请求未通过Google内容审核,提供者仍会部分计费。

柱状图:八次肖像头像编辑的每次运行价格,从GPT Image 2 Edit的低档不到1美分,到Seedream v5.0 Pro Edit的两个3:4档位$0.045和$0.09,再到Nano Banana 2 Edit的三个分辨率档位,最高为GPT Image 2 Edit的高档$0.16964。

价格来自Atlas Cloud的计算端点,检查于2026年8月18日。GPT Image 2的数据仅为输出token;上传的照片会增加输入token。

一个遵循阶梯的工作流:在廉价档位起草,直到要素正确,然后在昂贵档位运行一次。十次GPT低档肖像起草加上一次Nano Banana 2 4K运行,在计入每次起草的输入图像token后,大约花费29美分。

撇开成本不谈,引擎对相同措辞的解读也不同。我们将之前的五要素模板未经编辑地输入所有三个模型,使用另一个拍摄对象的一张参考照片。第四格是免费工具在同一张照片上的一键输出,因为它完全不需要提示词。

四个AI头像:同一男子穿着海军蓝西装外套和开领白衬衫,分别标注Seedream v5.0 Pro Edit、Nano Banana 2 Edit、OpenAI GPT Image 2 Edit和Atlas Cloud AI头像,主要差异在于背景色调和肩膀构图的松紧度。

五要素模板的三次提示词运行加上免费工具的默认输出,2026年8月18日。

着装条款在所有输出中都得到了体现:海军蓝外套、白衬衫、开领、不打领带。背景是各面板的差异点。三个提示词模型都生成了模板要求的中间灰色,GPT Image 2的色调最冷,构图最紧。免费工具没有提示词,改为暖灰色,这是前面章节描述过的权衡:不写任何东西,就无法控制结果。构图也有所漂移,从Seedream保留最多躯干到免费工具保留最少,这一点值得注意,如果个人资料需要特定裁切。

常见问题

专业AI头像的最佳提示词结构是什么?

身份保护条款后跟五个要素:姿态、着装、灯光、背景、镜头构图。身份保护告诉编辑模型保持面部照片一致,不修图;每个要素回答一个模型原本会用训练数据平均值填充的视觉问题。完整骨架见上文公式部分。

在AI头像提示词中需要指定相机或镜头吗?

不需要品牌。像“85mm f/2.8”这样的焦距短语作为风格词使用:预期更紧的构图和更柔和的背景,而非真实玻璃的模拟。省略它,模型会为你选择构图。

能否不写任何提示词就能获得专业头像?

可以。Atlas Cloud的免费AI头像生成器完全不需要提示词:上传自拍,它就会返回一张专业风格的头像。账户的第一次生成免费,无需信用卡;之后每次生成从充值余额中扣除$0.045。

为什么AI头像仍然会把手或牙齿弄错?

通常的解释是训练信号:细小、高细节的结构在无数姿态变化中拍摄,人类眼睛能立即发现错误。无论原因如何,有效的解决方法是让它们不出现在画面中:手用头部和肩部裁切,牙齿用闭口表情。

对于头像提示词,我应该从哪个Atlas Cloud模型开始?

Seedream v5.0 Pro Edit最易于预算,有两个价格档位,无需关注其他内容,前提是检查尺寸字符串而非信任比例标签。GPT Image 2 Edit的低档是最便宜的起草渠道,每次运行约一美分。Nano Banana 2 Edit介于两者之间,仅按分辨率定价,使其成为4K最终渲染的可预测选择。确切的每次运行费用见模型比较部分及其图表。

AI头像会违反领英的照片规则吗?

不会因为它是AI生成而违反。领英的个人资料照片指南指出“你的个人资料照片必须反映你的形象”,可移除的类别包括标志、风景、名人和其他人的形象。从你自己的自拍生成的AI头像,保持可辨识的你的样子,属于规则允许范围。凭空生成或美化到无法辨认的版本,才是可能违规的版本。

结论

当输出有特定规格时,这个公式很有价值:公司着装规范、品牌背景、整个团队复用的同一个骨架。对于一张没有特殊要求的个人资料照片,一次免费运行预设工具比四十次修改更快。提示词技能最诚实的版本是知道在开始打字之前你处于哪种情况。

最新模型

一个 API,畅享全模态 AI。

探索全部模型