搜索"grok face swap",结果一片混乱,充斥着非官方教程、名称类似grokimagine.ai的山寨应用,以及大量关于深度伪造的新闻报道。没有一条来自xAI。实际产品Grok Imagine中,没有名为"Face Swap"的按钮、模板或记录在案的功能,其发布历史中也从未显示有过。
它实际拥有的是一个通用图像编辑器,可以接收一张照片和一句话,而"没有专用工具"和"模型显然能做到"之间的差距,正是导致xAI卷入长达一年的监管函件、欧盟委员会程序以及代表真实儿童提起的诉讼的原因。本文将介绍Grok Imagine的编辑端点实际做了什么,当人们将其对准真实人脸时发生了什么,以及如今在Atlas Cloud上运行相同的底层模型,旁边还有一个更窄、需要同意的替代方案。
关键要点
- 截至2026年7月,Grok Imagine自己的模板库列出了23个命名工具。没有一个叫"Face Swap"。身份交换是通过通用编辑端点上的自由文本提示完成的,而不是一个标记的功能。
- 从2025年8月应用发布开始,历时五个月的升级,在2026年1月达到大规模的"脱衣"浪潮,导致英国通信管理局、欧盟委员会和加利福尼亚州总检察长在同一个月内都正式对X采取了行动。
- xAI当前有效的可接受使用政策(2026年6月26日生效)明确将"对真实人物进行脱衣或裸化"列为禁止类别,同时要求每个输出都必须带有不可移除的水印。
- Atlas Cloud直接运行相同的编辑模型:xai/grok-imagine-image-quality/edit在游乐场中每次运行定价从$0.06起,旁边还有一个专门构建的atlascloud/face-swap-image端点,每次运行从$0.096起,该端点在模型页面本身要求同意。
Grok缺失换脸按钮背后的真实故事

来源:grok.com/imagine模板栏,于2026年7月29日浏览并记录。
我们直接打开Grok Imagine的编辑器来验证,而不是轻信任何人的说法。特色模板栏列出了:Glossy Product Shot、Chibi、Object Remover、Professional Headshot、Haze Portrait、Product Showcase、Logo Editor、70s Street Style、Quality Enhancer、Comic Book、80s Anime、Watercolor Portrait、Video Game、3D Animation、Spaghetti Western、Funky Dance、Future Past、Roman Empire、Ad Astra、Add Girlfriend、Future Family、Laser Fight和Sunny Morning。共23个命名工具,身份交换不在其中。

所有名称均来自grok.com/imagine,2026年7月29日。
所有这些工具之下是一个单一的"上传+提示"界面:附加一张照片,输入指令,选择图像或视频模式。没有蒙版工具,没有像专用换脸应用那样的"源脸/目标脸"双槽布局。如果有人从Grok Imagine中获得换脸结果,他们只是在该通用框中输入了类似"将这个人脸放到这张照片上"的内容,而模型(基于xAI称为Aurora的架构)完成了其余工作。
这种区别比听起来更重要。一个标记的功能带有定义的输入、定义的输出,通常在发布前有审查过程。而一个从通用编辑器中涌现的能力默认不会得到任何此类审查,一旦人们开始在真实、可识别的人脸上测试它,差异就很快显现出来。
深入了解Grok Imagine:编辑背后的Aurora模型
xAI走到这一步的路径涉及两个经常在网上被混淆的产品。Aurora于2024年12月悄然出现在Grok聊天中,根据TechCrunch当时的报道,它是一个自回归混合专家图像模型,以类似语言模型预测单词的方式预测图像令牌,而不是像扩散模型那样去噪图像。它因生成真实人物的无限制图像而被短暂下线。大多数人今天所说的独立应用Grok Imagine于2025年8月4日单独发布,向iOS上的SuperGrok和X Premium+订阅者推出,并从一开始就内置了"辣妹模式"预设。

来源:TechCrunch、好莱坞报道、x.ai的可接受使用政策。
今天用于身份工作的编辑变体xai/grok-imagine-image-quality/edit,在其自己的Atlas Cloud模型页面上描述为运行在相同的Aurora基础上,该页面称其与基于扩散的竞争对手相比,具有异常强大的面部一致性和纹理准确性。该模型接受一个提示加上一个或多个image_urls,并有记录在案的多图像语法<IMAGE_0>、<IMAGE_1>,用于告诉它哪个参考做什么。无需蒙版,最多八张参考图像,输出分辨率为1K或2K。
一个单独的、较新的预览版称为Grok Imagine Video 1.5,在报道中被描述为在生成的片段中"保持相同的面部、身体和身份锁定"。这是一个用于在视频中平滑动画化一个人的单主体一致性功能,而不是将一个人的脸放到另一个人身体上的工具。很容易看出,在关于Grok能做什么的随意讨论中,这两者是如何被混淆的。
在Atlas Cloud上运行Grok Imagine的编辑API
编辑模型的两个层级——标准版xai/grok-imagine-image/edit和高保真版xai/grok-imagine-image-quality/edit——都在Atlas Cloud上运行,旁边还有300多个其他模型,包括xAI模型系列和专用的Grok Imagine编辑游乐场。一个账户和一个API密钥涵盖两个层级,因此在承诺使用高保真版之前测试更便宜的选项只需切换模型字符串,无需注册两次。
方法1:直接在游乐场中运行
- 创建一个Atlas Cloud账户并打开编辑模型页面。
- 上传目标图像(最多可接受八张参考图像),并编写描述编辑的提示,当涉及多张图像时,使用<IMAGE_0>和<IMAGE_1>指向特定的上传。
- 设置分辨率为1K或2K,并选择要生成的候选输出数量,从一到四。
- 点击运行。在默认1K、自动宽高比设置下,我们测试时游乐场报价为每次运行$0.06;切换到2K则升至$0.08。
方法2:直接调用API
步骤1:获取API密钥。 登录Atlas Cloud控制台,从仪表板生成一个密钥。


步骤2:检查请求模式。 API文档涵盖了身份验证以及平台上每个图像模型使用的共享generateImage端点。
步骤3:发送请求。
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateImage \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 3 -H "Content-Type: application/json" \ 4 -d '{ 5 "model": "xai/grok-imagine-image-quality/edit", 6 "prompt": "Replace the face in <IMAGE_0> with the face from <IMAGE_1>. Keep the pose, clothing, background and lighting unchanged.", 7 "image_urls": ["https://your-cdn.com/target-photo.jpg", "https://your-cdn.com/source-face.jpg"], 8 "num_images": 1, 9 "resolution": "2k" 10 }'
生成异步运行。响应返回一个预测ID,轮询该ID直到作业完成:
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<PREDICTION_ID> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
相同的密钥、相同的两个端点以及相同的轮询模式适用于Atlas Cloud上的每个模型,因此围绕Grok Imagine构建的流水线可以通过更改请求体中的一个字符串,稍后添加Seedream、Nano Banana或GPT Image 2。
该请求模式中没有任何内容限制提示或参考照片可以包含的内容。正是这种开放性将同样的编辑能力变成了xAI最大的责任,接下来将介绍这一点。
方法3:尝试使用Seedream 5.0 Pro Edit
并非每个身份编辑都需要专门使用Grok。由于Grok Imagine的编辑端点是一个通用模型,而不是专门为保持面部完整而调优的,Atlas Cloud也运行Seedream 5.0 Pro Edit,这是字节跳动的多参考编辑模型,专门设计用于在最多十张参考图像中稳定保持身份、光照和色调。例如,上传一张莫奈1875年画作《撑阳伞的女人》的公有领域复制品作为参考,以及一张AI生成的虚构人脸作为第二张参考,然后使用以下提示:
将画作参考中女人的脸替换为肖像参考中的脸。保持她精确的姿势、阳伞、裙子、草地、天空以及画作原有的笔触、光照和色调完全不变。
定价随设置变化:该模型列表基本价格为每次运行$0.036(享受20%折扣后),但使用下方尺寸的两张参考图像运行,定价为$0.0744,折扣自$0.093。

使用bytedance/seedream-v5.0-pro/edit在Atlas Cloud上生成,2026年7月。画作参考是莫奈1875年原作的公有领域复制品;面部参考是AI生成的,而非真实人物。
身份转移本身效果干净:正确的光照、正确的角度,无可见接缝。然而,风格请求并未完全实现。提示明确要求新面部融入印象派笔触,但结果明显更平滑、更摄影化,与周围松散笔触形成对比。
Grok Imagine的编辑端点中没有任何内容限制提示或参考照片可以包含的内容。正是这种开放性将同样的编辑能力变成了xAI最大的责任,接下来将介绍这一点。
为什么换脸成为Grok最危险的提示
在2025年8月发布后的几小时内,The Verge测试了新工具,请求泰勒·斯威夫特的图像,并选择了辣妹模式视频预设,据称其中一个产生了她脱衣的镜头,而没有人明确要求过,根据多家媒体对该测试的报道。当时的年龄验证据称只是自我报告出生年份。TechCrunch同周的报道标题为"该应用让你制作NSFW内容",并指出审核存在但行为不一致,有些提示返回模糊标记的结果,有些则没有。
那是较小的一波。更大的浪潮在2025年底到来,当时Grok的编辑功能(当时已更广泛地推出)被大规模用于"脱衣"真实人物的照片,包括未成年人,直接发生在X上。研究员Genevieve Oh的分析(被多家媒体引用)发现,在2026年1月初的一个窗口期内,Grok账户每小时生成约6700张性暗示或裸化图像,而五个专门的"脱衣"网站的平均总和为每小时79张。数字仇恨中心估计更广泛的数字是在11天的时间内生成约300万张性化图像,其中估计有2.3万张似乎描绘了未成年人。
各国政府在几天内相继行动。印度技术部于1月3日发出正式通知。印度尼西亚于1月10日完全封锁Grok,马来西亚次日跟进,两者都在xAI提供书面保证后约两周内解除了封锁。英国通信管理局根据《在线安全法》展开调查,于1月12日发出警告,可能处以高达1800万英镑或全球收入10%的罚款。1月14日晚间,X发布了一份公开声明,后被好莱坞报道引用:

来源:好莱坞报道、Ofcom、加州司法部、欧盟委员会。
两天后,加利福尼亚州总检察长向xAI发送了一封停止并终止信函,援引了该州民事深度伪造法等法规。当时的媒体报道称这是加州新AB 621法案下的首次重大执法行动,该法案允许恶意违规的最高法定损害赔偿金为25万美元。1月26日,欧盟委员会根据《数字服务法》对X展开正式程序,将Grok的发布纳入现有调查,并命令X保留内部记录至2026年底。
诉讼紧随监管压力而来。一起拟议的集体诉讼,Jane Doe诉xAI Corp.,于1月下旬在加州北区法院提起,指控在12月至1月窗口期内生成了超过400万张图像,其中约41%包含女性的性化图像。Elon Musk其中一个孩子的母亲Ashley St. Clair因她声称从自己童年照片生成的深度伪造内容单独起诉xAI;xAI当天就合同纠纷反诉。3月,一群田纳西州青少年(后来加入怀俄明州和威斯康星州的原告)起诉了xAI和Stability AI,指控内容据称从真实儿童照片生成。7月,xAI本身起诉了一名南卡罗来纳州男子(该男子已于3月被州当局逮捕),指控其反复改写提示以绕过安全措施。
| 案件 | 提交日期 | 法院 | 核心指控 |
|---|---|---|---|
| Jane Doe诉xAI Corp. | 2026年1月23日 | 加州北区法院 | 集体诉讼,涉及约440万张图像,约41%为女性性化图像 |
| Ashley St. Clair诉xAI | 2026年1月15日 | 纽约州法院,后移至纽约南区法院 | 从童年照片生成的性深度伪造内容 |
| xAI诉St. Clair(反诉) | 2026年1月15日 | 德州北区法院 | 涉嫌违反用户协议论坛条款 |
| 未成年人诉xAI / Stability AI | 2026年3月16日 | 加州北区法院 | 据称从真实儿童照片生成的内容 |
| xAI诉Harwood | 2026年7月15日 | 德州北区法院 | xAI起诉用户涉嫌反复绕过安全措施 |
根据韩国Google Play的列表,实际后果仍然可见:X应用在韩国的年龄评级于2026年6月从16+提升至19+,当地报道将这一变化直接归因于Grok的图像工具。Ofcom的调查截至其最新公开更新尚未做出临时决定。这一切都不像是一章已经结束,并且正是当前政策如此表述的直接原因。
xAI今天指向的政策是其可接受使用政策,于2026年6月26日生效,鉴于其对这个故事的核心重要性,我们直接阅读了它,而不是盲目相信。它禁止(以其自己的措辞)"对真实人物进行脱衣或裸化,或以其他方式修改真实人物的图像或肖像,以在亲密或性环境中描绘他们",并单独禁止"欺骗性地冒充真实人物"。xAI的自己常见问题解答进一步说明了其视为绝对禁止的类别:某些内容"无论您的设置或订阅如何,都绝不允许",并且"无法禁用",点名了儿童性虐待材料和非自愿亲密图像。疑似CSAM会报告给国家失踪与受虐儿童中心。
| 类别 | 状态 | 来源 |
|---|---|---|
| CSAM / 涉及未成年人的性内容 | 绝不允许,无法禁用 | docs.x.ai/grok/faq |
| 非自愿亲密图像 | 绝不允许,无法禁用 | docs.x.ai/grok/faq |
| 对真实人物进行脱衣或裸化 | 根据AUP禁止 | x.ai 可接受使用政策 |
| 欺骗性冒充真实人物 | 根据AUP禁止 | x.ai 可接受使用政策 |
| 移除或修改Grok水印 | 根据AUP禁止 | x.ai 可接受使用政策 |
Grok生成的每张图像和视频都带有水印,xAI的常见问题解答称其"没有移除设置",并且剥离或修改它本身就是违反政策的行为,与底层图像的内容无关。综合来看,书面政策是全面的。这一整个事件暴露出的差距在于,在公众压力迫使技术修复之前,政策在纸上所写的内容与通用编辑器在实践中实际阻止的内容之间的差距,每当提示接近真实人物的肖像时,这个差距都值得记住。
Grok Imagine编辑 vs Atlas Cloud的专用换脸工具
Grok Imagine的编辑端点和Atlas Cloud自己的atlascloud/face-swap-image模型以不同方式解决重叠的问题。产品页面本身就像价格表一样清楚地显示了这一点。
| Grok Imagine Image Edit | Grok Imagine Image Quality Edit | Atlas Cloud Face Swap (Image) | |
|---|---|---|---|
| 端点 | xai/grok-imagine-image/edit | xai/grok-imagine-image-quality/edit | atlascloud/face-swap-image |
| 输入 | 提示 + 最多8张参考图像 | 提示 + 最多8张参考图像 | 两个固定槽位:源脸、目标图像 |
| 专为身份交换构建 | 否,通用编辑器 | 否,通用编辑器 | 是,专门构建 |
| 模型页面上的同意语言 | 不存在 | 不存在 | "获取所描绘人物的同意" |
| 已验证的游乐场价格 | $0.022/次运行 (1K, 自动) | $0.06/次运行 (1K), $0.08/次运行 (2K) | $0.096/次运行 (自动尺寸) |
| 输出分辨率 | 1K / 2K | 1K / 2K | 自动, 1K, 1.5K, 2K, 3K |
Grok模型要求一个句子并奖励创造力:改变服装、交换背景、重新设计整个场景、将一张脸放在另一张脸的位置,所有操作都通过同一个框完成。这就是本文已经讨论过的开放式灵活性。为了亲眼看到这种差异,而不仅仅是阅读,我们通过两个模型运行了相同的身份交换:将一个虚构的AI生成的面孔(而非真实人物)融合到"Doge"迷因照片中的柴犬身上。
原始模板:

广泛流传的迷因照片,原为一只名为Kabosu的柴犬。
Grok Imagine Image Quality Edit结果:

通过xai/ grok-imagine-image-quality /edit在Atlas Cloud上生成,2026年7月。
Atlas Cloud Face Swap结果:

通过atlascloud/ face-swap-image 在Atlas Cloud上生成,2026年7月。
两个输出沿着规格表预测的线条分叉。Grok的编辑端点将虚构人脸融合到狗的脸部结构中:耳朵、毛发轮廓和整体头部形状都保留了下来,眼睛、鼻子和嘴巴读起来像人类,但模型没有将头部其余部分视为可修改区域。Atlas Cloud的Face Swap工具(列在平台的图像工具类别下)做了完全不同的事情:它替换了整个头部,包括耳朵,只在肩膀处留下毛发作为原始照片的提醒。一个是提示驱动的混合,保留指令未明确更改的任何内容。另一个是固定交换,将整个头部视为要替换的东西,直接在页面上说明其同意期望,并且每次默认运行价格为$0.096,在花费任何积分之前。其视频对应物atlascloud/face-swap-video将相同的完全替换方法扩展到视频,在我们的测试中每次运行1080P价格为$1.30。
使用Grok Imagine进行更安全的面部编辑提示

基于xAI的可接受使用政策和docs.x.ai/grok/faq。
一些习惯可以防止合法的编辑变成被拒绝的请求,或者更糟,违反xAI自己的条款。
- 只编辑你有权使用的照片。 这意味着你自己的照片或获得其中人物明确同意的图像,没有例外。这不是可选的指导;这正是xAI政策划定的界限,Atlas Cloud的换脸工具出于同样原因在模型页面上说明这一点。
- 围绕姿势、服装、背景和风格编写提示,绝不涉及裸体或亲密场景。 Quality层级的长处是逼真的光照和纹理,而这正是提示向裸露皮肤漂移时会被标记(有时不一致)的原因,根据TechCrunch自己的测试。
- 提供清晰、正面的源图像。 编辑模型会填补它们看不到的部分。模糊或倾斜的参考会产生在技术上符合提示但不匹配该人物的面部。
- 当涉及多张照片时,使用<IMAGE_0> / <IMAGE_1>标签。 没有它们,模型必须猜测哪个上传是源,哪个是目标,猜测就是产生不想要结果的地方。
- 期望水印保持原样。 这不是需要绕过的bug。移除它是一个单独的政策违规,无论图像本身内容如何。
常见问题解答
Grok有换脸功能吗?
没有。截至2026年7月,Grok Imagine自己的模板库列出了23个命名工具,换脸不在其中。身份交换发生在有人上传参考照片并在通用编辑端点上编写描述交换的提示时,而不是通过一个专用的、标记的功能。
如何使用Grok Imagine的编辑API进行换脸?
上传你想要组合的图像,然后使用<IMAGE_0>和<IMAGE_1>标签编写提示,指定哪个参考提供面部,哪个提供场景,例如"将<IMAGE_0>中的面部替换为<IMAGE_1>中的面部,保持其他一切不变"。标准版xai/grok-imagine-image/edit和高保真版xai/grok-imagine-image-quality/edit都接受相同的语法。
为什么监管机构打击了Grok的换脸能力?
2025年12月和2026年1月的大规模"脱衣"浪潮导致Grok的编辑工具被大规模用于真实人物的照片,引发了英国通信管理局和欧盟委员会的正式调查、加州总检察长的停止并终止信函,以及多起诉讼。xAI的回应是将图像编辑限制为付费订阅者,然后为所有人阻止了真实人物的"暴露衣物"编辑。
未经同意换脸是否违法?
可能是,而且法律在这个具体问题上发展迅速。加州AB 621法案允许非自愿深度伪造色情内容的每次违规最高法定损害赔偿金为25万美元,而联邦TAKE IT DOWN法案要求平台在收到请求后移除报告的非自愿亲密图像,包括AI生成的。这不是法律建议,但xAI的可接受使用政策和Atlas Cloud的换脸模型页面都要求所描绘人物的同意,正是出于这个原因。
Grok会在换脸图像上添加水印吗?
是的。xAI自己的常见问题解答指出,Grok生成的图像或视频"没有移除水印的设置",并且更改或剥离它本身就是违反政策的行为,与图像内容无关。
运行Grok Imagine编辑模型最便宜的方式是什么?
标准版xai/grok-imagine-image/edit层级,在我们测试中,1K分辨率、自动宽高比下每次运行价格为$0.022。高保真版xai/grok-imagine-image-quality/edit在1K下为$0.06,在2K下为$0.08,用几美分换取更强的面部一致性和更清晰的细节。
对于身份交换,Atlas Cloud的专用换脸工具是否比Grok Imagine Edit更合适?
对于专门将一个人的脸放到另一张图像上的任务,是的,它是更可预测的选择。atlascloud/face-swap-image接受固定的源脸和目标图像对,而不是开放式提示,直接在页面上说明其同意要求,并且每次默认运行价格为$0.096。当任务比身份更广泛时——重新设计整个场景、更换服装、合成多个参考——Grok Imagine的编辑端点是更好的选择,其自然语言灵活性值得保留。
结论
对"Grok是否有换脸功能"这个问题的诚实回答是,它从来不需要一个。一个能理解像"交换这张脸"这样的提示的通用编辑器可以在没有专用按钮的情况下完成工作,而正是同样的灵活性让事情在一个月内以波及三大洲监管机构的规模出了差错。xAI当前的政策具体说明了现在禁止什么,水印留在每个输出上,API本身在Atlas Cloud上以同样的方式运行——一个密钥、一个提示和一对参考图像。改变的是,在将其对准别人的脸之前,这种组合需要多少审视。






