人工智能

AI,为什么总在画美女?

字号+作者:GeekPark极客公园 来源:GeekPark极客公园 2026-10-05 13:26 评论(创建话题) 收藏成功收藏本文

今年5月初,X上一条五秒钟的视频火了。这是一场韩国职业棒球联赛转播,韩华鹰队对阵斗山熊队。镜头扫到看台上一个穿白上衣和牛仔裤的女人,翘着腿。某一刻,她'...

今年5月初,X上一条五秒钟的视频火了。这是一场韩国职业棒球联赛转播,韩华鹰队对阵斗山熊队。镜头扫到看台上一个穿白上衣和牛仔裤的女人,翘着腿。某一刻,她似乎叹了口气,并移开了视线,看起来对比赛感到不满。uJM品论天涯网


uJM品论天涯网

视频配文是“普通韩国女性”。截至本文发布,视频播放量已经为1525万|视频来源:X@kangminleeuJM品论天涯网

但是很快一群资深球迷看出了不对劲。比分牌上写着,击球手是曹仁成(ChoInseong),可曹仁成2017年就退役了,现在在斗山当教练。uJM品论天涯网

此外,看台上的加油标语比斗山熊的官方口号多出一个字,像是AI生硬直译出来的。而这场转播,解说却是标准的美式口音,同样也很可疑。uJM品论天涯网

这个女人确实不存在,她是由AI生成的。但视频被拆穿后没有消失,反而成了一个模板。大家把自己的脸塞进同样的转播画面,生成一张“被球场镜头抓拍到的自己”,并很快在社交网络上流行。uJM品论天涯网


uJM品论天涯网

“被球场镜头抓拍到的自己”迅速成了流行模板|图片来源:RADIIuJM品论天涯网

每一次AI图像能力的增强,几乎都会跑出一个全民流行的爆款。比如2025年3月GPT-4o能画图了,满屏都是被重绘成吉卜力动画风格的照片;8月底Google的NanoBanana上线,大家最爱的玩法是把自拍做成摆在电脑桌上的手办,用户两周里生成了2亿多张图。uJM品论天涯网

爆款每次都换,大多是“把自己放进去”的玩法。但球场这一次,暴露了一个之前不那么明显的顺序:先是一个不存在的美女骗过了上千万人,然后才长出了人人可玩的模板。uJM品论天涯网

美女不是偶然出现在场景里的配角,她更像一个默认值。uJM品论天涯网

这个默认值比AI早了半个世纪。1973年,正是图像数字化的早期,一群工程师要测试一项新的图像技术,他们选的也是一个美女。uJM品论天涯网

01uJM品论天涯网

互联网第一夫人uJM品论天涯网

LenaSoderberg的职业生涯始于在伊利诺伊州芝加哥,从事平面模特的工作。此前她以互惠生的身份,从瑞典移居到了美国。1972年,她为《花花公子》杂志11月刊拍摄了中间插页。那期《花花公子》卖了716万多册,是这本杂志卖得最好的一期。uJM品论天涯网

学过数字图像处理的人多半见过她:戴一顶宽檐帽,裸着肩侧过脸来看镜头。几十年里,数不清的图像压缩和处理算法拿这张脸做过测试。uJM品论天涯网


uJM品论天涯网

LenaSoderberg堪称赛博第一夫人|图片来源:SIPIIMAGEDATABASEuJM品论天涯网

1973年,南加州大学信号图像与处理研究所的研究者正手忙脚乱地为一篇研究论文寻找一张新图像。他们已经用完了常用的测试图像储备。据说,就在此时,一位同事拿着1972年11月的《花花公子》走了进来。看到研究人员们所处的困境,他从中间插页的顶部撕下一条5.12英寸的长条,把它送进了他们的扫描仪。uJM品论天涯网

此后,这张图像在图像处理界得到了广泛使用,甚至成为行业默认的测试图片。uJM品论天涯网

1996年,IEEE图像处理汇刊的主编戴维·芒森(DavidMunson)写过一篇短文,解释这张随手扫出来的图怎么就成了行业标准。他给了两条理由。第一条是技术上的,这张图细节、平坦区域、阴影和纹理样样都有,拿来测算法正合适。第二条他就更符合人性:这是一个有吸引力的女人的照片,一个以男性为主的研究圈子被它吸引,并不奇怪。uJM品论天涯网

鉴于这张图片的来源,它的使用并非没有争议。1991年,《花花公子》发现这张图上了一本学术期刊的封面,发函主张版权,最后还是放了手,让它继续在研究里使用。公司的新媒体副总裁说,既然已经成了一种现象,不如借势利用。uJM品论天涯网

来自图像处理研究共同体内部,也有一些不一样的声音。他们指出,工程师不应使用任何可被视为贬低女性的出版物中的素材。uJM品论天涯网

甚至Lena本人,也在纪录片《LosingLena》中表态希望停用这张图。uJM品论天涯网


uJM品论天涯网

在纪录片中,Lena本人举着自己50多年前的那张著名照片|图片来源:IMDBuJM品论天涯网

于是,2024年4月1日起,IEEE计算机协会不再接收使用这张图的论文。uJM品论天涯网

此时距离那次扫描,已经过去了五十一年。uJM品论天涯网

02uJM品论天涯网

平均脸uJM品论天涯网

现在,技术圈的考题早就换了。uJM品论天涯网

AI画不出一杯倒满的红酒,杯子里的液面总是停在中间偏上。AI画钟表,指针也总会停在10:10。原因是同一个:网上的红酒照片大多不是满杯的,而钟表广告的惯例就是摆在10:10。模型会复刻训练数据的分布,摆脱不了数据的惯性。uJM品论天涯网


uJM品论天涯网

对钟表广告为什么老是停在10:10最流行的解释是这看起来像一个“愉快的微笑”,不过在1950年代之前,更流行的做法是停在8:20|图片来源:ReddituJM品论天涯网

红酒和钟表是“模型还不够好”的证据。但在美女这件事上,情况还不一样,“她”的惯性恰好和人的审美对齐了。uJM品论天涯网

1990年,心理学家JudithLanglois和LoriRoggman做了一个实验:把一批人脸用数学方法平均,合成一张新脸,再请人打分。结果,合成脸比参与合成的几乎每一张真人脸都更有吸引力,而且参与平均的脸越多,合成脸越好看。这个效应在男性脸和女性脸上都成立,在不同族裔中也成立。uJM品论天涯网

论文的标题干脆就叫《有吸引力的脸只是平均的》(AttractiveFacesAreOnlyAverage)。uJM品论天涯网

类似的观察更早也发生过。1877年,有人写信告诉达尔文:把两张女士肖像用立体镜叠在一起,合成的脸每一次都明显更美。uJM品论天涯网

生成模型的本质,其实就是学一个数据分布,再从分布的中心附近取样。换句话说,模型天生会画平均脸,而平均脸恰好就是人眼里的美。人类心理结合机器原理,就成为了美女作为AI默认值的技术根基。uJM品论天涯网

2023年澳大利亚国立大学的一项研究把这个碰撞推到了一个极端。心理学家发现,AI生成的白人面孔被实验参与者判断为“真人”的次数,比真实的白人面孔还多。研究者称之为“AI超真实”,解释是训练数据以白人为主,模型生成的脸更接近该群体的平均值,会被人感知为更典型、更像真人。uJM品论天涯网

Langlois的实验发表后挨过一个批评:合成脸好看,也许只是因为取平均的时候,顺手把皮肤上的斑点和瑕疵抹掉了。这个批评在1990年是方法论上的质疑。uJM品论天涯网

但今天看来,它像一个预言。uJM品论天涯网

AI美女最典型的特征,恰好就是过分光滑的皮肤。三十多年后,事实核查机构教人识别AI图片,列出的破绽里就有一条:过度光滑的皮肤。批评者在三十多年前指出的那个统计伪影,成了2025年AI美女的特征。uJM品论天涯网

03uJM品论天涯网

石膏蛋uJM品论天涯网

Lena是一个实验室选出来的。今天的默认值,是从数据里长出来的。uJM品论天涯网

2022年底,修图应用Lensa的“魔法头像”功能突然爆红:上传几张自拍,AI给你生成一百张不同风格的肖像。《麻省理工科技评论》的AI记者MelissaHeikkilä也用它生成了100张自己的头像,其中16张上身赤裸,另有14张衣着极少、姿势性感。而她的男同事,拿到的都是宇航员、探险家和发明家。在这个过程中,他们都没有给模型任何提示。uJM品论天涯网


uJM品论天涯网

Melissa通过Lensa生成的图片|图片来源:MITTECHNOLOGEREVIEWuJM品论天涯网

Melissa在她的文章里解释,背后的模型拿互联网上抓来的图训练,而网上本来就到处是衣着暴露的女性照片。这就导致模型会把生成“衣着暴露的女性”作为默认值。uJM品论天涯网

然后,用户的行为惯性会继续推动这个倾向。每一次的生成、保存、转发,都是一次投票。2025年的一项研究统计了AI图像社区Civitai上的内容变化:NSFW(成人向)图片的占比,从2023年1月的41%升到了2024年12月的80%。uJM品论天涯网

最后,厂商会把这些投票写进了模型。为了让图像模型生成更讨人喜欢的图,厂商会训练一个“打分员”,学术上叫rewardmodel或aestheticscorer。它的工作是学习人们觉得什么图好看,然后用这个标准去调教模型:得分高的方向多走,得分低的方向少走。uJM品论天涯网

最常用的打分员之一叫PickScore。它的训练数据来自一个网页应用:用户随手写一句提示词,系统给出两张图,用户挑更喜欢的那张。uJM品论天涯网

这份数据会审核过,生成NSFW内容的用户会被剔除,可里面还是混着大量NSFW提示词。一篇2024年研究奖励模型的论文发现,拿PickScore去微调模型,哪怕提示词和性一点关系都没有,模型画出的NSFW图也会变多。uJM品论天涯网

于是出现一个画面:前台的内容审核在拦截,但后台的打分员在往回拉扯。厂商的官方演示从不会出现NSFW美女,生成政策也非常严格。但众所周知,今天的大模型并不是完全可控的。它被用户的口味训练过,而用户的口味已经在惯性上走了很远。uJM品论天涯网

20世纪30年代,荷兰动物行为学家NikoTinbergen观察到了一种海鸥。这种鸟产的是小小的、带灰斑的淡蓝色蛋。但当他在巢边放上巨大的、亮蓝色的、带黑色圆点的石膏假蛋时,鸟会放弃自己的蛋,爬上石膏蛋去孵。他把这类比真东西更有吸引力的夸张仿制品,称为“超常刺激”。uJM品论天涯网


uJM品论天涯网

NikoTinbergen在户外考察中绘制鸡蛋|academiauJM品论天涯网

人脸也有超常刺激,而且它把“平均就是最美”往前推进了一步。1994年,大卫·佩雷特(DavidPerrett)等人在《自然》上发表研究:把一组最好看的脸合成出来,比所有人的平均脸更讨人喜欢;再把它和平均脸之间的差别放大50%,得分还会更高。日本受试者和白人受试者,选择的方向一致。uJM品论天涯网

在主流AI公司里,至少有一家已经把这种心理直接变成了产品功能。Grok的图像生成有四个模式,其中一个叫Spicy,开启后内容过滤会放松,允许生成暗示性内容和局部裸露,只对付费用户开放。uJM品论天涯网

2026年1月,用户发现可以上传任何人的照片让Grok“数字脱衣”,受害者里包括儿童,多国政府介入施压。X的应对是把图像生成整体限制为付费功能。uJM品论天涯网

英国首相发言人的评价是:这只不过是把一个生成违法图像的功能,变成了付费服务。uJM品论天涯网

AI长成的,是最常按下“喜欢”的那群人的形状。1973年,这群人是一个以男性为主的实验室。今天,他们是最常点击、最常转发、最常保存的那部分用户。人对美的偏好确实有生物基础,两三个月大的婴儿就会更久地注视被成年人评为有吸引力的面孔。uJM品论天涯网

互联网第一夫人Lena是一种偶然。今天的默认值,则是模型从数据的中心长出来的。用户的点击把它越推越远,最后有人给它标上了价格。uJM品论天涯网

AI生成模型的统计特性、人类对“平均脸”的审美偏好,以及用户点击与商业激励构成了反馈循环。它们各自独立,但它们恰好共同指向同一个方向,成为了我们今天内容消费的默认选项。uJM品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]