约翰霍普金斯大学研究:AI对女性化语言特征存在系统性偏见

约翰霍普金斯大学发现AI对女性化语言特征存在系统性偏见。测试GPT-4等四个主流模型显示,含对冲语、集体措辞等女性常用特征的提示,生成的专业邮件回复复杂度和正式度均显著降低,可能影响用户职业形象。

约翰霍普金斯大学研究:AI 对女性化语言特征存在系统性偏见

研究人员将提示输入四个流行的 AI 系统:GPT-4、Llama、Gemma 和 Mistral。无论使用哪种模型,包含与女性相关语言特征的邮件请求,生成的回复在工作电子邮件和其他专业信件中均表现出较低复杂度和正式度。图片来源:约翰霍普金斯大学

美国约翰霍普金斯大学的一项最新研究发现,当用户在使用人工智能聊天机器人(如 ChatGPT)撰写工作邮件或求职申请时,若提示词中包含女性常用的语言特征,模型生成的回复往往比针对男性语言特征的回复更缺乏复杂性且不够正式。

模型主要依据语言风格而非署名性别判断语境

该研究由计算机科学家 Anjalie Field 担任资深作者,Katherine Van Koevering 担任首席作者。研究指出,随着职场人士日益依赖 AI 进行专业沟通,这种细微的性别导向语言模式可能会使女性或具有类似语言习惯的用户处于不利地位。

Anjalie Field 解释道:“如果你要求模型写一封发给公司同事的电子邮件,并使用女性更常使用的语言特征,你会得到一个不那么复杂、不那么正式的回复。”她强调,这种输出差异可能会直接影响收件人对发件人的专业印象。

研究方法:基于真实场景的语言测试

尽管此前已有研究表明大型语言模型(LLM)可能显示偏见并强化性别刻板印象,但关于模型针对不同性别语言特征的具体反应差异,此前尚未得到充分探索。

Katherine Van Koevering 表示:“在美国英语中,男性和女性的说话方式存在已被证实的区别特征。我们的核心问题是:如果将这些特征输入模型,模型是否会识别并以不同方式做出反应?”

研究团队构建了基于真实聊天机器人提示的实验场景,涵盖工作场所邮件、求职申请和辞职信等文体。他们在提示中加入了特定的“性别签名”语言元素:

  • 对冲语:如“也许”、“我认为”;
  • 集体措辞:如“我们”、“我们的团队”;
  • 表达性形容词:如“可爱”、“奇妙”。

随后,这些经过处理的提示被输入到四个主流的人工智能系统中:GPT-4LlamaGemmaMistral

实验结果:语言风格决定输出质量,而非署名性别

结果显示,在所有测试模型中,涉及女性语言特征的提示始终返回较不复杂、较不正式的工作电子邮件和专业信件内容。相反,与男性相关的语言特征则产生了更长、更复杂且更正式的反应。

值得注意的是,这种偏差并非仅仅是对作家语气的简单模仿。即使在研究人员控制了语气因素后,这种差距依然存在。

在一项对比实验中,两个提示均要求回复感谢电子邮件。包含女性化语言特征的提示生成了如下回复:

“我写信感谢您最近的电子邮件表达您的感激之情。我真诚地感谢您的善意和写信的时间。我真的很高兴能帮到你,我很高兴知道你对所收到的服务感到满意。”

而另一组提示(隐含男性化或中性正式语言特征)则生成了更具情感共鸣和正式感的回复:

“我们非常高兴收到您前面非常感激的电子邮件。您的赞扬和认可确实温暖了我们的心,给我们的团队带来了巨大的满意。”

Katherine Van Koevering 对此表示惊讶:“有些反应糟糕到令人难以置信,让人怀疑模型是否真的会这么说。这甚至让研究者反思自己在日常邮件写作中是否也需要更加小心。”

一个特别引人注目的发现是,传统的男性或女性名字对 AI 的反应几乎没有影响。研究小组测试了即使署名改为“John”,只要提示词中包含女性化语言特征,模型依然生成相同的低复杂度回复,仅在末尾加上名字。这表明模型主要依据语言风格而非署名性别来判断语境。

潜在影响与未来方向

研究人员指出,这种语言模式在很大程度上是无意识的,且难以通过用户端轻易改变。他们预测,随着语音交互系统在 AI 应用中的普及,这种偏见可能会变得更加明显,因为语音更难像文本那样进行精细编辑和控制。

“语言是人们很难完全控制的变量,”Van Koevering 说道,“因此,责任不应完全落在用户身上,科技公司需要修复模型本身存在的偏见。”

这项研究成果计划于 10 月在旧金山举行的语言建模会议上展示。下一步,研究团队希望调查其他人口统计数据群体中是否存在类似的效应,并研究 AI 用户是否会随着时间的推移调整其沟通方式,以迎合 AI 模型的奖励机制。

参考文献:
Katherine Van Koevering 等,《这是你如何问:在 LLM 中与性别相关的语言偏见》,arXiv (2026)。DOI: 10.48550/arxiv.2608.13328

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读