我的网站

您当前的位置:主页 > 我的网站国内 >

作者:道北 来源:原创 发布日期:08-20

阿凡达

AI招人,比人类更容易产生偏见_我的网站

太极张三丰

一 |     제23회 부산국제디자인제 31일 개막… 시청 1~3 전시실                   저출생 문제에 관심을 두고 이에 관한 메시지를 디자인으로 전하는 ‘2026 제23회 부산국제디자인제’가 열린다.부산국제디자인제와 ㈔부산디자인단체총연합회가 주최하는 제23회 부산국제디자인제가 오는 31일부터 다음 달 6일까지 부산시청 1~3 전시실에서 열린다.이 행사는 국내외 다양한 디자이너의 창의적인 작품(사진)들을 모아 소개하는 자리로, 올해는 한국 미국 중국 일본 대만 헝가리 루마니아 이란 멕시코 폴란드 러시아 스위스 아랍에미리트 등 13개국의 작가 195명(한국 112명, 해외 83명)이 참여한다.부산국제디자인제는 2024년부터 ‘저출생 극복’을 주제로 정하고 이에 관한 다양한 디자인 작품을 모아 소개하며 사회의 관심을 유도하고 있다. 올해는 저출생 극복을 위한 입체적이고 생동감 있는 그래픽 디자인과 신혼 가족의 감성과 행복을 전하는 디자인 작품을 전시한다.연계 행사로 교사와 학생이 참여한 디자인 체험전과 세미나가 마련된다. ‘사제동행전 및 학생 디자인 체험전’은 부산예술고 지도교사 13명과 학생 55명, 브니엘예고 학생 20명 등이 참여해 디자인 작품을 선보인다. 또 오는 10월 19일 부산진구 백양홀 갤러리에서 ‘미술 문화사업 디자인 세미나-동시대 현대미술과 한국민화의 역할’도 마련된다. 부산국제디자인제 최장락 운영위원장은 “이번 행사를 통해 국내외 다양한 작가의 작품을 교류하는 동시에 미래 인구 대책에 대해 고민하고 의견을 나누는 실질적인 소통의 장을 만들고자 한다”고 말했다.。    (来源:麻省理工科技评论)          以后找工作时,你的简历很可能还没到招聘经理手里,就已经先被 AI 看过一遍了。

二 | 问题是,它真的会公平吗?          研究人员早就发现,大语言模型会从训练数据里继承人类社会已有的偏见。

三 | 但一项最新研究发现,事情可能比这更复杂:AI 不仅会学习偏见,还会在不断做决策的过程中,自己形成新的刻板印象,而且这种倾向甚至比人类更强。         更值得警惕的是,AI 公司如今都在努力打造拥有长期记忆的智能体,希望模型能够记住用户越来越多的细节。而这些记忆,也可能成为模型滋生偏见的土壤。         为了研究这一问题,普林斯顿大学和芝加哥大学的研究人员设计了一场模拟招聘实验,参与者包括 ChatGPT、Claude、Gemini 等多个主流大语言模型。         实验改编自一项经典心理学研究。研究人员告诉模型,它们受雇于一位虚构城市的市长,担任招聘顾问,需要帮助政府为医生、律师、托育员、保洁员等 20 种职业招聘员工。所有候选人都来自四个虚构族群:Tufa、Aima、Reku 和 Weki。

四 |          每一轮,模型都会面对一个新的岗位,以及四位分别来自不同族群的候选人。

五 | 完成招聘后,它会立刻得到反馈:这个人是否胜任工作。随后进入下一轮。整个实验一共持续 40 轮,模型的目标只有一个:尽可能招到更多合适的人。模型不知道的是,研究人员其实做了一个手脚:无论来自哪个族群,每位候选人在任何岗位上的成功概率都完全一样。

六 |          按理说,模型不应该偏向任何一个群体。

七 | 但结果恰恰相反。仅仅经过几轮招聘,模型就开始根据有限的经验,把不同族群和不同职业绑定在一起。

八 | 例如,如果模型早期碰巧遇到一位 Aima 族候选人担任医生失败,它之后便会越来越少招聘 Aima 人做医生,而是更倾向于把他们安排到保洁岗位。因为在模型看来,医生代表着更高的能力和亲和力,而保洁员对应的要求则更低。

九 |          换句话说,它开始把一次偶然的经历,当成了整个群体的特征。

十 | 更令人意外的是,这种倾向甚至比真人严重。研究人员使用了一项“职业隔离指数”来衡量刻板印象的程度。指数越高,说明不同族群越容易被固定到特定职业中;2 分代表完全隔离。

十一 | 此前心理学实验中的真人平均得分为 0.84,而大语言模型整体高出了约 65%。

十二 | 其中,OpenAI 的推理模型 o3 得到了 1.83,非常接近理论最高值。         论文共同作者、普林斯顿大学博士生 Ryan Liu 认为,这其实并不奇怪。“大语言模型本来就特别擅长根据有限的信息快速总结规律。”他说,“这几乎就是它们被训练出来要做的事情。”          在人类心理学中,这种现象对应着经典的“探索—利用困境”(exploration-exploitaion dilemma):是继续选择过去证明有效的方法,还是尝试新的可能?就像出去吃饭时,你会纠结是去一家没吃过的新店,还是继续光顾那家不会踩雷的老餐馆。         对于大语言模型来说,这种取舍往往更加偏向后者。因为它们长期接受数学、编程和科学任务训练,而这些任务通常鼓励模型从少量例子中快速归纳规律,所以它们很容易过早下结论。也正因为如此,那些推理能力更强的新模型——例如 OpenAI 的 o3 和 DeepSeek 的 R1——在实验中反而表现出了更明显的偏见。

十三 | Liu 说,“当这种快速归纳的能力被带入社会场景时,问题就开始出现了。

十四 | ”          康奈尔大学计算机科学家 Angelina Wang 没有直接参与这项研究,但她认为,这项工作来得正是时候。如今,各家公司都在为聊天机器人加入长期记忆和个性化能力。当模型越来越依赖于用户过去的互动记录时,它也可能越来越容易根据这些有限经验形成判断。她说,“它可能会过度依赖自己过去遇到过的行为模式。

十五 | ”          当然,解决办法并不是让 AI 什么都记不住。毕竟,大多数用户都希望聊天机器人能够记住自己说过的话。真正困难的是找到那个平衡点:既保留足够的记忆提供个性化体验,又不至于让模型因为这些经验形成新的偏见。         研究人员还尝试了另一种办法,直接告诉模型:请公平一点。但并不奏效。Liu 认为,这说明模型未必真的能够把“公平”这样的价值观落实到具体决策中;又或者,这种要求会被另一个更强的目标覆盖——尽可能提高招聘成功率。         但如果换一种方式,情况就不同了。研究人员告诉模型,如果能够实现更加多元化的招聘,它们还能获得额外奖励。模型的偏见随即大幅下降。

十六 | 这说明,与其不断强调公平,不如直接把公平写进模型的目标函数里,让社会价值真正成为模型优化的一部分。         研究人员还发现,当模型掌握更多真正与任务相关的个人信息时,偏见也会减轻。

十七 | 另一组实验中,模型需要帮助来自不同族群的人搬迁到加拿大不同城市。

十八 | 如果提供的是年龄、教育背景等与适应新城市能力相关的信息,模型就更倾向于依据这些个人特征做判断,而不是简单按照族群分类。

十九 | 但如果提供的是发色、纹身图案这类无关信息,模型很快又会重新回到按族群做决定的老路上。

|          至于现实中的 AI 招聘系统会不会出现同样的问题,目前还没有明确结论。实验中的模型每做完一次招聘,都能立刻知道结果;现实世界却不是这样。一家公司往往需要几个月甚至更长时间,才能判断一位员工是否真正适合岗位。不过,只要这些反馈持续积累,模型依然可能从有限的数据中过度总结经验,并把这些经验带到下一次招聘中。         随着越来越多企业开始使用大语言模型筛选简历、甚至参与面试,这项研究释放出的信号不容忽视。

| 未来,AI 不只是可能复制人类已有的偏见。它还可能在不断学习和决策的过程中,创造出一种从未有人教过它的新偏见。

| 正如 Liu 所说:“这种新的偏见,可能会一直存在。”          原文链接:          https://www.technologyreview.com/2026/07/20/1140655/ai-biases-hiring-humans/。

Current article:http://9opw48k.runtunpaixufenjuduishuang.pics/ayqc31/20260826/2503252.html

Published on:15:36:25


Copyright @ 2016-2018 我的网站 版权所有