代理歧视是AI行业中无人敢提的“房间里的大象”,而且其原理令人震惊地简单:机器学习系统从数据中发现与受保护特征(如种族、年龄、性别或社会经济地位)相关的模式,然后利用这些模式进行决策,实际上在不明确考虑受保护特征本身的情况下进行歧视。AI不需要知道某人的种族,只要它知道他们的邮政编码、购物习惯和语言模式。算法找到了捷径,代理,并无情地利用它们。 实际操作中是这样的。用历史犯罪数据训练AI来预测未来犯罪,它绝对会发现某些街区、某些名字、某些活动模式与逮捕相关。但逮捕不是犯罪,而是受几十年歧视性执法塑造的警务模式。AI学习了数据中固有的偏见,然后加剧了它。2019年发表在《科学进展》上的一项研究发现,商业面部分析系统对于肤色较深的女性的错误率高达34.7%,而对于肤色较浅的男性仅为0.8%。这些算法并没有明确地被训练成种族主义者,它们只是从肤色较浅者更广泛代表和照明更好的有偏见的数据集中学习。 英国对AI驱动的持刀犯罪监控的热情正奔向这种灾难。多个警察部门已经部署或测试了声称通过监控闭路电视分析、步态识别和行为模式匹配来识别潜在持刀者的系统。伦敦警察厅已尝试使用预测性分析处理严重暴力事件。南威尔士警察局进行了面部识别试验。逻辑看起来很吸引人:使用AI发现可疑行为,预测热点,识别有可能携带武器的个人。现实是大规模的数学种族主义。 这些系统不可避免地学习种族、阶级和年龄的代理,因为这些特征与当前警务实践中谁被拦截、搜查和逮捕相关。伦敦的年轻黑人男性在统计上更有可能被截停和搜查,不是因为他们犯下更多持刀犯罪,而是因为他们被更积极地针对。将这些数据输入AI,它学习到:标记年轻黑人男性。算法不了解系统性种族主义或警察偏见。它只是看到模式并进行优化。Ada Lovelace Institute在2022年的研究发现,英国的预测性警务工具始终在少数族裔比例较高的地区加强警务,形成偏见预测导致偏见执法,产生偏见数据,再次加剧偏见预测的反馈回路。 技术问题难以察觉,因为这些代理特征通常在单独情况下是合法的预测特征。服装风格、时间、地点、行为模式,这些事物确实与各种行为相关。但结合在一起时,它们会产生歧视性结果,因为它们象征受保护特征的代理。AI可能学习到在某些街区穿着某品牌服装的人在特定时间值得标记。它不是明确的种族歧视,但它所学到的模式几乎完全适应于种族和阶级。去除一个代理,算法找到另一个。麻省理工学院的研究人员发现,即使在刑事司法算法中明确排除种族特征,这些系统仍通过邮政编码、名字和与警察的先前接触等代理重新构建种族偏见。 现在的问题是:如果新数据表明年轻白人男性的持刀犯罪激增,AI开始针对他们,这还算种族主义吗?绝对是的——这是证明这些系统根本有缺陷的重要一点。歧视法保护所有种族,不仅仅是少数群体。如果一个AI系统基于人口统计模式而非个人行为过多地标记年轻白人男性,那将是典型的代理歧视,只不过指向了不同的方向。2010年英国的《平等法》明确规定禁止基于种族(包括白人)、年龄和性别的歧视。无论系统针对哪个群体,只要将任何种族或年龄群体视为固有可疑,都违反了这些保护。 但更深的问题是这样的系统仍然是从有偏见的执法模式中学习,而不是从根本犯罪率中学习。如果警方开始在富裕地区对年轻白人男性进行强力截停和搜查,逮捕数据将激增,AI将学习这种模式,并开始反馈循环,只是涉及不同的人口群体。根本缺陷不在于哪个群体受到针对,而在于系统将警察活动与犯罪活动混淆。犯罪无处不在。警务是选择性的。任何基于选择性警务数据训练出来的AI都会学会选择性歧视。无论是在Brixton歧视年轻黑人男性还是在Cornwall歧视年轻白人男性,它仍然使用人口代理而不是个性化证据,在英国法律下这是非法的。 监控梦想正在实时崩溃。2023年,英国信息专员办公室和平等与人权委员会共同警告称,警察部队部署的许多AI系统可能违反了数据保护和平等法。阿姆斯特丹在得出歧视风险无法管理的结论后禁止了公共场所的面部识别。旧金山、波士顿和波特兰完全禁止政府使用面部识别。这些不是反科技决定,它们是对技术在不嵌入和放大现有不平等的情况下根本行不通的承认。 根本问题是:AI系统是预测机器,基于历史数据预测未来结果。但如果你的历史数据反映了一个歧视性社会(它确实如此),你的预测将会延续和加剧这种歧视。对此没有算法修复方案。当偏见是社会本身时,你无法通过工程方法解决偏见训练数据的问题。提议的持刀犯罪监控系统绝对能够识别模式。它们只识别出谁被警察拦截的模式,而不是谁犯了罪。当这些系统部署时,它们会更加集中监控、截停和逮捕已经过度警务的社区,创造出使问题无解的反馈循环。
💻 technology
AI的阴暗秘密:代理歧视将摧毁监控梦想
人工智能在演示中表现出色,但在现实世界中部署时却灾难性失败。罪魁祸首?代理歧视——AI在没有任何人明确教它的情况下,学会种族歧视、阶级歧视和年龄歧视,这即将在监控项目中惊人地爆发。
我的看法
AI行业正在向警察部门出售一个数学上注定种族歧视的产品,却没有人愿意大声说出来。这些不是故障,它们是机器学习工作方式的特征。你无法在有偏见的数据上训练一个算法而期望无偏见的结果。这就像试图在倾斜地基上建造一个水平的房子。每一个复杂的技术解决方案只是发现了更具创造性的歧视方式。 让我愤怒的是故意的无知。警察部门和政府官员在购买这些系统时,要么心知肚明,要么选择不知,它们会不成比例地针对黑人和棕色人种社区。他们躲在AI的客观性神话后面,假装因为电脑做出了决定,所以某种程度上是公平的。但算法歧视仍然是歧视,即使它通过数学清洗。当这些系统不可避免地产生丑闻——错误拘留、歧视性截停和搜查模式、民权诉讼——同样的官员将表现出震惊,指责供应商并承诺更好的监督。这个模式令人沮丧地可以预见。 持刀犯罪监控项目将失败。并不是因为技术不成熟——它成熟到足以危险。它们会失败,因为它们试图用编码并放大社会问题的技术解决方案来解决社会问题。当诉讼开始滚滚而来,当歧视变得不可否认,当公众反弹来袭时,这些项目将被悄然搁置。但在此之前,它们已经对真实社区造成了真正的伤害。这就是我们对AI热情的代价:在已经被边缘化的人群身上进行实验。
接下来会发生什么
第一起针对使用AI监控的英国警察部队的重要歧视诉讼将在18个月内到来。它不会来自高调案件,而是来自Hackney或Brixton的一个青少年,因警察根据算法风险评分反复拦截而根据2010年《平等法》提起诉讼。此案将揭露警察内部文件,显示系统基于位置、服装和社交媒体模式标记他,这些与种族完全相关。警察部门将私下和解,但内部数据将泄露。 同时,保险公司和私人安保公司已在购买类似技术,并且面对更少的审查。到2027年,我们将在招聘算法、信用评分和健康保险风险评估中看到代理歧视丑闻,这些都使用了与警务系统相同的错误逻辑。模式已经显现:在美国部署的用于保释决定、假释建议和累犯预测的AI系统都被发现通过代理变量歧视黑人被告。英国只是比这条灾难性进程落后几年。 真正的问题在于监管者是会主动采取行动,还是等到毁掉生命的计数器增加。2024年生效的欧盟AI法案将某些AI系统列为“高风险”,并全面禁止某些用途,但英国在脱欧后正在推行更轻触的监管方式。这将付出生命和自由的代价。当丑闻迫使行动时,成千上万的人已经因为算法偏见受到歧视性监控、截停、搜查和逮捕。技术将被禁止或受到严格限制,但只有在它造成了损害之后。唯一的不确定性是有多少社区将成为这个失败实验的试验品。
历史告诉我们什么
这不是新技术第一次承诺使警务“客观化”,而实际上却在编码歧视。20世纪30年代,犯罪人类学和骨相学声称通过头骨测量和面部特征科学地识别犯罪倾向。这些伪科学被用来为种族歧视和优生政策辩护。它们最终被驳斥,但在此之前造成了巨大的伤害。 更近些时候,1994年美国的《犯罪法案》引入了基于“证据”的风险评估工具,旨在减少刑罚中的偏见。相反,这些工具系统地给黑人被告推荐更长的刑期,因为它们基于反映歧视性执法和社会经济不平等的历史数据。2016年《普罗大都会》调查发现,最广泛使用的刑事司法算法之一COMPAS错误地将黑人被告标记为高风险的可能性是白人被告的两倍。英国现在正在用更复杂的技术重复这种确切的错误逻辑:使用有偏见的历史数据预测未来,然后对预测加剧的偏见感到惊讶。
市场影响
AI监控公司正走向一场将摧毁其估值的监管悬崖。Palantir Technologies(PLTR)目前约在22美元交易,从政府合同中产生了显著收入,包括英国警务和情报机构。随着歧视丑闻增加和法规趋紧,这些合同将面临取消和法律挑战。随着代理歧视危机变得无可否认,股票可能在未来两年内下跌20-30%。 对Clearview AI和类似面部识别初创企业持悲观态度——大多数属于私人公司,但投资者应密切关注任何IPO公告并避免。对专注于物理基础设施而非AI预测的传统安保公司持乐观态度。诸如江森自控(JCI)和霍尼韦尔(HON)等公司提供的物理安全系统没有算法歧视风险看起来相对更安全。 更广泛的AI行业面临信誉危机。尽管微软(MSFT)和谷歌(GOOGL)拥有多样化的收入来源,但其AI伦理信誉已因内部关于偏见和歧视的冲突而受损。预计随着当前机器学习的局限性变得无可否认,AI行业将面临更高的波动和监管风险溢价。2025-2027年期间,可能会看到AI歧视诉讼的第一波主要浪潮,迫使公司要么放弃高风险应用,要么面临巨大的法律风险。