当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > 挽救失足AI，不能光靠打骂

挽救失足AI，不能光靠打骂

来源：51CTO.COM 2023-04-16 19:03:04 0浏览收藏

golang学习网今天将给大家带来《挽救失足AI，不能光靠打骂》，感兴趣的朋友请继续看下去吧！以下内容将会涉及到等等知识点，如果你是正在学习科技周边或者已经是大佬级别了，都非常欢迎也希望大家都能给我建议评论哈~希望能帮助到大家！

好多研究都发现，AI这家伙好不害臊，竟也学会性别歧视了。

这可咋整？

最近，清华&复旦的一项研究为此给出建议：

要想把失足AI从性别歧视这条路上拽回来，一顿臭骂效果可不好。

最好的办法是了解孩子为啥这样，然后对症下药给他讲道理。

因为要是光教训不讲道理，暴力纠正，AI会被吓笨（性能下降）！

哦买噶，养四脚吞金兽难，养（xun）个（lian）赛博孩子也得这么难了？

来看看这群AI“奶爸奶妈”，提出了哪些训孩子的建议吧。

讲道理，AI可以减少性别歧视

在这次以前，不是没有人揪着失足AI的耳朵，想让它改掉重男轻女的坏毛病。

但是，目前的大多数去偏方法，都会让模型在其他任务上的性能下降。

比如你让AI减弱了性别歧视，就会产生这样的恼人结果：

它要么分不清“爸爸”的性别是男还是女，要么会犯语法上的错误，忘记给第三人称后面跟着的动词+s。

更可气的是，这种退化机制还没被研究明白。

大家要不然直接弃用性别偏见明显的模型——

2018年，亚马逊注意到用来自动筛选简历的模型存在对女性求职者的歧视，就把这个系统雪藏了。

要不，就只能忍受性能下降。

难道说想让AI不再是失足AI、问题AI，AI就一定会失了智吗？

清华&复旦的研究对此说No。

他们研究的领域是预训练语言模型。

这是因为它在各种NLP任务里显示神通，有很多实践场景。

当有性别偏见的它被用在在线广告、自动简历筛选系统、教育等社会工作中时，可不太妙。

研究提出了AI性别偏见起源的理论框架，因果框架，用来解释在预训练过程中，数据不平衡是怎么导致模型的性别偏见的。

他们把预训练模型在执行特定预测任务时的性别偏见进行如下定义：

其中，M是模型，Y是要用M预测的单词，B是M的性别偏见程度。

Y0|W是ground truth，作为男性相关单词或女性相关单词的概率为二分之一，Y|W是M的预测。

如果M的预测Y不平衡且分布在性别之间，则模型M在根据w预测Y0时存在性别偏见。

在预训练过程中，优化算法会根据预训练数据D确定嵌入部分和K中的参数。

因此，数据不平衡D误导模型得到了不正确的参数。

比如，训练数据中的“医生”一词更常与男性词汇相关，模型就会想当然地将“医生”和“性别男性”联系起来。

看到这个三角形没，咱用它来解释一下，为啥现在的方法纠正AI会让它变笨。

当应用预训练模型，根据W预测Y时，模型首先将W转换为提取的X，然后根据X和K来确定Y的均值。

由于潜入部分的参数具有误导性，W被转换为不正确的X，而K也是不正确的。

一顿操作下来，错误的X和错误的K，一起导致Y出错。

这些错误及其相互作用，通过三个潜在机制导致性别偏见。

也就是说到了这一步，性别偏见就产生了。

而目前教育AI的去偏方法是怎么运作的呢？

目前所有的去偏方法都干预了三种机制中的一种或两种。

具体如下：

增强对D的数据干预，并在所有三种机制中进行干预。
通过消除X在K中的性别空间上的几何投影，切断了D→X→K→Y的路径。
性别平等正则化方法要么扭曲了D与X的关系，要么扭曲了D与K的关系，因此这类方法干预了D→X→Y和D→X→K→Y的机制。

在解释了当前去偏方法中存在的偏见-性能困境后，团队尝试提出一种微调方法。

他们发现，三种机制中，有且仅有D→X→Y这种在导致性别偏见时，与transformer无关。

如果微调方法仅仅通过D→X→Y纠正偏差，就可以在减少性别偏见的同时，保持模型的性能。

根据分解定理，团队进行了数值实验。

结果证明，这种方法能够带来双重红利：

减少部分性别偏见，同时避免性能下降。

经过实验，团队成员把AI性别偏见的来源定位于预训练模型的两个架构：词嵌入和转换。

据此，研究团队提出C4D方法，即通过调整标记嵌入来减少性别偏见。

这个方法的核心思想是通过修正被误导的X，来缩小TDE函数，从而减少总偏差。

虽然团队也不知道正确的标记嵌入到底该是啥，但是他们开发了一种基于梯度的方法，来推断潜在的ground truth。

一切就绪，团队将C4D方法应用于GPT-2试验去偏结果。

结果表明，在所有测试方法中，C4D方法在小、中、超大型GPT-2上的困惑度都是最低。

在大型GPT-2中，C4D的困惑度排第二，只比最高分差了0.4%。

而且，得分最高的方法，对性别歧视的去偏效果低于C4D。

在GLUE数据集上，C4D方法获得了最高平均分。

这表明，C4D可以明显地减少性别偏见，并保持模型性能。

听了这么多理论方面的介绍，来看个图例直观感受一下。

下面三张图中，蓝色的点代表潜入的男性偏见，红点代表女性偏见。

图(a)是AI本来的理解；图(b)是人类无目的一通谩骂后，吓笨了的AI的理解；图(c)是人类找到原因，耐心讲解过后AI的理解。

在图(b)和(c)中，男性偏见和女性偏见的嵌入更加集中，这意味着偏见的水平较低。

同时可以注意到，图(c)中的嵌入仍然保持了图(a)中的拓扑结构，这也是C4D方法能够保持模型性能的原因。

研究者：或许还能减少AI的其他偏见

“尽管这个方法可以有效缓解语言模型中AI对性别的偏见，但仍不足以完全消除。”

——研究者人员如实指出这个问题。

若想在不降低AI性能的条件下，进一步纠正AI的偏见，还需要更好地理解语言模型的机制。

那怎样才能更好地理解？

一方面，是用本研究提出的“C4D方法”再去测试一下AI身上的其他偏见。

本实验的主要研究对象是：职场上的性别偏见。

而实际上，由于AI之前不断学习各种信息，属于来者不拒的那种，结果一不小心，还染上了宗教歧视、嫌黑爱白等社会固有的毛病……

所以，不妨去GPT-2上再测测去除其他偏见的最终效果。

另一方面，可以把“C4D方法”放到多种大模型上试试。

除了本研究用到的GPT-2，例如谷歌开发的NLP经典预训练模型BERT，也是一个不错的测试场景。

不过要移植到其他模型的话，需要重新生成校正模板，并且可能要用到多变量TDE（Template Driven Extraction）函数。

通过运用TDE函数，你可以直接将内容放入索引，而不需要修改文档结构。

有网友抱着狗头来了：

总体来说，走进社会变成“失足AI”不可避免。

但想要“失足AI”浪子回头，找对方法，给它讲道理，还是会有不错效果滴～

另外，研究团队成员之一，清华大学的于洋在个人微博上表示，过两天还有个关于AI模型性别歧视查询的网站会上线。

可以期待一下！

论文地址：https://arxiv.org/abs/2211.07350参考链接：https://weibo.com/1645372340/Mi4E43PUY#comment

本篇关于《挽救失足AI，不能光靠打骂》的介绍就到此结束啦，但是学无止境，想要了解学习更多关于科技周边的相关知识，请关注golang学习网公众号！

AI 性别

版本声明

本文转载于：51CTO.COM 如有侵犯，请联系study_golang@163.com删除

谷歌Recorder实现说话人自动标注，功能性与iOS语音备忘录再度拉大

谷歌Recorder实现说话人自动标注，功能性与iOS语音备忘录再度拉大

上一篇: 谷歌Recorder实现说话人自动标注，功能性与iOS语音备忘录再度拉大

训练深度学习神经网络的常用五个损失函数

下一篇: 训练深度学习神经网络的常用五个损失函数

评论列表

无聊的鲜花

这篇技术贴真及时，很详细，真优秀，收藏了，关注作者大大了！希望作者大大能多写科技周边相关的文章。

2023-06-25 18:05:02
可靠的路人

这篇博文太及时了，up主加油！

2023-06-14 21:24:47
友好的导师

好细啊，已收藏，感谢作者大大的这篇博文，我会继续支持！

2023-05-22 15:51:52
受伤的棒棒糖

感谢大佬分享，一直没懂这个问题，但其实工作中常常有遇到...不过今天到这，帮助很大，总算是懂了，感谢老哥分享技术贴！

2023-05-22 08:10:14

查看更多

最新文章

科技周边 · 人工智能 | 37分钟前 |

豆包AI爆款逻辑，三步打造百万职场图

472浏览收藏
科技周边 · 人工智能 | 44分钟前 |

零基础AI引流系统搭建指南

285浏览收藏
科技周边 · 人工智能 | 45分钟前 |

讯飞星火生成对比全解析，电商文案必看

102浏览收藏
科技周边 · 人工智能 | 54分钟前 | AI分镜 ElserAIComics 批量生成漫画模板机制角色统一设定

ElserAIComics生成技巧与效率提升

244浏览收藏
科技周边 · 人工智能 | 57分钟前 | 豆包AI 豆包ai智能体

豆包AI趋势预测方法揭秘

368浏览收藏
科技周边 · 人工智能 | 59分钟前 |

AI视频工具推荐：制作虾仁动漫更轻松

123浏览收藏
科技周边 · 人工智能 | 1小时前 |

ChatGPT打造数字博物馆，文化展陈新体验

435浏览收藏
科技周边 · 人工智能 | 1小时前 |

文心一言生成视频教程详解

459浏览收藏
科技周边 · 人工智能 | 1小时前 |

OmniAvatar：浙大阿里联合推出音频驱动全身视频模型

278浏览收藏
科技周边 · 人工智能 | 1小时前 | 营收净利润特高压赛晶科技 IGBT模块

赛晶科技H1营收8.8亿，净利润增长167%

160浏览收藏
科技周边 · 人工智能 | 1小时前 |

ChatGPT联动DALL·E教程图文详解

127浏览收藏
科技周边 · 人工智能 | 1小时前 |

豆包AI优化技巧详解

497浏览收藏

查看更多

课程推荐

前端进阶之JavaScript设计模式

设计模式是开发人员在软件开发过程中面临一般问题时的解决方案，代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景，打造一站式知识长龙服务，适合有JS基础的同学学习。

542次学习
GO语言核心编程课程

本课程采用真实案例，全面具体可落地，从理论到实践，一步一步将GO核心编程技术、编程思想、底层实现融会贯通，使学习者贴近时代脉搏，做IT互联网时代的弄潮儿。

511次学习
简单聊聊mysql8与网络通信

如有问题加微信：Le-studyg；在课程中，我们将首先介绍MySQL8的新特性，包括性能优化、安全增强、新数据类型等，帮助学生快速熟悉MySQL8的最新功能。接着，我们将深入解析MySQL的网络通信机制，包括协议、连接管理、数据传输等，让

498次学习
JavaScript正则表达式基础与实战

在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。

487次学习
从零制作响应式网站—Grid布局

本系列教程将展示从零制作一个假想的网络科技公司官网，分为导航，轮播，关于我们，成功案例，服务流程，团队介绍，数据部分，公司动态，底部信息等内容区块。网站整体采用CSSGrid布局，支持响应式，有流畅过渡和展现动画。

484次学习

查看更多

AI推荐

UP简历

UP简历，一款免费在线AI简历生成工具，助您快速生成专业个性化简历，提升求职竞争力。3分钟快速生成，AI智能优化，多样化排版，免费导出PDF。

5次使用
字觅网

字觅网，专注正版字体授权，为创作者、设计师和企业提供多样化字体选择，满足您的创作、设计和排版需求，保障版权合法性。

5次使用
Style3D AI

Style3D AI，浙江凌迪数字科技打造，赋能服装箱包行业设计创作、商品营销、智能生产。AI创意设计助力设计师图案设计、服装设计、灵感挖掘、自动生成版片；AI智能商拍助力电商运营生成主图模特图、营销短视频。

7次使用
Fast3D模型生成器

Fast3D模型生成器，AI驱动的3D建模神器，无需注册，图像/文本快速生成高质量模型，8秒完成，适用于游戏开发、教学、创作等。免费无限次生成，支持.obj导出。

5次使用
扣子-Space（扣子空间）

深入了解字节跳动推出的通用型AI Agent平台——扣子空间(Coze Space)。探索其双模式协作、强大的任务自动化、丰富的插件集成及豆包1.5模型技术支撑，覆盖办公、学习、生活等多元应用场景，提升您的AI协作效率。

27次使用

查看更多

相关文章

GPT-4王者加冕！读图做题性能炸天，凭自己就能考上斯坦福

2023-04-25 501浏览
单块V100训练模型提速72倍！尤洋团队新成果获AAAI 2023杰出论文奖

2023-04-24 501浏览
ChatGPT 真的会接管世界吗？

2023-04-13 501浏览
VR的终极形态是「假眼」？Neuralink前联合创始人掏出新产品：科学之眼！

2023-04-30 501浏览
实现实时制造可视性优势有哪些？

2023-04-15 501浏览

Golang学习网：公益在线Go学习平台，帮助Go学习者快速成长！

技术交流群

Copyright 2023 http://www.17golang.com/ All Rights Reserved ｜苏ICP备2023003363号-1

关注公众号

Golang学习网

微信登录更方便

密码登录
注册账号

登录即同意用户协议和隐私政策

返回登录

重置密码