谷歌请印度标注员给Reddit评论数据集打标签，错误率高达30％？

科技机器之心· 2022-07-19

机器之心报道

编辑：蛋酱

可以确定的是，人工标注员完全没懂 Reddit 网友的梗。

去年，谷歌发布了 GoEmotions 数据集，该数据集包含 58K 人工标注的 Reddit 评论，其中涉及 27 种情绪。

但一位名叫 Edwin Chen 的机器学习工程师却在使用该数据集的时候，偶然发现了一些令人哭笑不得的错误。

他们本来尝试自己在 GoEmotions 数据集上训练模型，注意到似乎存在一些深层的质量问题。于是他们随机抽取了 1000 条评论，在其中 308 条中发现了严重错误。

这里举一些有代表性的例子：

aggressively tells friend I love them—— 被标记为「愤怒」

Yay, cold McDonald's. My favorite.—— 被标记为「喜爱」

Hard to be sad these days when I got this guy with me—— 被标记为「悲伤」

Nobody has the money to. What a joke—— 被标记为「愉悦」

……

光是从抽取的评论中，他们就统计到了 25 种被错误标记的情绪。

在人工智能领域，数据标注是一项非常基础，但也非常关键的工作。好的数据对于训练模型至关重要，当数据面临如此离谱的错误时，又该怎么训练模型并评估模型的性能呢？

Edwin Chen 最后发问：「我们真的可以相信谷歌能够创造出公正的现实世界人工智能吗？」

所以，是什么导致了这些问题？

有人说：「有没有可能，他们没请人工标注员，或者请的人工标注员并未掌握流利的英语？」

据了解，GoEmotions 数据集的标注还是有人工参与的，只不过这些标注员是「以英语为母语的印度人」。

在论文的第 3.3 节中，有这么一段话：「我们给每个样本分配了三个评估者。对于那些评估者没有达成一致的样本，我们分配了两个额外的评估者。所有评估者都是以英语为母语的印度人。」

因为根据「Cowen et al. (2019b) 这项研究的结论，印度和美国两地的英语使用者的情绪判断维度很大程度上是相同的。

事实是，尽管掌握了流利的英语，标注员之中的许多人可能不了解所标注文本的文化、社会背景。但这却是关键要点之一，尤其是对于 NLP 数据集，标注者必须具备充分的文化意识。

也就是说，鉴于很多标注员可能缺乏必要的背景知识，即使大多数的数据标注都不存在争议了（如上图），也不代表标注结果就是完全正确的。

造成这种问题的另一个重要原因是，数据集中的数据都没有附加的元数据 (比如作者或子版块名称)。原论文中也提到了这一点：

语言不是处于真空之中的，它所在的版块等信息非常重要。谷歌在构建数据集时却忽略了这一点。

这不是一个孤立事件：作者还提到，假如连谷歌这种拥有大量资源的公司都难以创建准确的数据集，那么我们见过的其他数据集质量更是难以想象。

好消息是，已经有学者关注到了这个问题。上个月，吴恩达发起了「以数据为中心的 AI」倡议，他表示，专注于提升人工智能系统的数据质量将有助于释放其全部力量。

如果你想部署现实中 work 的机器学习模型，是时候关注高质量数据集而不是更大的模型了。

参考链接：

https://arxiv.org/pdf/2005.00547.pdf

https://www.surgehq.ai/blog/30-percent-of-googles-reddit-emotions-dataset-is-mislabeled

THE END

转载请联系本公众号获得授权

投稿或寻求报道：[email protected]

本文来自网络，不代表趣头条立场，转载请注明出处：https://www.ngnnn.com/article/4_30518.html

谷歌标注员印度_科技 reddit 人工智能英语

为您推荐

笑死！湖北文旅利川市旅游局美女局长全程英语介绍，评论区嗯搞笑

一位身着红裙的美女站在麦克风前，用流利的英语向世界介绍着中国湖北小城利川的旅游资源和人文魅力。她就是利川市旅游局的波波局长。

谷歌推出文本到图像模型Muse：生成图片质量更高、推理时间更短

作者 | 冬梅自 2021 年初以来，随着大量深度学习支持的文本到图像模型（例如 DALL-E-2、Stable Diffusion 和 Midjourney 等）的诞生，人工智能研究的进展发生了革命性的变化。近日，谷歌Muse AI 系统正式亮相。据谷歌 Muse AI 团队称，Muse 是一种文本到图像的 Transformer 模型，该模型可以实现先进的图像生成性能。我们提

盖茨盛赞ChatGPT：人工智能历史意义不亚于“PC或互联网诞生”

腾讯科技讯 2月3日消息，微软联合创始人比尔·盖茨表示，像ChatGPT这样的AI聊天机器人将变得与个人电脑或互联网同样重要。盖茨今日接受采访时表示:“AI将成为2023年最热门的话题。这是不可避免的。”他随后补充道:“ChatGPT将变得与个人电脑、互联网同样重要。”盖茨在20世纪80年代帮助开创了个人电脑时代。在微软和苹果等

谷歌街景独立 App 将于 2023 年停止运营

IT之家 11 月 2 日消息，安卓和 iOS 版谷歌街景 App 将于明年初停止运营，并将在未来几周从应用商店中删除。一位 Google 发言人证实，该应用将从 2023 年 3 月起停用。这是安卓和 iPhone 上的专用街景应用程序，允许用户使用谷歌公司的服务来获得世界各地的 360 度视图。需要注意的是，该功能不会从标准的谷歌地图应用中删

专访墨奇科技CEO邰骋：人工智能需要新的AI数据基础设施

“人工智能要发展到下一代，必然需要基础理论和基础设施的革新，特别是需要新的 AI 数据基础设施。”9月2日，新京报贝壳财经记者获悉，在近日举办的HICOOL2022全球创业者峰会上，AI（人工智能）基础技术和平台墨奇科技的项目团队获得“HICOOL 2022 全球创业大赛一等奖”。墨奇科技联合创始人、CEO 邰骋接受了新京报贝壳财

人工智能大会将举办智慧体育高峰论坛，发布AI＋体育蓝皮书

2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。主办方供图AI+体育，将成为世界人工智能大会的全新命题和新亮点。2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。论坛上将发布由上海人工智能研究院牵头，联合上海交通大学、上海体育学院、首都体育学院、同济大学等单位编制的国内首本《“AI+体育”蓝

大脑还有多少秘密？世界人工智能大会首开脑机接口主题论坛

在2022世界人工智能大会上，天桥脑科学研究院（简称TCCI）转化中心联合中国科学院上海微系统与信息技术研究所、脑虎科技、中国神经科学学会、上海市神经科学学会共同举办“脑·机智能融合-让大脑连接未来”论坛，这也是脑机接口首次以主题论坛的形式登陆世界人工智能大会。英国皇家工程院院士、上海交大医疗机器人研究院院

我国人工智能学科主要奠基人涂序彦逝世，享年 88 岁

IT之家 3 月 28 日消息，据北京科技大学消息，我国人工智能领域著名科学家、人工智能学科的主要奠基人、中国人工智能学会的主要创始人之一、第二和第三届中国人工智能学会理事长、北京科技大学计算机与通信工程学院教授涂序彦先生，因病医治无效，于 2023 年 1 月 1 日 0 时 10 分在北京逝世，享年 88 岁。IT之家附讣告原文

如何在特斯拉人工智能日上成功搭讪埃隆·马斯克

苹果谷歌牵头制定追踪行业规范草案防止功能遭滥用

【CNMO新闻】在2021年的春季发布会上，苹果推出了蓝牙追踪设备AirTag，该产品配合苹果设备的“查找”应用，可以追踪和查找重要物品。然而，也有用户发现这类设备可能会遭到滥用，例如将其放在他人不知情的地方，可以对个人进行跟踪。AirTag为了杜绝此类现象，苹果与谷歌宣布联合提交一份行业规范草案，帮助应对蓝牙定位追踪

梁建章：人工智能如何影响经济和各行各业

近日人工智能再次成为了热门话题。很多人好奇的是，人工智能未来到底会如何影响经济、人口和创新？今天，我跟大家分享个人的一些看法——谈谈人工智能对于经济以及各行各业的影响。自从深度神经网络出现以来，人工智能的发展速度超乎想象。ChatGPT的出现是个奇迹，超出了几乎所有计算机科学家的预料。一个简单的神经网络模

劈柴哥预告Bard将迎重磅升级，谷歌“最强大脑”能否超车ChatGPT？

财联社4月2日讯（编辑赵昊）上周，美国科技巨头谷歌公司推出了聊天机器人“巴德”（Bard）的测试版本。由于用户使用体验远不如ChatGPT，Bard反响平平。当地时间周五（3月31日），谷歌首席执行官"劈柴哥"桑达尔·皮查伊（Sundar Pichai）在播客节目中表示，这种状况可能很快就会改变，因为Bard将在未来几天从目前基于的LaM

科技巨头欧洲裁员不易，谷歌亚马逊设法“吸引”员工离职

勒紧裤腰带“过冬”的美国科技巨头现在碰到新的难题，想在欧洲搞大裁员谈何容易，特别是要在国内劳动法对员工保护力度位居欧盟成员国前列的法国和德国，更是难上加难。在美国，企业宣布大裁员后就能在几个月内解雇数百甚至数千名员工，许多公司已经这样做。而在欧洲，媒体发现，科技企业的大裁员已经停滞，因为在一些欧洲国

AI炒股新纪元？头部量化私募幻方宣布全力探索人工智能应用

头部量化私募幻方宣布成立新的独立的研究组织，探索AGI（即通用人工智能，Artificial General Intelligence）的本质。4月14日，幻方发布公告显示，幻方将集中资源和力量，全力投身到服务于全人类共同利益的人工智能之中，成立新的独立的研究组织，探索AGI的本质，“我们将充分而持续地投入，不做中庸的事，用最长期的眼光去

谷歌Stadia发布新试玩系统：玩家解锁特定成就完成试玩

【CNMO新闻】游戏试玩我们都曾有所接触，在过去游戏试玩版本通常是开发者在游戏上市之前发布的一个涵盖游戏部分内容的封包进行上传后，有意试玩的玩家进行下载测试，这样的方式已经延续了很久，其弊端就是玩家需要在游戏正式发布后在单独下载新的游戏包体，增加了重复下载的困扰。也有一些开发者选择游戏整包作为测试版本上

史上AI最高分！谷歌大模型创美国医师执照试题新纪录

杨净羿阁发自凹非寺量子位 | 公众号 QbitAI史上AI最高分，谷歌新模型刚刚通过美国医师执照试题验证！而且在科学常识、理解、检索和推理能力等任务中，直接与人类医生水平相匹敌。在一些临床问答表现中，最高超原SOTA模型17%以上。此进展一出，瞬间引爆学界热议，不少业内人士感叹：终于，它来了。广大网友在看完Med-PaL

谷歌计划打造全新搜索引擎应对必应等竞争推AI功能升级现有引擎

【美媒：谷歌计划打造全新搜索引擎应对必应等竞争将推出AI功能升级现有引擎】财联社4月17日电，据纽约时报消息，新必应等AI竞争者正成为25年来谷歌搜索业务的“最严重威胁”，作为回应，谷歌据悉正寻求打造一款由AI技术驱动的全新搜索引擎。查阅的内部文件显示，谷歌还在用AI功能升级现有引擎。据悉，谷歌正测试项目名为“

卷完模型卷芯片！为提升效率，微软准备推出专属人工智能芯片

在早期成功押注ChatGPT的研发公司OpenAI之后，市场发现，微软在其武器库中还拥有另一个秘密武器：自研人工智能芯片，这一芯片将为生成式AI背后的大型语言模型提供强大动力。4月18日周二，据媒体援引两位知情人士的话说，微软早在2019年就开始开发内部代号为Athena的AI芯片。其中一位知情人士称，一些微软和OpenAI的员工已经

真正的应用级量子人工智能距离我们还有多远？

·“量子科技是强国竞争的战略制高点，但不能一哄而上，低水平重复内卷，或片面追求发论文、抢专利，各自为战，闭门造车，而缺少真正的技术投入和系统配合。”·“当下量子系统的规模非常重要，而这很大程度上取决于芯片。”当前，发展量子计算和人工智能已成为世界各国的重要战略，两者交汇而生的量子人工智能更是发展迅速

消息称谷歌正测试一款类似ChatGPT的聊天机器人

鞭牛士 2月2日消息，据外媒报道，据知情人士表示，谷歌正在测试新的人工智能驱动的聊天产品，可能会影响未来公共产品的发布。这些产品包括一个新的聊天机器人，以及一种将其整合到搜索引擎的潜在方式。