当前位置：首页 >时尚 >移除ImageNet标签错误，模型排名发生大变化移除ImageNet标签错误

移除ImageNet标签错误，模型排名发生大变化移除ImageNet标签错误

2024-06-28 10:32:44 [百科] 来源：避面尹邢网

移除ImageNet标签错误，移除模型排名发生大变化

作者：机器之心 2022-09-16 15:10:12人工智能新闻数据集的标签质量，真的错误很重要。

此前，模型ImageNet 因为存在标签错误的排名问题而成为热门话题，这个数字说出来你可能会大吃一惊，发生至少有十万个标签是大变存在问题的。那些基于错误标签做的移除研究，很可能要推翻重来一遍。标签

由此看来管理数据集质量还是错误很重要的。

移除ImageNet标签错误，模型排名发生大变化移除ImageNet标签错误

很多人会使用 ImageNet 数据集作为 benchmark，模型不过基于 ImageNet 预训练的排名模型，最终结果可能会因为数据质量而变化。发生

移除ImageNet标签错误，模型排名发生大变化移除ImageNet标签错误

本文中，大变来自 Adansons 公司的移除工程师 Kenichi Higuchi 对《 Are we done with ImageNet? 》一文中的 ImageNet 数据集进行重新研究，在去除错误标签数据后，重新评估 torchvision 上发布的模型。

移除ImageNet标签错误，模型排名发生大变化移除ImageNet标签错误

从 ImageNet 中删除错误数据并重新评估模型

本文将 ImageNet 中的标签错误分为三类，如下所示。

(1) 标注错误的数据

(2) 对应多个标签的数据

(3) 不属于任何标签的数据

总结来看，错误数据大约有 14000 多个，考虑评估数据的数量为 50000，可以看出错误数据占比极高。下图是一些有代表性的错误数据。

方法

在不重新训练模型的情况下，该研究通过只排除标注错误的数据，也就是上述（1）类错误数据，以及从评估数据中排除所有错误数据，也就是 (1)-(3) 错误数据，来重新检查模型的准确率。

为了删除错误数据，需要使用一个描述标签错误信息的元数据文件。在这个元数据文件中，如果包含 (1)-(3) 类错误，信息将在「correction」属性中描述。

该研究使用一款名为 Adansons Base 的工具，Adansons Base 通过将数据集链接到元数据来过滤数据。这里测试了 10 个模型，如下所示。

10 个用于测试的图像分类模型

结果

结果如下表所示（数值是以 % 为单位的精度，括号中的数字是排名）

10 个分类模型的结果

以 All Eval 数据为基线，排除错误数据类型(1)，准确率平均提高 3.122 分；排除所有错误数据 (1)～(3) ，准确率平均提高 11.743 分。

和预想的一样，排除错误数据，准确率全面提高，这一点毫无疑问，因为与干净数据相比，存在错误数据很容易出错。

当在不排除错误数据的情况下进行评估，以及错误数据(1)~(3) 都被排除时，模型的准确率排名发生了变化。

本文中，错误数据 (1) 有 3670 个，占全部 50000 条数据的 7.34%，移除后准确率平均提高了 3.22 点左右。当移除错误数据后，数据规模发生了变化，单纯的比较准确率可能存在偏差。

结论

尽管并未特别强调，但是在做评估训练时，使用准确标记的数据很重要。

在比较模型之间的准确率时，以前的研究可能得出错误的结论。所以应该先对数据进行评估，但这真的可以用来评估模型的性能吗？

许多使用深度学习的模型往往不屑于对数据进行反思，而是渴望通过模型的表现性能来提高准确性和其他评估指标，即使是评价数据中包含错误数据，也没进行准确的处理。

当创建自有的数据集时，比如在业务中应用 AI 时，创建高质量的数据集直接关系到提高 AI 的准确率和可靠性。本文的实验结果表明，仅仅提高数据质量就可以将准确率提高约 10 个百分点，这表明在开发 AI 系统时不仅要改进模型，还要改善数据集。

然而，保证数据集的质量并不容易。虽然增加元数据的数量以正确评估 AI 模型和数据的质量很重要，但管理起来可能很麻烦，尤其是对于非结构化数据。

责任编辑：张燕妮来源：机器之心模型AI

(责任编辑：热点)

相关内容

推荐文章

秀域健康美容连锁机构地址在哪属于四川省企业吗？
秀域健康美容连锁机构地址在康定县支行宿舍三单元3-2号，属于四川省企业。 ...[详细]
科学抗衰
衰老是每个人必须面临的自然规律，但很显然，有的人刚过40岁便老态龙钟，有的人80岁了依然精神抖擞。为什么每个人的衰老速度不一样呢？能不能找到长寿基因，打破衰老定律，永葆年轻态呢？长寿基因的确存在——S ...[详细]
《原子之心》魅魔冰箱“诺拉”内部设定图别家冰箱制冷它发烧
《原子之心》官方近日公布了“魅魔冰箱”诺拉的内部细节设定图，在游戏内诺拉是为玩家提供装备升级的维修站，因为满嘴骚话，在游戏发售后获得了“电子魅魔”称号，风头甚至盖过了发售前官方大力宣发的双子舞伶。 “ ...[详细]
舍得酒业第三季度经营数据表现亮眼中秋国庆旺季动销效果显著
10月26日收盘后，舍得酒业股份有限公司(600702.SH，以下简称“舍得酒业”)披露2022年第三季度业绩报告。2022年1-9月份公司实现营业收入46.17亿元，同比增长28%，归属于上市公司股 ...[详细]
中国海油有限海南分公司一季度天然气增幅54% 有效保障粤港琼天然气需求
近日，中国海油有限海南分公司一季度业绩公布：天然气实现较大幅增产，比去年同期增加7.3亿立方米，增幅54%，占有限公司一季度天然气增量的72%，有效保障粤港琼天然气需求。今年年初，中国海油有限海南分公 ...[详细]
新调查数据显示 iPhone折旧率仅为安卓一半
目前手机的换代速度极快，保值率也是个问题，近日根据一份由BankMyCell发布的2021-2022年手机折旧报告，苹果iPhone手机最为保值，而同期安卓机型折旧率远超iPhone，甚至达到两倍以上 ...[详细]
《守望先锋2》小美女皇皮肤演示中国玩家无语：太丑了
近日油管主Warped Overwatch分享了《守望先锋2》小美女皇皮肤演示视频，展示了该皮肤的细节和实际游玩效果。一起来看看视频吧！演示视频：许多国内玩家看了这个演示视频后，都表示很无语，“太丑了 ...[详细]
MIUI 13升级计划：首批32款机型内测版已尝鲜
昨晚小米正式发布了MIUI 13大版本更新，带来了全新字体和隐私保护功能，而且流畅度有了大幅提升，将于4周后推送首批机型。小部件是MIUI 13新增功能之一，支持应用小部件提供快捷功能，同时增加可玩性 ...[详细]
安逸花还清后还收费吗取消方法是怎样的？
大家应该都知道，贷款都是要成本的，贷款平台会在借款成功后收取一定的费用，在安逸花借钱也一样。有不少人在安逸花上借的钱还清了想知道还会不会再收费，那么安逸花还清后还收费吗?这个要看具体是什么费用了，一起 ...[详细]
联想于海：中小企业发展涌现新机联想初创企业中心实现“双向赋能”
7月11日，联想科技瞭望塔2022 CVC创投周正式启幕，在“联想科技创新和双向赋能”主题论坛上，由联想中小企业客户业务群携手联想创投、联想百应等团队共同打造的科技创新企业服务平台——“联想初创企业中 ...[详细]

热点阅读

随机内容

友情链接

接受PR>=1、BR>=1，流量相当，内容相关类链接。