Bias in, Bias out: Annotation Bias in Multilingual Large Language Models

文章核心总结与创新点

一、主要内容

本文聚焦多语言大型语言模型(LLMs)中的标注偏差问题,系统分析了偏差的来源、影响、检测方法及缓解策略,核心内容如下:

  1. 问题背景:多语言LLMs的性能依赖人工标注数据集,但标注过程中存在的偏差(如任务框架、标注者主观性、文化差异)会导致模型输出失真,加剧社会危害(如对少数群体语言的误分类)。
  2. 偏差分类:提出三类标注偏差类型——
    • 指令偏差:源于标注任务设计(如提示词措辞、标注指南、界面设计)中的隐含假设;
    • 标注者偏差:来自标注者的个人倾向、认知启发式、人口统计学特征等;
    • 语境与文化偏差:因语言规范、文化世界观差异及多模态线索解读不同导致。
  3. 影响分析:标注偏差会通过“输入有偏,输出有偏”(Bias in, Bias out)效应传递给模型,造成不同群体间的性能差异(如深色皮肤女性的性别分类错误率更高)和表征伤害(如强化性别职业刻板印象)。
  4. 检测方法:综述了标注偏差的检测技术,包括标注者间一致性(Cohen’s κ、Fleiss’ κ等)、模型分歧分析、元数据分析(如人口统计学差距计算)、多语言分歧分析等。
  5. 缓解策略:提出主动缓解(如招募多样化标注者、迭代优化标注指南)和被动缓解(如事后模型调整、语境去偏、多目标加权集成学习)两类策略,并扩展弱集成学习(WEL)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

UnknownBody

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值