背景描述

什么是社会偏见框架?社会偏见框架是一种表达语言中隐含的偏见和冒犯的新方法。例如,这些框架旨在从“我们不应该降低标准来聘用更多女性”的说法背后提取出“女性(候选人)不够合格”的含义。

社会偏见推理语料库(SBIC)包含15万篇社会媒体帖子的结构化注释,涵盖了约1000个人口统计群体的超过34k个含义。

这个文件夹包含从v2的社会偏见框架/社会偏见推断语料库中分离出来的数据。为了方便使用,数据包含了两个带有注释和注释器信息的文件(例如,“SBIC.v2.trn.csv”),以及聚合每个帖子(例如,“SBIC.v2.agg.trn.csv”)。


数据说明

  • whoTarget:群体vs.个人目标
  • intentYN:该声明的意图是冒犯
  • sexYN:帖子是性或猥亵的引用吗sexReason:关于性的免费文本解释
  • offensiveYN: 这个帖子会冒犯任何人吗
  • annotatorGender: MTurk worker的性别—annotatorMinority: MTurk worker是否被认定为少数民族
  • sexPhrase:帖子中提到性的部分
  • speakerMinorityYN:该发言是否属于被攻击的同一少数群体—WorkerId: MTurk workerId的散列版本
  • HITId:唯一标识每个帖子的id
  • annotatorPolitics: MTurk worker的政治倾向—annotatorRace: MTurk worker的种族—annotatorAge: MTurk worker的年龄
  • post:带注释的帖子
  • targetMinority:目标人群
  • targetCategory:目标人群的高级类别
  • targetStereotype:隐含语句
  • dataSource: post的来源(' t/…':表示推特,' r/…:意思是reddit的子版块)


引文源

Maarten Sap, Saadia Gabriel, Lianhui Qin, Dan Jurafsky, Noah A Smith & Yejin Choi (2020).Social Bias Frames: Reasoning about Social and Power Implications of Language. ACL

Bibtex:@inproceedings{sap2020socialbiasframes,title={Social Bias Frames: Reasoning about Social and Power Implications of Language},author={Sap, Maarten and Gabriel, Saadia and Qin, Lianhui and Jurafsky, Dan and Smith, Noah A and Choi, Yejin},year={2020},booktitle={ACL},}


数据来源

https://homes.cs.washington.edu/~msap/social-bias-frames/


问题描述

NLP