多语言有毒言论检测数据集2023

多语言有毒言论检测数据集2023 数据来源:互联网公开数据 标签:有毒言论,社交媒体,自然语言处理,多语言,文本分类,情感分析,言论监测 数据概述: 本数据集收录了用法语、英语和阿拉伯语标注的推文,每条推文被标记为有毒或非有毒。数据集中,标签0表示非有毒推文,标签1表示有毒推文。该数据集为研究多语言环境下的有毒言论提供了丰富的资源。 数据用途概述: 该数据集适用于有毒言论检测、自然语言处理、情感分析和言论监测等多种场景。研究人员可利用此数据训练和评估多语言文本分类模型;社交媒体平台可借助数据识别并过滤有毒内容;政策制定者可基于数据制定更加有效的言论监管政策。此外,数据集也适合用于教育培训,帮助学习者理解多语言文本分析的技术和方法。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 6.82 MiB
最后更新 2025年4月14日
创建于 2025年4月14日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。