大型电影评论情感分类数据集-2011-hamditarek

大型电影评论情感分类数据集-2011-hamditarek 数据来源:互联网公开数据 标签:电影评论,情感分析,机器学习,自然语言处理,数据集,分类,ACL,学术研究

数据概述: 本数据集用于二元情感分类,包含比以往基准数据集更多的数据。数据集提供了一组25,000条高度极性的电影评论用于训练,25,000条用于测试。此外,还有额外的未标记数据可供使用。数据集以原始文本和预处理的词袋格式提供。更多详情请参见随数据集发布的README文件。

数据用途概述: 该数据集适用于情感分析、自然语言处理、机器学习等领域的研究和开发。研究人员可以利用此数据集进行词向量学习、模型训练和评估;教育机构可以将其用于教学和演示;开发者可以将其用于构建情感分析系统。此外,数据集也适合用于比较不同情感分析算法的性能,为相关领域的学术研究提供有价值的资源。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 25.2 MiB
最后更新 2025年4月22日
创建于 2025年4月22日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。