保加利亚诗歌数据集1963-2021

保加利亚诗歌数据集1963-2021 数据来源:互联网公开数据 标签:保加利亚诗歌,文本生成,作者分类,文学研究,语言学 数据概述: 本数据集收录了从Chitanka.info网站爬取的保加利亚诗歌,涵盖了多个时期的作品。数据以CSV文件格式存储在chitanka-corpus.csv文件中,包含三个主要字段:作者(author)、诗题(title)和诗歌内容(poem)。每首诗的行尾使用换行符(newline)作为特殊标记,以分隔不同的行。 数据用途概述: 该数据集适用于文本生成、作者分类、文学研究和语言学分析等多种场景。研究人员可以利用此数据进行文本生成模型的训练,开发能够创作保加利亚诗歌的智能系统;也可以用于作者身份识别,通过分析诗歌风格和语言特征来判断作品的作者。此外,数据集还适合进行文学研究和语言学分析,帮助学者了解保加利亚诗歌的发展历程和语言特征。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 8.81 MiB
最后更新 2025年4月15日
创建于 2025年4月15日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。