GitHub社交网络数据集-2019年6月-kausthubkannan

GitHub社交网络数据集-2019年6月-kausthubkannan 数据来源:互联网公开数据 标签:GitHub,社交网络,开发者,节点分类,机器学习,Web开发

数据概述: 本数据集收集自2019年6月的GitHub公开API,包含一个大型GitHub开发者的社交网络。其中,节点代表至少关注过10个仓库的开发者,边代表开发者之间的相互关注关系。节点特征基于开发者的位置、关注的仓库、雇主和电子邮件地址提取。该数据集用于二元节点分类任务,目标是预测GitHub用户是Web开发者还是机器学习开发者。该目标特征根据每个用户的职位信息推导得出。

数据用途概述: 该数据集适用于社交网络分析、节点分类研究、机器学习模型训练等场景。研究人员可以利用此数据集进行社交网络结构特征分析;开发者可以利用此数据集进行用户行为模式研究;教育机构可用数据集作为教学案例,帮助学生了解社交网络分析和机器学习的基本概念。此外,数据集还适合用于评估机器学习算法在实际应用中的表现。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 2.28 MiB
最后更新 2025年4月22日
创建于 2025年4月22日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。