数据集:英文垃圾邮件分类数据集
此数据集可用于训练和评估垃圾邮件检测模型,特别是对于那些希望使用传统机器学习方法(如朴素贝叶斯分类器)的研究人员和开发者来说非常有用。通过该数据集,用户可以开发出高效的垃圾邮件过滤系统,减少用户的邮件负担,并提高信息安全性。该数据集包含了一组电子邮件样本,每个样本都标记为两类之一:正常邮件(ham)或垃圾邮件(spam)。
·
该数据集包含了一组电子邮件样本,每个样本都标记为两类之一:正常邮件(ham)或垃圾邮件(spam)。数据集以CSV表格格式存储,其中包含以下字段:
-
-
label
: 分类标签,指示邮件是否为正常邮件(ham)或垃圾邮件(spam)。text
: 邮件正文文本。label_num
: 标签的数值编码,其中“ham”编码为0,“spam”编码为1。
-
此数据集可用于训练和评估垃圾邮件检测模型,特别是对于那些希望使用传统机器学习方法(如朴素贝叶斯分类器)的研究人员和开发者来说非常有用。通过该数据集,用户可以开发出高效的垃圾邮件过滤系统,减少用户的邮件负担,并提高信息安全性。

魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐
所有评论(0)