摘要: 朴素贝叶斯垃圾邮件分类 1. 读邮件数据集文件,提取邮件本身与标签。 2.邮件预处理 2.1传统方法 2.1 nltk库 分词 nltk.sent_tokenize(text) 对文本按照句子进行分割 nltk.word_tokenize(sent) 对句子进行分词 2.2 punkt 停用词 fr 阅读全文
posted @ 2020-05-17 21:00 00小毅00 阅读(190) 评论(0) 推荐(0)