摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 列表;numpy数组 2.邮件预处理 ①邮件分句 ②句子分词 ③大小写,标点符号,去掉过短的单词 ④词性还原:复数、时态、比较级 ⑤连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 安装完成,通过下述命令可查看nltk版本: impo 阅读全文
posted @ 2020-05-14 18:57 HvYan 阅读(211) 评论(0) 推荐(0)