摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 源代码: 运行结果: 2.邮件预处理 邮件分句 名子分词 去掉过短的单词 词性还原 连接成字符串 传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() # 阅读全文
posted @ 2020-05-17 13:01 符秋雨 阅读(182) 评论(0) 推荐(0) 编辑