2020 年 5月随笔档案 - 卡哇伊黑猫

13-垃圾邮件分类2

摘要：1.读取 2.数据预处理 3.数据划分—训练集和测试集数据划分 from sklearn.model_selection import train_test_split x_train,x_test, y_train, y_test = train_test_split(data, target, 阅读全文

posted @ 2020-05-24 19:20 卡哇伊黑猫阅读(198) 评论(0) 推荐(0)

12.朴素贝叶斯-垃圾邮件分类

摘要：1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句名子分词去掉过短的单词词性还原连接成字符串传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() # sever地址改成 h 阅读全文

posted @ 2020-05-18 11:31 卡哇伊黑猫阅读(165) 评论(0) 推荐(0)

11.分类与监督学习，朴素贝叶斯分类算法

摘要：1.理解分类与监督学习、聚类与无监督学习。简述分类与聚类的联系与区别。（1）联系：将所有的数据按照对应的目标点分成几类；（2）区别：分类就是判断一个点属于哪个类别，整体数据是有划分类别，每个点都有对应的类别；聚类是将数据集中相似的数据划分为一起，没有数据类别。简述什么是监督学习与无监督学习阅读全文

posted @ 2020-05-11 13:55 卡哇伊黑猫阅读(149) 评论(0) 推荐(0)

卡哇伊黑猫

05 2020 档案

公告