05 2020 档案

摘要:1.读取 2.数据预处理 3.数据划分—训练集和测试集数据划分 from sklearn.model_selection import train_test_split x_train,x_test, y_train, y_test = train_test_split(data, target, 阅读全文
posted @ 2020-05-23 21:36 seele233 阅读(186) 评论(0) 推荐(0)
摘要:1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 import csv filepath = r"D:\data\SMSSpamCollection" sms = open(filepath, 'r', encoding='utf-8') csv_reader = csv.read 阅读全文
posted @ 2020-05-18 09:54 seele233 阅读(184) 评论(0) 推荐(0)
摘要:1.理解分类与监督学习、聚类与无监督学习。 简述分类与聚类的联系与区别。 简述什么是监督学习与无监督学习。 2.朴素贝叶斯分类算法 实例 利用关于心脏病患者的临床历史数据集,建立朴素贝叶斯心脏病分类模型。 有六个分类变量(分类因子):性别,年龄、KILLP评分、饮酒、吸烟、住院天数 目标分类变量疾病 阅读全文
posted @ 2020-05-09 23:12 seele233 阅读(227) 评论(0) 推荐(0)