05 2020 档案

摘要:1.读取 源代码: #读取文件 file_path=r'D:\PycharmProjects\201706120186罗奕涛\data\SMSSpamCollection' sms=open(file_path,'r',encoding='utf-8') sms_data=[] sms_label= 阅读全文
posted @ 2020-05-21 11:26 罗奕涛 阅读(294) 评论(0) 推荐(1)
摘要:1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 2.邮件预处理 邮件分句 句子分词 大小写,标点符号,去掉过短的单词 词性还原:复数、时态、比较级 连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 pip install nltk import nltk nl 阅读全文
posted @ 2020-05-14 12:05 罗奕涛 阅读(205) 评论(0) 推荐(0)
摘要:老师:MissDu 提交作业 1.理解分类与监督学习、聚类与无监督学习。 简述分类与聚类的联系与区别。 简述什么是监督学习与无监督学习。 分类:在已知的类中自己找相似性,自动归类。(先前已有类) 聚类:在大量的数据中把相似的聚成一类。(先前未有类) 监督学习:从大量的先前知识中来判断是什么类型。( 阅读全文
posted @ 2020-05-07 11:43 罗奕涛 阅读(240) 评论(0) 推荐(0)