05 2020 档案
机器学习---12
摘要:import csvimport nltkfrom nltk.corpus import stopwordsfrom nltk.stem import WordNetLemmatizer# 词性pos赋值def get_word_pos(tag): if tag.startswith('J'): r 阅读全文
posted @ 2020-05-21 15:30 zzzkai 阅读(254) 评论(0) 推荐(0)
机器学习--11
摘要:1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 2.邮件预处理 邮件分句 句子分词 大小写,标点符号,去掉过短的单词 词性还原:复数、时态、比较级 连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 pip install nltk import nltk nl 阅读全文
posted @ 2020-05-14 16:53 zzzkai 阅读(225) 评论(0) 推荐(0)
机器学习--10
摘要:1.理解分类与监督学习、聚类与无监督学习。 简述分类与聚类的联系与区别。 -分类是指按照定好的类别对样本进行划分,聚类是指将相对靠近的样本进行统一划。分分类与聚类本质上都是将杂乱复杂的样本清楚、有目的性地整理在一起。 简述什么是监督学习与无监督学习。 -监督学习就是我先告诉程序,这种样本怎么怎么分类 阅读全文
posted @ 2020-05-08 10:12 zzzkai 阅读(152) 评论(0) 推荐(0)