• 博客园logo
  • 会员
  • 众包
  • 新闻
  • 博问
  • 闪存
  • 赞助商
  • HarmonyOS
  • Chat2DB
    • 搜索
      所有博客
    • 搜索
      当前博客
  • 写随笔 我的博客 短消息 简洁模式
    用户头像
    我的博客 我的园子 账号设置 会员中心 简洁模式 ... 退出登录
    注册 登录
 






sfzyk

 
 

Powered by 博客园
博客园 | 首页 | 新随笔 | 联系 | 订阅 订阅 | 管理

2017年5月19日

第一周<单元一聚类>
摘要: K means 聚类算法 初始随机选择 而后不断更新 kmeans 应用 省份归类 调用kmeans方法所需要的参数 + n_clusters 指定的聚类中心 + init 初始聚类中心的初始化方法 默认k means++ + max_iter 最大的次数 默认300 + data 数据 + lab 阅读全文
posted @ 2017-05-19 14:11 sfzyk 阅读(158) 评论(0) 推荐(0)
 
第一周<导学>
摘要: 导学 + 欧氏距离 平方 + 曼哈顿距离 一次方 + 马氏距离 协方差(先标准化再计算距离)\\(d(x_{i},x_{j})=\sqrt{(x_{i} x_{j})^{T}s^{ 1}(x_{i} x{j})}\\) s为数据的协方差 + 夹角余弦 sklearn cluster sklearn. 阅读全文
posted @ 2017-05-19 12:50 sfzyk 阅读(137) 评论(0) 推荐(0)
 
总体<导学>
摘要: 有一些奇奇怪怪的数据集 波士顿房价数据集 使用 加载相关的数据集 重要参数 return_X_y 表示是否返回target (价格) 默认为False 同时返回data和target 鸢尾花数据集 类别分为三类 Iris Setosa,Iris Versicolour Iris Virginica 阅读全文
posted @ 2017-05-19 12:49 sfzyk 阅读(217) 评论(0) 推荐(0)