会员
众包
新闻
博问
闪存
赞助商
HarmonyOS
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
Loading
Thank CAT
博客园
首页
管理
上一页
1
2
3
4
5
6
7
8
9
10
···
16
下一页
2023年3月26日
机器学习基础05DAY
摘要: 分类算法之k-近邻 k-近邻算法采用测量不同特征值之间的距离来进行分类 优点:精度高、对异常值不敏感、无数据输入假定 缺点:计算复杂度高、空间复杂度高 使用数据范围:数值型和标称型 一个例子弄懂k-近邻 电影可以按照题材分类,每个题材又是如何定义的呢?那么假如两种类型的电影,动作片和爱情片。动作片有
阅读全文
posted @ 2023-03-26 23:46 ThankCAT
阅读(125)
评论(0)
推荐(0)
2023年3月25日
机器学习基础04DAY
摘要: scikit-learn数据集 我们将介绍sklearn中的数据集类,模块包括用于加载数据集的实用程序,包括加载和获取流行参考数据集的方法。它还具有一些人工数据生成器。 sklearn.datasets (1)datasets.load_*() 获取小规模数据集,数据包含在datasets里 (2)
阅读全文
posted @ 2023-03-25 23:20 ThankCAT
阅读(215)
评论(0)
推荐(0)
2023年3月23日
机器学习基础03DAY
摘要: 特征降维 降维 PCA(Principal component analysis),主成分分析。特点是保存数据集中对方差影响最大的那些特征,PCA极其容易受到数据中特征范围影响,所以在运用PCA前一定要做特征标准化,这样才能保证每维度特征的重要性等同。 sklearn.decomposition.P
阅读全文
posted @ 2023-03-23 21:23 ThankCAT
阅读(52)
评论(0)
推荐(0)
2023年3月21日
机器学习基础02DAY
摘要: 数据的特征预处理 单个特征 (1)归一化 归一化首先在特征(维度)非常多的时候,可以防止某一维或某几维对数据影响过大,也是为了把不同来源的数据统一到一个参考区间下,这样比较起来才有意义,其次可以程序可以运行更快。 例如:一个人的身高和体重两个特征,假如体重50kg,身高175cm,由于两个单位不一样
阅读全文
posted @ 2023-03-21 21:27 ThankCAT
阅读(79)
评论(0)
推荐(0)
2023年3月20日
机器学习基础01DAY
摘要: 数据的特征抽取 现实世界中多数特征都不是连续变量,比如分类、文字、图像等,为了对非连续变量做特征表述,需要对这些特征做数学化表述,因此就用到了特征提取. sklearn.feature_extraction提供了特征提取的很多方法 分类特征变量提取 我们将城市和环境作为字典数据,来进行特征的提取。
阅读全文
posted @ 2023-03-20 23:11 ThankCAT
阅读(62)
评论(0)
推荐(0)
2023年3月10日
Hadoop-HA节点介绍
摘要: 设计思想 hadoop2.x启用了主备节点切换模式(1主1备) 当主节点出现异常的时候,集群直接将备用节点切换成主节点 要求备用节点马上就要工作 主备节点内存几乎同步 有独立的线程对主备节点进行监控健康状态 需要有一定的选举机制,帮助我们确定主从关系 我们需要实时存储日志的中间件 ActiveNam
阅读全文
posted @ 2023-03-10 22:16 ThankCAT
阅读(421)
评论(0)
推荐(0)
2023年3月8日
HDFS数据读写流程
摘要: HDFS 写入数据流程 宏观流程 | No | 步骤 | 详情 | | : | : | : | | 1 | 客户端向HDFS发送写数据请求 | hdfs dfs -put tomcat.tar.gz /bdg/ | | 2 | filesystem通过rpc调用namenode的create方法 |
阅读全文
posted @ 2023-03-08 16:50 ThankCAT
阅读(98)
评论(0)
推荐(0)
2023年3月7日
HDFS安全模式和机架感知
摘要: 安全模式 集群启动时的一个状态 安全模式是HDFS的一种工作状态,处于安全模式的状态下,只向客户端提供文件的只读视图,不接受对命名空间的修改;同时NameNode节点也不会进行数据块的复制或者删除 NameNode启动时 首先将镜像文件(fsimage)载入内存,并执行编辑日志(edits)中的各项
阅读全文
posted @ 2023-03-07 22:49 ThankCAT
阅读(84)
评论(0)
推荐(0)
2023年3月6日
HDFS节点的分类与作用
摘要: 文件的数据类型 文件有一个stat命令 元数据信息-->描述文件的属性 文件有一个vim命令 查看文件的数据信息 分类 元数据 File 文件名 Size 文件大小(字节) Blocks 文件使用的数据块总数 IO Block 数据块的大小 regular file:文件类型(常规文件) Devic
阅读全文
posted @ 2023-03-06 23:27 ThankCAT
阅读(289)
评论(0)
推荐(1)
2023年3月5日
HDFS文件目录与LiveNodes 数量关系
摘要:
阅读全文
posted @ 2023-03-05 22:33 ThankCAT
阅读(26)
评论(0)
推荐(0)
上一页
1
2
3
4
5
6
7
8
9
10
···
16
下一页
公告