09 2018 档案
摘要:Table1--mysql常用操作 主题 用例 说明 书写规范 数据库和表的名称不一定要大写。 输入文本类型的数据时都要加上单引号; ...
阅读全文
摘要:part4:归并排序归并排序的基本思想是分而治之(D&C)。D&C的工作原理如下:找出最简单的基线条件;确定如何缩小问题的规模,使其符合基线条件。归并排序的动态图如下: 注意点:在排序过程中我们引入一个中间列表(tmpArr),用来存放合并后的列表。代码实...
阅读全文
摘要:注意点zookeeper需要在各个节点的机器上搭建,它的启动也要在各个节点的$ZOOKEEPER_HOME/bin 下启动。环境搭建下载安装包并解压。在$ZOOKEEPER_HOME/conf 目录下,生成zoo.cfg文件并添加配 置。mv zoo_sam...
阅读全文
摘要:注意点Hbase 需要zookeeper。Hbase 需要在各个节点的机器上配置。集群中的启动顺序是Hadoop、zookeeper 和Hbase搭建步骤解压安装文件并配置环境变量。export HBASE_HOME=/usr/local/src/hbase...
阅读全文
摘要:注意点:安装Spark前先要配置好Scala运行环境。Spark和Scala需要在各个机器上配置。环境变量配置在~/.bashrc中添加如下的配置信息。#scala confexport SCALA_HOME=/usr/local/src/scala-2.1...
阅读全文
摘要:注意点:在启动Hive 的时候要先启动Hadoop和MySQL服务。Mysql 和 Hive 搭建在 yan00机器上。part1:MySQL配置相关安装和配置相关命令:Yum install mysqlYum install mysql-server/e...
阅读全文
摘要:hadoop 配置要点 软件 版本 java 1.8.0_151 hadoop 2.6.1part1 $HADOOP_HOME/etc/hadoop 目录下配置参数。slaves 配置从节点 yarn01,yarn02。 core-site.xm...
阅读全文
摘要:集群架构系统虚拟机软件Linux环境虚拟机台数集群主机名64位 WIN7 旗舰版VMware WorkstationCentOS-6.5-x86_643yarn00/yarn01/yarn02part1 Linux虚拟机搭建安装VMWare安装CentOS配...
阅读全文
摘要:part1:冒泡排序冒泡排序的核心:一步一步交换相邻位置的数据!代码示例for 循环实现。def bubble_sort1(arr): # 交换的细节 def swap(i,j): arr[i],arr[j]=arr[j],arr[...
阅读全文
摘要:简介堆排序是一种不稳定的排序算法。堆排序的时间复杂度为O(NlogN)。堆排序有两种实现方式。基于递归函数的实现,其额外空间复杂度为O(logN);非递归实现的额外空间复杂度为O(1)。这里讨论的是非递归的实现方式。堆分为大根堆和小根堆,是完全二叉树。对于完...
阅读全文
摘要:入坑机器学习有一定的门槛,不要怕!让老司机用一张图来告诉你如何进行机器学习。正文实验案例:房价预测步骤总结如下:导入需要的Python依赖库。两个重要的库:Numpy、Pandas。导入数据集(Data sets)。处理缺失数据(Missing data)和...
阅读全文
摘要:这是机器学习入门教程系列的第三部分,点击这里跳转到第一部分,点击这里跳转到第二部分。part6通过前面的学习,我们掌握了用已有数据对目标进行预测的方法。在使用模型的时候,有些人或许会好奇,模型究竟是怎样的?这里我们通过一个独特的视角——部分依赖图(Parti...
阅读全文
摘要:这是机器学习入门教程系列的第二部分,点击这里跳转到第一部分,有英文阅读能力的人点这里。part4让我们回到数据部分。一份数据,理想的状况是能直接拿来用。现实中往往不是这样,需要我们先对原始数据进行处理。这里我们这里讨论了一种情况:对缺失值的处理方式。处理缺失...
阅读全文
摘要:阅读此文,需要有python基础,有英文阅读能力的人点这里。part1这里不回答机器学习是什么,能做什么,只告诉你如何快速上手。熟悉你手中的数据。1.常用模块导入命令import pandas as pd2.文件导入命令FILE_PATH=".CSV后缀文件...
阅读全文

浙公网安备 33010602011771号