2021年12月28日

02补交作业

摘要: 02 环境搭建 1.安装虚拟机 下载 01 VirtualBox-6.1.16-140961-Win.exe,并安装完成。 2.安装Linux操作系统 下载02 ubuntukylin-16.04-desktop-amd64.iso,并完成安装。 在线安装教程http://dblab.xmu.edu 阅读全文

posted @ 2021-12-28 16:12 ZHY2号 阅读(15) 评论(0) 推荐(0) 编辑

2021年12月13日

09 hive 安装与操作

摘要: 一.安装Hive 1.下载解压重命名权限 2.配置环境变量 $HIVE_HOME 3.修改Hive配置文件 gedit 4.1配置mysql驱动 4.2下载合适版本的mysql jar包,拷贝到/usr/local/hive/lib目录下 ls 4.3在mysql新建hive数据库 show dat 阅读全文

posted @ 2021-12-13 23:25 ZHY2号 阅读(33) 评论(0) 推荐(0) 编辑

2021年11月29日

08 分布式计算MapReduce--词频统计

摘要: WordCount程序任务: 程序 WordCount 输入 一个包含大量单词的文本文件 输出 文件中每个单词及其出现次数(频数), 并按照单词字母顺序排序, 每个单词和其频数占一行,单词和频数之间有间隔 1.用你最熟悉的编程环境,编写非分布式的词频统计程序。(Python) 文件 分词(text. 阅读全文

posted @ 2021-11-29 19:26 ZHY2号 阅读(35) 评论(0) 推荐(0) 编辑

2021年11月15日

07HBase操作

摘要: 1.理解HBase表模型及四维坐标:行键、列族、列限定符和时间戳。 表:HBase采用表来组织数据,表由行和列组成,列划分为若干个列族。 行键:每个HBase表都由若干行组成,每个行由行键(row key)来标识。在表里面,每一行代表着一个数据对象。每一行都是由一个行键(Row Key)和一个或者多 阅读全文

posted @ 2021-11-15 21:08 ZHY2号 阅读(72) 评论(0) 推荐(1) 编辑

2021年11月2日

06 HBase安装与伪分布式配置

摘要: 1.下载压缩文件 2.解压 3.修改文件夹名 4.修改文件夹权限 查看hbase版本: 5.配置环境变量 编辑./bshahrc 使编辑内容生效 在任何目录下查看hbase版本 6.伪分布式配置文件 7.启动HDFS,启动Hbase 8.进入shell界面 9.停止Hbase,停止HDFS运行 阅读全文

posted @ 2021-11-02 22:31 ZHY2号 阅读(15) 评论(0) 推荐(0) 编辑

05 HDFS Java API应用实例

摘要: 一、在Ubuntu系统中安装和配置Eclipse 二、利用hadoop 的java api,向HDFS写一个文件。写入内容含自己的姓名学号信息。 三、从HDFS读取一个文件的内容并显示。 阅读全文

posted @ 2021-11-02 20:25 ZHY2号 阅读(14) 评论(0) 推荐(0) 编辑

2021年10月19日

第四次作业Hadoop思想与原理

摘要: 1.用图与自己的话,简要描述Hadoop起源与发展阶段。 从与谷歌系统的关系,关键时间节点,1.x,2.x与3.x的区别,不同公司发行版本等方面来讲。 (1)Hadoop最早起源于lucene下的Nutch。Nutch的设计目标是构建一个大型的全网搜索引擎,包括网页抓取、索引、查询等功能,但随着抓取 阅读全文

posted @ 2021-10-19 16:14 ZHY2号 阅读(38) 评论(0) 推荐(0) 编辑

2021年9月24日

03Linux与Hadoop操作实验

摘要: 34. window系统 Linux系统 hdfs 35 启动hdfs 查看与创建hadoop用户目录。 在用户目录下创建与查看input目录。 将hadoop的配置文件上传到hdfs上的input目录下。 运行MapReduce示例作业,输出结果放在output目录下 查看output目录下的文件 阅读全文

posted @ 2021-09-24 14:21 ZHY2号 阅读(27) 评论(0) 推荐(0) 编辑

2021年9月6日

01

摘要: 1.为什么产生大数据技术? 因为大数据的出现可以使我们的存储成本的大幅下降,那么电脑系统的运行、 计算速度就可以得到提升,我们也不必去一个个的收集我们需要的数据,直接通 过技术来让我们的脑力劳动得到解放。 2.为什么要学习大数据技术? 1)对大数据的处理分析正成为新一代信息技术融合应用的结点。 移动 阅读全文

posted @ 2021-09-06 20:29 ZHY2号 阅读(59) 评论(0) 推荐(0) 编辑

导航