强-大数据第二讲

Hadoop的背景起源一: GFS: Google File System

一、什么是大数据,本质?
(1)数据的存储:分布式文件系统(分布式存储)-----> HDFS: Hadoop Distributed File System
(2)数据的计算:分布式计算

二、如何解决大数据的存储?----> 分布式文件系统(HDFS,来源于GFS)
举例:网盘
(1) GFS: 没有硬盘的,数据只能存在内存中
(2) Hadoop的安装模式
(*)本地模式 :1台
(*)伪分布模式:1台
(*)全分布模式:3台

 

如何解决大数据的存储?

什么是PageRank?

 

posted @ 2019-07-12 10:33  苗苗姨的小狼狗  阅读(183)  评论(0)    收藏  举报