11 2021 档案
08 分布式计算MapReduce--词频统计
摘要:def getText(): txt=open("D:\\test.txt","r").read() txt=txt.lower() punctuation = r"""!"#$%&'()*+,-./:;<=>?@[\]^_`{|}~“”?,!【】()、。:;’‘……¥·""" for ch in 阅读全文
posted @ 2021-11-24 17:22 咚咚锵上天堂 阅读(77) 评论(0) 推荐(0)
07 HBase操作
摘要:1.理解HBase表模型及四维坐标:行键、列族、列限定符和时间戳。 2.启动HDFS,启动HBase,进入HBaseShell命令行。 3.列出HBase中所有的表信息list 4.创建表create 5.查看表详情desc 6.插入数据put 7.查看表数据scan 创建用户信息 8.多版本实验: 阅读全文
posted @ 2021-11-05 09:11 咚咚锵上天堂 阅读(37) 评论(1) 推荐(1)
06 HBase安装与伪分布式配置
摘要:1.下载压缩文件 2.解压 3.修改文件夹名 4.修改文件夹权限 5.配置环境变量 6.伪分布式配置文件 7.启动HDFS,启动Hbase 8.进入shell界面 9.停止Hbase,停止HDFS运行 阅读全文
posted @ 2021-11-02 09:21 咚咚锵上天堂 阅读(27) 评论(0) 推荐(0)