暑假周总结8
本周是暑假学习计划的第八周,也是大型数据库技术大作业集中收尾的一周。主要任务包括完成热词目录和解释的 Word 报告导出、检查系统整体功能、整理项目文档,同时对这八周学习的大数据、Redis 和 Java 后端知识进行阶段性总结。
首先完成了 Word 报告导出功能。根据作业要求,报告中需要包含所有热词目录以及对应的中文解释。因此后端首先按照分类查询热词,例如人工智能、大数据、云计算、数据库、网络安全、物联网等,然后查询每个热词的解释、热度和部分相关新闻信息,最终自动生成 Word 文档。
在生成 Word 时,我按照“一级分类标题—热词名称—热词解释—相关新闻”的结构组织内容。开始时所有内容只是普通文本,导出的文档虽然能打开,但格式比较混乱。因此后面增加了标题层级、字体大小、段落以及表格等格式,使生成的报告更加接近正式作业报告。
完成 Word 导出后,我对项目进行了完整测试。目前整个系统的基本流程已经形成:首先通过爬虫定期采集信息技术相关新闻,然后对文本进行清洗、中文分词和关键词提取;之后根据关键词权重进行自动分类,生成不同领域的热词目录;系统自动为热词保存中文解释,并记录包含该词的近期文章链接;统计分析结果存储到数据库并使用 Redis 缓存部分热点数据;最终前端通过词云、排行榜和关系图展示热词分析结果,同时支持查看热词详情和导出 Word 报告。
回顾最初的大数据案例,我也重新整理了 Hadoop 部分的完整数据流程:采集北京市政信件数据,通过 MapReduce 清洗后上传 HDFS,在 Hive 中建立数据表并使用 HiveSQL 进行离线统计,再通过 Sqoop 把分析结果导出到 MySQL,最后由 JavaWeb/Spring Boot 提供接口并使用 ECharts 完成图表展示。第二个热词项目实际上就是在这套思路上进一步扩展了爬虫、中文分词、自动分类、关系分析、Redis 缓存和 Word 导出。
本周总学习时间约 28 小时。其中项目完善和测试约 10 小时,Word 导出功能约 5 小时,项目文档和报告整理约 5 小时,Redis 和 Java 后端知识复习约 5 小时,解决遗留问题约 3 小时。
本周遇到的主要问题不再是某一个具体技术错误,而是不同模块之间的整合。例如修改数据库字段后,MyBatis 实体类、SQL、前端接口都可能需要一起修改;修改热度计算规则后,Redis 中原有的缓存也需要重新生成。这让我认识到真实项目开发并不是“一个功能写完就结束”,而是不同模块之间存在很多依赖关系。
Redis 方面,这一阶段已经学习了五种基本数据结构、缓存、过期策略、缓存穿透、缓存击穿、缓存雪崩以及基本的缓存一致性问题。虽然还谈不上熟练,但已经可以在 Spring Boot 项目中完成简单应用。
Java 后端就业路线方面,经过暑假学习,我对接下来的方向也更加明确。后续准备继续深入 Java 基础、JVM、并发编程、MySQL、Redis、Spring Boot、MyBatis、计算机网络、操作系统和 Linux,同时学习 Git、Docker 等开发工具,并继续完善自己的项目。
总体来说,这八周最大的收获并不是单独学会某一个框架,而是第一次比较完整地把数据采集、数据处理、数据库、后端、缓存和前端可视化串联起来。项目目前仍然有很多可以改进的地方,例如分类算法仍然以关键词规则为主,热词关系算法比较简单,爬虫稳定性也需要提高。但是至少已经从最开始“只知道作业要求中这些技术的名字”,发展到能够理解这些技术在整个系统中分别承担什么作用。
暑假八周的学习暂时告一段落,接下来准备继续完善项目代码和最终报告,同时按照 Java 后端就业路线系统复习基础知识。相比一开始盲目学习各种技术,现在的目标更加明确:既要能够写出项目,也要理解项目背后的基础原理,把课程作业逐渐变成自己真正掌握的项目经验。

浙公网安备 33010602011771号