摘要: 原文链接http://zhhll.icu/2020/11/12/java%E5%9F%BA%E7%A1%80/%E5%8F%8D%E5%B0%84/%E5%8A%A8%E6%80%81%E4%BB%A3%E7%90%86/ 动态代理 动态代理有很多种方式,如jdk代理,cglib,ASM等 在说动态 阅读全文
posted @ 2021-01-14 21:20 拾光师 阅读(174) 评论(0) 推荐(0)
摘要: MapReduce 数据压缩:用 CPU 换 IO,这笔账怎么算? 数据压缩是 MapReduce 性能优化的"常规武器"——减少磁盘写入、减少网络传输、节省存储空间。但压缩不是白给的,它消耗 CPU。 核心逻辑就一句话:用 CPU 换 IO。 如果作业瓶颈在 IO(磁盘读写在等)→ 压缩能提速 如 阅读全文
posted @ 2026-09-24 15:15 拾光师 阅读(2) 评论(0) 推荐(0)
摘要: Python 常用模块:别从头造轮子,这些内置的和第三方的直接拿来用 Python 最值钱的东西就是它的生态——标准库加上 PyPI 上几十万的第三方包,几乎覆盖了你可能遇到的所有需求。 写代码的时候,遇到问题第一反应不应该是"自己怎么实现",而是"有没有现成的模块可以用"。 文件和路径:os、sy 阅读全文
posted @ 2026-09-23 14:47 拾光师 阅读(12) 评论(0) 推荐(0)
摘要: 为什么说线性模型是深度学习的基石?从 Scikit-Learn 谈起 很多刚接触深度学习的人,容易陷入一个误区。大家往往一上来就去研究复杂的网络结构,觉得基础的线性模型太简单,甚至有点过时。但如果你去拆解那些庞大的网络,你会发现,它们最后输出结果的那一层,往往还是最基础的线性模型。不理解这些基础,就 阅读全文
posted @ 2026-09-22 09:59 拾光师 阅读(6) 评论(0) 推荐(0)
摘要: MapReduce Shuffle 深度解析:数据从 Map 到 Reduce 的完整旅程 MapReduce 里有一句老话:"Map 和 Reduce 的代码好写,Shuffle 的调优最难。" Shuffle 是 Map 输出到 Reduce 输入之间的所有数据处理——分区、排序、溢写、拉取、合 阅读全文
posted @ 2026-09-21 17:51 拾光师 阅读(5) 评论(0) 推荐(0)
摘要: Python 单例模式:一个类只能有一个实例,到底怎么实现? 写程序的时候,有些东西全局只能有一份——配置管理器、日志记录器、数据库连接池。如果每个地方都 new 一个,资源浪费不说,状态还不一致。 单例模式就是干这个的:确保一个类在整个程序里只有一个实例,所有人都用它。 单例要解决的问题,先看一个 阅读全文
posted @ 2026-09-20 15:10 拾光师 阅读(7) 评论(0) 推荐(0)
摘要: MapReduce Join 操作:大表关联小表用 Map 端,大表关联大表用 Reduce 端 数据处理中,多表关联是家常便饭——订单关联用户、日志关联商品、销售关联库存。在 SQL 里一个 JOIN 就搞定,在 MapReduce 里得自己实现。 MapReduce 提供了两种 Join 方案: 阅读全文
posted @ 2026-09-18 13:00 拾光师 阅读(5) 评论(0) 推荐(0)
摘要: Python 的 @classmethod 和 @staticmethod:什么时候用哪个,一次说清楚 写 Python 类的时候,除了普通的实例方法,还有两种带装饰器的方法:@classmethod 和 @staticmethod。 刚接触的时候很容易搞混——"不都是类里的方法吗,为什么还要分三种 阅读全文
posted @ 2026-09-17 10:10 拾光师 阅读(10) 评论(0) 推荐(0)
摘要: pdf文件压缩 添加依赖 阅读全文
posted @ 2025-01-14 10:44 拾光师 阅读(83) 评论(0) 推荐(0)
摘要: 图片压缩 添加依赖 阅读全文
posted @ 2025-01-07 15:48 拾光师 阅读(117) 评论(0) 推荐(0)
摘要: 密码错误重试导致数据库超慢 有同事把项目的数据库密码配错了,导致其他所有连接该数据库的项目全部连接都 阅读全文
posted @ 2024-12-30 09:59 拾光师 阅读(123) 评论(0) 推荐(0)