摘要: 向量库不再囤数据:Milvus 3.0 零拷贝直读数据湖 做 RAG 的人大概都经历过这么个流程:数据在 S3 上的 Parquet 文件里躺着,你得先把它读出来,跑一遍 Embedding 模型,再把向量写进 Milvus。原始数据一份,向量数据又一份。数据湖一份,向量库一份。 然后问题就来了。数据更新了怎么办?向量过期了怎么办?两份数据怎么同步?半夜跑 阅读全文
posted @ 2026-08-26 20:35 Jackeyzhe 阅读(166) 评论(1) 推荐(1)
摘要: GitHub 宕机近 8 小时!一次 sidecar 配置失误,如何放倒全球最大代码平台 8 月 17 日晚,无数开发者像往常一样打开 GitHub,准备提 PR、跑流水线、找代码。结果等来的,不是页面,是超时、报错、转不完的圈。 Issues 打不开,PR 提不上,Actions 卡住不动,连 Copilot 都开始罢工。微博上有人调侃:"今天全世界的程序员都在摸鱼。" 但真相,比摸鱼 阅读全文
posted @ 2026-08-21 17:29 Jackeyzhe 阅读(309) 评论(0) 推荐(4)
摘要: 吴恩达看了1万份招聘启事 总结出AI时代最值钱的4项技能 事情是这样的。 昨晚摸鱼刷推,看到吴恩达发了一条长得离谱的推文,一千多个英文单词,配了一张图,叫The AI Engineering Skills Map,AI工程技能图谱。 我读了两遍,把图存了下来,然后老老实实从头到尾翻译了一遍。 很多不关注这个领域的朋友可能不知道吴恩达的分量。前百度首席科学家 阅读全文
posted @ 2026-08-20 00:44 Jackeyzhe 阅读(31) 评论(0) 推荐(0)
摘要: 我用 Codex 做周报自动化,第一件事是防止它胡写 时间都去哪儿了? 我每周最烦的时间点,基本就是写周报。 前阵子我粗略算了一下,过去 3 个月我光是手写 prompt、翻记录、拼周报,差不多花了 12 个小时。平均下来,每周 50 分钟左右。这里面写字的时间其实不多,大头都花在找材料上:翻 GitHub,看这周提交了什么;翻 Jira,看哪些 ti 阅读全文
posted @ 2026-06-17 14:46 Jackeyzhe 阅读(572) 评论(0) 推荐(0)
摘要: 让 3 个 AI 一起写公众号:一篇 Hermes 多 Agent 实操 写公众号最折磨人的不是动笔。是排队。 选题 30 分钟、查资料 1 小时、写稿 2 小时、审校 30 分钟、配图 20 分钟。每个环节都得盯着前一个 AI 跑完才能开始下一个。我后来意识到,我不是在写文章,我是在陪 AI 排队。 这篇要解决的就是这件事:用 Hermes 搭一个 3 Agent 流水线,把调研、写作、审校三件事拆给三个 AI 并行跑,整篇压缩到 10 分钟出初稿。 阅读全文
posted @ 2026-06-09 16:42 Jackeyzhe 阅读(759) 评论(1) 推荐(0)
摘要: 从零学习Kafka:调优 在这个系列的结尾篇,我们来聊一下 Kafka 有哪些调优策略。 阅读全文
posted @ 2026-05-19 11:09 Jackeyzhe 阅读(294) 评论(0) 推荐(1)
摘要: 从零学习Kafka:消费者组重平衡 本文我们一起来学习消费者组重平衡相关的知识。 阅读全文
posted @ 2026-05-18 21:33 Jackeyzhe 阅读(181) 评论(0) 推荐(0)
摘要: 从零学习Kafka:幂等与事务 前文我们聊了生产者压缩机制相关的知识点,压缩机制主要是为了节省资源并提高吞吐。本文我们再来看一下 Kafka 的可靠性机制。 阅读全文
posted @ 2026-05-12 10:02 Jackeyzhe 阅读(192) 评论(0) 推荐(0)
摘要: 从零学习Kafka:生产者压缩 前面了解了生产端的分区机制后,我们继续来看生产端的另一个重要的机制——压缩。 阅读全文
posted @ 2026-05-11 11:29 Jackeyzhe 阅读(165) 评论(0) 推荐(0)
摘要: 从零学习Kafka:生产者分区机制 在前面的文章中,我们主要学习了 Kafka 服务端的相关知识。从本文开始,我们将视角转到客户端。 阅读全文
posted @ 2026-04-28 16:16 Jackeyzhe 阅读(219) 评论(1) 推荐(0)