摘要: RAG 为什么总是“看起来能用,实际不好用”? RAG 真正让人头疼的地方,从来不是“搭不起来” 如果你已经做过一段时间 RAG,大概率会有一种非常熟悉的感觉: 系统是能跑的,流程也是完整的,embedding 用的也不差,向量库、召回、rerank 该有的都有,但整体效果始终差点意思。 有时候是召回的内容看起来“擦边”, 有时候是答案明明就在文 阅读全文
posted @ 2026-01-22 16:34 大模型玩家七七 阅读(111) 评论(0) 推荐(0)
摘要: PPO vs DPO:不是谁淘汰谁,而是你用错了位置 为什么大家突然开始“只谈 DPO,不谈 PPO” 如果你最近在刷技术社区、看分享或者听内部讨论,很容易产生一种感觉: PPO 好像有点“过时”了,DPO 才是新一代对齐方案。 很多文章在反复强调: DPO 不需要 reward model DPO 更稳定 DPO 更简单 DPO 是对 PPO 的“降 阅读全文
posted @ 2026-01-22 14:57 大模型玩家七七 阅读(54) 评论(0) 推荐(0)
摘要: 你以为 PPO 很高级,其实它更像个“微调旋钮” 为什么 PPO 在真实业务里越来越重要 如果你是从论文或者课程里接触 PPO 的,那大概率会有一种“这东西看起来很厉害”的感觉。策略梯度、clip、KL 约束、reward model,一整套体系下来,很容易让人产生错觉:只要把 PPO 跑起来,大模型就能被“精细打磨”。 但真正进到业务里,你会发现 阅读全文
posted @ 2026-01-22 13:56 大模型玩家七七 阅读(42) 评论(0) 推荐(0)
摘要: PPO 为何成了大模型微调“最后的底牌”?一篇真正能跑通的工程实战指南 PPO 为何成了大模型微调“最后的底牌”?一篇真正能跑通的工程实战指南 开篇:无数大模型,是怎么被「一行 PPO 参数」训废的 如果你真正做过大模型微调,大概率经历过这些瞬间: reward 曲线一路狂飙,但模型开始胡说八道 模型突然学会“拍马屁”,却忘了基本常识 微调前还能正常回答,微调后像换了个 阅读全文
posted @ 2026-01-21 19:35 大模型玩家七七 阅读(81) 评论(0) 推荐(0)
摘要: 从零搭建向量数据库:实现文本语义检索实战 从零搭建向量数据库:实现文本语义检索实战 写在最前面:我一开始真没打算“自己搭一个” 说句实话,我第一次接触向量数据库的时候,根本没想过要自己搭一套。 原因也很现实: 市面上已经有不少成熟产品 文档、SDK、Demo 一应俱全 看起来直接用现成的就好 所以一开始我的想法非常简单: 我只需要一个“能做 阅读全文
posted @ 2026-01-21 18:46 大模型玩家七七 阅读(73) 评论(0) 推荐(0)
摘要: 向量数据库技术内核:从存储到检索,拆解其高效运作的秘密 向量数据库技术内核:从存储到检索,拆解其高效运作的秘密 写在前面:我也是“被向量数据库名词轰炸”过的人 说实话,我第一次接触向量数据库的时候,是有点抗拒的。 那会儿各种文章都在说: 向量数据库是 AI 时代的“新型基础设施” 没有向量数据库,大模型就跑不起来 它彻底改变了传统数据库的范式 结果我真正 阅读全文
posted @ 2026-01-21 17:42 大模型玩家七七 阅读(51) 评论(0) 推荐(0)
摘要: 从零开始:PPO 微调大模型实战(基于 PyTorch) 从零开始:PPO 微调大模型实战(基于 PyTorch) PPO 真正难的,不是算法本身 如果你已经看过一些 PPO 的原理文章,大概率会有过这种感觉: 好像每个字都认识,但真让我自己写代码,脑子还是一片空白。 这其实挺正常的。 至少我第一次准备动手写 PPO 的时候,也是这种状态。 问题不在你,而 阅读全文
posted @ 2026-01-21 12:14 大模型玩家七七 阅读(57) 评论(0) 推荐(0)
摘要: RAG 选型避坑:5 种主流方案对比,轻量场景 vs 大规模场景怎么选? 今天这篇文章,基于10+企业级RAG落地经验,拆解5种主流RAG方案的底层逻辑、实测效果,给出“轻量场景(数据量<10万条,并发<100 QPS)”和“大规模场景(数据量>100万条,并发>500 QPS)”的选型框架与实操步骤,帮你精准避坑。 阅读全文
posted @ 2026-01-20 11:28 大模型玩家七七 阅读(372) 评论(0) 推荐(0)
摘要: 10 万文档 RAG 落地实战:从 Demo 到生产,我踩过的所有坑 但当你真的把 RAG 从 Demo 推到生产,会发现三个问题几乎一定会出现: 文档一多,检索明显变慢 明明文档里有答案,模型却“搜不到” 本地 + 向量库 + 模型 + 服务,部署复杂度飙升 这篇文章不会再重复“RAG 是什么”这种内容,而是围绕一个真实企业级目标展开: 在 10 万级文档规模下,如何构建一个可用、稳定、可扩展的 RAG 系统。 阅读全文
posted @ 2026-01-20 10:18 大模型玩家七七 阅读(154) 评论(0) 推荐(0)
摘要: 大模型微调评测入门:看懂这些指标,才知道模型好不好 大模型微调评测入门:看懂这些指标,才知道模型好不好 从“瞎评”到“精准评”:大模型微调核心评测指标全拆解 大家好,我是七七!最近后台收到很多粉丝的共性提问:“我用LoRA微调了Llama 2 7B模型做情感分析,怎么判断它好不好用?”“微调后的文案生成模型,凭感觉比原版好,但是怎么证明?” 这其实戳 阅读全文
posted @ 2026-01-19 19:43 大模型玩家七七 阅读(147) 评论(0) 推荐(1)