摘要:
RAG 真正让人头疼的地方,从来不是“搭不起来” 如果你已经做过一段时间 RAG,大概率会有一种非常熟悉的感觉: 系统是能跑的,流程也是完整的,embedding 用的也不差,向量库、召回、rerank 该有的都有,但整体效果始终差点意思。 有时候是召回的内容看起来“擦边”, 有时候是答案明明就在文 阅读全文
RAG 真正让人头疼的地方,从来不是“搭不起来” 如果你已经做过一段时间 RAG,大概率会有一种非常熟悉的感觉: 系统是能跑的,流程也是完整的,embedding 用的也不差,向量库、召回、rerank 该有的都有,但整体效果始终差点意思。 有时候是召回的内容看起来“擦边”, 有时候是答案明明就在文 阅读全文
posted @ 2026-01-22 16:34
大模型玩家七七
阅读(111)
评论(0)
推荐(0)
摘要:
为什么大家突然开始“只谈 DPO,不谈 PPO” 如果你最近在刷技术社区、看分享或者听内部讨论,很容易产生一种感觉: PPO 好像有点“过时”了,DPO 才是新一代对齐方案。 很多文章在反复强调: DPO 不需要 reward model DPO 更稳定 DPO 更简单 DPO 是对 PPO 的“降 阅读全文
为什么大家突然开始“只谈 DPO,不谈 PPO” 如果你最近在刷技术社区、看分享或者听内部讨论,很容易产生一种感觉: PPO 好像有点“过时”了,DPO 才是新一代对齐方案。 很多文章在反复强调: DPO 不需要 reward model DPO 更稳定 DPO 更简单 DPO 是对 PPO 的“降 阅读全文
posted @ 2026-01-22 14:57
大模型玩家七七
阅读(54)
评论(0)
推荐(0)
摘要:
为什么 PPO 在真实业务里越来越重要 如果你是从论文或者课程里接触 PPO 的,那大概率会有一种“这东西看起来很厉害”的感觉。策略梯度、clip、KL 约束、reward model,一整套体系下来,很容易让人产生错觉:只要把 PPO 跑起来,大模型就能被“精细打磨”。 但真正进到业务里,你会发现 阅读全文
为什么 PPO 在真实业务里越来越重要 如果你是从论文或者课程里接触 PPO 的,那大概率会有一种“这东西看起来很厉害”的感觉。策略梯度、clip、KL 约束、reward model,一整套体系下来,很容易让人产生错觉:只要把 PPO 跑起来,大模型就能被“精细打磨”。 但真正进到业务里,你会发现 阅读全文
posted @ 2026-01-22 13:56
大模型玩家七七
阅读(42)
评论(0)
推荐(0)
PPO 为何成了大模型微调“最后的底牌”?一篇真正能跑通的工程实战指南 开篇:无数大模型,是怎么被「一行 PPO 参数」训废的 如果你真正做过大模型微调,大概率经历过这些瞬间: reward 曲线一路狂飙,但模型开始胡说八道 模型突然学会“拍马屁”,却忘了基本常识 微调前还能正常回答,微调后像换了个
从零搭建向量数据库:实现文本语义检索实战 写在最前面:我一开始真没打算“自己搭一个” 说句实话,我第一次接触向量数据库的时候,根本没想过要自己搭一套。 原因也很现实: 市面上已经有不少成熟产品 文档、SDK、Demo 一应俱全 看起来直接用现成的就好 所以一开始我的想法非常简单: 我只需要一个“能做
向量数据库技术内核:从存储到检索,拆解其高效运作的秘密 写在前面:我也是“被向量数据库名词轰炸”过的人 说实话,我第一次接触向量数据库的时候,是有点抗拒的。 那会儿各种文章都在说: 向量数据库是 AI 时代的“新型基础设施” 没有向量数据库,大模型就跑不起来 它彻底改变了传统数据库的范式 结果我真正
从零开始:PPO 微调大模型实战(基于 PyTorch) PPO 真正难的,不是算法本身 如果你已经看过一些 PPO 的原理文章,大概率会有过这种感觉: 好像每个字都认识,但真让我自己写代码,脑子还是一片空白。 这其实挺正常的。 至少我第一次准备动手写 PPO 的时候,也是这种状态。 问题不在你,而
今天这篇文章,基于10+企业级RAG落地经验,拆解5种主流RAG方案的底层逻辑、实测效果,给出“轻量场景(数据量<10万条,并发<100 QPS)”和“大规模场景(数据量>100万条,并发>500 QPS)”的选型框架与实操步骤,帮你精准避坑。
但当你真的把 RAG 从 Demo 推到生产,会发现三个问题几乎一定会出现:
文档一多,检索明显变慢
明明文档里有答案,模型却“搜不到”
本地 + 向量库 + 模型 + 服务,部署复杂度飙升
这篇文章不会再重复“RAG 是什么”这种内容,而是围绕一个真实企业级目标展开:
在 10 万级文档规模下,如何构建一个可用、稳定、可扩展的 RAG 系统。
大模型微调评测入门:看懂这些指标,才知道模型好不好 从“瞎评”到“精准评”:大模型微调核心评测指标全拆解 大家好,我是七七!最近后台收到很多粉丝的共性提问:“我用LoRA微调了Llama 2 7B模型做情感分析,怎么判断它好不好用?”“微调后的文案生成模型,凭感觉比原版好,但是怎么证明?” 这其实戳
浙公网安备 33010602011771号