摘要: 系列第 6 篇,也是收官篇。P4 结束时它已是一个能进客户 IdP、多租户隔离、发布前可审核的企业级知识库;P5 要谈的是"产品化"——Agent 多步检索/工具调用/护栏、多模态(OCR+表格问答)、私有化离线部署、计费(配额/用量/套餐)。但这一篇最想告诉你的是:产品化不是堆功能,而是"每项都有用户故事+验收标准"的纪律。我会如实写出四块能力的真实落地度——Agent 编排框架与护栏已落地但默认是单步、多模态 OCR 与表格问答已通但图片理解未做、私有化 L1 离线栈能跑通、计费有计量与硬配额底座却仍缺流式计量与套餐体系——并标出每个"刻意不做"的决定。技术栈:LlamaIndex Workflow + FastAPI + Ollama + Next.js。 阅读全文
posted @ 2026-08-17 18:00 南珂丶一梦 阅读(6) 评论(0) 推荐(0)
摘要: 系列第 5 篇。P3 结束时它已是"能上线"的工程化应用——但仍是单组织:所有人进同一个库、自己传自己发、账号密码本地一套。这篇把它升到"企业级":① 多租户隔离(TenantMembership + 会话 active_tenant_id,跨租户一律 404,应用层统一注入为唯一出口);② 完整审批流(draft→ready→pending_review→published 状态机 + 职责分离 SoD + require_approval 门禁);③ 企业 SSO(OIDC/PKCE,租户由 IdP 断言推导、禁止自选;httpOnly Cookie 会话替换 P3 的 localStorage 债务);④ 向量层 tenant 过滤 + 本地文件夹连接器 + 每库 IngestProfile + 脱敏审计导出。全文围绕 P4 四条设计红线 G1~G4 展开,含 15+ 个真实踩过的坑(含"提交人自审形同虚设""callback 自选租户=租户投毒""localStorage 存 token 的 XSS 与吊销弱点")。 阅读全文
posted @ 2026-08-16 09:05 南珂丶一梦 阅读(5) 评论(0) 推荐(0)
摘要: 系列第 4 篇。前三个阶段做完,这是一个"能答得准"的知识库——但也是个玩具:元数据躺在 JSON 文件里、大文件上传把 API 卡死、任何人都能读任何库、出了问题两眼一抹黑。 这一篇干一件事:从"能跑"到"能上线"。核心七块:① 元数据从 JSON 搬进 PostgreSQL(Alembic 迁移 + 备份/校验/回滚三步安全网); ② JWT 鉴权(为什么把 python-jose 换成 PyJWT)+ ③ 知识库级 RBAC;④ 大文件异步入库(ARQ Worker + 进度 + 失败重试 + 僵尸任务自愈); ⑤ 发布门禁("取消发布必须立刻从问答里消失"——为什么 Chroma metadata 过滤不可靠);⑥ 审计留痕 + 结构化日志 + token 费用统计;⑦ 上传限制与限流。 全文 12+ 个真实踩过的坑(含一次真线上事故:登录直接 500,根因竟是从没跑过迁移)。技术栈:FastAPI + SQLAlchemy 2.0 + PostgreSQL + ARQ/Redis + Next.js。 阅读全文
posted @ 2026-08-15 11:06 南珂丶一梦 阅读(6) 评论(0) 推荐(0)
摘要: 系列第 3 篇。P1 做出了"能答"的知识库,但"能答"不等于"答得对"。这一篇干一件事:让答案从"能答"变成"答得准",而且能**用数字证明**它变准了。 核心是四块:① 先攒一套 Golden Set 当"尺子",把规则打分写成纯函数;② 把问答链路节点化,naive / advanced 两条流并存、一键切换对比; ③ 混合检索(向量 ∪ BM25)+ rerank 补召回和排序;④ 引用高亮、来源页码、👍/👎 反馈收口。全文含 9 章、15+ 个真实踩过的坑(含"advanced 失败绝不能静默降级成 naive"这种反直觉但关键的设计), 代码与真实实现一致。技术栈:Python + FastAPI + LlamaIndex + Chroma + Next.js。 阅读全文
posted @ 2026-08-12 01:00 南珂丶一梦 阅读(13) 评论(0) 推荐(0)
摘要: 系列第 2 篇。P0 在命令行把 RAG 链路跑通了,但 CLI 没法给同事演示。这篇给 RAG 套上 Web 外壳: 用 FastAPI 把「建库 / 上传文档 / 流式对话带引用」暴露成 HTTP 接口,用 Next.js 做一个能上传、能对话、能看引用的页面。 全文分 6 章(目标 → 后端 → 前端 → 联调 → 跑起来 → 选型复盘),标注 24 个真实踩过的坑和解决方案, 重点包括:CORS 不能用 *、OpenAILike 绕过模型名枚举、SSE 必须关缓存头、EventSource 不能 POST、 思考模型 reasoning 走 raw.delta、切换 embedding 模型后维度不一致必须重建索引、NEXT_PUBLIC_ 前缀、SSE 分片截断、Private Network Access 等。 技术栈:Python + FastAPI + LlamaIndex + Chroma + Next.js 15 + React 19。 阅读全文
posted @ 2026-08-10 18:02 南珂丶一梦 阅读(11) 评论(0) 推荐(0)
摘要: 系列第 1 篇。P0 阶段的目标只有一个:不写一行前端代码,用两个 CLI 脚本把 RAG 全链路跑通—— 文档 → 切分 → 向量化 → 存入 Chroma → 相似度检索 → 拼 Prompt → LLM 生成带引用的回答。 全文分 5 章(准备 → 链路 → 验收),手把手跑通全链路,共标注 37 个实际踩过的坑和对应解决方案,包括那个卡了半天的 「模型名不在 OpenAI 枚举里」、「Chroma collection 命名规则」、「重复入库产生重复向量」。 技术栈:Python 3.12 + uv + LlamaIndex + Chroma + 任意 OpenAI 兼容 LLM。 阅读全文
posted @ 2026-08-09 22:37 南珂丶一梦 阅读(21) 评论(0) 推荐(0)
摘要: 前端出身,想把 RAG 这套东西真正做出来而不是看完就忘?这是一个 7 篇的实战系列的总纲。 我把「从零造一个企业级 RAG 知识库」拆成 6 个阶段(P0 地基 → P5 产品化),每个阶段都交付一个能跑、能演示的增量产品, 学什么完全绑定这一阶段要实现的功能。本篇讲清楚整体路线、技术栈、每阶段的产出与验收标准,并专门用一节回答「像 Dify 那样的工作流 / 对话流编排该在哪个阶段引入、代码放哪、引擎要不要自己写」, 另附路线层面最容易踩的 11 个坑。技术栈:Python + FastAPI + LlamaIndex + Chroma + Next.js + Docker Compose。 阅读全文
posted @ 2026-08-08 12:37 南珂丶一梦 阅读(28) 评论(0) 推荐(0)
摘要: 数字孪生实战:从零搭建室内导航系统 最近做了一个室内导航数字孪生项目,涉及多模型分层加载、MQTT实时定位、历史轨迹回放、自定义围栏告警等。本文记录核心实现和踩坑点,代码已脱敏。 一、项目背景 某商业综合体需要做一套室内导航系统,支持: 3D楼层可视化(单层/外部/内部模型分层加载) 实时定位导航( 阅读全文
posted @ 2026-07-13 02:11 南珂丶一梦 阅读(15) 评论(0) 推荐(0)
摘要: Cesium 导航模块设计 js/cesium/navigation/ 是 3D 地图 iframe 内的 路线预览 + 实时导航 子系统。对外通过 createCesiumNavigation(viewer, options) 创建实例,由 js/cesium/index.js 在路线查询、换层、 阅读全文
posted @ 2026-06-11 01:53 南珂丶一梦 阅读(80) 评论(0) 推荐(0)
摘要: 最近发现了一个挺好用的AI agent——hermesagent,是Nous Research做的自改进型AI,能自己学技能、记对话,还能跨平台用,TG、Discord都能连,用起来很方便。 我部署的时候踩了好几个坑,查了不少资料才搞定,今天把自己的部署过程记下来,算是个记录,也给有需要 阅读全文
posted @ 2026-04-20 21:00 南珂丶一梦 阅读(756) 评论(0) 推荐(0)