会员
周边
新闻
博问
闪存
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
deephub
overfit深度学习
博客园
首页
新随笔
联系
订阅
管理
上一页
1
2
3
4
5
6
7
8
9
···
161
下一页
2026年5月10日
三个工具,让 agent 在一次对话里完成研究、写码、调试与保存
摘要: agent 抓了一份 Python 文档,写了三段 list comprehension 示例,然后跑起来。前两段没问题第三段抛出了语法错误。它没有停在那里,而是去读错误信息、找到问题、把代码改了,再跑一次。这次过了,到这一刻"agentic" 这个词才真正落地。 单个工具是噱头,工具集才是真正的系
阅读全文
posted @ 2026-05-10 22:10 deephub
阅读(13)
评论(0)
推荐(0)
2026年5月7日
用 Playwright 和 LLM 实现自愈测试自动化
摘要: Playwright 是一个用于 Web 自动化和端到端测试的开源框架。如果我们将他和LLM结合,就可以实现“自愈”的自动化测试,这样如果UI有了改动框架不再硬性失败而是在检测到失败之后分析当前的 DOM(Document Object Model),基于规则的策略自动恢复出一个能用的 locato
阅读全文
posted @ 2026-05-07 21:51 deephub
阅读(43)
评论(0)
推荐(0)
2026年5月6日
为什么 MCP 在协议层会有 prompt injection的问题:工具描述如何劫持 agent 上下文
摘要: MCP(Model Context Protocol)当初被设计成 AI agent 的通用集成层,但它的架构有一个根本缺陷: 你接入的每一个 MCP 服务器,都会把它的工具描述原样放进 agent 的上下文窗口,每加一个就扩大一次攻击的可能性。 这就是Context Poisoning —— 即恶
阅读全文
posted @ 2026-05-06 22:07 deephub
阅读(47)
评论(0)
推荐(0)
2026年4月30日
BM25 + Vectors:为什么真实 RAG 系统通常两者都需要
摘要: RAG 是一个先选内容再做生成的系统;retriever 不搜索文档,它搜索 chunks。chunks 有问题了那么检索还没开始就已经完蛋了,所以我们可以用结构感知切分修这一点,把标题、代码块、警告框保持在一起。 但 chunks 完全连贯并不意味着就没事了,retriever 还需要正确的搜索信
阅读全文
posted @ 2026-04-30 21:30 deephub
阅读(20)
评论(0)
推荐(0)
2026年4月29日
从无状态到有状态:长时运行 Agent 的 5 种架构模式
摘要: 生产里真正有分量的工作流是能批量处理几千份保险理赔、跑完一周的销售触达节奏、跨系统对账等等的复杂工作,而这些是没办法塞进一次对话轮次里。因为他们的处理时间以天为单位,而不是秒。 一旦动手做这类长时运行的 agent,会遇到一个问题:大多数 agent 架构本质上是无状态的,每次交互都从数据库里把 c
阅读全文
posted @ 2026-04-29 22:02 deephub
阅读(17)
评论(0)
推荐(0)
2026年4月28日
LangChain 生态里的三层抽象:LangGraph、create_agent、Deep Agents
摘要: 要做这样一个 AI 助手:能上网查资料、能读写文件、能记住过去的对话,还能在执行有风险的操作前先征询人类的意见。听起来是不是很复杂,其实并不是LangChain 生态里现成的几套工具,把开发时间压到了几个小时。不过这里就多了一个问题: create_agent 、Deep Agents 和 Lang
阅读全文
posted @ 2026-04-28 20:05 deephub
阅读(18)
评论(0)
推荐(0)
2026年4月27日
DeepSeek-V4 深度解读:百万上下文背后的工程细节
摘要: 1M token 上下文设置下,DeepSeek-V4-Pro 的单 token 推理 FLOPs 仅为 DeepSeek-V3.2 的 27%,KV Cache 仅为 V3.2 的 10%;V4-Flash 更激进——FLOPs 10%、KV Cache 7%。百万上下文从演示用 demo,变成了
阅读全文
posted @ 2026-04-27 21:20 deephub
阅读(72)
评论(0)
推荐(0)
2026年4月26日
Graphify:为代码库构建知识图谱,以图遍历替代向量检索
摘要: Graphify 是一个 Python 工具,同时也是一个 Claude Code skill。它把分析工作一次性做完,把所有内容压缩成一张可查询的知识图谱,放到磁盘上。后续查询走图谱遍历,不再重新读取原始文件。项目简介的数字是:在混合语料库上每次查询的 token 量降低 71.5 倍。虽然这个数
阅读全文
posted @ 2026-04-26 20:46 deephub
阅读(73)
评论(0)
推荐(0)
2026年4月25日
2026年的 ReAct Agent架构解析:原生 Tool Calling 与 LangGraph 状态机
摘要: ReAct(Reason + Act)架构要解决的问题是开放式研究里最经典的问题。本文要做的是一个 Research Brief Agent:会上网搜索、抓取真实 URL、压缩证据,最终产出一份带真实引用的结构化简报。重点不在于功能,而在于 正确写法——不再依赖那种脆弱的 "Thought: / A
阅读全文
posted @ 2026-04-25 20:48 deephub
阅读(32)
评论(0)
推荐(0)
2026年4月24日
LangChain 还是 LangGraph?一个是编排一个是工具包
摘要: 现在介绍LangGraph 和 LangChain 的文章。每一篇的结论都差不多:简单流程用 LangChain,复杂的用 LangGraph。 但是简单和复杂都是相对的,如果是具体问题呢,比如说一个做代码分析、三个 Agent 串起来的流水线,到底该拿哪一个上线? 所以本文用同一个需求分别用两个框
阅读全文
posted @ 2026-04-24 21:12 deephub
阅读(19)
评论(0)
推荐(0)
上一页
1
2
3
4
5
6
7
8
9
···
161
下一页
公告