上一页 1 2 3 4 5 6 ··· 161 下一页
摘要: 向量搜索、图遍历还是网络搜索 -- 本文介绍如何用 LangGraph 让智能体为每个问题选择合适的工具。 语义搜索、向量数据库迁移、Graph RAG。这些系统有一个共同缺陷——都是 Pipeline,固定执行序列,问题进、答案出,不论输入是什么。 真实问题并不符合这个假设。 "我们的退款政策是什 阅读全文
posted @ 2026-06-25 22:01 deephub 阅读(9) 评论(0) 推荐(0)
摘要: 做过地质统计学、储层建模或空间机器学习的人,大概都面对过这个选择:Kriging(经典地质统计学的主力工具),还是高斯过程回归(Gaussian Process Regression,GPR,其机器学习更加接近)。两者在数学上是相通的——都是基于协方差/核函数构建的"最佳线性无偏预测器"——但实际使 阅读全文
posted @ 2026-06-24 21:59 deephub 阅读(15) 评论(0) 推荐(0)
摘要: 现在训练一个 1000 亿参数的 Transformer 模型已经算不上什么新鲜事。GPT-3 有 1750 亿参数,Llama 2 最大版本达 700 亿,许多团队现在随口就把"100B 作为基准"挂在嘴边。但第一次真正上手训练的团队,往往会在一个意想不到的地方撞墙:不是算力,是内存。几乎所有人都 阅读全文
posted @ 2026-06-23 21:07 deephub 阅读(16) 评论(0) 推荐(0)
摘要: DiffusionGemma 的发布在 AI 研究圈子里引发了相当多的讨论,原因在于它触及了 LLM 文本生成方式的根本性问题。 标准 Gemma 4 系列依赖自回归解码(autoregressive decoding),从前到后逐个预测 Token。DiffusionGemma 则是离散文本扩散( 阅读全文
posted @ 2026-06-22 23:22 deephub 阅读(14) 评论(0) 推荐(0)
摘要: 微调LocateAnything-3B,实现当图像中有 300+ 个密集重叠目标、人工标注不可行时的实用方案。假设手头有一批种子发芽托盘、谷物质检图像或植物学调查照片。每张图像包含 100–500+ 粒种子,许多彼此重叠,部分被遮挡。老板(或导师)要求模型能精确定位每一粒。 在每张图像里手动为 30 阅读全文
posted @ 2026-06-21 21:53 deephub 阅读(38) 评论(0) 推荐(0)
摘要: 大多数 AI 应用都从一个简单的演示开始:用户提问、LLM 给出回答,所有人都觉得很厉害。 但是应用需要检索文档、调用工具、处理故障、路由请求、记住历史操作,还要在关键决策节点引入人工审核。这时这个聊天机器人已经变成了一套工作流。 很多 AI 项目就卡在这个转变上,演示和生产系统之间的差距,通常不在 阅读全文
posted @ 2026-06-16 21:25 deephub 阅读(12) 评论(0) 推荐(0)
摘要: 在当前的人工智能领域LLM 及其生成能力几乎独占了所有焦点。但再精密的 RAG Pipeline,能力上限也取决于那个沉默的引擎:搜索与聚类层。聚类不只是一项经典的数据科学任务,它是组织高维向量空间的核心机制——让 LLM 能在数十亿条文档和参数的海洋中定位正确的记忆。随着数据集规模持续扩大,沿用数 阅读全文
posted @ 2026-06-15 21:04 deephub 阅读(15) 评论(0) 推荐(0)
摘要: 没人提前规划的记忆问题 大多数 AI Agent 项目都从模型开始。该用哪个模型?是用 GPT、Claude、Gemini、Llama,还是本地部署的模型?要不要加工具?要不要加 function calling?要不要让它自主运行? 然后,第一个生产问题出现了。 Agent 忘记了用户上周说的话; 阅读全文
posted @ 2026-06-14 22:14 deephub 阅读(29) 评论(0) 推荐(0)
摘要: 相关性表示两个指标存在同步变动趋势,因果性则代表一件事直接促成了另一件事。两者之间有着一道需要用严谨论证来填补的鸿沟。测算相关性毫无门槛但是证明因果关系却极度困难。 本文将介绍我们为何习惯性地无视这道鸿沟,拆解变量同步变动却不具备因果关系的三种核心机制,并审视这些误区在数据科学领域的具体表现。阅读后 阅读全文
posted @ 2026-06-12 20:52 deephub 阅读(14) 评论(0) 推荐(0)
摘要: 2026 年用于构建 agent 的开源工具包已经已经得到了巨大的发展,所以本篇文章将从以下角度来帮助你如何选择最适合你的工具:延迟预算、审计追踪、模型可移植性、还是语言栈。 我们总结了7层需求,选择每一层的工具时,可以问三个问题: 主要约束是什么? 四个约束决定了大多数层的选择。延迟预算是每轮能花 阅读全文
posted @ 2026-06-11 21:20 deephub 阅读(15) 评论(0) 推荐(0)
上一页 1 2 3 4 5 6 ··· 161 下一页