刷新
英伟达算力卡全解析:型号规格、算力、采购限制与国内选型指南(2026年8月)

博主头像 文章时间:2026年8月9日 覆盖范围:卡的类型、算力规格、国内外采购限制、费用情况、国内选型建议 数据时效:重点覆盖 2026年2月—8月 的最新动态 数据来源:NVIDIA 官网、公开媒体报道(路透社、环球时报、第一财经等)、渠道报价(京东/算力租赁平台)、行业分析机构 一、核心结论速览 维度 ...

15天学会AI应用开发(二十)使用LangChain实现RAG检索功能

博主头像 ​之前的文章《15天学会AI应用开发(十三)上下文与RAG的阶段性总结》概述了检索RAG知识库的主要步骤,现在采用LangChain将其改造为更智能的本地RAG系统。 接下来基于LangChain框架与Chroma向量数据库,结合离线的文本嵌入模型和大语言模型,从零开始搭建本地的RAG检索系统。 一 ...

奇摩技术说:大模型编程助手的底层逻辑与实战

博主头像 奇摩技术说:大模型编程助手的底层逻辑与实战 一、大模型在编程领域的应用现状 近年来,大语言模型(LLM)在代码生成、调试和自动化领域的应用愈加成熟。客观来说,虽然市面上涌现了大量AI编程工具,但真正能将大模型能力融入开发者日常工作的产品并不多。多数工具停留在代码补全层面,无法理解项目的完整上下文,更 ...

15天学会AI应用开发(十九)使用LangGraph实现持久记忆功能

博主头像 ​上一篇文章介绍了如何使用InMemoryStore实现用户偏好的精确记忆功能,但记忆只保留在内存中,一旦AI应用重启,就会丢失上次在内存中的记忆数据。 为了让AI应用持久记忆业务数据,就得引入文件或者数据库等存储介质,比如Python自带的轻量级数据库SQLite。接下来就介绍如何结合LangGr ...

WrenAI:企业级 GenBI 语义层架构设计方案

博主头像 WrenAI:企业级 GenBI 语义层架构设计方案1. 方案综述:填补 AI 与业务数据间的“语义鸿沟”在企业推进生成式商业智能(GenBI)的进程中,大语言模型(LLM)正面临一个关键的战略瓶颈:虽然模型能够解析复杂的数据库 Schema,却普遍缺乏“业务直觉”。LLM 无法自动理解 statu ...

奇摩有话说:WorkBuddy上下文策略与长文档处理

博主头像 大模型的长上下文真的够用吗 大语言模型的上下文窗口从最初的4K tokens发展到如今的128K甚至1M,看起来似乎已经解决了长文本处理的所有问题。令人惊讶的是,在实际工程场景中,上下文窗口的大小与任务完成质量并不总是正相关。当上下文达到一定规模后,模型的注意力会自然分散,关键信息容易被淹没在大量无 ...

基于本体建模与逻辑引擎的金融级智能体(Agent)架构方案

博主头像 基于本体建模与逻辑引擎的金融级智能体(Agent)架构方案:从“对话机器人”到“绝对严谨决策机”1. 业务痛点分析:大模型财务幻觉的系统性风险与治理瓶颈在强财务相关的企业级业务场景(如高速公路费率结算、金融跨行清算)中,精准度是衡量系统可用性的唯一指标。在这些高频结算环境下,即便产生 ±0.01 元 ...

奇摩干货铺:WorkBuddy上下文窗口管理实用技巧

博主头像 上下文窗口不是无限大的,但你经常当它无限用 把整个项目文件夹拖给WorkBuddy、把所有文档一次性塞进去、让AI同时分析十几个文件——这些操作很多开发者每天都在做。 归根结底,大模型的上下文窗口在理论上是数十万token级别,但在实际使用中,上下文的质量比数量重要得多。当无关信息占据窗口时,AI的 ...

AI 时代,你的大脑正在“萎缩”吗?捍卫不可替代性的 5 个深度洞察

博主头像 AI 时代,你的大脑正在“萎缩”吗?捍卫不可替代性的 5 个深度洞察1. 引言:当“平庸”成为新的标准线想象一下,当你醒来时,发现无论是你的老板、客户,甚至是你自己,都无法分辨你的工作成果与机器生成的有何区别。这并非科幻,而是正在发生的现实。当 AI 能够以近乎完美的表现通过 MCAT(医学院入学考 ...

奇摩技术说:大模型如何驱动编程效率革命

博主头像 背景:大模型为什么让编程方式发生质变 大型语言模型的兴起,正在从根本上改写软件开发的底层逻辑。过去十年,编程效率的提升主要靠框架、IDE插件和CI/CD流程优化——但这些都属于"工具增强"层面。大模型带来的改变,是在"思维辅助"层面。 归根结底,编程的本质是将人类意图翻译成计算机可执行的指令。传统方 ...

<1234···34>