文章时间:2026年8月9日 覆盖范围:卡的类型、算力规格、国内外采购限制、费用情况、国内选型建议 数据时效:重点覆盖 2026年2月—8月 的最新动态 数据来源:NVIDIA 官网、公开媒体报道(路透社、环球时报、第一财经等)、渠道报价(京东/算力租赁平台)、行业分析机构 一、核心结论速览 维度 ...
企业引入LLM工具面临云端vs本地的部署抉择,WorkBuddy的本地化架构设计确保数据主权始终在用户手中,兼顾性能与合规。 ...
快手的 MLE Agent 优化工作,目前挂在 Arxiv 26.07 上,提出了一种将 Bandit 算法与 LLM 智能体相结合的推荐模型自动化优化框架 RecHarness 背景 推荐系统优化天然适合 MLE Agent,但直接应用通用 MLE Agent 存在一个关键的系统挑战:每个候选修改 ...
之前的文章《15天学会AI应用开发(十三)上下文与RAG的阶段性总结》概述了检索RAG知识库的主要步骤,现在采用LangChain将其改造为更智能的本地RAG系统。 接下来基于LangChain框架与Chroma向量数据库,结合离线的文本嵌入模型和大语言模型,从零开始搭建本地的RAG检索系统。 一 ...
奇摩技术说:大模型编程助手的底层逻辑与实战 一、大模型在编程领域的应用现状 近年来,大语言模型(LLM)在代码生成、调试和自动化领域的应用愈加成熟。客观来说,虽然市面上涌现了大量AI编程工具,但真正能将大模型能力融入开发者日常工作的产品并不多。多数工具停留在代码补全层面,无法理解项目的完整上下文,更 ...
WorkBuddy提示词工程方法论:三层架构设计+迭代优化实战,将人工修改率从40%降至5%以下。奇摩计算机结合企业落地经验,拆解提示词版本管理和效果追踪的量化路径。 ...
上一篇文章介绍了如何使用InMemoryStore实现用户偏好的精确记忆功能,但记忆只保留在内存中,一旦AI应用重启,就会丢失上次在内存中的记忆数据。 为了让AI应用持久记忆业务数据,就得引入文件或者数据库等存储介质,比如Python自带的轻量级数据库SQLite。接下来就介绍如何结合LangGr ...
快手发布的一篇技术报告 AgentX,提出了一个可以自我迭代的 MAS 把工业推荐的 idea-to-launch 闭环整体自动化,推荐领域的 Loop Engineering 背景 工业推荐系统的算法迭代长期依赖算法工程师的持续介入。一次完整的算法迭代通常需要经历数据分析、特征工程、模型开发、在线 ...
云端大模型编程工具面临上下文断裂和数据安全两大难题。WorkBuddy的本地化架构和多工具编排能力,为企业场景提供差异化方案。 ...
上下文窗口不是越大越好。本文从上下文工程的三层结构出发,结合WorkBuddy的记忆系统和技能模块,用实测数据对比不同上下文策略对代码生成准确率的影响,分享让大模型输出更精准的实用技巧。 ...
大模型在代码生成领域的表现日趋成熟,但单纯依赖模型生成代码远不足以覆盖程序员全流程需求。本文探讨WorkBuddy如何通过智能体执行层设计让大模型从文本生成器进化为任务执行器。 ...
开源地址:https://github.com/StudiousXiaoYu/dawn-courier-3d 上周的 ChinaJoy 刚刚结束。今年展会是 7 月 31 日到 8 月 3 日,主题叫“与AI同游”,正好也是我比较感兴趣的方向。 不过我去 ChinaJoy,最主要的目的当然还是玩游戏 ...
WrenAI:企业级 GenBI 语义层架构设计方案1. 方案综述:填补 AI 与业务数据间的“语义鸿沟”在企业推进生成式商业智能(GenBI)的进程中,大语言模型(LLM)正面临一个关键的战略瓶颈:虽然模型能够解析复杂的数据库 Schema,却普遍缺乏“业务直觉”。LLM 无法自动理解 statu ...
大模型的长上下文真的够用吗 大语言模型的上下文窗口从最初的4K tokens发展到如今的128K甚至1M,看起来似乎已经解决了长文本处理的所有问题。令人惊讶的是,在实际工程场景中,上下文窗口的大小与任务完成质量并不总是正相关。当上下文达到一定规模后,模型的注意力会自然分散,关键信息容易被淹没在大量无 ...
大模型编程工具落地企业,关键在于深度融入开发流程而非孤立使用。本文拆解五个落地关键步骤,结合代码审查等场景展示大模型的实际价值。 ...
基于本体建模与逻辑引擎的金融级智能体(Agent)架构方案:从“对话机器人”到“绝对严谨决策机”1. 业务痛点分析:大模型财务幻觉的系统性风险与治理瓶颈在强财务相关的企业级业务场景(如高速公路费率结算、金融跨行清算)中,精准度是衡量系统可用性的唯一指标。在这些高频结算环境下,即便产生 ±0.01 元 ...
上下文窗口不是无限大的,但你经常当它无限用 把整个项目文件夹拖给WorkBuddy、把所有文档一次性塞进去、让AI同时分析十几个文件——这些操作很多开发者每天都在做。 归根结底,大模型的上下文窗口在理论上是数十万token级别,但在实际使用中,上下文的质量比数量重要得多。当无关信息占据窗口时,AI的 ...
同样一个任务,用不同方式描述WorkBuddy给出的代码质量可能相差数倍。本文从三阶提示框架出发,拆解实用提示技巧。 ...
AI 时代,你的大脑正在“萎缩”吗?捍卫不可替代性的 5 个深度洞察1. 引言:当“平庸”成为新的标准线想象一下,当你醒来时,发现无论是你的老板、客户,甚至是你自己,都无法分辨你的工作成果与机器生成的有何区别。这并非科幻,而是正在发生的现实。当 AI 能够以近乎完美的表现通过 MCAT(医学院入学考 ...
背景:大模型为什么让编程方式发生质变 大型语言模型的兴起,正在从根本上改写软件开发的底层逻辑。过去十年,编程效率的提升主要靠框架、IDE插件和CI/CD流程优化——但这些都属于"工具增强"层面。大模型带来的改变,是在"思维辅助"层面。 归根结底,编程的本质是将人类意图翻译成计算机可执行的指令。传统方 ...