结论 apim中rest实现的mcp,不需要更新2.0,它是不为2.0取决于客户端和后端服务 apim中mcp实现的mcp-server,需要有版本控制,版本不对,会出现问题 apim中的服务,如果中间走了聚合mcp服务,它返回的mcp版本取决于聚合服务的mcp版本 name: MCP Dual E ...
MCP 2.0(即 2026-07-28 协议修订版)是一次从架构到交互模式的重大升级。它最核心的变化是从“有状态的本地会话”转向了“无状态的分布式协议”,目标是让 MCP 成为 AI Agent 时代的真正基础设施。 下面是 v2.0 引入的核心新方法,以及与 v1.0 的主要变更对比。 M ...
面对“调研三家竞品并给出上线建议”这类任务,如果让模型一次性生成答案,很容易得到一篇结构完整、证据却松散的作文。规划的作用,是把模糊目标变成一组能执行、能检查、能恢复的步骤。 ReAct:边观察边决定下一步 ReAct 把推理与行动交替组织。Agent 先判断当前缺少什么,再调用搜索、数据库或代码工 ...
DeepSeek Harness 是 DeepSeek 开源的一款 AI 智能体开发平台:提供网页界面、会话管理,以及代码执行、文件操作、任务看板、SSH 运维等工具能力。 ...
多个月以后,面对满屏的代码无从下手时,些瓶将会回想起,他第一次接触 Coding Agent 的那个遥远的下午。这篇笔记主要记录了咱在 AI 编码方面的一些实践体会,以及配置 Pi Coding Agent 的一些小想法。 ...
Advanced‑RAG 是基于 Naive RAG 演化而来的高级检索增强生成方案,针对朴素RAG检索不准、上下文相关性差、召回噪声多等缺陷进行多层优化。该方案完全沿用朴素RAG的基础流水线模式、不改动核心架构,仅在各流程节点嵌入预处理、后处理增强模块,精细化优化检索环节。通过引入查询改写、重排序... ...
这是一个用来快速提取文档关键值的脚本,可以用来批量提取一批相同类型,但是不同型号的公共参数值,可以避免人工大量重复性的搜索和来回翻阅工作: 例如快速提取esp32_datasheet_cn.pdf的以下字段 | **型号** | **封装类型** | **工作温度(°C)** | **CPU 架构* ...
一个有记忆的个人助理,体验差异不在于它能复述昨天聊过什么,而在于它能把已确认的信息用到新任务里,并且知道哪些信息已经过期、哪些动作仍需重新确认。 我会把记忆拆成四层 第一层是不可变的事件日志,用于追溯发生过什么;第二层是会话摘要,用于压缩长对话;第三层是用户画像,只保存稳定且可修改的偏好;第四层是任 ...
连续对话里,用户说过的偏好、已经确认的约束和当前任务进度都不能每轮重新猜。但“把所有聊天记录都塞回上下文”并不等于记忆,反而会带来成本、噪声和隐私问题。 三类记忆解决三类问题 短期记忆维持当前会话的连续性,例如刚才确认的文件路径;工作记忆保存任务中间状态,例如已完成步骤、待验证假设和工具结果;长期记 ...
本文为DeepSeek Harness本地完整部署保姆级教程,适配Windows系统,全程零基础可上手。详细讲解Node.js26.7环境安装、DeepSeek官方仓库拉取、pnpm依赖安装、项目编译构建、Web服务启动,搭配LlamaCpp部署qwen2.5-1.5b本地量化模型,完成模型接口对接... ...
真正让 Agent 变得不稳定的,往往不是模型换了一种说法,而是工具接口没有把输入、权限和失败方式讲清楚。工具本质上是模型与真实系统之间的一份契约:模型负责提出调用意图,应用负责决定这次调用能否发生。 一个好工具先要“容易被正确选择” 工具名、描述和参数 schema 都会参与模型判断。search ...
向量检索增强生成(RAG,Retrieval‑Augmented Generation),是弥补大语言模型固有缺陷的关键技术。它可接入私有文档、内部笔记等外部数据源,有效缓解训练数据滞后、知识固化、回答幻觉等问题,输出更为精准可信的内容。Naive RAG 即朴素 RAG,是 RAG 体系中最基础原... ...
聊天模型只能根据上下文生成内容。它不知道实时天气、订单状态,也不能凭空计算一个复杂结果。Agent 之所以能够“做事”,是因为应用把外部能力包装成了模型可以选择的工具。 Tool Use 解决了什么问题 工具调用把一次请求拆成两个角色:模型负责判断是否需要动作、选择哪个工具和填写参数;程序负责真正执 ...
背景:机器学习项目中「重复劳动」到底占了多少时间 很多人以为机器学习工程师的时间主要花在建模上。实际上,一套ML项目从数据到上线,真正花在算法创新上的时间往往不到三成,大量精力都消耗在了数据处理、环境配置、实验记录这些重复环节。 数据清洗:处理缺失值、格式转换、特征对齐,琐碎但必不可少。 环境搭建: ...
背景:大模型为什么「答非所问」越来越多 使用大模型做编程辅助的人,几乎都遇到过同一个困扰:模型输出的代码看起来很专业,但仔细一看,变量命名对不上、依赖库版本不匹配、甚至接口名都是编造的。 这不是模型退化了,而是「上下文」出了问题。大模型本身没有记忆,它每一次回答,都只依赖你喂给它的那一段上下文。上下 ...
背景:AI编程工具的普及为何没有自动带来效率提升 过去两年,AI编程助手从概念走进了几乎每个开发者的日常工作流。打开编辑器,自动补全、代码生成、单元测试写作,这些功能看起来已经足够成熟。 但事实是,工具普及并不等于效率提升。很多团队装上助手之后,代码产出的速度确实变快了,可返工率、上下文切换成本、以 ...
大家好,我是晓凡。 等了这么久,DeepSeek 终于有视觉模型了。8 月 21 日,DeepSeek 悄悄上线了多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,DeepSeek 终于自己能看图了。 一、这是个什么模型? 先说定位。V4-Flash-Vision-Exp ...
第一次搭 Agent,最容易卡在模型和框架之间:Python 版本不对,依赖互相冲突,API Key 写进了代码,最后还没看清 Agent 做了什么就开始堆功能。 这本书把环境准备放在前面,我觉得很合理。一个可复现的最小项目,应该先解决“能运行、能观察、能停止”三个问题。 环境准备要可复现 建议先建 ...
DeepSeek Harness以MIT协议开源,一切皆插件的架构理念正在改写AI Agent生态。4天14.9万星,1300+社区插件,基于Cordis元框架实现核心组件热插拔,内置38条模型路由。本文拆解其架构革命、四种运行模式和生态数据。 ...
Agent 的决策能力最终要落到模型上。模型如果没理解目标、没识别工具参数,后面的工作流设计得再漂亮也只能得到错误动作。 所以在进入工具调用之前,有必要先把大语言模型看成一个“能力很强但需要检查的实习生”:它能理解自然语言、总结材料、提出计划,但不天然知道事实,也不会自动遵守业务规则。 Token ...