AI
刷新
Agent 学习笔记 02:大语言模型并不神秘,先看懂 Token、Prompt 与能力边界

博主头像 Agent 的决策能力最终要落到模型上。模型如果没理解目标、没识别工具参数,后面的工作流设计得再漂亮也只能得到错误动作。 所以在进入工具调用之前,有必要先把大语言模型看成一个“能力很强但需要检查的实习生”:它能理解自然语言、总结材料、提出计划,但不天然知道事实,也不会自动遵守业务规则。 Token ...

Agent 学习笔记 01:Agent 到底是什么,从感知、思考到行动的循环

博主头像 “把大模型接上工具”就算 Agent 了吗?这个说法有一定道理,但还不够完整。 如果只是用户点击按钮,程序固定调用一个函数,那更像普通自动化;如果模型能够根据目标和当前结果,决定下一步做什么,并在受限范围内循环执行,才更接近 Agent 的核心形态。 Agent 的最小定义 我会把 Agent 暂时 ...

Zvec: 开箱即用、高性能的嵌入式向量数据库

博主头像 摘要:Zvec 是一款类 SQLite 的轻量级嵌入式向量数据库,专为终端侧设计,具备开箱即用、资源可配置、极致性能以及多样化向量能力四大核心优势。基于Apache 2.0协议开源,Zvec 旨在为开发者提供从原型验证到端侧生产部署的一站式解决方案。欢迎体验 Zvec,期待你的使用、反馈与贡献! 背 ...

奇摩实战笔记:WorkBuddy驱动机器学习项目提速

博主头像 一、机器学习项目的周期之痛 机器学习项目有个通病:周期长、环节多、见效慢。数据清洗、特征工程、模型训练、调参评估,每一步都耗时。真正花在建模上的时间,往往被大量重复性准备工作占据。 客观来说,ML项目的时间黑洞,大多不在模型本身,而在数据与流程的琐碎环节。这些环节处理不好,再好的模型也难以快速落地。 ...

奇摩爱分享:大模型编程助手落地避坑心得

博主头像 一、大模型编程助手:理想与现实的落差 大模型编程助手的概念很火,但真正落地后,不少团队发现效果并没有想象中那么神奇。问题往往不在模型能力,而在使用方式。很多团队把助手当成"万能代码生成器",结果产出的代码质量参差不齐,反而增加了评审负担。 事实上,工具本身没有错,错的是对工具的定位。大模型擅长的是模 ...

"LatentMem: Customizing Latent Memory for Multi-Agent Systems" 论文笔记

博主头像 同济 + 上海 AI Lab + 港中文 + 南大 + 上交的工作,目前挂在 Arxiv 26.03 上。当前多智能体系统(MAS)的记忆设计普遍存在两个瓶颈:记忆同质化(缺乏角色感知的定制)和信息过载(记忆条目过于细碎冗长)。本文提出 LatentMem,一个可学习的隐空间多智能体记忆框架:用一个 ...

AI 太聪明反而危险?OpenAI 暂停训练背后隐藏的难题

博主头像 一场突然的暂停 凌晨时分,OpenAI 放出了一条让整个 AI 圈措手不及的消息:下一代模型的强化学习训练被按下了暂停键,原计划中规模最大的一次前沿训练也被无限期搁置。原因不是算力不够,也不是数据短缺,而是模型在测试中表现出的某些行为,让安全团队觉得不能再往下推了。 公告里提到的直接导火索,是上个月... ...

LangGraph+PostgreSQL 会话记忆持久化存储

博主头像 本文基于LangGraph会话记忆管理相关内容,聚焦对话持久化存储方案,以LangChain官方推荐的PostgreSQL数据库为载体,拆解Checkpointer检查点存储与Store通用长期存储两大核心体系。通过对比两套存储机制的底层逻辑、差异特点与适用场景,结合可运行实战代码,实现会话重启续聊... ...

<1···141516···50>