08 2026 档案
摘要:
该系统由Daniel García设计,构建了8个专精Agent协作的自动化流水线,持续扫描GitHub、筛选优质AI工作流、提取标准化Skill并提交PR。全程解耦人工干预,实现Agent能力的自主发现、理解与扩展,大幅提升开源能力复用效率。
阅读全文
该系统由Daniel García设计,构建了8个专精Agent协作的自动化流水线,持续扫描GitHub、筛选优质AI工作流、提取标准化Skill并提交PR。全程解耦人工干预,实现Agent能力的自主发现、理解与扩展,大幅提升开源能力复用效率。
阅读全文
摘要:
Agent记忆系统需超越简单存储,构建覆盖写入、更新、检索、失效与治理的全生命周期管理机制,确保信息时效性、一致性与安全性。
阅读全文
Agent记忆系统需超越简单存储,构建覆盖写入、更新、检索、失效与治理的全生命周期管理机制,确保信息时效性、一致性与安全性。
阅读全文
摘要:
本文提出ACM(主动上下文管理)机制,让Agent自主决策何时压缩历史、何时回查原始信息,解决长任务中上下文膨胀与信息丢失难题。通过`manage_context`和`query_memory`双工具,实现工作记忆与长期记忆分离,在128K窗口下将222K轨迹成功执行,显著提升长任务成功率与执行稳定性。
阅读全文
本文提出ACM(主动上下文管理)机制,让Agent自主决策何时压缩历史、何时回查原始信息,解决长任务中上下文膨胀与信息丢失难题。通过`manage_context`和`query_memory`双工具,实现工作记忆与长期记忆分离,在128K窗口下将222K轨迹成功执行,显著提升长任务成功率与执行稳定性。
阅读全文
摘要:
NVIDIA提出跨模型KV Cache映射技术,通过线性转换复用小模型生成的缓存,使大模型跳过重复Prefill,加速2.7–25倍;实验证明误差在注意力敏感方向的影响远大于整体重建精度,为高效低成本模型切换提供新范式。
阅读全文
NVIDIA提出跨模型KV Cache映射技术,通过线性转换复用小模型生成的缓存,使大模型跳过重复Prefill,加速2.7–25倍;实验证明误差在注意力敏感方向的影响远大于整体重建精度,为高效低成本模型切换提供新范式。
阅读全文
摘要:
最近,一篇题为《“Code was never the hard part” is an insult to all programmers》的文章在 Hacker News 上引起了不少讨论。它主要讲是 AI Coding 之后越来越常听到的一句话:Code was never the hard
阅读全文
最近,一篇题为《“Code was never the hard part” is an insult to all programmers》的文章在 Hacker News 上引起了不少讨论。它主要讲是 AI Coding 之后越来越常听到的一句话:Code was never the hard
阅读全文
摘要:
本期「周一上线」聚焦AI工程化新动向:端侧轻量Agent(LFM2.5)、千万级超长上下文(Pokee-Isaac)、2.4万亿参数Coding旗舰(Qwen3.8-Max)密集发布;Cursor开源MoE训练内核,OpenAI向免费用户开放GPT-5.6不限量文本聊天。
阅读全文
本期「周一上线」聚焦AI工程化新动向:端侧轻量Agent(LFM2.5)、千万级超长上下文(Pokee-Isaac)、2.4万亿参数Coding旗舰(Qwen3.8-Max)密集发布;Cursor开源MoE训练内核,OpenAI向免费用户开放GPT-5.6不限量文本聊天。
阅读全文
摘要:
从设置 Goal、让 Codex 主动推进,到人工检查实际结果,再用 Plan 收窄修改范围,这次实践至少说明了一件事:长任务交给 Agent 之后,我们可以把方向交给 Goal,把阶段性的控制交给 Plan,同时还得自己看最终结果有没有真的变好。
阅读全文
从设置 Goal、让 Codex 主动推进,到人工检查实际结果,再用 Plan 收窄修改范围,这次实践至少说明了一件事:长任务交给 Agent 之后,我们可以把方向交给 Goal,把阶段性的控制交给 Plan,同时还得自己看最终结果有没有真的变好。
阅读全文
摘要:
本文详解Agent状态的核心概念与工程实践:它不是简单记忆,而是任务执行的实时快照,涵盖进度、环境、内部判断与资源约束。通过结构化Schema、分层检查点和状态栏机制,实现可靠暂停恢复、高效决策与长程连贯性。
阅读全文
本文详解Agent状态的核心概念与工程实践:它不是简单记忆,而是任务执行的实时快照,涵盖进度、环境、内部判断与资源约束。通过结构化Schema、分层检查点和状态栏机制,实现可靠暂停恢复、高效决策与长程连贯性。
阅读全文
摘要:
camelAI重构Coding Agent架构,将长期驻留的虚拟机解耦为按需调用的分层执行环境:Agent运行于Cloudflare Durable Object(“脑”),文件存于SQLite+R2,常规操作交由JavaScript沙箱,仅构建/Notebook等重任务临时启用Linux容器
阅读全文
camelAI重构Coding Agent架构,将长期驻留的虚拟机解耦为按需调用的分层执行环境:Agent运行于Cloudflare Durable Object(“脑”),文件存于SQLite+R2,常规操作交由JavaScript沙箱,仅构建/Notebook等重任务临时启用Linux容器
阅读全文
摘要:
面对层出不穷的AI工具与提示词,开发者常陷“工具焦虑”。GitHub AI专家Burke Holland提出:少即是多——聚焦一个成熟Agent Harness(如Copilot),通过原型→规划→实现→评审的八步工作流,把AI用深、用透、用稳。
阅读全文
面对层出不穷的AI工具与提示词,开发者常陷“工具焦虑”。GitHub AI专家Burke Holland提出:少即是多——聚焦一个成熟Agent Harness(如Copilot),通过原型→规划→实现→评审的八步工作流,把AI用深、用透、用稳。
阅读全文
摘要:Harness 自进化真的在变好么?
阅读全文
摘要:先做代码切片和行为图,证据不足再查文档、进沙箱
阅读全文
摘要:本期「周一上线」聚焦AI两大演进方向:模型加速迈向多模态与机器人,Agent则从“写代码”升级为长期协作、端到端交付与自我改进。DeepSeek V4-Flash、MiniMax H3、Gemini Robotics 2等密集发布,OpenAI Astra、Lilian Weng的RSI团队、贾扬清Intent Lab齐探AI自主进化;行业层面,AlphaFold团队拆分、字节整合飞书/豆包/火山引擎,技术与组织同步重构。
阅读全文
浙公网安备 33010602011771号