摘要: Anthropic 经典指南:如何构建有效的 AI Agent——从简单模式到自主系统 这是 Anthropic 迄今为止被引用最多、传播最广的一篇技术文章。由 Erik S. 和 Barry Zhang 撰写,发布于 2024 年 12 月,至今仍被视为 AI Agent 工程实践的入门必读和架构 阅读全文
posted @ 2026-06-16 22:10 iTech 阅读(125) 评论(0) 推荐(0)
摘要: Anthropic 发布企业 AI Agent 建设指南:三大支柱、六个月部署框架与实战案例 2026 年 4 月 30 日,Anthropic 发布了一份 23 页的指南——《Building AI Agents for the Enterprise》。这不是又一篇"AI 能做什么"的布道文,而是 阅读全文
posted @ 2026-06-16 22:06 iTech 阅读(168) 评论(0) 推荐(0)
摘要: Anthropic 发布 Agent 零信任框架:五大风险、三层架构与八阶段实施 2026 年 5 月 27 日,Anthropic 发布了一份名为 《Zero Trust for AI Agents》 的安全白皮书。这不是一篇关于"怎么防止模型说错话"的指南,而是一个更底层的问题:当 AI Age 阅读全文
posted @ 2026-06-16 21:58 iTech 阅读(169) 评论(0) 推荐(0)
摘要: Google 发布 Open Knowledge Format:给 AI Agent 喂知识的标准格式 2026 年 6 月 12 日,Google Cloud 悄悄发布了一个 v0.1 的开放规范——Open Knowledge Format(OKF)。没有大张旗鼓的发布会,只有一篇博客文章和一个 阅读全文
posted @ 2026-06-16 21:51 iTech 阅读(3376) 评论(0) 推荐(0)
摘要: 1099 个赞,136 条评论:Hacker News 程序员们到底有没有用本地模型替代 Claude? 一个月省 $100 订阅费,代价是你的代码质量下降多少? Hacker News 上有一则帖子火了——"Ask HN: Has anyone replaced Claude/GPT with a 阅读全文
posted @ 2026-06-16 20:54 iTech 阅读(67) 评论(0) 推荐(0)
摘要: 三个便宜模型组队干翻 Fable 5:OpenRouter Fusion 的多模型融合实验 一个模型想不通的问题,三个模型一起想。OpenRouter 用"模型陪审团"的思路,把深度研究任务的质量推到了前沿模型之上。 OpenRouter 上周发布了 Fusion Router(openrouter 阅读全文
posted @ 2026-06-16 20:51 iTech 阅读(139) 评论(0) 推荐(0)
摘要: 一笔 $3,000 退款自动发出,没人批准——Google ADK 五层防御能挡住这种攻击吗 你的 Agent 查询了一个外部系统,外部系统返回了一段恶意指令,Agent 照做了。用户完全不知情。 一笔 $3,000 的退款刚刚自动发出。没有人类批准过。你的 AI Agent 读到了一段被投毒的工具 阅读全文
posted @ 2026-06-16 20:48 iTech 阅读(42) 评论(0) 推荐(0)
摘要: 告别脆弱的选择器测试:Approxima 开源了一个用自然语言写测试用例的 Agent 平台 还在为 CSS 选择器漂移导致的测试失败加班?有人把测试用例写成了自然语言,让 AI Agent 在真实浏览器里跑。 你有没有过这种经历:改了个按钮的 class 名,CI 里 40 个 E2E 测试全红了 阅读全文
posted @ 2026-06-16 19:53 iTech 阅读(43) 评论(0) 推荐(0)
摘要: AI 技术日报 - 2026-06-16 Top 10 AI 技术要闻 美团开源 WBench:首个面向交互式世界模型的系统性评测基准 美团 LongCat 团队提出了 WBench,首个面向交互式视频世界模型的多轮评测基准,包含 289 个测试案例和 1058 个交互轮次。WBench 对 20 阅读全文
posted @ 2026-06-16 07:16 iTech 阅读(50) 评论(0) 推荐(0)