摘要:
一笔 $3,000 退款自动发出,没人批准——Google ADK 五层防御能挡住这种攻击吗 你的 Agent 查询了一个外部系统,外部系统返回了一段恶意指令,Agent 照做了。用户完全不知情。 一笔 $3,000 的退款刚刚自动发出。没有人类批准过。你的 AI Agent 读到了一段被投毒的工具 阅读全文
posted @ 2026-06-16 20:48
iTech
阅读(42)
评论(0)
推荐(0)
摘要:
告别脆弱的选择器测试:Approxima 开源了一个用自然语言写测试用例的 Agent 平台 还在为 CSS 选择器漂移导致的测试失败加班?有人把测试用例写成了自然语言,让 AI Agent 在真实浏览器里跑。 你有没有过这种经历:改了个按钮的 class 名,CI 里 40 个 E2E 测试全红了 阅读全文
posted @ 2026-06-16 19:53
iTech
阅读(43)
评论(0)
推荐(0)
摘要:
AI 技术日报 - 2026-06-16 Top 10 AI 技术要闻 美团开源 WBench:首个面向交互式世界模型的系统性评测基准 美团 LongCat 团队提出了 WBench,首个面向交互式视频世界模型的多轮评测基准,包含 289 个测试案例和 1058 个交互轮次。WBench 对 20 阅读全文
posted @ 2026-06-16 07:16
iTech
阅读(50)
评论(0)
推荐(0)

浙公网安备 33010602011771号