上一页 1 2 3 4 5 6 7 8 ··· 10 下一页
摘要: Dockerless:不跑测试、不搭环境,也能给 Coding Agent 的修复打分? 上海交大与抖音团队提出Dockerless:首个无需执行环境的代码修复验证器。它摒弃传统Docker测试,让Verifier像人类审阅者一样主动探索代码库、搜集证据并裁决patch有效性,在SWE-bench等基准上AUC达81.0,显著提升SFT/RL训练效率与泛化性。 阅读全文
posted @ 2026-07-21 14:36 小七-七牛开发者 阅读(15) 评论(0) 推荐(0)
摘要: 2.5 万个 AgentPR的实证:AI 涌入GitHub一年,到底做出多少产出? RIT研究团队分析25,264个真实Agent PR发现:AI编程代理已广泛落地(覆盖2361个热门仓库),但应用极浅——中位数项目3个月仅提交1–2个PR;仅1%项目产出超人类基准;78.9%的PR由同一开发者审、改、合,凸显当前“人机协作”实为“单人+Agent”模式。 阅读全文
posted @ 2026-07-21 14:08 小七-七牛开发者 阅读(271) 评论(1) 推荐(0)
摘要: 本文详解Coding Agent中Model与Effort的核心差异:Model决定能力上限(换权重),Effort控制工作深度(调思考量)。二者协同影响质量与成本——简单任务宜用小模型+默认Effort,复杂问题需大模型+高Effort。调试时应先优化上下文,再按“能力不足换Model,验证不足提Effort”原则调整。 阅读全文
posted @ 2026-07-20 15:11 小七-七牛开发者 阅读(24) 评论(0) 推荐(0)
摘要: 周一上线|OpenAI 开卖 Agent 指挥台,DeepSeek 被曝筹备 IPO,开放模型迈入 3T 时代 本期「周一上线」聚焦AI圈鲜活实践:开发者玩转Codex实体指挥台、用球员名织国旗、5个prompt搭3D选座;Kimi K3(2.8T)、Inkling、Monolith-1.0等大模型密集发布;Qwen3.8预告2.4T参数;Grok Build开源、Claude Fable 5权益调整;Sutton再创业成立Oak Lab。 阅读全文
posted @ 2026-07-20 14:29 小七-七牛开发者 阅读(222) 评论(0) 推荐(0)
摘要: 专访 NetsGo 作者张硕:把内网穿透从配置文件搬进一个控制台 NetsGo 是张硕开发的轻量级内网穿透与节点管理平台,专注解决多设备(NAS、树莓派、PVE等)场景下的配置分散、状态难查、变更难管问题。单文件二进制+Web控制台,不替代frp,而是补足其管理短板。v0.1.11已支持P2P隧道与AI驱动的真实环境测试。 阅读全文
posted @ 2026-07-17 14:55 小七-七牛开发者 阅读(31) 评论(0) 推荐(0)
摘要: Dario 常驻 Codex|从生图到安装,手把手带你换一套 Codex 皮肤 本文为 macOS 用户提供的 Codex Desktop 换肤实践指南,基于开源项目 Codex Dream Skin,教你用 ChatGPT 生成像素风“Dario”主题背景图,并完成一键定制与还原。非官方教程,适配 Windows 可参考流程。需 ChatGPT 会员及基础操作经验。 阅读全文
posted @ 2026-07-17 14:20 小七-七牛开发者 阅读(324) 评论(0) 推荐(1)
摘要: Agent 小知识|上下文预算:让 Agent 知道该看什么 本文详解Agent系统中关键的“上下文预算”概念:区别于Chatbot的静态对话,Agent需动态管理有限上下文窗口,科学分配目标、规则、工具、记忆与历史等信息。通过固定保留、最近保留、压缩摘要、按需加载四类策略,平衡信息完整性与模型效率,保障长任务稳定执行。 阅读全文
posted @ 2026-07-16 13:55 小七-七牛开发者 阅读(207) 评论(0) 推荐(0)
摘要: 从 Fable 案例看 Coding Agent 的未知项管理 Anthropic 提出的“unknowns”概念,精准揭示了Coding Agent协作中的核心挑战:任务中未明说、未察觉或未意识到的潜在问题。本文系统解析四类unknowns(已知/可知/隐性/未知),并提供实战方法,助开发者与Claude高效协同。 阅读全文
posted @ 2026-07-15 14:50 小七-七牛开发者 阅读(21) 评论(0) 推荐(0)
摘要: RAG 工程里的上下文剪枝:如何减少 68% 的上下文 Kapa提出“上下文剪枝”新范式:在Reranker与Generator间插入轻量小模型(Pruner),基于五档评分(Essential至Unrelated)全局评估候选chunk,兼顾互补性与必要性。实测剪枝68%冗余内容,保留96%关键召回,单次查询成本降34%,特别适配Agent等多步推理场景。 阅读全文
posted @ 2026-07-15 14:32 小七-七牛开发者 阅读(197) 评论(0) 推荐(0)
摘要: 不仅听懂,更能干活:看张之阳如何让 Agent 安全接管智能家居 本文介绍七牛云工程师张之阳基于OpenClaw+Home Assistant打造的智能家居Agent实践:让AI理解“朋友来家调灯”等模糊指令,自动补全设备、参数与上下文,完成从对话到执行、状态回查的完整闭环,并严守权限隔离、最小权限、内网部署等安全边界。 阅读全文
posted @ 2026-07-14 15:02 小七-七牛开发者 阅读(15) 评论(0) 推荐(0)
上一页 1 2 3 4 5 6 7 8 ··· 10 下一页