摘要:
上海交大与抖音团队提出Dockerless:首个无需执行环境的代码修复验证器。它摒弃传统Docker测试,让Verifier像人类审阅者一样主动探索代码库、搜集证据并裁决patch有效性,在SWE-bench等基准上AUC达81.0,显著提升SFT/RL训练效率与泛化性。 阅读全文
上海交大与抖音团队提出Dockerless:首个无需执行环境的代码修复验证器。它摒弃传统Docker测试,让Verifier像人类审阅者一样主动探索代码库、搜集证据并裁决patch有效性,在SWE-bench等基准上AUC达81.0,显著提升SFT/RL训练效率与泛化性。 阅读全文
posted @ 2026-07-21 14:36
小七-七牛开发者
阅读(15)
评论(0)
推荐(0)
摘要:
RIT研究团队分析25,264个真实Agent PR发现:AI编程代理已广泛落地(覆盖2361个热门仓库),但应用极浅——中位数项目3个月仅提交1–2个PR;仅1%项目产出超人类基准;78.9%的PR由同一开发者审、改、合,凸显当前“人机协作”实为“单人+Agent”模式。 阅读全文
RIT研究团队分析25,264个真实Agent PR发现:AI编程代理已广泛落地(覆盖2361个热门仓库),但应用极浅——中位数项目3个月仅提交1–2个PR;仅1%项目产出超人类基准;78.9%的PR由同一开发者审、改、合,凸显当前“人机协作”实为“单人+Agent”模式。 阅读全文
posted @ 2026-07-21 14:08
小七-七牛开发者
阅读(271)
评论(1)
推荐(0)
摘要:
本文详解Coding Agent中Model与Effort的核心差异:Model决定能力上限(换权重),Effort控制工作深度(调思考量)。二者协同影响质量与成本——简单任务宜用小模型+默认Effort,复杂问题需大模型+高Effort。调试时应先优化上下文,再按“能力不足换Model,验证不足提Effort”原则调整。 阅读全文
posted @ 2026-07-20 15:11
小七-七牛开发者
阅读(24)
评论(0)
推荐(0)
摘要:
本期「周一上线」聚焦AI圈鲜活实践:开发者玩转Codex实体指挥台、用球员名织国旗、5个prompt搭3D选座;Kimi K3(2.8T)、Inkling、Monolith-1.0等大模型密集发布;Qwen3.8预告2.4T参数;Grok Build开源、Claude Fable 5权益调整;Sutton再创业成立Oak Lab。 阅读全文
本期「周一上线」聚焦AI圈鲜活实践:开发者玩转Codex实体指挥台、用球员名织国旗、5个prompt搭3D选座;Kimi K3(2.8T)、Inkling、Monolith-1.0等大模型密集发布;Qwen3.8预告2.4T参数;Grok Build开源、Claude Fable 5权益调整;Sutton再创业成立Oak Lab。 阅读全文
posted @ 2026-07-20 14:29
小七-七牛开发者
阅读(222)
评论(0)
推荐(0)
摘要:
NetsGo 是张硕开发的轻量级内网穿透与节点管理平台,专注解决多设备(NAS、树莓派、PVE等)场景下的配置分散、状态难查、变更难管问题。单文件二进制+Web控制台,不替代frp,而是补足其管理短板。v0.1.11已支持P2P隧道与AI驱动的真实环境测试。 阅读全文
NetsGo 是张硕开发的轻量级内网穿透与节点管理平台,专注解决多设备(NAS、树莓派、PVE等)场景下的配置分散、状态难查、变更难管问题。单文件二进制+Web控制台,不替代frp,而是补足其管理短板。v0.1.11已支持P2P隧道与AI驱动的真实环境测试。 阅读全文
posted @ 2026-07-17 14:55
小七-七牛开发者
阅读(31)
评论(0)
推荐(0)
摘要:
本文为 macOS 用户提供的 Codex Desktop 换肤实践指南,基于开源项目 Codex Dream Skin,教你用 ChatGPT 生成像素风“Dario”主题背景图,并完成一键定制与还原。非官方教程,适配 Windows 可参考流程。需 ChatGPT 会员及基础操作经验。 阅读全文
本文为 macOS 用户提供的 Codex Desktop 换肤实践指南,基于开源项目 Codex Dream Skin,教你用 ChatGPT 生成像素风“Dario”主题背景图,并完成一键定制与还原。非官方教程,适配 Windows 可参考流程。需 ChatGPT 会员及基础操作经验。 阅读全文
posted @ 2026-07-17 14:20
小七-七牛开发者
阅读(324)
评论(0)
推荐(1)
摘要:
本文详解Agent系统中关键的“上下文预算”概念:区别于Chatbot的静态对话,Agent需动态管理有限上下文窗口,科学分配目标、规则、工具、记忆与历史等信息。通过固定保留、最近保留、压缩摘要、按需加载四类策略,平衡信息完整性与模型效率,保障长任务稳定执行。 阅读全文
本文详解Agent系统中关键的“上下文预算”概念:区别于Chatbot的静态对话,Agent需动态管理有限上下文窗口,科学分配目标、规则、工具、记忆与历史等信息。通过固定保留、最近保留、压缩摘要、按需加载四类策略,平衡信息完整性与模型效率,保障长任务稳定执行。 阅读全文
posted @ 2026-07-16 13:55
小七-七牛开发者
阅读(207)
评论(0)
推荐(0)
摘要:
Anthropic 提出的“unknowns”概念,精准揭示了Coding Agent协作中的核心挑战:任务中未明说、未察觉或未意识到的潜在问题。本文系统解析四类unknowns(已知/可知/隐性/未知),并提供实战方法,助开发者与Claude高效协同。 阅读全文
Anthropic 提出的“unknowns”概念,精准揭示了Coding Agent协作中的核心挑战:任务中未明说、未察觉或未意识到的潜在问题。本文系统解析四类unknowns(已知/可知/隐性/未知),并提供实战方法,助开发者与Claude高效协同。 阅读全文
posted @ 2026-07-15 14:50
小七-七牛开发者
阅读(21)
评论(0)
推荐(0)
摘要:
Kapa提出“上下文剪枝”新范式:在Reranker与Generator间插入轻量小模型(Pruner),基于五档评分(Essential至Unrelated)全局评估候选chunk,兼顾互补性与必要性。实测剪枝68%冗余内容,保留96%关键召回,单次查询成本降34%,特别适配Agent等多步推理场景。 阅读全文
Kapa提出“上下文剪枝”新范式:在Reranker与Generator间插入轻量小模型(Pruner),基于五档评分(Essential至Unrelated)全局评估候选chunk,兼顾互补性与必要性。实测剪枝68%冗余内容,保留96%关键召回,单次查询成本降34%,特别适配Agent等多步推理场景。 阅读全文
posted @ 2026-07-15 14:32
小七-七牛开发者
阅读(197)
评论(0)
推荐(0)
摘要:
本文介绍七牛云工程师张之阳基于OpenClaw+Home Assistant打造的智能家居Agent实践:让AI理解“朋友来家调灯”等模糊指令,自动补全设备、参数与上下文,完成从对话到执行、状态回查的完整闭环,并严守权限隔离、最小权限、内网部署等安全边界。 阅读全文
本文介绍七牛云工程师张之阳基于OpenClaw+Home Assistant打造的智能家居Agent实践:让AI理解“朋友来家调灯”等模糊指令,自动补全设备、参数与上下文,完成从对话到执行、状态回查的完整闭环,并严守权限隔离、最小权限、内网部署等安全边界。 阅读全文
posted @ 2026-07-14 15:02
小七-七牛开发者
阅读(15)
评论(0)
推荐(0)
浙公网安备 33010602011771号