08 2026 档案

摘要:Agent 时代,软件工程基础该学什么?吴恩达更新AI工程技能图谱,聚焦“软件工程基础”五大核心:全栈开发、数据管理、系统架构、安全可靠、生产运维。强调即便Coding Agent能力提升,开发者仍需理解系统原理与工程权衡,以指导AI、把控质量、驱动长期演进。 阅读全文
posted @ 2026-08-31 15:57 小七-七牛开发者 阅读(37) 评论(0) 推荐(0)
摘要:OpenAI 要从 Cursor 撤模型,腾讯开源 Hy4,索尼、华纳起诉 Anthropic本周AI圈密集更新:腾讯Hy4预览版、Qwen3.8-Flash-Next(Qwen4架构先行版)、智谱GLM-5.3-Flash、阿里Wan3.0(单次生成30秒视频)及微信WeMM多模态Embedding模型集中发布;Hugging Face开源小鸭机器人Microduck,英伟达拟129亿美元收购HF;OpenAI终止向Cursor供模型。 阅读全文
posted @ 2026-08-31 15:42 小七-七牛开发者 阅读(19) 评论(0) 推荐(0)
摘要:实测推荐 3 个 Skill,轻松上手 Codex 网页设计与交付流程小七实测3个前端Skill:`design-taste-frontend`强化设计规范与双主题支持,`humanizer`去除AI腔、优化文案自然度,`better-interface`完成可访问性等交付级审查。结果表明——当Agent基础能力已强,Skill核心价值转向固化专业标准、流程与质量门禁。 阅读全文
posted @ 2026-08-28 17:56 小七-七牛开发者 阅读(36) 评论(0) 推荐(0)
摘要:拆解 dsh 系列:从源码和版本变化看 DeepSeek Harness 的设计取舍DeepSeek Harness(dsh)发布仅两周,实则历经两个月内部打磨。本文基于Git历史与npm发布数据,梳理其从0.0.1-rc.1到0.1.1-rc.2的演进:命名重构、定位升维(Coding Agent→Agent Harness)、核心与扩展边界持续厘清,展现一个开源智能体运行时如何审慎定义自身能力疆界。 阅读全文
posted @ 2026-08-28 17:37 小七-七牛开发者 阅读(235) 评论(1) 推荐(1)
摘要:Agent 小知识 | Skill 的设计与生命周期:从工具接口到能力模块本文探讨Agent的“Skill”概念:当Agent拥有工具与环境后,仍需可复用的任务方法论。Skill是面向特定任务的能力模块,包含流程、原则、约束与资源,支持发现、加载、组合与复用,使Agent行动更稳定、一致、可扩展。 阅读全文
posted @ 2026-08-27 14:25 小七-七牛开发者 阅读(302) 评论(1) 推荐(1)
摘要:Coding Agent 如何跑稳长任务?从上下文管理到运行时状态本文提出Ledger运行时层,解决长程Coding Agent因依赖冗长交互历史导致的状态失准问题:通过观察记录、修改状态与命令记录构建显式执行账本,并以Inform(前置状态提示)和Govern(后置动作治理)双通道,显著提升任务成功率(+5.2%)、降低Token消耗近半,实现“提准”与“降本”平衡。 阅读全文
posted @ 2026-08-26 14:25 小七-七牛开发者 阅读(34) 评论(0) 推荐(0)
摘要:拆解 DeepSeek Harness:Profile 与 Bundle 如何装配运行时dsh 通过 Profile 与 Bundle 实现运行时的分层组装:Bundle 是可分发的配置单元,提供插件与配置;Profile 显式声明需加载的 Bundle 及其顺序,决定最终运行形态(如 Web/Headless)。多层 patch 按序叠加、ID 驱动覆盖,支持灵活复用与差异化定制。 阅读全文
posted @ 2026-08-26 13:49 小七-七牛开发者 阅读(199) 评论(0) 推荐(0)
摘要:解读 Cordis:dsh 一切皆插件背后的运行时设计Cordis提出“时空可组合性”:时间维(Temporal)确保插件卸载时副作用可完整回滚;空间维(Spatial)保障依赖动态响应与隔离。通过可逆Effect与响应式Coeffect,实现运行时安全热插拔。 阅读全文
posted @ 2026-08-25 15:24 小七-七牛开发者 阅读(81) 评论(0) 推荐(0)
摘要:61 亿次请求背后:LLM Serving 的 Cache 与调度难题本文基于CompanyX一年61.2亿次真实LLM请求Trace,揭示Serving工作负载动态演化规律:长输入/短输出趋势凸显、Prefix Cache复用呈强时间局部性(99%在15分钟内),并首次系统论证多节点下“缓存复用”与“负载均衡”的本质权衡——Cache-aware路由可提升效率,仅牺牲5%~7%负载均衡度。 阅读全文
posted @ 2026-08-25 14:27 小七-七牛开发者 阅读(213) 评论(1) 推荐(1)
摘要:Agent Skill 到底有没有用?NVIDIA 实测了 300+ SkillsNVIDIA开源SkillEvaluator,首创A/B测试法评估Agent技能:通过启用/禁用Skill对比任务表现,计算“Skill Lift”;构建三层评测体系(校验、去重、真实任务),从正确性、可发现性等5维度量化效果。首批300+Verified Skills平均提升31分,验证技能价值与成本平衡。 阅读全文
posted @ 2026-08-24 15:50 小七-七牛开发者 阅读(49) 评论(0) 推荐(0)
摘要:GitHub 宕机近 8 小时,Stripe 宣布收购 OpenRouter,Cursor 开始托管代码本周AI开发深度进化:Cursor推出Origin代码托管平台,让AI Agent直接参与克隆、PR、合并等全流程;Warp构建“软件工厂”,Vercel开源轻量Agent Harness fx。Stripe收购OpenRouter加码模型路由,GPT-5.6 Sol API降价50%。开发者创意迸发:Google Sheets播狮子、ASCII建赛博朋克城、用户名生成几何生物。 阅读全文
posted @ 2026-08-24 15:24 小七-七牛开发者 阅读(158) 评论(0) 推荐(0)
摘要:dsh 拆解系列 Vol.01:没有特权内核的 Agent 运行时DeepSeek Harness(dsh)是DeepSeek开源的Agent运行时框架,秉持“一切皆插件”理念,将模型适配器、工具、会话、主循环等全部解耦为可配置、可替换、可卸载的插件,基于Cordis元框架实现时空可组合性。当前v0.1.0-rc.7为开发者预览版,MIT协议,强调工程可扩展性而非仅功能堆砌。 阅读全文
posted @ 2026-08-21 17:50 小七-七牛开发者 阅读(160) 评论(0) 推荐(0)
摘要:Agent 小知识|Agent 环境工程:部分可观测性、状态转移与执行隔离Agent环境是其执行动作的外部世界,涵盖代码仓库、数据库、网页等动态对象。它决定Agent能观察什么、改变什么,并需持续验证状态变化是否符合预期,是任务落地的关键支撑。 阅读全文
posted @ 2026-08-20 14:53 小七-七牛开发者 阅读(170) 评论(0) 推荐(0)
摘要:给 Coding Agent 加上质量门禁:测试如何进入 Agent Loop本文提出“质量门禁(Quality Gates)”理念,将测试、静态分析等确定性检查嵌入Coding Agent工作流,形成分层验证闭环:修改后触发快速门禁(Lint/类型检查/关联单测),任务完成前执行集成与回归测试,PR阶段由CI进行全量验证。Harness自动接管测试执行与反馈解析,失败结果结构化送回Agent驱动修复,同时通过Hook机制(如PostToolUse、Stop)实现流程管控,兼顾效率与可靠性。 阅读全文
posted @ 2026-08-19 14:20 小七-七牛开发者 阅读(42) 评论(0) 推荐(0)
摘要:DeepSeek Harness 设计解析:从 Agent Harness 的六个关键决策讲起DeepSeek Harness 是一款“一切皆插件”的开源Agent执行框架,聚焦长任务可靠运行:通过可替换的Loop机制、按需暴露的工具Schema、动态管理的上下文、事件驱动的持久状态、分层权限控制及多维验证体系,解决任务中断、约束丢失、上下文污染与验收失真等核心痛点。 阅读全文
posted @ 2026-08-19 13:53 小七-七牛开发者 阅读(431) 评论(1) 推荐(0)
摘要:没有推理轨迹,如何“偷走”模型的推理能力?本文介绍Cornell Tech提出的“推理轨迹反演”(Trace Inversion)技术:攻击者仅凭黑盒模型输出的答案(及可选摘要),即可合成高质量推理链,用于蒸馏训练学生模型。实验证明,该方法在数学与科学任务上显著提升学生模型性能,甚至优于使用真实思维链的训练效果,揭示了隐藏思维链并非绝对防线。 阅读全文
posted @ 2026-08-18 15:11 小七-七牛开发者 阅读(46) 评论(0) 推荐(0)
摘要:多 Agent 越多越好吗?关于协作、共识与冲突Anthropic最新研究揭示多Agent系统的核心挑战:数量增加未必提升效能。当任务可独立拆分(如漏洞搜索),协作能扩大覆盖;但一旦涉及共享资源、动态依赖或目标冲突,协调成本剧增,易引发重复劳动、集体误判与行为趋同。关键不在“多少个Agent”,而在“如何共同工作”。 阅读全文
posted @ 2026-08-18 14:13 小七-七牛开发者 阅读(326) 评论(0) 推荐(1)
摘要:为什么 Go 很适合 AI 辅助开发?Google指出,Go因语法极简、工具链统一、静态类型强、编译反馈明确等特性,成为AI Coding Agent的理想协作语言——它降低AI幻觉风险,提升代码可读性与可维护性,让“生成→验证→修复”闭环更高效可靠。 阅读全文
posted @ 2026-08-17 15:34 小七-七牛开发者 阅读(36) 评论(0) 推荐(0)
摘要:Grok 4.6 连着 Bot 一起发,Manus 恢复独立,NVIDIA 拉来 5000 亿美元本期「周一上线」聚焦AI纵深演进:模型与Agent加速迈向长程任务与真实场景;资本与公司关系重构,Manus回归独立、林俊旸创立语用科技、NVIDIA联合华尔街撬动5000亿美元AI基建。开发者持续“整活”,硬核又有趣。 阅读全文
posted @ 2026-08-17 15:09 小七-七牛开发者 阅读(202) 评论(0) 推荐(0)
摘要:上下文最佳实践:写给非技术大佬看的上下文管理几个能直接用的上下文管理习惯,让 AI 少背历史包袱。 阅读全文
posted @ 2026-08-14 17:30 小七-七牛开发者 阅读(289) 评论(1) 推荐(0)
摘要:Agent 小知识 | Agent 编排的三种方式:ReAct、Plan-and-Execute 与 Workflow Graph本文深入解析Agent编排三大范式:ReAct(动态探索未知路径)、Plan-and-Execute(目标明确、可调整的结构化执行)与Workflow Graph(规则固化、安全可控的流程图)。三者非替代关系,而是按任务确定性分层协同——主干用Workflow守边界,子任务用Plan组织,细节用ReAct灵活应对。 阅读全文
posted @ 2026-08-13 16:16 小七-七牛开发者 阅读(38) 评论(0) 推荐(0)
摘要:专访 DBX 作者 t8y2:20MB 轻量工作台,如何直面 70+ 数据库的兼容挑战DBX是一款轻量开源数据库工作台,统一管理70+种数据库与数据系统(含国产信创库),支持桌面端、Web/Docker、CLI及AI SQL助手。20MB安装包,基于Tauri+Rust构建,通过内置驱动与外置Agent平衡性能与兼容性,专注解决多源切换、环境核对与操作不一致痛点。 阅读全文
posted @ 2026-08-13 14:16 小七-七牛开发者 阅读(445) 评论(1) 推荐(3)
摘要:构建持续进化的 Agent:从 GitHub 仓库提取工作流并生成 Skill 的 8 步流程该系统由Daniel García设计,构建了8个专精Agent协作的自动化流水线,持续扫描GitHub、筛选优质AI工作流、提取标准化Skill并提交PR。全程解耦人工干预,实现Agent能力的自主发现、理解与扩展,大幅提升开源能力复用效率。 阅读全文
posted @ 2026-08-12 16:08 小七-七牛开发者 阅读(26) 评论(0) 推荐(0)
摘要:Agent Memory 不只是存下来:如何设计写入、遗忘与维护机制Agent记忆系统需超越简单存储,构建覆盖写入、更新、检索、失效与治理的全生命周期管理机制,确保信息时效性、一致性与安全性。 阅读全文
posted @ 2026-08-12 15:29 小七-七牛开发者 阅读(23) 评论(0) 推荐(0)
摘要:让 Agent 自己管理 Context:长任务如何主动压缩与召回信息本文提出ACM(主动上下文管理)机制,让Agent自主决策何时压缩历史、何时回查原始信息,解决长任务中上下文膨胀与信息丢失难题。通过`manage_context`和`query_memory`双工具,实现工作记忆与长期记忆分离,在128K窗口下将222K轨迹成功执行,显著提升长任务成功率与执行稳定性。 阅读全文
posted @ 2026-08-12 14:45 小七-七牛开发者 阅读(42) 评论(0) 推荐(0)
摘要:跨模型复用 KV Cache:如何复用 Prefill 结果NVIDIA提出跨模型KV Cache映射技术,通过线性转换复用小模型生成的缓存,使大模型跳过重复Prefill,加速2.7–25倍;实验证明误差在注意力敏感方向的影响远大于整体重建精度,为高效低成本模型切换提供新范式。 阅读全文
posted @ 2026-08-12 14:14 小七-七牛开发者 阅读(23) 评论(0) 推荐(0)
摘要:代码从来不是软件开发的难点?最近,一篇题为《“Code was never the hard part” is an insult to all programmers》的文章在 Hacker News 上引起了不少讨论。它主要讲是 AI Coding 之后越来越常听到的一句话:Code was never the hard 阅读全文
posted @ 2026-08-12 14:06 小七-七牛开发者 阅读(16) 评论(0) 推荐(0)
摘要:ChatGPT 免费文本聊天将不限量,1000 万上下文来了,Cursor 品牌可能要消失本期「周一上线」聚焦AI工程化新动向:端侧轻量Agent(LFM2.5)、千万级超长上下文(Pokee-Isaac)、2.4万亿参数Coding旗舰(Qwen3.8-Max)密集发布;Cursor开源MoE训练内核,OpenAI向免费用户开放GPT-5.6不限量文本聊天。 阅读全文
posted @ 2026-08-12 13:52 小七-七牛开发者 阅读(20) 评论(0) 推荐(0)
摘要:Codex 实践系列 Vol.04:用 Goal 和 Plan 管住一个长任务从设置 Goal、让 Codex 主动推进,到人工检查实际结果,再用 Plan 收窄修改范围,这次实践至少说明了一件事:长任务交给 Agent 之后,我们可以把方向交给 Goal,把阶段性的控制交给 Plan,同时还得自己看最终结果有没有真的变好。 阅读全文
posted @ 2026-08-12 13:36 小七-七牛开发者 阅读(225) 评论(0) 推荐(0)
摘要:Agent 小知识|长任务不重来:Agent 状态保存的工程设计本文详解Agent状态的核心概念与工程实践:它不是简单记忆,而是任务执行的实时快照,涵盖进度、环境、内部判断与资源约束。通过结构化Schema、分层检查点和状态栏机制,实现可靠暂停恢复、高效决策与长程连贯性。 阅读全文
posted @ 2026-08-06 14:20 小七-七牛开发者 阅读(261) 评论(0) 推荐(1)
摘要:Coding Agent 不需要 VM:如何把 Agent、文件系统和代码执行拆出虚拟机camelAI重构Coding Agent架构,将长期驻留的虚拟机解耦为按需调用的分层执行环境:Agent运行于Cloudflare Durable Object(“脑”),文件存于SQLite+R2,常规操作交由JavaScript沙箱,仅构建/Notebook等重任务临时启用Linux容器 阅读全文
posted @ 2026-08-05 15:02 小七-七牛开发者 阅读(29) 评论(0) 推荐(0)
摘要:“打透” Harness:用 GitHub Copilot 跑通从原型、规划到实现与评审的 AI Coding 工作流面对层出不穷的AI工具与提示词,开发者常陷“工具焦虑”。GitHub AI专家Burke Holland提出:少即是多——聚焦一个成熟Agent Harness(如Copilot),通过原型→规划→实现→评审的八步工作流,把AI用深、用透、用稳。 阅读全文
posted @ 2026-08-05 14:19 小七-七牛开发者 阅读(645) 评论(0) 推荐(5)
摘要:Harness 自进化真的在变好么? 阅读全文
posted @ 2026-08-04 16:29 小七-七牛开发者 阅读(27) 评论(0) 推荐(0)
摘要:先做代码切片和行为图,证据不足再查文档、进沙箱 阅读全文
posted @ 2026-08-04 16:20 小七-七牛开发者 阅读(17) 评论(0) 推荐(0)
摘要:本期「周一上线」聚焦AI两大演进方向:模型加速迈向多模态与机器人,Agent则从“写代码”升级为长期协作、端到端交付与自我改进。DeepSeek V4-Flash、MiniMax H3、Gemini Robotics 2等密集发布,OpenAI Astra、Lilian Weng的RSI团队、贾扬清Intent Lab齐探AI自主进化;行业层面,AlphaFold团队拆分、字节整合飞书/豆包/火山引擎,技术与组织同步重构。 阅读全文
posted @ 2026-08-03 14:29 小七-七牛开发者 阅读(840) 评论(0) 推荐(1)