摘要: 一条指令,Claude 自己写好调度脚本,在后台并行跑几十到几百个 Agent,你的会话全程不被占用——这就是 Claude Code v2.1.154(2026 年 5 月 28 日)推出的 Dynamic Workflows(动态工作流)。它不是把任务拆给你看,而是把整个编排计划写成一段可复用的 JavaScript 脚本交给运行时执行,中间结果存在脚本变量里而不是你的上下文窗口里,跑完再把最终报告交还给你。适合整个代码库的 Bug 扫描、500 个文件的批量迁移、需要多来源交叉核验的深度研究——也就是任何"一个 Agent 装不下、逐轮对话太慢"的任务。本文基于官方文档全文给出从触发到监控、从保存到复用的完整实操,以及五个最实用的提示词模板。 阅读全文
posted @ 2026-07-06 13:59 vibecoding患者 阅读(51) 评论(0) 推荐(0)
摘要: 韬定律(τ scaling)是华为提出的一套接替摩尔定律的芯片演进理论,被形象地称为"摩尔定律的时间版"——不再比拼晶体管做得多小,而是比拼系统的时间常数 τ 谁更短。时间常数 τ 指一个系统对输入变化做出响应、达到稳定所需的特征时间,论文将其分解为晶体管层、电路层、芯片层、系统层四部分叠加,跨度约十二个数量级,从皮秒级铺到秒级。2026 年,华为将这篇论文更新至第二版:把摘要里笼统的"性能提升 41%"拆成频率提升 13%、功耗降低 41% 两条并讲清测试条件,补充了技术选型的取舍逻辑(为何放弃顺序式 3D 集成),并首次正面提及 3D 堆叠带来的散热难题。本文基于该论文,梳理韬定律的核心思想、两个量产案例(LogicFolding 与 AI 数据中心三件套),以及第二版新增的关键细节。 阅读全文
posted @ 2026-07-06 12:05 vibecoding患者 阅读(65) 评论(0) 推荐(0)
摘要: Loop Engineering(循环工程)是 2026 年 AI 编程的新兴实践:开发者不再逐条向编码智能体写提示词,而是设计能自动生成提示词、自动编排任务的循环系统。这个概念因两句话走红——Claude Code 负责人 Boris Cherny 说"我已经不再 prompt Claude 了……我的工作是写循环";OpenClaw 作者 Peter Steinberger 说"你不该再给编码智能体写提示词了,你该设计给它们写提示词的循环"。Andrew Ng 随后在《The Batch》中将其系统化为三层循环框架(分钟级智能体编码循环、小时级开发者反馈循环、天级外部反馈循环)。本文基于三个一手来源,拆解循环的六大构件、七个可落地模式、L1→L3 分级上线路径与三大反模式。 阅读全文
posted @ 2026-07-03 15:23 vibecoding患者 阅读(282) 评论(0) 推荐(0)
摘要: CLAUDE.md、Hooks、Skills、Subagents 是 Claude Code 的四大定制机制,分别解决四类问题:CLAUDE.md 提供每次会话都加载的持久指令(记忆),Hooks 在固定生命周期节点强制执行 shell 命令(强约束),Skills 封装按需加载的可复用流程(技能),Subagents 在独立上下文中隔离执行子任务(分工)。选择的核心判据是:事实和约定写 CLAUDE.md,必须执行的规则写 Hook,多步流程做成 Skill,会污染主上下文的探索交给 Subagent。本文基于官方文档给出四大机制的完整配置模板、选型决策表和团队工程化组合方案。 阅读全文
posted @ 2026-07-03 10:08 vibecoding患者 阅读(71) 评论(0) 推荐(0)
摘要: 模型 Agent 能力测评是指通过 Agent Arena、Terminal-Bench、OSWorld 等基准,衡量大模型在自主规划、工具调用、多步执行等智能体任务中的真实表现,是 2026 年模型选型的核心依据。Anthropic 于 2026 年 5 月 28 日发布 Claude Opus 4.8、6 月 30 日发布 Claude Sonnet 5:前者在 Agent Arena 排行榜位列第二(Thinking 模式净改进率 9.37%),是复杂 Agent 编码的首选;后者以介绍价 $2/$10 每百万 token 提供接近 Opus 4.8 的能力,是性价比之王。横向对比中,OpenAI GPT-5.5 以 xHigh 推理档位列第三,国产阵营的 GLM 5.2、DeepSeek V4、Kimi K2.7 在成本敏感场景具备竞争力。本文基于官方一手数据给出完整横评与分场景选型决策矩阵。 阅读全文
posted @ 2026-07-02 11:17 vibecoding患者 阅读(536) 评论(0) 推荐(0)
摘要: OpenAI Codex 是由 OpenAI 于 2025 年推出的编程智能体平台,分为运行在终端的轻量级 CLI(94.8k GitHub Star,2026 年 7 月最新版本 v0.142.5)和云端版 Codex Web 两种形态,核心能力是"read, edit, and run code"——支持在沙箱中后台并行处理多个独立任务。多 Agent 协作是 Codex 的核心架构设计:主 Agent 分解任务、子 Agent(Subagents)并行执行、Auto-review 自动审查,与 GitHub、Slack、Linear、MCP 协议深度集成,使单个开发者或小团队得以同时推进多条代码线,实现类似"虚拟开发团队"的工作密度。本文涵盖 Codex 多 Agent 的运行原理、并行 PR 实战步骤、AGENTS.md 配置方法、与 Cursor Agent 的选型对比,以及安全与 CI/CD 集成要点,适合希望系统掌握 AI 编程协作工作流的开发者参考。 阅读全文
posted @ 2026-07-02 10:08 vibecoding患者 阅读(3773) 评论(0) 推荐(0)
摘要: Hermes Agent 是一个"模型无关、自我改进"的开源对话式 Agent 框架,由社区开发者维护,可作为命令行工具(CLI/TUI)、消息网关或定时任务(cron worker)运行,核心卖点是"闭环学习"——Agent 会自己编写可复用的技能文档并维护持久记忆,理论上越用越强。它支持 20+ 消息渠道和多种模型 provider,架构分为交互界面、Agent 核心(工具/技能/记忆/模型四大子系统)和执行后端三层。但在实际落地中,开发者普遍反映它存在成本缓存陷阱、循环失控、自写技能不可靠、记忆污染风险和工程复杂度过高等一系列坑:一个 datetime.now() 就可能让成本翻 10 倍,Agent 会写出引用不存在工具的技能,完整搭建单人需 2-3 周。本文汇总来自实测文章的 7 大真实痛点及对应避坑方法,帮助你判断 Hermes 是否值得投入。 阅读全文
posted @ 2026-07-01 14:32 vibecoding患者 阅读(93) 评论(0) 推荐(0)
摘要: Claude Sonnet 5 于 2026 年 6 月 30 日发布,以"最擅长 Agent 的 Sonnet"为定位,用中端价格提供逼近 Opus 4.8 的性能,是当前大规模、成本敏感 Agent 场景的高性价比之选。据 Anthropic 官方说明,其发布期输出定价仅为 Opus 4.8 的 40%,并通过 effort levels 进一步给出降本空间;对多数团队,从 Sonnet 4.6 升级的迁移成本很低。 选型上,走量选 Sonnet 5、攻坚选 Opus 4.8 是基本原则。本文内容基于 2026 年 6 月至 7 月的官方数据,模型定价与 benchmark 可能随版本更新变动,建议以 Anthropic 官方 System Card 与 API 文档为准并定期核对。 阅读全文
posted @ 2026-07-01 14:10 vibecoding患者 阅读(188) 评论(0) 推荐(0)
摘要: 美团 LongCat-2.0 于 2026 年 6 月 30 日正式发布并对外开源,是业界首个在 5 万卡国产算力集群上完成全流程训练与推理的万亿参数大模型。技术规格:MoE 架构,总参数 1.6T,平均激活约 48B(动态范围 33B~56B),原生支持 1M 超长上下文,预训练数据超过 30T tokens。基准测试方面,LongCat-2.0 在 SWE-bench Pro 上拿到 59.5 分,超过 GPT-5.5(58.6)和 Claude Opus 4.6(57.3);测试版匿名以"Owl Alpha"身份上线 OpenRouter,总调用量跻身全球前三,在 Hermes 的月调用量位列全球第一。 阅读全文
posted @ 2026-07-01 10:47 vibecoding患者 阅读(1313) 评论(0) 推荐(0)
摘要: Codex 是 OpenAI 面向软件开发的编码代理,可以在本地终端、IDE、桌面 App 和云端环境中帮助开发者理解代码、修改文件、运行命令、审查差异和调试问题。根据 OpenAI Codex manual 2026 年 6 月 30 日抓取版本,Codex 当前覆盖 CLI、IDE extension、Codex app、Cloud tasks、worktrees、MCP、skills、AGENTS.md、web search、image input 和 code review 等能力;新手最稳的入门路径是先在一个 Git 仓库里用默认 workspace-write + on-request 权限运行小任务,再逐步启用 IDE、App、云端任务和自定义规则。不要一开始就给 Full Access,也不要让多个线程同时改同一批文件;Codex 的真正价值来自“清晰任务 + 可验证命令 + Git 审查”,而不是一次性把整套项目交给它自由发挥。 阅读全文
posted @ 2026-07-01 09:13 vibecoding患者 阅读(1419) 评论(0) 推荐(0)