摘要:
Codex 用不好,多数不是模型问题,而是配置问题——官方最佳实践原文写着:"很多质量问题其实是环境设置问题(wrong directory, missing tools)"。本文把官方 Troubleshooting、Sandboxing、Best Practices 三份文档中的坑点,按国内开发者的踩坑频率重排为七类:环境安装坑、沙箱权限坑、Worktree 坑、提示词坑、AGENTS.md 坑、上下文管理坑、自动化坑,每个坑都给出官方修复方案和一条"防坑规则"。通读一遍大约 10 分钟,能省掉的排查时间以天计。 阅读全文
posted @ 2026-07-07 16:30
vibecoding患者
阅读(8550)
评论(0)
推荐(0)
摘要:
J-space(全局工作空间)是 Anthropic 在 2026 年 7 月的研究《A Global Workspace in Language Models》中发现的一小组内部神经模式,它在 Claude 的内部激活中扮演着类似神经科学"全局工作空间"的角色——一个让信息变得可被"意识到"、可调用的共享心智通道。它的名字来自发现它所用的 Jacobian(雅可比)技术。关键在于,J-space 不是模型对外可见的思维链(chain-of-thought)输出,而是安静运行在内部激活里的表示——Claude 可以"想"一个概念却不把它写出来。研究发现,J-space 具备可报告、可自主控制、参与因果推理等五个功能特性,且它并非人为设计,而是在训练中自发涌现。本文基于 Anthropic 官方研究,解读 J-space 是什么、如何被发现、有哪些特性,以及它对理解大模型认知的意义。 阅读全文
posted @ 2026-07-07 10:54
vibecoding患者
阅读(1031)
评论(0)
推荐(0)
摘要:
OpenCode 是一个开源、支持 75+ 供应商和本地模型的终端 AI 编码 Agent,安装最简单的方式是官方脚本 curl -fsSL https://opencode.ai/install | bash,配置通过 opencode.json 完成、模型 ID 采用 provider_id/model_id 格式,并支持全局/项目/环境变量多级配置合并。
上手路径很清晰:先装(脚本或 npm)→ 用 /connect 加供应商 → 用 /models 选模型 → 在 opencode.json 设默认。对国内用户,通过 OpenAI 兼容的自定义 provider 即可接入国内多模型平台。本文内容基于 OpenCode 官方文档(opencode.ai/docs)2026 年公开信息,命令与配置字段可能随版本更新变动,建议以官方文档为准并定期核对。 阅读全文
posted @ 2026-07-06 17:31
vibecoding患者
阅读(197)
评论(0)
推荐(0)
摘要:
一条指令,Claude 自己写好调度脚本,在后台并行跑几十到几百个 Agent,你的会话全程不被占用——这就是 Claude Code v2.1.154(2026 年 5 月 28 日)推出的 Dynamic Workflows(动态工作流)。它不是把任务拆给你看,而是把整个编排计划写成一段可复用的 JavaScript 脚本交给运行时执行,中间结果存在脚本变量里而不是你的上下文窗口里,跑完再把最终报告交还给你。适合整个代码库的 Bug 扫描、500 个文件的批量迁移、需要多来源交叉核验的深度研究——也就是任何"一个 Agent 装不下、逐轮对话太慢"的任务。本文基于官方文档全文给出从触发到监控、从保存到复用的完整实操,以及五个最实用的提示词模板。 阅读全文
posted @ 2026-07-06 13:59
vibecoding患者
阅读(51)
评论(0)
推荐(0)
摘要:
韬定律(τ scaling)是华为提出的一套接替摩尔定律的芯片演进理论,被形象地称为"摩尔定律的时间版"——不再比拼晶体管做得多小,而是比拼系统的时间常数 τ 谁更短。时间常数 τ 指一个系统对输入变化做出响应、达到稳定所需的特征时间,论文将其分解为晶体管层、电路层、芯片层、系统层四部分叠加,跨度约十二个数量级,从皮秒级铺到秒级。2026 年,华为将这篇论文更新至第二版:把摘要里笼统的"性能提升 41%"拆成频率提升 13%、功耗降低 41% 两条并讲清测试条件,补充了技术选型的取舍逻辑(为何放弃顺序式 3D 集成),并首次正面提及 3D 堆叠带来的散热难题。本文基于该论文,梳理韬定律的核心思想、两个量产案例(LogicFolding 与 AI 数据中心三件套),以及第二版新增的关键细节。 阅读全文
posted @ 2026-07-06 12:05
vibecoding患者
阅读(65)
评论(0)
推荐(0)
摘要:
Loop Engineering(循环工程)是 2026 年 AI 编程的新兴实践:开发者不再逐条向编码智能体写提示词,而是设计能自动生成提示词、自动编排任务的循环系统。这个概念因两句话走红——Claude Code 负责人 Boris Cherny 说"我已经不再 prompt Claude 了……我的工作是写循环";OpenClaw 作者 Peter Steinberger 说"你不该再给编码智能体写提示词了,你该设计给它们写提示词的循环"。Andrew Ng 随后在《The Batch》中将其系统化为三层循环框架(分钟级智能体编码循环、小时级开发者反馈循环、天级外部反馈循环)。本文基于三个一手来源,拆解循环的六大构件、七个可落地模式、L1→L3 分级上线路径与三大反模式。 阅读全文
posted @ 2026-07-03 15:23
vibecoding患者
阅读(270)
评论(0)
推荐(0)
摘要:
CLAUDE.md、Hooks、Skills、Subagents 是 Claude Code 的四大定制机制,分别解决四类问题:CLAUDE.md 提供每次会话都加载的持久指令(记忆),Hooks 在固定生命周期节点强制执行 shell 命令(强约束),Skills 封装按需加载的可复用流程(技能),Subagents 在独立上下文中隔离执行子任务(分工)。选择的核心判据是:事实和约定写 CLAUDE.md,必须执行的规则写 Hook,多步流程做成 Skill,会污染主上下文的探索交给 Subagent。本文基于官方文档给出四大机制的完整配置模板、选型决策表和团队工程化组合方案。 阅读全文
posted @ 2026-07-03 10:08
vibecoding患者
阅读(70)
评论(0)
推荐(0)
摘要:
模型 Agent 能力测评是指通过 Agent Arena、Terminal-Bench、OSWorld 等基准,衡量大模型在自主规划、工具调用、多步执行等智能体任务中的真实表现,是 2026 年模型选型的核心依据。Anthropic 于 2026 年 5 月 28 日发布 Claude Opus 4.8、6 月 30 日发布 Claude Sonnet 5:前者在 Agent Arena 排行榜位列第二(Thinking 模式净改进率 9.37%),是复杂 Agent 编码的首选;后者以介绍价 $2/$10 每百万 token 提供接近 Opus 4.8 的能力,是性价比之王。横向对比中,OpenAI GPT-5.5 以 xHigh 推理档位列第三,国产阵营的 GLM 5.2、DeepSeek V4、Kimi K2.7 在成本敏感场景具备竞争力。本文基于官方一手数据给出完整横评与分场景选型决策矩阵。 阅读全文
posted @ 2026-07-02 11:17
vibecoding患者
阅读(503)
评论(0)
推荐(0)
摘要:
OpenAI Codex 是由 OpenAI 于 2025 年推出的编程智能体平台,分为运行在终端的轻量级 CLI(94.8k GitHub Star,2026 年 7 月最新版本 v0.142.5)和云端版 Codex Web 两种形态,核心能力是"read, edit, and run code"——支持在沙箱中后台并行处理多个独立任务。多 Agent 协作是 Codex 的核心架构设计:主 Agent 分解任务、子 Agent(Subagents)并行执行、Auto-review 自动审查,与 GitHub、Slack、Linear、MCP 协议深度集成,使单个开发者或小团队得以同时推进多条代码线,实现类似"虚拟开发团队"的工作密度。本文涵盖 Codex 多 Agent 的运行原理、并行 PR 实战步骤、AGENTS.md 配置方法、与 Cursor Agent 的选型对比,以及安全与 CI/CD 集成要点,适合希望系统掌握 AI 编程协作工作流的开发者参考。 阅读全文
posted @ 2026-07-02 10:08
vibecoding患者
阅读(3486)
评论(0)
推荐(0)
摘要:
Hermes Agent 是一个"模型无关、自我改进"的开源对话式 Agent 框架,由社区开发者维护,可作为命令行工具(CLI/TUI)、消息网关或定时任务(cron worker)运行,核心卖点是"闭环学习"——Agent 会自己编写可复用的技能文档并维护持久记忆,理论上越用越强。它支持 20+ 消息渠道和多种模型 provider,架构分为交互界面、Agent 核心(工具/技能/记忆/模型四大子系统)和执行后端三层。但在实际落地中,开发者普遍反映它存在成本缓存陷阱、循环失控、自写技能不可靠、记忆污染风险和工程复杂度过高等一系列坑:一个 datetime.now() 就可能让成本翻 10 倍,Agent 会写出引用不存在工具的技能,完整搭建单人需 2-3 周。本文汇总来自实测文章的 7 大真实痛点及对应避坑方法,帮助你判断 Hermes 是否值得投入。 阅读全文
posted @ 2026-07-01 14:32
vibecoding患者
阅读(91)
评论(0)
推荐(0)
浙公网安备 33010602011771号