摘要:
整体来看,OpenAI 内部使用 Codex 的方式并不复杂。一般是用在边界比较清楚、可以验证、可以 review 的工程任务里:读懂代码、做迁移、补测试、查性能问题、生成初始实现,或者处理一些暂时不想打断当前工作的零散任务。 阅读全文
posted @ 2026-05-26 18:23
小七-七牛开发者
阅读(33)
评论(0)
推荐(0)
摘要:
今天来解读下论文「Is Grep All You Need? How Agent Harnesses Reshape Agentic Search」。论文的作者们均来自 PwC U.S. 的 AI 研究团队,研究方向偏企业内部 AI 工程与 Agent 应用。这个背景也解释了为什么这篇论文没有只停留 阅读全文
posted @ 2026-05-26 18:22
小七-七牛开发者
阅读(8)
评论(0)
推荐(0)
摘要:
这期的 News 有点像开发者版“工具和玩具一起上线”。 工具这边,大模型和 AI 编程产品还在继续更新:Cursor 发布 Composer 2.5,Warp 开始支持自带推理接口,OpenAI 给 Codex 加了 Appshots,Qwen 也发布了面向 Agent 时代的新模型;开源社区里, 阅读全文
posted @ 2026-05-26 18:18
小七-七牛开发者
阅读(8)
评论(0)
推荐(0)
摘要:
当 Agent 完成任务所需的连续步骤变长时,AI Agent 的训练和执行会出现什么变化,以及如何降低这种长链路(多步骤)带来的结果不稳定。 阅读全文
posted @ 2026-05-23 15:31
小七-七牛开发者
阅读(27)
评论(0)
推荐(0)
摘要:
用户要的往往不是一个标准答案,而是一种判断、一种情感陪伴,甚至是一种选择确认。这也给 AI 带来了一个新问题:当用户带着情绪和立场来求助时,是应该安慰,还是应该反驳? 阅读全文
posted @ 2026-05-23 15:22
小七-七牛开发者
阅读(21)
评论(0)
推荐(0)
摘要:
有开发者把马斯克、巴菲特、大神 Karpathy,还有一些知名博主的工作方法,做成了可以直接在终端(比如 Claude Code)里调用的 Skill。 阅读全文
posted @ 2026-05-23 15:06
小七-七牛开发者
阅读(20)
评论(0)
推荐(0)
摘要:
只要你和现在的 AI 工具交流,无论是 Codex、Claude,还是 ChatGPT、DeepSeek、豆包,你应该都注意过一件事:它并不是一次性把完整答案吐出来,而是一个字接着一个字,慢慢形成一行字,再逐渐生成一整段话,直到所有结果都返回完毕。 而你看到的第一个 token,往往要等一会儿才出现 阅读全文
posted @ 2026-05-22 16:05
小七-七牛开发者
阅读(24)
评论(0)
推荐(0)
摘要:
上周,Google Cloud / Gemini 工程师 Addy Osmani 写了一篇文章,题目叫《Agent Harness Engineering》。 只看标题的话,Harness Engineering 这个话题其实已经不算新鲜了。从年初到现在,Harness Engineering 这个 阅读全文
posted @ 2026-05-20 18:20
小七-七牛开发者
阅读(11)
评论(0)
推荐(0)
摘要:
上周技术圈的信息挺杂,但有几条线索值得放在一起看。 一边,AI 产品继续往具体工作流里走:Claude Code 开始支持 Agent View,OpenAI 把 Codex 带到移动端;另一边,开发者社区继续整活:有人给 Claude Code 做实体旋钮,有人做 Claude 用量桌面仪表盘,还 阅读全文
posted @ 2026-05-19 17:35
小七-七牛开发者
阅读(10)
评论(0)
推荐(0)
摘要:
不知道你平时用的 IDE 是什么?小七的工程师同事有在用 Vim 的,也有 Emacs 党,IntelliJ 全家桶也有人在用,用得最多的可能是 VS Code。只要代码能写好、工具链能跑通,似乎大家没有必要使用同一个 IDE。 Google 早年也是如此。在 Google 工作了 13 年(201 阅读全文
posted @ 2026-05-19 17:35
小七-七牛开发者
阅读(10)
评论(0)
推荐(0)
浙公网安备 33010602011771号