随笔分类 -  AI Coding / Skill

1
摘要:Agent 小知识|长任务不重来:Agent 状态保存的工程设计本文详解Agent状态的核心概念与工程实践:它不是简单记忆,而是任务执行的实时快照,涵盖进度、环境、内部判断与资源约束。通过结构化Schema、分层检查点和状态栏机制,实现可靠暂停恢复、高效决策与长程连贯性。 阅读全文
posted @ 2026-08-06 14:20 小七-七牛开发者 阅读(86) 评论(0) 推荐(1)
摘要:Coding Agent 不需要 VM:如何把 Agent、文件系统和代码执行拆出虚拟机camelAI重构Coding Agent架构,将长期驻留的虚拟机解耦为按需调用的分层执行环境:Agent运行于Cloudflare Durable Object(“脑”),文件存于SQLite+R2,常规操作交由JavaScript沙箱,仅构建/Notebook等重任务临时启用Linux容器 阅读全文
posted @ 2026-08-05 15:02 小七-七牛开发者 阅读(7) 评论(0) 推荐(0)
摘要:“打透” Harness:用 GitHub Copilot 跑通从原型、规划到实现与评审的 AI Coding 工作流面对层出不穷的AI工具与提示词,开发者常陷“工具焦虑”。GitHub AI专家Burke Holland提出:少即是多——聚焦一个成熟Agent Harness(如Copilot),通过原型→规划→实现→评审的八步工作流,把AI用深、用透、用稳。 阅读全文
posted @ 2026-08-05 14:19 小七-七牛开发者 阅读(437) 评论(0) 推荐(5)
摘要:Claude 新模型的上下文工程:从堆规则到设计上下文Anthropic提出“上下文工程”(Context Engineering)新范式:Claude Opus 5/Fable 5删减超80%系统提示词,性能未降。核心转向“瘦提示-厚工件-瘦技能”,强调模型自主判断、渐进披露与高保真参考,告别冗余规则堆砌。 阅读全文
posted @ 2026-07-31 15:25 小七-七牛开发者 阅读(225) 评论(0) 推荐(1)
摘要:AI 模型是如何训练出来的本文用人类学习类比AI训练,通俗解析大模型如何通过预训练、监督微调与强化学习掌握新技能;详解Model Spec、宪法等行为规范如何引导AI成为可靠协作者,并介绍评测与持续对齐的关键作用。 阅读全文
posted @ 2026-07-30 14:42 小七-七牛开发者 阅读(20) 评论(0) 推荐(0)
摘要:Agent 小知识|让 Agent 调对工具:输入输出契约的设计本文详解Agent工具调用的输入输出契约:输入契约规范工具名称、描述、参数Schema与使用边界,确保模型准确调用;输出契约定义结构化结果、状态码与错误反馈,支撑模型可靠决策。二者共同保障Agent“思考→行动→判断”闭环的稳定性与可解释性。 阅读全文
posted @ 2026-07-30 14:10 小七-七牛开发者 阅读(137) 评论(0) 推荐(0)
摘要:从 GPT-2 到 Kimi K3:22580 倍规模增长背后的架构演进本文深度解析Kimi K3技术演进路径:从GPT-2出发,历经Linear Attention、DeltaNet、Gated DeltaNet、Kimi Linear,最终抵达2.8万亿参数的Kimi K3。全文以“状态管理”为主线,揭示架构迭代本质 阅读全文
posted @ 2026-07-29 15:24 小七-七牛开发者 阅读(282) 评论(1) 推荐(0)
摘要:大规模代码如何用 Claude Code 进行迁移Anthropic团队近期利用Claude系列模型,将Bun等百万行级项目从Zig、Python等语言高效迁至Rust/TypeScript:Jarred 11天完成Bun百万行迁移,Mike一个周末重构16.5万行Python为TS。AI驱动六步流程大幅压缩周期与成本,同时保障功能一致性和性能提升。 阅读全文
posted @ 2026-07-29 13:52 小七-七牛开发者 阅读(79) 评论(0) 推荐(0)
摘要:下个吉时|我让 AI 给 GitHub 项目算了一个“合并代码的良辰吉时”“合历”是一款趣味AI Coding实践项目,为GitHub仓库智能推荐代码合并与发布的“良辰吉时”,通过这款趣味实践项目,一篇带你走完AI从零开始写的完整工程实践 阅读全文
posted @ 2026-07-27 13:46 小七-七牛开发者 阅读(195) 评论(1) 推荐(2)
摘要:从 Prompter 到 Loop 设计者:成为 10x 开发者的 20 步路线图本文系统解读“Loop Engineering”AI协作新范式:工作单元正从“一句Prompt”升级为“一个可自主运行的Loop”。文章以四阶段、二十步实操路线图,详解如何设计含验证、终止、状态与人工检查点的可靠循环系统,助你从手动提示者蜕变为AI系统架构师。 阅读全文
posted @ 2026-07-23 14:16 小七-七牛开发者 阅读(16) 评论(0) 推荐(0)
摘要:Agent 小知识:把动态 Prompt 做成一个系统组件本文详解Agent时代Prompt的范式升级:从静态文本迈向动态拼装。它将Prompt拆解为稳定、任务、状态、外部四类信息,按执行阶段实时组合,兼顾上下文精简与关键信息聚焦,是支撑ReAct循环、保障Agent稳定性的核心工程能力。 阅读全文
posted @ 2026-07-23 13:52 小七-七牛开发者 阅读(191) 评论(0) 推荐(0)
摘要:Agent Graph Engineering:从线性 Workflow 到可扩展 Agent 系统本文介绍Agent图编排(Agent Graph Engineering)的核心思想:摒弃简单串行流程,以数据依赖关系构建节点(Agent/代码)与边(数据流)组成的有向图。强调清晰输入输出约定、并行执行、故障隔离、验证机制与动态循环设计,提升系统可组合性、稳定性与成本效率。 阅读全文
posted @ 2026-07-22 14:08 小七-七牛开发者 阅读(167) 评论(0) 推荐(1)
摘要:Dario 常驻 Codex|从生图到安装,手把手带你换一套 Codex 皮肤本文为 macOS 用户提供的 Codex Desktop 换肤实践指南,基于开源项目 Codex Dream Skin,教你用 ChatGPT 生成像素风“Dario”主题背景图,并完成一键定制与还原。非官方教程,适配 Windows 可参考流程。需 ChatGPT 会员及基础操作经验。 阅读全文
posted @ 2026-07-17 14:20 小七-七牛开发者 阅读(318) 评论(0) 推荐(1)
摘要:Agent 小知识|上下文预算:让 Agent 知道该看什么本文详解Agent系统中关键的“上下文预算”概念:区别于Chatbot的静态对话,Agent需动态管理有限上下文窗口,科学分配目标、规则、工具、记忆与历史等信息。通过固定保留、最近保留、压缩摘要、按需加载四类策略,平衡信息完整性与模型效率,保障长任务稳定执行。 阅读全文
posted @ 2026-07-16 13:55 小七-七牛开发者 阅读(203) 评论(0) 推荐(0)
摘要:Codex 实践系列 Vol.03:Codex 那些好用的 slash command本文是Codex系列第三篇,聚焦真实项目协作:以AI志愿填报Demo为案例,详解`/status`、`/goal`、`/plan`等核心slash命令的实战用法——从确认环境、设定目标、规划修改,到聚焦文件、审查diff、复查逻辑、压缩长对话,系统提升AI编程的可控性与工程规范性。 阅读全文
posted @ 2026-07-13 15:17 小七-七牛开发者 阅读(14) 评论(0) 推荐(0)
摘要:别再手调 RAG 了,让 Loop 自己找配置本文介绍如何用工程化 Loop 自动调优 RAG 参数:通过定义搜索空间、构建自动评估函数(recall@k)、设置最小提升阈值与 train/holdout 拆分防过拟合,并集成运行次数与预算双熔断机制,实现目标驱动、可复现、可审计的智能调参闭环。 阅读全文
posted @ 2026-07-13 14:58 小七-七牛开发者 阅读(22) 评论(0) 推荐(0)
摘要:300 个 Agent 一起干活,Claude 负责验收:一次自进化的 Loop Engineerig 实践Kimi 2.6 Swarm 搭配 Opus 4.8 的最佳实践 阅读全文
posted @ 2026-06-25 14:56 小七-七牛开发者 阅读(50) 评论(0) 推荐(0)
摘要:SkillOpt 让你的 Skill 实现自进化SkillOpt是微软开源的文本空间优化器,专为优化Agent的自然语言技能文档(如Markdown格式的skill.md)而设计。它不修改模型参数,而是通过“执行-反思-更新-验证”闭环,自动迭代出更鲁棒的`best_skill.md`,让技能持续适配真实任务,提升Agent在复杂流程、多源判断、跨项目迁移等场景中的稳定性与准确性。 阅读全文
posted @ 2026-06-24 18:43 小七-七牛开发者 阅读(72) 评论(0) 推荐(0)
摘要:工程实践|Warp 的 Loop Engineering:Agent 如何自己改进 Skill?Warp 团队提出“双循环驱动”AI Agent进化:内循环(Inner Loop)自动分诊GitHub Issue;外循环(Outer Loop)从人类反馈中提炼规则,生成PR更新技能文件(SKILL.md)。技能即SOP,可审查、可回滚、持续迭代,让Agent越用越懂团队。 阅读全文
posted @ 2026-06-24 17:54 小七-七牛开发者 阅读(60) 评论(0) 推荐(0)
摘要:Skills 是什么?Claude 官方教你做一个好用的 SkillSkills 可以理解成 Claude Code 给 Agent 准备的任务经验包。它把一类任务里反复出现的说明、脚本、模板、配置、坑点和历史记录放在一起,让 Claude 下次遇到类似任务时,可以直接复用已有经验。 阅读全文
posted @ 2026-06-11 17:03 小七-七牛开发者 阅读(117) 评论(0) 推荐(0)

1