Claude 代码自动化
核心问题:修复提示信息,而不是结果
经过几个月与人工智能生成代码的斗争,我发现了一些改变我一切的事情。
突破点:当东西坏了,不要修补结果。不要和克劳德争论。而是:
- 修改计划
- 修复提示信息
- 调整试剂配比
所以下一次运行从一开始就正常。
说到底,问题总是出在我身上,而不是机器上。但话说回来,当初也是我让机器出了问题。所以,归根结底,还是我的问题。
人工智能真的有可能取代工程师。所以我构建了一个系统,让人工智能代理管理其他人工智能代理。现在我基本上成了机器人的中层管理者。(希望它们不会发现。)
我的世界类比
你可以把它想象成在《我的世界》里搭建红石装置。你的目标不是手动挖掘每个方块,而是建造自动化系统来帮你挖掘、分类和制作物品。
同样的原则也适用于人工智能开发:构建一个能够实现以下功能的智能体系统:
- 生成代码
- 核实一下
- 随着时间的推移,他们会不断进步。
为什么这很重要
结果可以抛弃,但计划和提示却会累积。
当你在源头进行调试时,这些改进可以推广到未来的每一个任务中。它将智能体从简单的代码打印器转变为能够自我改进的同事。
主要优势:
- 不再反复遇到同样的障碍
- 通过系统性改进实现更快规模化
- 采用实验方法寻找最佳方案
我目前的配置:系统运行中
我同时打开了好几个Claude Code 窗口,每个窗口都运行在各自的Git 工作树上。以下是团队成员:
参赛选手:
- o3 和 Sonnet 4:制定详细的实施计划
- Sonnet 3.7 或 Sonnet 4:执行计划并编写代码
- o3:对照原始要求检查结果(毫不妥协,甚至有些粗鲁)
- 自定义 MCP:处理样式强制执行和库集成等特殊任务
人工智能真的有可能取代工程师,甚至取代很多工作。所以现在我每天都在调解不同人工智能模型之间关于代码质量的争论。o3 就像个严厉的老师,什么都不及格,而 Claude 只想让每个人都开心。
妙处在于:发现的任何问题都会反馈到计划模板中,而不是直接在线修复。系统能够真正实现自我改进。
管理预期
我常常觉得事情进展缓慢,因为我们都被训练成期待点击按钮就能得到想要的东西。
但这更像是和同事交谈,一起商量接下来要做什么,然后回顾你们共同制定的计划。
事实是:
- 仍然需要时间
- 比我自己规划和编写所有代码快多了。
- 在任何内容写入代码库之前捕获问题
1. 规划阶段:奠定基础
我首先给Claude Code一个高级任务,该任务会调用o3来生成一个全面的计划。
为什么 o3 在规划方面表现出色:
- 提出澄清问题以明确工作要求
- 目前为止最容易合作的
- 想起那些我怀念的事物
- 仍然需要引导它遍历代码库并提取重点文件
计划输出结构
输出结果是一个<task>-plan.md包含以下内容的文件:
- 我最初的请求
- 详细实施计划
- 潜在的极端情况和注意事项
- 它认为我错过的事情
实际例子:当我请求更新 form-block.vue 的处理流程时,o3 的方案包含以下内容:
- GraphQL 更新
- 高级自定义字段更新
- 根据之前的请求得知,需要审查多个代码库。
2. 执行阶段:将计划转化为代码
第一步: Sonnet 4 阅读计划,确认其合理性,并将其分解为可执行的任务。
步骤 2: Claude Code 使用Sonnet 3.7 或 Opus 4.5执行该计划。
- 当我需要一个优秀的思维模型来确保结果正确时,我会使用Opus 4.5 (你也可以使用像“超思维”这样的思维触发器来进行更深入的推理)。
- 我觉得这篇文章很快就会过时,因为会有新款车型推出,不过我跑题了——我想,这或许也是个更新文章的理由吧。
关键安全功能
关键说明: Claude 会为每个任务步骤编写提交记录。
好处:
- 如果出现意外情况,克劳德和我都可以恢复到之前的任何状态。
- 救命功能——始终有回滚的方法
3. 验证阶段:在问题恶化之前发现并解决
代码生成后,我会对其进行两层验证:
- 十四行诗 4:根据原始计划验证代码
- o3:对照计划和原始请求进行核实
双重验证为何有效?
这种双重验证可以发现不同类型的问题:
克劳德的倾向:
- 想要取悦
- 可能会保留不必要的向后兼容代码
- 喜欢添加lint 忽略标志
o3 的方法:
- 毫不留情地指出问题
- 要求删除不必要的代码
- 标记有问题的 lint 忽略项
我忍不住笑了,因为这简直就是我的写照(捂脸)。
人工智能真的有可能取代工程师。所以我构建了一个“好警察/坏警察”系统,Claude 编写友好的代码,而 o3 则对其进行批判性分析。我基本上是在进行一场数字化心理治疗。
关键原则:任何模型发现的问题都会被重新整合到计划模板中,而不是直接在模板内修复。他们必须自行解决错误。
入门指南:基本提示
以下是一些简单的提示,我已经添加了键盘快捷键,以便加快这些步骤(# 快捷键用于持久化项目说明,在这里尤其有用):
规划:
为 [TASK] 制定一份全面的计划。计划应包含实现要求、潜在的极端情况以及依赖关系。输出结果应为 [TASK]-plan.md。
执行:
按照 [TASK]-plan.md 中的计划逐步执行。每完成一项任务,就提交一次。
确认:
请对照 [TASK]-plan.md 文件和原始需求验证实现情况。如有任何差异,请标记出来。
有用的资源
我发现Prompts.chat这个工具非常实用。它简直太棒了,感谢所有为之做出贡献的人。
它的功能:
- 帮助你开始任何项目
- 与人工智能对话并为其分配角色
- 不仅限于编程
超越基本工作流程的扩展
负责复杂任务的专业代理
我已经开始使用MCP(使用模型上下文协议连接工具和外部系统的 AI 代理)背后的特定代理来编码更复杂的工作流程:
风格执法人员:
- 扫描所有生成的代码
- 应用本地样式规则
- 一旦 Claude 进入代码检查/测试/调试周期,就能发现问题。
图书馆集成代理:
- 评论生成的代码
- 替换通用模式(例如重试和线程/睡眠)
- 使用内部重试库
工作原理: Claude 编写的代码虽然能运行,但使用了诸如手动循环之类的基本模式。您的库集成代理会扫描这段代码,并指出“我们有更好的方法”,然后用您团队已建立的库和模式替换它。这就像一位资深开发人员审查初级开发人员的代码,并说“不要重复造轮子——使用我们现有的工具”。
API集成组合器:
- 参考API 文档和内部业务案例
- 协调多个代理进行构建:
- 集成
- 测试
- 文档
与其让您疲于奔命地处理多项任务并确保所有环节协同运作,不如让这个代理程序充当指挥者,统筹协调所有环节,最终交付完整、经过测试且文档齐全的集成方案。它本质上是将通常需要多人或数天才能完成的“添加新 API 集成”工作流程完全自动化。
构图的力量
通过构建一系列小型、专注的代理,我可以将它们组合成更复杂的工作流程。
好处:
- 每个代理人都能出色地完成一项特定任务。
- 他们携手合作,无需人工干预即可处理大量复杂功能。
- 我基本上组建了一个团队来帮助我变得更好——或者至少我是这么想的。
- 我一直致力于加快进度,并了解我使用的工具。
秘诀在于:使用 Git 工作树进行并行开发
这种方法的强大之处在于:尝试完成一项任务基本上是免费的,所以我正是这样做的。
Git 工作树让我可以并排打开多个 Claude Code 实例,每个实例同时构建不同的功能。
并行开发是如何运作的
每个窗口独立运行,各自拥有自己的:
- 对话历史
- 语境
- 重点关注
示例设置:
- 窗口 1:完成用户身份验证
- 窗口 2:构建支付集成
- 窗口 3:修复仪表盘中的错误
我仍然手动合并,但我不再需要照看单个代理了。
人工智能真的有可能取代工程师。所以我构建了一个系统,让多个人工智能同时处理不同的功能。这就像拥有一支永远不会疲倦、永远不会抱怨、永远不会要求加薪或抱怨工作与生活失衡的实习生团队。
核心理念
关键在于:我克制住想要改变结果的冲动,而是去改变提示语。
那个循环就是系统本身。
- 代码本身是可丢弃的。
- 指令和代理人才是真正的资产。
- 花时间计划和构思提示语至关重要
就像你会花时间培训新团队成员,而不是不断地修补他们的工作一样——投资于基础,而不是结果。
我正在进行几项改进工作
更好的协调
- 目前我是手动启动的。
- 需要自动化工作流程管理
- 需要处理代理之间的依赖关系。
文档对齐方式
- 改变我们获取信息的方式
- 转向更高层次的抽象,以便智能体能够更有效地使用。
- 侧重于用例而非底层实现细节。
复杂工作流程扩展
- 当前配置可以处理相当复杂的工作流程。
- 希望进一步探讨:
- 更多代理商
- 更好的协调
- 更复杂的交互
底线
AI 会处理那些枯燥乏味的事情,而我可以假装自己是一位富有远见的建筑师,而不是一个曾经花费三个小时来调试缺失分号的人。
工具会不断改进,但主要思路不变:修复指令,而不是输出。
当你不再手动修正人工智能输出的结果,而是从一开始就教它做得更好时,奇妙的事情就会发生。
你不仅仅是在更快地编写代码——你是在构建一个能够真正学习和自我改进的系统。
事情就此变得有趣起来。
高级提示和快捷方式
如果您想深入了解,这里收集了一些更专业的提示和 Claude Code 快捷键,可以处理复杂的工作流程……
🎯 规划与建筑提示
# Initial Planning (with o3 or Claude)
"Create a comprehensive plan for [TASK]. Include:
- Implementation requirements
- Potential edge cases I might have missed
- Dependencies across codebases
- Architecture considerations
- Security implications
Output to [TASK]-plan.md"
# Plan Verification
"Read the plan in [TASK]-plan.md, verify it makes sense, and break it into actionable tasks with clear success criteria"
# Architecture Review
"Review the current architecture and suggest improvements for scalability, maintainability, and performance"
# Dependency Analysis
"Analyze all dependencies in this project and identify:
- Outdated packages
- Security vulnerabilities
- Unused dependencies
- Optimization opportunities"复制
🚀 执行与实施提示
# Step-by-Step Implementation
"Execute the plan in [TASK]-plan.md step by step. Write a commit for each completed task. Use descriptive commit messages following conventional commits format"
# Safe Mode Execution
"Implement [FEATURE] but show me each change before applying it. Explain your reasoning for each modification"
# Test-Driven Development
"First write comprehensive tests for [FEATURE], then implement the feature to pass all tests"
# Refactoring with Safety
"Refactor [CODE/FILE] to improve [METRIC]. Create a backup first, then show me the diff before applying changes"复制
✅ 验证和质量保证提示
# Dual Verification
"Verify the implementation against both [TASK]-plan.md AND the original requirements. Flag any discrepancies or missing features"
# Code Review
"Review this code for:
- Logic errors
- Security vulnerabilities
- Performance issues
- Code style violations
- Unnecessary backwards compatibility
Remove any lint ignore flags unless absolutely necessary"
# Test Coverage Analysis
"Analyze test coverage and write additional tests for uncovered edge cases"
# Performance Audit
"Profile this code and identify performance bottlenecks. Suggest optimizations with benchmarks"复制
🛠️ 开发工作流程提示
# Project Onboarding
"Analyze this codebase and create a comprehensive CLAUDE.md file with:
- Project overview
- Architecture patterns
- Key commands
- Development workflow
- Coding conventions"
# Documentation Generation
"Generate comprehensive documentation for [MODULE/API] including:
- Usage examples
- API reference
- Common patterns
- Troubleshooting guide"
# Migration Planning
"Create a migration plan from [OLD_TECH] to [NEW_TECH] with:
- Step-by-step process
- Rollback strategy
- Risk assessment
- Testing checklist"
# Debugging Assistant
"Debug this issue: [DESCRIPTION]. Use console.log strategically, check error boundaries, and trace the execution flow"复制
🔧 高级 Claude Code CLI 命令
# Session Management
claude --resume # Resume last session
/clear # Reset context
/summarize # Summarize long conversations - <mark>custom command</mark>
# Planning Mode
Shift+Tab (twice) # Enter planning mode
/plan # Alternative planning command - <mark>custom command</mark>
# File Operations
/add **/*.js # Add all JS files to context
/remove tests/ # Remove test files from context - <mark>custom command</mark>
/lint # Run linter on modified files - <mark>custom command</mark>
# Git Integration
claude diff # Show current changes
claude commit # Smart commit with message
create a pr # Create pull request
# <mark>custom command</mark>s
/init # Bootstrap CLAUDE.md
/memory # Edit project memory
/hooks # Configure automation hooks
/permissions # Manage Claude's permissions
# Model Selection
/model opus # Switch to Opus for complex tasks
/model sonnet # Switch to Sonnet for speed
# Productivity Shortcuts
Ctrl+C # Stop current operation
Escape # Interrupt and redirect
Double Escape # Jump back in history
Tab # Autocomplete filenames复制
📋 自定义斜杠命令(添加到 .claude/commands/)
analyze-pr.md
Please analyze PR #$ARGUMENTS:
1. Use 'gh pr view' to get details
2. Review code changes for bugs and security issues
3. Check test coverage
4. Verify against coding standards
5. Provide concise, actionable feedback复制
quick-fix.md
Fix the issue: $ARGUMENTS
1. Identify the root cause
2. Implement minimal necessary changes
3. Add tests if needed
4. Commit with descriptive message
5. Verify fix doesn't break other features复制
优化性能.md
Optimize performance for: $ARGUMENTS
1. Profile current performance
2. Identify bottlenecks
3. Implement optimizations
4. Benchmark improvements
5. Document changes复制
🎨 UI/前端开发提示
# Component from Mockup
"[Image] Build this UI component with:
- Semantic HTML
- Tailwind CSS (core utilities only)
- Proper accessibility
- Responsive design
- Smooth animations"
# Design System Integration
"Create a component that follows our design system. Reference CLAUDE.md for tokens and patterns"
# Interactive Prototyping
"Build an interactive prototype with:
- Realistic data
- Error states
- Loading states
- Edge case handling"复制
🔐 安全与最佳实践提示
# Security Audit
"Perform a security audit focusing on:
- Input validation
- Authentication/authorization
- Data sanitization
- SQL injection prevention
- XSS protection"
# Code Quality Check
"Review code quality:
- SOLID principles adherence
- DRY violations
- Code complexity
- Naming conventions
- Documentation completeness"复制
⚡自动化和钩子配置
# Pre-commit Hook
{
"matcher": "Bash(git commit:*)",
"preToolUse": "npm run lint && npm test"
}
# Post-edit Hook
{
"matcher": "Edit",
"postToolUse": "npm run format"
}
# Documentation Update Hook
{
"matcher": "Edit(*.js|*.ts)",
"postToolUse": "npm run docs:generate"
}复制
🚨 紧急和恢复指令
# Quick Rollback
"Revert all changes since last commit"
# Safe Mode Flag
claude --dangerously-skip-permissions
# Snapshot Creation
"Create a git stash with descriptive name before making major changes"
# Conflict Resolution
"Resolve merge conflicts favoring [ours/theirs] and explain each decision"复制
💡 专业技巧和键盘快捷键
- 尽早部署,频繁部署:
git add经常使用以创建恢复点 - 多个工作树:
git worktree add ../project-feature-x用于并行 Claude 会话 - 无头模式:
claude -p "prompt" --output-format json用于 CI/CD 集成 - 自动接受模式:
Shift+Tab切换自主工作模式 - 上下文保留
/summarize:在达到令牌限制之前使用-自定义命令也使用/compact - 自定义主题:
/config与您的终端主题相匹配
🎮 高级工作流程组合
# Full Feature Development Flow
"1. Plan feature X → 2. Implement with TDD → 3. Review & optimize → 4. Document → 5. Create PR"
# Rapid Prototyping
"Build MVP for [IDEA] with basic functionality. Focus on core features, skip polish"
# Bug Hunt Mode
"Systematically find and fix all bugs in [MODULE]. Create test for each bug found"
# Refactoring Sprint
"Refactor for [GOAL] while maintaining 100% test coverage. Show before/after metrics"复制

浙公网安备 33010602011771号