Anthropic公开Claude Code团队内部验证循环,包括代码审查、简化、验证和设计四项自动检查,实现智能体工作流程从人工检查转向自动验证和迭代修复
本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。
Anthropic于7月22日公开了Claude Code团队内部的验证循环。该循环让Claude在完成代码编写后自动执行四项检查:code-review用于查找并修复bug,simplify用于简化冗余实现,verify用于端到端验证,design用于当涉及改动时对照DESIGN.md核对视觉。这改变了智能体工作流程,从原本的收集上下文、执行动作、人工检查,变为收集上下文、执行动作、自动验证、修复、再验证的迭代过程。
Claude Code团队每天使用这四个Skill进行自查。code-review专门审查代码改动,揪出潜在bug并提供审查意见。simplify清理本次改动的diff,删除绕来绕去的复杂实现,让结构变简单。verify进行端到端验证,确认功能真正完成。design在动了UI时上场,对着仓库里的DESIGN.md逐条核对视觉实现。这些Skill的底层依赖Claude Code已内置的验证支持:内置的/verify能把应用跑起来观察变化,CLAUDE.md中写明的构建和测试命令会被执行;还有专门在PR上做多智能体审查的Code Review、能在每次提交时自动开火的GitHub Actions。
Anthropic给出了编写验证Skill的方法:将每次需要手动执行的检查用大白话写下来,就像给新同事交代注意事项。如果描述不清楚,可以先让Claude给一版通用最佳实践再修改。检查例子包括:任何删掉数据库字段却没有配套数据迁移步骤的改动一律打回。写好的Skill可以丢给skill-creator或直接放入.claude/skills/目录下的Markdown文件。对于无法修改的内置Skill,可以写一个外壳Skill先调原来的再调自己的验证。
验证Skill的触发有四种自动化级别:Standalone为手动触发,Embedded嵌入任务流程,Chained将多个验证Skill串成链自动执行,On every PR为每次提交代码自动运行。Skill正在成为跨厂商的开放标准,GitHub Copilot、Cursor、OpenAI Codex、Gemini CLI已采用同一套格式,这意味着为团队沉淀的Skill不会被锁死在某一家工具上。