怎样学 Claude Agent 开发:一条七步路线
能落地的 Claude agent 开发学习路线:从 Messages API、tool use、agent 循环到子代理、MCP、Agent SDK,用 CCA-F 当里程碑。
更新于
学 Claude agent 开发最快的路径,是按顺序爬同一架梯子:无状态的 Messages API,然后 tool use,然后 agent 循环,然后多 agent 编排,然后 MCP,然后 Claude Code,最后 Agent SDK。每一级都复用下一级,跳级正是多数自学工程师后来卡住的原因。
Claude Certified Architect – Foundations 考试(CCA-F)考的恰好就是这一整套栈,所以把它当里程碑很合适,不算绕路。下面每一步都链接到本站免费的学习指南文章,你可以直接从概念跳到练习。
为什么要按这个顺序学?
每一层都建立在下一层之上。tool use 是无状态消息数组之上的一套约定;agent 循环是反复执行 tool use 直到模型停下;子代理是协调者用精心准备的提示词启动的 agent 循环;MCP 是提供工具的标准方式;Claude Code 和 Agent SDK 是把上面所有东西打包好的产品。先学高层,它的失败模式看起来像魔法;按顺序学,每一层都只是一小步。
七个步骤分别是什么?
第 1 步:理解 Messages API 没有记忆
其他一切都建立在一个事实上:每次 API 请求彼此独立。没有会话,没有服务端状态。发第 4 轮时,你发的是第 1 到第 4 轮的全部内容。system 提示位于请求顶层,与 messages 分开,为每一轮定框架。
如果你见过一段”对话”突然忘了上下文,那不是服务器忘了,是客户端不再发送历史了。读一下 Messages API 没有记忆——每次请求都是从零开始和读懂响应:stop_reason 才是你的控制信号,然后写一个 30 行的脚本,维护一个消息数组,把每次 assistant 的回复追加进去。这个脚本就是你以后每个 agent 的种子。
**检查点:**你能解释为什么输入成本随轮数增长,能说出最重要的两个 stop_reason 值。
第 2 步:把 tool use 当协议学,不是当功能学
tool use 是跨越至少两次 API 调用的六步舞:你定义工具,模型返回 tool_use 块,你的代码执行它,你把引用同一 ID 的 tool_result 发回去,模型继续。Claude 自己从不执行任何东西。这种分离就是为什么安全和限流归你管,不归模型管。
练习方式:定义一个带真实 input_schema 的工具,观察模型用你没有硬编码的参数调用它。然后故意搞坏它:把描述缩成五个词,看选择准确率怎么滑坡。文章:Tool Use 的舞步:六个步骤,三次 API 调用、定义工具:名称、描述和输入 Schema,以及领域 2 的简略描述 30% 误路由,详细描述接近零。
**检查点:**你能写出一条包含用途、输入、输出、使用场景和”NOT for”边界的工具描述。
第 3 步:手写 agent 循环
agent 就是一个循环:推理、行动、观察、重复,直到 stop_reason 变成 end_turn。先自己写一遍,加上 max_turns 保护,再让框架把它藏起来。你会用吃亏的方式学到三件考试后面要考的事:循环由模型驱动(没有固定步数);它不保证完成;每次迭代都重新发送完整历史。
然后读 Agentic 循环:推理 → 行动 → 观察 → 重复、Agent 做事,Chatbot 聊事,以及领域 1 的 stop_reason 才是唯一靠谱的循环控制。现在就给你的工具加上结构化错误结果;一个对所有问题都只收到 “Operation failed” 的 agent,会对权限错误无限重试。
**检查点:**你的循环在 end_turn 时终止,在轮数上限处停止,工具错误带着分类和可重试标记传回。
第 4 步:进入子代理和编排
一个 agent 跑通之后,问题就变成多个 agent 怎么协作。先学五种编排模式(链式、路由、并行、编排者-工作者、评估者-优化者),这样你能给自己在造的东西起名字。然后学让 hub-and-spoke 系统运转的两条规则:子代理只和协调者对话;子代理从空上下文启动,所以协调者必须把它需要的每个事实都写进任务提示词。
搭一个协调者加两个专家,每个专家只给它角色需要的工具。观察忘记把协调者的发现写进子代理提示词时会发生什么:它把活重做一遍。文章:五种编排模式:从简单链式到动态协调、Hub-and-Spoke:所有路径都经过协调者、子代理什么也看不到:上下文必须显式传递。本站还有一篇更长的子代理为什么要做上下文隔离。
**检查点:**你能解释什么时候该并行运行子代理、为什么纯文本交接会丢失归因、为什么协调者自己的允许列表里必须有 Task 工具。
第 5 步:把 MCP 当集成层学
Model Context Protocol 把 AI 应用与外部系统的对话标准化了:底层是 JSON-RPC,上层三个原语(Tools 做动作,Resources 做可浏览的只读数据,Prompts 做模板),传输方式按部署选(本地进程用 stdio,远程用基于 HTTP 的方式)。它是开放协议,不是 Claude 的专属功能。
写一个极小的 stdio server,暴露一个工具和一个 resource,接上,然后为一个模拟的超时返回正确的 isError: true。注意命名坑:MCP 用 inputSchema,Messages API 用 input_schema。文章:MCP:一个协议连接一切、Tools、Resources、Prompts:MCP 的三大原语、本地用 stdio,远程用 HTTP:选择 MCP 传输方式,以及本站的 MCP server 设计错误一文。
**检查点:**你能说出某项能力该用哪个原语,团队共享的 server 配置放在哪(.mcp.json,密钥用 ${ENV_VAR})。
第 6 步:把 Claude Code 当日常 agent 用,并且正确配置它
Claude Code 是 Anthropic 的 CLI agent。用它能让你从操作者的座位上体会一个配置良好的 agent 是什么感觉:CLAUDE.md 放长期指令,.claude/rules/ 配路径 glob 放范围限定的约定,Skills 放按需工作流,权限模式管控制,hook 管确定性强制,-p 用于非交互的 CI 运行。
搭一个真实项目:一份简短的项目级 CLAUDE.md、一个按路径限定的规则文件、一个拦截破坏性命令的 PreToolUse hook。文章:Claude Code:一个 CLI 工具,不是 IDE、CLAUDE.md 的三个层级:用户、项目、目录、四种权限模式:从完全控制到完全自动化,以及本站的 CLAUDE.md 怎么写指南。
**检查点:**你能解释为什么安全规则该放在 hook 里而不是 CLAUDE.md 的一句话里,为什么 plan 模式是严格只读的。
第 7 步:升级到 Agent SDK
Agent SDK 把 Claude Code 的引擎(工具循环、子代理、权限、hook、MCP 连接)打包成你可以编程调用的东西,适用于任何领域,不限于写代码。两个接口:query() 用于无状态的单次任务,ClaudeSDKClient 用于多轮会话。两者都跑完整的工具循环,区别在于跨调用的状态。ClaudeAgentOptions 里放着 allowed_tools(白名单)、permission_mode、max_turns、hooks、mcp_servers,AgentDefinition 描述每个子代理。
把第 4 步的协调者用 SDK 重写一遍。代码应该变短,而且现在你设的每个选项自己都能解释。文章:Agent SDK:把 Claude Code 的 Agentic 能力变成可编程的、query() vs ClaudeSDKClient:无状态 vs 有状态、ClaudeAgentOptions:配置一个 Agent 能做什么、子代理:协调者委派,专家执行。
**检查点:**你能针对给定场景在 query() 和 client 之间做选择,并且能解释两者都不改变模型和 token 成本。
CCA-F 在这条路线里处于什么位置?
考试的五个领域正好对应这架梯子:领域 1(Agentic Architecture & Orchestration,27%)是第 3、4 步加第 6 步里的 hook 部分;领域 2(Tool Design & MCP,18%)是第 2、5 步;领域 3(Claude Code Configuration,20%)是第 6 步;领域 4(Prompt Engineering & Structured Output,20%)贯穿第 1、2 步;领域 5(Context Management & Reliability,15%)是你在第 3、4 步上下文越来越长时观察到的那些问题。考试是 60 道情景题、120 分钟、闭卷、125 美元、量表分 720 通过;报名前请到 Anthropic / Pearson VUE 官方页面核对这些信息。
把它当里程碑的好处在于:题目问的是”在约束条件下哪种设计最不坏”,这和你在上面每个检查点把自己的 agent 弄坏时练出来的判断力是同一种东西。
下一步
从 Foundations 入门篇开始,它用 32 篇短文覆盖了第 1 到第 7 步;然后进入领域 1 深入编排。等检查点都觉得轻松了,做一次免费的 60 题模拟考看看缺口在哪。
常见问题
学 Claude agent 开发需要会 Python 或 TypeScript 吗?
expand_more
两者熟练掌握其中一个就行。Agent SDK 两种语言都有,MCP server 也常用这两种写,底层概念(无状态 API、工具循环、结构化错误)本身与语言无关。
学到能通过 CCA-F 的程度要多久?
expand_more
看起点。已经在 Messages API 上做过开发的工程师,通常需要几周时间集中攻编排、MCP 和 Claude Code 配置;刚接触 LLM API 的人,前三步要多留时间。
必须用 Agent SDK 吗,还是可以直接在 Messages API 上写 agent?
expand_more
可以直接在原生 API 上写,只是工具循环、子代理管道、权限、hook 都要你自己搭。SDK 提供的是这套基础设施,用的模型完全一样,所以这个选择本质上是你想自己拥有多少管道代码。
动手练起来
做一套免费 60 题 Claude Certified Architect 模拟考,或按领域逐个啃 CCA-F 学习指南。
Certified Architect 是社区独立搭建的备考站点。文中考试信息来自 Anthropic / Pearson VUE 的公开资料,随时可能调整,报名前请以官方页面为准。