AI Agent 工程师课程
程序员进阶版

Staff 能力矩阵

平台、架构、影响力三维要求,以及单人学习情境下的代理证据

程序员进阶版全部模块完成后,用这份矩阵自查。每一条都要能指向一个具体产出,指不出来的就是还没真正掌握。

平台能力

  • 设计多团队共享的 Agent Platform
  • 设计 Runtime Adapter
  • 建立 Tool、Prompt、Agent、Workflow、Session、Event、Skill、Extension 标准
  • 建立多租户隔离和权限模型
  • 建立统一 Trace 与 Eval 标准
  • 建立平台 SLO
  • 设计 Control Plane / Data Plane、Sandbox、Policy 和框架退出演练
  • 能把不在自己语言里的 Runtime 纳入统一治理,并说清哪一部分治理确实失效了

主要来自 A5、A2、A10 与程序员基础版第 9 周。

架构能力

  • 能判断何时自研,何时使用框架
  • 能判断何时用模型能力(微调 / 对齐 / 换模型),何时用工程手段(Prompt / RAG / 规则)
  • 能处理长任务、分布式状态和恢复
  • 能设计 branch / fork / replay / compaction 及跨 Runtime 的事件语义
  • 能设计跨语言 MCP 与跨框架 Agent 互操作
  • 能设计 A2A 与 AG-UI Adapter,保持远端 Agent 和前端不绑定 Runtime 私有事件
  • 能推动 Agent 安全、成本和质量治理
  • 能在模型层建立成本 / 延迟 / 质量的三角权衡与 SLO
  • 能为多个业务团队提供可复用基础设施
  • 能评估异构技术栈的长期成本,且把数据迁移成本单独算清楚

主要来自 A1、A3、A4、A7、A8、A10、F 轨道与 E 模块。

责任与治理能力

  • 能设计责任链,让每次高风险决策可归属到人和策略
  • 能把执行轨迹翻译成面向用户、运营、审计三种粒度的解释
  • 能实现数据权利并验证级联删除的完整性
  • 能识别并测量系统引入的偏见,而不是把问题推给模型
  • 能按可逆性、影响面、错误代价给操作定自主性等级

来自 A9。这一维是 2026-07-31 新增的,在 To B 与受监管行业的 Staff 面试里权重最高。

影响力

  • 编写 RFC 和 ADR
  • 主导架构评审
  • 建立代码规范和发布标准
  • 指导其他工程师
  • 用指标证明架构收益

单人学习怎么验收影响力

影响力这一维在单人学习情境下没法直接验收,用代理证据替代:

  1. 两篇公开技术文章:建议选对照实验和 exit drill 这两个主题,它们有独家数据,别人抄不走
  2. 30 分钟毕业答辩:结构见程序员基础版第 10 周
  3. 至少一次公开的架构评审展示:社区分享或同伴评审均可,重点是接受质疑并回应

代理证据不是打折版,它在面试里同样能用。一篇有实测数据的技术文章,比简历上写精通某框架有说服力得多。

用这份矩阵准备面试

Staff 级面试和高级工程师面试的差别,不在于技术深度,而在于你的回答是否始终站在平台和团队的高度。

同一个问题,三种层次的回答:

问题中级回答高级回答Staff 回答
你们用什么 Agent 框架用了 Mastra用 Mastra,因为类型安全和 Workflow 持久化更好用 Mastra 但做了 Adapter 隔离,做过退出演练,删掉它业务包零改动,能力缺口清单在这
怎么保证质量写了测试有 Eval 数据集和 CI 门禁四层评测加置信区间,门禁阈值是这么定的,误报率控制在多少,团队没关掉它
Agent 出错了怎么办看日志Trace Explorer 三次点击定位根因有 Decision Record 能追责到人和策略版本,模拟听证会三轮问题都能答
你的抽象真的框架无关吗我们做了 Adapter 层五个 Runtime 都能跑同一份 Definition,做过退出演练五个都是 TS 同进程,只证明了 TypeScript 无关;接 Python Runtime 之后 Policy Gate 策略覆盖率掉到多少,这是我抽象的真实边界

右边一列的共同点是:有数据、有边界、有对失败的准备。这三点比任何技术名词都更能证明职级。

自查完之后

  • 矩阵里勾不满但已经完成主线模块:正常,先去投简历。程序员进阶版的价值是在面试里拉开差距,不是拿满分才能用
  • 想继续补:优先补勾得最少的那一维,而不是最熟悉的那一维
  • 全部勾满:把附录 C 的实验数据和 A9 的听证会记录整理成两篇文章,这是影响力维度的直接产出

On this page