
字节笔记本
2026年10月6日 · 约 12 分钟读完
Agentic 编程实战课 22:人机协作团队的组织设计
本文是《Agentic 编程实战课》系列的第 22 章,视角从个人效率抬到组织设计:当团队里每个人都配上 Agent,团队结构、招人标准和考核方式都要跟着变。这一章回答三个问题:公司怎么搭,谁做什么,怎么避免"全员有 Agent,效率反而下降"。
传统团队里,5 个人就是 5 份生产力;Agentic 团队里,5 个人各自指挥 5 个 Agent,理论上是 25 份生产力。听起来美好,现实却经常打脸:很多公司跟风让全员用 AI 工具,结果效率提升不均匀,少数人爆发,多数人没用上;协作反而变难,每个人都在和自己的 Agent 较劲;质量参差不齐,有人产出惊艳,有人原地踏步。
问题出在哪?工具发了,组织没动。

一、效率是乘法,不是加法
Agentic 时代的效率可以写成一个公式:
效率 = 工具 × 流程 × 组织 × 人才
四个因子对应四种动作:工具要换成 AI,流程要重新设计,组织要重构,人才要重新招。只升级工具,等于四个因子里只动了四分之一,乘出来还是老样子。真正的效率提升来自组织重构:把工作方式、协作规范和角色定义一起改掉,工具的价值才放得出来。
二、每个角色都从执行者变成指挥者加验证者
| 传统角色 | Agentic 时代的升级 | 核心能力转变 |
|---|---|---|
| 初级程序员 | Agent 调度员 | 从写代码,到指挥 Agent 写 |
| 高级工程师 | 架构加评估师 | 从实现,到设计加验证 |
| 产品经理 | Agentic PM | 从提需求,到规格化加验证 |
| 设计师 | 创意导演 | 从画图,到指挥 Agent 画并把关审美 |
| 数据分析师 | 数据指挥 | 从跑 SQL,到指挥 Agent 跑并解读结果 |
| QA | 评估工程师 | 从手动测试,到设计评估集 |
关键洞察:每个角色都从执行者变成指挥者加验证者。初级岗的执行工作会被 Agent 吃掉,但判断工作更值钱。能力价值随之重估:执行类能力贬值,因为 Agent 能做;判断类能力升值,因为 Agent 做不了;沟通类能力升值,因为指挥 Agent 本身就是一门沟通功夫。
三、四种典型团队结构
结构 1:扁平的超级个体团队。 每个人都是超级个体,独立指挥自己的 Agent 小队。适合早期创业公司和 10 人以内的小团队;优势是每个人都高效,沟通成本低;风险是缺深度专家,人人都是通才。
结构 2:金字塔指挥结构。 少数指挥官带大量 Agent 与助理。适合中型公司和需要纵深的领域;优势是专家指挥规模化产出;风险是指挥官容易成为瓶颈,培养周期长。
结构 3:模块化产品小队。 每个产品小队独立,内含多角色加 Agent,比如用户增长小队和商业化小队各自配产品、设计、开发。适合成熟产品公司和大企业;优势是模块化、并行交付;风险是跨小队协调成本。
结构 4:生态众包加核心。 核心小团队加大量外部 Agent 协作者,比如 3 人核心调度产品、研发、销售三条线上的 Agent 与外部专家。适合超早期项目、副业和独立开发;优势是极轻、启动快;风险是质量管控难。

四、招人标准:从会做什么到判断力加学习力
传统面试问的是:会用 React 吗?写过几年 Java?实现过什么功能?Agentic 时代的面试更关心:给你一个 Agent,3 天能做出什么?这份 Agent 产出哪里不对、怎么验证?给一个新领域,多久能指挥 Agent 做出可交付物?
新的核心能力清单,按重要性排:
- 学习速度(最重要):能在新领域快速建立判断力
- 规格化能力:能不能把模糊想法变清晰
- 验证能力:能不能识别 Agent 的错误
- 领域专长:至少一个领域的深度
- 协作与沟通:能指挥 Agent,也能协调人
传统那种"会用某个框架"已经不重要,Agent 比任何人都会用框架,判断力才是稀缺资源。
一个可落地的面试设计:给候选人一个真实业务问题、一个 Agent 账号、3 天时间,考核最后产出质量(不是代码量)、过程中怎么指挥 Agent、怎么验证产出对错、卡壳时怎么调整。这种实战考核比刷题面试有效得多。
五、考核方式:KPI 要换尺子
传统指标正在失效:代码行数,Agent 写得比人多;commit 数量,Agent 能批量化;工时,效率提升后反而下降。
新的考核维度有五个:交付价值,看实际业务影响;判断准确率,看规格与验证的质量;知识沉淀,看 CLAUDE.md、评估集、决策记录;协作效能,看帮助他人提升的程度;创新度,看能否用 Agent 做出之前做不到的事。
还有一个新指标:Agentic 杠杆率 = 团队总产出 / 团队人数。高杠杆团队的特征是每人都指挥 Agent,1 人顶 5 人。
六、协作流程的四条新规范
传统协作的老毛病:文档版本乱,每人本地一份;知识不共享,每个人和 Agent 单线较劲;标准不统一,每人的 prompt 都不一样。
对应四条新规范。
规范 1:共享 CLAUDE.md。 团队共用一份 CLAUDE.md,所有人的 Agent 遵守同一规则,可以按层级拆分:
company/
├── CLAUDE.md <- 全公司规则
├── team-product/
│ └── CLAUDE.md <- 产品团队规则
├── team-engineering/
│ └── CLAUDE.md <- 工程团队规则
└── projects/
└── project-x/
└── CLAUDE.md <- 项目规则规范 2:共享评估集。 团队共用一套评估数据集,所有人的 prompt 优化对齐同一标准。
规范 3:共享 Prompt 库。 把 code-review、bug-analysis、design-critique、user-research 这类高频 prompt 沉淀成库,新人直接用,不用从零摸索。
规范 4:决策记录公开。 所有重要决策记在 decision-log.md,全公司可查。这就像传统的团队 Wiki,但更结构化、更可执行。
七、一个案例:5 人团队跑出 30 到 50 人的产出
一家做企业 AI 工具的创业团队,5 个人,人人精通 Agentic 方法:
| 角色 | 指挥 Agent 做什么 | 人亲自做什么 |
|---|---|---|
| 创始人(产品) | 产品决策支持、用户调研分析 | 关键判断与取舍 |
| CTO(架构) | 写代码 | 架构与安全把关 |
| 设计 | 出设计稿 | 审美与品牌把关 |
| 销售 | 客户研究 | 客户谈判 |
| 运营 | 内容与数据 | 用户运营 |
产出对比:传统同等规模公司月产 1 到 2 个功能,这个 5 人团队月产 10 到 15 个功能,相当于传统 30 到 50 人的产出。
关键成功因素有四条:每人都精通 Agentic 方法,不是只有 CTO 会;共享 CLAUDE.md 与评估集,协作有共同基础;决策公开加沉淀,避免重复造轮子;业务判断全在人,不外包给 Agent。
这就是超级团队的样子:人数少,但每个人乘以 Agent 的乘积巨大。
八、五个常见的组织陷阱
- 只买工具不培训。 给所有人买了账号却不培训,结果大部分人拿来聊天,少部分人用起来。应对:组织统一的系统培训,定期开分享会。
- 中层管理者抗拒。 中层怕自己被替代,抵制 Agent。应对:重新定义中层角色,从管执行变成管规格与验证。
- 质量失控。 每个人加 Agent 的产出爆炸,但没有统一标准,质量参差。应对:建立团队 CLAUDE.md、评估集和代码审查制度。
- 过度依赖 Agent。 客户谈判、关键决策、创意方向这些必须人做的事被外包给 Agent。应对:明确一份哪些事必须人做的清单。
- 忽视安全。 多人多 Agent 操作,密钥管理混乱。应对:统一密钥管理(如 Vault)、权限分级、审计日志。
九、90 天转型路线
第 1 到 30 天,试点: 选 3 到 5 个先锋,深度培训 Agentic 方法,让他们做 1 到 2 个真实项目,总结经验。
第 31 到 60 天,推广: 全员基础培训,建立团队 CLAUDE.md 与评估集,调整 KPI,加入 Agentic 杠杆率指标。
第 61 到 90 天,深化: 重构协作流程,优化组织结构(可能要调整岗位),按新标准招人,沉淀公司级 Agentic 知识库。

十、自评:你的团队离 Agentic Ready 有多远
每项 1 到 5 分,快速打分。
人才(满分 15):团队普遍具备指挥 Agent 的能力;至少 1 个有领域深度的专家;招人按判断力加学习力标准。
流程(满分 15):有共享的 CLAUDE.md;有评估集和 A/B 测试流程;有 Prompt 库与决策记录。
组织(满分 15):角色定义已升级;KPI 已调整;协作流程已重构。
工具(满分 5):Agent 工具齐全(含 MCP);安全配置到位。
总分 50:40 到 50 分属于 Agentic 领先,25 到 39 分正在转型,0 到 24 分还没开始。建议 3 个月后再评一次,看进步在哪。管理者可以拿上一节的 90 天路线写一份转型计划;普通员工也可以用本篇内容说服老板,准备一页"我们团队为什么要 Agentic 化"的提案;还可以想一想,你的公司里哪些岗位最容易被 Agent 替代,哪些最难,为什么。
要点回顾
- Agentic 时代效率 = 工具 × 流程 × 组织 × 人才,四个因子都要升级。
- 每个角色从执行者升级为指挥者加验证者。
- 四种团队结构:超级个体、金字塔指挥、产品小队、生态众包加核心。
- 招人新标准是学习力、判断力加领域专长,而不是会用某个框架。
- 考核新维度:交付价值、判断准确率、知识沉淀、协作效能、创新度。
- 协作新规范:共享 CLAUDE.md、评估集、Prompt 库、决策记录。
- 一个全员掌握方法的 5 人团队,可以跑出传统 30 到 50 人团队的产出。
- 转型三步走:试点、推广、深化,90 天一个周期。
参考资料
- 团队组织设计借鉴 Spotify Model 与 Team Topologies
- "超级个体"概念参考 Anthropic 报告中关于个体产出放大的论述



