← 顶级AI播客总结
Lenny's Podcast

打造世界最 AI 化的工程团队:Anthropic 的 Fiona Fung

Building the most AI-pilled engineering team in the world | Fiona Fung (Anthropic)
节目时长 99 分钟 阅读约 16 分钟
▶ 在 YouTube 收看原片
打造世界最 AI 化的工程团队:Anthropic 的 Fiona Fung 插画

Anthropic 工程师人均产码量四年涨 8 倍,Fiona Fung 拆解管理、验证、招聘与团队文化如何重写。

核心要点

  • 人均产码 8 倍:Anthropic 工程师人均季度产码量比 2021-2025 涨 8 倍,coding 不再是瓶颈,挑战转向「这么高吞吐下如何做验证」,且现在设计师、PM、各职能都在 check in 代码。
  • 常驻 Claude 掌全局:Fiona 在所有 repo 里常驻一个 Claude Code 远程会话、接入全部 Slack 频道和指标,每月和团队一起跑 session 回顾上线效果、bug、反馈主题,而非只生成 PR。
  • routines 实现异步:工程正转向异步——routines 能定时自动扫反馈频道、生成 prompt、spawn agents,她醒来就有 PR 可审;抽象层不断上移,从同步 prompt 到「agent 帮我生成 prompt」。
  • 两类招聘画像:现在只招两类人——有产品 sense 的创意 builder(dreamer,端到端拥有产品),和负责硬骨头的深度系统专家(trust but verify 里需要验证之处)。
  • bad vs sad 质量框架:把质量分为 bad(不可恢复的严重错误,如崩溃丢工作)和 sad(可恢复的痛点,如闪烁),各团队按 agency 自定义本领域的 bad/sad,比一堆 dashboard 更能 zoom out 看整体体验。
  • 测试驱动开发复活:Claude 自动写测试让曾经「要先吃西兰花」的 TDD 复活;把 spec、「what good looks like」框架 check 进 repo,Claude Code Review 就能持续校验。
  • 别盲目追指标:从 lines of code 到 time-to-land-PR 都有缺陷;要问输出是否真导向 outcome(「don't forsake motion for progress」),并做面向资深工程师的 listening tour。
打造世界最 AI 化的工程团队:Anthropic 的 Fiona Fung 信息图
一图速览本期内容(点击查看大图)

章节时间轴

详细内容

软件工程史的转折与「AI-pilled 团队」

Fiona 喜欢回望历史。她从 IBM DB2 操作系统服务团队起步——当时多数人用 Vim 和终端调试,连 IDE 都没用上(她那时天真到以为 Visual Studio 是「更好的画图程序」)。加入微软 Visual Studio 编辑器团队后,她「用 VS 编辑器构建 VS 编辑器」,由此爱上 dogfooding——还记得在 Twitter 出现前(约 2006)工程师很难拿到快速客户反馈,而她们团队因都是重度 VS 用户而能彼此快速反馈。她还经历过「软件刻在 CD 上发版、有硬截止日期、因此要大量提前规划」的年代。

这些转折铺垫出今天的核心命题:coding 不再是瓶颈。她引用昨天发的图——Anthropic 工程师人均季度产码量比 2021-2025 涨 8 倍,曲线长期平稳后骤然冲天。但这带来三重转变:不只工程师、连设计师和 PM 都在 check in 代码;不只更多人、还是不同职能;吞吐量极高,于是「如何做验证」成为新焦点。Boris 那句「coding is salt(编码是盐)」成了注脚。

用常驻 Claude 与 routines 重写管理

Fiona 最具体的管理创新是在所有 repo 里常驻一个 Claude Code 远程会话,接入全部 Slack 频道和团队追踪的所有指标。过去她只用这类会话生成 PR 和 bug fix,现在每月和团队一起共享屏幕跑 session 回顾:本月聚焦了什么、上线产品表现如何、反馈频道说了什么、是否有 bug、能否归纳出质量「热点」主题、哪里是好的投资点。这把单纯的「shipping 动作」延伸到「在市场里表现如何、是否造成 bug」的对话。她坦言一年前根本拿不到这些洞察——部分也因当时产码量没这么大,列个小清单就够了。

晨间例行也被 routines 改写。她过去的仪式是端着咖啡看反馈频道、挑一个能帮上忙的点;如今 routines 定时(每天某时刻)自动扫某反馈频道、归纳主题、spawn agents、生成 PR——她醒来就有总结和可审的 PR。反馈来自内部、邮件、Twitter、LinkedIn、社交、合作伙伴等多渠道,全 post 进 Slack,多到必须靠 Claude 才能跟上。她描述抽象层在不断上移:从同步 prompt,到异步 kick off 多个 prompt,到现在「routine 帮我生成 prompt」——工程正整体转向异步、agent 舰队的工作方式。代码审查同理:Anthropic 去年还没有 Claude Code Review,人类审查曾是大瓶颈;现在重要的、需深度领域专长的地方仍由人类审,但只要把「what good looks like」的框架、spec check 进 repo 并保持更新,Claude Code Review 就能持续校验——本质是 TDD 的演进,只是现在 Claude 替你先写测试,「太不公平了」。

招聘画像、ambition 与直面恐惧

Fiona 现在只招两类人:有产品 sense 的创意 builder(她称 dreamer——对产品有热情、有想法就建、看反馈、迭代、打磨、端到端拥有),和负责硬骨头的深度系统专家。她刚加入 Claude Code 时团队多是产品通才,缺系统/分布式系统背景的人,于是补强——「trust but verify」里需要验证之处,就要投入深度领域专长。

她反复强调 growth mindset 与 ambition。一位 10X 工程师告诉她,过去听到「我们该建这个」会觉得太难太复杂,现在会想「完全可能,让 Claude Code 做就行」——天花板被抬高,拼的是你能多有野心。她举例一位非移动工程师靠 Claude 也给功能加上了移动端。对挣扎、抵触的人,她诊断根源常是恐惧(演化遗产),建议「lean in 并问:我能控制什么?」把「事情发生在我身上」转为「为我而发生」。这里她讲了高中故事:成长于安大略、计算机昂贵、高中才第一次接触电脑,怕付不起工程学院学费,于是抓住国家银行在校招高中实习柜员的传单——周一到周五上学、周六做柜员,攒下学费、dot-com 崩盘后还继续做了两年。她最爱的两句是「如果你不害怕,你会做什么」和「偶尔做点可怕的事,因为那是成长的方式」;Lenny 回赠那句他用得最多的「你害怕的洞穴,藏着你要寻的宝藏」。

弥合 AI 鸿沟与小企业

Fiona 的一个 passion 是帮人尤其小企业学用 AI,源于她在加拿大长大、由只说粤语的外婆带大、外婆在一家会说粤语的毛线店找到编织圈子的记忆。她自己用 Co-work 做差旅报销时觉得「魔法」,意识到辛苦经营、利润微薄的小企业朋友——她见过他们在吧台堆着账单做 invoicing——会从中受益巨大。她帮几位朋友 onboard(还顺手发现了好 bug),他们的用法超出她预期:一位开两家餐厅的朋友让 Coda 在「downloads 垃圾抽屉」里找菜单,再让 Claude 跨同类菜系做市场对比分析以「对本地人和游客都定价合理」。这直接催生了 Claude for small business(在 Co-work 里一个开关打包所有插件)。她呼吁 AI-pilled 的听众主动和社区成员、家人或喜爱的小企业分享「真正改变了你生活」的用例,否则鸿沟会越拉越大。

质量、指标与 bad vs sad

面对每天海量 PR,Fiona 的核心是「主动质量」和早期检测。她设计了「bad vs sad」框架:bad 是不可恢复的严重错误(如 CLI 崩溃丢工作),sad 是可恢复的痛点(如闪烁),但 sad 堆叠起来会变 bad。各团队按 agency 自定义本领域的 bad/sad 和目标——这比一堆 dashboard 更能 zoom out 看整体体验,因为面对众多产品面时很难判断某个原始数字是好是坏。团队还有个 2025 年 9 月起的「脏话 dashboard」追踪用户因挫败爆粗的频率。她强调投资测试、eval 和监控失败/速度,胜过花更多时间人工审查——这呼应「为 agent 闭环」的思路。

指标上她有大量教训。从 lines of code(被一个只是 port 库的工程师暴露缺陷)到 time-to-land-PR 都不完美;要问输出是否真导向 outcome,「don't forsake motion for progress」——衡量工具使用量只是衡量动作。她的 Facebook Marketplace 故事很典型:早期按区域上线、用「卖家数量」当扩张门槛,但首个区域卖家少、买家却能找到想要的东西(这才是目标),原来是有 power seller,于是更新了指标。她建议除了指标更要做面向资深工程师的 listening tour,「Jeff Bezos 说如果数据和轶事冲突,相信轶事」。

经理先做 IC、技能退化与团队文化

Fiona 推行两个独特实践。一是经理先做 IC、并持续兼任 IC(player-coach):新经理先给自己 maker time 深入代码和产品、建立 rapport,再承担带人重责——她自己从 Meta 500 人组织来到 Anthropic 也先做了短期 IC,Claude 成了她的 onboarding buddy(她自 2017 后就没发过生产软件,怕搞砸,Claude 帮她写自动测试、设计手动测试用例,重建了 ship PR 的信心,不少做了多年经理的朋友也因 Claude「重新开始写代码」)。她认为领导住在自己产品里极重要——Marketplace 卖 MacBook Air 时遇到新型诈骗、VR 时总能发现地板高度 bug、智利上线因 LTE 慢导致 feed 加载不出,都是 dogfooding 或客户拜访的收获。

她也直面新世界的失去:担心 coding 技能 atrophy,要求工程师仍花时间理解架构、做「double click」(了解你依赖的那一层,依赖变了才更敏感);更明显的是孤独感——大家都只和自己的 agent 工作,于是 Claude Code 团队近期开了 pairwise programming 午餐和 hackathon,发现每个人用 Claude Code/Co-work 的方式都不同、彼此能学到很多(像孩子的「parallel play」)。她说工程是最受冲击的角色,第二是 PM(不再被工程带宽卡住),再下来是 design 和 data science——验证在多职能 check in 下尤其重要。

最让她失眠的不是产品或工程难题(那些有 dashboard 和 hypothesis),而是团队文化——文化是活的、会随高速增长漂移,体现在彼此如何相处、是否在快到终点线时回头看队友。她强调「one-team mentality」和开放坦诚:她的噩梦是经理报「一切都好」,而那个「房间着火却说 this is fine」的 meme 正是她最怕的。规划上她从 6 个月路线图缩到「JIT 月度规划」(轻到没有 doc、只是小表格对齐当月优先级),每周快速校验是否仍是本月优先级,并仍想着「能否进一步自动化」;半年一次全团队对齐 themes。她还有一条团队文化:明确许可去 kill 不再服务于目标的流程,定期问「这个流程还有意义吗」。

金句

coding 不再是瓶颈了……现在不仅工程师,设计师、PM、所有人都在 check in 代码。 —— Fiona Fung 9:10
它就这么直接替你先把测试写了,太不公平了。 —— Lenny / Fiona 16:05
你害怕的那个洞穴,藏着你要寻找的宝藏。 —— Lenny Rachitsky 25:19
别为了「动起来」而牺牲「真正的进展」。 —— Fiona Fung 41:22
高 agency 也意味着高 accountability——给人自由去做,但也要问 hypothesis 是什么。 —— Fiona Fung 39:06
在一个你可以成为任何人的世界里,做一个善良的人。 —— Fiona Fung 92:42

提到的书·产品·人物

适合谁听

想了解顶尖 AI 公司如何重写工程管理、验证、招聘与团队文化的工程领导者、PM 与正在适应 AI 工作方式的从业者。

← 返回全部观看原片 ↗