← 顶级AI播客总结
Latent Space

干掉强制代码评审的团队:AMP 如何用 20 人跑在所有人前面 6 个月

Inside the Team That Killed Mandatory Code Review — Quinn Slack, AMP
节目时长 40 分钟 阅读约 26 分钟
▶ 在 YouTube 收看原片

Quinn Slack 拆解 AMP 的反常识实践:本地开发已死、强制 code review 已死、CI 命不久矣。

核心要点

  • 本地开发已死:Quinn 说自己「几天前才意识到,我已经两周没跑过本地 dev server」;orbs 让 agent 跑在云端、关掉笔记本也不影响,配上端口转发直接看 dev server,本地开发不再有任何体验优势 3:06
  • 杀功能比加功能多:AMP 过去几个月「以删功能闻名而不是加功能」——早早砍掉编辑器插件等一堆东西。他的原则是在 AI 时代把用户留在旧做法上「价值是负的」,三个月后用户只会骂你的产品已经过时 1:34
  • 强制评审已死:合并进 main 前的强制 code review「从我们开始做 AMP 那天起就死了」。前提不是工具而是人——20 人全是 co-founder、人人有 skin in the game,替代方案是「日志或客户反馈进来 15 分钟内就能上线修复」,赌的是 MTTR 而不是 MTBF 7:00
  • 云端 agent 更安全:给 orb 一个 OIDC 换来的 30 分钟只读令牌,胜过让 agent 在开发者笔记本上继承一切已认证凭据;他举 Hugging Face 那次事故和客户「某个恰好还登录着的脚本摸到了生产控制台」为例 17:00
  • CI 命不久矣:Quinn 的反问是——agent 已经在与全队一致的沙箱里跑过测试,为什么还要等 CI?Swyx 的辩护是 agent 只跑 context 里的东西、不保证穷尽;Quinn 承认「这颗牙还能挂三周」,但真正在爆发的是 E2B、Daytona 这类沙箱公司 23:56
  • 20 人利润为正:拆分时 20 人跟着 AMP 走,投资人和员工在两家公司都持股。Quinn 说自己当 200 人公司的 CEO 远不如现在——20 人里任何一个都能被信任去见客户、修任何 bug;同规模公司急着招 PM 和市场是「老办法」,结果是 10% 的人做产品、90% 的人做卖它的开销 30:03
  • jellyware 与新开源:与其做设置页、做集成、做开源维护,不如把代码扔出来让别人用自己的 agent 改——「比软件更软但不是纯 vibe coding」。Swyx 的版本是开源 skills 而不是库:「一堆 markdown 加示例代码,可能比一个库更有价值」33:07

章节时间轴

详细内容

一、orbs:把 agent 搬到云端之后,本地开发就没有理由了

Quinn 介绍 AMP 近期最大的变化叫 orbs——agent 跑在远端,你可以关掉笔记本,可以同时跑一百件事。他给出的量化说法很重:用户在过去三四周使用 orbs 带来的软件构建方式变化,超过了去年一整年的总和,而「去年可不是什么平静的一年」1:34。

他把这归结为一条产品哲学:在 AI 变化这么快的时候,「把用户留在旧做法上的价值实际上是负的」。过去技术周期是五年十年,你获取一个用户就能留住十年;现在如果你不推着、拽着用户跟你一起站在前沿,三个月后他们会说「产品里这帮蠢货是谁啊,这东西已经过时了」,并因此看低你 2:20。这也解释了 AMP 为什么以删功能闻名——很早就砍掉编辑器插件,砍掉一堆不再合理的东西。

Quinn 主动给 Devon 记了一功:这个想法不是 AMP 首创,Devon 在被嘲笑「这玩意儿根本不work」的时候就已经押对了远程 agent 的重要性 2:20。AMP 做的是把体验凑齐:agent 在云端跑、dev server 在门户里直接能看、能进桌面、能并行、一切都「就是能用」——好到你不再想用本地开发。

Swyx 补充了一个 pre-AI 的历史坐标:他 2021 年就写过「localhost 的终结」,因为 Facebook、Google、Uber、Stripe 这些大公司早就是 SSH 到一台远端机器、本地只留一个很轻的 clone,「一旦基础设施足够好,笔记本就退化成一个薄壳,你在 iPad 上写代码都行,它只是个输入设备」3:54。

Quinn 的反驳恰恰在这里:那些公司的员工会说「远端确实更慢、牺牲很多,在笔记本上干活手感更好」;但有了远程 agent 之后,你不觉得自己牺牲了任何东西。不是公司安全部门逼你用开发 VM,而是你某天忽然发现「我已经两周没启动本地 dev server 了」——Quinn 说这正是他几天前的真实体验 4:41。

关于「为什么是今年」,Swyx 观察到全行业几乎同时转向云端:OpenCode 在做、Conductor 在做、Claude 做了很多、Cursor 也做了,反而 Codex 还没怎么动。他自己认为云端去年就已经准备好了,却是今年才起飞。Quinn 给的解释有两层:一是 agent 在长时程任务上确实变强了;二是当你看到 agent 足够多次可靠地做对,你就开始不再逐行审所有代码,这才腾出时间去并行跑更多任务;三是去年 12 月到 1 月 CLI agent 的爆发本身就是这一步的前提 5:27。

但他强调这仍然是「按人类的速度在走」。很多人反问 orbs 有什么用:我笔记本上本地环境都配好了;或者——我们公司必须走代码评审,我攒 20 个等着被审的东西有什么好处?并行度对我没有收益 6:13。这就自然引到了这期最硬的话题。

二、强制代码评审已死:前提是团队,不是工具

Swyx 直接确认:「等等——代码评审对你们来说已经死了?」Quinn 的回答是「合并进 main 之前的强制代码评审,是的,已经死了,从我们开始做 AMP 那天起就死了」7:00。

Swyx 追问是否投资了配套系统来补偿。Quinn 的回答值得原样理解:最重要的系统是一支真正被信任的团队。他认为 AI 的作用之一,是让你可以拥有一支更值得信任、更有 skin in the game、端到端有 ownership 的团队——他们不是从产品经理和某个 sprint 接收输入、再把东西吐给市场团队去发布的自动机,而是有责任、要担后果的人 7:00。

第二层是能力:你要做到「日志里冒出问题、或者客户反馈进来,15 分钟后就能上线修复」。他明确划了适用边界——这不是适用于所有软件的做法,本质是在 MTTR(平均恢复时间)和 MTBF(平均失效间隔)之间做选择;对于迭代如此之快的终端用户软件,AMP 选 MTTR。他甚至认为这比「等好几天才能发布」质量更高 7:45。

Quinn 由此给团队定位:AMP 20 人「都是 co-founder」,想法高度一致,所以能真正吃到并行的红利——因为不必等评审。他的原话是:「我们大概是在提前体验其他团队六个月后的工作方式」7:00。

三、agent 不只写代码:分阶段数据迁移与飞机上的 ops

Quinn 现场演示的第二类变化是 agent 做运维。他打开 AMP 里一个叫「phase 1 B2」的线程:这是把 AMP 从「用户只能在一个 workspace」改成「可以在多个 workspace」的改造——任何做过软件的人都知道,这是动最核心数据模型的改动,必然又脏又碎,必须切成很多步并保证每步向后兼容 14:41。

强的地方在于:agent 逐阶段推进,每部署完一个阶段,它会去看日志、去查数据库,确认自己事先想好的不变量成立、没有冒出一堆意料之外的错误 15:27。

Quinn 讲了一个具体场景:一周前飞往慕尼黑的 12 小时航班上,机上 Wi-Fi 靠不靠得住谁都不知道。他让 agent 推了几个比较安全的阶段并盯日志——一切正常就进入下一阶段,不正常就回滚。「最后机上 Wi-Fi 其实还挺争气,我在飞机上还睡了一会儿。」而这件事在过去要占掉一个开发、甚至一群开发加运维全程盯着 16:13。

四、最反直觉的一段:云端 agent 比笔记本更安全

「怎么能给 agent 生产日志的权限?」——Quinn 说这问题会让很多人发毛,但恰恰引出他这期最有说服力的论证 16:13。

有意为之的限权是关键:让云端 orb 通过 OIDC 拿一个令牌,只给 30 分钟、只读、只能读 G-Cloud 日志,或者只读生产数据库 17:00。

对照组才是真正可怕的:今天所有人在做的,是让一个跑在开发者笔记本上的 agent 拥有这台机器上一切已授权凭据的无限权访问。Quinn 举了两个证据——Hugging Face 那次事故说明「agent 非常擅长逃出隔离」;以及 AMP 客户报告过的情况:某个恰好处于登录态的脚本,被 agent 找到路径摸到了生产控制台。他认为这在所有 agent 上都会发生 17:46。

于是结论反转:你以为最抗拒上云的是安全团队,实际上 AMP 的一些大客户反馈是云端看起来更安全。既然开发者(可以大量并行、不用再玩 worktree 的杂技)和安全团队同时受益,「这轮迁移会比人们想的快得多——我不知道,也许两个月后 CLI 编程 agent 基本上就死了」18:32。

Swyx 给出了一个真实的反向张力:人们确实喜欢那种无限权带来的通用智能与完全自主,他对 OpenClaw 的观察也是如此——大家就是直接跑,它并不安全,但「装进盒子里有时反而更糟,因为你没法提前预判自己的需求」。他把这归为 UX 层面的根本张力:把 agent 当成团队里的完整人类,还是因为安全顾虑一直用短绳牵着 19:20。Quinn 的回应是:如果卖点只是「orbs 更安全」,那不会赢;真正赢的是把开发者的摩擦压到零——一次起 20 个互不冲突、权限齐全的任务,那种感觉很魔幻 19:20。

五、GitHub 的凋零、Pierre、以及 CI 还剩几周

Quinn 说 AMP 主仓库还在 GitHub,但「我们基本不去 GitHub 了,唯一去的时候是 GitHub Actions 出问题」——而录制前 24 小时刚好赶上 Actions 长时间宕机 20:05。他给了一句判断句:「不是说 AMP 是 GitHub 杀手,它是下一个 GitHub。这类东西不是砰的一声死掉,是无声地凋零。」 不用 issue、不用 PR、几乎不用 Actions、正想彻底搬走。他觉得最诡异的感受是:GitHub 是他记忆里一直都在的东西,而现在「团队里有人把这个换掉一周后才告诉大家,也完全可能」20:52。他个人项目已全部迁到 AMP 托管的仓库(后端跑在 Pierre 上),「一点都不怀念」。

对 Pierre 的第三方评价是:想要的功能都做到了、可靠、团队很熟(里面还有前 Sourcegraph 的人)、提需求都会办,「我希望他们能更快一点,但都办了」21:39。Swyx 的顾虑很实用:Pierre 做存储但不做 Actions、不做 CI/CD,而 CI/CD 才是他真正头疼的部分——「存东西有什么难的?」22:25

Quinn 接住这点讲了一个更大的判断:自建只服务一个人的软件,很容易做得非常扎实;一旦要做多租户,复杂度直接翻倍,再加上设置项、集成、销售。所以像代码托管这种提供各种保证的第三方服务很好,但对你个人来说你并不需要那些保证,你自己搭的会比任何第三方给你的更合适。「这种不对称,我认为会是接下来软件行业最有意思的主题。」Swyx 顺势推出一句金句式结论:编程 SaaS 会是世界上最后一个 SaaS,因为其他所有 SaaS 都可以用编程 SaaS 造出来 23:10。

然后是 CI 之争。Quinn 的反问:我的 agent 当然知道要跑测试,它跑在一个全队一致的沙箱环境里,具备 CI 那种可复现性,而我讨厌等待——既然 agent 为了自我验证已经跑过测试,我为什么还需要 CI? 23:56

Swyx 的辩护是「不那么令人满意但简单」的:你不信任 agent 会穷尽——它只会跑 context 里的东西,项目一大你就无法确认它跑全了。CI 是一个确定性的阶段:就把这些测试全跑一遍,失败反馈给 agent、agent 修完再来一遍。而且经常出现「你改的东西碰坏了另一个你根本没意识到的地方」24:42。

Quinn 的回应是「我大概还能同意你三周」:他说自己像颗晃动的牙,还挂着一点点,而AMP 团队有一半人在喊「兄弟们,我们不需要 CI」——他们需要的只是打包镜像然后推去部署。他的反证是:任何人要让 CI 不那么痛苦,实际上都已经用上了「只跑变更文件相关测试」这类启发式,很少有人一直跑全量测试套件;那么如果你直接让 agent「全都跑」,可靠性反而会相当高,再把折磨人的 flaky 测试都干掉(甚至让 agent 自动修 flake),整体处境可能更好 25:28。

他的元判断是:「每次有人说『我不信任模型能做 X 或 Y』,这话都撑不了太久。」所以「我们所知的 CI」日子有限——但换个角度,CI 本质就是一个可复现的项目运行环境,而有人一天跑一百个 orb,E2B、Daytona 这类沙箱公司正在爆炸式增长:「所以很像 CI 的东西正在猛涨,但 CI as we know it 命不久矣」26:14。

沙箱这块,AMP 现在用 E2B,Quinn 说他们很棒、暂时没有换的痛点,只希望更便宜——因为不想让任何人对多开 orb 有一丝犹豫;AMP 的 Megawatt / Gigawatt 订阅给的 orb 配额很宽,99.9% 的人碰不到上限。他顺手点评了大云厂商:它们也叫「沙箱」、以为在和 E2B 竞争,却缺少恢复能力,或者沙箱压根没有网络访问,很离谱 27:00。Swyx 补了两句:这取决于你把它当副业还是当公司存亡;而且大家对沙箱的需求差异很大,这个空间的需求还在边做边发现,RL 沙箱又是完全不同的一套原语 27:45。

六、从 Sourcegraph 拆出 AMP:20 人、盈利、人人可信

Quinn 回顾自己的轨迹:Sourcegraph 做代码搜索,客户里有十大上市科技公司中的九家、六大银行中的四家,还有 Uber、Stripe 等等,他因此见过「一个伟大的软件生意长什么样」28:32。

Sourcegraph 内部有两个产品:代码搜索和 AMP。他和董事会、联合创始人 Beyang 决定做拆分——他说这在创业和软件行业里基本没人做过,上一个可比案例要追到 2009 年 David Sacks 把 Yammer 从 Geni 里拆出来;有趣的是 Sacks 一直在他们董事会里,直到去白宫 28:32。拆分的做法是 20 个人跟着 AMP 走,其余留在 Sourcegraph;对投资人做了正确的事——每个投资人、每个员工都同时持有两家公司的股份。他也提到了另一种可能路径:Intercom 与 Finn(第一个生意是 Intercom,AI 那个是 Finn)。他的理由是代码只会越来越多、代码搜索显然前途光明,但两边都需要专注 29:18。

对他个人:「我热爱在一支 20 人的团队里。跟做 200 人公司的 CEO 相比,就我自认擅长的事情来说,我远没有那么好,而现在我能获得的能量多得多。」现在这支队伍里任何一个人他都可以完全放心地让 TA 去和任何客户对话、修任何 bug、做任何事 30:03。

关键论证在下一句:和几年前相比,你不再需要去招那些你并不信任、缺乏高 agency 或缺乏对应技能的人,因为那些事可以交给 agent 30:49。他承认 AMP 有历史带来的运气——已经盈利、身处高速增长的赛道,因此有自由度。但他对同规模公司的批评很直接:看到有些和他们体量差不多的公司开始去招 PM、招市场,「那感觉就是造软件生意的老办法」,最终会变成 10% 的人在想怎么做出好产品、90% 的人在想怎么卖它的那些开销。过去这是必要的,「我不认为现在还必要」31:34。

七、内部 agent、jellyware,与 Swyx 把 Codex 当 CMO

Swyx 问 AMP 有没有内部 agent 顶替了本来要招的人。Quinn 的回答有一句很好的框架:「你没法把一个 agent 关在贴着别的标签的盒子里——它现在就只是 agent。」 AMP 起步是编程 agent,但团队一切都在 AMP 里做。至于「市场 agent」意味着什么:一部分是出想法和落地实现,另一部分是营销自动化,后者他们还没有,但是接下来要建的一批 app 之一 31:34。

由此引出 jellyware。Quinn 说他们造了很多只适用于 AMP 的东西,但有些是通用的——比如一个能监控 X、Discord、邮件里所有人在怎么议论他们、并且方便回复和识别出优质社区拥护者的工具。过去要么做成开源项目、然后被开源维护的麻烦缠住(「我们不想干这个」),要么做设置项和集成然后拿去卖。现在的第三条路是:直接把代码放出去,让别人用自己的 agent remix 和定制。他们把这类东西叫 jellyware——「比软件更软,但也不是完全 vibe coded」32:20。Swyx 对这个词的评价:好记就够了,虽然「听起来有点太好吃了」33:07。

Swyx 随后交换了自己的实践:Codex 已经当了他两个月的 CMO,跑广告、给 AEO 和 SEO 建议,「比跟真人顾问聊更合我意,我也真找过真人,结果大致相同」。他补了一句冷幽默:不知道这对 CMO 和 fractional CMO 咨询业意味着什么,「反正谁也不真的知道什么,那你不如就照大家公认为真的去做,这事不需要一个人类替你干」33:53。

他不展示自己的 Codex,而是推荐看他公开发布的 skills——那是他现在 GitHub 用量的主体,「还打算迁到我的 GitHub 克隆 Forge,但 GitHub 目前够用」。里面装的是他工作用的一切,包括营销,包括最新的「AI devrel」。Forge 的工程博客不是人类写的、但由他策划:他给一些指向,说「这是个不错的工程故事,写出来吧」,再给一点关于最终目标的指导,就这样,连配图都是生成的 34:41。他的判断是:这大概就是新的开源——你开源一批 markdown 文件加示例代码,他自己会做得比纯 markdown 多一点,但「这东西可以移植到任何项目里,这一点现在可能比一个库更有价值」35:26。

关于视频,Swyx 是这期唯一一个逆向观点。他不太做切条,因为 Latent Space 做长内容(AIE 的视频 20 分钟到 3 小时,Latent Space 30 到 60 分钟),不想做 clickbait。有人用 Claude Code 切条、用 Hyperframes 拼生成的视觉,他没投入带宽试;试过 A16Z 投的 Overclip「效果不太好」,接下来打算试 star zero。他强调这不是「技术不成熟」的判断,只是优先级问题——「人类剪辑现在还足够便宜、也足够好,就不是问题。」 更实际的原因是关系:他可以在一个剪辑点上说「Alejandro,记得处理这里」,两年的合作关系让他知道对方会接住 36:13。Swyx 自己给出了成本口径:他做的是高质量高价值视频的媒体生意,没必要压production 成本那么多;「我今年在 AV 上花了大概 600 万美元,几万块算什么」37:49。

八、小团队会成为新范式吗

结尾 Swyx 把话题拉高:创始人是不是应该抛下大公司、组一支小 SWAT 团队去打自己认为重要的事?他认为 Quinn 正在拿出结果,而且「你提到你们盈利这件事很重要」——他还开过玩笑说 Quinn 应该办一场「盈利 SaaS CEO 聚会」的 meme,结果全场只有他一个人 38:35。

论据是 Jeff Dean 刚刚离开 Google:据他们所知,Jeff 打算就五个人在一间屋子里干,离职时的使命陈述大意是「一小撮人能做到什么,相对于几千人能做到什么」。Swyx 认为这句话「肯定是在暗讽 Gemini 是几千人在做」,而他觉得这个实验非常有意思。但他也把开放问题摆了出来:领域专家还有没有位置?多人协作规模化还有没有位置? 「人们现在到底该怎么运营公司,这是一个非常开放的问题。」39:22

Quinn 的回答只有一句,也是这期的调性:「感觉没人知道,我们都会一起摸出来。所以最好的位置就是出去干、去造。」Swyx 补了另一个例子——Airtable 的 Howie Liu 用 Hyper Agents 做了类似的事,只是他没那么并行地跑,而是公司已经卖掉之后双头并进了一段。「时间线在缩短,我们正生活在 AGI 里。」39:22

金句

在 AI 变化这么快的时候,把用户留在旧做法上的价值,实际上是负的。 —— Quinn Slack 2:20
合并进 main 之前的强制代码评审,已经死了——从我们开始做 AMP 那天起就死了。 —— Quinn Slack 7:00
不是说 AMP 是 GitHub 杀手,它是下一个 GitHub。这类东西不是砰的一声死掉,是无声地凋零。 —— Quinn Slack 20:52
每次有人说「我不信任模型能做 X 或 Y」,这话都撑不了太久。 —— Quinn Slack 25:28
编程 SaaS 会是世界上最后一个 SaaS,因为其他所有 SaaS 都可以用编程 SaaS 造出来。 —— Swyx 23:10
你没法把一个 agent 关在贴着别的标签的盒子里——它现在就只是 agent。 —— Quinn Slack 31:34

提到的书·产品·人物

适合谁听

想知道「全员信任、无强制评审、云端并行」的工程团队到底怎么运转,以及小而盈利的 AI 公司如何组织的创始人与工程负责人。

← 返回全部观看原片 ↗