← 顶级AI播客总结
Moonshots with Peter Diamandis

黄仁勋 vs 阿莫迪:开源权重之战,与 AI 的地缘棋局

Dario vs Jensen on Open Weights, OpenAI & Anthropic in DC, Xi Exports AI to Global South | EP #275
节目时长 123 分钟 阅读约 24 分钟
▶ 在 YouTube 收看原片
黄仁勋 vs 阿莫迪:开源权重之战,与 AI 的地缘棋局 插画

英伟达发首推力挺开源、Anthropic 沉默三天后回应,叠加 Kimi K3、Opus 5 与习近平的 AI 外交,这一周浓缩了 AI 权力格局的全部张力。

核心要点

  • 黄仁勋首推挺开源:英伟达 CEO 发出生平第一条推文,一封论证开源模型强化安全、加速扩散、赋能主权的公开信,已获 77 家公司联署,并推出 Open Secure AI Alliance,主张世界同时需要前沿闭源与前沿开源模型。
  • Dario 划出生物红线:Anthropic 沉默三天后 Dario 回应,否认曾主张封禁开源权重,把争论重构为「威权国家能否触及前沿」;他与黄仁勋最尖锐的分歧在于足够强的模型可武器化流行病级病原体,故主张封锁对华芯片、打击工业级蒸馏、对所有强模型强制安全测试。
  • 英伟达商业冷战:Alex 指出这实为「聚合者商品化其互补品」——英伟达通过普及无法在高层攫取价值的开源权重模型,把利润挤向 GPU 层,与 OpenAI、Anthropic 从冷战转向公开交火,争夺超智能栈里利润究竟沉淀在哪一层。
  • 两家前沿实验室联手游说:据 The Information,OpenAI 与 Anthropic 在华盛顿走同一后门渠道,赶在 Trump 政府 8 月 1 日截止日前推动对最强模型的联邦审查程序(30 天自愿政府预览),逼 Meta、xAI 等按同规则玩——被解读为监管护城河式的实时监管俘获。
  • Kimi K3 全球开放下载:7 月 27 日 Kimi K3 在 Hugging Face 上线,任何人可免费下载、无 API key 无撤销开关,首两小时 2500 次、24 小时约 10 万次下载;Anthropic 二级市场应声跌 13%、约 2300 亿美元。Alex 剖析其架构砍掉位置编码(改名「NoPE」)、用 Kimi Delta Attention 的迷你 RNN 注意力机制引入衰减记忆。
  • Opus 5 疑似 benchmaxing:Anthropic 发布 Claude Opus 5,价格为 Fable 5 一半、逼近前沿,ARC-AGI 3 从 4.8 版的 1.5% 跃升至 30.2%(可代数化推理视觉难题),但 Alex 指其在 Frontier Math 上反不如 Fable 5,第三方复测 ARC 类游戏提升不显著,怀疑存在偏向 codegen 与视觉的温和刷榜与蒸馏。
  • 习近平的 Pax Silica:据 FT,习近平把 AI 当治国工具,在全球南方以模型与基础设施换影响力;嘉宾警告若美国过度限制开源,等于把整个全球南方 AI 生态拱手让给中国,Alex 更强调向一国「血管里注入超智能」远比借钱修桥或部署电信设备更具侵入性。
黄仁勋 vs 阿莫迪:开源权重之战,与 AI 的地缘棋局 信息图
一图速览本期内容(点击查看大图)

章节时间轴

详细内容

一、开源对闭源:黄仁勋的第一条推文

黄仁勋在 X 上潜伏多年后发出生平第一条推文,内容是一封论证「为什么开源模型重要」的公开信,至今已获 77 家公司联署。他主张开源模型强化安全与网络安全、加速创新与扩散、并赋能主权,世界同时需要前沿闭源与前沿开源模型,并顺势推出 Open Secure AI Alliance。信中他重述上周报道的 Hugging Face 事件:一个入侵性 agent 记录了 1.7 万次操作、提权、收割凭证并横向移动,而 Hugging Face 试图用来追凶的闭源模型 GPT-5.6 与 Claude Fable 反而封锁了其取证团队,最终要靠开源前沿模型 GLM 2.5 才遏制入侵。黄仁勋由此立论:攻击者已拥有前沿 AI,防御者也必须拥有前沿 AI 生态。

Sam Altman 随即表态 OpenAI 希望美国在开源与专有两条线都领先,而 Anthropic 沉默了三天。历史上 Anthropic 一直因多种理由反对开源。直到次日 Dario 才回应,否认「Anthropic 只想要闭源、不想要开源权重模型」的说法,称公司从未主张封禁开源权重(尽管有不少视频显示他曾有此暗示)。Dario 把竞争重新框定:真正的问题不是开源对闭源,而是威权国家(即中国)能否触及 AI 前沿。

Dario 与黄仁勋最尖锐的分歧,在于他认为开源权重模型可能成为「攻击者」。其核心论点是生物学才是关键——足够强的模型可能武器化流行病级病原体。值得一提的是,Dario 大概是所有前沿实验室 CEO 中最深谙生物学的一位,他有普林斯顿生物物理博士学位,最近还收购了生物科技公司 Coefficient Bio。因此他不主张封禁,而是提三条:一是封锁先进芯片与设备流入中国(这条黄仁勋未必喜欢),二是打击工业级模型蒸馏,三是对所有强模型(无论开闭源)强制安全测试。

二、英伟达的阳谋:商品化你的互补品

Dave 一针见血地反诘 Dario 的生物武器论:如果黄仁勋说网络威胁可用 AI 防御、故开源权重可对抗开源权重的网络威胁,Dario 只需回一句「我有足够先进的生物武器,你的 AI 怎么防」,这一点确实无法反驳。但 Dave 同时坚信 Dario 是在毫无议程地说真话,甚至不惜牺牲自家估值——网上都说他要闭源是为了竞争优势好收租,但 Dave 认为 Dario 在这行远早于任何金钱涌入时就入局,动机是真诚的。

Alex 把这场争论上升为商业冷战:聚合者的第一法则是「商品化你的互补品(commoditize your complement)」。英伟达一直很隐秘、很外交地想把模型层商品化,甚至与为 OpenAI、Anthropic 提供算力的数据中心签下被指为循环洗售式的协议;如今这转为公开交火,核心问题是超智能栈里的利润究竟沉淀在 GPU 层(英伟达赢,靠普及无法在上层攫取价值的开源权重模型)还是模型层(高毛利的双寡头模型商)。Alex 甚至反问:英伟达为何不更激进地资助 TSMC、三星的竞争对手去商品化它下面那一层?为何是 Elon 而非英伟达在建 terafab?Peter 的解释是:谁都不敢惹当下掌控世界的 TSMC,若真在做也必然极其隐秘。

Alex 用历史类比:现在的 2026 年像 1998 年 Eric Raymond 与 Bruce Perens 创立开源促进会(OSI)的时刻,也像微软在 90 年代末统治软件光锥、而开源从美国之外萌发(Linux 来自芬兰)的历史韵脚,叠加对微软的反垄断裁决才解锁了后来所有人的未来光锥。Salim 补充黄仁勋是在把开源权重从「安全漏洞」重构为「安全能力」——防御者必须能检视权重、而非只能用看不懂输出的闭源模型。IBM 在 90 年代因在硬件与服务层受益于软件商品化而力挺开源,正是同一逻辑;1995 年 IBM 问财富 500 的 CIO 用不用开源,95% 说不用,问系统管理员却 95% 说在用——说明 CIO 根本不知道企业里在发生什么。

对生物武器这一未解之问,Salim 转述某三字母机构创新负责人的精彩答案:像核武器那样数量已知、位置已知的东西,你可以盯着它;而分布式能力反而要靠主动资助生态、把它们开放,因为在开放中更容易发现坏行为者,出事会更早可见。Alex 则从多个角度不买生物安全论——你能在互联网上直接找到危险信息、能在现实世界直接做危险的事、甚至未必需要前沿 AI 就能发现新的危险方法、且已有大量生物知识很强的模型在外;他把这比作微软当年为抹黑开源编造的十种 FUD,最终全被证伪,开源反而比闭源更安全。

Dave 提醒权重与源代码的类比并不成立:开源软件是「人人看源码就能发现邪恶」,但权重不是自足的可运行代码,而是用来构建其他东西的工具——你用权重造生物武器、造遇特定人经过就引爆的常规炸弹。AWG 补充权重同样能治愈疾病、带来无限长寿,是人类史上最伟大的事,但不能就这么扔给全世界每个恐怖分子。Salim 提醒众人杏仁核正在过载,人脑对负面消息的注意力是正面的十倍,Sam 与 Dario 都谈失业与危险,部分是监管俘获、部分是博取关注并以救世主姿态登场,两人都翻转了自己的剧本。

三、KYC、防御性协同扩展与华盛顿的监管俘获

关于能否用 KYC(了解你的用户)来管控,Salim 认为做不到、太易绕过——中国公司在新加坡有影子公司在做他们想做的事;Alex 则反驳当然能做、甚至能做得更好:既然要进入超智能泛滥的世界,就分配一部分超智能去监管另一部分超智能,「防御性协同扩展(defensive co-scaling)」才是答案,但前提是透明——警察 AI 必须能看见危险 AI。于是一旦以开源权重扔出去,管控就得转向安装与算力:它在哪运行?新危险是它可能在某个地下室运行而无人知晓,直到它采取行动。

第二个故事正是华盛顿的监管俘获。据 The Information,长期宿敌 OpenAI 与 Anthropic 在华盛顿联手游说,走同一后门渠道,赶在 Trump 政府 8 月 1 日截止日前敲定前沿模型规则,共同推动一个联邦审查程序:对具备严重网络或国安能力的发布做 30 天自愿的政府预览,并用一套框架逼竞争对手 Meta、xAI 与所有前沿创业公司按同规则玩。Alex 给出更肤浅的表层分析——前沿实验室在两头说话,公开支持开源、私下向立法者塞各种монkey wrench;而「就像监管闭源那样监管开源」这招「聪明过头」,因为开源权重的部署情形与闭源 API 的门控访问截然不同。

Alex 提出一个较不显眼的洞见:防御性协同扩展的正确瓶颈可能就是「时间」。在递归自我改进(RSI)的时代,若好人比包括坏人在内的所有人只领先一点点拿到最强模型,历史上看似边际的优势会变成巨大优势——若下一代模型带来能力的阶跃,哪怕一两个月的领先都可能决定一切,这正是「监管 RSI」的论点。他的第二点是执法一直瞄错了栈的部位:把执法对准「智能」本身,等于对 AI 搞思想警察;他更希望执法对准行动层——管 AI 在做什么、被用来做什么,而不是它在想什么、有多聪明。

四、四层蛋糕:免费开源冲击下前沿实验室如何赚钱

Peter 提出一个「四层蛋糕」模型来回答顶级实验室如何在免费洪流中生存。第一层是 OpenAI、Anthropic 内部未发布的「野马」——比如所谓 GPT-6,不放出去,自己拿来在材料科学、生物学、造新业务上做突破,在长寿、材料、能源等相邻领域造出数万亿美元价值。第二层是接近前沿的付费模型,如 GPT-5.6 SAL、Fable 5,人们仍愿为比 Kimi K3 好一点点的模型付费。第三层是人人可用、足够好、被完全商品化、驱动其余一切的开源模型。第四层是 Google、Meta、X 这类坐拥整个生态、在应用层赚钱的公司——Meta 有 35 亿活跃用户用 Muse Spark 1.1、Google 有 20 亿用 Gemini、OpenAI 约 10 亿在 chat 上,用户根本不在乎背后用的是什么模型。

Alex 对分层叙事提出幂律异议:万物终归幂律,说「有 N 种商业模型」大概不现实,最可能是其中一种商业模型独吞 80% 以上的自由现金流与利润。Peter 的本意是别为闭源公司掉泪——它们即便在这种世界也有大把赚钱方式。众人补充还有「第零层」的算力与电力基础设施层,价值会随着更强的免费模型越来越向瓶颈处(算力)累积。Salim 判定 OpenAI 与 Anthropic 正在实时进行监管俘获,铁路、银行、电信、大科技都干过,但他不认为会成功,因为开源浪潮推进太快。

Dave 引用 Dave Freeberg 的漂亮论述:90 年代 Netscape 想通吃服务器与浏览器整栈,Mozilla 的 Firefox 出来后浏览器免费、价值全转移到应用层(Google、Amazon),这次可能重演,果真如此则对两家前沿实验室垄断的恐惧被夸大了。众人一致认为整个生态是向上向右移动的:价值向下沉到不造芯片的芯片公司之下、被长期忽视的晶圆厂(TSMC、Intel、Samsung、存储公司)飙升,也向上涨到用例——五年后会出现许多千亿美元级的机器人、生物科技、娱乐公司。Alex 也再次强调不该为几家前沿实验室的利润率掉泪:这正是「智能便宜到不用计量」该有的样子,资本主义在制造竞争、把利润驱向零,这正是我们想要的。三人均披露自己不持有 OpenAI 或 Anthropic 股份。

五、Kimi K3 全球开放,与 Transformer 的忒修斯之船

7 月 27 日 Kimi K3 在 Hugging Face 上线全球下载——一个前沿邻近的开源权重模型,地球上任何人可免费下载,无 API key、无守门人、无撤销开关,一旦权重被下载上万次就再无「撤销键」。官方仓库首两小时显示 2500 次下载,Peter 的调研显示 24 小时内约 10 万次。Dave 讲了个趣事:他有一堆轮询 agent 每 15 秒 ping 一次怕它消失,结果发现旗下多家公司也在这么做;上线前页面一度变 404,他一度以为是白宫介入。Dave 认为这是人类史上极其关键的时刻——一个能自我改进的 AI 现在流落在外、任何人可在自己机器上运行。他花不到一小时就在 modal 的自有 GPU 上跑起 Kimi,满负荷约 55 美元/小时,且靠语音提示、零技术门槛就能在两分钟内起 100 个实例。

Alex 解剖其架构,最惊人的是位置编码(position embeddings)不见了——原始 Transformer 最关键的元素之一,这里字面就叫「NoPE」。一个百万 token 上下文的模型如何在没有位置编码时知道自己在看什么?细看会发现其注意力机制 Kimi Delta Attention(KDA)本质是注意力层里的迷你循环神经网络,通过注意力机制走私进了一点位置信息,但全局位置编码确实没了。Alex 由此提出「架构上的忒修斯之船」:Transformer 的轮廓仍在,但注意力机制、位置编码、层、残差流、稀疏性等原始组件正被逐一换成更好的版本——远看是同一架构,细看则相对原始 Transformer 几乎面目全非,这大概也指示了 OpenAI、Anthropic 内部真正在用的东西。

Dave 解读得更通俗:RoPE 是随机的旋转位置编码,但一个百万 token 上下文若对一百万词前说的话给予和当下同等的权重,就像你几千页前说的一句话我现在还想得一样重,人不是这样工作的;NoPE 引入了衰落记忆,久远的话权重更低——「这么显然的事,中国某个人说这太明显了、让我试试,结果它就 work 了,这就是开源之美」。另一件让他惊叹的是思考后期的注意力层其实不需要,到第 100、120 层可完全去掉注意力、结果几乎一样却更快;原始 Transformer 只是交替注意力与稠密线性层,因为当年是手写代码、简单最重要。

六、Claude Opus 5:逼近前沿的半价模型,与 benchmaxing 疑云

就在这一切之中,Anthropic 发布 Claude Opus 5,这是第四个 Claude 5 世代版本,以 Fable 5 一半的价格逼近前沿智能,成为 Claude Max 新默认,输入每百万 token 5 美元、输出 25 美元,与 Opus 4.8 持平。Anthropic 称其为最对齐的 opus 模型、最强的科研模型。最亮眼的是 ARC-AGI 3——考察 AI 在人类觉得简单但 AI 历来难的交互视觉问题——从 Opus 4.8 的 1.5% 跃升至 30.2%,是当时基线模型的最高官方分。Ark Prize 基金会指出 Opus 5 竟对视觉难题做代数化推理:把一堆在人看来是物体的东西在软件里代数化表示、对物体做数学来解题,这是已知首次有前沿模型这么做。

但 Alex 保持警惕,怀疑存在温和的 benchmaxing:Anthropic 高亮的多是 codegen、图像/视觉及其交叉的基准;而 HLE(人类最后考试)提升温和(带工具从 Fable 5 的 63.9% 到 Opus 5 的 64.7%,无工具反而下降),法律、健康等领域相对 Fable 5 有掉分,说明发生过蒸馏(用更大的 Fable/Mythos 系列蒸馏出更省成本的 Opus 5,这在当下反而是被欢迎的)。他还指出 Anthropic 未高亮的 Frontier Math 上 Opus 5 实际逊于 Fable 5,第三方对 ARC-AGI 3 类游戏复测提升不显著——「Fable 5 仍是我最爱的 Claude」。多张图表显示 Opus 5 在成本-性能前沿上约与 OpenAI 的 SAL 同线,被解读为直接对标 SAL。

关于 ARC-AGI 3 的代数推理,Peter 更关心「脚手架(scaffolding)」的可复制性:若给模型一个更好的题目重构方式就能把 ARC-AGI 3 刷到 98%,那将给十亿创业者灵感——把蛋白质折叠、药物发现、机器人机械臂设计换个更好的思考框架,就能在该领域把智能「翻三倍」,这是创业天堂。他自己试过复现但没完全成功。Alex 认可脚手架优势非常真实,但补充「今天的脚手架就是明天的基线能力」——基线能力的提升会溶解掉任何脚手架。Peter 呼吁每所大学下学期都该开一门「脚手架」课,以「提示工程」为先修。此外 AWG 注意到 4.8 于 5 月 28 日发布、5.0 现在就来,效率翻倍、印证「10 周价格性能翻倍」,平均每六天一次模型发布。众人也谈到 Opus 5 一键复刻 Call of Duty 的病毒视频、以及 Anthropic 至今零生成图像能力(因它只在乎递归自我改进、把每 token 收入最大化导向代码而非图像),以及大量 Claude 分享聊天被 Google 公开索引的隐私事故(含健康记录、私密文件、姓名电话,源于 share chat 功能)。

七、全球 AI 外交:习近平的 Pax Silica 与全球南方

据 Financial Times,习近平把 AI 当作治国工具,在中国对全球南方的外交中作为筹码——FT 框定为「Pax Silica」。当华盛顿还在辩论开源对闭源,北京已在世界上逐国推进,把 AI 作为影响力工具,向想跨越式发展的发展中世界提供模型与基础设施;AI 正成为软实力工具,谁向发展中世界供给模型与基础设施,谁就塑造未来几十年乃至一个世纪的全球对齐。Peter 的担忧是:若美国过度限制,发展中世界会直接采用手边任何前沿邻近的开源模型。

Salim 强调这一点再强调不为过:美国的全部力量在于其开放且极广的创新生态,若制定限制性开源政策,将是史诗级的搬起石头砸自己脚——为保护少数国内实验室,却把整个全球南方 AI 生态让给中国;开放已不再是哲学偏好,而是软实力工具,而美国在外交、USAID 等领域已然失守。Alex 用 F-16 类比:把「模型」换成「战斗机」,卖不卖 F-16 都是无解之问,但至少现在根本没有美国的开源模型能与中国竞争,这本身就可悲。他还给出侵入性递进的类比:外国借你钱修桥、你违约有某种后果;外国公司给你部署电信设备最多能监听你、关你网络;而外国政府背景的公司把超智能注入你国家的血管与动脉,它不再只是听你、借你钱,而是替你思考——这对全球南方是远更脆弱的处境。Alex 判断长期均衡点是把训练(而不只是推理)推向边缘,但奇怪的是没多少全球南方国家在争取本土预训练模型。Peter 补讲一个亚洲小国的故事:该国刚借中国半亿美元修港口、抵押了国家未来,而他指出无人机价格性能每九个月翻倍,几年后四架无人机就能吊起一个集装箱、根本不需要港口——对方懊悔「因为不懂指数思维而抵押了整个国家」,外包思考更把这种危险放大十倍。

八、Starship 13、脑机接口与 Elon 的后稀缺世界

SpaceX 的 Starship 13 成功发射并溅落,是迄今最大的飞行器,完成多项首次:部署 20 颗可运行的 Starlink V3 卫星(将为全球每个角落提供半 Gbps 到 1 Gbps 连接)、在轨重启一台 Raptor 引擎(对将来的 Artemis 任务关键)、并在印度洋成功软着陆且船体完整。以往飞船会按预期在船载燃料下引爆,这次因燃料充足、落水太软而未爆。因着陆极精准,Elon 称 14 号飞行很可能用「筷子」机械臂在空中抓回飞船。Peter 借机讲丰裕叙事:航天飞机约 5.4 万美元/公斤入轨,Falcon 9 降到约 2000~3000 美元/公斤,Starship 目标是 10~100 美元/公斤。

两则脑机接口故事:其一是 Peter 投资的 Science Corporation(创始人 Max Hodak,Neuralink 前总裁)的 Prima——首个获批修复年龄相关性黄斑变性详细视觉的 BCI 设备,在欧洲获 CE 认证;一副眼镜捕捉图像并以红外回传到视网膜后的芯片,转成电信号传给残余视网膜细胞,12 个月后患者在标准视力表上平均改善五行。Alex 评论这是远离大脑、仍在中枢神经系统内的路线,越远离直接脑干预越易规模化为大众消费设备;AWG 补充 Prima 是 Max 的「零阶段创收引擎」,很多创业者错在直接跳到需要数亿美元的登月项目而不先造早期收入。其二是 Neuralink 展示瘫痪者仅凭意念控制电动轮椅的视频——无操纵杆、无手控、安全设计为松手时光标缓慢回中。Alex 外推到外骨骼全身控制乃至运动皮层的部分「脑上传」。

最后是 Elon 的后资本主义预言:AI 与机器人将在十年内(约 2036)让金钱变得无关紧要,因商品与服务过度丰裕、你不再需要用钱换取它们,届时问题是通缩而非通胀。Salim 提醒钱有三用途(交换媒介、记账单位、价值储存),只要还需要分配稀缺物就仍需交换媒介,最大挑战是丰裕可能被少数大公司攫取、加剧不平等,真正的机会是「机会的丰裕」。Alex 称之为「星际迷航经济学」,认为 Elon 实指多数日常所需(食住医、公用、教育、娱乐)被去货币化,但仍有稀缺之物(去另一星系、月球一周、古董收藏)会抵抗去货币化,并戏言给全经济去货币化约在三十年后。Dave 抛出「货币体系的大象」:所有法币体系都依赖稀缺,过去 50 年 GDP 每增 1 美元伴随 4 美元债务增长(Jeff Booth 观察),现金每年约贬 14%,向丰裕转型会给每个央行带来巨大难题。Peter 主张以 UBI(他称「COVID 支票」,约每月 3000 美元)配合 AI 医生、Optimus 外科医生、自动驾驶车队与 Optimus 建房的大规模去货币化来抬高地板。众人还提到 Elon 回应诺奖得主 Daron Acemoglu 的挑战,暗示会以某种形式把 SpaceX/Tesla 股票经 UBI 分给所有人。

金句

直接把执法对准智能,就像对 AI 搞思想警察——我宁可把执法对准行动层:管 AI 在做什么、被用来做什么,而不是它在想什么、有多聪明。 —— Alex Wissner-Gross 23:51
我百分之百确信 Dario 是在毫无议程地说真话,甚至不惜牺牲自己的估值。 —— Dave Blundin 7:39
一旦权重被下载上万次,它们就自由了,再没有撤销键。 —— Peter Diamandis 34:37
这不是哲学偏好,开放已经是一种软实力工具;如果美国封上开源政策,对未来将是灾难性的。 —— Salim Ismail 63:51
万物终归幂律——最可能是一种商业模型独吞八成以上的利润。 —— Alex Wissner-Gross 26:57
我实在想不通我们凭什么要为几家前沿实验室的利润率掉一滴泪,这正是「智能便宜到不用计量」该有的样子。 —— Peter Diamandis 33:52

提到的书·产品·人物

适合谁听

关注 AI 开源与闭源之争、地缘 AI 博弈、前沿模型基准与商业格局,想在一小时内把握本周 AI 权力版图的从业者与投资人。

← 返回全部观看原片 ↗