← 顶级AI播客总结
Moonshots with Peter Diamandis

政府坐进了发布回路:当美国把前沿AI变成「逐客户审批」的国家机密

US Government Blocks GPT-5.6, Alibaba's AI Theft, and Why OpenAI Is Stalling Their IPO | #267
节目时长 138 分钟 阅读约 24 分钟
▶ 在 YouTube 收看原片
政府坐进了发布回路:当美国把前沿AI变成「逐客户审批」的国家机密 插画

一场周六加更的紧急播客:美国政府首次把商业AI当核武器管制,逐客户放行GPT-5.6与Mythos,而中国开源模型正逼近平价——这是「奇点中段」的实时战报。

核心要点

  • 逐客户审批:白宫首次对商业AI下国家安全暂停令——Anthropic 的 Mythos 5 仅放行给约100家精选公司,OpenAI 的 GPT-5.6 仅放行20家,政府正式进入「发布回路」,逐个客户决定谁能用前沿模型。
  • 政府成了同步器:AWG 指出,人们曾担心递归自我改进会引发「竞速失控」,需要实验室间协调机制;如今政府这个「对暴力的地理垄断」恰好充当了同步机制,让 GPT-5.6 与 Mythos 几乎同时达到平价。
  • 圣诞前追平:一张在 X 上流传的图表外推中国开源模型追平西方开源前沿的时间差,按算法不同将在今年圣诞归零;Emad 称 GLM 5.2 在最难的 Frontier SWE 基准上配合正确 harness 已超越 GPT-5.5。
  • 猫已出笼:Dave 警告政府「太晚了」——用 Opus 4.8 或 GPT-5.5 套上足够聪明的 harness 就能超过本周被叫停的 Mythos/GPT-5.6,意味着真正要管的是「能否自我构建」这一查询。
  • 2880万次蒸馏:Anthropic 指控阿里巴巴用 25,000 个假账户、2880 万次欺诈对话蒸馏 Claude,号称史上最大模型盗窃指控;AWG 反讽 Anthropic 自己也曾因盗用版权材料被多次起诉。
  • 推迟IPO真因:OpenAI 推迟 IPO 表面归咎 SpaceX 股价波动(Dave 称 SpaceX 从135美元开到150、现153,定价近乎完美),实因已募资1220亿不缺钱、Sam 从未当过上市公司CEO、且都相信一年后世界将面目全非。
  • 4小时睡眠药:Eli Lilly 以63亿美元收购 Centessa,其药物靶向 orexin 这一大脑清醒「总开关」——若成生活方式药,每天多4小时清醒相当于每年多两个月寿命。
政府坐进了发布回路:当美国把前沿AI变成「逐客户审批」的国家机密 信息图
一图速览本期内容(点击查看大图)

章节时间轴

详细内容

一、白宫坐进发布回路:国家安全暂停令

本期的核心冲击是一条制度性的头条。Peter 报告:美国历史上首次,行政分支对商业AI产品下达「国家安全暂停令」。上周 Anthropic 的 Fable 与 Mythos 模型一度被下架,随后 Trump 政府与 Anthropic 达成协议,允许把 Mythos 5 放行给约100家精选公司;两天前 OpenAI 正要发布 GPT-5.6 时,白宫同样出手,只允许放行给20家精选公司。Altman 在内部备忘录中说,政府将在「有限预览窗口」内逐客户审批访问权,若一切顺利数周后再扩大放行。GPT-5.6 分三档发布,全部被白宫节流:旗舰 Saul(太阳)、中端 Terra、低成本快速版 Luna。

缺席的 Salem 留了一个问题贯穿全场:既然白宫在拖延前沿模型,政府是否在用监管毯子扼杀本土AI,甚至压垮 OpenAI 与 Anthropic 的估值?Dave 的回答是「问题一是,问题二否,但这不可避免」。他认为模型已强大到「必须被控制」,网络安全只是第一个借口,其他邪恶用例紧随其后,这就是新常态。至于估值,他认为唯一能压低市值的论点是「中国是否会反超」,而他儿子 Sean 刚从中国、越南、韩国回来,结论是中国在「蒸馏、复制、窃取知识产权」上做得极好,但在推进前沿上「几乎没有机会」威胁美国公司市值——前提是政府一视同仁(他承认这不太可能)。

AWG 给出了本期最具洞见的框架:这是「监管的终局」。在 OpenAI、DeepMind、Anthropic 创立早期,人们极度焦虑递归自我改进时代到来时的「竞速失控」(race condition),普遍共识是前沿实验室需要某种相互协调机制以「手拉手一起冲过终点线」,许多人当时认为这是 Moloch 经济学的悖论、不可能实现。结果证明,「我们用了几千年的老协调机制——政府,即对暴力的地理垄断」恰好胜任,强行让 OpenAI 与 Anthropic 这对双寡头同步把能力放给最初几十个客户。换言之,政府无意中成了「同步器」,让 GPT-5.6 在原始性能上达到与 Mythos 5 预览版的平价。

二、中国开源的逼近与「harness」让旧模型反超

讨论很快转向中国。AWG 提到一张在 X 上流传的图表,外推中国开源模型追平西方两个剩余开源前沿模型的时间差,按不同算法「将在今年圣诞前归零」。Peter 由此担心:如果中国开源在收敛、而美国政府在节流,全球公司会转向 on-prem 部署中国模型。

Emad 给出技术细节:GLM 5.2 是第一个有「大模型感觉」的开源模型,尽管它只是在 GLM 5.1 基础上多训练。更关键的是 harness(脚手架)——多模型编排。他的老东家 Sakana 发布了 Fugu,Blitzy 团队登顶 SWE-Bench Pro。Emad 的 Intelligent Internet 将在周一发布一个 harness,在最难的 Frontier SWE(每个任务耗时11小时、要求构建新颖内核)上,GLM 5.2 配合该 harness 登顶,而用普通 harness 只排第四五;考虑到 GLM 5.2 可能只值约2500万美元算力,这「相当疯狂」。他的结论:基础模型性能正变得不如「如何使用它」重要。

Dave 把这点推到极致——「因此政府太晚了」。你现在就能拿已经发布的 GPT-5.5 或 Opus 4.8,套上足够聪明的 harness,让它超过本周被叫停的 Mythos 或 GPT-5.6。这意味着「猫已经出笼」,政府若要补救就得回头锁死 4.8、甚至 4.7,假装六个月前就做了。他亲身验证:Blitzy 确实能在 SWE-Bench Pro 上击败 Mythos。

AWG 应 Peter 之请解释了 harness:它指「非权重的能力提升」。从2020年 GPT-2 的 prompt(in-context 改变行为),到 system prompt(抽取公共元素),再到把逻辑、文本抽取出来形成 harness——即 Karpathy 所说的「software 1.0 脚手架」,在模型外编排、喂提示词、解析输出、混合不同厂商的模型以达到超常表现。Dave 补充,AI 现在整天对他说要「monkey patch」,他写了35年代码从没用过这个词,但「它确实能工作,我们就放手让它做」。

三、Project Glass Wing 与从攻击转向防御

Peter 为政府的决定做了「钢人论证」(steel man)。据美联社报道,Anthropic 的 Mythos 在 Project Glass Wing 下与美国情报机构做红队演练,「在数小时而非数周内攻破了几乎所有机密系统」,参议员 Mark Warner 称其「在演练范围外识别并利用了漏洞」。12天后 Trump 政府就要求 Anthropic 对外国国民禁用 Mythos 5 和 Fable 5。

但嘉宾普遍认为网络安全只是「掩护故事」。Dave 直言真正的问题是那个查询:「Mythos,你能帮我构建你自己吗?」——在中国,如果模型能回答这个,就能复制出对等的竞争模型。Opus 4.8 答不了,Mythos 能(他在被撤回前有两天的访问权)。他类比历史:政府总是先有议程,再等一个触发事件来「正当化」早就想采取的行动,就像俄罗斯进入乌克兰。真正的驱动是「自我改进能力不能流向世界,否则永远覆水难收」。

AWG 同意「我们在终局」。他认为中国此刻已有足够能力实现自己的递归自我改进(他称之为「费米堆」),无需再窃取西方的推理痕迹或外泄权重;这项政策只有在「递归自我改进的终局、每一天都重要」的前提下才说得通。Alex 还抛出一个尖锐类比:这是一个「来自内部的 Sputnik 时刻」——NSA 和 Cyber Command 被私营部门突袭,私营部门在漏洞等网络能力上反超了政府一直雪藏的能力。他进一步「略带挑衅」地说:如果你支持对人类移民设强力政策,那么当AI能力开始超越人类,你也得开始思考「进口外国AI」的政策——美国未来进口的外国人工智能可能多于外国人类智能。

四、信任层、中毒对齐与谁来合并代码

第二条 OpenAI 故事是代号 Daybreak 的 GPT-5.5 Cyber,一个防御性网络安全模型,在 Cyber Gym 基准刷出85.6的历史最高单模型分。Altman 说「真正的奖品不是找到漏洞,而是自动编写并测试修复,从浏览器一路到 Linux 内核,把威胁变成解药」。AWG 称这正是他和 Peter 在《Solve Everything》中写过的——AI 正在批量解决开源与闭源项目的漏洞,IBM 等非营利项目专门做这事,这将成为「时代的伟大工程,就像州际公路系统」,回溯所有历史开源仓库批量修复。

更微妙的是「中毒」(poison)对齐。AWG 注意到 OpenAI「字里行间」在引导模型,让那些试图用于进攻性网络的用户「自我破坏或中毒」,这是比 Anthropic 原始措辞「稍不那么煽动」的说法。Emad 警告权重盗窃的风险升级——埃隆与 Anthropic 做了交易,Anthropic 权重被加载到 Colossus 上;对手不是地下室的孩子,而是民族国家,他们若拿到「预训练结束前、系统提示之前」的基础权重,那些模型更有创造力、更不受约束,攻击力更大。他还预警中国模型可能在代码中植入后门,藏在潜空间里数天数月数年都查不出,因为「这通话里谁还逐行审查自己合并的每一行代码?」由此可能催生「ISO认证模型」来合并代码的要求。

Dave 收尾时指出,没人能再检查代码了——你让AI安装东西它快到你跟不上,问题只剩「我信不信任那个AI」,所以中国模型注入间谍软件「一行代码就够」。本节的更大主题是「只有AI能跟上AI」。Peter 还补了一句关于隐私的现实主义:在 Palantir 协助下,美国政府难道读不到我们的每条短信、每封邮件吗?「我假设他们能。我们想要隐私,但我不假设有隐私。」

五、推迟IPO:借口与真因

第三条 OpenAI 故事是推迟近期 IPO。顾问给了两条路:今年上市但估值可能低于1万亿美元;或等到2027年继续做大营收、基建、合作,保住万亿叙事。Altman 不愿在低于万亿时上市。表面理由是 SpaceX 股价波动(从22美元高点滑到昨收153——此处应指拆股后口径,IPO 价135、开盘150、现153)让他们担心。

Dave 直言这头条「胡扯」,且 Peter 已点破原因。SpaceX 的 IPO「定价近乎完美」——若真涨到三倍,埃隆就在桌上留下了上万亿现金。推迟的真因有二:一是 OpenAI 刚募资1220亿(Dave 与 Emad 互相确认是「122」),不缺钱;二是「谁来运营公司」——半开玩笑说会是最新的 GPT 模型,但那要过 SEC 的 S-1 审批。Dave 还点出 Sam 有至少400项外部投资,作为上市公司高管要披露每一项持仓和潜在利益冲突,「对 Sam 来说那得是本百科全书」;Sam 和 Dario 都没当过上市公司CEO,而埃隆早就玩过(为一条推文付过2200万美元罚款)。

AWG 补充一个批评:OpenAI 搞砸了,太早、太久押注消费者会是营收引擎,这个赌注「很可能错了」,本该聚焦企业级。他们现在「正比 Anthropic 变成 OpenAI 更快地变成 Anthropic」,而 Codex 是个好产品、营收暴涨。他设想关键问题是「Codex 还要多久能整体脑换 ChatGPT、撑起万亿IPO的营收引擎」,但他赌这主要是「营收故事和会计故事」,确保盈利而非烧钱,大概一年内能到位。Peter 提出更深一层:三人(Dario、Sam、Elon)中只有埃隆快速上市,另两人在旧金山,那里的共识是「硬起飞就在当下」,会发现新物理、新医学,与SEC、路演耗时是「奇点中期最愚蠢的事」。Dave 描述上市后的现实——股票跌了会有集体诉讼、发任何推文都要过法务批准——「朋友不让朋友运营上市公司」。

六、Neuralink 脑对脑与马斯克的「Star」宇宙

进入马斯克板块。埃隆宣布 Neuralink 今年内可能尝试首次「脑对脑」心灵感应通信——不打字不说话,思想直传。Peter 称这是神经科学最科幻的里程碑,并透露埃隆的终局不是医疗设备,而是为奇点造一个「I/O 层」,让人类与AI「耦合」。

AWG 谈到一篇《Cell》论文:双语者大脑中同义词的「桥神经元」问题,答案出人意料地是其相对几何「看起来就像 encoder-only transformer 的向量嵌入空间」——海马体像一个嵌入空间,pero 和 dog 的神经元相邻。若此成立,心灵感应会比想象容易,且人类认知或许没那么复杂。AWG 据此预测对「非侵入式人对人心灵感应」会有巨大需求,埃隆或在并行推进非侵入式 BCI。Peter 和 Emad 都引用人类 I/O 速率极窄:语音约40-60 bit/s、打字5-20 bit/s、有意识思维约10 bit/s。Emad 引 2023 年 Stability 神经团队的 MindEye 论文(用 fMRI 加 stable diffusion 重建所见),论证人类潜空间相似,因此心灵感应时「你不需要那么多词,用最少的词激活共同潜空间」,带宽可能上升一万到十万倍。

随后是马斯克的命名学。星系列:Starlink 移动比特、Starfall 移动原子、Starmind 移动智能。埃隆自嘲「要少用 star 前缀了,有点傻」。AWG 盘点:Starship、Starbase(德州)、Star Factory、Starshield(给国防部的政府级 Starlink)、Starfall(货物送入 LEO 再回收,解决「下行质量」难题,有公司把酵母送上轨道酿「轨道啤酒」)、Stargaze(利用卫星上下看做态势感知,可能成 Planet 竞品)、Starmind(AI 轨道星座、Dyson Swarm 品牌)、Starpipe(两天前宣布,SpaceX 进军油气炼化——因推进用 methalox,且建火星/月球殖民地需要油气与炼化能力)。

七、AI 视频、世界模型与30万亿企业机会

字节跳动的 Seedance 2.5(7月将出 beta)实现30秒4K视频、最多50路输入(图像/视频/音频)、文本提示编辑。Emad(前 Stability CEO)说「我早说了」——他离开 Stability 时就预言2026年到好莱坞级控制、2027年全长电影,如今50路输入意味着50个角色、近乎像素级控制。他担忧下游真实冲击:媒体行业的人力工时将被取代,且「无法再培训」。

AWG 判断「中国在视频生成上遥遥领先」:美国只有限于约10秒的 Gemini Omni 和埃隆的 Grok;中国训练视频模型有更便宜、更少版权束缚的数据(不太担心因 TikTok 数据被告侵权),而西方前沿实验室都在追逐能产生巨额营收的代码生成模型。他估算 codegen 营收是视频生成的20倍。Dave 把焦点引向视频游戏——比所有其他媒体加起来还大(数千亿 vs 好莱坞500亿),谁先实现实时4K交互式视频生成谁就拿大钱,瓶颈是延迟;他举 Liquid AI 为例(非 transformer 注意力窗口、极高效用上下文,9月买奔驰对车说话就是在用它)。AWG 进一步指出企业级才是「比视频游戏大几个数量级」的市场——约30万亿企业软件;他举阿里巴巴的「one streamer」实时交互式视频到视频 demo,若西方能做出能参与公司会议的实时 Zoom/FaceTime AI 参与者,就能撬动30万亿市场。Peter 顺势宣布明年要把顶级视频游戏公司请上 Abundance 360 舞台。

八、阿里蒸馏 Claude 与知识产权的存亡

Anthropic 指控阿里巴巴用 25,000 个假账户、2880 万次欺诈对话「大规模蒸馏 Claude」,若属实是「史上最大AI模型盗窃指控」。AWG 先指出反讽:Anthropic 自己因盗用版权书籍做预训练被多次起诉,如今「鞋穿在了另一只脚上」——只是蒸馏是模型到模型训练,预训练是语料到模型,概念相似。他解释中国通过代理(proxy)以九折优惠访问西方模型,代理收集所有推理痕迹(你放弃了隐私、被当作「袜子木偶」),再用于蒸馏;「蒸馏是否构成间谍活动」将被大量诉讼,世界正走向「第二次冷战」式的美中两大阵营,连推理痕迹都不愿流动。

Emad 区分蒸馏类型:直接对潜空间的,和「如何回答难题、写好代码库」的——后者极难锁死。他认为中国公司在用 Claude/Mythos 替代 Mercor 这类「专家输入」供应商,且 GLM 5.2 优于 5.1 是因为一个「递归自我改进循环」:初始分布足够好后,通过彻底循环回数据改进。他警告即便今天起中国永不能再用美国模型,其现有数据集和技术也已足以跟上前沿。Dave 用一个生动例子收尾:他儿子在深圳省政府大楼地下室买到25美元的假劳力士,连专利号和卡扣内铭文都有,「复制别处的想法、偷来带回家,已经在中国文化的DNA里」,所以对25,000个假账户感到震惊的人「完全脱离了中国的现实」。

随后是哲学层面的 IP 之争。Peter 引述早年与 Steve Jurvetson、Astro Teller 的对话:奇点末期 IP 将毫无意义,因为AI会把产品迭代地重新发明得更好,你必须不断创新而非保护多年前的成果。AWG 提出反命题:「IP 意味着一切」——AI 会超级武装 IP 诉讼律师,做超人级的 IP 保护。他不认为 IP 会因智能增强而消失,反而可能被「极度强化」:AI 能起草更好的专利权利要求、做更好的专利诉讼,防御侧同样会被超级智能武装。Emad 则认为复制/重混能力会让「几乎一切都能在几年内被一次性复刻」,但音乐有极强版权保护、软件几乎没有,会形成一整条光谱。

九、量子、光子计算与短睡眠药

Trump 签署行政令支持美国量子计算,白宫还要像保护核机密一样保护量子研究免遭外国间谍。政府用2026年5月的《芯片与科学法案》承诺20亿美元风投:IBM 拿走10亿(在纽约 Albany 合建 Anderon 量子芯片代工),D-Wave、Rigetti、Inflection 各1亿,PsiQuantum 拿1.4亿股权。AWG「轻度兴奋」——他更感兴趣的是行政令首次要求建立「发现科学量子计算机」(QC ads),以及一个他此前不知道的「量子信息科学与技术反情报保护团队」,体现政府「不想被第二次突袭」。但他指出量子做科学加速「效果一直不好」——蛋白质折叠本以为要量子,结果被 AlphaFold 3 纯经典方法解决;他点名 Sandbox AQ「不用量子计算,而是在AI平台上用量子物理方程」。

Emad 看好量子是「下一个大浪」,因量子计算机远比 GPU 难造,中国在光子量子有优势但缺各类型;最有趣的是「用超级 Mythos 级模型向量子计算机问对的问题」。他抛出宏大设想:能量增长用于问好问题 + 量子至上,两条曲线相遇,也许就不需要 Dyson 球了。AWG 提醒这隐含「复杂度层级坍缩」假设——量子计算难有用,是因为没有超级智能很难找到既经济有用又有量子优势的算法;但他乐观押注「若数学空间里存在AI可发现的量子优势AI训练/推理算法,AI会找到它」。Dave 透露自己创办了 Quantum.AI,主攻光子:高度量化的神经网络几乎确定能与 FP32 一样好,这打开「光子计算」的巨大效率之门,质量约为 NVIDIA 的百分之一,他赌一到一年半内埃隆会制造光子计算——「不是量子量子,而是量子光子」。AWG 补充埃隆/SpaceX 两天前花数十亿收购了一家光子计算/通信公司,谷歌也有「纯光做矩阵乘法」的专利(2023年申请、去年获批)。

健康板块(Fountain Life 广告:3.3%自认健康的会员体内有未知癌症,全身MRI早筛)后,谈短睡眠:8小时是进化所需,「短睡眠者」(4小时)占人口0.1%以下。睡6小时以下:冠心病风险增48%、中风15%、全因死亡12%、β淀粉样蛋白5%、2型糖尿病17%、感冒风险4倍。Eli Lilly 以63亿美元收购 Centessa,其药靶向 orexin(大脑清醒总开关),原为发作性睡病开发,Peter 认为终将成生活方式药——每天多4小时=每周28小时=每年58天=多两个月寿命。AWG 类比 GLP-1 剧本(从希拉毒蜥发现、原治糖尿病、让 Eli Lilly 成万亿公司),认为 orexin 会复刻:糖尿病角色由发作性睡病扮演、GLP-1 由 orexin 扮演。Emad 自称4小时睡眠者,看好 orexin 上调会降低炎症标志物(ghrelin、leptin),「你睡得更少,但炎症更轻」。

金句

「底线是,美国政府现在进入了最强模型的发布回路,逐个客户、逐个客户地挑选谁能拿到最新模型。」 —— Peter Diamandis 7:09
「事实证明,我们用了几千年的同一个老协调机制——政府,对暴力的地理垄断——似乎完全有能力充当那个同步机制。」 —— Alex Wissner-Gross (AWG) 11:29
「这意味着猫已经出笼了,政府得回头说『等等,我们太慢了,得回到六个月前假装当时就做了』。」 —— Dave Blondon 16:52
「任何对这件事感到震惊的人,都完全脱离了中国实际在做的事。」 —— Dave Blondon 85:42
「朋友不让朋友运营上市公司。」 —— Dave Blondon 60:09
「我们都是星辰之物,只是有些人会比另一些人更是星辰之物。」 —— Emad Mostaque [128:10]

提到的书·产品·人物

适合谁听

关注AI地缘政治、前沿模型监管、AI投资与未来科技趋势,想第一时间听懂「奇点中段」实时战报的从业者与爱好者。

← 返回全部观看原片 ↗