← 顶级AI播客总结
20VC

反数据中心是中国的认知战?一位芯片创始人的暴论

"Anti-Data Centers is a Chinese Psyop" | How Many Will Actually Get Built? | Positron AI Co-founder
节目时长 80 分钟 阅读约 5 分钟
▶ 在 YouTube 收看原片

Positron AI 联创拆解推理经济学、KV 缓存与算力政治,直言"减速前沿"是 IPO 前的降本借口。

核心要点

  • 反数据中心是认知战:Thomas 认为左右翼罕见共识地反对数据中心,几乎完全源自中国的信息操作。他指出耗水叙事是假的——一家 In-N-Out 的用水量超过全美最大数据中心,高尔夫球场更是高出好几个数量级,现代机房是闭环液冷。
  • 减速前沿是降本借口:他半开玩笑地说"pacing the frontier"讨论本质是 IPO 前的降本手段——停止训练就能让 OpenAI、Anthropic 立刻大幅盈利。他同时点名 Sam 需要理由不 IPO,Elon 需要时间追赶,动机对所有人都成立。
  • 最怕技术集中而非天网:他判断 Terminator 式失控概率极低,真正的 PTSD 是能力集中到少数人手中。把矩阵乘法立法管制是"通往奴役之路"的现代版,会把人类拽回启蒙运动之前,大公司会变成新的领主与国王。
  • 推理是内存墙问题:训练算力受限可大规模并行,推理必须自回归逐 token 生成,每个 token 都要读一遍全部权重。2014 到 2024 年单张 GPU 算力提升约 120 倍,内存带宽只提升 17 倍,两者持续背离。
  • 96% 的 token 是缓存命中:semianalysis 的 AgentX 基准追踪了大量真实 Claude Code 会话,发现整个 agentic 编码流程中约 96% 的 token 来自缓存。缓存 token 的处理成本是重算的千分之一,这是 Anthropic 80 个点 API 毛利的来源。
  • 用户上下文大过模型权重:按 Claude Fable 约 10 万亿参数估算,权重约 5TB,而长上下文下单个用户会话可达 100GB 量级。只要 50 个并发用户,用户 KV 缓存总量就超过模型权重本身,逼出多级内存分层。
  • 便宜的 token 更值钱:Silicon Data 指数显示每百万 token 价格本月跌破 1 美元,五年前是 60 美元。但他强调当年那种 token 今天没人愿意付一分钱,真实的单位智能价值提升应该乘上百倍甚至千倍。

章节时间轴

← 返回全部观看原片 ↗