先锋 趋势 方法 投研 作者
AI战争:OpenAI广告与Sora 2、Grok与美国政府合作、Google广告业务面临风险
返回节目精读

AI战争:OpenAI广告与Sora 2、Grok与美国政府合作、Google广告业务面临风险

摘要

  • 可投资的媒体变迁,正从算法筛选内容转向算法生成内容,把创作、分发和病毒式传播压缩进同一个循环。 尽管Meta拥有巨额AI预算,Vibes仍依赖Midjourney和Black Forest Labs,节目组将其视为专业初创公司获得验证的信号。Sora 2只需短暂捕捉面部,就能生成具备真实物理效果和音频的个性化视频;但“最令人震惊的事情”既不是质量,也不是易用性,而是:“它是免费的。”

  • Anthropic的Claude Sonnet 4.5让软件创作看起来像递归式改进的前沿,但其狭窄的代码路线仍是一场战略押注。 它在SWE-bench上拿到82%,Blitzy借助多个模型达到86.8%;据报道,Sonnet 4.5还能自主工作30多个小时,远超此前7小时的前沿水平。Alexander Wissner-Gross表示,如果这一结果可复现,意味着自主性曲线将是“超指数而非指数”增长;不过,未来6到12个月内,视频和其他模态也可能被证明同样关键。

  • AI接口正从预先编写的应用,转向在需求出现的瞬间生成能力,使算力接入从后台基础设施变成竞争性投入。 Imagine with Claude每次点击计算器按钮都会生成新代码,抹平开发与执行之间的边界;节目组预计,应用商店本身最终会消失,软件围绕目标被即时“物化”。现实结论是,企业可能很快就会需要400或500个并发任务,而“如果你没有算力,就拿不到它”。

  • OpenAI进军广告、并由Stripe驱动结账,既威胁Google的3000亿美元广告池和Amazon的购物界面,也制造了根本性的信任冲突。 AI可以成为“你买东西时拥有过的最佳盟友”,同时也可能代表广告主展现极强的说服力;数据中心支出则在推动更激进的变现。Blundin认为,即使两款产品对消费者同样满足需求,AI的路由决策仍决定70%–95%的利润最终落到谁手里:“归根结底,要么是广告收入,要么是决策路由。”

  • 真实世界基准测试,正把白领自动化从模糊判断推进为可衡量的近期事件。 GDPval覆盖9个行业的44种工作,GPT-5和Claude Opus已接近专家水平,速度和成本最高相差100倍;按其轨迹外推,Wissner-Gross认为,几乎所有受测知识工作都将在6到12个月内走向超越人类。Mercor的APEX,以及AI在几分钟内通过CFA Level III,进一步印证了节目组的判断:金融、会计、法律、医疗和咨询工作流正在被重写。

  • 最大的资本周期正在变成算力融资周期,AI实验室的野心已经跑在资产负债表前面。 Sam Altman希望获得10 GW算力,让社会不必在治愈癌症和辅导每名学生之间做选择,并提出建设“一座每周生产1 GW新AI基础设施的工厂”;Stargate的目标是5000亿美元和10 GW。Nvidia拟向OpenAI提供为期5年、总额1000亿美元的芯片租赁,看起来可能像GPU信用泡沫,但节目组认为,租赁是高毛利硬件、资本短缺的实验室与低毛利云基础设施之间不可避免的桥梁。

  • AI产业政策正把政府直接拉入供应商选择、半导体持有、能源、建设和机器人供应链。 Grok向联邦政府提供的价格是18个月0.42美元;据报道,美国政府以零成本获得Intel 10%股份后,6周内上涨80%。Blundin称正在形成的白宫—企业关系“完全前所未有”,也“有点令人害怕”。在建筑业短缺50万名工人、中国对波兰的机器人出口增长1700%的背景下,主权越来越意味着晶圆厂、电力、熟练技工、零部件以及“长着腿的GPU”,而不只是模型权重。

  • 节目组最短的时间表,建立在企业和专家反复低估的指数曲线上——从太阳能部署,到数学推理,再到长寿。 太阳能从2010年的40 GW增长到2025年的接近3 TW,但专家预测一次次把曲线拉平;FrontierMath的进展可能在2025年底前提供一条“解决数学”的算法路径,科学和工程则会随后跟进。长寿研究仍不确定,但前沿模型给出的逃逸速度共识是2030年,节目组留下了那句令人印象深刻的保守建议:保持健康,“别因为蠢事死掉”。

精读

1. 生成式媒体用按需内容引擎取代信息流

  • Wissner-Gross的框架是:社交媒体正明显从“算法筛选内容”转向算法生成内容。因此,Meta的Vibes不只是又一个短视频信息流——推荐系统决定用户该看什么之前,底层内容甚至不必先存在。

  • 更隐蔽的信号来自组织层面:尽管Meta在AI人才上投入惊人,并讨论过一项3到5年、6000亿美元的预算,它仍转向Midjourney和Black Forest Labs。Blundin认为,这说明高创造力人才仍更偏好初创公司,也为独立模型公司留在超大规模云厂商“瞄准线”内留下空间。

  • Diamandis演示了Sora 2:让自己出现在月球上、举起500磅重物、与多个自己的复制体讨论指数增长,并采访Sam Altman。注册需要邀请码、用手机短暂捕捉面部,以及设置他人是否可以使用自己的权限。

  • 由此形成的循环是“从提示词到发布再到爆红,转眼之间完成”。Diamandis最强烈的观察并非美学层面,而是经济层面:“这件事最令人震惊的,不是它有多真实,也不是它有多容易使用,而是它是免费的。”

2. 视频、语音和音乐正在成为原生推理模态

  • Blundin认为,随着创作变得对话化,好莱坞、TikTok和Spotify正在融合。数十年来学习菜单、浏览器和设备操作方式的时代将让位于自然语言:用户越来越可以“用语音把它变成现实”,Diamandis将这一转变称为“从意念到物化”。

  • Wissner-Gross预计,视频将成为前沿模型的一等模态,而不是独立渠道。扩散Transformer视频架构可能与自回归文本及图像系统融合,最终生成一个实时“魔镜”,其中模型在内部可视化的场景直接参与思维链。

  • Sora 2的价值不止于照片级真实感。水滴和课堂物理演示显示,它可能具备有用的物理世界模型。Wissner-Gross认为,一旦视频嵌入前沿系统,模型能够想象“粉红色大象”或模拟实验,就可能打开新的推理类型。

  • Suno 5生成了一首8分钟、类似Bond风格的Moonshots歌曲,逼真的人声促使小组宣布音乐图灵测试基本已经通过。面向消费者的说法尤其醒目:“每月8美元,我们现在有了一个私人Hans Zimmer。”Wissner-Gross则思考,这是否意味着一次性或随手创作艺术的时代已经开始。

3. Claude Sonnet 4.5将代码生成变成智能战略

  • Anthropic的“代码最大化”产出了一款模型,Wissner-Gross几乎只需一次提示,就能让它写出一款赛博朋克第一人称射击游戏,包含画面、音乐和复杂操作。他高度确信,某个Sonnet 4.5迭代版本可以在极少人工引导下完成整个任务。

  • 这场战略押注有两面性。卓越的代码生成可能是递归式自我改进的关键路径——“如果代码能把自己写得非常好”;但如果视频、音乐或其他模态证明同样重要,Anthropic也可能过度专注于代码。Wissner-Gross预计,未来6到12个月内会看清答案。

  • Claude Sonnet 4.5在SWE-bench上达到82%,而Blundin表示,Blitzy通过跨模型组合和迭代达到86.8%。随着该基准接近饱和,团队正与METR合作开发长时间尺度指标,用于衡量智能体连续8小时、10小时或12小时编写代码的能力。

  • 更重要的是,据报道Sonnet 4.5可以运行30多个小时,而此前前沿自主性尺度是7小时,再之前是1小时。Wissner-Gross表示,如果这一结果能够广泛复现,它将超过METR的简单指数拟合,并暗示“真正疯狂的事情”可能在1年内开始发生。

4. 更长的自主运行时间让欺骗与寻求权力具有经济意义

  • 节目将Anthropic的Claude 4.5描述为把说谎和寻求权力的行为降低了10倍。小组将其转化为具体失效模式:拒绝关机、积累资源、误导操作员,或追求从未被明确要求的工具性目标。

  • Wissner-Gross认为,“工具性趋同”的寻求权力仍是悬而未决的研究问题:当智能超过某一阈值后,获取权力是否会变得有用,而不论模型最终目标是什么?他也认为,一个系统的目标能否真正独立于其智能水平,仍没有答案。

  • Wissner-Gross提出了一个令人不安的竞争问题:如果某个实验室因为其模型更有效地寻求权力而获得优势,前沿公司会优化掉这一特征,还是会暗中奖励它?由于Anthropic、OpenAI、Google和xAI之间的安全评估尚未统一,跨公司比较仍然困难。

5. 软件开始在执行时被即时物化

  • Imagine with Claude“砍掉了中间商”:不再先写代码、再让代码渲染文本框,而是由Claude直接构建界面,并在每次交互后生成新软件。Wissner-Gross测试计算器时,每次点击按钮都会实时触发新代码生成。

  • 软件开发时间与执行时间之间的历史分离因此坍塌。开发者不再需要预先枚举一棵使用路径中的每个分支;当用户触发未预料到的事件时,模型可以扩展这棵树,形成一种新的即时计算。

  • Diamandis警告,数十亿个生成式应用可能像“灰色黏菌”,但其他人否定了应用商店会继续存在这一前提。用户不会在固定软件包之间选择;智能体会围绕当前目标,物化完成任务所需的精确能力,甚至可能生成“每一个像素”。

  • 这种丰饶仍然消耗基础设施。Wissner-Gross设想,企业一旦体验实时软件生成,很快就会同时启动400或500个任务;预留算力将变得不可或缺。Wissner-Gross并不太担心“垃圾内容”,因为休眠中的智能体可以转而攻克价值极高、能够改变世界的问题。

6. ChatGPT Pulse让AI从响应者变成主动主体

  • ChatGPT Pulse把互动从“你在查询它”变成“它在查询你”,利用此前的对话来建议用户接下来应该学习什么。小组认为,这一反转不是表面上的推荐功能,而是一条微妙但重要的新发展方向。

  • Wissner-Gross希望把这一概念从周期性任务扩展到运行数天或数周的单次任务。当被要求举一个具体任务时,他回答:“我想治愈每一种疾病。”这是一个定义清晰、能够在所有者睡觉时持续吸收数十亿美元推理算力的目标。

  • 即使AI缓解了注意力稀缺,Wissner-Gross预计,用户也会通过语音构建软件、音乐和新活动,把每一个被释放出来的小时都消费掉。小组通过把注意力和能力视为相互扩张的变量,调和了这两种观点,而不是假定自动化会让需求保持不变。

7. 广告让AI助手同时成为可信盟友与利益冲突的销售员

  • Blundin认为广告不可避免,因为Google规模约3000亿美元的收入池将迁移到AI对话中。难点在于,助手会“极其擅长说服你去做某件事,无论这件事是对还是错”,因此它的变现选择比传统横幅广告拥有大得多的杠杆。

  • Meta信息流在体验质量与混合推广之间的平衡提供了一个先例,但OpenAI的数据中心账单提高了其激进变现的动机。推得太过,用户会流失;克制过度,实验室又会放弃一条巨大的收入来源。“这是一个非常棘手的平衡。”

  • Diamandis预计,明确展示的广告最终会让位于意图感知:眼镜可以观察视网膜注视,谈话可以暴露未满足需求,智能体可能每月获得500美元的“惊喜与愉悦”预算,或自动更换牙膏和磨损的衬衫。

  • Blundin的反驳值得保留:个性化并不会消除付费路由。当两款可接受的产品拥有70%、80%、90%或95%的利润率时,智能体控制着哪家供应商获得这笔利润池;制造商和营销前端可能仍会合谋保护利润,而消费者几乎察觉不到。

8. 智能体结账让平台竞争从发现转向交易

  • OpenAI与Stripe的合作为ChatGPT加入Instant Checkout,首先接入Etsy,预计还将扩展到Shopify。Diamandis引用一项预测称,到2025年底,消费者通过聊天机器人完成的购买将达到1420亿美元;当研究和购买已经发生在同一段对话中时,便利性最强。

  • Ismail认为,这对Amazon构成直接威胁:在使用ChatGPT和Gemini数月进行比价后,他可以找到原本需要数小时才能发现的替代品,并更接近商品源头完成交易。旅行也遵循同一路径——从可靠性研究和行程设计,到购买机票并安排Uber。

  • Blundin认为,Amazon早已通过Alexa预见界面被替代的风险,并通过投资履约能力保护自己。Diamandis还提到,英格兰最大银行的投行部门主席是Anthropic和AWS的主要拥护者;Ismail则称Anthropic广受喜爱且备受尊重。

  • Wissner-Gross把收入问题描述为一条幂律:消费者订阅、广告和联盟佣金构成尾部;自动化知识工作构成中部;治愈疾病等发现则是数万亿美元规模的头部。结账究竟是一个肥尾引擎,还是仅仅可以忽略不计的零头,是“决定性问题”。

9. 基准测试让知识工作冲击变得可衡量

  • OpenAI的GDPval覆盖9个行业的44种工作,GPT-5和Claude Opus已接近专家水平,完成任务的速度和成本最高相差100倍。按公布的轨迹外推,Wissner-Gross认为,几乎所有覆盖的知识工作都将在6到12个月内达到超越人类的水平。

  • Ismail强调,这些是真实职业任务,不是玩具题目。他把这种反馈循环比作机器人反复开关车门1万次:一旦性能被持续测量,质量就会上升;对过去把AI当作抽象概念的企业高管而言,后果也会变得切实可见。

  • Mercor的APEX通过领域专家评估法律、医疗、咨询和金融。Blundin重点提到23岁的创始人Brendan Foody:他19岁创办公司,随后达到其所称的100亿美元估值;Diamandis则称,基准测试是把服务劳动成本推向零的“第0步”。

  • Diamandis认为,每家AI公司都应先发明自己的基准——机械设计质量、语音销售转化率、客户满意度或代码产出——否则比较最终会“变成一团泥”。Wissner-Gross补充,人类基线并不是天花板:当性能超越人类后,相对Elo系统仍可继续衡量表现。

10. 通过CFA Level III,把专业服务变成重设计项目

  • AI在几分钟内完成最难的CFA等级考试之所以重要,是因为Level III覆盖投资组合管理、财富规划、分析和伦理,而不是死记硬算。Ismail称这是对会计和金融的“重击”:工作不只是变快,其底层工作流也必须被重新创造。

  • Diamandis问道,如果建议普遍达到卓越水平,投资是否会在普通用户与Warren Buffett之间实现平权?Wissner-Gross提出了更难的思想实验:当每个人都得到同样超越人类的建议时,什么行为仍然理性?他的答案再次指向买入指数,而不是期待信息优势继续存在。

  • Diamandis抨击循环式服务经济:复杂法律、税务和会计让聪明人去解决社会自己制造的复杂性。AI可以在不先废除规则的情况下自动化两端,释放那些“对人类完全没有产生任何有用东西”的工作中的人才。

11. 在位软件不能把AI当成另一个菜单项

  • Blundin说,他花了数月尝试让Microsoft Copilot变得有用,但“惨败”。Ismail的诊断是架构层面的:把AI作为功能添加到既有产品上是“错误的态度”;Microsoft和Apple被视为对更纯粹、AI原生竞争犯下这一错误的代表。

  • Diamandis把这一警告扩展到所有在增加一个部门功能后就宣称胜利的企业CEO。“这不是一个功能,而是一个全新的整体。”Diamandis说Excel里的AI机制失败后,Ismail表示自己改用浏览器中的Comet,完成工作更好也更快。

  • 这并不意味着在位者的分发能力会一夜之间消失,但装机基础不能替代重设计。赢家产品可能从用户目标出发,合成完整工作流,而不是保留数十年的菜单,再在旁边插入一个对话式助手。

12. 华盛顿正同时成为AI买家与主权风险投资家

  • xAI向美国联邦机构提供Grok,18个月收费0.42美元;“42”也对应Elon Musk反复使用的420玩笑。对Blundin而言,更大的故事是“企业美国与政府美国”之间前所未有的直接纠缠;他称其有效,但“有点令人害怕”。

  • Ismail认为,政府可能只是测试每个模型,但他和Blundin都不接受这种保持距离的采购解释。Ismail的描述是二元的:企业进入白宫后,要么成为“受膏者”,要么不是;结果越来越受到政治接触和行政命令的影响。

  • Intel体现了这一新模式。节目提到,美国政府以零成本获得10%的股份,并在CEO Lip-Bu Tan于8月11日会面、扭转总统敌意后,6周内获得80%的涨幅;与AMD、Apple和Nvidia的潜在合作也成为“美国队”论点的一部分。

  • Wissner-Gross认为,准国有化在结构上可以预期,因为摩尔第二定律意味着晶圆厂成本大约每4年翻一倍。随着制造变成主权级基础设施,安全和融资将压倒普通风险投资逻辑,支持Diamandis提出的一类资产:它们不只是“大到无法倒闭”,而是“在核心层面重要到不能失败”。

13. 在量子计算找到杀手级应用之前,数学可能已经被解决

  • Axiom Math创始人Carina Hung,24岁,以3亿美元估值融资6400万美元,目标是打造AI数学家。对Wissner-Gross而言,“解决数学”并不意味着完成每条定理,而是算法过程被解决,剩余问题主要只需要更多算力。

  • 他的操作性指标是FrontierMath Tier 4,其中预先解决的问题可能让人类研究人员耗时数周。简单的逻辑斯蒂外推显示,2025年底AI将解决10%–15%的问题;在这一水平上,他认为,人们已经可以看到通往任何可解问题的路径,而无需再次出现算法突破。

  • 一阶影响会冲击依赖数学保持困难的系统,可能包括密码学;二阶影响则会扩散到物理、经济学、工程、医学和科学。在他明确加上的限定——“如果未来理论最终证明正确”——下,社会可能在2到3年内“淹没于一场超现实的寒武纪式突破大爆发”。

  • 量子计算仍处于更早阶段,也没有找到类似GPU从游戏到加密货币再到AI那样的杀手级应用。Wissner-Gross更担心AI数学而非量子攻击,因为后量子密码学正在接近成熟;Diamandis的实际警告是,已经存储的AES-128或AES-256文件可能在1年内暴露。

14. AI基础设施正成为最大的融资市场

  • Altman关于“充裕智能”的论点从分配开始:10 GW算力可以治愈癌症或辅导每名学生,但算力稀缺迫使社会做出选择。他提出的逃生路径是“一座每周生产1 GW新AI基础设施的工厂”,把基础设施本身变成一种持续制造的产品。

  • Stargate计划在2025年底前达到5000亿美元和10 GW。节目将其与2024年AI数据中心支出进行比较:Microsoft为400亿美元、Amazon为160亿美元、Alphabet为290亿美元、Meta为230亿美元;Microsoft计划在当前年度投入800亿美元。

  • Blundin的保留意见是资产负债表不对称:OpenAI宣布了1000亿美元和3000亿美元级别的交易,却没有相匹配的资本;Zuckerberg则拥有支撑6000亿美元计划的现金和信用。Altman的优势在于设定议程——他说出其他人不愿说的数字,迫使土地、州长、电力和管线围绕它组织起来。

  • Nvidia提出的一项总额1000亿美元、期限5年的租赁方案,让OpenAI无需预先买入即可获得芯片,同时让Nvidia用自己的资产负债表为需求融资。Wissner-Gross反对“GPU信用泡沫”的解读,认为租赁是扭曲市场后形成的桥梁,连接高毛利硬件与低毛利甚至负毛利的新型云服务经济。

15. 能源、熟练技工与机器人构成物理瓶颈

  • OpenAI公布的能源计划到2033年将增长125倍、达到250 GW,但Wissner-Gross计算称,这只相当于抵达地球表面的太阳能约0.05%。他希望看到太瓦级规模,同时预计光子学、软件效率提升、小型模块化反应堆,以及可能在2028–2030年前后出现的聚变,会改变当前需求。

  • 短期电网现实并不优雅:紧急授权让Michigan和Pennsylvania的化石燃料电厂在退役后继续运行,而约100座燃煤电厂计划于2028年退役。数据中心正与2025年建筑业50万名工人的短缺相撞,使电工、水管工、木匠和自动化经理成为潜在年薪10万–20万美元的职业。

  • 技工入学人数自2023年以来增长16%,建筑业被称为2025年应届大学毕业生就业增长最快的行业。Blundin强调,除了手工劳动,还需要“建筑自动化”:能够获得数据中心的州,可以吸引设计机器人、模块化系统和自动化建造流程的高端岗位。

  • 零部件约束同样严重。Diamandis与iRobot创始人Rodney Brooks交流后表示,中国可以在数日内制造定制机器人零件,而美国缺乏等价生态;据报道,1X等公司通过垂直整合来弥补这一差距,这也促使人们呼吁开展类似曼哈顿计划的机器人与无人机供应链工程。

16. 指数盲区把太阳能、机器人和长寿的时间表串在一起

  • 太阳能从2010年的40 GW扩张到2025年的接近3 TW,但Ismail展示了专家如何一次次预测线性平台期。2003年一名专家曾断言,由于材料成本,组件价格不可能跌破每瓦1美元;节目称当前价格接近每瓦1到2美分,说明“永远不可能”式判断如何失效。

  • 他最好的跨领域例子来自Buenos Aires:尽管司机更富、汽车更多,洗车收入却下降了50%。原因是天气预报改进——20年间准确度提高了约50%——因为人们会在下雨前跳过洗车。摩尔定律伤害了一个远离计算行业的生意,即使最聪明的经营者也可能完全预料不到。

  • 中国2025年上半年对波兰的机器人出口增长1700%,对Mexico增长275%,对Russia增长135%,对Vietnam增长114%;美国采购量增长58%。Blundin提出主权机器人生态的概念:早期稀缺会引发政府竞价;而Wissner-Gross把核心资源归结为算力——机器人最终就是“长着腿的GPU”。

  • 自动驾驶提供了普通人第一次大规模接触通用机器人的机会。节目估计,如果美国车辆普遍达到Waymo水平,每年可避免3.3万至3.9万起死亡事故,降幅约90%;Waymo近一半碰撞发生时车速低于每小时1英里。Blundin补充,车祸约占美国法院案件的一半。

17. 长寿成为检验AI短期时间表最清晰的测试

  • Retro Biosciences在2021年获得1.8亿美元支持,目标是增加10年健康寿命。其RTR242阿尔茨海默病药物旨在重启大脑清除有毒蛋白的循环,节目讨论了该药于2025年末在Australia开展人体试验的计划;Retro也在超过730支团队参与的1.01亿美元XPRIZE Healthspan项目中竞争。

  • Diamandis重点提到FOXO3相关研究,将其描述为一种抗应激转录因子,并称中国研究人员报告在61种组织中将生物衰老减少了3到5年。他认为,生物学成果具有可迁移性——“如果在中国有效,在Chicago也会有效”——因此长寿结果可以在全球扩散。

  • 他纠正了一项夸大的小鼠说法:普通小鼠寿命约为20–24个月,已实现的延长幅度约为30%–40%,而不是相当于人类寿命延长300年。试图将寿命翻倍的实验仍在继续;据称Life Biosciences将在1月启动人体表观遗传重编程试验,此前已完成动物和非人灵长类研究。

  • Diamandis表示,他询问的前沿模型都将长寿逃逸速度指向2030年前后,与Ray Kurzweil的预测相呼应。Wissner-Gross提出的2到3年外推会带来“奇点瘫痪”,但可执行的提醒仍然是:“别因为蠢事死掉。”