先锋 趋势 方法 投研 作者
(预告)智能体全解:Dots 登场、Google 与 Apple 之问、Muse 后续、超级智能与天命
返回节目精读

(预告)智能体全解:Dots 登场、Google 与 Apple 之问、Muse 后续、超级智能与天命

摘要

  • OpenAI 推出 Dots,暴露出产品定位错位:它看起来像一款友好的大众消费产品,实际却是一个用途狭窄、尚未完成的生产力智能体。 Andrew 称其结果“混乱且令人困惑”;Ben 认为它补上了 Codex 所需的协调层,却又觉得 Dots “莫名被阉割”,甚至不了解自己手头的真实项目。
  • Gemini 3 发布后,Ben 基本放弃了 OpenAI 在消费市场的前景,但 Amazon 可能给这家公司带来另一条变现路径。 OpenAI 可以成为 Amazon 产品和广告的智能体入口:“使用我们的产品,没问题;同时你也会看到我们的广告。这就是交换条件。”
  • 消费级智能体应该被当作止痛药来销售,而不是“内卷生活方式”的配件。 Ben 的说法是,它们应该成为“现代版 Tylenol、现代版 Advil”:对普通人而言,科技已经变得令人痛苦,从大约700个应用,到登录、双重身份验证和设备迁移,处处都是负担。
  • 真正有效的智能体需要新鲜、任务专属的上下文和持久化的外部记录,而不是一段无限拉长的对话。 Ben 认为,当旧指令被埋在历史记录里时,百万 token 的上下文“很糟”;他偏好的系统会持续把信息记录下来,调取相关材料,并在任务方向改变时开启新线程。
  • Claude 和 Codex 目前在 Ben 的工作流中扮演互补角色。 Claude 是负责保留上下文的“幕僚长”,Codex 更适合执行定义清晰的项目;Andrew 的比喻是:“Claude 是枪管,Codex 是弹药。”
  • OpenAI 更大的错误,是在 ChatGPT、ChatGPT Work 和 Codex 的架构尚未趋同之前,就强行把它们塞进一个超级应用。 Ben 认为终点方向是对的,但“他们没有耐心”;智能体最终会胜过应用,因为用户可以直接说出想要什么,而无需先知道该怎么做,“它会赢,是因为它会更好”。

精读

1. Dots 登场,AI 西部荒野时代回归

  • Andrew 认为,这一时刻的象征是:OpenAI 宣布 Dots 后,SpaceX AI 买下 dot.com 域名,并将其跳转到 Grok 下载页面。Ben 欢迎这种恶作剧,认为这让科技公司公开嘲讽竞争对手的时代重新出现;当行业变成“一群各自守着小封地的垄断者”后,这种做法已经越来越难持续。

  • 听众 Steven 给出了更尖锐的发布点评:OpenAI 在消费者心智中占据90%的份额,却展示了一群“满身旧金山科技圈气息的科技父母”在做创业项目和副业,而不是帮助普通家庭处理日程安排、孩子的活动、与朋友叙旧、买菜或照顾父母。Andrew 认为品牌定位同样自相矛盾:讨喜的卡通角色和小写字母“d”传递出大众消费产品的信号,但实际演示的产品仍高度偏向生产力场景。

2. 消费级智能体应该消除痛苦,而非美化工作

  • Ben 承认自己“早就放弃了 OpenAI 在消费市场的前景”,尤其是在 Gemini 3 展现强势、而 OpenAI 仍没有广告模式之后。但 Amazon 可能从 OpenAI 作为其对外智能体业务入口这件事中受益,这让 Ben 的判断有所松动:OpenAI 可以调用 Amazon 的产品,同时展示 Amazon 的广告。

  • Andrew 家里的经历提供了一个小小的反例。他的妻子起初问,ChatGPT 已经能处理个人事务管理,为什么还需要 Muse;但试用2天后,“她现在已经是 Muse 用户了”。

  • Ben 的定位非常明确:“把它们包装成现代版 Tylenol、现代版 Advil。”智能体之所以重要,是因为日常科技产品让普通人感到痛苦,而不是因为智能体本身新奇;应用确实比此前的工具更好,但这并不意味着它们会成为最终界面。

  • 具体痛点是层层累积的:大约700个应用、记不清东西放在哪里、反复登录、双重身份验证,以及设备迁移。Ben 在迁移到 Max 的过程中半途放弃,因为一旦回退,就得重新经历同样的折腾:“太糟糕了。”

3. 智能体质量取决于上下文架构

  • Codex 的项目—线程结构几乎可以直接对应 Ben 电脑上的文件夹,因此当他明确知道自己要构建什么时,Codex 非常有效。它愿意丢弃失败方向、重新开启线程,反而是一项优点:把每个错误都带进后续推理,只会让之后的判断更加混乱。

  • Ben 对上下文窗口的态度转变值得注意。早期的假设是“上下文越大越好”,如今他的结论却是:“其实不是,那很糟。”长线程会把最初的指令埋起来,而能力更强的智能体会持续记录状态、让当前上下文保持新鲜,只在需要时重新载入相关内容。

  • Claude 更擅长维持连续性,因此 Ben 把它当作覆盖服务器、摄像头及其他项目的“幕僚长”,再把定义清晰的执行工作交给 Codex。他会让智能体把信息写进 .codex 或 .claude 之外的普通文件,因为自己“对锁定非常过敏”。Andrew 总结得很到位:“Claude 是枪管,Codex 是弹药。”

4. Dots 识别出了真实的协调缺口,却没有填上

  • 从概念上看,Dots 像是 Ben 一直想要的总协调人,负责统筹他的 Codex 智能体;但实际使用中,“Dots 有点糟糕”:它忽略了他的项目,发现了一个日历插件,然后死盯着10月14日的冲突不放,引发了两句质问:“你是怎么知道的?”以及“这不是我需要你帮忙的事。”

  • Dots 甚至没能识别 Ben 自定义的 Codex 权限文件,也不知道文件在哪里,直到 Ben 明确指给它看。这让它同时表现出两种问题:对无关信息过度介入,却不了解本应协调的工作。

  • 相比之下,Spaces 很像 Ben 独立为 Gecko 搭建的系统:卡片保存事项的历史和附件,其中包括一份可以直接进入编辑环节的访谈文字稿。界面甚至可以保持轻量——点击 Done 只会向 Gecko 发送一条提示词,后续记录整理由智能体完成。

  • 问题在于,许多组成部分的想法本身“说得通,而且非常酷”,但没有一条组织主线,能让用户弄清 Dots、Spaces、Pages、定时任务、ChatGPT Work,以及本地与云端执行之间的关系。算力约束又进一步放大了这种错位:Dots 本可以帮助更广泛的用户,却在最初只对 Pro 层级订阅者开放。

5. OpenAI 的超级应用愿景早于底层基础设施成熟

  • Ben 认为,所谓“最大的原罪”就是超级应用。ChatGPT 在新开对话之间没有状态延续,ChatGPT Work 运行在 VM 中,Codex 则运行在本地电脑上;在这些架构仍然不同的时候强行合并, “无论从架构还是概念上都说不通”。“他们的愿景是对的,但他们没有耐心。”

  • 这个终点方向仍然让 Ben 信服:用户应该直接说出自己需要什么,而不是先搞清楚哪个应用、网站或工作流可以完成这件事。Ben 认为,智能体会胜出,是因为使用体验会更好,而不是因为极客偏爱它们,也不是因为经济有此要求。Andrew 则认为,这种优势本质上源于其他科技产品都太糟糕。预告在一位听众提出质疑时戛然而止:当需求增长并不会改善产品、切换成本又结构性偏低时,消费级智能体是否可能形成赢家通吃?