先锋 趋势 方法 投研 作者
返回先锋
Chinese Characteristics
研究员 1 场深度对话收录

Chinese Characteristics

观点集合

Nathan 赴华——第2部分:中国特色的 AI 安全

  • 🗓️ 日期2026-08-02 | 🎙️ 节目:The Cognitive Revolution

中国已部署AI的安全防护落后美国,但差距很大程度源于OpenAI和Anthropic主导美国平均水平;中国高校与企业的安全论文已增至每月约50-60篇。开放权重仍是关键分歧:北京监管服务并相信能在国内收回发布,但Nathan担心能力差距约9个月时,境外生物与网络风险可能变得不可逆。

查看访谈对话精读提要
  • 中国目前已部署 AI 的安全防护落后于美国,但表面上的差距很大程度上是 OpenAI-Anthropic 效应,而非文明层面的鸿沟。 Nathan 估计两国各有约 10-12 家接近前沿的开发商;如果剔除“Openthropic”,美国剩余公司的水平与中国同行重叠度会高得多,Gemini 也只是小幅领先。Concordia AI 的评估得出了相同结论:以美国专有模型为主的模型大多位于或高于“45度线”,以中国开放权重模型为主的模型则往往位于其下方。

  • “中国不在乎安全”“中国永远不会放慢速度”的说法,同时被政策和先例所否定。 据报道,北京在 2023 年曾因制定标准,暂缓了许多国内聊天机器人约 6 个月的上线;如今,CAC 可以要求服务在进入备案清单前接受地方和全国层面的审查。中国还针对推荐算法、零工平台、儿童游戏和 AI 伴侣出台过高成本监管措施,这表明当国家认为有必要干预时,会把企业增长置于其后。

  • 中国 AI 安全正通过大学和企业快速扩张,走的不是美国那种无需许可的非营利生态路径。 Concordia 统计显示,相关论文数量已从 2023 年每月仅几篇,增至 2026 年年中每月约 50-60 篇;美国或英语圈的估计则是每月 50 篇到几百篇不等。研究覆盖自我复制、评估造假、欺骗、机制可解释性、多模态攻击和危险能力隔离等方向;Nathan 的结论是:“AI 安全已经在中国扎根。”

  • 中国围绕 AI 安全的核心风险讨论,已经从审查转向能够在数字系统、最终甚至物理系统中采取行动的智能体。 一家大型科技公司坚持称自己“确实在乎 CBRN 风险等灾难性风险”,并表示有一个智能体每天生成美国 AI 安全讨论的报告。Xi Jinping 在 WIC 的讲话同样呼吁加快防范“失控”、防止恶意使用,并让 AI“处于人类控制之下”——在 Nathan 能找到的知名美国官员表述中,没有比这更强调安全的说法。

  • 最大的未决分歧在开放权重:中国监管服务,并相信自己能够把放出的精灵重新装回瓶子;西方安全分析则强调模型权重一旦全球释放,后果不可逆。 中国受访者认为,拥有 2.88 万亿参数的 K3 不可能直接在心理状态不稳定者的笔记本电脑上运行;严肃推理需要大量硬件和基础设施。这套逻辑在中国的监管边界内或许成立,但 Nathan 担心,一旦权重进入北京无法控制的司法辖区,它低估了境外生物和网络风险。

  • 随着中国能力追赶上来,监管差距可能收窄,因为企业似乎预期标准会与模型能力同步抬升。 Nathan 认为,能力差距最可信的中枢约为 9 个月,并指出 Claude 4.5 Opus 是智能体真正开始有效工作的分水岭。中国实验室如今也在发布智能体真正能够工作的模型。他的条件式预测是:当中国监管者遇到 OpenAI 和 Anthropic 目前正面对的那些失效案例时,会收紧要求,已部署的安全防护将“显著”趋同。

  • 中国在概念层面最大的缺口,或许是以品格为基础的对齐,而不是按规则服从。 中国 AI 告诉 Nathan,孔子的后裔据称历经 79 代仍自认是其后人,并举行仪式纪念孔子,这启发他追问:儒家宪法能否让价值观穿越递归生成的 AI 世代。然而研究者告诉他:“我们都是工程师”;当前生态强调明确规则和可靠服从,以智慧传统为基础的对齐领域“基本还是一片处女地”。

  • 🔗 原始收听与视频来源: Nathan 赴华——第2部分:中国特色的 AI 安全

收听完整访谈 →