先锋 趋势 方法 投研 作者
给互联网设年龄门槛 + Cloudflare 对阵 AI 爬虫 + HatGPT
返回节目精读

给互联网设年龄门槛 + Cloudflare 对阵 AI 爬虫 + HatGPT

摘要

  • 年龄验证正成为互联网基础设施,但英国的落地显示,儿童安全政策很快就可能演变成隐私与言论监管体系。 《网络安全法》要求服务评估未成年人是否可能接触色情、自杀鼓励或进食障碍相关内容,并在风险达到一定程度时部署“高质量年龄保障”。该制度覆盖 X、Reddit 社区,甚至可能波及 Wikipedia。成年人可能需要提交身份证件、信用卡或面部扫描,才能访问过去“基本完全私密”的内容。

  • 绕过手段可能削弱安全收益,却保留监控成本。 超过400,000人签署废除请愿书,VPN成为显而易见的绕过方式,用户还用 Death Stranding 里表情丰富的游戏角色骗过面部识别。但这套模式仍在扩散:美国已有24个州通过年龄验证法案,最高法院也维持了得州针对色情内容占比超过三分之一网站的相关要求。

  • 真正关键的层面可能是保护隐私的年龄保障,而不是散落在全网的数千个身份数据库。 Apple 提议的 API 会把家长提供的年龄转换为匿名令牌,再交给开发者;Meta 希望由 Apple 和 Google 承担更多法律责任,而 Apple 则希望提供基础设施、同时不承担这类责任。Kevin Roose 预计,年龄门槛互联网访问将“某种程度上不可避免”,因此决定性竞争在于实现架构。

  • Cloudflare 表示,AI 已严重侵蚀互联网以流量换内容的交易。 Matthew Prince 的公司位于“超过20%的互联网”之前,他说,为内容带来流量的难度已接近10年前的10倍;对 OpenAI 来说是750倍,对 Anthropic 则是30,000倍。如果出版商无法通过名声、广告或订阅获得认可或收入,那么在750倍难度下已经“死了”,在30,000倍下则会被遗忘。

  • Cloudflare 7月1日默认拦截爬虫,是在制造 AI 内容市场所需的稀缺性。 Prince 的核心判断非常明确:“AI 公司必须为内容付费”,因为它们如今复制原作,却不再返还可变现的流量。他预计,定价会从类似 iTunes 的“一首歌99美分”模式,转向类似 Spotify 的订阅或收入分成;能否接入独特内容,将成为模型差异化的关键。

  • Cloudflare 可能同时成为执行层和收费市场撮合者,在带来机会的同时增加集中度风险。 出版商与 AI 的直接交易不会给 Cloudflare 带来收入;如果由 Cloudflare 谈判或促成交易,Prince 提出20%–30%的分成设想,而拦截和分析服务即使对小网站也保持免费。他承认一家覆盖20%互联网的公司同时扮演这些角色令人不安,但认为“任何市场的第一步都必须是制造稀缺性”。

  • HatGPT 的几则故事显示,AI 产品捕捉身份、言论和劳动的速度,已经超过社会规范的适应速度。 LeBron James 的律师挑战未经授权的合成视频;Sam Altman 警告,ChatGPT 的治疗对话不受法律保密保护;Amazon 的收购目标 Bee 会记录用户及其周围所有人的声音;Meta 将允许部分编程候选人在面试中使用 AI。Casey Newton 希望建立的底线很简单:用户应当看见、控制并删除系统留存的关于他们的信息。

精读

1. 年龄保障正在割裂曾经同质化的互联网

  • Casey Newton 将英国《网络安全法》描述为西方民主国家“监管在线言论最全面的尝试之一”。该法于2023年通过,要求服务评估未成年人是否可能接触色情、自杀鼓励、进食障碍或其他列明危害;如果评估发现相关风险,就必须部署“高质量年龄保障”,不能只依赖一个很容易核验的“我已满18岁”按钮。

  • 相关条款于25日星期五生效后,许多成年人毫无预警地发现,浏览内容可能需要驾驶证、信用卡或基于摄像头的年龄估算。Casey 担心的是,一个过去“基本完全私密”的访问,突然变成了与个人身份信息绑定的互动,而这些信息会如何存储、后续如何使用,都不清楚。

  • 监管范围远不止显而易见的成人网站。关于戒烟、苹果酒等看似与性无关主题的 X 和 Reddit 社区也面临限制;Wikipedia 警告称,隐私问题可能迫使它限制英国访问,而不是收集自己并不想要的信息。

  • Kevin 更大的判断是:过去大约40年里,一个13岁孩子和一个50岁成年人可以接触同一张信息网络;年龄保障可能按年龄把互联网拆分成实质不同的产品。真正的结构性变化不是色情网站被拦截,而是互联网出现了分裂。

2. 简单绕过手段削弱安全逻辑,法律却持续扩张

  • 公众反应“不是保持冷静、照常生活的局面”:超过400,000人签署了要求撤销政策的请愿书。VPN提供了最简单的逃生通道,用户可以伪装成身处英国境外,按另一司法辖区的规则访问服务。

  • 更尖锐的例子来自 Death Stranding。一些摄像头检测会要求用户微笑或皱眉,于是有人用游戏的拍照模式让主角做出这些表情,再把生成的图像交给验证系统。Casey 开玩笑说,年龄门槛引发的反弹可能会让它成为英国最畅销的游戏。

  • Ofcom 表示,这项法律“不是万能药”,但仍坚持年龄检查能阻止儿童随意撞见有害内容。整个交锋留下了核心错位:有决心的用户可以绕过门槛,普通成年人却仍要承担摩擦和隐私暴露。

  • 这股政策方向已经跨过大西洋。美国已有24个州通过年龄验证法,最高法院也维持了得州一项针对色情材料占比超过三分之一网站的规定。大法官 Clarence Thomas 的理由是,网站不像店员,“无法看着访客来估计他们的年龄”。

3. 设备级令牌可以保护隐私,但责任归属仍有争议

  • Kevin 为年龄门槛进行了最强辩护:酒吧会查验身份证,成人杂志过去也一直放在柜台后面。Casey 同意应当让未成年人远离成人内容,但反对让人反复披露敏感信息,甚至可能“余生都要”这样做。

  • Apple 提出的年龄保障 API 提供了节目主持人偏好的架构。家长在设备设置时输入孩子的年龄或生日;Apple 对其匿名化,再向应用发送一个令牌,例如表明用户是13岁。该功能当时尚未上线,但 Apple 告诉 Bloomberg,很快就会推出。

  • 这种设计能减少每个开发者掌握的信息,但没有解决谁来负责。Meta 推动州级法案,把验证义务更多转给 Apple 和 Google;Apple 则希望提供基础设施,却不愿在儿童触及受禁内容时承担法律责任。有人把 Apple 比作商场,把 Facebook 比作商场里的酒铺。

  • Kevin 反驳称,平台本来就会从行为数据推断用户年龄。YouTube 计划利用浏览和观看模式;此前报道也显示,Meta 知道 Instagram 上存在未满13岁的用户。澳大利亚转而考虑禁止16岁以下儿童使用 YouTube,说明“社交媒体”规则可以多快扩大。

4. Te 说明身份数据库如何放大泄露风险

  • Te 是一款让女性匿名分享与男性约会经历的应用,曾短暂登上 Apple App Store 榜首。据报道,注册需要扫描驾驶证,并通过自拍进行性别核验——这正是会让验证系统变成高价值攻击目标的集中式信息收集。

  • Kevin Roose 表示,据他了解,Te 在未能保护部分上传的验证材料后遭到黑客攻击,相关内容随后泄露。Matthew Prince 说,4chan 用户又拿到这些自拍,将其改造成“Hot or Not 风格的网站”和其他滥用项目。Casey 更广泛的教训是,不同服务商的安全能力参差不齐,因此敏感数据库越多,暴露面就会按比例扩大。

  • Kevin 的价值判断仍然相互拉扯。成年人应继续访问合法信息,但家长“已经被逼到绝境”,不知该如何让孩子接触智能手机和社交媒体;现有控制工具甚至可能要求家长变成“兼职 IT 人员”。不过,他仍认为更广泛的年龄验证不可避免,并希望在下一次“Te 式泄露”发生前先采用保护隐私的实现方式。

  • Casey 把这个问题放进他所谓的“持续6个月的言论权回收”中,与针对记者、学术界和广播媒体的压力并列。要求用户出示政府身份证件才能查看网站,可能并不会困扰所有人,但他认为这些限制“都是同一件事”,回头看时可能会显得重要得多。

5. AI 答案正在侵蚀搜索以流量换复制的交易

  • Matthew Prince 表示,Cloudflare 位于“超过20%的互联网”之前,因此能看到一项持续25年的隐性交易:出版商允许 Google 复制自己的内容,Google 则返还访客,出版商可以通过广告或订阅将访客变现。

  • Google 逐步改变了这笔交易。答案框开始直接展示事实,把用户留在 Google 内部,反转了创始人过去“让人迅速离开自己的网站”的自豪说法;如今 AI Overviews 会直接总结更多查询,用户无需访问底层来源。

  • Cloudflare 的对比非常刺眼:把流量吸引到一篇内容上的难度,已经接近10年前的10倍。Prince 认为,对 OpenAI 来说难度是750倍,对 Anthropic 是30,000倍,因为用户越来越多地消费衍生内容、跳过脚注,并开始信任不断进步的 AI 答案。

  • 在 Prince 的分类里,内容生产的动机包括自我满足或名声、广告、订阅,或几者的组合。既没有认可,也没有收入,生产就会停止:出版商在10倍难度下苦苦挣扎,在750倍下已经“死了”,在30,000倍下则会“被埋进地下、彻底遗忘”。他称这对互联网构成生存威胁。

6. Cloudflare 正在制造稀缺性,让内容拥有价格

  • Prince 没有声称知道最终机制,但他的起点判断非常明确:“AI 公司必须为内容付费。”搜索引擎用流量补偿复制;AI 系统复制内容,却几乎不返还流量,因此出版商已经没有理性理由继续免费开放访问。

  • 包括 Amazon 与 The New York Times 的协议、OpenAI 与出版商的安排在内,现有交易说明市场愿意付费,但双边合同留下了搭便车问题。“Sam 不可能在 OpenAI 当冤大头”:一家企业不能购买授权内容,同时看着竞争对手以零成本抓取同一批作品。

  • 因此,Cloudflare 在7月1日宣布“内容独立日”,将参与网站的 AI 爬虫拦截设为默认,除非创作者主动选择开放访问或接受补偿。Prince 的市场逻辑很简单:“没有一定程度的稀缺性,就不可能有市场。”

  • 定价还会不断迭代。他把初期固定费率比作 Apple 的 iTunes“一首歌99美分”模式,而后者最终让位于 Spotify 约“每月10美元”的无限量订阅。最终形态可能是固定费率、订阅或收入分成,而不一定真的是按爬取次数付费。

7. 强制执行的网络控制,让 robots.txt 请求产生后果

  • Prince 把 robots.txt 比作限速标志:它传达请求,却没有物理执行力。而且它通常过于粗糙,只能广泛适用规则,无法让出版商区分具体内容、爬虫和商业安排。

  • Cloudflare 追踪到 AI 公司通过 Bing 缓存、Internet Archive,甚至能够返回页面描述的广告网络,寻找同一批材料。有些公司据称使用住宅代理来隐藏身份;Prince 说,最糟糕的行为看起来不像普通企业,更像“朝鲜黑客”,同时多次强调 OpenAI 的表现相对规矩。

  • Cloudflare 能执行这些规则,是因为客户流量经过一套为网络安全而建的网络。用于识别黑客的同一套系统,也能拒绝伪装爬虫访问:行为恶劣的机器人可以被送进“暂停区”,而与 Cloudflare 达成协议的 AI 公司则能获得高效、结构化的内容传输。

  • 预期中的控制面将足够细致。创作者可以授权 OpenAI、拒绝另一家爬虫,或者最终直接发布标准“价目表”,即使规模不足以单独谈判也能如此。Cloudflare 会把身份识别、拦截、分析和授权传输整合起来,而不是继续依赖爬虫的礼仪。

8. 内容交易所可能惠及长尾出版商,也让 Cloudflare 获利

  • Prince 说,出版商的回应带着明显的“欣喜”,反复按下“禁止访问”。让他意外的是,AI 公司大体接受“内容是驱动我们引擎的燃料”,因此必须付费——前提是 Cloudflare 能提供一个“公平竞争的环境”,防止不那么守规矩的对手免费拿走内容。

  • Google 仍然是关键变量。Prince 把它不断变化的交易比作“温水煮青蛙”:一项有益的安排,在 Google 持续留住更多注意力后,慢慢变成了惩罚。他希望说服能够奏效,同时也指出,全球范围的调查最终可能迫使 Google 合作。

  • Casey 希望可信出版物能进入深度研究产品,或许通过订阅者凭证实现,但 Prince 不愿把市场限制在大型出版商之内。未知网站也能生产有价值的原创内容,初创公司需要负担得起的输入;健康的交易因此需要“很多卖家和很多买家”,而不是只有大型媒体与 AI 企业之间的合同。

  • 如果是出版商自行与 OpenAI 达成的直接协议,Cloudflare 不会抽成。如果由 Cloudflare 谈判或促成交易,Prince 设想收取类似 Spotify 的20%–30%分成,不过具体数字尚未确定。拦截和分析仍将免费;Casey 说,即使 Platformer 只能收到80美元,只要由其他人找到买家,也可能值得。

9. 更好的激励机制可能重振知识,也可能把知识集中到 AI 巨头内部

  • 当被问及特朗普总统说对每篇文章或每本书收费“不可行”时,Prince 区分了政府强制定价与私人市场。他的理解是,政府反对澳大利亚或加拿大式的强制要求,而 Cloudflare 的杠杆来自技术:创作者获得补偿,否则就失去访问。

  • AI Labyrinth 提供了惩罚性的一端。Cloudflare 不只是拦截行为不端的爬虫,还可以把它送进无穷无尽的 AI 生成页面,“大规模污染他们的数据”。Prince 对那些在 GPU 上投入100亿美元的公司说,至少应该拿出一部分资本,去资助系统正在消耗的内容。

  • 他有意夸张的诊断——“当今世界所有问题最终都归咎于 Google”——针对的是激励设计。Google 教会出版商把流量视为“神”,Facebook 和 TikTok 又强化了注意力经济,创作者于是学会触发皮质醇和愤怒,而不是生产经久耐用的知识。

  • Prince 希望 AI 的需求能够付费给那些填补世界“巨大奶酪块”空洞的创作者。他眼中的“黑暗镜像”是:记者和研究人员只能成为5家强大 AI 公司的雇员,知识则被分割到不同意识形态和国家阵营中。他承认,Cloudflare 因位于20%的互联网之前而拥有单方面权力,并提到公司此前在大规模枪击事件后撤销对8chan 的保护;但他认为出版商正在消亡,必须采取行动,而“任何市场的第一步”都是稀缺性。

10. HatGPT 展示 AI 如何撞上肖像、隐私、招聘与言论边界

  • 据报道,LeBron James 的律师向 InterlinkAI 发出停止侵权通知,原因是其社区制作了未经授权的视频,描绘他怀孕、无家可归以及其他侮辱性场景,其中一些“带有种族主义色彩,糟糕透顶”。Casey 认为,就他所知,这可能是首批已知的名人反对 AI 公司滥用其肖像的案例之一,也预示着围绕同意和人格权的争议将不断增加。

  • Sam Altman 警告,类似治疗咨询的 ChatGPT 对话不享有法律保密保护,可能在诉讼中被提交。Casey 欢迎这一披露,但希望建立有关留存、画像和广告的规则:用户应知道聊天机器人存储了什么,能够查看它“知道”的内容,并删除相关记录。

  • Meta 将允许部分编程候选人在面试中使用 AI,Kevin 称这是对传统 LeetCode 测试的“Roy Lee 胜利”。他们的实际结论是,评估应当接近 AI 辅助下的真实工作。另一方面,Substack 的推荐系统推送了一份纳粹通讯后,Casey 觉得自己得到了验证——这正是促使他离开的放大风险,而 Substack 随后将该功能下线。

  • Amazon 的收购目标 Bee 制作一款手环,把日常谈话转录成可搜索的记忆和任务。Joanna Stern 的评价是“实用得令人印象深刻”,却“真的他妈令人毛骨悚然”;主持人质疑,是否值得牺牲佩戴者和旁观者双方的隐私,只为提醒自己买牛奶。较轻松的插曲包括用于捕捉偷猎者的热成像机器鹿,以及一只八哥把图像转换为声音、再转换回图像,充当有损存储设备。