Reddit 近期传出消息,正在评估是否限制谷歌对其内容的访问权限,特别是用于人工智能训练的数据。这一动态迅速在技术社区和内容生态领域引发热议。

实际上,Reddit 平台上丰富的讨论、问答及用户生成内容,长期以来都是训练大语言模型的宝贵资源。谷歌的 AI 模型(如 Gemini)此前大量依赖这些社区帖子进行学习。然而,如今 Reddit 似乎开始重新审视这一局面:自身数据被用于训练竞争对手的产品,而自己却无法获得相应回报,这样的合作模式是否可持续?
当然,目前仍处于“评估”阶段,尚未做出最终决策。但从市场信号来看,内容平台对 AI 爬虫的管控正迅速收紧。此前推特(X)已限制数据抓取,若 Reddit 跟进,AI 公司获取高质量网络语料的渠道将进一步受限。值得持续关注的是,谷歌与 Reddit 之间是否存在谈判余地,或者双方最终是否会转向“付费授权”模式——这或许才是整个行业未来面临的核心博弈。
