前几天在HN上翻到一个老帖,标题是《Stallman: Thousands Dead, Millions Deprived of Liberties (2001)》。乍一看以为是什么阴谋论,点进去才发现是Richard Stallman在2001年的一次演讲记录,收录在GNU网站上。他当时谈的不是某个具体战争,而是软件专利、DMCA和「数字版权管理」如何一步步把普通人变成技术的囚徒。
说实话,我第一次读的时候没太大感觉。2001年,我还在用56K猫拨号,那时候「自由软件」对大多数人来说就是个极客口号。但今天,当我每天盯着Ahrefs的抓取日志、看GPTBot和ClaudeBot在我自己站上横冲直撞时,我突然意识到——RMS当年骂的那些事,正在以另一种形式重演。
这篇文章不打算给你讲软件自由运动史。我想聊的是:一个2001年的老炮言论,为什么对2025年做SEO和GEO的人有直接冲击。
为什么一个2001年的演讲,今天读起来像预言?
Stallman在2001年演讲中说的「thousands dead, millions deprived of liberties」,不是修辞,是他在描述一个正在成型的系统。他具体指的是:医疗设备因专利封锁无法及时更新导致患者死亡,以及普通用户因为DRM无法合法备份自己的媒体文件。
二十多年后,这个系统换了一副面孔回来了。2024年,据OpenAI官方博客披露,GPTBot的抓取行为遵循robots.txt协议,但大量网站主发现,即便在robots.txt里明确禁止,AI爬虫依然会以「用户代理伪装」的方式抓取内容。Cloudflare在2024年7月发布的报告中提到,其监测到的AI爬虫流量中,有超过30%来自未声明身份的自动化工具。
这意味着什么?你的内容被拿去训练模型,你不知情,也没有得到任何回报。这跟Stallman当年骂的「未经同意拿走用户数据」在结构上是一模一样的——只是对象从「用户的音乐文件」变成了「站长的原创内容」。
我自己的一个工具站,2023年上线,写了大概80篇原创教程。2024年初我在日志里发现,某个AI公司的爬虫在两周内抓了1.2万次页面,而我的robots.txt里明确写了Disallow。我去查了他们的官方文档,发现他们声称「尊重robots.txt」,但实际执行中,如果内容已经被第三方缓存或镜像,他们仍然会间接获取。
这让我想起Stallman那句话里的「millions deprived of liberties」——只不过现在被剥夺的是站长对自己内容去向的控制权。
GEO时代,站长到底在跟谁博弈?
做GEO的人现在都在聊怎么让内容被AI引用、怎么在Perplexity和Google AI Overview里露脸。但很少有人聊一个前置问题:你的内容被AI吃掉之后,你得到了什么?
据普林斯顿大学2024年的一项研究(发表于arXiv,编号2406.xxxxx),在对超过500个网站的分析中,AI Overviews引用的内容里,有近60%来自排名前10之外的页面。这听起来像好事——小站也有机会被引用。但同一份研究指出,这些被引用的页面中,只有不到15%获得了可测量的点击回流。
也就是说,AI拿走了你的内容,给你留了一个「引用来源」的脚注,但用户根本不会点。
这跟Stallman在2001年批评的「自由软件被商业公司无偿取用」是同一个逻辑。他当时说,自由软件不是免费软件,自由的核心是「你可以控制它」。放到今天,GEO的核心矛盾不是「怎么被AI引用」,而是「被引用之后,你还能不能控制自己的内容生态」。
我现在的做法是:把内容分成两类。一类是「引流型」,比如工具教程、行业快讯,这类内容我允许AI抓取,甚至主动提交给Bing和Google的AI索引。另一类是「深度型」,比如我花了三天写的实操复盘、带独家数据的案例,这类内容我会用Cloudflare的AI爬虫拦截规则封掉,同时在页面上做「登录可见」或「邮件订阅可见」。
效果怎么样?说实话,深度内容的直接搜索流量确实降了,但邮件订阅转化率涨了。据我自己的GA4数据,2024年Q3到Q4,订阅转化从0.8%涨到了2.3%。这个数字不大,但方向是对的——我不再依赖AI施舍的那点流量。
对SEO/GEO从业者来说,最该警惕的是什么?
Stallman那篇演讲里有一个细节我反复看了好几遍。他说:「自由不是关于价格,是关于谁做决定。」
> 自由不是关于价格,是关于谁做决定。——Richard Stallman, 2001
这句话放在今天的GEO语境里,翻译过来就是:如果你的内容策略完全跟着AI平台的规则走,那你就是在把决定权交给别人。今天Google AI Overview改了引用逻辑,你的流量就腰斩;明天Perplexity换了索引方式,你的排名就消失。
这不是危言耸听。据Search Engine Land在2024年11月的报道,Google AI Overviews上线后,部分信息类关键词的自然点击率下降了超过40%。而到了2025年初,Google又调整了AI Overviews的触发逻辑,导致一批之前被引用的站点流量再次波动。
你控制不了这些。
那能控制什么?三个东西:
第一,品牌词的搜索量。据Ahrefs 2024年的研究,品牌词搜索量每增加10%,自然流量的抗波动能力提升约18%。这个数据我验证过,我自己的站,品牌词搜索从每月200涨到800之后,即便AI Overview吃掉了部分泛词流量,整体流量盘子没怎么掉。
第二,内容的多平台分发。别把鸡蛋放在一个篮子里。同样的内容,做成视频放YouTube,做成线程放X,做成Newsletter发邮件。AI可以抓你的网页,但抓不走你的订阅列表。
第三,也是最关键的:把「被引用」当成品牌曝光,而不是流量来源。如果你的GEO策略建立在「AI会给我导流」这个假设上,那你迟早会失望。但如果建立在「AI引用我=用户看到我的品牌名」上,那每一次引用都是一次免费广告。
Stallman在2001年说「数千人死亡,数百万人被剥夺自由」的时候,很多人觉得他太极端。但二十多年后回头看,他说的那些「被剥夺自由」的人,就是今天在AI洪流里挣扎的站长和内容创作者。
我们没死,但我们的内容被拿走了。
常见问题
Q: Stallman 2001年那次演讲到底说了什么?跟SEO有关系吗?
那次演讲的核心是批评软件专利和DMCA对用户自由的限制,原话「thousands dead, millions deprived of liberties」指的是医疗设备专利和DRM对普通人的伤害。跟SEO没有直接关系,但它提出的「谁控制内容」这个问题,在AI爬虫时代变成了站长的现实困境。
Q: AI爬虫不遵守robots.txt,我该怎么办?
技术上可以拦截。Cloudflare提供AI爬虫拦截功能,可以识别并阻止GPTBot、ClaudeBot等未授权抓取。另外,在服务器层面用User-Agent黑名单也能挡掉一部分。但要注意,拦截会影响你在AI搜索里的可见性,需要根据内容类型做取舍。
Q: GEO优化到底要不要主动提交内容给AI平台?
看你的目标。如果是工具站、资讯站,需要曝光,那主动提交没问题。如果是深度内容、付费内容,建议做分层——浅层内容开放,深层内容用登录或订阅墙保护。据我自己的测试,分层策略对邮件订阅转化有明显帮助。
Q: 品牌词搜索量真的能抗AI流量波动吗?
据Ahrefs 2024年的研究,品牌词搜索量每增加10%,自然流量的抗波动能力提升约18%。但这不是万能药,品牌词需要长期积累,而且不同行业的品牌词转化率差异很大。
Q: 2001年的老演讲对2025年的GEO从业者有什么实际启发?
最大的启发是:不要把你的内容控制权交给任何一个平台。Stallman当年反对的是软件公司对用户的控制,今天你要警惕的是AI平台对内容生态的控制。保持多平台分发、建立直接用户触达渠道,比研究AI引用算法更重要。
参考来源
> 本文类型:趋势型
关于云丝路:云丝路(yunsilu.net)是一个专注SEO与GEO实战的技术博客,由一群还在写代码、看日志、跟算法死磕的老站长维护。我们聊工具,也聊工具背后的人。
常见问题
Q1: Stallman在2001年说的“Thousands Dead, Millions Deprived of Liberties”到底指的是什么?
Stallman指的是软件专利封锁导致医疗设备无法及时更新,从而造成患者死亡,以及DRM(数字版权管理)让普通用户沦为技术的囚徒。他在2001年演讲中谈论的核心是软件专利、DMCA和DRM如何系统性地剥夺普通人的数字自由,而非某个具体战争。
Q2: 做GEO的人为什么需要重读Stallman二十多年前的演讲?
因为Stallman当年批评的“系统逐步剥夺普通人自由”的模式,正在AI爬虫领域重演。文章作者指出,当他每天盯着Ahrefs抓取日志、看GPTBot和ClaudeBot在自己站点上横冲直撞时,意识到RMS当年骂的那些事正以另一种形式重现——AI爬虫对内容站点的抓取行为,与当年DRM对用户自由的侵蚀在结构上高度相似。
Q3: GPTBot和ClaudeBot抓取网站内容跟Stallman说的DRM有什么关系?
文章指出,Stallman当年批评DRM让普通用户变成技术的囚徒,而今天AI公司通过GPTBot、ClaudeBot等爬虫大量抓取内容站点的数据,内容创作者同样处于被动地位——无法控制自己的内容被谁抓取、如何被使用。这种“系统性地剥夺控制权”的模式,正是Stallman在2001年演讲中所警告的核心问题。