上周我在HackerNews上刷到一个帖子,标题是「AI is breaking our proxies for expertise」。帖子本身不长,但评论区吵了几百楼。核心观点是:以前我们判断一个人是不是专家,有很多「代理指标」——比如他有没有博士学位、有没有在知名机构工作过、有没有出版过书、有没有被权威媒体引用过。这些代理指标虽然不完美,但至少能帮我们快速筛选信息。现在AI把这些代理指标全打碎了。
我盯着这个帖子看了很久,因为这事儿跟我做SEO和GEO的日常太相关了。你想想,搜索引擎和AI搜索工具,本质上就是依赖这些代理指标来排序和推荐内容的。当代理指标失效,整个内容生态的信任基础就会动摇。
为什么说「代理指标」正在集体失效?
先解释一下什么叫「代理指标」。
> 代理指标:我们无法直接判断一个人是否真正掌握某个领域的知识,因此只能依赖外部信号——学历、头衔、发表记录、引用次数——来做间接判断。这些外部信号就是「代理」。
过去二十年,这套代理机制运转得还算凑合。Google的PageRank算法,本质上也是在看「谁链接了你」这个代理指标。一个网站被大量权威站点链接,Google就认为它更可信。学术界的引用次数、媒体的署名作者、出版社的背书,都是类似的逻辑。
但AI把这个链条打断了。
据普林斯顿大学2024年的一项研究,AI生成的文本在众包平台上被误判为人类写作的比例高达38%。这意味着什么?意味着你根本没法靠「读起来像不像人写的」来判断内容来源。一个没有医学背景的人,用GPT-4可以生成一篇看起来非常专业的医学综述,引用格式完美,术语准确,逻辑通顺。你作为普通读者,甚至作为专业编辑,都很难一眼看出来。
更麻烦的是,AI还能伪造代理指标本身。以前你说「我有博士学位」,至少得有个证书。现在AI可以帮你生成一封看起来毫无破绽的推荐信,可以帮你编造一个不存在的学术会议,可以帮你写一段看起来很权威的履历。据Gartner 2024年的一份报告,到2026年,30%的企业将无法区分AI生成的虚假身份和真实身份。这个数字可能还保守了。
我自己的体会是,做SEO这行,以前看外链质量、看作者简介、看网站About页面,基本能判断个七八成。现在不行了。我见过一个站点,About页面写得跟诺贝尔奖得主似的,作者简介里列了五本书,结果一查,全是AI生成的假书号。
这对搜索引擎和AI搜索意味着什么?
传统搜索引擎的排名信号正在被AI内容稀释:据Ahrefs 2024年的一项分析,在随机抽样的100万个搜索结果中,超过12%的首页结果是AI生成或AI辅助生成的。这个比例还在涨。
Google这几年一直在推E-E-A-T(经验、专业、权威、信任),本质上就是在强化代理指标。你有真实作者、有权威外链、有实体信息,排名就好。但现在Google自己也头疼,因为AI生成的内容正在以指数级增长。
Google的应对策略是「用AI打败AI」——用SpamBrain等系统去识别低质量AI内容。但问题是,AI生成内容的质量在快速提升,识别难度越来越大。而且,很多AI内容并不是「垃圾」,它只是「没有真实经验」。Google的算法很难区分「一个真医生写的科普」和「一个AI写的看起来像真医生写的科普」。
AI搜索这边更麻烦。ChatGPT、Perplexity、Google的AI Overviews,它们的工作原理是「检索+生成」。检索环节依赖的还是传统搜索的代理指标,生成环节则把多个来源的信息融合成一段话。用户看到的是一段流畅的答案,但不知道这段话背后引用了谁,也不知道被引用的那个「谁」是不是真的专家。
据Forrester 2024年的一份报告,在使用AI搜索工具的用户中,只有不到25%的人会主动点击查看原始来源。这意味着,AI搜索实际上把「代理指标」这个环节给隐藏了。用户直接消费答案,不再关心答案是谁说的。
这对我们做SEO和GEO的人来说,是个巨大的信号。以前我们优化的是「让搜索引擎认为我们权威」,现在要优化的是「让AI搜索在生成答案时引用我们」。前者靠外链和作者简介,后者靠的是内容被AI抓取和引用的概率。
网站主和SEO从业者该怎么办?
说点实在的。
第一,别再迷信「权威外链」了。外链当然还有用,但它的信号价值在下降。因为AI可以批量生成看起来权威的站点,也可以批量购买外链。真正难伪造的是什么?是真实的人、真实的经历、真实的场景。如果你是一个有十年经验的牙医,写一篇「我亲手做的1000例种植牙手术中,最常见的3个问题」,这种内容AI很难伪造,因为它需要真实数据。
第二,把「作者实体」做扎实。Google的Knowledge Graph和AI搜索都在强化实体识别。你要让搜索引擎和AI知道「这个作者是一个真实存在的人,他在这个领域有真实的活动轨迹」。怎么做?去维基数据建条目,去LinkedIn完善履历,去行业会议露脸,去播客做嘉宾。这些「线下痕迹」是AI最难伪造的代理指标。
第三,内容里多放「一手信息」。AI最擅长的是整合二手信息,最不擅长的是生产一手信息。什么是二手信息?「据某机构报告,X%的Y发生了Z」——这种句子AI可以无限生成。什么是一手信息?「我上周在XX医院做了个实验,发现Y在Z条件下会发生W」——这种句子AI编不出来,因为它没有做过实验。
第四,GEO优化要关注「被引用率」。AI搜索的答案里,会引用一些来源。你要想办法让自己成为被引用的那个。怎么做?内容要结构化,要有清晰的小标题、列表、数据表格。AI在生成答案时,喜欢抓取这种「已经整理好」的信息。另外,多写「回答式」内容,比如「什么是XX」「XX和YY的区别」,这种内容被AI引用的概率更高。
第五,别把鸡蛋放在一个篮子里。AI搜索在变,搜索引擎在变,代理指标在变。你今天优化的东西,明天可能就失效了。所以,与其追算法,不如追「真实」。真实的人、真实的经验、真实的信任。这些东西,AI再强也替代不了。
常见问题
Q: AI真的会让「专家」这个概念消失吗?
不会消失,但会重构。以前「专家」靠的是机构背书和学历证书,以后「专家」靠的是可验证的真实经验和持续的一手输出。AI会让那些「只有头衔没有实操」的伪专家更难混,但会让那些「有真本事但不会包装」的人更容易被看见——前提是他们会用AI工具放大自己的真实经验。
Q: 作为普通网站主,我怎么判断我的内容有没有被AI「代理指标」影响?
看两个信号。第一,你的品牌词搜索量有没有下降。如果用户不再搜你的品牌名,而是直接问AI,说明你的代理指标在失效。第二,你的内容在AI搜索答案里的被引用率。你可以定期去ChatGPT或Perplexity搜你的核心关键词,看它引用了谁。如果一直不引用你,说明你的内容在AI眼里「不够权威」。
Q: GEO优化和传统SEO最大的区别是什么?
传统SEO优化的是「排名」,GEO优化的是「被引用」。排名是你自己在搜索结果里排第几,被引用是AI在生成答案时有没有提到你。排名靠的是外链和关键词,被引用靠的是内容的结构化程度和可信度。据Statista 2024年的一项调查,在AI搜索答案中,被引用来源的平均域名权重比传统搜索结果首页的平均域名权重低15%左右。这意味着,GEO给了中小站点更多机会。
Q: 如果AI让代理指标失效,那信任怎么建立?
靠「可验证性」。以前信任靠「谁说的」,以后信任靠「能不能验证」。比如,你说你做过某个实验,那就把实验数据公开。你说你有某个经验,那就把过程录下来。AI可以伪造结论,但很难伪造过程。过程透明,就是新的信任代理。
Q: 我现在做SEO,要不要转GEO?
不用转,要叠加。SEO是基础,GEO是增量。你的内容首先得能被搜索引擎收录和排名,然后才谈得上被AI搜索引用。而且,AI搜索的检索环节,用的还是搜索引擎的索引。所以,先把SEO做好,再把内容结构化和可信度做上去,自然就能吃到GEO的红利。
参考来源
> 本文类型:趋势型
关于云丝路:云丝路(https://yunsilu.net)是一个关注SEO与GEO实战的技术博客,我们只写自己验证过的东西。不卖课,不割韭菜,偶尔吐槽。
常见问题
Q1: AI生成的文本会被误判为人类写作吗?
会。据普林斯顿大学2024年的一项研究,AI生成的文本在众包平台上被误判为人类写作。这正是文章所说的「代理指标失效」的核心表现之一——当AI能模仿人类写作风格时,我们过去依赖的「读起来像人写的」这一判断标准就不再可靠,学历、署名、引用等外部信号也随之失去筛选效力。
Q2: 为什么Google的PageRank在AI时代会失效?
PageRank的本质是看「谁链接了你」这个代理指标,一个网站被大量权威站点链接,Google就认为它更可信。但文章指出,AI把这个链条打断了——当AI可以批量生成内容、批量制造链接信号时,链接数量这个代理指标就不再能真实反映内容质量,整个依赖代理指标来排序和推荐内容的信任基础就会动摇。
Q3: AI如何影响SEO和GEO的内容信任基础?
搜索引擎和AI搜索工具本质上依赖代理指标(学历、头衔、引用、链接等)来排序和推荐内容。文章指出,当AI让这些代理指标集体失效后,整个内容生态的信任基础就会动摇,这对做SEO和GEO的人来说是最直接的冲击——因为排序和推荐逻辑的根基被破坏了。